MySQL输入基于Binlog实时订阅的方式,实时读取您配置的MySQL数据库表数据。本文为您介绍,如何配置MySQL输入,以及配置输入之前需要准备的网络环境及账号权限。

前提条件

配置MySQL输入之前,请确保已完成以下规划与准备工作。
  • 准备数据源:已购买来源数据源MySQL。
  • 资源规划与准备:已购买独享数据集成资源组,并完成资源配置。详情可参见资源规划与配置
  • 网络环境评估与规划:新增数据源之前,您需根据业务情况,打通数据源、独享数据集成资源组之间的网络,并进行交换机、白名单等网络环境下的访问配置。
    • 如果数据源和独享数据集成资源组均处于同地域的同一VPC网络中,数据源与资源组间的网络天然联通。
    • 如果数据源和独享数据集成资源组均处于不同的网络环境中,您需要通过VPN网关等方式,将数据源与资源组间的网络打通。
    详情请参见配置白名单
  • 查看当前使用的数据库版本是否为MySQL5.x8.x版本。您可以通过如下语句查看。
    select version();
    说明 DataWorks的数据集成实时同步MySQL数据是基于实时订阅MySQL实现的,实时同步MySQL数据目前仅支持配置MySQL数据源为RDS的5.x8.x版本的MySQL,不支持配置为DRDS的MySQL。如果当前使用的数据库版本不是RDS的5.x8.x版本的MySQL,请更换为使用RDS的5.x8.x版本的MySQL,否则会导致数据集成任务无法执行。
  • 准备账号并授权:

    您需要规划一个可访问数据源的账号,用于后续数据集成过程中访问数据源并进行数据提取、写入的同步操作。

    详情请参见创建账号并配置账号权限
  • 开启MySQL:仅实时同步数据时需要开启MySQL。实时同步数据详细介绍请参见实时同步概述

    来源数据源为MySQL时,您需要开启Binlog。Binlog是记录所有数据库表结构变更(例如执行CREATE、ALTER操作)以及表数据修改(例如执行INSERT、UPDATE、DELETE等)的日志。方便您可以通过Binlog日志中的内容,查看数据库的变更历史、进行数据库增量备份和恢复以及主从数据库的复制。

    Binlog日志的格式如下:
    • Statement:基于SQL语句的复制。Binlog中会保存每条修改数据的SQL语句。
    • Row:基于行的复制。Binlog中不保存SQL语句上下文的相关信息,仅保存被修改的记录。
    • Mixed:混合模式复制。Statement与Row的结合,一般的语句修改使用Statment格式(例如函数),Statement无法完成复制的操作,则采用Row格式保存Binlog。MySQL会根据执行的每条SQL语句自主识别使用哪种格式。
    详情请参见开启MySQL的Binlog

使用限制

  • 数据集成不支持同步MySQL只读库实例的数据。
  • DataWorks的数据集成实时同步MySQL数据是基于实时订阅MySQL实现的,实时同步MySQL数据目前仅支持配置MySQL数据源为RDS的5.x8.x版本的MySQL,不支持配置为DRDS的MySQL。

配置MySQL输入

  1. 进入数据开发页面。
    1. 登录DataWorks控制台
    2. 在左侧导航栏,单击工作空间列表
    3. 选择工作空间所在地域后,单击相应工作空间后的进入数据开发
  2. 鼠标悬停至新建图标,单击数据集成 > 实时同步
    您也可以展开目标业务流程,右键单击数据集成,选择新建 > 实时同步
  3. 新建节点对话框中,选择同步方式为单表(Topic)到单表(Topic)ETL,输入节点名称,并选择目标文件夹
    注意 节点名称必须是大小写字母、中文、数字、下划线(_)以及英文句号(.),且不能超过128个字符。
  4. 单击提交
  5. 在实时同步节点的编辑页面,单击输入 > MySQL并拖拽至编辑面板。
  6. 单击MySQL节点,在节点配置对话框中,配置各项参数。
    输入
    参数 描述