【资料图】
DataX 是阿里巴巴集团内被广泛使用的离线数据同步工具/平台,实现包括 MySQL、Oracle、SqlServer、Postgre、HDFS、Hive、ADS、HBase、TableStore(OTS)、MaxCompute(ODPS)、DRDS 等各种异构数据源之间高效的数据同步功能。
为了解决异构数据源同步问题,DataX将复杂的网状的同步链路变成了星型数据链路,DataX作为中间传输载体负责连接各种数据源。当需要接入一个新的数据源的时候,只需要将此数据源对接到DataX,便能跟已有的数据源做到无缝数据同步。
DataX在阿里巴巴集团内被广泛使用,承担了所有大数据的离线同步业务,并已持续稳定运行了6年之久。目前每天完成同步8w多道作业,每日传输数据量超过300TB。
DataX目前没有单独的官网,DataX的GitHub地址:
https://github.com/alibaba/DataX
DataX本身作为离线数据同步框架,采用Framework + plugin架构构建。将数据源读取和写入抽象成为Reader/Writer插件,纳入到整个同步框架中。
Reader:Reader为数据采集模块,负责采集数据源的数据,将数据发送给Framework。Writer: Writer为数据写入模块,负责不断向Framework取数据,并将数据写入到目的端。Framework:Framework用于连接reader和writer,作为两者的数据传输通道,并处理缓冲,流控,并发,数据转换等核心技术问题。经过几年积累,DataX目前已经有了比较全面的插件体系,主流的RDBMS数据库、NOSQL、大数据计算系统都已经接入。DataX Framework提供了简单的接口与插件交互,提供简单的插件接入机制,只需要任意加上一种插件,就能无缝对接其他数据源。
DataX目前支持数据如下:
以上插件参照地址:
https://github.com/alibaba/DataX/blob/master/introduction.md
今天诺基亚新机发布,该机型号为诺基亚G22,与著名维修机构iFixit合作,推出了一系列维修工具,用户甚至可以自行尝试修理手机。搭载6 52英寸HD
洛阳市新型冠状病毒肺炎疫情:2月26日洛阳市疫情最新消息今天数据统计情况通报,截至2月26日17时30分洛阳市疫情数据统
其实,朋友之间,越简单越好,为人处事也是一样,有事就联系,没事各忙各的。我给焦总电话,说:“一个朋友在你那儿预定了一套房子,能不能优
1、乐蜂成立于2008年8月,由知名电视人李静创办,是以提供“亿万中国女性优质生活的首选入口”为目标,中国第一个拥有专家
1、RyanConner,1971年2月12日出生于美国加州,身高170cm,三围42D-34-44,1999年出道,2
X 关闭
X 关闭