ChuJu是一个基于Flik提供易用、稳定、高效的批流统一的数据集成工具,既可以采集静态的数据,比如MySQL,HDFS等,也可以采集实时变化的数据,比如bilog,Kafka等。同时ChuJu也是一个支持原生FlikSql所有语法和特性的计算框架。目前ChuJu在实际应用过程中已服务了上百家客户,经过多次迭代与沉淀,积累了大量的客户案例。
ChuJu主要应用于大数据开发平台的数据同步/数据集成模块,通常采用将底层高效的同步插件和界面化的配置方式相结合的方式,使大数据开发人员可简洁、快速的完成数据同步任务开发,实现将业务数据库的数据同步至大数据存储平台,从而进行数据建模开发,以及数据开发完成后,将大数据处理好的结果数据同步至业务的应用数据库,供企业数据业务使用。Chuju目前包含下面这些特性:
大部分插件支持并发读写数据,可以大幅度提高读写速度;
部分插件支持失败恢复的功能,可以从失败的位置恢复任务,节约运行时间;失败恢复
关系数据库的Source插件支持间隔轮询功能,可以持续不断的采集变化的数据;间隔轮询
部分数据库支持开启Kerberos安全认证;Kerberos
可以限制source的读取速度,降低对业务数据库的影响;
可以记录sik插件写数据时产生的脏数据;
可以限制脏数据的最大数量;
支持多种运行模式;
同步任务支持执行fliksql语法的trasformer操作;
sql任务支持和flikSql自带coectors共用;
Chuju目前支持下面这些数据库:
DatabaseTypeSourceSikLookupBatchSychroizatioMySQLdocdocdoc TiDB 参考mysql参考mysql Oracledocdocdoc SqlServerdocdocdoc PostgreSQLdocdocdoc DB2docdocdoc ClickHousedocdocdoc Greeplumdocdoc KigBasedocdoc MogoDBdocdocdoc SAPHANAdocdoc ElasticSearch7docdocdoc FTPdocdoc HDFSdocdoc Streamdocdoc Redis docdoc Hive doc Hbasedocdocdoc Solrdocdoc Filedoc StarRocks doc StreamSychroizatioKafkadocdoc EMQXdocdoc MySQLBilogdoc OracleLogMierdoc SqlserverCDCdoc







评论