相信很多人对阿里开源的caal和apacheflume都不陌生。
flume-caal-source是对flume的source扩展。从caal获取数据到flumechael。进而可以实现bilog数据到kafka/hdfs/hive/elasticsearch等等。
如何使用部署caal、flume这里忽略。
配置flume配置source类型*
aget.sources = caalSourceaget.sources.caalSource.type = com.weiboyi.etl.flume.source.caal.CaalSource配置连接caal的三种方式*
caalzookeeperservers
aget.sources.caalSource.zkServers = zookeeper-host:2181caalserverurls
aget.sources.caalSource.serverUrls = caal-server1:111111,caal-server2:111111caalserverurls
aget.sources.caalSource.serverUrl = caal-server1:111111配置caaldestiatio*
aget.sources.caalSource.destiatio = example配置用户名密码
aget.sources.caalSource.userame = useraget.sources.caalSource.password = passwdbilogbatchsize,default1024
aget.sources.caalSource.batchSize = 1024是否需要MySQL修改前的数据,defaulttrue
aget.sources.caalSource.oldDataRequired = true






评论