flink kafka sink (scala)

将对象数据通过Gson 转为jsonString,在将数据写到kafka中,这个可以根据需要修改,比如按照\t分开也行,可以节省字段名称的空间。

这里还有一个问题,就是每来一条数据都需要new Gson 对象,有没有办法减少创建呢

我们知道job 和task之间是不能够传输序列化的对象的。

那么如果需要减少Gson的创建,可以自定义map函数,继承并实现RichMapFunction中的方法,其中open就可以只创建一次Gson。

data.map(new Gson().toJson(_))

.addSink(new FlinkKafkaProducerString("topicName", new SimpleStringSchema(), props, Optional.ofNullableFlinkKafkaPartitioner\[String](null)))

.uid("write-to-kafka")

.name("write-to-kafka")

自定义map:

private class DemoMap extends RichMapFunctionData, String {

var gson:Gson=_

override def open(parameters: Configuration): Unit = {

gson=new Gson()

}

override def map(value: Data): String = {

gson.toJson(value)

}

override def close(): Unit = {

}

}

相关推荐
Devin~Y29 分钟前
抖音级短视频推荐与直播带货平台面试实战:从 Java 微服务到 RAG 智能客服全链路解析
java·spring boot·redis·spring cloud·kafka·agent·rag
livemetee3 小时前
关于【Kafka高可用配置】
分布式·kafka
TTBIGDATA3 小时前
【Ambari Plus】11.Kafka 安装
大数据·hadoop·分布式·kafka·ambari·hdp·ambari plus
rebibabo18 小时前
Java基础(番外) | Kafka 入门:分区、副本与消费者组原理
java·分布式·kafka·学习笔记·副本·分区·异步日志
swg32132121 小时前
Kafka基于ZK和KRaft的设计原理与差异
分布式·kafka
董可伦1 天前
Flink CDC2Kafka 总结
大数据·flink·cdc
大大大大晴天2 天前
Flink JDBC Connector 深度解析:从原理到最佳实践
flink
一条鱼丶3 天前
深入理解 Flink Watermark——流数据处理中的乱序问题解决方案
flink
大大大大晴天3 天前
Flink SQL 从编写到提交运行的全过程解析
flink
大大大大晴天5 天前
Flinksql内置函数不够用?一文弄懂UDF
flink