flink kafka sink (scala)

将对象数据通过Gson 转为jsonString,在将数据写到kafka中,这个可以根据需要修改,比如按照\t分开也行,可以节省字段名称的空间。

这里还有一个问题,就是每来一条数据都需要new Gson 对象,有没有办法减少创建呢

我们知道job 和task之间是不能够传输序列化的对象的。

那么如果需要减少Gson的创建,可以自定义map函数,继承并实现RichMapFunction中的方法,其中open就可以只创建一次Gson。

data.map(new Gson().toJson(_))

.addSink(new FlinkKafkaProducerString("topicName", new SimpleStringSchema(), props, Optional.ofNullableFlinkKafkaPartitioner\[String](null)))

.uid("write-to-kafka")

.name("write-to-kafka")

自定义map:

private class DemoMap extends RichMapFunctionData, String {

var gson:Gson=_

override def open(parameters: Configuration): Unit = {

gson=new Gson()

}

override def map(value: Data): String = {

gson.toJson(value)

}

override def close(): Unit = {

}

}

相关推荐
OceanBase数据库官方博客3 天前
OceanBase + Flink 数据集成(第二部分):通过 JDBC 协议实现实时数据同步
大数据·flink·oceanbase
Volunteer Technology3 天前
Flink Table API与SQL(一)
大数据·sql·flink
大大大大晴天️3 天前
Flink Connector Formats深度解析:从原理到实践
大数据·flink
大大大大晴天3 天前
Flink Connector Formats深度解析:从原理到实践
flink
whaledown3 天前
Kafka 与 Java 消息队列入门:用订单场景理解核心机制
java·kafka·消息队列·springboot
Volunteer Technology3 天前
Flink Table API与SQL(二)
大数据·数据库·flink
guslegend3 天前
第1章:初始Kafka
分布式·kafka
Devin~Y3 天前
大厂 Java 面试实录:从音视频内容社区到 AI RAG 的全链路技术设计
java·spring boot·redis·spring cloud·微服务·kafka·音视频
Justice Young3 天前
Flink第六章:flink中的时间和窗口
大数据·flink
Volunteer Technology4 天前
Flink状态管理与容错(一)
大数据·数据库·flink