Flink算子简单测试样例

Flink算子简单测试样例

1. 创建执行环境
c 复制代码
        // 创建执行环境
        StreamExecutionEnvironment env = StreamExecutionEnvironment.getExecutionEnvironment();
        env.setParallelism(1);

2. 创建数据流
c 复制代码
        // 创建数据流
        DataStream<String> source = env.addSource(new DataGeneratorSource<>(new DataGenerator<String>() {
            final int CNT = 10000; // 模拟一万条数
            int i = 0;

            @Override
            public void open(String s, FunctionInitializationContext functionInitializationContext, RuntimeContext runtimeContext) throws Exception {}

            @Override
            public boolean hasNext() {
                return i < CNT;
            }

            @Override
            public String next() {
                i++;
                try {
                    Thread.sleep(new Random().nextInt(2000)); // 随机发生时间
                } catch (InterruptedException e) {
                }
                return "" + i;
            }
        })).returns(String.class).uid("source").name("source");

3. 数据补充
c 复制代码
        // 数据补充-添加时间戳,增加金额
        SingleOutputStreamOperator<Map<String, String>> mapOperator = source.map((MapFunction<String, Map<String, String>>) s -> {
            HashMap<String, String> hashMap = new HashMap<>();
            hashMap.put("userid", s);
            hashMap.put("amt", new Random().nextInt(100) + "");
            hashMap.put("time", System.currentTimeMillis() + "");
            return hashMap;
        }).returns(TypeInformation.of(new TypeHint<Map<String, String>>() {
        })).uid("mapOperator").name("mapOperator");

4. 数据过滤
c 复制代码
        // 数据过滤-只取时间戳为偶数的数据
        SingleOutputStreamOperator<Map<String, String>> filterOperator = mapOperator.filter((FilterFunction<Map<String, String>>) data -> {
//                System.out.println("从mapOperator接到数据:" + data);
            long time = Long.parseLong(data.get("time"));
            return time % 2 == 0;
        }).returns(TypeInformation.of(new TypeHint<Map<String, String>>() {
        })).uid("filterOperator").name("filterOperator");

5. 数据放大
c 复制代码
        // 数据放大-时间戳是4的倍数,双倍奖励,8的倍数,三倍奖励
        SingleOutputStreamOperator<Map<String, String>> flatMapOperator = filterOperator.flatMap((FlatMapFunction<Map<String, String>, Map<String, String>>) (data, collector) -> {
            collector.collect(data);
            if (Long.parseLong(data.get("time")) % 4 == 0) {
                collector.collect(data);
            }
            if (Long.parseLong(data.get("time")) % 8 == 0) {
                collector.collect(data);
            }
        }).returns(TypeInformation.of(new TypeHint<Map<String, String>>() {
        })).uid("flatMapOperator").name("flatMapOperator");

6. 数据输出
c 复制代码
        // 数据输出
        flatMapOperator.print();

        // 执行程序
        env.execute("FlinkTest");

7. 执行结果
c 复制代码
{amt=45, time=1705048891056, userid=4}
{amt=45, time=1705048891056, userid=4}
{amt=45, time=1705048891056, userid=4}
{amt=56, time=1705048894374, userid=6}
{amt=96, time=1705048899462, userid=10}
{amt=65, time=1705048901638, userid=12}
{amt=33, time=1705048902544, userid=13}
{amt=33, time=1705048902544, userid=13}
{amt=33, time=1705048902544, userid=13}
{amt=10, time=1705048903748, userid=14}
{amt=10, time=1705048903748, userid=14}
...

Process finished with exit code 0
相关推荐
BYSJMG6 分钟前
计算机毕设选题:基于Python+MySQL校园美食推荐系统【源码+文档+调试】
大数据·开发语言·python·mysql·django·课程设计·美食
索迪迈科技1 小时前
Flink Task线程处理模型:Mailbox
java·大数据·开发语言·数据结构·算法·flink
深空数字孪生7 小时前
储能调峰新实践:智慧能源平台如何保障风电消纳与电网稳定?
大数据·人工智能·物联网
百胜软件@百胜软件7 小时前
胜券POS:打造智能移动终端,让零售智慧运营触手可及
大数据
摩羯座-185690305948 小时前
Python数据可视化基础:使用Matplotlib绘制图表
大数据·python·信息可视化·matplotlib
在未来等你8 小时前
Kafka面试精讲 Day 13:故障检测与自动恢复
大数据·分布式·面试·kafka·消息队列
jiedaodezhuti8 小时前
Flink通讯超时问题深度解析:Akka AskTimeoutException解决方案
大数据·flink
庄小焱8 小时前
大数据存储域——Kafka实战经验总结
大数据·kafka·大数据存储域
zskj_qcxjqr10 小时前
告别传统繁琐!七彩喜艾灸机器人:一键开启智能养生新时代
大数据·人工智能·科技·机器人
每日新鲜事11 小时前
Saucony索康尼推出全新 WOOOLLY 运动生活羊毛系列 生动无理由,从专业跑步延展运动生活的每一刻
大数据·人工智能