详解 Flink Table API 和 Flink SQL 之流处理中的表

文刀小桂2024-06-16 20:12

当流中有新数据到来，初始的表中会插入一行；而基于这个表定义的 SQL 查询，就应该在之前的基础上更新结果。这样得到的表就会不断地动态变化，被称为"动态表"（Dynamic Tables）
动态表是 Flink 在 T able API 和 SQL 中的核心概念，它为流数据处理提供了表和 SQL 支持。关系型表一般用来做批处理，面向的是固定的数据集，可以认为是"静态表"；而动态表则完全不同，它里面的数据会随时间变化

动态表可以像静态的批处理表一样进行查询操作。由于数据在不断变化，因此基于它定义的 SQL 查询也不可能执行一次就得到最终结果，所以对动态表的查询就永远不会停止，一直在随着新数据的到来而继续执行。这样的查询就被称作"持续查询"（Continuous Query）
动态表查询的处理过程：
- 流（stream）被转换为动态表（dynamic table）
- 对动态表进行持续查询（continuous query），生成新的动态表
- 生成的动态表被转换成流