社区
徐葳的课程社区_NO_1
流式数据湖新秀-Apache Paimon
帖子详情
在Flink SQL代码中操作Paimon
大数据徐葳
2023-11-04 18:02:02
课时名称
课时知识点
在Flink SQL代码中操作Paimon
在Flink SQL代码中演示如何读写Paimon表
...全文
87
回复
打赏
收藏
在Flink SQL代码中操作Paimon
课时名称课时知识点在Flink SQL代码中操作Paimon在Flink SQL代码中演示如何读写Paimon表
复制链接
扫一扫
分享
举报
写回复
配置赞助广告
用AI写文章
回复
切换为时间正序
请发表友善的回复…
发表回复
打赏红包
2 快速上手使用
Paimon
数据湖
想要使用
Paimon
是非常简单的,不需要复杂的安装部署,只需要使用一个jar包即可对它进行
操作
。目前
Paimon
主要提供的是
SQL
层面的API,所以我们在使用
Flink
操作
Paimon
的时候需要用到
Flink
SQL
。
3
Paimon
数据湖
中
的表类型详解_
paimon
表和hive区别
-- /*+ OPTIONS(‘scan.mode’=‘from-snapshot’,‘scan.snapshot-id’ = ‘1’) */ – 通过动态表选项来指定数据读取(扫描)模式,以及从哪里开始读取。|-- /*+ OPTIONS(‘scan.mode’=‘from-snapshot’,‘scan.snapshot-id’ = ‘1’) */ – 通过动态表选项来指定数据读取(扫描)模式,以及从哪里开始读取。
Paimon
——官网阅读:
Flink
引擎
Paimon
——官网阅读:
Flink
引擎
Paimon
集成
Flink
CDC (二) Kafka
Flink
提供了几种KafkaCDC格式:canal-json、debezium-json、ogg-json、maxwell-json。如果Kafka主题
中
的消息是使用更改数据捕获(CDC)工具从另一个数据库捕获的更改事件,则可以使用
Paimon
的KafkaCDC。将解析后的INSERT、UPDATE、DELETE消息写入到
paimon
表
中
。
揭秘
Paimon
如何无缝集成
Flink
Paimon
通过实现
Flink
的标准连接器接口(如CatalogFactory、DynamicTableSource/SinkFactory)无缝集成到
Flink
生态
中
。其核心机制包括:1)利用Java SPI实现自动发现,通过META-INF/services声明工厂类;2)
Flink
Catalog作为适配器桥接
Flink
与
Paimon
的元数据
操作
;3)
Flink
TableFactory创建包含
Paimon
特有Writer/Committer算子的Source/Sink。
徐葳的课程社区_NO_1
1
社区成员
86
社区内容
发帖
与我相关
我的任务
徐葳的课程社区_NO_1
大数据技术博客
复制链接
扫一扫
分享
社区描述
大数据技术博客
社区管理员
加入社区
获取链接或二维码
近7日
近30日
至今
加载中
查看更多榜单
社区公告
暂无公告
试试用AI创作助手写篇文章吧
+ 用AI写文章