12月5日Spark社区直播【是时候改变你数仓的增量同步方案了】

议题:

是时候改变你数仓的增量同步方案了

直播间直达(回看)链接:

https://tianchi.aliyun.com/course/live?&liveId=41124

简介:

本分享会先介绍传统数据增量同步方案,之后对比新方案(完全基于Spark无需额外组件),介绍新方案如何结合最新的数据湖(delta lake)实现,同时引入spark-binlog,极大的简化了数据增量的门槛和架构。如果时间允许,我们也会简单介绍开源项目spark-binlog,delta-plus等的内部设计是如何支持我们新的数据增量方案的。

讲师:

祝威廉,资深数据架构,11年研发经验。同时维护和开发多个开源项目。擅长大数据/AI领域的一些思路和工具。现专注于构建集大数据和机器学习于一体的综合性平台,降低AI落地成本相关工作上。

时间:

2019年12月5日 19:30-20:30
请钉钉扫码至群内观看直播,与嘉宾互动有机会获得社区礼物一份。
12月5日Spark社区直播【是时候改变你数仓的增量同步方案了】

上一篇:检测获取访问这的一个QQ接口


下一篇:Linux日常运维(rsync通过服务连接,linux日志,screen)