





































阿里巴巴技术专家宋军分享了题为《SparkSQL在ETL中的应用》的演讲。宋军表示,ETL主要有三个步骤:抽取、转换、加载。首先读取数据源,做清洗加工,整合处理,最终把这些数据存储到目标存储里,对ETL要求满足简单易用、支持多种数据源、支持容错处理、丰富的算子、复杂数据类型、计算快等多个因素。如何实现以上目标,宋军从DataSource、丰富的算子 、Hive兼容、性能、云上ETL 五个方面作出解读。
浏览3232次
浏览2565次
浏览5963次
浏览1538次
浏览5092次
浏览6678次
2026-06-12 太原
2026-04-24 杭州
2026-12-18 北京
2026-04-10 上海
打开微信扫一扫,分享到朋友圈