从Hive迁移到SparkSQL有赞的大数据实践 上传者:温三人主 2021-02-01 12:31:19上传 PDF文件 390.57KB 热度 27次 有赞数据平台从2017年上半年开始,逐步使用SparkSQL替代Hive执行离线任务,目前 SparkSQL每天的运行作业数量5000个,占离线作业数目的55%,消耗的cpu资源占集群总资源的 50%左右。本文介绍由SparkSQL替换Hive过程中碰到的问题以及处理经验和优化建议,包括以下方面的内容:有赞数据平台的整体架构。 下载地址 用户评论 更多下载 下载地址 立即下载 用户评论 发表评论