logo
publist
写文章

简介

该用户还未填写简介

擅长的技术栈

可提供的服务

暂无可提供的服务

coalesce分区数过小导致 Lost executor

由于之前一套spark代码没有合并小文件,被运维警告说小文件数超过了二十万,遂在落表时重分区,因为实际落表数据最大的只有几十MB,全都改成coalesce(1),最近由于业务发展,数据量翻倍,有一个逻辑一直执行不过,报如下错误ERROR YarnScheduler: Lost executorCaused by: org.apache.spark.SparkException: Job abort

#spark#big data#hadoop
到底了