VIPSpark
Spark数据本地性有哪些级别?为什么能优化性能
先抓住题目的核心考点,再把答案拆成可复述的面试表达。
28 次浏览2026/7/9
先下定义一句话说清它是什么,面试官先听到结论。
再讲机制拆出关键流程、边界条件和常见坑位。
最后落场景结合生产经验,说出什么时候用、怎么权衡。
题目描述
请回答:Spark数据本地性有哪些级别?为什么能优化性能
这是 Spark 调度调优里经常被追问的一题。面试官不是想听你背“PROCESS_LOCAL、NODE_LOCAL、RACK_LOCAL、ANY”,而是想看你能不能说清楚:Spark 为什么要等本地性、每个级别到底读哪里、为什么不能无限等、本地性差怎么排查,以及它和缓存、HDFS、Shuffle有什么关系。
评论
加载中...