后端岗位面试题更新 2026-08-05
请解释 Spark 中 shuffle read 数据量的含义及其对作业性能的影响。
哔哩哔哩后端开发性能优化技术原理Apache Spark
考察说明
考察对 Spark shuffle 阶段数据读取机制的理解
回答思路
- 说明 shuffle read 是下游任务从上游任务拉取的数据量
- 解释 shuffle read 涉及网络传输和磁盘读取
- 指出 shuffle read 过大可能导致 IO 压力和内存溢出
本题附完整参考答案与评分标准
登录后可查看结构化答题指导;也可以直接开一场模拟面试,AI 面试官用本题实时追问并给出评分。