后端岗位面试题更新 2026-08-05

请解释 Spark 中 shuffle read 数据量的含义及其对作业性能的影响。

哔哩哔哩后端开发性能优化技术原理Apache Spark

考察说明

考察对 Spark shuffle 阶段数据读取机制的理解

回答思路

  1. 说明 shuffle read 是下游任务从上游任务拉取的数据量
  2. 解释 shuffle read 涉及网络传输和磁盘读取
  3. 指出 shuffle read 过大可能导致 IO 压力和内存溢出
本题已收录答题指导

本题附完整参考答案与评分标准

登录后可查看结构化答题指导;也可以直接开一场模拟面试,AI 面试官用本题实时追问并给出评分。