后端岗位面试题更新 2026-08-05
在数据倾斜场景下,group by 操作如何进行优化?
京东后端开发电商性能优化技术原理问题排查Apache Spark
考察说明
考察对数据倾斜问题的识别能力及分布式聚合优化策略
回答思路
- 能说明数据倾斜的典型表现和根因(热点 key、分布不均)
- 能给出两阶段聚合(局部聚合加全局聚合)的核心思路
- 能讨论加盐、随机前缀、膨胀系数等具体手段及适用边界
- 能结合 Spark、Hive、MapReduce 等框架说明实现方式
- 能提及数据预处理、分桶或调整并行度等替代方案
本题附完整参考答案与评分标准
登录后可查看结构化答题指导;也可以直接开一场模拟面试,AI 面试官用本题实时追问并给出评分。