后端岗位面试题更新 2026-08-05

在数据倾斜场景下,group by 操作如何进行优化?

京东后端开发电商性能优化技术原理问题排查Apache Spark

考察说明

考察对数据倾斜问题的识别能力及分布式聚合优化策略

回答思路

  1. 能说明数据倾斜的典型表现和根因(热点 key、分布不均)
  2. 能给出两阶段聚合(局部聚合加全局聚合)的核心思路
  3. 能讨论加盐、随机前缀、膨胀系数等具体手段及适用边界
  4. 能结合 Spark、Hive、MapReduce 等框架说明实现方式
  5. 能提及数据预处理、分桶或调整并行度等替代方案
本题已收录答题指导

本题附完整参考答案与评分标准

登录后可查看结构化答题指导;也可以直接开一场模拟面试,AI 面试官用本题实时追问并给出评分。