人工智能面试题 · tech:apache-spark
人工智能相关岗位面试题。
共 11389 道真题 · 当前筛选命中 8 道 · 更新 2026-08-05
筛选题目已选:tech:apache-spark
考察点
技术栈
第 1 题Spark的宽依赖和窄依赖是什么? 考察对Spark作业调度核心概念的理解与区别应用第 2 题超大规模聚类怎么选取类别? 考察超大规模数据场景下选择聚类类别数(k值)的方法与权衡第 3 题如何结合 Spark 和 Flink 设计定时任务? 考察对流批调度、定时触发和框架特点的综合运用第 4 题有遇到大规模数据处理的情况吗?用过 Spark 吗? 考察大规模数据处理经验与 Spark 实际使用能力第 5 题union算子为什么依赖了多个分区,但仍然是窄依赖? 考察对Spark窄宽依赖本质的理解,以及union操作的依赖特性第 6 题在 Spark 中执行 join 时,如果两个表一大一小,如何实现高效 join? 考察对大表小表 join 优化策略的掌握程度第 7 题请讲讲你对 Spark 的了解,包括架构、核心组件和适用场景。 考察对 Spark 的核心原理和基础认知第 8 题请谈谈你对大数据生态中Spark和Hadoop的了解,以及它们各自的作用和关系。 考察大数据基础认知、技术选型与生态理解