京东面试题 · Apache Hive
京东相关面试题,按最终去重题目聚合。
共 2550 道真题 · 当前筛选命中 13 道 · 更新 2026-08-05
筛选题目已选:Apache Hive
考察点
技术栈
第 1 题请解释Hive中内部表与外部表的区别,并说明各自的使用场景。 考察对Hive表类型差异的理解及场景化应用能力第 2 题请说明Hive支持哪些常见存储格式,并简述各自的适用场景。 考察对Hive存储格式的掌握及选型能力第 3 题请说明什么是数据倾斜,并给出常见解决方法。 考察对MapReduce/Hive中数据分布不均问题的识别与调优能力第 4 题请介绍Hive的组成架构。 考察对Hive核心组件及数据流转机制的理解第 5 题Hive 中,建的表为压缩表,但输入文件为非压缩格式,会产生怎样的现象或结果? 考察对 Hive 表存储格式与文件压缩配置之间关系的理解第 6 题Spark和Hive的区别是什么? 考察对Spark与Hive在架构、计算模型和适用场景上的理解第 7 题请设计一个Hive表结构用于存储样例日志,并写出导入与聚合计算的SQL过程。日志格式为:pin|-|requesttm|-|url|-|skuid|-|amount,分隔符为"-|",数据样例:张三-|2013-11-23 11:59:30-|www.jd.com-|100023-|110.15。假设数据文件为sample.txt,导入到Hive的test库的tsample表,然后计算每个用户(pin)的总消费金额。 考察Hive建表、数据导入和聚合查询能力第 8 题什么是数据倾斜?如何解决? 考察对分布式计算中数据分布不均问题的理解及应对策略第 9 题HDFS和Hive的区别是什么? 考察对分布式存储与数据仓库工具的定位、功能与关系理解第 10 题在大数据处理中,数据倾斜是如何产生的,有哪些常见的解决思路? 考察对数据倾斜问题的识别、原因分析和解决策略第 11 题已知表 a 是一张内部表,如何将它转换成外部表?请写出相应的 Hive 语句。 考察 Hive 内部表与外部表的区别及表属性修改能力第 12 题请分析数据倾斜的常见成因,并说明有哪些解决方案。 考察对分布式数据处理中数据倾斜问题的理解深度与解决能力第 13 题请描述Hive中一条SQL语句从提交到执行的完整流程,并说明其底层MapReduce任务的执行过程。 考察对Hive架构和MapReduce执行机制的理解深度