MiniMax面试题更新 2026-08-05
讲一下大模型训练和推理的流程,SFT和RLHF的作用分别是什么?
腾讯MiniMax人工智能互联网/IT问题拆解技术原理LLM
考察说明
考察对大模型训练推理链路及对齐方法(SFT、RLHF)的理解
回答思路
- 清晰描述预训练、SFT、RLHF的流程与定位
- 说明推理阶段的前向计算与采样生成
- 对比SFT与RLHF的目标、数据、训练方式
- 指出RLHF中奖励模型与PPO的作用
本题附完整参考答案与评分标准
登录后可查看结构化答题指导;也可以直接开一场模拟面试,AI 面试官用本题实时追问并给出评分。