模型架构选型:在生成式大模型(如LLaMA、GPT)中,为何通常采用Decoder-only架构而非Encoder-Decoder结构?
考察说明
考察对生成式大模型架构选型原因的理解,包括训练目标、效率、一致性和扩展性
回答思路
- 解释Decoder-only与Encoder-Decoder在结构上的核心差异
- 说明自回归语言建模目标与Decoder-only的适配性
- 对比训练效率、推理延迟和资源开销
- 讨论统一架构对规模化扩展和生态一致性的好处
本题已收录答题指导
本题附完整参考答案与评分标准
登录后可查看结构化答题指导;也可以直接开一场模拟面试,AI 面试官用本题实时追问并给出评分。