人工智能面试题更新 2026-08-05

假设强化学习结合大模型,如何解决动作空间维度大的问题?

中兴通讯人工智能电子/半导体问题拆解系统设计技术原理LLM

考察说明

考察结合大模型进行强化学习时对高维动作空间的建模与降维策略

回答思路

  1. 能解释高维动作空间带来的稀疏奖励与探索困难
  2. 能提出动作抽象、分层或参数化降维方案
  3. 能结合大模型讨论动作生成、约束或表征学习
  4. 能提及具体方法如动作表征、Actor 输出压缩或课程学习