当论文精读2025年2月14日论文精读当 LLM 遇见 RL:大模型如何增强强化学习综述将 LLM 在强化学习中的角色分为信息处理器、奖励设计者、决策者与生成器四类,并讨论样本效率与奖励设计的挑战及机器人/自动驾驶前景。