跳到内容
lllrobots鼓马 · 技术研究行业观察鼓马官网

逐篇研究阅读

MLREF:借助大语言模型实现强化学习奖励设计中的高效模块复用

发表日期待核实

本条只有题录,尚未完成分析。中文译名与技术分析分别验收;以下原文入口不代表已审阅。

原文与来源

MLREF: Efficient Module Reuse for Reward Design in Reinforcement Learning via Large Language Models

打开原始论文