AI圈报
论文研究普通

Rubric-to-Code Credit Assignment:面向强化学习的评分细则到代码信用分配框架

信息来源:HuggingFace Daily Papers(社区热门论文)·
原始标题:Rubric-to-Code Credit Assignment for Reinforcement Learning

内容摘要

研究提出 Rubric-to-Code Credit Assignment(RCCA),一种将评分细则级功能反馈转化为代码局部优化信号的强化学习框架,以改善交互式网页应用生成中的信用分配问题。
内容分类AI 论文与研究
内容层级普通情报
发布时间(北京时间)
本站收录时间(北京时间)
信息来源HuggingFace Daily Papers(社区热门论文)
站内情报编号intel-28b34459393e7ddac4ac8acc