AI圈报
论文研究普通

RRSI:面向 Agent Harness 的正则化递归自我改进

信息来源:HuggingFace Daily Papers(社区热门论文)·
原始标题:RRSI: Regularized Recursive Self-Improvement of Agent Harnesses

内容摘要

针对 Agent Harness 递归自我改进容易过拟合训练任务、在分布外基准上收益消失的问题,研究者提出 RRSI,通过时间退火预算约束候选编辑数量、用 critic 过滤基准特定提案、用 pruner 剔除过小或过贵改动。
内容分类AI 论文与研究
内容层级普通情报
发布时间(北京时间)
本站收录时间(北京时间)
信息来源HuggingFace Daily Papers(社区热门论文)
站内情报编号intel-29e9fee174b348e23cbe9995