AI圈报
论文研究普通

Johns Hopkins 与 CMU 论文:小模型可从运行结果学会改进 Agent 的 harness 代码并迁移到新任务

信息来源:X:Rohan Paul (@rohanpaul_ai)·
原始标题:New John Hopkins and Carnegie Mellon University Paper Shows that a small model can learn to improve an agent's harness code from run resu...

内容摘要

Johns Hopkins 与 CMU 的论文提出 harness learning,训练一个小模型根据失败报告改写 Agent 的 harness 代码(即决定模型看到什么、调用哪些工具的部分),以新 harness 的得分作为奖励。
内容分类AI 论文与研究
内容层级普通情报
发布时间(北京时间)
本站收录时间(北京时间)
信息来源X:Rohan Paul (@rohanpaul_ai)
站内情报编号intel-fef12c1f85e4119763d106c3