论文研究普通
ScienceBuddy:面向交互式科学智能体的递归嵌套式自我改进
原始标题:ScienceBuddy: Recursive-in-Recursive Self-Improvement for Interactive Scientific Agents
内容摘要
研究团队发布交互式科研工作台 ScienceBuddy,其核心是递归嵌套式自我改进范式,将 harness 进化与模型强化学习耦合:内层在模型固定时改进 harness,外层在改进后的 harness 下训练模型。该工作台把研究者的请求、反馈与执行证据转化为持续学习的任务和评估标准,基准案例覆盖四类科学任务。ScienceBuddy 已作为研究产品开放给科学社区。
内容分类AI 论文与研究
内容层级普通情报
发布时间(北京时间)
本站收录时间(北京时间)
信息来源HuggingFace Daily Papers(社区热门论文)
站内情报编号intel-139f677567a8c20c4b891275