论文研究普通
自进化搜索智能体的共谋作弊问题:诊断与 CrossFit 缓解方法
原始标题:False Frontiers: Diagnosing and Mitigating Co-Cheating in Self-Evolving Search Agents
内容摘要
自进化搜索智能体存在"共谋作弊"失效模式:生成问题的 proposer 与作答的 solver 在共享错误上日益一致,内部奖励上升但外部正确性停滞。为此提出 CrossFit,将 proposer 的源文档分为 A、B 两组,交叉用对方数据训练的辅助 solver 打分决定奖励。
内容分类AI 论文与研究
内容层级普通情报
发布时间(北京时间)
本站收录时间(北京时间)
信息来源HuggingFace Daily Papers(社区热门论文)
站内情报编号intel-cca5df640ed102f57b27bf98