论文研究普通
普渡大学论文提出 NPO:单条提示词加教师反馈可匹敌 GEPA 的复杂搜索
原始标题:Prompt optimization may not need a search tree at all. It may depend more on the quality of the tea…
内容摘要
普渡大学论文提出 Naive Prompt Optimization(NPO),只保留一条提示词谱系,由教师模型根据近期 rollout 轨迹和奖励迭代修改。在 IFBench 和 HotpotQA 上,NPO 以更少的 rollout 达到与基于 Pareto 选择维护多候选的 GEPA 相当或更好的结果:3,500 vs 3,593 和 6,800 vs 6,871。
内容分类AI 论文与研究
内容层级普通情报
发布时间(北京时间)
本站收录时间(北京时间)
信息来源X:Rohan Paul (@rohanpaul_ai)
站内情报编号intel-3df20c061d1d34e3e084ec57