论文研究普通
COBRA-Skills:用上下文赌博机引导智能体技能进化
原始标题:COBRA-Skills: Contextual Bandit-Guided Evolution for Agent Skill Optimization
内容摘要
COBRA-Skills 将 LLM 智能体技能优化建模为动态候选空间上的预算化序列优化,结合上下文赌博机优先级排序与基于执行证据的技能进化。在六个异构智能体基准和三个目标模型上,其平均性能优于对比方法,优化成本较 SkillOpt 降低 55-58%,每个基准仅用 50 个优化样本。该方法对智能体 harness 变化保持稳健,目标模型自身也可用于技能生成与精炼。
内容分类AI 论文与研究
内容层级普通情报
发布时间(北京时间)
本站收录时间(北京时间)
信息来源HuggingFace Daily Papers(社区热门论文)
站内情报编号intel-26ee4d67ead8fb71d40068f7