AI圈报
论文研究普通

Harness-Aware Distillation:让小语言模型智能体学会 harness 之外的能力

信息来源:HuggingFace Daily Papers(社区热门论文)·
原始标题:Harness-Aware Distillation for Small Language Model Agents

内容摘要

研究者提出 Harness-Aware Distillation(HAD),将蒸馏重点放在教师模型超出 harness 之外的能力上,而非模仿教师的完整输出。HAD 在 on-policy 蒸馏基础上加入动作偏好对比与有效性校验,无需任务奖励、成功标签或未来信息。
内容分类AI 论文与研究
内容层级普通情报
发布时间(北京时间)
本站收录时间(北京时间)
信息来源HuggingFace Daily Papers(社区热门论文)
站内情报编号intel-6dc43b35c79d41b8ef949a82