论文研究普通
Qwen3.8-27B 聊天模板影响推理分数
原始标题:Chat models commonly include a chat template that formats messages and can add instructions before they reach the model.
内容摘要
ARC Prize 通过 Baseten 测试 Qwen3.8-27B,发现其自带聊天模板会按推理档位注入不同指令:low 要求思考简短聚焦,xhigh 要求仔细思考、检查假设并考虑替代方案,medium 则不加任何指令。这可能解释了 medium 档得分偏低——这些设置改变的是模型解题的指令方式,而非单纯扩大思考预算。
内容分类AI 论文与研究
内容层级普通情报
发布时间(北京时间)
本站收录时间(北京时间)
信息来源X:ARC Prize (@arcprize)
站内情报编号intel-3a9d08af5cbed7a6d5035816