AI圈报
论文研究普通

Pareto 26.9 混合模型智能体评测并列第一

信息来源:X:Elvis Saravia (@omarsar0, DAIR.AI)·
原始标题:Interesting results here. This is why I expect more agent workloads to run on blended models. Paret…

内容摘要

Pareto 26.9 通过将请求分发至多个前沿与开源模型并保留最佳答案,在 30 项智能体任务评测中与 GPT-6 Astra 并列第一,每成功任务成本约为后者 1/3,且完成任务速度快于 DeepSeek V4 Pro 和 GLM 5.3 Flash。同一评测中,GPT-6 Sol 得分追平 Opus 5.5,速度更快,每成功任务成本约为其 1/4。
内容分类AI 论文与研究
内容层级普通情报
发布时间(北京时间)
本站收录时间(北京时间)
信息来源X:Elvis Saravia (@omarsar0, DAIR.AI)
站内情报编号intel-ddb5d339711de18117b22359