模型发布 / 更新普通
GPT-6 Astra 基准测试对比 GPT-5.6 Sol 与 Claude Fable 5.1,ARC-AGI-3 从 7.8% 升至 98.6%
原始标题:You can quote me on this: OpenAI crushed Anthropic's IPO. They put the newly released, state-of-the…
内容摘要
作者转发一张完整基准对比表,称 OpenAI 新发布的 GPT-6 Astra 在多项评测上明显领先。ARC-AGI-3 从 GPT-5.6 Sol 的 7.8% 升至 98.6%,FrontierMath Tier 4 (v2) 为 97.6%,SRE-Bench 为 99.2%,ExploitBench 为 100.0%;作者称其压过了新发布的 Claude Fable 5.1。
内容分类AI 模型发布与更新
内容层级普通情报
发布时间(北京时间)
本站收录时间(北京时间)
信息来源X:Kim (@kimmonismus)
站内情报编号intel-6e4628442fd8e661bed6949c