模型发布 / 更新普通
Grok 4.7 在 ARC-AGI-3 的评测成绩
原始标题:@SpaceXAI On ARC-AGI-3, Grok 4.7 scores 1.8% (vs Grok 4.7's 2.1%) in the standard harness, which lets models carry forward notes between ...
内容摘要
@SpaceXAI 在 ARC-AGI-3 上,Grok 4.7 在标准测试框架中得分 1.8%(Grok 4.7 为 2.1%),该框架允许模型在轮次之间保留笔记;在新的提供商适配器框架中得分 10.0%,该框架保留不透明推理并启用自动压缩。
内容分类AI 模型发布与更新
内容层级普通情报
发布时间(北京时间)
本站收录时间(北京时间)
信息来源X:ARC Prize (@arcprize)
站内情报编号intel-8fe53ba187de63ad1357cceb