AI圈报
模型发布 / 更新普通

Grok 4.7 推理 token 用量与 ARC-AGI-2 得分相关

信息来源:X:ARC Prize (@arcprize)·
原始标题:@SpaceXAI Grok 4.7's reasoning-token usage correlates with its ARC-AGI-2 public score: low averaged 10k tokens per test-pair attempt and ...

内容摘要

@SpaceXAI Grok 4.7 的推理 token 用量与其 ARC-AGI-2 公开得分相关:low 档平均每次测试对尝试用 10k token,得分 25%;而 medium 到 xhigh 档用 86k 到 120k token,得分 57.5% 到 60%。low 档更低的 token 用量可能有助于解释其更低的得分。
内容层级普通情报
发布时间(北京时间)
本站收录时间(北京时间)
信息来源X:ARC Prize (@arcprize)
站内情报编号intel-c0efbc6a866e2244e28f05e4