AI圈报
论文研究精选

Dan Hendrycks 发布对比 Claude Opus 4.5 与 Gemini 3 的多维能力评测

信息来源:X:Dan Hendrycks (@hendrycks)·
原始标题:How does Claude Opus 4.5 compare to Gemini 3?

内容摘要

AI 安全研究者 Dan Hendrycks 在 X 上发布对 Claude Opus 4.5 与 Google Gemini 3 的横向评测,包含文本、视觉与安全三个维度的指数得分。结果显示:在控制推理令牌数后,两者文本能力相当;Gemini 3 在图像/视觉任务上显著领先;而 Opus 在对抗性测试(如越狱、诚实性)中表现更优。图表显示了 7 模型的文本能力(Gemini 3 Pro 47.6 领先)、视觉能力(Gemini 3 Pro 57.1 最高)及安全指数(Opus 33.6 最低,即最安全)。
内容分类AI 论文与研究
内容层级精选情报
发布时间(北京时间)
本站收录时间(北京时间)
信息来源X:Dan Hendrycks (@hendrycks)
站内情报编号intel-11278174dfe72cb00e477afe