模型发布 / 更新精选
UK AISI 与 CAISI 联合评估 Kimi K3 网络安全能力,显著低于前沿模型但超过 GLM-5.2
原始标题:UK AISI / CAISI Preliminary Assessment of Kimi K3's Cyber Capabilities
内容摘要
UK AISI 与 CAISI 对 Moonshot AI 于 2026 年 7 月 16 日发布的 Kimi K3 进行联合网络安全能力评估。在 ExploitBench 上 Kimi K3 得分 32%,高于 GLM-5.2 的 24%,但未能在 41 个样本中实现任意代码执行(ACE),最前沿美国模型平均可达 20/41。
内容分类AI 模型发布与更新
内容层级精选情报
发布时间(北京时间)
本站收录时间(北京时间)
信息来源英国 AI Security Institute:Blog(网页)
站内情报编号intel-9a817d05b8bc828a2ba42186