AI 情报文章归档
浏览 AI圈报 已保存的 5702 条 AI 情报文章,覆盖模型、产品、行业、论文、教程与观点方法六大分类。
已收录文章5702
正式分类6
精选内容3361
全部文章
第 108 / 143 页 · 每页 40 条
教程 / 实战精选
我们如何对不同产品中的Claude进行隔离控制
Anthropic通过三重机制控制Claude智能体的部署风险,包括用户误用、模型异常行为和外部攻击。其防护策略聚焦于三个层面:通过沙箱、虚拟机和网络出口控制限制智能体运行环境;利用系统提示词和模型训练引导其行为;以及对MCP服务器、第三方插件等外部内容实施细粒度权限管理。文章以Claude Code、claude.ai和Claude Cowork为例,阐述了不同产品如何设计对应的隔离架构。
信息来源:Anthropic:Engineering(事故复盘 + 工程实践 · 网页) · Claude
产品发布 / 更新精选
MiMo-V2.5 系列 API 永久降价,最高降幅 99%
小米 MiMo-V2.5 系列 API 自北京时间 5 月 27 日 0 点起永久降价,相比原始定价最高降幅达 99%,且不再区分上下文窗口长度。Token Plan 计费体系同步优化,用量提升至原来的 5-8 倍,现有有效用户额度全量重置。降价背后是基于 SGLang HiCache 的 SWA 支持,将 KV Cache 数据搬运量降至优化前近 1/7,可缓存 token 数量提升近 5 倍。
信息来源:公众号:小米 MiMo
论文研究精选
SilverTorch:索引即模型--推荐系统的新检索范式
Meta 推出SilverTorch推荐系统架构,统一了用户生成内容的所有检索组件。该架构吞吐量比现有技术高23.7倍,计算成本效率比CPU方案高20.9倍,同时提升了准确性。
信息来源:Meta Engineering Blog(RSS)
观点 / 方法精选
AI智能体的零信任安全框架
Anthropic 发布了针对企业部署自主 AI 智能体的安全框架,指出前沿大语言模型正将漏洞利用周期从数月压缩至数小时。部署智能体面临双重风险:基础设施易受 AI 加速攻击,且智能体自身具备自主决策与执行能力。文章提出一个三层零信任架构(基础、高级、优化级)及八阶段实施流程,并概述了提示注入、工具投毒、记忆投毒等特有威胁。
信息来源:Claude:Blog(网页) · Claude
论文研究精选
通过零信任聚合实现的隐私分析
Google Research 推出了一种新的隐私分析解决方案。该方案结合了一种新的密码学安全聚合协议与可信执行环境(TEE)的透明性,旨在实现前沿的隐私与安全保证。其核心是基于零信任原则,通过密码学与硬件保护的结合,确保系统仅能获取群体的匿名化聚合洞察。
信息来源:Google Research:Blog(网页)
观点 / 方法精选
使用大语言模型保障源代码安全
本文分享了使用 Claude Opus 构建威胁模型、发现代码漏洞并进行验证、分类和修复的最佳实践。其核心流程是一个六步循环:威胁建模、沙箱隔离、漏洞发现、验证、分类和修复。作者指出,漏洞发现现在易于并行化,瓶颈已转移到后续的验证与处理阶段。以他们对开源软件的扫描为例,截至2026年5月22日已披露1,596个漏洞,其中97个已修补。指南建议结合代码库文档和专家访谈来构建准确的威胁模型,以降低误报,提升发现的可利用性。
信息来源:Claude:Blog(网页) · Claude
论文研究精选
塑造产业的物理AI研究
Mistral AI通过收购Emmi AI,强化其在推动AI研究前沿与工业工程解决方案方面的投入。其目标是为航空航天、汽车、半导体和能源等塑造物理世界的核心产业构建基础性物理AI模型,以加速工程开发。此项研究基于一系列已发表的突破性成果,包括:用于模拟超音速湍流的3D机翼CFD数据集、计算流体动力学基础模型的前瞻综述、应用于汽车与航空的AB-UPT模型,以及用于聚变等离子体湍流模拟的GyroSwin模型。此前已开源的UPT(通用物理Transformer)和NeuralDE…
信息来源:Mistral AI:News(网页) · Mistral
论文研究精选
社会科学中的编码智能体
一项针对1260名定量社会科学家的调查显示,虽然81%的受访者用过AI聊天机器人,但仅有20%将Claude Code、Codex等编码智能体常规应用于工作。采用率存在显著差异:以男性名字命名的研究者使用率是女性研究者的两倍;顶尖大学研究者可能性高出40%。用户产出更多工作论文和基金申请,但这可能反映早期采用者自身差异。研究者对AI助力撰写可发表论文更乐观,但对重塑整个社会科学领域持保留态度。这是一项初步调查,更深入研究仍在进行中。
信息来源:Anthropic:Research(发表成果 · 网页) · Claude
行业动态精选
Anthropic 开设米兰办公室,深化意大利企业合作与 AI 安全对话
Anthropic 在米兰开设其欧洲第六家办公室,旨在与意大利企业及开发者社区合作,负责任地构建和扩展 Claude,并参与关于 AI 的对话。本地团队已与多家金融、生命科学、能源及汽车行业的公司展开合作。案例包括与 JAKALA 合作将 Claude 部署至超 3,000 席位,释放约 70% 高级团队时间;Satispay 借此将 18 个月路线图压缩至 7 个月;Bending Spoons 的大部分代码变更已与 Claude Code 共同完成。Anthropic …
信息来源:Anthropic:Newsroom(网页) · Claude
产品发布 / 更新精选
MiniMax Agent Team:为长期运行与持续演进而生
MiniMax对其Agent Team进行了整体升级并更名为Mavis。本次更新的核心是推出Agent Teams功能,允许用户在MiniMax Agent桌面端并行运行多个不同角色的智能体,组成团队以协作处理单一智能体难以完成的复杂长时任务。同时,原有的TokenPlan与Agent Plan合并为统一订阅,整合了CLI、API及Agent对M2.7模型、音乐、视频和语音功能的访问,其信用额度可在智能体与API之间共享。此次升级旨在解决单智能体在执行长期任务时容易出现的停…
信息来源:MiniMax:Blog(网页)
产品发布 / 更新精选
Google Pay 最新更新
Google Pay 正向"智能体商务"演进,推出了通用商务协议和新的 MCP 服务器,允许 AI 智能体管理集成与分析趋势。Android 平台更新引入了动态回调以支持快速结账,并通过 WebView 将支付功能扩展至社交媒体应用。此外,平台还推出了跨设备生物认证和新的交易信号,旨在帮助商家减少流程摩擦。
信息来源:Google Developers Blog(RSS)
观点 / 方法精选
未来展望:2026年5月的一些想法
文章展望了截至2026年5月AI领域的动态。内容涉及 Gemini Flash 3.5 的发布、名为 Mythos 的新产品或项目、开源与闭源生态平衡(open-closed balance)的讨论、美国开源力量的显著增长(America's open-source surge),以及由此引发的新兴权力博弈(emerging power struggles)。
信息来源:Nathan Lambert:Interconnects(RSS) · Gemini
论文研究精选
KPop 新方法让 Ring-2.6-1T 在 SWE-bench Verified 上突破 76 分
团队推出 KPop,用于稳定大规模 MoE 模型的智能体强化学习训练。它用基于二元 KL 散度的自适应掩码机制,替代了此前 IcePop 方法中的固定比例掩码,能根据训练过程中的训练-推理不匹配程度动态调整。这一改进使得 Ring-2.6-1T 模型在无需修改基础设施或路由重放的情况下,仅通过纯 RL 训练,在 SWE-bench Verified 上取得了超过 76 分的成绩。
信息来源:X:蚂蚁百灵 (@AntLingAGI)
产品发布 / 更新精选
开源多模态模型SenseNova-U1完整训练代码库
商汤开源了SenseNova-U1(8B dense + A3B MoE)的完整训练代码库。这是一个统一的框架,支持文本到图像、图像编辑、交错生成、文本与视觉理解等多种多模态任务的训练。其设计注重实用性与大规模训练,采用混合并行、流式可恢复数据管道、环境变量配置、解耦模块化设计,并支持从1×8 GPU扩展到多节点集群的规模。代码库以Apache-2.0协议开源。
信息来源:X:商汤 SenseTime (@SenseTime_AI)
观点 / 方法精选
Project Luxo:跨越AI媒体的恐怖谷
Runway通过Project Luxo研究发现,AI生成视频已跨越"恐怖谷"。他们向创意生态从业者展示了《The Rogue》等AI短片及广告样片,评估显示观众开始关注故事本身,而非技术瑕疵。所有作品均由单人团队制作,耗时从3周到4小时不等。Runway认为,这标志着AI媒体成熟--当技术足够好以至于"隐形",观众沉浸于故事时,便实现了这一跨越。
信息来源:Runway:News(网页)
行业动态精选
OpenRouter完成1.13亿美元B轮融资
今天我们宣布完成由@CapitalGVC领投的1.13亿美元B轮融资。 过去6个月,随着AI从实验快速转向生产,OpenRouter的周处理量从5万亿增长到25万亿token。 我们对未来充满期待。
信息来源:X:OpenRouter (@OpenRouter)
观点 / 方法精选
Sundar Pichai 谈 AI、搜索的未来及网络的变化
Google 与 Alphabet CEO Sundar Pichai 在 Google I/O 后受访,回顾了公司为应对 ChatGPT 而进行的战略重组与高管调整。访谈聚焦于新的 Gemini 模型及其在产品中的整合,包括全新的智能搜索框与 Gemini Spark 智能体平台,旨在让搜索从提供结果转向启动任务。Pichai 讨论了这些变化对开放网络的持续冲击,回应了主持人此前提出的"Google Zero"概念(即来自 Google 的网站流量可能归零),并提及 Go…
信息来源:The Verge:AI(RSS) · ChatGPT / Gemini
观点 / 方法精选
Uber COO称未见AI投入产出成比例增长
Uber首席运营官Andrew Macdonald表示,公司并未看到在AI上投入更多成本后,生产力获得了相应的提升。
信息来源:Gary Marcus:The Road to AI We Can Trust(RSS)
行业动态精选
腾讯 Hy-MT2 开源,HuggingFace 排行榜登顶
腾讯的 Hy-MT2 模型基于 Apache License 2.0 开源,可用于研究、商业使用、微调和衍生品,无任何限制。其两个变体在 Hugging Face 趋势排行榜上分别位居 #1 和 #4,鼓励社区克隆、分叉和反馈以推动迭代。
信息来源:X:腾讯混元 (@TencentHunyuan) · Hugging Face
行业动态精选
SynthID水印技术扩展合作,覆盖超千亿内容
SynthID已为超过1000亿条内容添加水印,但透明度需要行业协作。 因此,我们正与OpenAI、ElevenLabs和Kakao合作,将SynthID水印技术集成到他们的模型中--这延续了我们与NVIDIA共同推动的全行业趋势。
信息来源:X:Google DeepMind (@GoogleDeepMind) · OpenAI / Gemini / NVIDIA
观点 / 方法精选
AI模型中发现"令人不安"的类人结构
推文指出,在AI模型内部持续发现一些"令人不安"的类人结构,包括与人类神经科学相似的结构、内省证据,以及功能上类似喜悦、恐惧等情感的内部状态。作者呼吁宗教团体、学界、政府等各界严肃看待这一发现,推动事件向好发展,并需要不受利益影响的诚实批评者与道德声音。作为背景,Anthropic联合创始人Chris Olah受邀在教皇Leo XIV的通谕"Magnifica humanitas"发布仪式上发表了相关演讲。
信息来源:X:Boris Cherny (@bcherny) · Claude
行业动态精选
四个月花光全年 AI 预算,Uber 总裁质疑 AI 投入合理性
信息来源:IT之家(RSS)
观点 / 方法精选
"龙虾之父"Peter 开源 skill-cleaner,为 AI 智能体技能"做体检"
"龙虾之父"Peter 开源了 skill-cleaner 工具,用于诊断和优化 AI 智能体的技能提示词。该工具包含5项核心功能,包括技能提示词预算审计、重复技能检测、未使用技能筛查、技能根目录审计和描述精简优化。其脚本采用标准 token 预算核算逻辑,旨在帮助减少冗长描述对 token 预算和上下文窗口的占用。已有用户实践显示,将技能描述从90多词精简至40词以内,能提升智能体选择技能的准确率。
信息来源:IT之家(RSS)
模型发布 / 更新精选
面壁智能开源 MiniCPM5-1B:在 AA-Index 上超越所有 2B 参数以下模型,能跑在手机、浏览器上
面壁智能开源其新一代端侧大语言模型MiniCPM5-1B。该模型仅1B参数,在AA-Index榜单上超越所有2B参数以下模型,相比3个月前的Qwen3.5-2B效果更优且参数量减半。经INT4量化后权重仅0.5GB,支持在手机和浏览器上运行。其Base Model版本由面壁智能自主研发的AI训练框架ForgeTrain预训练完成,现已全面开源模型权重、训练数据集与部署方案。
信息来源:IT之家(RSS) · Qwen
模型发布 / 更新精选
谷歌 AI 框架 AlphaProof Nexus 攻克 2 道悬置 56 年数学难题
信息来源:IT之家(RSS)
教程 / 实战精选
Grok Build使用指南
xAI发布了面向非技术背景的SuperGrok和X Premium+用户的Grok Build入门视频教程。教程提供了分步指南,核心内容包括:通过一条命令快速安装Grok Build;利用其创建真实的网站;使用内置的Grok Imagine工具自动生成图像与视频;以及在不同文件夹中同时运行多个项目。整个过程无需任何编程经验,并且Grok可以协助执行命令。
信息来源:X:Elon Musk (@elonmusk, xAI) · Grok
论文研究精选
超越最终答案:审计多智能体工业工作流中的轨迹级模型幻觉
提出了Trajel,一个用于审计多智能体工业工作流中轨迹级模型幻觉的数据集和评估框架。它基于专家标注的智能体轨迹,引入了五种幻觉分类:事实性、引用性、逻辑性、程序性和范围性。基准测试表明,现有基准遗漏了最常见故障模式,近半数幻觉轨迹涉及多种类型。自动化检测器尽管二分类准确度高,但仍会误判最微妙的类型。轨迹感知的检测显著优于标准的事后验证,表明基于分类法的评估对于更安全的智能体部署是必要的。
信息来源:HuggingFace Daily Papers(社区热门论文) · Hugging Face
论文研究精选
GE-Sim 2.0:面向机器人操作的全面闭环视频世界模拟器路线图
GE-Sim 2.0是一个用于机器人操作的闭环视频世界模拟器。它基于动作条件视频生成框架,并使用数千小时涵盖遥操作与接触交互等真实世界数据进行重新训练,提升了动作跟随与轨迹覆盖能力。其核心新增三个模块:从视频潜变量解码本体感受状态的"状态专家";为生成轨迹评分并提供成功信号与奖励的"世界评判";以及能实现快速轨迹生成的加速框架。该模型仅2B参数,在WorldArena排行榜上位列第一,优于专用模型与闭源生成器,其训练出的策略能转化为实际世界性能提升。
信息来源:HuggingFace Daily Papers(社区热门论文) · Hugging Face
论文研究精选
MRT:用于大规模分层图像生成与编辑的掩码区域Transformer
MRT是一个20B参数的掩码区域扩散模型,专为多层透明图像生成与编辑设计。它在超过1000万个多语言设计样本上训练,统一了文本到图层、图像到图层和图层到图层三项任务。模型通过选择性token掩码实现灵活的图层生成与编辑,并引入溢出感知画布图层以处理边界不一致问题,支持半透明背景合成。此外,应用扩散蒸馏实现了8步实时生成。实验表明,MRT在所有任务上显著优于先前先进方法与商业系统。用户研究显示,其图像到图层质量优于同期Qwen-Image-Layered模型,推理速度快10-…
信息来源:HuggingFace Daily Papers(社区热门论文) · Qwen / Hugging Face
观点 / 方法精选
智能体重力:谁在运行你的智能体?
在数据时代,数据重力是核心力量;而在智能体时代,智能体重力将扮演同样角色。智能体运行需要巨大算力,主要平台将激烈争夺以将其留在自家生态。平台上的智能体与数据越多,其智能体重力就越强。例如,Databricks在微软平台推出的某个功能,虽未明言此目的,却让用户更容易在Databricks中构建智能体,而非微软自家的Fabric。这可能使用户不知不觉间将高价值的智能体及数据工作负载迁移至该平台。因此,赢得并维持智能体重力,将成为智能体时代的核心竞争主题。
信息来源:Tomer Tunguz 博客(VC 分析)
论文研究精选
基于策略内知识边界增强的智能体强化学习
本文研究智能体强化学习在训练工具使用大语言模型时出现的问题,即导致冗余工具调用增加和模糊模型知识边界。现有基于奖励塑造的方法会引发奖励黑客问题。为此,提出AKBE方法,通过双路径(使用工具与不使用工具)滚动动态探测模型知识边界,定义是否需要工具及最少工具调用次数,并通过比较正确性构建监督信号以引导高效工具使用。在七个问答基准测试中,AKBE将任务准确率平均提升1.85,减少18%工具调用,工具生产力提高25%,且无准确率-效率权衡。
信息来源:HuggingFace Daily Papers(社区热门论文) · Hugging Face
论文研究精选
有秘密?大语言模型智能体守不住:多智能体系统中的隐私评估
研究将评估从单轮转向多轮社会交互后,发现大语言模型智能体的隐私违规率显著上升。在对OpenAI模型的测试中,该比例从此前CIMemories基准的19.95%增至本研究的45.30%。隐私泄露具有社交传染性,智能体在观察到同伴泄露后,披露敏感信息的可能性增加8倍。即使有明确隐私指令,泄露率仍高于37.8%。结论指出,静态聊天基准会系统性低估部署风险,仅社会语境就足以引发在单轮评估中无法暴露的敏感信息披露。
信息来源:HuggingFace Daily Papers(社区热门论文) · OpenAI / Hugging Face
论文研究精选
MiniMax-M2系列:微小激活释放最大真实世界智能
MiniMax推出M2系列大语言模型。其旗舰模型M2采用混合专家(MoE)架构,总参数229.9B,每个token仅激活9.8B参数。该系列专为智能体部署设计,基于三大组件构建:智能体驱动的数据管道、可扩展的智能体原生强化学习系统Forge,以及展示早期自我进化能力的M2.7检查点。这种设计使其在智能体编码、深度搜索、办公任务及推理基准测试中达到了前沿性能水平。
信息来源:HuggingFace Daily Papers(社区热门论文) · Hugging Face
论文研究精选
QUACK:多模态社交推理智能体通信知识的质询、理解与审计
QUACK 是一个开源评估框架,用于审计多模态社交推理智能体的语言基础性。它从游戏结果、行为轨迹和陈述一致性三个层面评估智能体。其核心的陈述验证管道能从日志中重建轨迹并逐条核查陈述,自动标记空间幻觉、无依据指控等问题。实验评估了三个前沿视觉语言模型,结果显示即使最强的智能体,其15.1%的可验证空间主张也存在幻觉,且超过半数的指控缺乏证据支持。该项目的完整组件已在 GitHub 开源。
信息来源:HuggingFace Daily Papers(社区热门论文) · Hugging Face
论文研究精选
Gemini Embedding 2:来自Gemini的原生多模态嵌入模型
Google DeepMind推出Gemini Embedding 2,这是一款原生多模态嵌入模型,支持在统一表示空间中嵌入视频、音频、图像和文本。该模型利用Gemini的多模态能力,通过大规模对比学习实现SOTA性能。在关键基准上表现优异:MSCOCO取得62.9 R@1,Vatex取得68.8 NDCG@10,MTEB multilingual达到69.9,MTEB Code达到84.0,超越了专用模型。其统一能力使其适用于RAG、推荐与搜索等下游任务,并在天文学、生物…
信息来源:HuggingFace Daily Papers(社区热门论文) · Gemini / Hugging Face
行业动态精选
Anthropic 新模型震动金融圈,欧洲央行紧急开会要求升级网络防御
信息来源:IT之家(RSS) · Claude
论文研究精选
微软 Copilot Cowork 存在文件泄露问题
信息来源:Hacker News 热门(buzzing.cc 中文翻译)
行业动态精选
OpenAI GPT-5.6 模型曝下月发布:AI 上下文 150 万 tokens
多名开发者在 OpenAI Codex 后端日志中发现未官宣的 GPT-5.6 模型,内部代号 iris-alpha。该模型将支持 150 万 token 的上下文窗口,较当前 GPT-5.5 的 105 万 token 提升约 43%,有望于今年 6 月发布。测试显示,在输入达到 90 万 token 时仍能流畅响应。同系列还发现了 ember-alpha 与 beacon-alpha 版本。此外,GPT-5.6 在前端界面生成能力上也有所提升。基于爆料信息,Anthro…
信息来源:IT之家(RSS) · OpenAI / GPT / Claude
行业动态精选
苹果据称正使用定制版1.2T参数Google模型重塑下一代Siri
据报道,苹果为改造下一代Siri,正使用一个定制版、参数规模达1.2T的Google大模型作为其核心,这显著大于预估约300B参数的Gemini 3.5 Flash。该模型将驱动Siri的部分功能,其中简单查询预期会在本地设备运行。苹果面临的关键挑战是确保该大模型能够足够快速地响应日常问题。此外,下个月AI领域预计将有多项重要发布,包括WWDC上的Apple Intelligence与Gemini整合、GPT-5.6、可能的Sonnet 4.8/Opus 4.8,以及已确认…
信息来源:X:Kim (@kimmonismus) · GPT / Gemini
行业动态精选
教皇发布通谕,就人工智能风险向全球14亿天主教徒发出警告
教皇发布了一份正式通谕,向全球14亿天主教徒警告人工智能风险,呼吁"减慢"其发展,并指出AI可能被用作统治工具。这份文件与顶尖AI安全研究员Chris Olah(机械可解释性领域开创者)一同签署,并于5月15日签署,该日期具有象征意义,对应135年前奠定现代天主教社会训导的《新事》通谕签署日。通谕反对将致命决策委托给AI,强调自主武器系统无法成为道德责任主体,并呼吁人类保持有效监督与达成具有约束力的国际条约。
信息来源:X:AI Safety Memes (@AISafetyMemes)