AI 情报文章归档
浏览 AI圈报 已保存的 5771 条 AI 情报文章,覆盖模型、产品、行业、论文、教程与观点方法六大分类。
已收录文章5771
正式分类6
精选内容3361
全部文章
第 92 / 145 页 · 每页 40 条
产品发布 / 更新精选
借助 Workload Identity Federation 安全访问 Claude Platform
Workload Identity Federation (WIF) 已在 Claude Platform 上全面可用。WIF 兼容任何 OIDC 身份提供者,覆盖所有 Claude API 端点(包括第一方 SDK 和 Claude Code)。WIF 用短生命期凭证替代静态 API 密钥,并引入服务账户,每个工作负载拥有独立身份、角色和审计日志。Claude Console 提供引导设置流程,支持 Admin API 进行组织管理。API 密钥可并行使用以便逐步迁移。
信息来源:Claude:Blog(网页) · Claude
观点 / 方法精选
Google 分享 A2UI 与 MCP Apps 三种集成架构模式
Google 分享了三种集成 A2UI 与 MCP Apps 的架构模式,旨在结合两者优势。A2UI 采用声明式框架,通过 JSON payload 定义 UI,由宿主原生渲染,确保一致性与安全性,但受限于预定义组件库。MCP Apps 在 iframe 中使用标准 Web 技术提供自定义界面,但存在设计碎片化、性能与安全挑战。三种模式包括:通过 MCP 服务器提供 A2UI,利用 MCP Resources 或 Tool 调用传递 JSON,实现"一次编写,原生渲染"的跨…
信息来源:Google Developers Blog(RSS)
行业动态精选
谷歌发布Agentic Resource Discovery(ARD)开放规范
Agentic Resource Discovery(ARD)是一项开放规范,用于在Web上发布、发现和验证AI工具、技能与智能体。它基于两个原语:组织在其自有域名下托管catalog描述可用能力,registry作为搜索引擎索引catalog并响应发现请求。ARD支持加密验证,使客户端与端点连接前确认发布者身份,然后直接通过原生协议调用能力。Google Cloud的Gemini Enterprise Agent Platform通过Agent Registry提供企业级…
信息来源:Google Developers Blog(RSS) · Gemini
产品发布 / 更新精选
MOSS-TTS-Local-Transformer-v1.5 在 SGLang-Omni 上:原生流式 48 kHz 语音服务
MOSS-TTS-Local-Transformer-v1.5 是一款开源 TTS 模型,支持 48 kHz 立体声、零样本声音克隆、最长 10 分钟长文本合成、时长控制及 31 种语言。其核心采用 Qwen3-4B 骨干与约 2B 参数的 MOSS-Audio-Tokenizer-v2 音频编解码器,通过 12 个 RVQ 码本运行。SGLang-Omni 以三阶段流水线部署该模型。在 Seed-TTS-Eval 上词错误率 5.10%、语音相似度 69.23%,CV3-…
信息来源:LMSYS:Blog(Chatbot Arena 团队) · Qwen
产品发布 / 更新精选
Claude Design 更新:跨项目保持品牌一致,与Claude Code协同
6月17日,Claude Design 更新,支持跨项目使用统一设计系统,并与Claude Code同步工作流。用户可直接拖拽、对齐和缩放画布元素,编辑器稳定性大幅提升。设计系统可从GitHub、设计文件或原始上传导入,团队管理员可锁定标准系统防止篡改。新增桌面端侧边栏入口及独立网页端claude.ai/design。使用限制与聊天、Claude Cowork、Claude Code共享,每次任务消耗更少token,错误率下降。支持导出PDF、PPT,集成Adobe、Can…
信息来源:Claude:Blog(网页) · Claude
产品发布 / 更新精选
Copilot Cowork 全球正式可用,支持多模型
Copilot Cowork 现已全球正式可用,并支持多模型! 每个组织都可以让长期运行的智能体处理复杂的多步骤任务,基于你组织的独特知识和专有技术。 https://www.microsoft.com/en-us/microsoft-365/blog/2026/06/16/copilot-cowork-is-now-generally-available/?v=15
信息来源:X:Satya Nadella (@satyanadella)
观点 / 方法精选
保障AI智能体的未来安全
Google DeepMind发布AI Control Roadmap,这是一套针对内部先进AI智能体的系统级安全框架。该框架在传统模型对齐之上增加防线,假设AI智能体可能不对齐,通过威胁建模、沙箱隔离、端点安全、提示注入防御以及基于已验证行为逐步授予权限的机制建立信任。据估算,到2030年仅美国市场AI智能体就能创造2.9万亿美元经济价值。
信息来源:Google DeepMind:Blog(RSS) · Gemini
模型发布 / 更新精选
Kimi K2.7 Code发布:专注编码的智能体模型,接近GPT5.5
硅基流动上线月之暗面Kimi K2.7 Code模型。基于K2.6改进,专注编码与智能体任务。32B激活/1T总参,VLM多模态,支持交错思考与多步工具调用。相比K2.6,推理token使用减少30%,减少过度思考;长程编码任务指令遵循和完成率提升。性能接近GPT5.5与Opus 4.8。价格:缓存输入0.19/输入0.94/输出4.00每百万token。
信息来源:X:硅基流动 SiliconFlow (@SiliconFlowAI) · GPT / Kimi
行业动态精选
马斯克:AI将达Stockfish级编码
AI 将实现 Stockfish 级别的编码和通用计算机使用
信息来源:X:Elon Musk (@elonmusk, xAI) · Grok
产品发布 / 更新精选
Xiaomi MiMo Claw 正式版发布:搭载 MiMo-V2.5-Pro 旗舰模型,联动金山办公上线订阅服务
小米发布云端轻量化 Claw 类产品 MiMo Claw 正式版,搭载与 OpenClaw 框架深度适配的 MiMo-V2.5-Pro 旗舰模型,原生支持 MCP 协议与百万级超长上下文。
信息来源:公众号:小米 MiMo
产品发布 / 更新精选
小米 MiMo Claw 正式版发布:旗舰模型+金山办公,全新订阅服务上线
小米推出云端轻量化 Claw 类产品 MiMo Claw 正式版,搭载与 OpenClaw 框架深度适配的 MiMo-V2.5-Pro 旗舰模型。该模型原生兼容 MCP 工具调用协议,内置百万级超长上下文,支持单会话千次以上连续工具调用;依托 MTP 三层解码架构,在 OpenClaw 标准 Agent 工作流中吞吐效率提升约 3 倍。ClawEval 测试中任务达标率(Pass3)达 63.8%,Token 消耗较同类产品降低 40%-60%。联动金山办公生态,提供 Wo…
信息来源:公众号:小米 MiMo
行业动态精选
美国司法部援引国家安全为xAI未经许可的燃气轮机辩护
美国司法部在一份驳回诉讼的动议中称,xAI的聊天机器人Grok对军事行动至关重要,以此为其在密西西比州Southaven的Colossus 2设施运行未经许可的燃气轮机辩护。NAACP已提起诉讼,指控xAI的燃气轮机数量从4月的27台增至57台,导致氮氧化物排放飙升111%。国防部首席数字与人工智能官Cameron Stanley表示,Grok是支持机密和绝密网络军事任务的四款AI模型之一,包括近期针对伊朗的打击。
信息来源:The Decoder:AI News(RSS) · Grok
行业动态精选
SpaceX全股收购Cursor,联合构建有用AI
SpaceX已行使期权,以全股交易收购Cursor,旨在打造全球最有用的AI模型。过去几个月,SpaceXAI与Cursor联合训练了一款模型,该模型将很快在Cursor和Grok Build中发布。主推文的Michael Truell表示期待合作,兴奋与SpaceX联手构建有用AI。
信息来源:X:Michael Truell (@mntruell) · Grok / Cursor
观点 / 方法精选
WorkBuddy日活飙升至行业第二的3-4倍,非技术用户涌入
从3月至今,WorkBuddy日活用户数已达行业第二名的3-4倍,用户不再限于开发者,大量HR、运营、行政等非技术岗位也在使用。其企业版和项目功能进一步扩展了Agent办公场景。同期,Trae Work、QoderWork、Kimi Work等产品纷纷改名或出新,争夺市场。腾讯云认为这可能是十年一遇的机遇。
信息来源:公众号:数字生命卡兹克 · Kimi
行业动态精选
DeepSeek 完成首轮外部融资,估值超 500 亿美元
中国 AI 初创公司 DeepSeek 完成首轮外部融资,募资超 500 亿元人民币(约 74 亿美元),估值超 500 亿美元。投资结构特殊:多数投资者将资金投入 CEO 梁文锋管理的有限合伙企业,无投票权且锁定期五年;仅国资 AI 基金直接投资并保留投票权。创始人梁文锋个人投入约 200 亿元,腾讯和宁德时代为主要外部投资者。梁文锋表示优先基础 AI 研究与 AGI 开发,将继续开源。DeepSeek 去年初凭 V3、R1 模型获全球关注,今年 4 月发布运行于华为芯片…
信息来源:The Decoder:AI News(RSS) · OpenAI / GPT / DeepSeek
行业动态精选
OpenAI 去年支出 340 亿美元,净亏损约 390 亿但含一次性费用
OpenAI 过去一年支出 340 亿美元,其中约 190 亿投入研发,近 60 亿用于销售和营销。收入约 130 亿美元,年底月收入达 20 亿美元。净亏损从 50 亿跃升至约 390 亿美元,但《金融时报》指出其中约 300 亿为一次性非现金会计费用,剔除后实际亏损约 80 亿美元。OpenAI 正筹备 IPO,估值可能超 1 万亿美元。
信息来源:The Decoder:AI News(RSS) · OpenAI
产品发布 / 更新精选
Google Cloud 推出 OKF v0.1:供应商中立的 Markdown 规范,为 AI 智能体提供结构化上下文
Google Cloud 发布 Open Knowledge Format (OKF) v0.1,一种供应商中立的 Markdown 规范,为 AI 智能体提供结构化上下文知识。OKF 将知识表示为带 YAML 前置元数据的 markdown 文件目录,每个概念对应一个文件,通过 `type`、`title`、`description` 等少量保留字段实现互操作。无需专有服务、SDK 或运行时,目录可托管在 GitHub、以 tarball 传输或挂载到任意文件系统。OKF…
信息来源:MarkTechPost(RSS)
模型发布 / 更新精选
Cartesia 发布 Sonic 3.5 与 Ink 2 实时语音模型
Cartesia 推出 Sonic 3.5 和 Ink 2 两个模型,作为单一实时语音栈,分别负责文本转语音和语音转文本。Ink 2 在 Artificial Analysis 的流式语音转文字排行榜上排名第一。Sonic 3.5 在实时文本转语音中位列榜首,首音频延迟约 82ms。Cartesia 成为目前唯一同时拥有 #1 听与说模型的提供商。
信息来源:X:Testing Catalog (@testingcatalog)
模型发布 / 更新精选
Qwen-Robot 发布:通义实验室用三模型打通大模型到物理世界
通义实验室发布 Qwen-Robot 套件,以 Qwen-RobotNav、Qwen-RobotManip、Qwen-RobotWorld 三个模型分别覆盖导航、操作与世界预测,统一采用语言优先接口。
信息来源:公众号:通义实验室(千问) · Qwen
行业动态精选
微软旗下GitHub遭遇AI算力短缺,转而向AWS寻求支持
微软旗下GitHub面临AI算力短缺,微软因此转向亚马逊AWS寻求计算资源支持。原文来自Hacker News热门讨论,标题为"Microsoft turns to AWS as GitHub faces AI capacity crunch"。
信息来源:Hacker News 热门(buzzing.cc 中文翻译)
产品发布 / 更新精选
AI 版支付宝官宣开启邀测:右滑打开"阿宝",官方放出 100 个邀请码
支付宝今日开启 AI 版邀测,用户可右滑进入新版界面,在对话框或语音中输入指令,由"阿宝"助手代办事项。以查询公积金为例,阿宝自动匹配对应小程序和服务入口,用户点击确认即可完成,将多步跳转折叠为一句指令。所有涉及资金变动和支付的环节均需用户本人确认。首批放出 100 个邀请码。
信息来源:IT之家(RSS)
模型发布 / 更新精选
蚂蚁百灵发布 Ling & Ring 2.6 技术报告
蚂蚁百灵发布 Ling & Ring 2.6 技术报告,公开 2.6 系列在架构、预训练、后训练及 Agent 强化学习等细节。该系列采用 Lightning Attention 与 MLA 以 7:1 比例结合的混合线性注意力架构,预训练处理约 9.6T tokens,上下文扩展至 256K。
信息来源:公众号:蚂蚁百灵(Ling)
观点 / 方法精选
毕业生陷入AI检测荒诞循环:手写摘要被判99%AI率,AI写部分0%
当前毕业生面临论文AIGC率检测荒诞困境。学生手写摘要被判定99%AI率,纯AI写部分却为0%。学校要求AIGC率不超40%,学生用Claude反复修改并花上百元检测费(维普20元/篇,知网/万方2元/千字符),最终降至36.1%。答辩时老师要求改回学术表达,AI率回升至37.21%。同一论文在不同平台检测结果差异巨大(48%、44%、59%)。部分平台提供降重收费服务,少数学校已改用AI使用声明表替代一刀切检测。
信息来源:公众号:数字生命卡兹克 · Claude
模型发布 / 更新精选
Qwen-Robot Suite:面向物理世界智能的基础模型套件
Qwen 发布三款基础模型--Qwen-RobotNav、Qwen-RobotManip 和 Qwen-RobotWorld。Nav 通过可控观测协议统一指令跟随、点/物体目标导航、目标追踪和自动驾驶五类任务,在 VLN-CE RxR 上达 76.5% SR,HM3Dv2 物体目标导航(仅 RGB)75.6% SR,EVT-Bench 追踪率 90.0%,NAVSIM 91.4 PDMS。Manip 利用规范状态-动作空间对超 38,100 小时异构开源机器人数据进行跨本体…
信息来源:Qwen:Blog Retrieval(API) · Qwen
产品发布 / 更新精选
教育部"阳光志愿"信息服务系统全新升级上线:智能筛选志愿,数据权威可信
教育部"阳光志愿"信息服务系统今日全新升级上线,依托招生、学籍、就业等海量官方数据,免费为考生和家长提供志愿填报服务。系统支持31个省区市本专科普通批次志愿筛选,输入高考成绩、位次及个性化条件即可快速生成合理参考方案。AI助手"智慧小招"24小时在线解答政策规则。平台数据由高校直接报送、官方核验,真实可靠。同时推出专业倾向测评和21项生涯测评工具,帮助学生认清特长、规划未来。
信息来源:IT之家(RSS)
模型发布 / 更新精选
成本砍半,字节跳动推出 Seedance 2.0 Mini 视频生成模型
字节跳动火山引擎旗下火山方舟体验中心于 6 月 15 日上线 Seedance 2.0 Mini 视频生成模型,计划近期开放 API。该模型比 Seedance 2.0 Fast 快 2 倍,输出质量相当。图生视频定价 0.023 元/千 tokens,视频生视频 0.014 元/千 tokens,720P 规格下单秒生成成本约 0.5 元,较 Seedance 2.0 标准版降低约一半。模型面向电商内容生产、营销素材批量生成、UGC 创作及特效玩法等高频率、大规模视频生成…
信息来源:IT之家(RSS)
行业动态精选
五角大楼将大部分日常AI工作流从Anthropic转移,目标9月前完全切断
五角大楼宣布已将超2/3日常AI工作流从Anthropic转移,目标9月前清零。起因是年初五角大楼要求Anthropic签署协议允许Claude用于大规模监控和全自动武器,CEO Dario Amodei以模型不可靠为由拒绝。五角大楼将其列为"供应链风险",起诉未果。OpenAI调整立场获得订单。Polymarket预测6月底前和解概率仅9%。此事件凸显AI公司需在原则与政府合作间抉择。
信息来源:X:阿易 AI Notes (@AYi_AInotes) · OpenAI / Claude
观点 / 方法精选
5x for Free:本地编程栈
Hacker News 讨论揭示:Qwen 3.6 35B-A3B 模型提及率 33% 领先,27B 变体以 20% 紧随其后,DeepSeek Pro 与 Gemma4 31B 位列前四。Agent 工具中 Pi (49%) 与 OpenCode (45%) 占主导。用户对比称,Claude Opus 可带来 15 倍加速,而本地离线 Qwen 提供 5 倍加速,且完全免费、保护隐私。SWE-bench Verified 基准测试显示,Qwen 3.6 27B 得分 77…
信息来源:Tomer Tunguz 博客(VC 分析) · DeepSeek / Qwen / Claude
模型发布 / 更新精选
Qwen-RobotManip:对齐解锁机器人操作基础模型的规模化能力
Qwen-RobotManip 是通义千问基于 Qwen-VL 的视觉-语言-动作(VLA)基础模型,引入覆盖表示、运动和行为三维度的统一对齐框架。仅使用开源机器人数据集和人演示视频,构建约 38,100 小时预训练语料,涵盖 15 种机器人形态。在 LIBERO-Plus 达 91.4%,RoboTwin-C2R Hard 达 69.4%,RoboCasa365 Composite-Unseen 达 14.9%,EBench 达 45.6%,RoboTwin-IF 达 7…
信息来源:Qwen:Blog Retrieval(API) · Qwen
产品发布 / 更新精选
Subagent:让模型把琐碎任务委托出去
OpenRouter 推出 openrouter:subagent 服务器工具,允许前沿模型在生成过程中将独立的琐碎任务(如文档总结、结构化数据提取、文本重格式化)委托给更小、更便宜、更快的 worker 模型执行,从而节省前沿模型的 token 消耗。
信息来源:OpenRouter:Announcements(RSS)
论文研究精选
SAE干预不可靠:干预后抑制行为的恢复
稀疏自编码器(SAE)将残差流激活分解为可解释特征,但干预特定特征后,通过优化残差扰动可恢复原有行为。研究发现这是一种可恢复失败模式:干预阻断一条可见行为路径,却未消除行为本身。即使干预在整个优化和生成期间保持激活,恢复依然可行。在TPP、遗忘、IOI和拒绝引导场景中均观察到可恢复行为。安全关键的拒绝引导场景下有效样本恢复率达95.8%,被防御特征的相对漂移仅0.131。归因分析将恢复路径定位到SAE重建残差,表明控制SAE特征并不能保证控制底层行为。
信息来源:HuggingFace Daily Papers(社区热门论文) · Hugging Face
产品发布 / 更新精选
Grok for PowerPoint 发布:在 Microsoft PowerPoint 内直接生成和编辑幻灯片
xAI 于 6 月 16 日发布 Grok for PowerPoint,作为免费 Microsoft 365 插件上线。用户无需离开应用即可利用 Grok 将大纲转为完整幻灯片,进行内容研究、撰写、排版,并支持添加单张幻灯片、调整样式主题、重构章节。插件还能调用 Grok 连接器,从邮件或 SharePoint 中获取信息。该插件同样适用于 Word 和 Excel。
信息来源:xAI:News(网页) · Grok
论文研究精选
OpenAI 发布 Deployment Simulation 方法:通过模拟部署预测模型发布前行为
OpenAI 近日发布 Deployment Simulation 方法,通过在隐私保护下重放历史对话、用新候选模型重新生成回复,模拟模型上线后的实际表现。在多个 GPT-5-series Thinking 部署中,该方法比传统评估更准确地估计了不良行为频率,发现新型对齐问题,并降低模型识别测试的风险。它还能扩展至涉及工具使用的智能体场景。传统评估存在覆盖不足、选择偏差和模型可识别测试等局限,而 Deployment Simulation 使用真实对话分布缓解了这些问题,但…
信息来源:OpenAI:官网动态(RSS · 排除企业/客户案例) · OpenAI / GPT
模型发布 / 更新精选
Qwen-RobotWorld:具身智能体的无界世界
Qwen-RobotWorld以语言为统一动作接口,采用双流Multimodal Diffusion Transformer(MMDiT)架构,将Qwen2.5-VL作为动作编码器。在4个基准测试中取得顶尖成绩,统一20余种机器人形态,基于860万跨场景训练对和1300多项操作技能。语言接口标准化500多种动作类别,支持操作、自动驾驶、室内导航的联合训练。还支持Scene2Robot人类到机器人转移及2-4路多视角几何一致视频生成。
信息来源:Qwen:Blog Retrieval(API) · Qwen
模型发布 / 更新精选
xAI 发布 Grok Imagine Video 1.5
xAI 将 Grok Imagine Video 1.5 从预览转为全面可用,在 Imagine API 上提供 `grok-imagine-video-1.5`,并在 grok.com/imagine 及 iOS/Android 应用上推出 Video 1.5 Fast 版。相比前代,模型在音频与语音(更清晰、嘴型同步更好)、运动与物理(更连贯、重量感更真实)、生成速度(6 秒 720p 视频约 25 秒,此前超 40 秒)上全面提升。同时逐步推出 Projects、Mu…
信息来源:xAI:News(网页) · Grok
观点 / 方法精选
项目负责人揭秘为何苹果 AI 版 Siri 姗姗来迟:推倒重来,彻底重构
苹果AI版Siri迟迟未上线,项目负责人迈克·罗克韦尔在WWDC技术分享会上透露,去年团队曾做出在原有Siri基础上小幅改良、新增工具调用的可运行版本,但因无法达到产品愿景,最终选择推倒重来,完整从零重构系统,依托全新大模型搭建。重构后的Siri拥有独立应用程序,原生支持多模态交互,隐私保护贯穿底层架构,并覆盖iPhone、iPad、Mac、Apple Watch、Vision Pro、CarPlay、AirPods等全平台,提供统一连贯体验。
信息来源:IT之家(RSS)
教程 / 实战精选
GitHub Copilot CLI 初学者指南:常用斜杠命令概览
GitHub Copilot CLI 为初学者提供了常用斜杠命令的概述,帮助用户通过命令控制终端中的 AI 智能体。
信息来源:GitHub Blog
产品发布 / 更新精选
Meta 在 Facebook 上线"AI Mode",基于平台公开信息合成答案
Meta 宣布在 Facebook 推出"AI Mode"搜索功能,利用 Meta AI 从公开帖子(含群组和 Reels)提取信息并合成答案,用户可用自然语言提问获得摘要。同时新增视频拼贴剪辑、过渡效果及 AI 照片预设(可更换服装、发型和配饰),体育迷可在 Stories 中点击"AI Edit"虚拟穿上队服。这些更新延续了此前动态头像、Marketplace 自动回复和创作者 AI 助手的部署节奏。此外,Meta 近期启动了 Facebook、Instagram 和 …
信息来源:TechCrunch:AI(RSS) · Llama
产品发布 / 更新精选
OpenRouter新增免费模型gpt-oss-20b和Gemma4 26B
OpenRouter 上新增免费容量,由 @eigenlabs 的 Darkbloom 提供:gpt-oss-20b 和 Gemma 4 26B。 今天就开始使用这些模型吧 ↓
信息来源:X:OpenRouter (@OpenRouter) · GPT
观点 / 方法精选
免费LLM API比较:速率限制、模型与真实成本(2026)
13个平台提供免费LLM API,含永久免费层与试用额度。OpenRouter拥有20+免费模型,单密钥无需信用卡;Groq以约320 tokens/秒运行Llama 3.3 70B;Google AI Studio支持1M上下文;Mistral实验层约10亿token/月但需同意数据训练;Cerebras约1M token/天;GitHub Models提供GPT-4o、Claude 3.5 Sonnet等前沿模型。各免费层有速率限制、数据训练授权、上下文缩减等隐藏成本,…
信息来源:OpenRouter:Announcements(RSS) · GPT / Claude / Llama