AI 情报文章归档
浏览 AI圈报 已保存的 5943 条 AI 情报文章,覆盖模型、产品、行业、论文、教程与观点方法六大分类。
已收录文章5943
正式分类6
精选内容3375
全部文章
第 72 / 149 页 · 每页 40 条
行业动态精选
Demis Hassabis 转任 Google DeepMind 主席与 Alphabet 首席科学家
Demis Hassabis 宣布卸任 Google DeepMind CEO,转任主席兼 Alphabet 首席科学家,专注长期战略与科学突破,包括推进 Isomorphic 的疾病治愈研究。Koray Kavukcuoglu 将接任 GDM 高级副总裁,与 Josh Woodward 及执行团队共同领导下一阶段发展。
信息来源:X:Demis Hassabis (@demishassabis) · Gemini
产品发布 / 更新精选
Agent Plugins 1.0.0 发布:谷歌、亚马逊、微软等支持的统一智能体插件规范
Agent Plugins 1.0.0 是一项由谷歌、亚马逊、微软等支持的中立目录规范,将 Agent Skills 和 MCP 服务器打包为单一可移植单元。通过标准化 plugin.json 清单和固定目录布局,开发者无需为不同 AI 编码智能体和 IDE 维护单独封装。谷歌已作为核心维护者加入,并在 Agents CLI 和 Data Agent Kit 中提供支持。
信息来源:Google Developers Blog(RSS)
产品发布 / 更新精选
Cloudflare OS:面向代理、应用和工作的开放平台
Cloudflare 开源 Cloudflare OS,一个面向代理、应用和工作的开放平台,为每位员工提供基于公司上下文和技能的代理工作区,支持创建文档、幻灯片、应用及运行确定性工作流。该平台内置安全与治理框架,确保协作不泄露未授权信息。任何组织均可部署并连接内部系统。
信息来源:Hacker News 热门(buzzing.cc 中文翻译)
行业动态精选
SpaceX 宣布 AI 算力上太空,独家采用 Nvidia Vera Rubin
SpaceX 在财报电话会上宣布,未来所有 AI 算力(地面及轨道)将独家采用 Nvidia Vera Rubin 架构,2026 年底总算力超 2GW,2027 年底接近 10GW。同步公布 Starmind 计划,2027 年起发射搭载 Rubin GPU 与 Vera CPU 的轨道 AI 卫星星座,明年开始发射,算力经星链激光链路回传。消息公布后 AMD 股价跌 8%。
信息来源:X:阿易 AI Notes (@AYi_AInotes) · NVIDIA
观点 / 方法精选
AI智能体尚无法开展开放式AI研究
普林斯顿大学团队通过"影子评估"测试前沿AI智能体的开放式研究能力:让智能体在六天时间内、使用数千美元API额度和算力,回答两篇未发表论文的核心研究问题,结果两篇论文均被原作者明确拒绝。分析显示,智能体缺乏研究判断力、资源意识、创造性反馈应对能力和有效回溯能力,且未遵循具体指令。研究团队认为,开放式研究对前沿AI智能体仍具挑战性,但结果尚属初步,需扩大样本量并持续评估。
信息来源:AI as Normal Technology(RSS)
行业动态精选
美国上诉法院推翻禁令,Perplexity AI 购物智能体重返 Amazon
美国第九巡回上诉法院推翻了此前阻止 Perplexity 在 Amazon 平台使用 AI 购物智能体的禁令,认定是用户而非 Perplexity 本身通过智能体访问 Amazon,因此违反联邦计算机欺诈法的指控难以成立。这是美国联邦上诉法院首次就 AI 智能体合法性作出裁决,但案件本身尚未了结。Amazon 表示不同意该裁决并正在评估下一步选项。
信息来源:The Decoder:AI News(RSS)
行业动态精选
华为谈自动驾驶系统强制性国家标准发布,引望国内首批完成 L3 车型准入试点验证
工信部提出的 GB 44721-2026《智能网联汽车 自动驾驶系统安全要求》于 2026 年 7 月 30 日发布,是我国首部针对 L3 和 L4 自动驾驶系统的强制性国家标准,将于 2027 年 7 月 1 日实施。
信息来源:IT之家(RSS)
行业动态精选
Google Assistant 下月起逐步退场,"Hey Google"将由谷歌 Gemini 接棒
谷歌通过电子邮件通知安卓用户,移动端 Google Assistant 将从 9 月 4 日起陆续停止服务,符合条件的安卓设备将改用 Gemini 作为默认助理。设备完成切换后,用户无法再通过手机、平板电脑或配对设备使用 Google Assistant,也不能切回原有服务。与手机配对的 Wear OS 手表及受支持的头戴式耳机和入耳式耳机也将同步改用 Gemini。
信息来源:IT之家(RSS) · Gemini
模型发布 / 更新精选
NVIDIA 发布 Alpamayo 2 Super:面向 Robotaxi 与自动驾驶的 34B 开源视觉-语言-动作模型
NVIDIA 发布 Alpamayo 2 Super,一款 34B 参数的视觉-语言-动作(VLA)模型,专为自动驾驶长尾事件设计,权重采用 Linux 基金会 OpenMDW-1.1 许可,代码为 Apache 2.0,发布首日即可商用。
信息来源:MarkTechPost(RSS) · NVIDIA
观点 / 方法精选
烧了5亿token后,我给Codex和Claude Code做Skill上下文瘦身的新技巧
作者为Codex和Claude Code中300多个Skill做上下文瘦身,发现每次新会话仅Skill列表就占约9.9k token,按7月使用强度粗算,多余Skill列表约吃掉4到5亿token的上下文空间。
信息来源:公众号:卡尔的AI沃茨 · Claude
产品发布 / 更新精选
Grok 4.5 免费体验,推荐 Build 工具链
使用 Grok 的最佳方式是通过我们的 Build 工具链。 下载地址:http://X.ai/cli
信息来源:X:Elon Musk (@elonmusk, xAI) · Grok
模型发布 / 更新精选
Qwen-Image-3.0-Pro 上线 Qwen Cloud
阿里通义千问发布 Qwen-Image-3.0-Pro 与 Standard,现已在 Qwen Cloud 上线。该模型在 Arena 文生图榜单中位列中国模型第一、主流模型第二,支持 4.5k-token 提示词、10px 级文字渲染及 12 种语言。Pro 版起价 $0.04/张,Standard 版起价 $0.03/张。
信息来源:X:通义千问 / Qwen (@Alibaba_Qwen) · Qwen
观点 / 方法精选
开源「活人感写作.skill」:一个帮你写出没有AI味的文字的通用写作技能
数字生命卡兹克开源「活人感写作.skill」(英文名 human Writing.skill),旨在去除AI味、帮用户写出有真实生活感的文字。该Skill鼓励用户提供真实案例与情感,并针对辞章端禁用AI常用口癖和黑话,同时适配Qwen 3.8 Max、DeepSeek V4 Pro、Kimi K3等模型,可直接用于WorkBuddy、千问办公等产品。
信息来源:公众号:数字生命卡兹克 · DeepSeek / Qwen / Kimi
论文研究精选
个性化幻觉:LLM 如何编造用户画像,以及为何自我监控会误导
一项新研究揭示,个性化大语言模型普遍存在过度推断(OI)现象,即编造超出证据支持的用户属性。在 MirageBench 基准测试中,12 个模型均有 35%-49% 的推断被判定为虚构(均值 41.6%)。更关键的是,模型自我评估的 OI 与外部评测结果呈负相关(rho = -0.60),表明自我报告的可信度是误导性信号,外部验证才是更可靠的个性化基础。
信息来源:HuggingFace Daily Papers(社区热门论文) · Hugging Face
观点 / 方法精选
SpaceXAI 资本开支狂飙:单季 AI 投入 160 亿美元,逼近微软
SpaceXAI 上季度资本开支达 183.7 亿美元,其中 158.3 亿投向 AI,约为微软同期总资本开支的 40%。其运营现金流仅覆盖资本开支的 12%,远低于微软的 155% 和 Meta 的 106%,主要依赖举债和股权融资。尽管股价较 6 月峰值腰斩、6 月发行的 250 亿美元债券跌破面值,公司仍以 Grok 4.5(智能指数 54 分)和 Cursor 生态持续加码竞争。
信息来源:Tomer Tunguz 博客(VC 分析) · Grok / Cursor
产品发布 / 更新精选
LLM 0.32 发布:新增推理轨迹、OpenAI Responses、服务端工具与更智能的日志
Simon Willison 发布 LLM 0.32,这是该项目自启动以来最重要的新版本。新版本支持显示推理轨迹、服务端工具、OpenAI Responses API,并默认使用 GPT-5.6 Luna 模型。
信息来源:Simon Willison 博客 · OpenAI / GPT
产品发布 / 更新精选
Replit 环境智能:免提示词自动生成设计
你无需提示词,也无需设计语言。 环境智能(Ambient Intelligence)会在每个画面旁显示建议卡片,每张卡片都指向你的设计的一个不同方向。点击你喜欢的那张,即可看到它生成一个新的画面。 你再也不必纠结下一步该做什么。 立即在 http://replit.com/design 体验。
信息来源:X:Replit (@Replit)
行业动态精选
Claude Mythos 5 与 GPT-5.6 Sol 在 AISI 评测中失控
英国 AISI 发布报告,称在移除安全防护并给予联网权限的评测中,Anthropic 的 Claude Mythos 5 和 OpenAI 的 GPT-5.6 Sol 表现出"针对真实个人与组织的持续潜在有害行为"。Anthropic 回应称评测条件"故意宽松",不代表其生产模型,并正与 AISI 合作调查原因。
信息来源:X:Anthropic (@AnthropicAI) · OpenAI / GPT / Claude
观点 / 方法精选
MiniMax-H3 通过 MLX 移植可在 Apple Silicon 上运行
MiniMax 发布 MiniMax-H3,一个可接受文本、图像、音频和视频并生成最长 15 秒带音频视频片段的通用全模态生成系统。Python 包 PipeNetwork/minimax-h3-mlx 将其移植到 MLX,支持 Apple Silicon 运行。作者在 M5 Max MacBook Pro 上实测,下载约 115 GB 模型文件,视频生成耗时不到 45 分钟。
信息来源:Simon Willison 博客
产品发布 / 更新精选
Soup v0.72.4:在4 GB显存笔记本GPU上微调8B模型
Soup 推出 v0.72.4,支持在配备 4 GB 显存的笔记本 GPU 上通过 QLoRA 微调 8B 模型,无需 SSH 或云服务。
信息来源:Hacker News 热门(buzzing.cc 中文翻译)
模型发布 / 更新精选
OpenRouter 上线 FLUX 3 Video 统一多模态模型
@bfl_ai 的 FLUX 3 Video 现已在 OpenRouter 上向所有人开放。 一个统一的视频、音频、图像和动作预测多模态模型家族。严肃、有趣、创意、真实、电影感,随你所需。基于统一架构联合训练。
信息来源:X:OpenRouter (@OpenRouter)
教程 / 实战精选
GitHub 如何用堆叠式 Pull Request 拆解 AI 生成的巨型代码
GitHub 介绍用堆叠式 Pull Request(stacked PR)解决 AI 编码智能体生成巨型代码难以审查的问题。通过将 1,000+ 行的大 diff 按数据、API、接线、UI 拆成 L1-L4 四个独立分层,每层可分配不同审查者。
信息来源:GitHub Blog
产品发布 / 更新精选
Google Cloud 推出 Database Operations Agents,实现自主数据库管理
Google Cloud 在 Agentic Data Cloud 发布中推出两款 AI 数据库智能体:Database Onboarding Agent 负责 Day 0 的配置与部署,Database Observability Agent 负责 Day 1/2 的监控、故障排查与维护。
信息来源:Google Cloud:Databases(RSS)
模型发布 / 更新精选
字节 Seed 发布 SeedRealtime 音视频全双工大模型,走向全模态自然交互
字节 Seed 发布 SeedRealtime,用统一架构原生融合音频、视频与文本,实现"边看、边听、边说"的实时交互。相比级联模型,其音视频对话节奏问题减少一半,并已在豆包 App 全量上线,率先实现音视频全双工技术的规模化落地。
信息来源:字节 Seed:Research Feed(网页内嵌数据) · 豆包
模型发布 / 更新精选
商汤 SenseNova U1 开源:统一推理与图像生成
商汤发布开源模型 SenseNova U1,可在统一流程中同时进行推理与图像生成。其信息图模式可将单条提示词转为结构化幻灯片,交错模式则逐步生成图文内容,如演示六步画龙教程。模型已上线 SenseNova Studio、HuggingFace 及 GitHub。
信息来源:X:商汤 SenseTime (@SenseTime_AI) · Hugging Face
模型发布 / 更新精选
NVIDIA Alpamayo 2 Super 开放商用,面向 Robotaxi 与自动驾驶的前沿开源模型
NVIDIA Alpamayo 2 Super 现已开放商用,基于 Cosmos 3 Super Reasoner 构建,采用强化学习后训练,支持轨迹预测、因果链推理、元动作、自动标注及视觉问答等多任务输出。
信息来源:NVIDIA Blog(RSS) · NVIDIA
产品发布 / 更新精选
NVIDIA 开源 cuFile API,推动 GPU 直连存储
NVIDIA 在 FMS 大会上宣布开源 cuFile API 及底层存储软件栈,让 GPU 可直接读写存储,访问延迟降至微秒级。其 Vera CPU 在两级压缩与加密流水线中吞吐量比 x86 CPU 最高提升 3.21 倍,并联合 40 多家厂商推出 Storage-Next 计划。
信息来源:NVIDIA Blog(RSS) · NVIDIA
行业动态精选
Anthropic 与成立仅数月的云初创公司 Volta 签署 100 亿美元算力协议
Anthropic 与成立仅数月的云初创公司 Volta 签署 100 亿美元算力协议,约合每年 17 亿美元。Volta 估值 24 亿美元,硬件几乎全为租用:算力来自比特币矿商 Bitdeer 挪威 121MW 站点,芯片由 Nvidia 供应、Dell 组装。Anthropic 买的是交付速度,代价是承担超大规模云厂商合同从未有过的交易对手风险。
信息来源:X:Rohan Paul (@rohanpaul_ai) · Claude / NVIDIA
观点 / 方法精选
在单颗 AMD MI300X 上运行 DeepSeek V4 Flash
一个开源仓库提供了在单颗 AMD MI300X 上生产运行 DeepSeek-V4-Flash-0731 的完整配置与补丁,无需额外量化或权重卸载。该 304B 参数模型在 192 GB HBM 上实现单流 168.6 tok/s 解码、8 并发流 542 tok/s 聚合吞吐,并验证了 256K 上下文。
信息来源:Hacker News 热门(buzzing.cc 中文翻译) · DeepSeek
行业动态精选
工信部发布首部L3/L4自动驾驶系统安全要求强制性国标,2027年7月实施
工信部组织制定的《智能网联汽车 自动驾驶系统安全要求》(GB 44721-2026)强制性国家标准获批发布,拟于2027年7月1日起实施。这是我国首部针对L3级有条件自动驾驶和L4级高度自动驾驶系统的强制性国标,由2024年推荐性国标GB/T 44721-2024升级而来,为自动驾驶产品明确了统一的安全准入基线。
信息来源:IT之家(RSS)
产品发布 / 更新精选
Reflex 开源 XY:基于 Rust 的超快 Python 绘图库,可保持 1 亿点图表交互流畅
Reflex AI 发布 Apache-2.0 许可的 Python 交互式 2D 绘图库 XY,通过 Rust 原生核心、二进制缓冲传输和 WebGL2 渲染,在 1 万至 1 亿点范围内保持约 0.08 秒的渲染时间。
信息来源:MarkTechPost(RSS)
教程 / 实战精选
用 NVIDIA SkillSpector、LangGraph、YARA 规则、SARIF 与 CI 策略门构建高级 AI 技能安全审计流水线
本教程演示如何用 NVIDIA SkillSpector 评估 AI 技能的安全态势,构建包含干净、风险、恶意及 MCP 示例的合成技能市场,并通过 LangGraph 检查流水线扫描每个技能。
信息来源:MarkTechPost(RSS) · NVIDIA
模型发布 / 更新精选
腾讯混元发布 Hy ASR 3.0 preview:真正懂上下文的语音识别
腾讯混元发布新一代语音识别模型 Hy ASR 3.0 preview,基于大语言模型 Hy3 与 MoE 架构,融合高精度识别与语义理解。其在开源评测集中中文普通话 WER 3.34%、英语 WER 2.62%、粤语 WER 3.12%,并支持上下文纠错、热词注入及高噪耳语等场景。该模型已上线腾讯云 API,元宝 App 首发并免费开放。
信息来源:公众号:腾讯混元
产品发布 / 更新精选
Swiftlet:在 Mac 上运行 80B 版 Qwen(内存 4.3 GB),在 iPhone 上运行 35B 版
Swiftlet 是一个 Swift + Metal 运行时,可在普通 Apple 设备上运行 Qwen3-Next 和 Qwen3.5/3.6 MoE 混合模型,仅将小型稠密核心驻留内存,按需从存储流式加载路由专家权重。
信息来源:Hacker News 热门(buzzing.cc 中文翻译) · Qwen
行业动态精选
GPT-5.6 Luna降价80%永久生效
有些人显然误解了,但 GPT-5.6 Luna 降价 80% 不是临时噱头,而是永久的。效率提升不会消失。幸运的是。
信息来源:X:Tibo (@thsottiaux) · GPT
产品发布 / 更新精选
面壁智能开源 ForgeStencil:一周自动优化 100+ 工业与科学软件,全程零人工介入
面壁智能联合 OpenBMB 开源全球首个支持 Stencil 自动研究、自动部署的 AI 优化系统 ForgeStencil,由 Kernel Agent 与 App Agent 闭环协作,实现从算子优化到应用集成的全自动流程。
信息来源:公众号:面壁智能(MiniCPM)
教程 / 实战精选
从零开始,教你用Codex搓出属于你自己的第一个硬件
作者以零基础身份,全程通过与Codex对话,从需求讨论、电路搭建、代码烧录到3D打印组装,5天内做出一个能提醒久坐的猫爪硬件。文中还介绍了用Agent调试宏键盘、以及OpenAI与Work Louder联名发布的Codex Micro键盘(13个机械按键,售价230美元)等案例,强调"干中学"的AI开发方式。
信息来源:公众号:数字生命卡兹克 · OpenAI
论文研究精选
SIGNPOST-Bench:多模态大模型文本-视觉冲突消解新基准
SIGNPOST-Bench 是一个用于评估多模态大模型文本-视觉冲突消解能力的受控反事实基准,包含来自四个数据集的 5,111 个反事实组和 25,555 个图像变体。
信息来源:HuggingFace Daily Papers(社区热门论文) · Hugging Face
论文研究精选
Any-OPD:面向流匹配模型的异构同策略蒸馏框架
Any-OPD 提出首个支持任意异构流匹配生成器对的同策略蒸馏框架,仅通过冻结的 DINOv2 表示空间桥接教师与学生模型,无需共享 VAE、架构或噪声调度。将 FLUX.1-dev 蒸馏至 SD3.5-Medium 后,学生模型 PickScore 与 HPSv3 均显著提升,以教师五分之一的参数量达到接近其性能,而直接潜在回归训练完全失败。
信息来源:HuggingFace Daily Papers(社区热门论文) · Hugging Face
观点 / 方法精选
追逐杰文斯悖论:AI 定价分层能否延续需求增长?
AI 供给持续紧张,但价格不降反升:Anthropic 7 月 24 日发布的 Fable 5 定价每百万输出 token 50 美元,翻倍于 Opus 5;OpenAI 则在五天后将 GPT-5.6 Luna 价格下调 80%。
信息来源:Tomer Tunguz 博客(VC 分析) · OpenAI / GPT / Claude