AI 情报文章归档
浏览 AI圈报 已保存的 5771 条 AI 情报文章,覆盖模型、产品、行业、论文、教程与观点方法六大分类。
已收录文章5771
正式分类6
精选内容3361
全部文章
第 91 / 145 页 · 每页 40 条
产品发布 / 更新精选
Midjourney V8.1 发布大批次草稿模式
我们发布了 V8.1 的新大批次草稿模式。该新模式可让你生成 24 张低分辨率图像,价格仅为标准分辨率四图 Midjourney 任务的一半。当你喜欢某张图像时,只需按下 "Vary" 即可获得全分辨率的新版本。尽情享受吧!
信息来源:X:Midjourney (@midjourney)
论文研究精选
NVIDIA GEAR实验室发布ENPIRE:8个Codex智能体自主控制机器人完成物理实验
NVIDIA GEAR实验室推出ENPIRE系统,首次实现物理世界自主研究。系统让8个Codex智能体控制8台机器人,配备GPU和token预算。安全方面采用硬运动极限切断和扭矩受限夹爪两层硬件保障,支持通宵无人运行。奖励函数通过视觉分类器离线固定并冻结,防止智能体作弊。实时监测机器人利用率(MRU)、token利用率(MTU)和GPU利用率,以Tokens-to-Success和Time-to-Success评估效率。ENPIRE自主完成扎带、整理细针、安装GPU等高精度…
信息来源:X:Jim Fan (@DrJimFan) · NVIDIA
产品发布 / 更新精选
Google发布99美元Gemini智能音箱
Google推出首款专为Gemini打造的智能音箱Google Home Speaker,售价99.99美元。支持自然语言请求和多步指令,可在说话中途纠正,并具备连续对话功能。内置10种新声音。高级AI功能需订阅Google Home Premium(月费10美元或年费100美元),包括Gemini Live自由对话、Nest摄像头活动摘要等。即日起预售,本月发货。
信息来源:TechCrunch:AI(RSS) · Gemini
产品发布 / 更新精选
Claude Enterprise 推出企业托管 MCP 连接器授权管理
Claude Enterprise 推出企业托管授权功能,管理员可通过身份提供商(率先支持 Okta)为整个组织配置 MCP 连接器。用户首次登录 Claude 时自动获得授权,无需手动操作,实现零接触设置。该功能基于 Model Context Protocol 的 Enterprise-Managed Authorization 扩展构建,支持 Asana、Atlassian、Canva、Figma、Granola、Linear、Supabase 等 MCP 提供商,S…
信息来源:Claude:Blog(网页) · Claude
产品发布 / 更新精选
Claude Code 现已支持 artifacts
从今日起,Claude Code 可将工作进度生成为 artifacts--实时、可分享的交互式网页,涵盖 PR 走查、系统说明、仪表盘、发布清单等。artifacts 基于会话完整上下文(代码库、连接器、对话)自动构建,更新时页面原地刷新,同事即时可见。默认仅作者可见,可分享给组织内成员,由管理员通过组织层级开关和角色权限管控。内部测试中最常见用例为调试:工程师调查事件,Claude Code 分析日志并发布包含时间线、嫌疑提交和错误率图表的 artifact,团队无需再…
信息来源:Claude:Blog(网页) · Claude
论文研究精选
Anthropic Project Fetch 第二阶段:Claude Opus 4.7 自主完成任务,速度比人类团队快约20倍
Anthropic 发布 Project Fetch 实验第二阶段结果。在2024年8月原始实验中,配备 Claude Opus 4.1 的人类团队在操控四足机器人时显著超越无 AI 团队。新实验中,Claude Opus 4.7 无需人类协助即完成所有任务,速度比最快人类团队快约20倍,比无 Claude 团队快37倍以上,编码量减少近10倍。模型在传感器连接、路径规划等环节表现出色,但在精确移动沙滩球等闭环控制任务上仍存在困难。这些进展源于通用模型规模化,而非针对机器人…
信息来源:Anthropic:Research(发表成果 · 网页) · Claude
论文研究精选
CyberGym-E2E:AI智能体端到端网络安全能力的大规模真实世界基准
CyberGym-E2E 是一个包含920个真实漏洞、覆盖139个开源项目的大规模端到端网络安全基准。任务要求AI智能体在真实代码库中自行定位漏洞、生成触发崩溃的概念验证并编写补丁。测试表明:若直接给出漏洞位置,最强配置可修复约80%漏洞;但若需自行发现,端到端成功率急剧下降--Claude Opus 4.5仅19.2%,最新模型在37%-66%之间。智能体可能发现替代漏洞,且存在部分浅层补丁。所有漏洞已事先公开披露并修复。
信息来源:Berkeley RDI:Blog(AI 安全与评测) · Claude
观点 / 方法精选
驾驭 Claude Code:CLAUDE.md、技能、钩子、规则、子智能体等
Claude Code 提供七种自定义指令方式:CLAUDE.md(根目录始终加载,子目录按需加载)、规则(无范围或路径范围)、技能(按需调用,共享 token 预算)、子智能体(隔离上下文运行并返回最终消息)、钩子(生命周期事件触发,绕过压缩)、输出样式(注入系统提示,永不压缩)和附加系统提示(CLI 标志,仅单次有效)。每种方式在加载时机、压缩行为、上下文成本和适用场景上各有不同,例如 CLAUDE.md 适合存放构建命令与编码规范,路径范围规则避免无关上下文消耗,子智…
信息来源:Claude:Blog(网页) · Claude
产品发布 / 更新精选
Omnigent开源:AI智能体团队元框架
编程的未来不是单一智能体,而是一个完整的AI团队。 Omnigent让你在一个实时会话中运行一个智能体团队:Claude Code、Codex、Cursor、Pi,以及你自己的智能体。 它是一个面向AI智能体的元框架,基于我们内部的Databricks开发工具构建,现已开源给所有人。 由传奇人物@matei_zaharia和Databricks AI团队打造。没错,Matei仍然编写大量代码,包括Omnigent和我们产品的前端代码。
信息来源:X:Yuchen Jin (@Yuchenj_UW) · Claude / Cursor
模型发布 / 更新精选
MolmoMotion:语言引导的3D运动预测模型
MolmoMotion基于Molmo 2骨干网络,输入视频帧、物体上的3D点标记及文字动作指令(如"移动并旋转桌上放水果的木碗"),预测未来数秒内这些点的3D轨迹。提供两个变体:自回归的MolmoMotion-AR逐步预测坐标,流匹配的MolmoMotion-FM通过连续空间变换处理多可能性运动。同时发布MolmoMotion-1M数据集(含116万视频的3D点轨迹及动作描述)和PointMotionBench基准测试(2700个人工验证视频片段)。模型权重、数据集和基准测…
信息来源:Hugging Face:Blog(RSS) · Hugging Face
论文研究精选
Google 医学推理 AI 系统 AMIE 新研究:从诊断迈向长期疾病管理
今日发表在《自然》杂志上的研究展示了 Google 的医学推理 AI 系统 AMIE(Articulate Medical Intelligence Explorer)从单次诊断对话演进到长期疾病管理的能力。AMIE 利用 Gemini 模型的长上下文能力,整合共情对话智能体和深度思考管理推理智能体,可交叉引用数百页临床指南。在盲测中,AMIE 与 21 名初级保健医生相比,在整体管理推理上匹配临床医生,在计划精确性和指南一致性上得分显著更高。
信息来源:Google Blog:AI(RSS) · Gemini
教程 / 实战精选
如何在 OpenRouter 上使用 OpenAI Codex CLI
Codex CLI 支持自定义 OpenAI 兼容提供商,只需在 config.toml 中配置即可将请求路由到 OpenRouter。用户无需修改 Codex 本身,就能获得提供商故障转移、使用跟踪以及跨所有模型的统一密钥。
信息来源:OpenRouter:Announcements(RSS) · OpenAI
产品发布 / 更新精选
阿里云发布HappyOyster 1.0:一句话生成可实时交互的数字世界
6月17日,阿里云发布开放式世界模型HappyOyster 1.0(快乐生蚝)。该产品基于原生多模态架构,支持多模态输入与音视频联合生成,可在生成过程中持续接收用户指令并实时响应画面。它深度学习物理世界状态转移规律,保持人物和环境长程一致性。官网开放"实时导演"与"世界探索"两种玩法:前者可随时叫停改写故事、与虚拟男友实时互动等;后者支持自由漫游、滑板冲刺、翼装滑翔、骑马奔驰、攻击打怪等交互。该产品已于今年4月16日开放内测,即日起至7月17日官网不定期掉落体验积分。
信息来源:IT之家(RSS)
产品发布 / 更新精选
Strands Robots SDK:用单一智能体打通 Hugging Face Hub 到物理机器人
AWS(Apache 2.0)开源的 Strands Robots SDK 将 LeRobot 栈封装为 AgentTools,构建统一智能体。默认用 MuJoCo 模拟(无需硬件),mode="real" 切换至真实机器人。可记录演示数据为 LeRobotDataset 并推送 Hugging Face Hub,运行 GR00T 或 LerobotLocal 策略推理,经 Zenoh mesh 广播命令到多台机器人。模拟与硬件代码完全一致,只需改一个关键字参数。示例可在笔…
信息来源:Hugging Face:Blog(RSS) · Hugging Face
产品发布 / 更新精选
Kickart 3.0发布,让广告视频创作更精准高效
火山引擎一站式营销创作平台Kickart 3.0(原"创作Agent")正式上线,升级为对话式视频生成模式,用户可通过多轮对话调整商品图、故事板等,用自然语言生成营销视频。新增"爆款裂变"能力,上传视频链接后自动拆解爆款逻辑并重构至新商品视频,支持抖音电商内容合规与质量预审核。平台开放SaaS、API及Skill等多种交付方式,并已接入Seedance 2.0 mini,助力降低广告营销成本。
信息来源:公众号:火山引擎
模型发布 / 更新精选
GLM-5.2:为长周期任务而生
GLM-5.2 发布,支持 1M token 上下文,采用 IndexShare 架构--每 4 个稀疏注意力层共用一个轻量索引器,将 1M 上下文下每 token FLOPs 降低 2.9 倍;MTP 层改进使推测解码接受长度提升 20%。长周期编码基准上,FrontierSWE 落后 Opus 4.8 仅 1%、领先 GPT-5.5 1%;PostTrainBench 仅次于 Opus 4.8;SWE-Marathon 落后 Opus 4.8 13% 但排名第二。标准编…
信息来源:Hugging Face:Blog(RSS) · GPT / GLM / Hugging Face
模型发布 / 更新精选
MiniMax 发布 MSA 稀疏注意力方法,开源推理内核并推出 MiniMax-M3 模型
MiniMax 发布 MSA(MiniMax Sparse Attention),一种构建在 Grouped Query Attention 上的稀疏注意力方法。它将注意力分解为索引分支与主分支:索引分支以块粒度(默认 128 token)为每个 GQA 组选择 16 个 token 块(固定预算 2048 个键值 token),主分支仅在这些块上执行精确 softmax 注意力。MSA 在 109B 参数 MoE 模型上训练,开源了面向 NVIDIA SM100 GPU …
信息来源:MarkTechPost(RSS) · NVIDIA
模型发布 / 更新精选
GLM-5.2 开源登顶全球评测,与 Opus 4.8 持平
智谱今日开源 GLM-5.2,在 Artificial Analysis 综合评测中以 51 分排名全球前三、开源模型第一,与 Claude Opus 4.8 持平。该模型在 Code Arena 前端代码生成中获 1,595 分排名第二,在 DesignArena 设计编码场景中以 1,360 分夺冠,并在软件工程基准 FrontierSWE 中位列第三。
信息来源:X:唐杰(@jietang) · GPT / Claude / GLM
行业动态精选
消息称 OpenAI 今年一季度现金消耗达 37 亿美元,超同期收入的一半
OpenAI 在 2026 年第一季度现金消耗达 37 亿美元,超过同期 57 亿美元收入的一半。数据来自一份向股东披露的文件,直观体现 AI 大模型研发与规模化落地的巨额成本。OpenAI 正筹备上市,已在美国保密递交 IPO 申请,最早或于 9 月完成,估值最高可达 1 万亿美元。头部 AI 企业持续重金投入算力、模型研发与人才招募以维持竞争优势。
信息来源:IT之家(RSS) · OpenAI
观点 / 方法精选
GPT-Realtime-2:用语音控制操作系统
Greg Brockman 称 GPT-Realtime-2 是全新事物。@per_simmons_ 体验数周后表示,GPT-Realtime-2 是操作系统的未来,仅用语音即可打开应用、搜索网页、编辑 Premiere Pro,设置只需几个提示词且无需编码。视频演示了通过 MCP 连接 Obsidian 以及利用无障碍树控制 Premiere Pro 等功能。
信息来源:X:Greg Brockman (@gdb) · GPT
产品发布 / 更新精选
Wolfram 语言和 Mathematica 15 版发布:内置 AI 助手、符号音乐等新功能
在 Mathematica 诞生近 38 年后,Wolfram 语言与 Mathematica 发布 Version 15。每个笔记本内置 AI 助手,支持从 AI 环境中直接调用 Wolfram 技术。新增符号音乐系统、大规模时间序列与事件序列处理、分类数据计算、模型拟合超函数 ModelFit。笔记本支持千兆字节级大小与实时查找,首次引入侧边栏、视觉主题及弃用功能样式。强化了表格连接、多点可视化、图形刻度绘制与轨道运行计算等功能。DSolve 拐角处获得 AI 方法辅助…
信息来源:Hacker News 热门(buzzing.cc 中文翻译)
行业动态精选
中国加紧筹建世界人工智能合作组织
中国正加紧筹建世界人工智能合作组织,欢迎各方加入。2025年7月26日,中国政府倡议成立该组织,作为践行多边主义、推动共商共建共享全球治理的举措,旨在弥合数字和智能鸿沟、促进人工智能向善普惠发展。初步考虑总部设在上海。同日,2025世界人工智能大会发表《人工智能全球治理行动计划》,呼吁各方遵循向善为民、尊重主权、发展导向、安全可控、公平普惠、开放合作的原则,协力推进全球人工智能发展与治理。
信息来源:IT之家(RSS)
观点 / 方法精选
GLM-5.2上线并开源:专注Coding与长程任务
智谱上线并开源GLM-5.2,在Code Arena盲测中取得全球可用模型第一。该模型实现1M无损上下文,在FrontierSWE上仅比Opus 4.8低1%,在Terminal-Bench 2.1上相比GLM-5.1提升17.5%。模型已通过Hugging Face与ModelScope开源,采用MIT协议,API同步上线。
信息来源:公众号:智谱(GLM) · GLM / Hugging Face
模型发布 / 更新精选
Sumi:从头训练的7B开源均匀扩散语言模型
Sumi(日语"墨")是一个完全开源的7B参数均匀扩散语言模型,从零开始在1.5T模型token上预训练。它在知识、推理和编程评测中与同等token预算的自回归模型表现相当,但在常识推理benchmark上略逊,教育密集型数据混合可能是原因之一。Sumi开放模型权重、检查点及完整训练配方(含公开语料数据混合说明),为社区提供首个大规模均匀扩散模型的基准参考。
信息来源:HuggingFace Daily Papers(社区热门论文) · Hugging Face
模型发布 / 更新精选
Grok 4.3 在 Amazon Bedrock 正式可用
6 月 17 日,xAI 宣布 Grok 4.3 在 Amazon Bedrock 上全面可用。该模型在前沿模型中达成最低幻觉率,支持 100 万 token 上下文窗口,并提供可配置推理努力(none/low/medium/high)。在 Artificial Analysis Omniscience 基准排名第一,在 Tau2 Telecom 基准评估客服智能体真实工具调用性能排名第一,在 Vals AI Case Law 和 Corporate Finance 基准的…
信息来源:xAI:News(网页) · Grok
论文研究精选
LifeSciBench 发布
2026 年 6 月,OpenAI 联合 173 位博士级生命科学家发布 LifeSciBench 评测基准,涵盖 750 个真实研究任务,覆盖证据处理、分析、设计优化等七个工作流及七个生物领域。每项任务配有约 25 条细化评分标准(共 19,020 条),评估模型的科学正确性与实用价值。79% 的任务需多步推理,53% 要求解读图表、PDF 等附件数据,旨在衡量 AI 在复杂、不确定的研究任务中的实际能力,而非仅回答结构化问题。
信息来源:OpenAI:官网动态(RSS · 排除企业/客户案例) · OpenAI
模型发布 / 更新精选
智谱发布旗舰模型 GLM-5.2,实现稳定 1M token 长程任务能力
智谱发布 GLM-5.2,首次在 1M token 上下文中实现稳定长程任务能力。其 IndexShare 架构将每四个稀疏注意力层共享同一索引器,使 1M 上下文下每 token FLOPs 降低 2.9 倍。模型采用 MIT 开源协议,无区域限制。
信息来源:X:唐杰(@jietang) · GLM
观点 / 方法精选
人工智能是否已经让自助类非虚构书籍销声匿迹了?
2026年Q1美国成人非虚构书籍销量同比下降9%,自助类下跌26.3%,仅手工艺/爱好/古董/游戏和宗教两个子类别增长。一位出版了多本《纽约时报》畅销书的作者透露,其五本书的印刷版年销量从2022年基准连续下滑:2023年-5%,2024年-13%,2025年-46%,2026年年化跌幅达-57% vs 2025年;若持续,2026年销量将比2022年减少约80%。所有格式在2025年下半年环比上半年下降约45%。作者认为,Claude、ChatGPT等大语言模型能提供更快…
信息来源:Hacker News 热门(buzzing.cc 中文翻译) · ChatGPT / Claude
行业动态精选
Anthropic 5月企业AI订阅份额首超OpenAI,特朗普政府禁令反促采用量创新高
Anthropic 5月企业AI订阅市场份额达41%,首次超越OpenAI(39.5%)。公司刚完成650亿美元融资、估值9650亿美元,并因首次盈利季度秘密提交IPO。特朗普政府以出口管制为由要求Anthropic禁止非美国人访问最新模型Mythos 5及Fable 5,导致两款模型下架。Ramp首席经济学家指出,类似争议(如3月被国防部列为供应链风险)反而推动Anthropic企业采用量创纪录。Ramp数据显示,企业支出主要流向Claude Opus模型(最新为Opus…
信息来源:TechCrunch:AI(RSS) · OpenAI / Claude
产品发布 / 更新精选
Midjourney V8.1 推出 Draft mode 草稿模式与新功能预览
Midjourney V8.1 的 Draft mode 草稿模式每次生成24张低分辨率低质量图片。用户可对任意图片点击 "Vary",将其渲染为全质量、全分辨率版本。草稿任务消耗的快速小时数减半。
信息来源:Midjourney:Updates(RSS)
观点 / 方法精选
OpenAI 的领先优势正在快速缩小
评论认为 OpenAI 正面临多重危机:缺乏护城河导致市场领先地位下滑;最大投资者微软持续疏远,近期甚至公开考虑将主要产品外包给中国;亏损速度远超预期,年亏损额以 8 倍增长。华盛顿方面可能打压 Anthropic,但也可能反而帮助其崛起,而 Elon Musk 成为另一个潜在的竞标者。
信息来源:Gary Marcus:The Road to AI We Can Trust(RSS) · OpenAI / Claude
行业动态精选
美商务部要求Anthropic禁止出口Fable 5和Mythos 5
美国商务部长Howard Lutnick告知Anthropic,出口其最新模型Fable 5和Mythos 5至全球任何地方均需政府许可,甚至禁止向任何国籍的海外人士提供。Lutnick在信件中威胁,若不遵守将面临刑事和民事处罚。Anthropic回应:禁用这两个模型。推文作者指出,连友好国家也被排除在SOTA模型之外,AI正从私人公司转向政府控制。该信件全文由Bloomberg公开。
信息来源:X:Kim (@kimmonismus) · Claude
产品发布 / 更新精选
LangChain 发布 Open SWE:开源异步编码智能体
LangChain 推出 Open SWE,一个开源、云端托管的编码智能体,可自主处理 GitHub 任务,包括规划、编码、测试和提交 PR。该智能体采用异步架构,旨在提升开发效率。
信息来源:LangChain:Blog(RSS)
观点 / 方法精选
使用OpenRouter连接Claude Code
设置三个环境变量即可将Claude Code连至OpenRouter,无需本地代理或Docker。OpenRouter提供供应商故障转移、预算控制与用量监控,支持Anthropic Skin原生协议,保留Thinking、工具调用、流式输出。可为Opus(架构推理)、Sonnet(日常编码)、Haiku(快速转换)分别指定模型。Fast Mode最高2.5倍速度,仅限Claude Opus 4.6/4.7/4.8,需Claude Code v2.1.96+。团队场景:一个O…
信息来源:OpenRouter:Announcements(RSS) · Claude
观点 / 方法精选
Meta 解散工程部门引发热议
6月16日,一篇标题为"Why is Meta destroying its engineering organization?"的博客文章出现在 Hacker News,获得110个点赞。文章指出 Meta 正在解散其工程组织,引发业界广泛讨论。具体原因和后续影响尚未明确。
信息来源:Hacker News 热门(buzzing.cc 中文翻译)
行业动态精选
微软考虑为 Copilot Cowork 集成 DeepSeek V4
微软正考虑为 Copilot Cowork 提供微软托管的 DeepSeek V4 版本,作为更便宜的模型选项。Copilot Cowork 将放弃无限定价,转向按使用量计费,原因是成本过高(用户每周执行数百项任务导致费用激增)。若采用 DeepSeek,该模型将是可选的、经过微调与安全防护,并完全托管于 Azure。Axios 报道称微软已微调了一个可用模型,最终决定待定。
信息来源:X:Kim (@kimmonismus) · DeepSeek
论文研究精选
公开聊天数据能否预测真实世界AI失调?
OpenAI利用WildChat公开数据集(2023年4月至2024年5月收集的100万条对话)模拟模型部署,预测GPT-5.1、GPT-5.2、GPT-5.4在真实生产环境中的不良行为率。与私有生产数据对比发现,WildChat模拟的平均预测误差约3倍;但对技术性和智能体型失调的预测精度下降。研究验证了公开数据集作为外部审计工具的可行性。
信息来源:OpenAI:Alignment 研究博客(RSS) · OpenAI / GPT
行业动态精选
Fable 遭美国政府封禁,TechCrunch 质疑真正原因并非模型越狱
美国政府对 Anthropic 的模型 Fable 实施封禁,但 TechCrunch 发文质疑,实际原因可能并非此前认为的"模型越狱"问题。该文章在 Hacker News 引发讨论,获得 103 个点赞。
信息来源:Hacker News 热门(buzzing.cc 中文翻译) · Claude
产品发布 / 更新精选
NVIDIA GEAR 实验室推出 ENPIRE:首次在物理世界启用 AutoResearch
NVIDIA GEAR 实验室首次在物理世界启用 AutoResearch,推出 ENPIRE 项目。给 8 个 Codex 智能体分配机器人舰队、GPU 和 token 预算,目标快速安全完成任务。人类退出后,机器人舰队自主学会寻找视觉线索、重置场景、练习新技能、调整控制栈、阅读论文、辩论反思。ENPIRE 能高精度完成扎带、整理细针、安装 GPU 等任务。发现物理扩展:8 机器人并行探索比少机器人效率显著提升。实验室部分可整夜自我改进,早上读取报告。所有内容将开源。
信息来源:X:Jim Fan (@DrJimFan) · NVIDIA
论文研究精选
用SGLang-JAX在TPU上优化Ling-2.6-1T:一个Pallas核将MoE数据移动隐藏在计算中
SGLang-JAX现已支持inclusionAI的Ling-2.6-1T(1T稀疏MoE,63B激活参数,256路由专家,top-8路由加共享专家)在TPU v7x上高效推理。团队开发了Fused MoE V2--一个融合scatter、专家FFN和gather的Pallas核,通过将MoE数据移动隐藏在计算中,使MoE预填充延迟从5.16ms降至2.42ms(降幅53%),解码核延迟从0.249ms降至0.211ms(降幅约15%)。仅替换MoE核即提升预填充吞吐量24…
信息来源:LMSYS:Blog(Chatbot Arena 团队)