AI 情报文章归档
浏览 AI圈报 已保存的 5880 条 AI 情报文章,覆盖模型、产品、行业、论文、教程与观点方法六大分类。
已收录文章5880
正式分类6
精选内容3375
全部文章
第 82 / 147 页 · 每页 40 条
论文研究精选
宇树G1人形机器人完成首例活体微创手术
一篇新的《自然》论文展示了宇树G1人形机器人执行研究人员所称的首例由人形机器人完成的活体标准微创手术。加州大学圣地亚哥团队使用G1,以常规手术器械完成了对两只活猪的腹腔镜胆囊切除术;第二次手术耗时32分钟。该机器人仍需反复校正,且尚无法满足手术无菌标准,但其成本可能仅为达芬奇系统的约5%。
信息来源:X:X.PIN (@thexpin)
产品发布 / 更新精选
Claude Code桌面版新增应用内浏览器
Claude Code 桌面版现在有了应用内浏览器。 Claude 可以调出文档、设计稿或任何其他网站。它可以像操作本地开发服务器一样,进行阅读、点击浏览和交互。 该浏览器采用沙盒机制且可配置:你可以自行选择会话是否持久保留。
信息来源:X:Claude Devs (@ClaudeDevs) · Claude
产品发布 / 更新精选
Greg Brockman 推出开源项目 Tend,将收件箱等转化为 AI 循环系统
OpenAI 联合创始人 Greg Brockman 宣布推出实验项目 Tend,这是一个开源提示词和代码仓库,可将收件箱、招聘流程或客服队列转化为可在 ChatGPT Work 中管理的 AI 循环系统。Tend 基于 GPT-5.6 构建,能自动扫描邮件、判断优先级、研究上下文并生成摘要和回复建议,用户可批准或编辑。每次处理后,智能体从用户修订中学习并记住偏好。Brockman 认为知识工作正从处理单个任务转向管理 AI 循环系统。
信息来源:X:Greg Brockman (@gdb) · OpenAI / ChatGPT / GPT
产品发布 / 更新精选
ChatGPT Work 将智能体推向消费级规模
ChatGPT Work 将智能体带到消费级规模。 它在可用性(你只需在手机上操作,无需笔记本电脑)和可及性上都有提升,适用于个人和职业生活。 非常期待看到人们如何使用它,以及它如何赋能用户!
信息来源:X:Greg Brockman (@gdb) · ChatGPT
行业动态精选
Mira Murati 新公司 Thinking Machines Lab 获 20 亿美元融资
Mira Murati 创立的 Thinking Machines Lab 宣布获得 20 亿美元融资,由 a16z 领投,NVIDIA、Accel 等参投。公司专注于多模态 AI、定制模型和开放科学,将在未来几个月推出首款产品,包含重要的开源组件,面向研究人员和初创公司。
信息来源:X:Mira Murati(@miramurati) · NVIDIA
产品发布 / 更新精选
Perplexity 推出跨模型信用额度分析功能
推出 Computer Analytics:你现在可以跨模型跟踪信用额度支出。 该功能现已面向个人和企业用户开放,可在账户设置的 Analytics 下使用。
信息来源:X:Perplexity (@perplexity_ai)
行业动态精选
OpenAI高管Fidji Simo因慢性疾病加重辞去全职职务,转为兼职顾问
OpenAI高管Fidji Simo宣布因慢性疾病加重,辞去全职职务,转为兼职顾问。三个月前她因病情恶化休病假,意识到康复之路漫长复杂,需全力专注健康。她回顾自己曾因工作错过休整机会,包括拒绝Facebook提供的一年病假。她表示将继续通过OpenAI及ChronicleBioAI、CODA_research推动AI在疾病治疗等领域的应用。OpenAI联合创始人Greg Brockman发文感谢她的贡献,并祝愿她早日康复。
信息来源:X:Greg Brockman (@gdb) · OpenAI
产品发布 / 更新精选
百度搭子在成都AI Day发布四项更新:个人版升级、自媒体套件、企业版及搭子联盟
百度搭子在成都百度AI Day上发布四项更新。个人版新增浏览器调用、智能路由(平均任务耗时降20%,Token利用率提升25%)、多端共享记忆及强化PPT生成,并上架"一镜"数字人制作、"灵医"报告解读等Skill。行业首个自媒体专业套件支持选题到复盘全链路。企业版支持团队协作与权限管理。搭子联盟启动,中国联通等已加入。上线三个月,日均提问量增长20倍。
信息来源:公众号:百度智能云(文心)
论文研究精选
小红书发布大模型新架构 PIPO
小红书提出 PIPO 架构,通过输入侧压缩器将两个 token 折叠为一个 latent,输出侧 MTP head 将隐藏状态展开为额外 token,实现输入长度减半、每步输出翻倍。基于 Qwen3.5-4B/9B backbone,在 AIME 2025 等基准上最高带来 +7.15 pass@4 提升。部署测评中,TTFT 加速约 1.23×,TPOT 加速约 1.86×。训练采用 SFT 和 On-Policy Distillation 两阶段,将 verifier …
信息来源:公众号:小红书技术(dots.llm) · Qwen
行业动态精选
扎克伯格首度回应 Meta"算力过剩":没人会嫌算力太多,但租出去更赚钱
Meta CEO 扎克伯格首次正面回应公司筹划云基础设施业务一事,否认"算力过剩"猜测,称内部算力需求依然旺盛、满负荷运转。但他同时表示,当前市场对算力出价极高,将部分 AI 基础设施对外出租在财务上更划算。Meta 正制定代号"Meta Compute"的云计算计划,包括开放模型访问权限和直接出租裸算力两条路线。扎克伯格还提及 SpaceX 以每月 12.5 亿美元将数据中心租给 Anthropic 的模式。Meta 2026 年资本支出指引达 1250 亿至 1450 …
信息来源:IT之家(RSS) · Claude
观点 / 方法精选
马斯克承认Anthropic是当前AI领导者
马斯克在X上发文承认自己此前对Anthropic的判断有误,称其"显然是当前AI领域的领导者"。他表示,没有公司发布过像Mythos/Fable这样优秀的模型,并相信Anthropic很快会推出Mythos 2。他还强调,即使作为竞争对手,也不会以伤害对方的方式切断合作,并列举了特斯拉开源专利、开放超级充电网络等先例。该推文被Rohan Paul转发,称这是Anthropic"最强有力的炫耀"。
信息来源:X:Rohan Paul (@rohanpaul_ai) · Claude
观点 / 方法精选
Elon Musk 转发用户称赞 Grok Build 的反馈
Elon Musk 转发用户 @0x0funky 对 Grok Build 的称赞。该用户称 Grok Build 是目前唯一集大成的 coding agentic workflow,内建图像生成和图片生视频功能,生图速度快且品质不输 Codex。Agent 可直接完成图像与视频生成,无需额外串接 MCP 或外部服务。用户结合 Agent Sprite Forge 工具,利用 Grok Build 的视频生成能力,先产出 6 秒角色动作视频再反编译为 game sprite…
信息来源:X:Elon Musk (@elonmusk, xAI) · Grok
模型发布 / 更新精选
GPT-5.6 Sol 发布,速率限制将重置两次
为庆祝 GPT-5.6 Sol 发布,我们将在接下来 24 小时内(两次)重置 ChatGPT Work 和 Codex 的速率限制。 我们希望你有时间真正尝试有挑战性的任务并掌握它。祝探索愉快!
信息来源:X:Tibo (@thsottiaux) · ChatGPT / GPT
产品发布 / 更新精选
Claude Code v2.1.206 发布
Claude Code v2.1.206 发布,主要更新包括:为 `/cd` 命令添加目录路径建议;新增 `/doctor` 检查以建议修剪 CLAUDE.md 文件中模型可从代码库推导的内容;`/commit-push-pr` 现在自动允许 git push 到仓库配置的推送远程仓库;`/login` 支持 Anthropic 运营的公共网关端点;后台智能体在更新后自动升级。修复了过期登录导致所有模型报错、`claude --resume` 和 `--continue` …
信息来源:Claude Code:GitHub Releases(RSS) · Claude
论文研究精选
GenCeption:视频生成模型作为通用视觉学习器
论文提出 GenCeption,利用预训练文本到视频扩散模型作为前馈感知骨干,通过文本指令驱动完成深度估计、表面法线、相机位姿、指代分割和 3D 关键点预测等多种视觉任务。GenCeption 在多个基准上达到 SOTA,匹配或超越 DepthAnything3、SAM3、D4RT、VGGT-Omega 等专用模型。视频生成预训练骨干在同等设置下优于 V-JEPA 和 Video MAE 等替代范式。GenCeption 展现出数据与模型缩放特性,仅用 7 到 500 倍更…
信息来源:HuggingFace Daily Papers(社区热门论文) · Hugging Face
观点 / 方法精选
Thinking Machines Lab:构建延伸人类意志与判断的 AI
Thinking Machines Lab 在官方博客中阐述其使命:构建能够延伸人类意志与判断的 AI。文章指出,当前多数 AI 在少数地方训练后便冻结,无法被使用者塑造。该实验室正致力于训练具备多模态交互和可定制化能力的强模型,开发允许用户训练模型权重的工具,并构建拓宽人机沟通渠道的界面。其核心理念是让 AI 服务于分布式的人类知识,使每个组织都能利用自身独特知识微调模型,并持续适应知识演变。
信息来源:Thinking Machines Lab:官方博客(RSS)
产品发布 / 更新精选
Show HN: 如何在我的低配置电脑上运行 GLM-5.2
colibrì v1.0 引擎以纯 C 实现、零运行时依赖,可在约 25 GB RAM 的消费级电脑上运行 744B 参数的 GLM-5.2 MoE 模型。模型经 int4 量化后磁盘占用约 370 GB,常驻内存仅 9.9 GB,通过流式加载磁盘专家实现推理。冷解码速度约
信息来源:Hacker News 热门(buzzing.cc 中文翻译) · GLM
观点 / 方法精选
AI 能否回答 3 万亿美元的问题?
Sequoia 合伙人 David Cahn 更新 AI 基础设施支出估算:2026 年全球投入达 1.5 万亿美元,行业需产生 3 万亿美元收入才能回本。Anthropic 年化收入(ARR)达 600 亿美元,OpenAI 2025 年收入 130 亿美元(11 月称 ARR 200 亿美元),但缺口仍大。Apollo 首席经济学家指出,谷歌、Meta、微软、亚马逊均预测 2028 年自由现金流加速,但风险在于更多组织转向更便宜的开放权重模型(尤其中国模型),且 Ope…
信息来源:TechCrunch:AI(RSS) · OpenAI / Claude
观点 / 方法精选
社交媒体AI生成内容泛滥:LinkedIn超过40%长文为AI写作
安全公司Pangram通过Chrome扩展收集超100万条帖子,分析发现社交媒体AI生成内容泛滥。整体AI检测率13.8%,长文(超250词)中25.72%完全由AI生成。LinkedIn最为严重,超40%长文帖子被标记为完全AI生成,占全部AI内容的62%;X/Twitter近一半文章(23.9%完全AI+22.9%混合)为AI写作。Reddit整体AI率仅4.4%,但顶层帖子AI率达11.6%。分析使用Pangram 3.3模型,假阳性率0.01%。Substack上长…
信息来源:Hacker News 热门(buzzing.cc 中文翻译)
观点 / 方法精选
Bun 被 Anthropic 收购后用 Rust 重写,月下载超 2200 万
Bun 于 2025 年 12 月被 Anthropic 收购,作者使用预发布版 Claude Fable 5 进行了大量 Rust 重写。Bun 最初用 Zig 在一年内构建,如今 CLI 月下载超 2200 万,被 Claude Code 等采用。广泛功能带来稳定性挑战,v1.3.14 修复了多项 use-after-free、内存泄漏等 bug。团队通过 ASAN、Fuzzilli 模糊测试等系统性预防,并借助 Rust 的内存安全特性减少此类缺陷。
信息来源:Hacker News 热门(buzzing.cc 中文翻译) · Claude
产品发布 / 更新精选
微软发布Flint:面向AI智能体的可视化语言
微软研究院推出Flint,一种可视化中间语言,让AI智能体通过简洁的人类可编辑spec自动生成美观图表。用户只需提供数据、语义类型和图表类型,Flint编译器即可推导坐标轴、配色、布局等底层参数。支持46种图表类型,可渲染到Vega-Lite、ECharts和Chart.js三个后端。项目通过npm安装(TypeScript/JavaScript),并提供MCP服务器用于智能体工作流集成。采用弹性布局模型自动优化图表尺寸与间距,已开源。
信息来源:Hacker News 热门(buzzing.cc 中文翻译)
模型发布 / 更新精选
Cognition 推出 SWE-1.7,接近 GPT 5.5 与 Opus 智能水平
Cognition 发布迄今最强模型 SWE-1.7,基于 Kimi K2.7 基座训练,通过强化学习管线改进(基础设施、训练稳定性、数据质量、长程任务技术)实现前沿智能水平并大幅降低成本。在 FrontierCode 1.1 Main 基准上达 42.3%(Kimi K2.7 Code 为 30.1%,GPT-5.5 为 43.0%,Opus 4.8 为 46.5%),Terminal-Bench 2.1 达 81.5%,SWE-Bench Multilingual 达 …
信息来源:Hacker News 热门(buzzing.cc 中文翻译) · GPT / Kimi
产品发布 / 更新精选
ChatGPT Sites将创意变可发布网站
将一个想法变成可发布和分享的实时网站 以下是OpenAI团队的一些成员用Sites构建的示例👇 @prd_008 用Sites将一个想法变成了个人专注应用:
信息来源:X:OpenAI Developers (@OpenAIDevs) · OpenAI / ChatGPT
产品发布 / 更新精选
Google 推出 LiteRT.js:高性能 Web AI 推理运行时
Google 发布 LiteRT.js,这是 LiteRT 跨平台边缘 AI 运行时的最新成员,专为 JavaScript 开发者设计,可直接在浏览器中运行机器学习模型。LiteRT.js 基于 WebGPU 和即将推出的 WebNN 实现 SOTA 推理性能,同时支持回退到 WebAssembly CPU 方案。
信息来源:Google Developers Blog(RSS)
模型发布 / 更新精选
GPT-5.6 Sol 是目前最强模型
GPT 5.6 Sol 是我们迄今为止在几乎所有方面最好的模型。 与GPT-5.5相比,在编码、困难上下文与策略任务、搭建网站……以及任何我需要完成的事情上,差异非常显著。这完全要求你提升自己的尝试目标。
信息来源:X:Tibo (@thsottiaux) · GPT
论文研究精选
DeepSeek-V4 Flash 强化学习训练登陆 AMD Instinct MI355X GPU,由 Miles 框架支持
DeepSeek-V4 Flash 的强化学习训练现已在 AMD Instinct MI355X GPU 上通过 Miles 框架获得支持,基于 ROCm 软件栈运行。该 2840 亿参数 MoE 模型(每 token 激活 130 亿参数)需 SGLang 进行 rollout 生成、Megatron 进行策略更新,Miles 负责异步循环与权重同步。团队解决了 SGLang 与 Megatron 间模型对齐、量化状态在线更新及多节点并行稳定性三大挑战,最终在四个八 GP…
信息来源:LMSYS:Blog(Chatbot Arena 团队) · DeepSeek
行业动态精选
消息称特斯拉三代擎天柱人形机器人初步定型,马斯克放话达不成产能目标就开掉整个采购团队
据晚点LatePost报道,特斯拉Optimus Gen 3经马斯克评审通过,即将量产。供应链要求供应商9月产能达1000台/周,年底升至2000-2500台/周,届时年产能可达10万台。马斯克六月底高管会上要求年底前实现产能目标,否则开除整个Optimus采购团队。弗里蒙特工厂已改造为Optimus生产线,Model S/X于5月停产。马斯克表示初期生产极其缓慢,低产量夏季启动,高产量2027年展开。
信息来源:IT之家(RSS)
产品发布 / 更新精选
Mistral 推出 Studio,为 AI 提示词和技能提供系统记录
Mistral 今日推出 Studio,为 AI 提示词和技能提供集中式系统记录。平台将 prompts 和 skills 视为生产资产,支持不可变版本、回滚、明确所有权、分类标签和审计日志,保证变更可追溯。非开发者可直接编辑测试,通过标签将变更推送至生产,保留原有 CI/CD 流程。可观测性让生产输出回溯到对应资产版本,形成闭环治理。现面向 Mistral Studio 客户开放。
信息来源:Mistral AI:News(网页) · Mistral
观点 / 方法精选
TeXada:基于MiniCPM的本地数学Agent发布
社区开发者基于MiniCPM5-1B和MiniCPM-V 4.6构建了本地优先的数学智能体TeXada。该Agent支持自然语言直接转LaTeX、手写/图像公式OCR转可编辑LaTeX、LaTeX补全与错误修复等核心功能。所有推理在本地完成,无需依赖云服务,保障隐私安全,适用于学生、研究人员和开发者随时随地处理数学表达式。已开源至GitHub,并提供HuggingFace模型下载。
信息来源:X:面壁智能 OpenBMB (@OpenBMB) · Hugging Face
模型发布 / 更新精选
Meta 发布 Muse Spark 1.1 模型
来自 @finkd 的消息 - Muse Spark 1.1 已上线。
信息来源:X:AI at Meta (@AIatMeta)
模型发布 / 更新精选
Meta 发布 Muse Spark 1.1 低价智能体模型
今天我们发布 Muse Spark 1.1--一款价格极低、能力强大的智能体与编程模型。它已通过我们新的 Meta Model API 上线,并集成于 Meta AI 中。
信息来源:X:Mark Zuckerberg (@finkd) · Llama
产品发布 / 更新精选
Claude 推出反思功能(Beta)
Anthropic 为 Claude 推出一项反思功能(Beta),帮助用户追踪使用模式。用户可回顾过去 1、3、6 或 12 个月的活动总结,涵盖关键主题、使用频率和任务类型。功能结合 4D AI Fluency Framework(委托、描述、辨别、勤勉)提供协作分析,支持设定静音时段或定时休息提醒。隐私方面,不涉及无痕对话和健康集成工具,也不提取连接工具中的底层文件。该功能面向 Free、Pro 和 Max 用户,需开启记忆功能,可通过 Claude 网页或桌面应用设…
信息来源:Anthropic:Newsroom(网页) · Claude
行业动态精选
法国对英伟达反垄断调查接近尾声,聚焦 CUDA 生态和产业投资
法国竞争管理局确认,对英伟达的反垄断调查已近尾声,即将发布正式异议声明。调查聚焦两大问题:市场对CUDA平台的严重依赖,以及英伟达对CoreWeave等AI云计算公司的投资。英伟达占全球AI加速器超70%份额。若认定滥用市场支配地位,最高可处全球年营业额10%罚款。法国是首个准备正式指控英伟达的监管机构。
信息来源:IT之家(RSS) · NVIDIA
模型发布 / 更新精选
美团 LongCat-2.0 正式开源,同步开放国产卡推理代码
美团万亿参数大模型 LongCat-2.0 正式开源,总参数 1.6T,平均激活约 48B,专为真实 Agentic Coding 任务设计。模型引入 LongCat 稀疏注意力机制与 N-gram Embedding,提升长上下文处理效率与 Token 级表示能力。LongCat-2.0 是业界首个在五万卡国产算力集群上完成推理的万亿参数模型,从模型架构、芯片适配到部署策略进行深度协同优化,支持百万上下文高效推理。开源同步提供 BF16、FP8、INT8 等多精度版本及针…
信息来源:公众号:龙猫LongCat(美团)
模型发布 / 更新精选
OpenAI 推出 ChatGPT Work:可跨应用自主工作的 AI 智能体
OpenAI 发布 ChatGPT Work,一个能跨应用和文件收集信息、将复杂项目分解为小步骤独立完成并持续工作数小时的 AI 智能体。它内置 Codex 技术,目前每周超 500 万用户使用 Codex,其中超 100 万用于非软件开发场景。ChatGPT Work 由今天同步推出的最新前沿模型 GPT-5.6 驱动,具备多步骤推理和按模板生成材料的能力。该功能今天起面向 Pro、Enterprise 和 Edu 计划推出,未来几天扩展至 Plus 和 Business…
信息来源:OpenAI:官网动态(RSS · 排除企业/客户案例) · OpenAI / ChatGPT / GPT
模型发布 / 更新精选
GPT-5.6 系列模型发布:Sol、Terra、Luna
OpenAI 推出 GPT-5.6 系列,包括旗舰 Sol、平衡型 Terra 和成本最优 Luna。在 Agents' Last Exam 上,Sol 以 53.6 分超越 Claude Fable 5(自适应推理)13.1 分;中等推理时以约四分之一成本领先 11.4 分。Terra 和 Luna 以约十六分之一成本超越 Fable 5。在 Artificial Analysis Coding Agent Index 上,Sol 以 80 分创 SOTA,高于 Fabl…
信息来源:OpenAI:官网动态(RSS · 排除企业/客户案例) · OpenAI / GPT / Claude
模型发布 / 更新精选
NVIDIA 发布 Nemotron-Labs-3-Puzzle-75B-A9B:压缩混合 MoE 模型,服务器吞吐量提升 2.03 倍
NVIDIA 发布 Nemotron-3-Super 的压缩变体 Nemotron-Labs-3-Puzzle-75B-A9B,总参数从 120.7B 降至 75.3B,活跃参数从 12.8B 降至 9.3B,保持 88 块混合布局(40 Mamba、40 MoE、8 注意力)。在 8×B200 节点上,8K/64K 场景匹配用户吞吐量≥100 tok/s 时,服务器吞吐量提升 2.03 倍。单 H100 上 1M-token 并发从 1 增至 8,权重占用从 70 GB …
信息来源:MarkTechPost(RSS) · NVIDIA / Hugging Face
模型发布 / 更新精选
蚂蚁灵波开源全球首个面向具身智能的MoE视频基模LingBot-Video
蚂蚁灵波科技正式开源LingBot-Video,这是全球首个基于MoE架构、面向具身智能的视频生成基础模型。总参数30B,推理时仅激活约3B,效率较同规模Dense架构提升约3倍。模型引入7万小时VLA、VLN、Ego等机器人数据,并通过多维强化学习奖励系统对齐物理合理性与任务完成度。在RBench上总分0.620,超越Wan2.6等模型;在Physics-IQ Verified评测中排名第一。可用于机器人动作预测、仿真数据生成等方向。
信息来源:IT之家(RSS)
观点 / 方法精选
官方支招两种AI方案:Claude Fable 5搭配Sonnet 5省token
Anthropic官方建议将Claude Fable 5用作规划层、Sonnet 5执行任务以降低成本。顾问模式下,Sonnet 5主执行,仅需额外指导时调用Fable 5;SWE-bench Pro测试显示相比完全用Fable 5可达92%性能,成本仅63%。协调者模式下,Fable 5充当规划者,将子任务分派给多个Sonnet 5工作智能体;BrowseComp基准上达到Fable 5单独运行96%表现,成本为46%。
信息来源:IT之家(RSS) · Claude
模型发布 / 更新精选
蚂蚁灵波开源实时交互世界模型 LingBot-World 2.0
蚂蚁灵波开源新一代实时交互世界模型 LingBot-World 2.0(14B 参数),支持施法、攻击、跳跃等丰富角色动作及文本驱动事件(如切换场景、召唤风暴),内置 Pilot Agent 与 Director Agent 实现世界持续演化,并支持多人同时交互。模型采用因果预训练范式和混合双向自回归注意力掩码(MoBA),可稳定输出 720p/60fps 实时画面,长达一小时测试画质不衰减。通过一致性蒸馏与 DMD 降低采样成本,结合注意力 kernel 优化、混合并行推…
信息来源:IT之家(RSS)