AI 产品发布与更新
发现 AI 应用、智能体、开发工具、生成式 AI 产品及重要功能升级,快速了解新产品能做什么。
分类文章1369
当前页11 / 35
持续更新永久归档
分类文章
按发布时间从新到旧 · 每页 40 条
产品发布 / 更新普通
MiniMax H3 在 GB200 上推理提速 27.7 倍
NVIDIA SANA 团队的 Sol Engine 将 MiniMax H3 视频生成延迟大幅压缩:单块 GB200 上 10s 768p 视频从 414s 降至 14.93s(27.7 倍加速),5s 视频达 22.2 倍加速。
信息来源:X:MiniMax (@MiniMax_AI) · NVIDIA
产品发布 / 更新普通
Claude 网页与桌面端长回复流式渲染提速 4 倍
Claude 网页版和桌面版的长回复现在流式输出流畅度提升约 4 倍。 我们重构了流式渲染器,使其只更新仍在变化的部分,因此在较慢的笔记本电脑上,长回复的卡顿次数减少 9 倍,最长冻结时间缩短 4.5 倍;在 120Hz MacBook 上,全程可保持 120fps。
信息来源:X:Claude Devs (@ClaudeDevs) · Claude
产品发布 / 更新普通
阿里万相3.0上线OpenRouter
阿里巴巴的 Wan 3.0(来自 @Alibaba_Wan 和 @alibaba_cloud)现已上线 OpenRouter。 支持从文本、图像或参考内容生成 2-30 秒视频,分辨率可选 480p、720p 或 1080p。 发布定价:$0.05/$0.10/$0.20 每秒,所有分辨率限时 15% 折扣。
信息来源:X:OpenRouter (@OpenRouter)
产品发布 / 更新普通
Nvidia Rubin Ultra HBM4 容量大幅缩水至192GB
Nvidia Rubin Ultra 将搭载 192GB HBM4 8-hi,较最初预览的 1TB HBM 大幅缩水,甚至低于常规 Rubin 的 288GB。容量削减主因:4 die 方案取消致 cube 数降至 8、堆叠高度从 16-hi 降至 8-hi、改用 24Gb die 的 HBM4(而非 HBM4E 的 32Gb),未来或可升级至 8-hi HBM4E。
信息来源:X:SemiAnalysis (@SemiAnalysis_) · NVIDIA
产品发布 / 更新普通
Conductor MCP 发布,AI 智能体可协同管理云会话
推出 Conductor MCP! 你的 Claude、Codex、Cursor 智能体现在可以与人类一起使用 Conductor。 它配备了你的智能体创建和管理云会话所需的全部工具。 ```get-started.txt 在 https://api.conductor.build/mcp 添加 Conductor MCP,并通过 OAuth 进行身份验证。```
信息来源:X:Charlie Holtz(@charlieholtz) · Claude / Cursor
产品发布 / 更新普通
书海无涯,总有下一本
总还有下一本书。
信息来源:X:Odyssey (@odysseyml)
产品发布 / 更新普通
Grok Build 新增 Browser Use 插件
SpaceXAI 为 Grok Build 推出 Browser Use 插件,赋予 Grok 访问真实浏览器的能力,支持用户自有 Chrome(含现有登录态)或隔离的 Browser Use 云浏览器。
信息来源:X:cb_doge (@cb_doge) · Grok
产品发布 / 更新普通
OCR It--从无法复制的文档中提取文本,供您的LLM使用
一款Chrome扩展,通过固定屏幕区域并按下热键,即可对分页文档(扫描书、幻灯片、PDF等)逐页截图、OCR并追加为连续文本,供Claude或ChatGPT等LLM总结、搜索或提问。OCR在本地运行,使用内置Tesseract构建,无需API密钥或网络请求。支持自动翻页(通过点击控件或按键触发),并设有300页上限及重复页检测等停止条件。
信息来源:Hacker News 热门(buzzing.cc 中文翻译) · ChatGPT / Claude
产品发布 / 更新普通
开发者打造低延迟 AI 游戏伙伴 Varkos,可实时陪玩《上古卷轴5:天际》
一位开发者构建了名为 Varkos 的 AI 游戏伙伴,能实时执行战斗、拾取、搜索、递物等复杂多步指令,并支持条件触发与持续目标规划,全程低延迟且无预设脚本。该系统优先本地运行以保护隐私并降低成本,仅性格演化部分依赖云端大模型调用。Varkos 初始为"转生为狗的恶魔",其性格、词汇和情绪状态会随共享游戏经历逐步演化,且改动可版本化回退。
信息来源:Hacker News 热门(buzzing.cc 中文翻译)
产品发布 / 更新普通
AgentSky 推出"智能体版 OpenRouter"统一 API
AgentSky.dev 发布"OpenRouter for Agents",以统一 API 接入 Claude Code、Codex、DeepSeek、Kimi、OpenCode 等主流智能体,并附带 Agent Playground 供用户在浏览器中并排对比各智能体的耗时、成本与 token 消耗。
信息来源:X:Kim (@kimmonismus) · DeepSeek / Claude / Kimi
产品发布 / 更新普通
Claude 企业版 MCP 连接器托管认证正式可用
面向 MCP 连接器的企业托管认证现已全面可用。 对于 Claude Team 和企业版管理员,授权通过你的身份提供商集中管理。 对于用户,工具和数据自动连接,无需单独进行 OAuth。
信息来源:X:Claude Devs (@ClaudeDevs) · Claude
产品发布 / 更新普通
AgentSky 推出 Agent Playground 对比主流智能体
AgentSky 推出 Agent Playground,可在同一浏览器中让 Claude Code、Codex、DeepSeek 执行相同任务,并排对比耗时、成本与 token 消耗。
信息来源:X:Elvis Saravia (@omarsar0, DAIR.AI) · DeepSeek / Claude
产品发布 / 更新精选
MetaRoCE:为 AI 规模以太网打造的全新 RDMA 传输协议
Meta 设计并开源了 MetaRoCE,一个专为 AI 工作负载在通用以太网上打造的 RDMA 传输协议,已通过 Open Compute Project(OCP)发布规范、参考软件实现和合规测试套件。该协议将智能移至端点,原生支持乱序交付、多路径、无损容忍和双向拥塞控制,无需 PFC,可在百万 GPU 规模下提供高吞吐、低尾延迟。现有 RDMA Verbs API 和软件栈无需修改即可运行。
信息来源:Meta Engineering Blog(RSS)
产品发布 / 更新普通
MTIA 300:Meta 首款内置 NIC 与通信卸载引擎的训练芯片
Meta 发布 MTIA 300,这是其自研加速器家族中首款针对推荐与排序模型训练优化的芯片。芯片封装内集成 12 个 800 Gbps RDMA NIC,提供 1.2 TB/s 总 I/O 带宽,并通过 16 个专用消息引擎卸载通信,使大规模 GEMM 与集合通信并发时计算吞吐损耗低于 0.5%。
信息来源:Meta Engineering Blog(RSS)
产品发布 / 更新普通
Grok Bot 十分钟将 Doom 移植到新设备
Grok @Bot 在 10 分钟内将 Doom 移植到了一台新设备上。
信息来源:X:Elon Musk (@elonmusk, xAI) · Grok
产品发布 / 更新普通
Qwen3.8 27B 现可接入 Optima 基准测试
您现在可以使用 Optima 对 Qwen3.8 27B 进行基准测试。了解这款可在笔记本电脑上运行的模型,在您的定制用例中,其性能、成本和速度表现如何。 我们还为希望为其用例构建基准测试的企业提供积分以及 Artificial Analysis 团队成员的免费咨询。如果您感兴趣,请告诉我们:https://forms.gle/VxRfD7toBXFBjVZc9 立即在 https://artificialanalysis.ai/optima 构建并运行您的自定义基准测试。
信息来源:X:Artificial Analysis (@ArtificialAnlys) · Qwen
产品发布 / 更新普通
NVIDIA Groq 3 LPX 全面投产,输出速度破纪录
NVIDIA Groq 3 LPX 已全面投产,为 Vera Rubin 平台新增专用 token 生成加速器。在 Artificial Analysis 基准测试中,运行 Gemma 4 31B(10 万 token 上下文)达到每秒 3400 输出 token,为该模型最快纪录。Nebius 将率先通过其 Token Factory 部署,Groq 紧随其后。
信息来源:X:Kim (@kimmonismus) · NVIDIA
产品发布 / 更新普通
llm-anthropic 0.27 发布:适配 anthropic v1.0.0 Python 库
llm-anthropic 0.27 发布,主要适配近期推出的 anthropic v1.0.0 Python 库,后者将依赖从 httpx 切换至 httpx2。OpenAI 在两周前的 v3.0.0 版本中也做了相同变更。Anthropic 提供了迁移指南,作者借助 Claude Code 中的 Fable 5 完成升级并让测试通过。
信息来源:Simon Willison 博客 · OpenAI / Claude
产品发布 / 更新普通
Artificial Analysis 联合 Liquid AI 发布手机端小模型评测
Artificial Analysis 与 Liquid AI 合作,在 iPhone 17 Pro 和 Galaxy S26 Ultra 上对 4-bit 或更低精度的小模型进行端到端推理性能与智能水平独立评测。
信息来源:X:Artificial Analysis (@ArtificialAnlys)
产品发布 / 更新精选
Claude 记忆功能全面打通聊天与 Cowork,用户可逐条查看和编辑
Claude 即日起将聊天与 Claude Cowork 的记忆统一,用户在任一场景对话时都能调用此前积累的上下文,减少重复解释。记忆会在聊天过程中实时更新,用户可在 Memory 设置中按主题查看、编辑或删除每条记忆。健康、信仰等敏感话题默认不存储,但可在设置中开启,且敏感识别号、犯罪记录等始终不会被保存。
信息来源:Claude:Blog(网页) · Claude
产品发布 / 更新普通
Grok Bot 将新增模板与多账户支持
SPACEXAI 🔥:Grok Bot 即将获得模板、多账户支持、出口隧道和 Chrome 配置文件导入功能。 目前尚不清楚模板将位于任务层级还是机器人层级,但设置中将设有专门的发现标签页。
信息来源:X:Testing Catalog (@testingcatalog) · Grok
产品发布 / 更新普通
exo 开源智能体框架如何实现递归自我改进
exo 是专为递归自我改进(RSI)设计的新开源智能体框架,将智能体拆为三层:exoharness 以追加式事件日志存储不可篡改的持久状态,executor 负责组装提示词、调用模型与调度工具,sandbox 在可快照回滚的隔离环境中执行任务。支持从任意事件分叉对话、回滚至出错前检查点、数周后恢复完整会话,并可通过 tool_requested 与 tool_result 查看实际执行的命令。
信息来源:X:DAIR.AI (@dair_ai)
产品发布 / 更新普通
exo 开源智能体框架如何解决递归自我改进
exo 是一个新的开源智能体框架,专为解决递归自我改进(RSI)而设计,将智能体分为三层:exoharness 存储不可篡改的追加式事件日志、executor 负责组装提示词与调用模型、sandbox 提供可快照回滚的隔离执行环境。该框架支持从任意事件分叉对话、回滚到破坏前状态、数周后恢复完整上下文,并读取实际执行的命令。
信息来源:X:Elvis Saravia (@omarsar0, DAIR.AI)
产品发布 / 更新普通
ACEMAGIC 推出 F2A 迷你主机:酷睿 Ultra X7 358H 处理器、32GB 内存
ACEMAGIC 推出新一代迷你主机 F2A,搭载酷睿 Ultra X7 358H 处理器(16 核 16 线程),NPU AI 算力最高 50 TOPS,整机 AI 性能最高 180 TOPS。标配 32GB LPDDR5X 内存和 1TB 固态硬盘,配备 USB4、双 2.5G 网口等接口,最多可连接 4 台显示器,预装 Windows 11 专业版。
信息来源:IT之家(RSS)
产品发布 / 更新普通
百度自研磐玉蜂巢服务器新品上市:高密度ARM架构升级至48刀片节点
百度ARM云推出新版磐玉蜂巢服务器(PY-FCR3-L05-R96-M24-S16S-3648),在保持96片RK3588S SoC规模不变的基础上,将刀片节点由24增至48个,内存从16GB升级至24GB,并配备4×SFP+万兆光口聚合。整机提供768个CPU核及576 TOPS总AI算力,支持8K 60FPS视频编码,适配云手机、云游戏、数字人等场景,兼容公有云、私有云及混合云部署。
信息来源:公众号:百度智能云(文心)
产品发布 / 更新普通
百度搭子界面改版:输入框更醒目,移动端可远程连接电脑派任务
百度搭子产品界面改版,首页输入框更醒目,常用能力(自媒体运营、金融分析、生成PPT、数据处理等)集中展示,并支持"换一换"推荐与同款提示词编辑。移动端同步更新,"连接电脑"功能更好找,手机可远程调用电脑本地文件修改PPT、整理表格,执行进度实时同步。8月27日,百度搭子产品发布会将在上海举行,个人版、企业版和行业套件将集中升级。
信息来源:公众号:百度智能云(文心)
产品发布 / 更新普通
小米集团副总裁朱丹:芯片研发投入是为下一个十年买"入场券"
小米今日发布玄戒 O3、玄戒 O100、玄戒 D100 三款自研芯片,集团副总裁朱丹称AI时代算力是一切智能体验的根基,不掌握芯片能力就无法从底层定义产品体验,这笔投入是为下一个十年买"入场券"。玄戒 O3 采用3nm制程,定位AI旗舰SoC,安兔兔首破500万,预计9月搭载于小米18Fold;玄戒 O100 主攻高带宽AI加速,玄戒 D100 面向智驾场景。
信息来源:IT之家(RSS)
产品发布 / 更新普通
NVIDIA 宣布 SpaceXAI 将部署 Vera CPU 与 Vera Rubin 平台,把 Grok 的 AI 基础设施扩展至轨道
NVIDIA 宣布 SpaceXAI 将部署 Vera CPU 与 Vera Rubin 平台,把 Grok 的 AI 基础设施从地面扩展至轨道。Vera 是 NVIDIA 首款为 AI 智能体打造的 CPU,配备 88 个 Olympus 核心与 1.2 TB/s 内存带宽,任务完成速度比 x86 CPU 快 1.8 倍。
信息来源:X:cb_doge (@cb_doge) · Grok / NVIDIA
产品发布 / 更新普通
NVIDIA 如何用 NVLink Fusion 让定制 XPU 融入世界级 AI 工厂
NVIDIA 推出 NVLink Fusion,将定制 XPU 接入其 NVLink 扩展域,使 XPU 间端到端延迟比基于现成以太网的方案低 3 倍、数据包速率高 10 倍。
信息来源:NVIDIA Blog(RSS) · NVIDIA
产品发布 / 更新普通
NVIDIA 扩展 Vera Rubin 推理能力,Groq 3 LPX 全面投产支持智能体系统
NVIDIA 宣布 Vera Rubin NVL72 扩展快速 token 生成能力,以支持智能体系统。其机架级系统 NVIDIA Groq 3 LPX 已全面投产,旨在通过 AI 工厂各层协同工作来定义下一代 AI 推理,而非依赖单一芯片、网络或系统的突破。
信息来源:NVIDIA Blog(RSS) · NVIDIA
产品发布 / 更新精选
NVIDIA Vera Rubin NVL72 树立 AI 智能体效率新标准:每瓦特工作量提升至 30 倍
NVIDIA 实测数据显示,Vera Rubin NVL72 在智能体工作负载下每兆瓦吞吐量较 GB300 NVL72 最高提升 30 倍,每百万 token 成本降低至 35 倍。
信息来源:NVIDIA Blog(RSS) · NVIDIA
产品发布 / 更新普通
OpenRouter 新增图像模型视觉基准测试
新增:用于了解图像模型能力的视觉基准测试 🌅 查看每个模型在各种挑战性提示词下的表现:https://openrouter.ai/benchmarks/media/images
信息来源:X:OpenRouter (@OpenRouter)
产品发布 / 更新普通
苹果 Apple Store 应用 AI 助手悄悄上线,目前处于早期预览状态
苹果 Apple Store 应用正在逐步推送 AI 助手,目前处于"早期预览"状态。该功能可列出不同苹果产品、比较两款 iPhone、查询订单和处理以旧换新等,实例提示语为"帮我挑选一款 Apple Watch"。目前尚不清楚该功能向多少用户开放,外媒 Appleinsider 称其尚未收到推送。
信息来源:IT之家(RSS)
产品发布 / 更新普通
Gemini 4 筹备启动,桌面端将迎 Avatar 支持
Google 正为 Gemini Desktop 添加 Avatar 支持,并推出 Customize 标签页供用户发现 Apps、Skills 与 Plugins。与此同时,Gemini 4 的筹备工作已开始,检测到 120+ 条相关新提及,与去年 Gemini 3 发布前的模式相似。
信息来源:X:Testing Catalog (@testingcatalog) · Gemini
产品发布 / 更新普通
小米玄戒 O3 行业首发支持 LPDDR6,长鑫存储为核心合作伙伴
小米首款 AI 旗舰 SoC 玄戒 O3 今日发布,行业首发支持 LPDDR6,速率达 10667Mbps、4×24 bit 位宽、113.8GB/s 带宽,相比前代玄戒 O1 内存带宽提升 48%。据供应链消息,长鑫存储是该 LPDDR6 内存核心合作伙伴,这也是国产 LPDDR6 芯片首次在旗舰级处理器芯片上实现应用。
信息来源:IT之家(RSS)
产品发布 / 更新普通
雷军官宣 9 月为小米"科技大月",澎程系列新车与 Xiaomi 18 Pro/Fold 同月发布
雷军宣布 9 月为小米"科技大月",月初澎程系列新车上市并同场发布 Xiaomi 18 Fold,月底推出 Xiaomi 18 Pro 系列。小米 18 Fold 与小米平板 9 Pro Max 首发搭载玄戒 O3 AI 旗舰 SoC,安兔兔跑分 522 万,CPU 多核首破 15000 分,GPU 性能提升 85%、功耗降低 64%,并全球首发支持 LPDDR6。
信息来源:IT之家(RSS)
产品发布 / 更新普通
Runway Ruby 支持多模型直出专业格式
在 Runway 上用任意模型生成,然后通过 Ruby 将其提升至交付规格。无论你使用 Seedance 2.5、Gen-4.5 还是 MiniMax H3,都可直接转换为 16-bit EXR 或 10 位和 12 位 ProRes 及 HEVC。 点击下方链接立即体验。
信息来源:X:Runway (@runwayml)
产品发布 / 更新普通
IBM 发布首款双架构大型机处理器:2nm 工艺,11 核心 5.7GHz
IBM 在 Hot Chips 2026 大会上发布首款双架构大型机处理器,基于 2nm 工艺,整合 11 个频率超 5.7GHz 的核心,并配备 AI 推理加速器、片上 DPU 和大容量缓存。该处理器可原生执行 IBM Z / LinuxONE 与 Arm 指令,使基于它的 Z 和 LinuxONE 系统能同时运行 IBM 和 Arm 平台的操作系统与应用,可扩展至数百核心和数十 TB 内存。
信息来源:IT之家(RSS)
产品发布 / 更新普通
Cerebras 推出 CS-4 AI 加速器,同芯片性能翻倍
Cerebras 发布新一代 AI 加速器 CS-4,CEO 称其为业界最快系统。该机架级产品仍采用 5nm WSE-3 芯片,通过提升功耗与散热将时钟频率翻倍,单机架容纳三片晶圆,每用户每秒可处理高达 4,400 tokens,据称比 Nvidia GPU 方案快 30 倍。
信息来源:The Decoder:AI News(RSS) · NVIDIA
产品发布 / 更新普通
Coherent 出样 300mm 高导热 SiC 衬底,散热性能提升多达 25%
Coherent 上周宣布已开始向人工智能半导体合作伙伴提供 300mm(12 英寸)高导热性碳化硅(SiC)衬底样品,宣称散热性能比现有解决方案提升多达 25%。该公司高级副总裁 Craig Mullaney 表示,AI 性能日益受散热能力限制,Coherent 正结合数十年 SiC 专业技术和可扩展的 300mm 制造平台,为未来 AI 基础设施构建材料基础。
信息来源:IT之家(RSS)