AI 产品发布与更新
发现 AI 应用、智能体、开发工具、生成式 AI 产品及重要功能升级,快速了解新产品能做什么。
分类文章1371
当前页15 / 35
持续更新永久归档
分类文章
按发布时间从新到旧 · 每页 40 条
产品发布 / 更新精选
LLM 0.32 发布:新增推理轨迹、OpenAI Responses、服务端工具与更智能的日志
Simon Willison 发布 LLM 0.32,这是该项目自启动以来最重要的新版本。新版本支持显示推理轨迹、服务端工具、OpenAI Responses API,并默认使用 GPT-5.6 Luna 模型。
信息来源:Simon Willison 博客 · OpenAI / GPT
产品发布 / 更新精选
Replit 环境智能:免提示词自动生成设计
你无需提示词,也无需设计语言。 环境智能(Ambient Intelligence)会在每个画面旁显示建议卡片,每张卡片都指向你的设计的一个不同方向。点击你喜欢的那张,即可看到它生成一个新的画面。 你再也不必纠结下一步该做什么。 立即在 http://replit.com/design 体验。
信息来源:X:Replit (@Replit)
产品发布 / 更新精选
Soup v0.72.4:在4 GB显存笔记本GPU上微调8B模型
Soup 推出 v0.72.4,支持在配备 4 GB 显存的笔记本 GPU 上通过 QLoRA 微调 8B 模型,无需 SSH 或云服务。
信息来源:Hacker News 热门(buzzing.cc 中文翻译)
产品发布 / 更新精选
Google Cloud 推出 Database Operations Agents,实现自主数据库管理
Google Cloud 在 Agentic Data Cloud 发布中推出两款 AI 数据库智能体:Database Onboarding Agent 负责 Day 0 的配置与部署,Database Observability Agent 负责 Day 1/2 的监控、故障排查与维护。
信息来源:Google Cloud:Databases(RSS)
产品发布 / 更新精选
NVIDIA 开源 cuFile API,推动 GPU 直连存储
NVIDIA 在 FMS 大会上宣布开源 cuFile API 及底层存储软件栈,让 GPU 可直接读写存储,访问延迟降至微秒级。其 Vera CPU 在两级压缩与加密流水线中吞吐量比 x86 CPU 最高提升 3.21 倍,并联合 40 多家厂商推出 Storage-Next 计划。
信息来源:NVIDIA Blog(RSS) · NVIDIA
产品发布 / 更新精选
Reflex 开源 XY:基于 Rust 的超快 Python 绘图库,可保持 1 亿点图表交互流畅
Reflex AI 发布 Apache-2.0 许可的 Python 交互式 2D 绘图库 XY,通过 Rust 原生核心、二进制缓冲传输和 WebGL2 渲染,在 1 万至 1 亿点范围内保持约 0.08 秒的渲染时间。
信息来源:MarkTechPost(RSS)
产品发布 / 更新精选
Swiftlet:在 Mac 上运行 80B 版 Qwen(内存 4.3 GB),在 iPhone 上运行 35B 版
Swiftlet 是一个 Swift + Metal 运行时,可在普通 Apple 设备上运行 Qwen3-Next 和 Qwen3.5/3.6 MoE 混合模型,仅将小型稠密核心驻留内存,按需从存储流式加载路由专家权重。
信息来源:Hacker News 热门(buzzing.cc 中文翻译) · Qwen
产品发布 / 更新精选
面壁智能开源 ForgeStencil:一周自动优化 100+ 工业与科学软件,全程零人工介入
面壁智能联合 OpenBMB 开源全球首个支持 Stencil 自动研究、自动部署的 AI 优化系统 ForgeStencil,由 Kernel Agent 与 App Agent 闭环协作,实现从算子优化到应用集成的全自动流程。
信息来源:公众号:面壁智能(MiniCPM)
产品发布 / 更新精选
OpenRouter 推出 ori CLI:为 Claude Code 等 Harness 提供开箱即用的优化配置
OpenRouter 发布 ori CLI,用户安装并登录后即可获得针对 Claude Code、Codex、OpenCode、Hermes 等 harness 的优化配置,省去手动设置大量环境变量的麻烦。
信息来源:OpenRouter:Announcements(RSS) · Claude
产品发布 / 更新精选
GPT-Live实时音频新架构发布
GPT-Live 是一种用于实时音频的新架构和栈: GPT-Live 可以在说话的同时聆听。 为了让这种体验在 ChatGPT 规模下显得自然,我们从客户端到模型重建了语音栈。 这一新架构让音频持续流动,因此更深入的推理和工具使用不会打断对话。
信息来源:X:Greg Brockman (@gdb) · ChatGPT / GPT
产品发布 / 更新精选
微软开源 Orchard 智能体训练框架
Orchard 是一个面向研究社区的开源框架,用于跨任务类型训练和评估 AI 智能体。它降低了复杂性,同时通过让研究人员复用同一套基础设施,支持较小模型也能实现强劲性能。https://msft.it/6019a8fqP
信息来源:X:Microsoft Research (@MSFTResearch)
产品发布 / 更新精选
SpecForge v0.3.0 发布:统一解耦与共置投机解码栈,新增开放 SpecBundle 草稿模型
SpecForge v0.3.0 将目标模型推理与草稿模型训练分离,支持 EAGLE3、EAGLE3.1、P-EAGLE、DFlash、Domino、DSpark 等多种投机解码算法,并统一在线、离线与解耦工作流。
信息来源:LMSYS:Blog(Chatbot Arena 团队)
产品发布 / 更新精选
Google Cloud API Gateway 推出统一模型路由功能,支持 Gemini、Claude 与 OpenAI OSS-GPT
Google Cloud API Gateway 新增模型路由功能(Public Preview),开发者可在 OpenAPI 3.x 规范中配置虚拟模型名到后端目标的映射,无需硬编码端点或管理开源代理。网关作为无服务器入口层,接受标准 OpenAI 兼容请求,自动将负载转码为目标模型的原生格式并动态路由流量。
信息来源:Google Developers Blog(RSS) · OpenAI / GPT / Claude
产品发布 / 更新精选
OpenRouter 推出 Ori Eval 简化评估流程
推出 Ori Eval:编写首个评估的最简单方式。 没有绝对最好的模型,只有最适合每项任务的模型。Ori Eval 利用 OpenRouter 的 API 处理代码库中的每项任务,然后评估结果。 curl -fsSL https://openrouter.ai/skills/spawn-ori-eval
信息来源:X:OpenRouter (@OpenRouter)
产品发布 / 更新精选
Grok 支持分析任意视频
Grok 可以分析任何视频 https://grok.com/share/bGVnYWN5_8013f7a3-f604-4351-8cd7-acecf3ef165b
信息来源:X:Elon Musk (@elonmusk, xAI) · Grok
产品发布 / 更新精选
百度搭子一镜Skill:一句话生成数字人口播视频
百度搭子内置的一镜Skill支持仅凭一句话或一个主题,自动完成脚本生成、声音、数字人形象、口型驱动和视频渲染,生成可直接播放的数字人口播视频,全程无需拍摄、剪辑和露脸。该功能适用于旅游攻略、产品种草、知识科普、临时活动宣传、企业内部培训及个人IP起步等场景,大幅降低视频制作门槛。
信息来源:公众号:百度智能云(文心)
产品发布 / 更新精选
Replit Design 推出数百设计模板
再也不用从空白页开始了。 Replit Design 内置了由真实设计师制作的数百个模板,涵盖手机界面、落地页到社交媒体帖子。 可以拖入一个模板开始,或在项目中遇到瓶颈时随时添加一个。 立即尝试:http://replit.com/design
信息来源:X:Replit (@Replit)
产品发布 / 更新精选
OpenRouter 推出 Ori Eval:用你的数据证明哪款模型最适合你的项目
OpenRouter 发布 Ori Eval,一个能扫描代码库、自动编写 eval 文件并运行评测的智能体,帮助开发者在 500 多款模型中选出最适合自己项目的单一模型。
信息来源:OpenRouter:Announcements(RSS)
产品发布 / 更新精选
Gemini Spark 集成 Chrome 自动浏览功能
Gemini Spark 🤝 @GoogleChrome Gemini Spark 现已与 Google Chrome 的自动浏览功能集成。经你许可,Spark 可直接在你的 Chrome 浏览器中处理网页任务,例如预约看房或自动填写航班信息。
信息来源:X:Gemini (@GeminiApp) · Gemini
产品发布 / 更新精选
Google Earth 集成 Nano Banana 2 图像生成
Google Earth 网页版上线基于 Nano Banana 2 的图像生成功能,用户可通过文本提示词将卫星与 3D 影像结合,重新想象全球任意地点(如百年前的城市风貌或社区新球场)。该功能现已面向所有用户开放。
信息来源:X:Google AI (@GoogleAI)
产品发布 / 更新精选
OpenRouter 下调 GPT-5.6 Terra/Luna 价格
GPT-5.6 Terra 和 Luna 刚刚获得了 @OpenAI 的降价。 OpenRouter 的价格仍然更低。我们的 50% 独家折扣在此基础上适用,使 Luna 输入降至 $0.1/M、输出降至 $0.6/M,Terra 输入降至 $1/M、输出降至 $6/M。 使用 luna 扩展你的工作负载:https://openrouter.ai/openai/gpt-5.6-luna
信息来源:X:OpenRouter (@OpenRouter) · OpenAI / GPT
产品发布 / 更新精选
GitHub Copilot 应用新增堆叠会话与拉取请求功能
GitHub Copilot 应用推出堆叠会话功能,允许用户在同一个仓库中创建一系列相互承接的任务,每个会话可基于前一个会话的成果继续工作。作者通过一个十余年历史的个人项目演示了该功能:先使用 Plan 模式制定前端现代化计划,再通过堆叠会话将 React-Bootstrap 替换工作拆分为独立会话,并自动为每个会话创建对应的拉取请求,避免范围蔓延。
信息来源:GitHub Blog
产品发布 / 更新精选
Perplexity Computer 推出 Projects 功能
在 Perplexity Computer 上推出 Projects。 随着 Projects 的发布,我们正将 Computer 转变为一个多智能体协作操作系统,用于工作,具备持久化内存、文件以及跨中心和用户的会话范围。 现已向所有用户开放!
信息来源:X:Aravind Srinivas(Perplexity CEO) (@AravSrinivas)
产品发布 / 更新精选
llm-chat-completions-server 0.1a0 发布
Simon Willison 发布 llm-chat-completions-server 0.1a0 插件,可在本地 9001 端口启动一个兼容 OpenAI Chat Completions API 的服务器,暴露 LLM 工具中所有已安装的模型。
信息来源:Simon Willison 博客 · OpenAI
产品发布 / 更新精选
Token Saver:用本地混合 RAG 将 Claude PDF token 消耗削减 92%-99% 的开源 MCP 扩展
Marktechpost AI 团队发布 Token Saver,一款面向 Claude Desktop 的开源 MCP 扩展,通过本地混合 RAG 在设备端检索 PDF,无需上传文件。该工具将 token 消耗削减 92%-99%,并保证数据隐私,设置无需 Python 环境或终端配置。
信息来源:MarkTechPost(RSS) · Claude
产品发布 / 更新精选
WorkBuddy 深度打通腾讯文档,打造 Agent 时代的第三代办公协同
WorkBuddy 新版本深度打通腾讯文档,支持在侧边栏直接编辑生成的文件,并将腾讯文档嵌入工作流,实现人与 AI、同事及各自 Agent 间的协同。用户可选用 DeepSeek V4 Pro、Kimi K3 等模型处理文档,并将文件上传至云端分享流转。作者认为,这种"人、Agent 与共享状态"的协作模式,标志着第三代办公产品的到来。
信息来源:公众号:数字生命卡兹克 · DeepSeek / Kimi
产品发布 / 更新精选
Replit Design 发布:AI 赋能设计愿景
你不需要成为设计师。你只需要知道你想把什么变为现实。 你脑海中的想法与屏幕上的成果之间的差距刚刚消失了。 这就是 Replit Design 背后的愿景。 阅读我们构建它的原因以及我们认为 AI 驱动设计的未来方向:https://replit.com/blog/introducing-replit-design
信息来源:X:Replit (@Replit)
产品发布 / 更新精选
OpenAI 为学术研究者免费提供前沿模型
ChatGPT for Academic Researchers - 免费(!!)使用我们的前沿模型,包括 GPT-5.6-Sol Pro,面向数学家、科学家、研究人员和学者。 让未解难题倒下!
信息来源:X:Sherwin Wu(@sherwinwu) · OpenAI / ChatGPT / GPT
产品发布 / 更新精选
Perplexity 开源智能体检测层 Numbat
今天我们开源了 Numbat,这是一个智能体检测与响应层,旨在跨多种智能体框架工作。 Numbat 为安全团队提供对智能体活动的可见性,并可在执行前阻止选定操作。 了解更多:https://research.perplexity.ai/articles/securing-agents-across-perplexity%E2%80%99s-client-endpoints-with-numbat
信息来源:X:Perplexity (@perplexity_ai)
产品发布 / 更新精选
开源引擎可在任何 M 系列 Mac 上以 2 GB 内存运行 Gemma 4 26B
一个开源引擎让 Gemma 4 26B 模型能在任何 M 系列 Mac 上运行,仅需 2 GB 内存。该项目已发布在 GitHub 上,大幅降低了本地运行大语言模型的硬件门槛。
信息来源:Hacker News 热门(buzzing.cc 中文翻译)
产品发布 / 更新精选
Martha Stewart 联合创办 AI 初创公司 Hint,为房主提供家居管理 AI 助手
Hint 今日上线,利用 AI 技术帮助房主管理维护计划、能耗、土壤与空气质量、保险理赔等事务,并支持存储和查询房屋相关合同与文件。该应用基于公开数据为每栋房屋建立档案,通过 AI 聊天机器人回答个性化问题,并提供主动维护提醒与"房屋评分"。Hint 目前免费提供 iOS 版,无订阅或广告,未来计划推出付费高级功能。
信息来源:TechCrunch:AI(RSS)
产品发布 / 更新精选
腾讯混元开源 AngelSpec 投机解码框架
腾讯混元开源端到端投机解码框架 AngelSpec,支持训练与部署。在 Hy3-A21B 模型上,其 DFly 方案相比自回归解码实现 1.98-2.40 倍端到端加速,吞吐量比 DFlash 高 10.5-11.8%。训练代码及 Hy3-A21B MTP/DFly 草稿模型权重已开源。
信息来源:X:腾讯混元 (@TencentHunyuan)
产品发布 / 更新精选
腾讯混元开源 AngelSpec:投机解码推理加速最高 2.4 倍
腾讯混元开源覆盖训练到部署的投机解码框架 AngelSpec,并放出 Hy3-A21B 的 MTP 与 DFly drafter 权重及训练代码。
信息来源:公众号:腾讯混元
产品发布 / 更新精选
烧了一万块API后,我找到了同时适用于Fable5和GPT5.6的AI工作流
作者将Claude Code与Codex的协作工具搭子升级至2.0版,通过deep_reasoner、fast_worker、arbiter三种身份及跨项目模型混编,把每周500美元的API账单压缩至400美元。2.0新增本地配置UI、一键试跑、Goal哈希校验和带证据链的小票,并支持按host分命名空间独立配置两个Agent。
信息来源:公众号:卡尔的AI沃茨 · GPT / Claude
产品发布 / 更新精选
在 M1 Max 上运行 2.8T 参数的 Kimi K3:Deltafin 项目实现 0.0687 token/s 推理
Deltafin 项目成功在 64 GB M1 Max 上运行了 2.8T 参数的 MoE 模型 Kimi K3,当前中位推理速度为 0.0687 token/s(14.6 秒/token)。完整安装需约 1.7 TB 本地磁盘,流式模式仅需 215 GB 但推理速度降至 3 分钟以上/token。项目提供 OpenAI 兼容 API 服务器,支持聊天和代码补全,但建议客户端超时设为小时级别。
信息来源:Hacker News 热门(buzzing.cc 中文翻译) · OpenAI / Kimi
产品发布 / 更新精选
OpenAI 发布 Codex 安全 CLI 与 SDK
更多开源福利。我们刚刚发布了一个 CLI 和 TypeScript SDK,用于查找、验证和修复代码中的安全漏洞。扫描仓库、审查变更、随时间追踪发现,并在 CI 中运行安全检查。 https://github.com/openai/codex-security
信息来源:X:Tibo (@thsottiaux) · OpenAI
产品发布 / 更新精选
Gemini API Managed Agents 默认升级为 3.6 Flash,新增环境钩子与免费套餐
Google DeepMind 将 Gemini API Managed Agents 的默认模型升级为 Gemini 3.6 Flash,并支持显式选择 3.5 Flash 或 3.5 Flash-Lite。新增环境钩子允许在沙箱内工具调用前后执行自定义脚本,用于安全审查或代码格式化。此外,还推出了免费套餐、预算控制和基于 cron 的定时触发功能。
信息来源:Google Blog:AI(RSS) · Gemini
产品发布 / 更新精选
Perplexity 推出 Windows 版个人电脑智能体
Personal Computer 现已在 Perplexity Windows 应用中可用。 Personal Computer 是面向你工作的本地智能体工具。它协调跨本地文件、已连接应用和网络的智能体。 研究、编码、浏览和构建,全部在一个统一系统中完成。
信息来源:X:Perplexity (@perplexity_ai)
产品发布 / 更新精选
豆包搜索开放服务,为Agent提供实时、权威、可信的搜索能力
火山引擎正式上线豆包搜索服务,为企业和开发者构建AI Agent提供跨语言、多模态、多垂类的联网信息查询引擎。该服务支持API、Skill、MCP等多种接入形态,也可在Agent Plan中一键配置启用,并提供每月500次免费搜索额度。豆包搜索已在SimpleQA、FreshQA、BrowseComp-ZH等多项公开评测中表现优异,并服务国内9成TOP手机厂商的智能助手。
信息来源:公众号:火山引擎 · 豆包
产品发布 / 更新精选
火山引擎上线豆包搜索服务,为AI Agent提供实时可信搜索能力
火山引擎正式上线豆包搜索服务,为AI Agent提供跨语言、多模态、多垂类联网信息查询,融合全域互联网信息、行业知识与字节跳动独家内容资源。该服务从网站站点和创作者维度建立权威分级体系,过滤低质信息,在SimpleQA、FreshQA、BrowseComp-ZH等评测中表现优异。豆包搜索支持API、Skill、MCP等多种接入形态,面向企业和开发者提供每月500次免费搜索额度。
信息来源:公众号:火山引擎 · 豆包