AI 产品发布与更新
发现 AI 应用、智能体、开发工具、生成式 AI 产品及重要功能升级,快速了解新产品能做什么。
分类文章1369
当前页33 / 35
持续更新永久归档
分类文章
按发布时间从新到旧 · 每页 40 条
产品发布 / 更新精选
Claude新增日常生活连接器
2026年4月23日,Anthropic宣布扩展其AI助手Claude的连接器生态,新增15款日常生活应用,包括AllTrails、Instacart、Audible等。自2025年7月上线以来,连接器目录已增长至超过200个,覆盖设计、金融、生产力等领域。新版本支持动态情境化推荐,能根据用户对话上下文智能建议相关应用,并在多应用适用时并列展示选项。所有连接操作需用户授权确认,用户数据不会用于模型训练,且可随时断开。该功能全版本可用,移动端处于测试阶段。
信息来源:Claude:Blog(网页) · Claude
产品发布 / 更新精选
利用 Responses API 中的 WebSockets 加速智能体工作流
Responses API 集成 WebSockets 技术优化 Codex 智能体循环架构。通过建立持久化连接并引入连接级缓存机制,该方案显著降低 API 通信开销,有效缩短模型响应延迟。这一技术改进解决了传统请求模式下的性能瓶颈,为高频交互的智能体工作流提供更高效的实时数据传输能力。
信息来源:OpenAI:官网动态(RSS · 排除企业/客户案例) · OpenAI
产品发布 / 更新精选
Agent Platform 中的 Agents CLI:从创建到生产,一栈式实现
Google Cloud 推出 Agents CLI 工具,专为连接本地开发与生产级 AI 智能体部署而设计。该 CLI 为编码助手提供对完整 Google Cloud 技术栈的机器可读访问,显著减少脚手架过程中的上下文过载与 token 消耗。通过将评估、基础设施配置和部署流程整合至统一的程序化主干,开发者能够将项目从初始概念推进至实时服务的时间从数周缩短至数小时。
信息来源:Google Developers Blog(RSS)
产品发布 / 更新精选
Making ChatGPT better for clinicians
OpenAI 宣布向美国经过验证的医生、执业护士和药剂师免费提供 ChatGPT for Clinicians。该版本专门支持临床护理、医疗文档撰写及医学研究任务,旨在提升医疗专业人士的工作效率与决策支持。此次免费开放标志着生成式AI工具在专业医疗场景的进一步应用落地。
信息来源:OpenAI:官网动态(RSS · 排除企业/客户案例) · OpenAI / ChatGPT
产品发布 / 更新精选
GitHub Copilot 个人计划的变更
GitHub官方博客发布关于Copilot个人订阅计划的变更公告。提供的正文内容仅包含文章标题与链接,未披露具体调整细节、定价变化、功能限制或用户配额等关键数据指标。该公告在Hacker News平台获得102个点赞,完整变更条款需查阅GitHub官方博客原文。
信息来源:Hacker News 热门(buzzing.cc 中文翻译)
产品发布 / 更新精选
QIMMA:一个质量优先的阿拉伯语大语言模型排行榜
QIMMA 是一个首创质量验证流程的阿拉伯语大语言模型评估平台。它整合了14个基准测试的109个子集、超5.2万个样本,覆盖文化、STEM等7大领域,其中99%为原生阿拉伯语内容。平台采用双阶段质量验证:先由两个大模型自动评估,再经人工审核,发现并剔除了现有基准中存在的系统性质量问题。此外,QIMMA首次集成了阿拉伯语问题描述的代码评估任务,并公开逐样本推理结果,确保了评估的可靠性与透明度。
信息来源:Hugging Face:Blog(RSS) · Hugging Face
产品发布 / 更新精选
我们在RTX 3090上运行Qwen3.5-27B,获得了207 tok/s的性能
开发者在单张RTX 3090显卡上成功运行Qwen3.5-27B模型,实现了每秒207个token的生成速度。该项目已在GitHub平台开源,展示了消费级硬件运行270亿参数大语言模型的高性能潜力。相关成果在Hacker News获得105个点赞,引发技术社区对本地大模型部署效率与优化方案的关注。
信息来源:Hacker News 热门(buzzing.cc 中文翻译) · Qwen
产品发布 / 更新精选
Show HN: TRELLIS.2 图像转3D功能已在 Mac Silicon 上运行--无需 Nvidia GPU
TRELLIS.2 图像转3D功能完成 Mac Silicon 适配,无需 Nvidia GPU 即可在苹果芯片上本地运行。开发者开源的移植版本打破了此前对英伟达显卡的硬件依赖。该项目在 Hacker News 发布当日获得 102 个点赞,标志着端侧 AI 3D 生成技术向跨平台部署迈出重要一步。
信息来源:Hacker News 热门(buzzing.cc 中文翻译) · NVIDIA
产品发布 / 更新精选
Anthropic Labs 推出 Claude Design
Anthropic Labs 推出 Claude Design,由 Claude Opus 4.7 驱动的视觉设计工具,面向 Claude Pro、Max、Team 及 Enterprise 订阅者开放研究预览。用户可通过对话快速创建设计原型、幻灯片及营销物料,支持自动应用企业设计系统、多格式导入导出,并能与 Claude Code 无缝衔接。据 Brilliant 反馈,复杂页面设计从 20 余条提示缩减至 2 条,设计到生产周期从数周缩短至单次对话。
信息来源:Anthropic:Newsroom(网页) · Claude
产品发布 / 更新精选
AutoClaw上线自进化机制与Skill商店,GLM Office Skills五件套同步上架
AutoClaw(澳龙)正式上线自进化机制与Skill商店,每轮对话后扫描用户纠正、新教方法或踩坑经验,经用户审批后写入永久记忆,支持关键词触发和自动检测两种方式,并保持每周1-3次高质量进化。
信息来源:公众号:智谱(GLM) · GLM
产品发布 / 更新精选
Grok语音转文本与文本转语音API发布
xAI发布Grok语音转文本(STT)与文本转语音(TTS)两款独立API,采用与Grok Voice、Tesla及Starlink相同技术栈。STT支持批量(0.10美元/小时)与实时流式(0.20美元/小时)转录,电话实体识别词错率仅5.0%,整体6.9%,优于竞品,支持25种以上语言及说话人分离。TTS定价4.20美元/百万字符,可通过【laugh】等标签精细控制情感语调。
信息来源:xAI:News(网页) · Grok
产品发布 / 更新精选
Chrome 推出 AI Mode:全新的网页探索方式
Chrome 浏览器今日升级 AI Mode 功能,通过人工智能技术深度改变用户与网页的交互方式。此次更新提供了全新的网络探索体验,将传统浏览行为转变为智能化交互模式,使用户能够更高效地获取和处理网络信息,标志着 Chrome 在浏览器 AI 化进程中的重要进展。
信息来源:Google Blog:AI(RSS)
产品发布 / 更新精选
Gemini 应用推出个性化图像创建新功能
Nano Banana 2 现支持结合个人上下文与 Google Photos 数据生成图像,通过分析用户独特的生活场景,创建反映个人经历的个性化视觉内容。该功能已在 Gemini 应用中上线,使 AI 图像生成能够基于真实生活语境,输出更贴合用户个人故事的定制化结果。
信息来源:Google Blog:AI(RSS) · Gemini
产品发布 / 更新精选
A2UI v0.9:便携、框架无关的生成式UI新标准
A2UI v0.9发布了一个框架无关的新标准,旨在帮助AI代理依据公司现有设计系统,实时生成定制化的UI组件。本次更新通过提供全新的Python版Agent SDK、共享的Web核心库,以及对React、Flutter和Angular等渲染器的官方支持,显著简化了开发体验。该版本将UI意图与具体平台解耦,实现了生成式界面在Web和移动应用间的无缝、低延迟流式传输。通过集成AG2和Vercel等更广泛的生态系统,A2UI v0.9致力于推动生成式UI从实验演示走向可用于生产环…
信息来源:Google Developers Blog(RSS)
产品发布 / 更新精选
适用于(几乎)所有场景的 Codex
Codex 应用推出重大更新,正式支持 macOS 和 Windows 双平台。新版本集成计算机操控、应用内浏览、图像生成、记忆存储及插件系统五大核心能力,通过自动化操作与多模态功能深度整合,全面加速开发者工作流程。
信息来源:OpenAI:官网动态(RSS · 排除企业/客户案例) · OpenAI
产品发布 / 更新精选
MiniMax 发布 MaxHermes:全球首个云端沙箱 Hermes,一键"养马"
MiniMax 正式上线 MaxHermes,这是全球首个基于 Hermes Agent 构建的云端沙箱 AI 助手。它通过学习闭环自动提炼可复用 Skills,并支持持久化跨会话记忆、自然语言定时任务及多子代理并行运行,能力随使用持续生长。相比本地部署,MaxHermes 无需自备服务器或 API Key,已打通飞书、钉钉等 IM 渠道,并支持 Token Plan 抵扣任务消耗。
信息来源:公众号:MiniMax(稀宇科技)
产品发布 / 更新精选
Ecom-RLVE:面向电子商务对话代理的自适应可验证环境
Ecom-RLVE 是一个为电子商务对话代理设计的自适应可验证环境。该环境支持智能体在模拟且可验证的电商场景中进行训练与评估,通过动态调整交互难度和规则约束来提升对话系统的鲁棒性与适应性。其核心在于结合强化学习与验证机制,确保智能体行为既符合商业逻辑又可追溯,为电商对话系统的开发与测试提供标准化、可复现的实验平台。
信息来源:Hugging Face:Blog(RSS) · Hugging Face
产品发布 / 更新精选
Agents SDK 的下一代进化
OpenAI 推出 Agents SDK 重大更新,引入原生沙盒执行环境与模型原生 harness 架构。新版本支持开发者构建可跨文件及工具运行的安全、长期驻留型智能代理。通过内置隔离执行机制与模型层原生集成,该 SDK 显著提升了代理系统的安全性与持续运行能力,为企业级复杂代理应用提供基础设施支撑。
信息来源:OpenAI:官网动态(RSS · 排除企业/客户案例) · OpenAI
产品发布 / 更新精选
认识HCompany的HoloTab:您的AI浏览器伴侣
H公司在Hugging Face平台发布博客,正式推出AI浏览器伴侣HoloTab。该产品定位为浏览器内的智能助手,旨在通过AI技术提升网页浏览与信息处理效率。目前公开信息显示其集成于浏览器环境,具体功能细节与性能指标尚未披露。
信息来源:Hugging Face:Blog(RSS) · Hugging Face
产品发布 / 更新精选
宣布推出视频生成功能
OpenRouter平台现已上线视频生成服务。用户可通过单一API接口,直接调用顶级的视频生成模型。这一集成简化了开发流程,使开发者无需分别对接不同厂商,即可便捷地访问和使用当前领先的视频AI模型能力。
信息来源:OpenRouter:Announcements(RSS)
产品发布 / 更新精选
在画布中与智能体创建的可视化界面交互
Cursor新增画布功能,可将信息转化为可视化、可交互的界面,替代难以阅读的长篇文本。智能体能利用画布为真实数据创建仪表盘,或定制带逻辑的交互界面,应用于代码审查、学习库文档乃至管理其他智能体。该功能基于React组件库构建,包含表格、图表等原生组件。在数据密集型任务中尤为高效,例如聚合多源数据生成统一分析图表,或在代码审查中智能分组并优先展示关键变更。Cursor团队已借此显著提升了模型评估分析和复杂问题研究的效率,成为扩展人机协作信息带宽的关键工具。
信息来源:Cursor Blog · Cursor
产品发布 / 更新精选
Subagents 已登陆 Gemini CLI
Gemini CLI 引入了子代理功能,这是一种专门的专家代理,能在独立的上下文窗口中处理复杂或高吞吐量任务,从而保持主会话的快速与专注。用户可通过 Markdown 文件自定义这些代理,并支持并行运行以提高效率。使用 @agent 语法即可轻松调用,实现精准的任务委派。该架构通过将复杂的多步骤执行过程整合为简洁的摘要反馈给主协调器,有效防止了"上下文腐化"。
信息来源:Google Developers Blog(RSS) · Gemini
产品发布 / 更新精选
Claude Code 推出 Routines 自动化功能
Claude Code 发布 routines 研究预览版,支持配置包含提示词、代码仓库及连接器的自动化工作流,可按定时计划(每小时/每晚/每周)、API调用或GitHub Webhook事件触发,并在云端基础设施运行,无需本地电脑保持在线。适用于自动处理积压工单、代码审查、部署验证及告警分类等场景。目前向Pro、Max、Team及Enterprise订阅用户开放,每日运行次数限制分别为5次、15次和25次。
信息来源:Claude:Blog(网页) · Claude
产品发布 / 更新精选
Chrome 推出 Skills 功能:将优质 AI 提示词变为一键工具
Chrome 浏览器新增 Skills 功能,支持用户发现、保存和重新组合 AI 工作流,实现一键即时复用。该功能可将常用 AI 提示词转化为可重复调用的自动化工具,避免重复输入复杂指令,提升浏览器内的 AI 使用效率。用户能够保存优质提示词并灵活改造,在 Chrome 中快速构建个性化 AI 工具库。
信息来源:Google Blog:AI(RSS)
产品发布 / 更新精选
Mistral AI在Studio中发布Connectors功能,通过内置和自定义MCP连接企业数据到AI应用
2026年4月15日,Mistral AI在Studio中推出Connectors功能,允许开发者通过可复用的连接器、直接工具调用和人工审批控制,安全地将企业数据集成到AI应用程序。所有内置连接器及自定义MCP均支持API/SDK调用,并集中注册,可在LeChat和AI Studio等平台使用。直接工具调用提供更精确的控制,而人工审批流程能在工具执行前进行安全审查。该功能旨在解决企业集成中重复构建、维护成本高和安全风险等问题,简化AI代理开发流程。
信息来源:Mistral AI:News(网页) · Mistral
产品发布 / 更新精选
基于 Sentence Transformers 的多模态嵌入与重排序模型
Sentence Transformers 开源社区发布了支持多模态的嵌入与重排序模型。新模型能够同时处理文本和图像输入,生成统一的语义向量表示,并可通过交叉编码器实现细粒度相关性重排序。该版本显著扩展了原框架的纯文本能力,支持图像-文本检索、跨模态匹配等场景,所有代码与预训练模型均已开源,延续了其推动AI民主化的目标。
信息来源:Hugging Face:Blog(RSS) · Hugging Face
产品发布 / 更新精选
Claude Cowork 正式上线企业版功能
Claude Cowork 向所有付费用户正式开放,并推出企业级管理控制功能。企业版管理员现可配置基于角色的访问权限、团队支出预算及 OpenTelemetry 可观测性,通过面板追踪 DAU/WAU/MAU 等使用数据。新增 Zoom MCP 连接器及按工具细分的权限控制。数据显示,目前大部分使用来自工程团队以外的运营、市场、财务和法务部门,主要用于项目更新、协作文档等任务。
信息来源:Claude:Blog(网页) · Claude
产品发布 / 更新精选
顾问策略:为智能体提供智能升级
Anthropic 在 Claude Platform 推出 advisor tool 测试版,实现"顾问策略":以 Opus 为顾问模型,Sonnet 或 Haiku 为执行模型。执行模型全程主导任务,仅在遇到决策难题时咨询 Opus 获取指导。该方案让 Sonnet 在 SWE-bench Multilingual 基准上性能提升 2.7 个百分点,同时成本降低 11.9%;Haiku 搭配 Opus 在 BrowseComp 得分达 41.2%,是单独 Haiku(1…
信息来源:Claude:Blog(网页) · Claude
产品发布 / 更新精选
Bugbot 现可通过学习规则实现自我改进
Bugbot 的 bug 解决率已从 2025 年 7 月正式推出时的 52% 提升至近 80%,领先其他 AI 代码审查产品。其核心改进在于引入了规则学习机制,能够从实时代码审查反馈(如开发者反应、回复和人工评审意见)中自主学习,取代了原先依赖离线实验的更新模式。自测试版推出以来,已有超过 11 万个仓库启用该功能,生成了逾 4.4 万条规则。这些规则可根据信号积累被激活或禁用,帮助 Bugbot 更精准地识别问题。用户可在 Cursor Dashboard 中管理学习规…
信息来源:Cursor Blog · Cursor
产品发布 / 更新精选
cuLA:用 CUDA 重写线性注意力
cuLA是一套面向GLA、KDA等线性注意力变体的高性能CUDA内核库。它通过手工优化的CuTe DSL与CUTLASS C++实现,深度适配NVIDIA Hopper和Blackwell等新一代GPU架构,旨在将复杂算法转化为可直接调用的高性能算子。其接口与flash-linear-attention保持一致,开发者仅需修改一行import即可低成本接入。性能测试显示,其内核在Blackwell和Hopper GPU上相比Triton基线实现,平均加速比最高达1.52倍。…
信息来源:蚂蚁百灵:Developer Blog(网页) · NVIDIA
产品发布 / 更新精选
TorchTPU:在谷歌规模上原生运行 PyTorch 于 TPU
TorchTPU 是一个新的工程栈,旨在让 PyTorch 工作负载以最小代码改动在谷歌 TPU 基础设施上获得原生高性能体验。它采用"Eager First"设计,提供多执行模式,并利用 XLA 编译器优化大规模集群的分布式训练。项目计划到 2026 年进一步降低编译开销,扩展对动态形状和自定义内核的支持,以确保下一代 AI 实现无缝扩展。
信息来源:Google Developers Blog(RSS)
产品发布 / 更新精选
Codex App 使用量已超越 VS Code 扩展和 CLI,成为我们最常用的界面。难怪它…
Codex App 使用量正式超过 VS Code 扩展和 CLI,成为 OpenAI 最热门的交互界面。这一成功引发同行关注(👀)。新用户现可前往官网安装,企业或商业入门最高可获 $500 额度。
信息来源:X:Tibo (@thsottiaux) · OpenAI
产品发布 / 更新精选
Cursor 3.0 发布:以 Agent 为核心的统一开发空间
Cursor 3.0 正式发布,重构为以 Agent 为核心的统一工作空间。新界面原生支持多仓库协作,可并行运行本地与云端 Agent(覆盖移动端、Slack、GitHub 等入口),支持会话在环境间无缝迁移以便离线运行或本地迭代。完整保留 IDE 能力:文件编辑、LSP、内置浏览器及插件市场。基于自研 Composer 2 模型,目标是通过多 Agent 自主协作实现"代码库自动驾驶"。
信息来源:Cursor Blog · Cursor
产品发布 / 更新精选
ADK Go 1.0 正式发布:迈向生产就绪的多智能体开发框架
Agent Development Kit (ADK) for Go 1.0 版本正式发布,标志着其从实验性脚本转向生产就绪的服务框架。本次更新核心在于强化可观测性、安全性与可扩展性,主要特性包括:原生集成OpenTelemetry以实现深度追踪;支持自愈逻辑的新插件系统;在敏感操作中引入"人在回路"安全确认机制。此外,新版本提供了基于YAML的配置以加速迭代,并优化了Agent2Agent协议,以支持跨编程语言的智能体无缝通信。该框架使开发者能够依托Go语言的高性能工程标…
信息来源:Google Developers Blog(RSS)
产品发布 / 更新精选
Stripe Projects:让 AI 自动完成 DevOps 全流程
构建现代应用的最大挑战并非代码本身,而是 DevOps 中繁琐的服务集成、API 密钥管理和部署配置。作者期待未来 AI 智能体能自动完成从文档阅读到生产环境部署的全流程,无需人工点击网页或手动配置。Stripe 推出的 Projects 正是朝此方向迈进:开发者可通过 CLI 命令自动配置 PostHog 等第三方服务,实现账户创建、密钥获取和计费设置的自动化,真正将基础设施生命周期转化为代码。
信息来源:X:Andrej Karpathy (@karpathy)
产品发布 / 更新精选
OpenAI 推出安全漏洞赏金计划
OpenAI 启动安全漏洞赏金计划,悬赏征集 AI 滥用及安全风险漏洞,涵盖智能体漏洞、提示注入攻击和数据泄露等问题。
信息来源:OpenAI:官网动态(RSS · 排除企业/客户案例) · OpenAI
产品发布 / 更新精选
Claude Code 自动模式:在安全与效率间取得平衡
Anthropic 为 Claude Code 推出"自动模式",旨在解决用户因频繁手动批准而产生的"批准疲劳"。该模式介于完全手动审批和危险的无权限跳过之间,采用两层防御机制:输入层通过服务器端提示注入探测器扫描工具输出;输出层则利用基于 Sonnet 4.6 模型的转录分类器,在执行前评估操作风险。分类器采用高效的两阶段设计,先快速过滤,必要时才启动思维链推理。其目标是拦截危险操作(如过度积极行为、无心之失、提示注入等),同时让大部分安全操作无需确认即可运行,内部测试显…
信息来源:Anthropic:Engineering(事故复盘 + 工程实践 · 网页) · Claude
产品发布 / 更新精选
ChatGPT 推出产品发现功能
ChatGPT 上线基于 Agentic Commerce Protocol 的全新购物功能,提供更丰富的视觉化沉浸式体验,支持商品发现、并排对比及商家集成。
信息来源:OpenAI:官网动态(RSS · 排除企业/客户案例) · OpenAI / ChatGPT
产品发布 / 更新精选
Superintelligence 团队新图像模型 MAI-Image-2 登陆 Copilot,即将上架 Foundry 企业版
MAI-Image-2 图像生成模型已在 MAI Playground 上线,竞技场排名第 3,支持从写实风格到详细信息图等多种生成需求。即将集成至 Copilot、Bing Image Creator 及 Microsoft Foundry,面向企业客户开放。
信息来源:X:Satya Nadella (@satyanadella)
产品发布 / 更新精选
FastVideo推出Dreamverse原型,实现"氛围导演"式实时视频生成
FastVideo团队发布Dreamverse原型界面,引入创新的"氛围导演"工作流。该模式允许用户通过自然语言实时、迭代地引导视频生成,如更换背景或调整运镜,无需编写复杂的长提示词。其核心是全新的实时推理栈,能在单GPU上以约4.55秒生成5秒1080p视频,速度快于观看时间,从而将生成过程从被动等待转变为实时导演体验。团队认为,视频生成的未来在于让创作速度跟上想象速度,快速的反馈循环比单纯追求模型性能更能催生优质作品。
信息来源:X:Sky Computing Lab (@haoailab)