AI 情报文章归档
浏览 AI圈报 已保存的 5973 条 AI 情报文章,覆盖模型、产品、行业、论文、教程与观点方法六大分类。
已收录文章5973
正式分类6
精选内容3375
全部文章
第 68 / 150 页 · 每页 40 条
模型发布 / 更新精选
Liquid AI 发布 LFM2.5 系列 QAD Q4_0 量化检查点,恢复 97% 精度损失
Liquid AI 发布基于量化感知蒸馏(QAD)训练的 LFM2.5-230M、350M、1.2B-Instruct 和 2.6B 四款 Q4_0 GGUF 检查点,在保持原生 Q4_0 内存与速度的同时,恢复 BF16 平均精度损失的 97%。
信息来源:Hugging Face:Blog(RSS) · Hugging Face
产品发布 / 更新普通
SpaceXAI Grok 4.6 在 Amazon Bedrock 一般可用:云渠道落地,非新权重
SpaceXAI/xAI 旗舰模型 Grok 4.6(本体 8-12 发布)于 8-19 在 Amazon Bedrock 对支持区域一般可用,开发者可在 Bedrock 直接调用。这是云平台渠道落地,并非新模型或新权重发布;官方 x.ai 页与 AWS what-new 页均确认。
信息来源:AI Insight · Grok
产品发布 / 更新精选
GLM-5.3上线:AA智能指数60分并列开源第一,成本更低
GLM-5.3 API即日上线,擅长复杂编码、防御性网络安全与长程任务,在AA综合智能指数中取得60分,与Claude Fable 5、GPT-5.6 Sol等闭源旗舰同级,并与Kimi K3并列开源模型第一。该模型以更小参数规模和更低调用成本降低前沿智能门槛,单任务成本为旗舰模型中最低。API定价与GLM-5.2持平,模型权重将于下周五开源。
信息来源:公众号:智谱(GLM) · GPT / Claude / GLM
行业动态精选
OpenRouter 宣布加入 Stripe
OpenRouter 宣布与 Stripe 合并,以加速推动全球经济增长。OpenRouter 目前每日处理来自 400 多个 AI 模型的 10+ 万亿 token,服务超 1000 万开发者与公司,自成立以来推理量每年至少增长 10 倍。合并后 OpenRouter 将继续以原名、原使命独立运营,产品与路线图不变,路由决策仍以用户利益为先,交易预计在未来数周内完成。
信息来源:OpenRouter:Announcements(RSS)
产品发布 / 更新精选
Grok Build 全面上线网页与移动端,所有套餐可用
Grok Build 现已面向所有套餐开放,支持网页、iOS 和 Android 端使用。用户描述应用、游戏或网站后,Grok 可在聊天中实时生成可运行版本。该功能自 7 月推出 Early Beta 以来,新增了发布分享、接入 X 及调用 Grok 自身模型等能力,发布的应用可获得 grok.me 链接并支持自定义域名、导出到 GitHub 等。
信息来源:xAI:News(网页) · Grok
产品发布 / 更新精选
Mojo 语言正式开源,编译器与工具链全面开放
Mojo🔥 语言现已正式开源,采用 Apache 2.0 许可证(含 LLVM 例外),编译器、工具链及全部源码已发布至 modular GitHub 仓库。Mojo 上周刚达成 1.0 版本(源码稳定),此次开源涵盖整个编译器与工具链。目前暂不接受编译器相关贡献,计划年底前开放,标准库自 2024 年起已接受社区贡献。
信息来源:Hacker News 热门(buzzing.cc 中文翻译)
产品发布 / 更新精选
Claude 现已支持 Gmail 邮件与 Google Drive 文件管理
Claude 现在可以在 Gmail 中发送邮件,并管理 Google Drive 中的文件。 让 Claude 回复某个邮件线程,它会起草并发送回复。你可以控制何时需要你的批准。 从连接器菜单中选择连接 Gmail 或 Google Drive 即可试用。所有付费套餐均可用。
信息来源:X:Claude (@claudeai) · Claude
论文研究精选
智能体记忆并非越多越好:八款模型评测显示剂量需按能力校准
智能体记忆并非可随意开启的功能,而是需按模型能力校准的剂量。强模型适合注入完整指南集,DeepSeek-V3.2(671B MoE)任务完成率提升+9.5个百分点;较弱模型采用精选检索效果最佳,gpt-oss-120b(117B MoE)提升+16.1pp且仅增加+5% token。该方法无需更新权重或人工标注,通过从智能体过往轨迹中蒸馏指南并在推理时注入实现。
信息来源:Hugging Face:Blog(RSS) · GPT / DeepSeek / Hugging Face
论文研究精选
突破 DeepSeek-V4-Pro 服务极限:H20 上的多场景优化方法
LMSYS 团队针对 1.6 万亿参数的 MoE 模型 DeepSeek-V4-Pro,在 H20 GPU 上通过场景化服务配置逼近 B300 性能。单节点 H20-141GB 参考实现达 271 output tokens/s,与 B300 的 383.7 tokens/s 性能差距缩小至 1.42×。
信息来源:LMSYS:Blog(Chatbot Arena 团队) · DeepSeek / NVIDIA
观点 / 方法精选
OpenAI 在"关键网络能力"时代放缓模型开发节奏
OpenAI 因 OpenAI-Hugging Face 事件及即将推出的 Astra 模型可能达到《预备框架》下的"关键网络安全能力"阈值,暂时放缓了模型扩展速度,包括暂停最新部署模型的强化学习训练两周,并搁置最大规模前沿 RL 运行。公司已加强研究环境安全,要求对 Astra 及网络相关负载实施最严格防护,并扩展思维链监控,采用多阶段激活分类器检测机制。
信息来源:OpenAI:官网动态(RSS · 排除企业/客户案例) · OpenAI / Hugging Face
产品发布 / 更新普通
Anthropic:Claude Cowork 对 Pro/Max/Team 等付费套餐开放 mobile 与 web(beta)
此前先在 Max 滚动的 Claude Cowork 移动端与网页端,现已对 Pro、Max、Team 等付费套餐(及管理员启用的 Enterprise)beta 开放,Pro 侧仍在分批推进。帮助中心标明仍为 beta,部分功能(如桌面端的 live artifacts)暂未在全部端可用。
信息来源:AI Insight · Claude
行业动态普通
OpenAI 暂停最新待部署模型的强化学习两周,最大前沿 RL 跑数仍挂起
OpenAI 公布已对拟部署的最新模型暂停两周强化学习,用于加固研究环境并扩展监控;最大计划中的前沿 RL 跑数仍挂起,改由更小规模训练与评估来验证防护。此举与网络能力主题(Daybreak 与 GPT-5.6-Cyber)相关,本条新信息是训练节奏本身。
信息来源:AI Insight · OpenAI / GPT
论文研究普通
Anthropic 发布 Claude 自主设计蛋白实验:14/15 靶标获有效绑定剂,湿实验独立验证
Anthropic 8-18 发布研究:Claude(Mythos Preview 与 Opus 4.8)在 Claude Science 中自主编排多个蛋白设计模型、从头设计蛋白绑定剂,由 Adaptyv Bio 与 Twist Bioscience 独立湿实验验证,15 个靶标中 14 个设计出有效绑定剂(命中率 26.7%、单靶 35.1%,高于常见 10–15%)。另 Opus 5 处理 NMR 与 LC-MS 原始数据(约 23/19 分钟),纯度判读 96.4%…
信息来源:AI Insight · Claude
产品发布 / 更新普通
OpenAI 上线 ChatGPT for Teens:面向 13–17 岁,默认强化安全与学习导向
OpenAI 8-18 正式推出面向 13–17 岁的 ChatGPT for Teens。用户注册自报未满 18 岁、或系统用 AI 年龄预测判定疑似未成年时自动进入该体验;默认加强安全防护(限制自残、暴力、饮食失调、色情等内容)并偏学习导向(作业与学习辅助重在引导而非直接给答案,含休息提醒与家长控制)。同日公布与 CodeAI 的教育合作,归同一 release。
信息来源:AI Insight · OpenAI / ChatGPT
观点 / 方法精选
设计 AI 评测:先求清晰,再谈可视化
本文演示如何用开源评测框架 Inspect AI 和 Harbor 评估 agent 技能,并借助 Google Sheets 和 Data Studio 进行可视化分析。
信息来源:Google AI:DEV 作者专属(RSS)
论文研究精选
StartupBench:面向市场验证端到端工作流的通用智能体基准测试
StartupBench 是一个基于市场验证的 AI 初创公司产品构建的端到端智能体基准,从真实采用的产品工作流中提炼任务,而非研究者预设任务。在统一智能体框架下,最强模型也仅能完成约 30% 的任务,复杂指令遵循和领域专业知识是主要失败来源。该基准揭示了当前通用智能体在真实用户任务上的能力边界。
信息来源:HuggingFace Daily Papers(社区热门论文) · Hugging Face
观点 / 方法精选
本地小模型也能媲美云端前沿模型:Qwen3.8-27B 的另类飞行路径
本地运行的 Qwen3.8-27B 在 Artificial Analysis 智能指数上以 52 分位列 135 个模型之首,超过 7530 亿参数的 GLM-5.2。在 25 项风投任务评测中,它与云端 DeepSeek V4 输出质量同为 8.0 分,但需多花 7.2 倍 token 思考,速度慢约 9 秒。小模型靠更长的链式推理弥补知识差距,而非直接给出答案。
信息来源:Tomer Tunguz 博客(VC 分析) · DeepSeek / Qwen / GLM
产品发布 / 更新精选
Sentence Transformers v6.0 新增 MultiVectorEncoder,支持 ColBERT 风格多向量模型
Sentence Transformers v6.0 新增第四种模型类型 MultiVectorEncoder,可直接加载 PyLate、Stanford-NLP ColBERT 及 colpali-engine 检查点,用于 ColBERT 式晚期交互检索。
信息来源:Hugging Face:Blog(RSS) · Hugging Face
观点 / 方法精选
一个实用的深度思考Prompt:用"双向钢人论证"让AI帮你挖出最本质的答案
作者基于Reddit上"让Claude真正开始思考"的帖子,引入逻辑学中的"钢人论证"(steelman)概念,并自创了一个"双向钢人Prompt"。该Prompt通过重述真实问题、强化正反双方观点、找出关键变量、逼AI给出明确判断四步,旨在避免模型谄媚,帮助用户找到问题最本质的答案。作者以自己选择公司司庆日的真实案例演示了使用效果。
信息来源:公众号:数字生命卡兹克 · Claude
产品发布 / 更新精选
Cursor 推出 Origin 代码托管服务,作为 GitHub 的替代方案
Cursor 今日起向所有付费计划用户开放 Origin 代码托管的早期测试版,提供仓库、拉取请求、代码浏览及 GitHub 同步功能。用户可创建以 cursor.com/codebase/ 为前缀的仓库,或将 GitHub 仓库同步至 Origin,双向同步评论与审查。Vercel、Depot 和 Buildkite 集成已可用,智能体功能即将推出。
信息来源:Hacker News 热门(buzzing.cc 中文翻译) · Cursor
行业动态精选
404 Media 追踪珍本图书流向:亚马逊批量购书扫描用于 AI 训练后销毁
404 Media 通过在一本珍本图书中放置追踪设备,首次揭露亚马逊未公开的购书行动:批量购入大量书籍,扫描用于 AI 训练数据,随后销毁。追踪显示这些书最终被送往亚马逊的一处人工智能训练中心。
信息来源:Hacker News 热门(buzzing.cc 中文翻译)
教程 / 实战精选
如何禁用或避免侵入式 AI:一份覆盖 Windows、Chrome、Edge、Firefox 及主流应用的实用指南
一份面向希望减少技术环境中侵入式 AI 的用户的操作指南,涵盖 Adobe Acrobat、Android/Gemini、Apple Intelligence、Chrome、Edge、Firefox、DuckDuckGo、Google Workspace、Slack、WhatsApp 及 Windows 11/Copilot 等平台。
信息来源:Hacker News 热门(buzzing.cc 中文翻译) · Gemini
教程 / 实战精选
Claude Tag 如何担任 Anthropic CI/CD 故障的一线响应者
Anthropic 的 CI 工程师用 Claude Tag 构建了值班智能体,作为 CI/CD 故障的一线响应者。Claude 在事故发生后中位 14 分钟发布首份基于证据的分析,最快案例中 3 分钟内验证修复并确认错误率恢复基线。该方案通过 Slack 频道、Datadog 或 Grafana 工具访问及 GitHub 技能文件实现,Anthropic 已发布通用设置套件供其他团队部署。
信息来源:Claude:Blog(网页) · Claude
行业动态精选
黄仁勋宣布与SB Energy合作,为OpenAI建AI工厂
黄仁勋宣布NVIDIA与SB Energy合作,在俄亥俄州PORTS-Pike科技园区锁定LPS容量,专供NVIDIA AI工厂使用,OpenAI将作为租户。初始部署预计提供4.25吉瓦AI工厂容量,每代系统约150万块NVIDIA GPU,对应1500亿至2000亿美元收入。OpenAI已承诺至2030年部署约12吉瓦NVIDIA算力,可扩展至16吉瓦,总机会约6000亿美元。
信息来源:X:Jensen Huang (@JensenHuang) · OpenAI / NVIDIA
行业动态精选
NVIDIA 与 SB Energy 合作锁定俄亥俄州 PORTS-Pike 园区电力容量,OpenAI 将入驻
NVIDIA 宣布与 SB Energy 合作,锁定俄亥俄州 PORTS-Pike 科技园区的电力容量(LPS)以独家部署 NVIDIA 算力,OpenAI 将成为租户。
信息来源:NVIDIA Blog(RSS) · OpenAI / NVIDIA
行业动态精选
A 股迎来"人形机器人第一股",宇树科技官宣 8 月 19 日科创板上市
宇树科技宣布股票将于 2026 年 8 月 19 日在科创板上市,发行价 150.80 元/股,对应市值约 609.93 亿元,预计募资约 60.99 亿元。该公司 2023 至 2025 年营收分别为 1.59 亿元、3.93 亿元和 16.99 亿元,净利润分别为-1114.51 万元、9547.47 万元和 2.78 亿元,是全球少数实现盈利的高性能通用机器人公司。
信息来源:IT之家(RSS)
行业动态普通
OpenAI 加入 PORTS-Pike 数据中心项目:SB Energy 建运、20 年租约,2028 起分阶投产
OpenAI 已签约成为俄亥俄州 Pike County 的 PORTS-Pike 机房容量客户,伙伴为 SB Energy、NVIDIA 与美国能源部/商务部。NVIDIA 公告确认 OpenAI 为 8-IT GW 客户,SB Energy 建设、拥有并运营该数据中心并以 20 年租约租给 OpenAI,NVIDIA 另向 SB Energy 投资 15 亿美元。官方写明产能预计 2028 年起分阶段投产——这是已签约的基建扩展,不是已上线算力。
信息来源:AI Insight · OpenAI / NVIDIA
产品发布 / 更新精选
inclusionAI 开源 ConceptEdit:基于概念缩放与密集监督的图像编辑数据生成管线
蚂蚁集团 inclusionAI 开源 ConceptEdit,一个基于概念缩放与密集监督的图像编辑数据生成管线。该管线通过三阶段流程(VLM 生成指令、FLUX 执行编辑、VQA 评估筛选)构建大规模、基于分类法的图像编辑数据集,并提供单概念与多概念两种变体。项目采用 MIT 许可证,支持断点续跑,需 OpenAI 兼容 VLM 端点与本地 FLUX 检查点。
信息来源:蚂蚁 inclusionAI:GitHub 新仓库 · OpenAI
教程 / 实战精选
OpenAI 如何用前沿智能加固自身防御:The Defender's Window
OpenAI 在 OpenAI-Hugging Face 事件后反思低估了模型真实网络攻击能力,正通过四大支柱强化自身安全:用 Codex 验证代码漏洞、用智能体优先分流安全告警、持续枚举攻击路径,并仅向可信防御者开放网络能力。文中演示 ChatGPT Work(基于 GPT-5.6 Sol)15 分钟发现个人网站 13 个问题并在一小时内完成修复。
信息来源:OpenAI:官网动态(RSS · 排除企业/客户案例) · OpenAI / ChatGPT / GPT
产品发布 / 更新精选
OpenRouter 推出 Activity 仪表盘与 Analytics API:按智能体、模型、请求追踪 AI 使用成本
OpenRouter 发布 Activity 仪表盘和 beta Analytics API,可按智能体、模型、请求维度查看支出、token 量、缓存命中率等指标,并支持下钻至单条请求日志。
信息来源:OpenRouter:Announcements(RSS)
观点 / 方法精选
Qwen 3.8 27B 表现出色,但默认推理强度过高导致过度思考
阿里 Qwen 实验室发布 Apache 2 许可的 27B 参数视觉大模型 Qwen 3.8 27B,官方基准显示其超越前代 Qwen 3.6 27B 及闭源 Qwen 3.7-Plus。
信息来源:Simon Willison 博客 · Qwen
教程 / 实战精选
用 Google 的 Agent Development Kit 构建零信任 AI 智能体
Google 开源了基于 ADK 和 Gemini 的零信任客服与退货智能体示例,演示如何防御提示注入等攻击。该架构在 LLM 上下文之外通过三层硬性安全机制保障:硬件支持的加密签名确保数据库写入不可抵赖、gVisor 沙箱隔离动态代码执行、确定性语义网关校验业务逻辑。系统提示词只是软约束,无法作为安全边界。
信息来源:Google Developers Blog(RSS) · Gemini
论文研究精选
AI生成书籍正淹没亚马逊,并拉低人类作者的单书收入
一项对14,419本自出版电子书的分析显示,AI生成书籍正以数量而非质量挤占人类作者市场,即便未检测到AI文本的书籍,单书收入也在下滑。2023年Q1至2026年Q1,书目总量增长38.3倍,而季度收入仅增长8.9倍;在八个类型中,七个类型的无AI文本书籍单书收入下降。
信息来源:The Decoder:AI News(RSS)
模型发布 / 更新精选
MOSS-VL技术报告:将实时交互作为一等能力的开源视觉语言模型家族
MOSS-VL是一个将实时交互(边感知边说话)作为一等能力的开源视觉语言模型家族,通过门控交叉注意力让语言解码器在生成时同步处理视觉输入。MOSS-VL-Realtime在四个流式基准中平均成绩居开源模型之首(三项第一、一项第二),在OmniMMI Proactive Alerting上以66.0分大幅领先最佳基线(37.5分)。
信息来源:HuggingFace Daily Papers(社区热门论文) · Hugging Face
模型发布 / 更新精选
Gemini 3.7 Flash 全面上线 Pro 与 Ultra 用户
Gemini 3.7 Flash 现已向 Gemini 聊天中的 Pro 和 Ultra 用户开放。该模型更新提升了多步骤任务的推理与准确性,如智能整合数十个文件和邮件为一份主文档。同时,Gemini Spark 也已运行于 3.7 Flash,通过改进对 Google Workspace 应用的工具调用,让个人 AI 智能体更精准。
信息来源:X:Gemini (@GeminiApp) · Gemini
模型发布 / 更新精选
通义千问开源 Qwen3.8 系列模型
通义千问兑现承诺,开源 Qwen3.8 系列模型。其中 Qwen3.8-27B 为原生多模态稠密模型,仅 27B 参数即全面超越 Qwen3.7-Plus,原生支持 262K 上下文,可通过 YaRN 扩展至 1M tokens,采用 Apache 2.0 许可。Max 级 Qwen3.8-2.4T-A95B 的开放权重也已同步发布。
信息来源:X:通义千问 / Qwen (@Alibaba_Qwen) · Qwen
行业动态精选
OpenAI and Anthropic in price war as Chinese AI rivals gain ground
信息来源:Ars Technica:AI(RSS) · OpenAI / Claude
行业动态精选
Cursor 正式被 SpaceX 收购
Cursor 已被 SpaceX 正式收购,完成自 4 月启动的收购流程。合并后 Cursor 将获得全球最大 GPU 集群,以构建更强且运行成本更低的模型,从而以更低价格向客户提供更强大的模型。本周三发布的 Grok 4.6 是双方合作成果的早期体现。
信息来源:Cursor Blog · Grok / Cursor
模型发布 / 更新精选
dots3-note Preview 开源:280B 参数轻量模型,主打长程智能体与多模态推理
小红书技术开源 dots3-note Preview,这是 dots3 系列最轻量模型,总参数 280B、激活参数 16B,支持 512K 上下文及文本、视觉、语音多模态理解,并针对复杂推理和长程 Agent 任务优化。
信息来源:公众号:小红书技术(dots.llm)
模型发布 / 更新普通
智谱发布 GLM-5.3:同基座后训练强化编程与安全,上线 Coding Plan/ZCode,权重拟两周后开源
智谱 8-14 发布 GLM-5.3,已通过 GLM Coding Plan 与 ZCode 提供。与 GLM-5.2 同基座,能力提升主要来自后训练强化,聚焦复杂编程、长程 agent 与漏洞发现类任务;官方称编程较 5.2 约提升 50%、在 Terminal Bench 3.0 与 Agents Last Exam 等公开榜位列开源第一、逼近 Claude Fable 5,网络安全 CyberGym 得 84.5%(以上为 Zhipu 自评/官方数据)。API 与开源…
信息来源:AI Insight · Claude / GLM