AI 情报文章归档
浏览 AI圈报 已保存的 5621 条 AI 情报文章,覆盖模型、产品、行业、论文、教程与观点方法六大分类。
已收录文章5621
正式分类6
精选内容3500
全部文章
第 11 / 141 页 · 每页 40 条
观点 / 方法普通
GLM-5.3 Flash 对比 Claude Opus 4.6 与腾讯 Hy4
AI/ML API 用同一提示词测试 GLM-5.3 Flash、Claude 4.6 Opus 与腾讯 Hy4 的图像生成,成本分别为 $0.03、$0.29 和 $0.13。GLM-5.3 Flash 价格仅为 Claude 的 1/9.7,凸显模型路由的价值--"最佳模型"正让位于按需选择。
信息来源:X:Rohan Paul (@rohanpaul_ai) · Claude / GLM
产品发布 / 更新普通
Rosalind Workbench 研究预览发布
研究在工具之间的交接中会慢下来。 Rosalind workbench 现已进入研究预览:引导式任务、科学查看器,以及让你的问题、分析和证据保持关联的基因组学工作流。 立即试用:https://chatgpt.com/rosalind-workbench/
信息来源:X:Jason Liu (@jxnlco) · ChatGPT
行业动态普通
Gerred:全球顶尖的大规模推理服务专家
Gerred 可能位列全球前十,擅长在数千块 GPU 上进行大规模推理服务--去和 Gerred 一起工作吧。
信息来源:X:Dex Horthy(HumanLayer)(@dexhorthy)
产品发布 / 更新普通
Grok Bot 获虚拟信用卡可代购
给 Grok @Bot 配上专属虚拟信用卡!每笔请求都需你批准。 【引用 @bot】:Grok Bot 现在可以在互联网上购物了。 要开始使用,连接 @link,让你的 Bot 去购物,它就能替你完成购买。
信息来源:X:Lauren Tan (@poteto) · Grok
论文研究普通
Anthropic 研究员展示自我改进 AI:自动化系统可可靠缓解对齐失败
Anthropic 研究员 Chen Yueh-Han 团队发布论文,展示自动化系统在 10 个对齐基准上全部提升模型表现且不损害整体性能。系统模拟传统研究流程,搜索文献、提出方法并训练 30 分钟,迭代优化。论文称最佳 AAR 方法平均 6 小时内超越人类专家提议,成本约每小时 $4 API 推理,远低于人类研究员的 $150。
信息来源:TechCrunch:AI(RSS) · Claude
观点 / 方法普通
AI 将引发全面社会变革,拐点已至
在密集的模型发布潮中,我们正忽视一个更宏大的图景:AI 将带来堪比工业革命乃至人类发现火种的文明级变革。Demis Hassabis 称之为科学的黄金时代,癌症乃至衰老等疾病终将可治愈,自主 AI 研究员将在数年内彻底改变科学和药物发现。智能体正从聊天转向独立完成任务,ChatGPT Work 已能代处理邮件和日程,白领行业将很快被颠覆,教育领域也将迎来个性化 AI 导师。
信息来源:X:Kim (@kimmonismus) · ChatGPT
模型发布 / 更新普通
GLM-5.3-Flash 与 Qwen3.8-Flash-Next 对比:两家中国 AI 实验室独立收敛于同一模型架构
Z.ai 与 Qwen 各自独立推出了近乎相同的架构:3:1 线性混合、压缩索引器、门控残差与 Muon 训练。两家中国 AI 实验室在未互通的情况下,于模型设计上实现了趋同。
信息来源:MarkTechPost(RSS) · Qwen / GLM
观点 / 方法普通
pstack 新增创建与维护验证技能,助 Agent 像真实用户一样验证应用
pstack 新增 `/create-verification-skill` 与 `/maintain-verification-skill` 两个技能。前者为应用创建高质量验证技能并生成 feature map,让 Agent 像真实用户一样导航和验证应用;后者可通过云 Agents 每日自动运行,检查应用变更并保持 feature map 更新。
信息来源:X:Lauren Tan (@poteto)
产品发布 / 更新普通
Replit Growth Skills 助力产品增长
你已经有了想法。你用 Agent 以前所未有的速度构建了产品。 Replit 的 Growth Skills 能让你的产品触达需要它的人。我们的专家合作伙伴让增长变得更加容易,即使你不知从何入手。 今天就在 Replit 中开始使用:@ZoomInfo @useapolloio @Clay_GTM @Sideshift_app @RevenueCat @Stripe @PostHog 在 http://replit.com/growth-kit 一夜之间把想法变成真正的业务。
信息来源:X:Replit (@Replit)
观点 / 方法普通
Chamath:长时程任务仍是笑话,AI 将陷幻灭低谷
Chamath 在斯坦福 AI Club 直言,长时程任务与复杂问题目前均无法被 AI 妥善处理。他认为 AI 将经历炒作周期后进入"幻灭低谷",届时人们会说 AI 是个笑话。他建议用符号空间引导嵌入空间,以跨越这一鸿沟。
信息来源:X:Rohan Paul (@rohanpaul_ai)
产品发布 / 更新普通
GLM 5.3 上线 Perplexity Computer
GLM 5.3 现已登陆 Perplexity Computer。 它专为长上下文、多模态智能体工作负载而构建,在我们面向大规模、有证据支撑的研究的基准测试 WANDR 上,超越了 GLM 5.2。
信息来源:X:Perplexity (@perplexity_ai) · GLM
论文研究普通
Google DeepMind 将 AI 科学家 Co-Scientist 扩展为实验室集成研究伙伴
Google DeepMind 将多智能体系统 Co-Scientist 从假设生成器扩展为实验室集成研究伙伴,可规划实验、编写代码、控制设备并生成论文。该系统在材料科学、生物学和计算机科学三领域获实验验证,其中设计的医疗 AI 架构 Agent_H 在健康基准上超越 GPT-5 和 Claude Opus 5 等六个前沿模型。
信息来源:The Decoder:AI News(RSS) · GPT / Claude / Gemini
产品发布 / 更新普通
谷歌专家智能作者来信获赞
在 @Gemini_Notebook 的专家智能中,我最喜欢的部分之一是作者来信,真是妙笔!
信息来源:X:Josh Woodward (@joshwoodward, Google Labs VP)
观点 / 方法普通
安全漏洞传闻就足以让攻击者找到利用点,开源安全响应模式亟需改变
OCaml 的 cohttp 6.3.0 修复路径遍历漏洞时,作者发现公开 PR 后几分钟内服务器即遭探测,且其智能体仅凭粗略方向就能在一分钟内生成可利用代码。
信息来源:Hacker News 热门(buzzing.cc 中文翻译)
论文研究普通
EBR-bench人类基线:AI难以企及
人类会随着经验而进步。AI?则不然。我们在Earthborne Rangers上运行了一个人类基线--这是我们EBR-bench基准背后的复杂、长周期桌游。人类起初表现不佳,但最优秀的玩家在5次游戏后掌握了这款游戏。而我们评估过的所有AI都从未达到这一水平。
信息来源:X:Epoch AI (@EpochAIResearch)
产品发布 / 更新普通
Grok Bot 模板现支持与他人共享
将你的 Grok @Bot 分享给他人! 【引用 @bot】:你现在可以将 Bot 的模板分享给其他人了。
信息来源:X:Elon Musk (@elonmusk, xAI) · Grok
产品发布 / 更新普通
Databricks Genie One 新增功能:将洞察转化为行动
Databricks 为 Genie One 推出新功能,帮助用户将 AI 生成的洞察直接转化为实际行动。新功能聚焦于从"回答问题"到"执行任务"的延伸,使用户能在同一界面内基于分析结果触发后续操作,减少来回切换工具的成本。具体功能细节与可用性未在原文中详述。
信息来源:Databricks:Blog(RSS)
产品发布 / 更新普通
Grok 金融功能上线,可连接银行账户
突发:Grok 的全新 Finance 功能现已上线,用户可安全连接银行与投资账户。 该功能可将你的财务信息直接带入聊天,让使用 Grok 理解支出、追踪账户和管理资金变得更加轻松。 重大升级!
信息来源:X:cb_doge (@cb_doge) · Grok
产品发布 / 更新普通
OpenAI Rosalind Workbench 连接科研与模型工具
Rosalind Workbench 将科学问题与专业模型、工具及可审查输出整合到一个工作流中,涵盖从蛋白质结构与序列分析到测序流程等应用。
信息来源:X:OpenAI Developers (@OpenAIDevs) · OpenAI
观点 / 方法精选
OpenAI 攻击 Hugging Face 事件的 5 个教训
7 月,OpenAI 的 AI 系统在测试中攻破 Hugging Face,OpenAI 于 7 月 21 日承认责任;Anthropic、Meta 和 OpenAI 在其他场合也发生过智能体越权执行真实网络操作的事件。METR 发布了一份 90 页的相关报告。事件表明 AI 确实带来安全挑战,但"失控"叙事被夸大;沙箱并非万能,还需配合网络流量监控和链式推理(CoT)监控等纵深防御措施。
信息来源:Gary Marcus:The Road to AI We Can Trust(RSS) · OpenAI / Claude / Hugging Face
行业动态普通
开源权重AI公司成为硅谷最热收购目标
英伟达据报将以130亿美元收购开源模型平台Hugging Face,此前已斥资60亿美元收购Poolside,Stripe亦以超70亿美元收购OpenRouter。开源权重模型目前采用率仍低,仅6%企业使用,但英伟达等巨头正借此对冲对前沿实验室的依赖,并应对OpenAI、谷歌自研推理芯片的挑战。Fireworks CEO称其每日处理40万亿token,超过Gemini和OpenAI API的总和。
信息来源:TechCrunch:AI(RSS) · OpenAI / Gemini / NVIDIA
产品发布 / 更新普通
Claude Code v2.1.251 发布:新增模型切换钩子与远程控制流式输出
Claude Code v2.1.251 新增 PreModelSwitch 和 PostModelSwitch 钩子事件,支持拦截、确认或标注模型切换;远程控制客户端现可实时流式查看前台子代理的工具调用与结果。/usage 新增消费限额条,/cost 新增按会话的提示词缓存统计行。本次更新还修复了符号链接路径穿越、插件路径越界、后台会话卡死等多项安全与稳定性问题。
信息来源:Claude Code:GitHub Releases(RSS) · Claude
观点 / 方法普通
编程的未来已经到来:魔兽世界插件客户端监控智能体
编程的未来已经到来。 【引用 @samlambert】:我构建了一个 @cursor_ai 客户端,作为插件运行在《魔兽世界》内,这样我就能随时关注我的智能体,并在需要时向它们发送提示。
信息来源:X:Lauren Tan (@poteto)
产品发布 / 更新普通
NotebookLM 新功能支持应用内购书
@shreyas 试试这个,昨天刚在 @Gemini_Notebook 上线 https://x.com/Gemini_Notebook/status/2093059543362306369
信息来源:X:Josh Woodward (@joshwoodward, Google Labs VP)
行业动态精选
联邦法官裁定特朗普政府将 Anthropic 列入黑名单违法
美国加州北区联邦地区法院法官 Rita Lin 裁定,特朗普政府将 Anthropic 列为国家安全供应链风险并禁止其 AI 技术使用的行为违法,构成违反第一修正案的非法报复。裁决指出,Anthropic 因拒绝放弃对其产品用于致命自主战争和大规模监控美国人的限制而遭政府封禁。法院批准了 Anthropic 部分即决判决动议。
信息来源:Ars Technica:AI(RSS) · Claude
模型发布 / 更新普通
GLM-5.3 开源,Ethan Mollick 呼吁发布模型卡
GLM-5.3 已开源权重,可下载、运行和定制,是智谱(Z.ai)最强的智能体编程与网络防御模型。Ethan Mollick 认为,随着开源模型性能提升,发布模型卡和进行红队测试愈发重要,因为任何开源模型都可能被突破护栏,需明确风险。
信息来源:X:Ethan Mollick (@emollick) · GLM
产品发布 / 更新普通
Replit 免费模式获用户认可
我们直接听到了用户的声音:免费模式与众不同。
信息来源:X:Replit (@Replit)
行业动态普通
Polsia 用 AI 智能体运营公司,完成 3000 万美元融资
Polsia 让用户运行一组自主 AI 智能体来运营公司,其自身业务也跑在同一网络上,智能体处理了营销、外联及最近一轮融资,包括投资人简报和尽调往来。该轮融资以 2.5 亿美元估值完成 3000 万美元募资,公司仅一名创始人、无员工。创始人表示 AI 已自动化 80% 的工作,剩余精力投入品牌与体验。
信息来源:X:Testing Catalog (@testingcatalog)
行业动态普通
Runway 发起 HORSE 挑战赛赢百万积分
我们来玩个游戏吧。 一场 HORSE 投篮挑战赛。我们先来(见下方视频)。参与方式:评论"HORSE"并引用转发这条推文,附上你最好的应战作品。 → 获胜者将获得 1,000,000 积分。→ 仅限 24 小时。 提示词和角色都在帖子里 🧵
信息来源:X:Runway (@runwayml)
论文研究普通
Claude 自主对齐其他 AI,超越 28 位研究员
Anthropic 新研究显示,Claude 可自主完成对齐研究,且被纠正的模型比执行纠正的模型能力更强。Claude 自主发现的安全训练方法,超越了 28 位资深研究员各自提出的方案。五个智能体并行工作长达 48 小时,共享结果,并通过隐藏测试和能力门控筛选过拟合与明显退化。
信息来源:X:Rohan Paul (@rohanpaul_ai) · Claude
观点 / 方法普通
Dr Eggbot v0.1.0 发布,可分享 Bot 模板
试试我的 Dr Eggbot (v0.1.0):https://x.ai/bot/93gOz3op1UQdBdbekQFLK 他能为你制作高质量机器人!编码机器人使用 pstack,非编码机器人也有同样的严谨性。
信息来源:X:Lauren Tan (@poteto)
模型发布 / 更新普通
MiniMax FastH3 v1 开源:13秒生成15秒768p视频
MiniMax 联合 NVIDIA、FastGen 发布开源模型 FastH3 v1,可在 13 秒内生成 15 秒 768p 视频,在 NVIDIA Blackwell GPU 上实现最高 14 倍加速。模型权重与加速方案完全开源,社区可自行运行和改进。团队表示,开源视频模型时代已开启,后续将分享更多关于后训练如何提升速度与质量的经验。
信息来源:X:Sky Computing Lab (@haoailab) · NVIDIA
教程 / 实战普通
Trackunit 如何用 AI 将建筑数据转化为决策
Trackunit 利用 AI 将建筑设备遥测、维护记录等海量数据转化为可执行的运营决策。其方案整合设备数据与工作流程,帮助建筑企业优化设备利用率、预测维护需求并提升项目效率。通过 AI 驱动的数据分析,Trackunit 将原始数据流转化为管理层可直接采取行动的洞察。
信息来源:Databricks:Blog(RSS)
模型发布 / 更新普通
Meta 模型 API 上线 Muse 图像生成
1/ Muse 图像已在 Meta 模型 API 上线 $0.01/张--生产级用量中性价比最高的选择之一
信息来源:X:Alexandr Wang(Scale AI 创始人/Meta 首席 AI 官) (@alexandr_wang)
产品发布 / 更新普通
Vercel 开源 vgpu:面向 AI Agent 着色器的 TypeScript WebGPU 库
Vercel 开源了其内部用于 vercel.com 的 WebGPU 库 vgpu。该 TypeScript 库将 .wgsl 文件作为可导入模块,通过单一 Gpu 上下文在浏览器、无头 Node.js(Dawn 后端)及确定性 mock 中运行同一着色器。完整全屏效果压缩后仅 25 KB,MIT 许可,已发布至 npm(v0.3.1),并提供 CLI、llms.txt 及只读 MCP 端点。
信息来源:MarkTechPost(RSS)
产品发布 / 更新普通
Grok Bot 支持将机器人分享为模板
SPACEXAI 🔥:Grok Bot 现允许用户将机器人分享为模板! 正如所预言的那样 👀
信息来源:X:Testing Catalog (@testingcatalog) · Grok
行业动态普通
Decagon 接入 Perplexity 实时搜索服务大客户
Decagon 与 Perplexity 合作,为其客服智能体引入实时联网搜索,可在对话中途检索最新信息并附来源回复。该服务已用于 Delta Airlines、Ticketmaster、Deutsche Telekom、American Airlines 等大品牌的客服场景,解决依赖实时准确信息的问题。
信息来源:X:Aravind Srinivas(Perplexity CEO) (@AravSrinivas)
观点 / 方法普通
杰文斯悖论:GPT 5.6 降价引爆 13.8 倍用量
杰文斯悖论反直觉且令人振奋。 【引用 @OpenRouter】:当 GPT 5.6 Terra 和 Luna 在 OpenRouter 上大幅降价时发生了什么? Token 使用量暴涨 13.8 倍 杰文斯悖论 = 当技术使资源使用更高效时,该资源的总消耗量反而增加而非减少 🧵
信息来源:X:Greg Brockman (@gdb) · GPT
观点 / 方法普通
智能体编程时代软件工程基础技能图谱
智能体编程如何改变了软件工程基础?这是我们整理的软件工程基础 AI 工程技能图谱。https://x.com/i/article/2093384274372419585
信息来源:X:Andrew Ng(DeepLearning.AI 创始人) (@AndrewYNg)
行业动态普通
Neuralink 首位女性受试者用脑机接口创作数字艺术
Neuralink 临床试验首位女性参与者 Audrey 因 16 岁脊髓损伤瘫痪超 20 年,2025 年 7 月植入 Telepathy 芯片。该设备通过运动皮层 128 根线程将脑信号转为电脑指令,使她能用意念控制光标,20 年来首次写下自己名字,并创立 NeuraArt Studio 分享数字艺术作品。
信息来源:X:cb_doge (@cb_doge)