AI 情报文章归档
浏览 AI圈报 已保存的 5825 条 AI 情报文章,覆盖模型、产品、行业、论文、教程与观点方法六大分类。
已收录文章5825
正式分类6
精选内容3375
全部文章
第 51 / 146 页 · 每页 40 条
观点 / 方法普通
Grok Voice Think Fast 2.0登顶语音指数
Grok Voice Think Fast 2.0 现已在 Artificial Analysis 更新的语音到语音指数中位列第一,超越 OpenAI、Google 及其他厂商。 Grok 在语音推理中得分 97.2%,智能体性能 56.5%,任务成功率 94.7%。
信息来源:X:cb_doge (@cb_doge) · OpenAI / Grok
观点 / 方法普通
Grok Voice 2获马斯克盛赞
Grok Voice 2 很棒 【引用 @SpaceXAI】:Grok Voice Think Fast 2.0 现已在 Artificial Analysis 语音到语音指数中排名第一。 该指数衡量语音智能体能否对所听到的语音进行推理、解决真实客户问题,并使用智能体工具正确完成任务。
信息来源:X:Elon Musk (@elonmusk, xAI) · Grok
观点 / 方法普通
你的alt文本能通过自动化检查,不代表它真的合格
WebAIM Million报告显示,主流网页中16.2%的图片缺少alt文本,另有10.8%的alt文本模糊或重复。GitHub为Accessibility Scanner构建了alt文本插件,采用五条确定性规则检测缺失、文件名、占位符、泛化词及相邻重复,并引入基于布局的重复检测和可选视觉模型审查,以平衡误报率与实用性。
信息来源:GitHub Blog
产品发布 / 更新普通
Conductor MCP 发布,AI 智能体可协同管理云会话
推出 Conductor MCP! 你的 Claude、Codex、Cursor 智能体现在可以与人类一起使用 Conductor。 它配备了你的智能体创建和管理云会话所需的全部工具。 ```get-started.txt 在 https://api.conductor.build/mcp 添加 Conductor MCP,并通过 OAuth 进行身份验证。```
信息来源:X:Charlie Holtz(@charlieholtz) · Claude / Cursor
行业动态普通
Cohere 成 Superwhisper 默认本地模型
Supertranscribe = S 级。 Cohere 现已成为 @superwhisper 新用户引导流程中的默认本地模型。即刻口述你的想法,一切尽在你的设备上--无需 Wi-Fi。 享受 Transcribe 与 @Nativ_AI 的组合,@RayFernando1337 🤝
信息来源:X:Cohere(@cohere)
行业动态普通
Starlink 用 Grok Voice 日处理超 1.5 万客服电话
突发:Starlink 正使用 Grok Voice 每天处理超过 15,000 通客户支持与销售电话。 Grok 通过语音通话和聊天诊断硬件问题、寄送替换件,并每周完成超过 3,000 笔订单。
信息来源:X:cb_doge (@cb_doge) · Grok
观点 / 方法普通
sPTC:推测式工具调用加速智能体推理
来自RLM作者的sPTC(Speculative Programmatic Tool Calling)技术,在代码生成时提前推测并排队工具调用,使工具延迟与token生成重叠,而非叠加。该方法在harness层实现,当前带来1至1.2倍加速,前景可观。
信息来源:X:Elvis Saravia (@omarsar0, DAIR.AI)
行业动态普通
Grove Research 新公司亮相,deepfates 现身
我一直很期待听到尊敬的 @deepfates 的最新动向。 也很期待一个新的"GROVE MENTIONED"梗图能进入大众视野。
信息来源:X:Charlie Holtz(@charlieholtz)
模型发布 / 更新普通
Grok Voice Think Fast 2.0登顶语音指数榜首
Grok Voice Think Fast 2.0 现已在 Artificial Analysis 语音到语音指数中排名第一。 该指数衡量语音智能体能否对所听到的语音进行推理、解决真实客户问题,并使用智能体工具正确完成任务。
信息来源:X:SpaceXAI (@SpaceXAI) · Grok
观点 / 方法普通
OpenAI Codex 语音智能体演示直播
我们将在 1 小时后与 @AlexFinn 一起直播。 看看他如何在 Codex 中通过语音智能体完成工作--在桌面端和移动端上。 键盘可选。
信息来源:X:OpenAI Developers (@OpenAIDevs) · OpenAI
行业动态普通
Tinker 推出最高5万美元安全研究资助
今天,我们推出 Tinker 资助计划,为开放权重模型的安全研究提供最高 50,000 美元的额度。我们在下方分享了一些令我们兴奋的项目想法;如果你正在从事一个可以通过额外 Tinker 额度加速的安全项目,我们期待你的来信!
信息来源:X:Thinking Machines (@thinkymachines)
行业动态普通
SpaceX 与 NVIDIA 合作将 Vera Rubin 系统送入轨道
SpaceX 与 NVIDIA 合作设计了太空优化的 Vera Rubin NVL72 系统,计划于今年晚些时候发射入轨。SpaceXAI 将部署 NVIDIA Vera CPU 加速其下一代智能体 AI 工作负载,并扩展基于 Vera Rubin 平台的 Grok AI 基础设施,向吉瓦级算力迈进。首代 Starmind AI 卫星将基于该优化系统,马斯克称 Q4 发射、2028 年显著扩展。
信息来源:X:Testing Catalog (@testingcatalog) · Grok / NVIDIA
观点 / 方法普通
Google Antigravity 智能体技能进阶(一):交互式 UI 工作流
Google Antigravity 通过将原生聊天 UI 组件嵌入 SKILL.md 指令,让智能体从被动文本解析器转变为主动技术面试官。本文详解交互式 UI 技能架构:使用 ask_question 工具渲染原生模态框,通过 user_prefs.json 实现跨会话状态水合与持久化,并介绍内置 /grill-me 命令及 making-forms-demo 参考实现。
信息来源:Google AI:DEV 作者专属(RSS)
行业动态普通
Replit CEO Amjad Masad 将亮相 TechCrunch Disrupt 2026,畅谈编程未来
Replit CEO 兼联合创始人 Amjad Masad 将出席 10 月 13-15 日在旧金山 Moscone West 举办的 TechCrunch Disrupt 2026,探讨编程未来与 AI 时代创业。Replit 当前年化收入运行率接近 10 亿美元,而 2024 年报告收入仅 280 万美元;公司估值今年早些时候达 90 亿美元,六个月前为 30 亿美元。
信息来源:TechCrunch:AI(RSS)
观点 / 方法普通
Anthropic首席经济学家谈建设性对话
这是一次富有成效的对话。我很高兴我们把它列入了议程。
信息来源:X:Peter McCrory(Anthropic 首席经济学家,@PeterMcCrory) · Claude
产品发布 / 更新普通
书海无涯,总有下一本
总还有下一本书。
信息来源:X:Odyssey (@odysseyml)
观点 / 方法普通
数据中心禁令对AI进展影响甚微
Ethan Mollick 认同 Arvind 观点:州级数据中心禁令对 AI 整体进展影响甚微。引用推文估算,典型州实施 1 年禁令仅拖慢 AI 效率进展 5-10 小时;即使纽约州全面禁止新建数据中心,在 90% 泄漏率假设下也只拖慢不到一天。数据中心选址高度可替代,禁令并非减缓 AI 发展的有效手段。
信息来源:X:Ethan Mollick (@emollick)
产品发布 / 更新普通
Grok Build 新增 Browser Use 插件
SpaceXAI 为 Grok Build 推出 Browser Use 插件,赋予 Grok 访问真实浏览器的能力,支持用户自有 Chrome(含现有登录态)或隔离的 Browser Use 云浏览器。
信息来源:X:cb_doge (@cb_doge) · Grok
行业动态普通
OpenAI 下调 GPT-5.6 Sol API 价格
从今天起,OpenAI 将 GPT-5.6 Sol API 的输入价格下调 20%,输出价格下调 33%。 新价格为:每百万输入 token 4 美元,每百万输出 token 20 美元,该价格至少持续到 11 月 21 日。 从时机来看,OpenAI 显然是在给 Anthropic 即将进行的 IPO 再添一击,并继续努力吸引更多用户。
信息来源:X:Kim (@kimmonismus) · OpenAI / GPT / Claude
观点 / 方法普通
NVIDIA 对比 AMD 成本效率优势达 5 倍
NVIDIA 在 GLM 5.3 SGLang 对比测试中,在 150 tok/s/user 条件下,成本效率最高比 AMD 优 5 倍。 - 最新 SemiAnalysis 报告 "以 AMD 当前的软件状态,在 150 tok/s/user 下,NVIDIA 的性能优势如此之大,以至于即便竞争对手的芯片硬件免费赠送(但服务商仍需支付数据中心托管、电力和其它运营成本),使用 NVIDIA 的每 token 成本仍然更低。"
信息来源:X:Rohan Paul (@rohanpaul_ai) · GLM / NVIDIA
行业动态普通
Runway 旧金山黑客松:9月30日报名开启
9月30日,加入我们在旧金山举办的线下黑客松,使用 Runway 的 API 构建最佳智能体、应用或创意工作流。这场为期一天的活动将在 Masonic 举行,与我们的 Runway AI 峰会同期。 无需演示文稿。无需审批流程。只需在下午5点前完成一个可运行的演示,就有机会赢取 $25K 奖金和 200K 积分。
信息来源:X:Runway (@runwayml)
行业动态普通
GPT-5.6 上线 Kiro,融入开发者工作流
GPT-5.6 现已在 @kirodotdev 中可用,将我们最新的模型引入开发者已在生产环境中使用的规划、构建、测试和审查软件的工作流程。
信息来源:X:OpenAI Developers (@OpenAIDevs) · OpenAI / GPT
论文研究普通
ASI-Bench:步骤比方法名更决定智能体表现
ASI-Bench 用 60 个真实科研项目、11 个科学领域测试研究智能体,仅改变指令内容。18 种智能体与模型组合下,完整步骤提示平均得分 50.91,仅给方法名降至 29.10,再删方法名仅再降 2.5 分。仅方法名提示还多耗 59% token,因命名方法既限制方向又迫使智能体重建全部实现细节。
信息来源:X:Rohan Paul (@rohanpaul_ai)
观点 / 方法普通
Grok 刷屏 X 时间线引热议
我的整个 X 时间线现在全是 Grok @bot 😂🔥
信息来源:X:cb_doge (@cb_doge) · Grok
观点 / 方法普通
AI影响时间线争论:从即刻到多年
我认为当前的讨论过于偏向"AI的影响需要很多年才能显现",正如不久前过于偏向"AI将立即改变经济"一样。
信息来源:X:Ethan Mollick (@emollick)
行业动态普通
Mistral 与 HUMAIN 战略合作开发阿拉伯语模型
今天,我们宣布与 @HUMAIN 达成战略合作,涵盖 AI 基础设施、先进模型开发,以及在沙特阿拉伯及整个地区部署 AI 解决方案。我们将共同开发本地化的前沿 AI 模型,初始重点领域包括网络安全、语音,以及在阿拉伯语中表现优异的模型。 https://mistral.ai/news/mistral-x-humain/
信息来源:X:Mistral AI (@MistralAI) · Mistral
观点 / 方法普通
安德森·霍洛维茨风投正向一个黯淡的未来投入数十亿资金
安德森·霍洛维茨风投的投资组合中充斥着利用法律漏洞、制造令人不安的产品甚至违法的公司。该机构正向一个黯淡的未来投入数十亿资金,其投资方向引发外界对其判断力与行业影响的质疑。
信息来源:Hacker News 热门(buzzing.cc 中文翻译)
产品发布 / 更新普通
OCR It--从无法复制的文档中提取文本,供您的LLM使用
一款Chrome扩展,通过固定屏幕区域并按下热键,即可对分页文档(扫描书、幻灯片、PDF等)逐页截图、OCR并追加为连续文本,供Claude或ChatGPT等LLM总结、搜索或提问。OCR在本地运行,使用内置Tesseract构建,无需API密钥或网络请求。支持自动翻页(通过点击控件或按键触发),并设有300页上限及重复页检测等停止条件。
信息来源:Hacker News 热门(buzzing.cc 中文翻译) · ChatGPT / Claude
产品发布 / 更新普通
开发者打造低延迟 AI 游戏伙伴 Varkos,可实时陪玩《上古卷轴5:天际》
一位开发者构建了名为 Varkos 的 AI 游戏伙伴,能实时执行战斗、拾取、搜索、递物等复杂多步指令,并支持条件触发与持续目标规划,全程低延迟且无预设脚本。该系统优先本地运行以保护隐私并降低成本,仅性格演化部分依赖云端大模型调用。Varkos 初始为"转生为狗的恶魔",其性格、词汇和情绪状态会随共享游戏经历逐步演化,且改动可版本化回退。
信息来源:Hacker News 热门(buzzing.cc 中文翻译)
观点 / 方法普通
《寓言》与"免费午餐"的终结:智能体编程成本分化
Anthropic 的 Fable 发布后,高昂定价促使智能体编程用户转向更便宜的替代模型。GLM 5.2 与 Fable 同周发布,成本约为其 1/9(约为 Opus 5 的 1/5),对多数常规编码任务已足够。作者认为推理价格下降不会让一切重回最大模型,Fable 的访问控制与数据留存要求也促使企业重新思考工作负载分配。
信息来源:Hacker News 热门(buzzing.cc 中文翻译) · Claude / GLM
观点 / 方法普通
氛围税:AI 编码代理的隐性成本
一位开发者让 AI 编码代理 Pol 通宵开发待办应用,醒来却发现其耗尽每周全部 token 配额,项目仅剩大量过度设计的测试文件,应用本体却不存在。文章指出,这类为追求"一次成功"而过度消耗 token 的行为,正成为所有常规开发者被迫承担的"氛围税"。
信息来源:Hacker News 热门(buzzing.cc 中文翻译)
观点 / 方法普通
为什么萨尔·汗行不通:关于"做中学"与"讲授式教学"
萨尔·汗承认其AI辅导机器人Khanmigo对多数学生而言是"非事件",首席学习官Kristen DiCerbo直言"尚未看到教育革命"。作者指出,汗本人通过广泛阅读、绘图、提问、致电朋友等方式主动建构理解,而学生仅被动观看视频或与聊天机器人互动,缺乏"制作"的目的驱动。文章援引杜威的四种自然冲动(探究、建构、表达、交流),解释为何讲授式AI辅导注定失败。
信息来源:Hacker News 热门(buzzing.cc 中文翻译)
观点 / 方法普通
什么是智能体安全带(Agent Harness)?
智能体安全带(Agent Harness)是一种为AI模型提供运行环境的软件,用户可自行拥有。它通常执行四项功能:提供系统提示词、描述并供给工具、建立智能体循环框架,以及提供翻译层以兼容不同模型。以Lefos等为例,安全带可通过邮件、终端等界面交互,其核心是让模型自主决定何时调用工具。
信息来源:Hacker News 热门(buzzing.cc 中文翻译)
观点 / 方法普通
我花了266美元和四个AI模型,终于拥有了自己的平板电脑
一位用户为完全掌控自己的Amazon Fire HD 10平板,花费266.15美元借助四个AI模型成功获取root权限。Kimi K3以164.25美元发现利用CVE-2022-38181的漏洞,GLM-5.2以21.90美元修复致命错误,GLM-5.3在80美元订阅首日一天内完成最终任务。整个过程中Kimi K3的会话长达621条消息,并自动重试超过500次。
信息来源:Hacker News 热门(buzzing.cc 中文翻译) · GLM / Kimi
观点 / 方法普通
AI 芯片架构:从 TPU 到 GPU、LPU 的领域专用架构演进
2018 年图灵奖演讲预测的领域专用架构(DSA)爆发已成现实,GPU、TPU、LPU 等数十种 AI 芯片架构竞相发展。NVIDIA 领先,AMD 紧随其后,TPU 训练 Gemini 并服务 Anthropic,Cerebras 为 OpenAI 提供推理,Groq LPU 被 NVIDIA 以 200 亿美元收购。
信息来源:Hacker News 热门(buzzing.cc 中文翻译) · OpenAI / Claude / Gemini
行业动态普通
NVIDIA 将 Groq 技术整合进机架级产品
NVIDIA 在获得 Groq 非独家授权 8 个月后,首次将 Groq 技术整合进机架级产品,Groq 机架将于今年上线。NVIDIA 将智能体 AI 工作负载拆分:Rubin GPU 负责重计算,Groq 3 LPX 处理延迟敏感的 token 生成,Vera CPU 运行代码与数据处理。相比 Cerebras,Groq 3 LPX 声称带来 4 倍响应速度提升,对长任务影响尤为显著。
信息来源:X:Rohan Paul (@rohanpaul_ai) · NVIDIA
观点 / 方法普通
对人工智能的依赖将导致编程专业技能的崩溃
过度依赖AI编程工具会削弱开发者的专业技能,尤其是缺乏经验的新手。JetBrains引用的研究显示,重度使用AI辅助的参与者常跳过关键规划阶段,以"能力错觉"而非真正理解收场;而限制或忽略AI辅助的新手表现最佳。LLM的"倒置学习"模式要求使用者具备足够经验才能有效驾驭,否则易被误导。
信息来源:Hacker News 热门(buzzing.cc 中文翻译)
论文研究普通
逆向工程发现 MS Paint 和"照片"为本地 AI 生成图片添加不可见 GUID 水印
逆向工程显示,MS Paint 和"照片"应用会将服务器下发的 GUID 以不可见方式嵌入本地生成的 AI 图像像素中。该水印由服务器签发,用于追踪图片来源,但用户无法直接察觉其存在。
信息来源:Hacker News 热门(buzzing.cc 中文翻译)
行业动态普通
OpenAI 下调 GPT 5.6 Sol 价格,至少持续至 11 月 21 日
OpenAI 宣布下调 GPT 5.6 Sol 的价格,该优惠至少持续至 11 月 21 日。此次降价面向开发者,具体幅度与适用计费方式以官方公告为准。
信息来源:Hacker News 热门(buzzing.cc 中文翻译) · OpenAI / GPT
观点 / 方法普通
小米新CPU Xring O3单线程媲美苹果,多线程性能大幅领先
小米新款CPU Xring O3在单线程性能上大致与苹果处理器相当,多线程执行速度则快得多。该芯片总缓存达44 MB,超过多数笔记本CPU;其最强核心C1-Ultra支持SME2与SVE2,拥有21个执行端口,其中6个支持128位SIMD操作,执行单元数量超过Intel/AMD处理器。这一趋势显示核心正朝着大规模并行执行单元与更大缓存方向发展。
信息来源:Hacker News 热门(buzzing.cc 中文翻译)