AI 情报文章归档
浏览 AI圈报 已保存的 5825 条 AI 情报文章,覆盖模型、产品、行业、论文、教程与观点方法六大分类。
已收录文章5825
正式分类6
精选内容3375
全部文章
第 52 / 146 页 · 每页 40 条
教程 / 实战普通
如果我17岁,我会从零开始学习如何构建大型语言模型
一位开发者分享,若回到17岁,会选择从零开始学习构建大型语言模型(LLM)。文章以推特帖子形式呈现,获得426个Hacker News点赞,强调通过亲手搭建理解LLM底层原理的价值。
信息来源:Hacker News 热门(buzzing.cc 中文翻译)
观点 / 方法普通
Anthropic 最优秀 AI 模型难以吸引用户,更便宜工具蓬勃发展
Anthropic 最优秀的 AI 模型在用户吸引力上不及更便宜的工具,后者正蓬勃发展。这一现象反映出价格敏感的市场中,性价比正成为用户选择的关键因素。Anthropic 的高端模型面临来自低成本替代品的激烈竞争。
信息来源:Hacker News 热门(buzzing.cc 中文翻译) · Claude
观点 / 方法普通
My agent.md:用项目级提示文件提升大语言模型辅助的代码质量
一位开发者分享通过项目根目录的 agent.md 文件注入编码风格偏好,显著改善 LLM 生成代码的质量。该文件包含避免魔法数字、缩短函数名、减少缩进、严格分层等规则,并附完整示例。作者提醒这并非万能,仍需人工审查,同时指出上下文稀释问题可通过保持短上下文和显式重载 agent.md 缓解。
信息来源:Hacker News 热门(buzzing.cc 中文翻译)
论文研究普通
美国GDP统计漏算英伟达经济贡献
我们发现,美国GDP统计遗漏了英伟达为美国经济增加的大部分价值。 因此,过去一年GDP增长被低估了约0.3个百分点。
信息来源:X:Epoch AI (@EpochAIResearch) · NVIDIA
产品发布 / 更新普通
AgentSky 推出"智能体版 OpenRouter"统一 API
AgentSky.dev 发布"OpenRouter for Agents",以统一 API 接入 Claude Code、Codex、DeepSeek、Kimi、OpenCode 等主流智能体,并附带 Agent Playground 供用户在浏览器中并排对比各智能体的耗时、成本与 token 消耗。
信息来源:X:Kim (@kimmonismus) · DeepSeek / Claude / Kimi
论文研究普通
潜态推理视频世界模型如何学习世界演化
学习世界如何演化 通过潜态动力学推理实现的外推式视频世界模型 论文:https://huggingface.co/papers/2608.09926
信息来源:X:AK (@_akhaliq) · Hugging Face
行业动态普通
Grok 4.6 在 Hermes 五折促销
在 Hermes 中试用 Grok 4.6,现通过 @NousResearch 门户可享 50% 折扣。 或者,使用您现有的 SuperGrok 和 X Premium+ 付费订阅。
信息来源:X:SpaceXAI (@SpaceXAI) · Grok
论文研究普通
皮尤研究:ChatGPT 发布后网络 AI 生成文本激增
皮尤研究中心分析近 50 万个英文网页发现,ChatGPT 发布后发布的页面中超过三分之一带有 AI 生成文本痕迹。商业 .com 域名出现 AI 文本的比例约为 .edu 或 .gov 网站的十倍。分析工具 Open Pangram 难以区分完全自动生成与部分 AI 辅助的文本,且"delve"等 AI 常用词及破折号、牛津逗号的使用频率自 2023 年以来显著上升。
信息来源:The Decoder:AI News(RSS) · ChatGPT
产品发布 / 更新普通
Claude 企业版 MCP 连接器托管认证正式可用
面向 MCP 连接器的企业托管认证现已全面可用。 对于 Claude Team 和企业版管理员,授权通过你的身份提供商集中管理。 对于用户,工具和数据自动连接,无需单独进行 OAuth。
信息来源:X:Claude Devs (@ClaudeDevs) · Claude
产品发布 / 更新普通
AgentSky 推出 Agent Playground 对比主流智能体
AgentSky 推出 Agent Playground,可在同一浏览器中让 Claude Code、Codex、DeepSeek 执行相同任务,并排对比耗时、成本与 token 消耗。
信息来源:X:Elvis Saravia (@omarsar0, DAIR.AI) · DeepSeek / Claude
观点 / 方法普通
Qwen 3.8 27B 量化精度测试:Q4 不输 Q8
Rohan Paul 分享 @atomic_chat_hq 的测试:更高量化精度并不自动带来更好结果,Qwen 3.8 27B 的 Q8 版在体素任务上有时被 Q4 版追平或超越。
信息来源:X:Rohan Paul (@rohanpaul_ai) · Qwen
观点 / 方法普通
Instinct 强大 AI 助手引发隐私与安全担忧
由前 Sierra 研究员 Noah Shinn 团队打造的 AI 个人助理 Instinct 虽仍处于内测阶段,但其服务条款授予公司对用户数据的"永久且不可撤销"许可,包括屏幕截图、光标移动和键盘输入,并可代表用户签订具有约束力的协议。测试者还发现该智能体在断开连接后仍会总结邮件、拒绝删除 Gmail 记录,且易被钓鱼攻击,引发对其安全模型的质疑。
信息来源:TechCrunch:AI(RSS)
产品发布 / 更新精选
MetaRoCE:为 AI 规模以太网打造的全新 RDMA 传输协议
Meta 设计并开源了 MetaRoCE,一个专为 AI 工作负载在通用以太网上打造的 RDMA 传输协议,已通过 Open Compute Project(OCP)发布规范、参考软件实现和合规测试套件。该协议将智能移至端点,原生支持乱序交付、多路径、无损容忍和双向拥塞控制,无需 PFC,可在百万 GPU 规模下提供高吞吐、低尾延迟。现有 RDMA Verbs API 和软件栈无需修改即可运行。
信息来源:Meta Engineering Blog(RSS)
行业动态普通
AI软件工厂设计模式播客预告
明天与 @vaibcode 的 🦄 AI that works 播客会很特别,我们将讨论软件工厂设计模式 构建模块长什么样,哪些可以买、哪些可以自己造,harness 等式的两个层面,以及作为构建者你绝对想自己掌控哪些部分
信息来源:X:Dex Horthy(HumanLayer)(@dexhorthy)
行业动态普通
MiniMax M3/M2.7 限时免费体验
14 天,无限构建。⚡ 8 月 24 日至 9 月 6 日期间,可在 @gmi_cloud 上无限使用 MiniMax M3 和 M2.7--外加 Speech 2.8 和 Music 3.0。 立即在 GMI Cloud 上开始构建。你将创造什么?👇
信息来源:X:MiniMax (@MiniMax_AI)
模型发布 / 更新普通
Ox Alpha 大更新引期待
Ox Alpha 似乎已经收到了一次重大更新。 你无法想象我对正式发布和模型技术细节有多期待。
信息来源:X:Kim (@kimmonismus)
行业动态普通
丰田北美如何用 Deep Agents 和 LangSmith 规模化企业 AI
丰田北美借助 Deep Agents 和 LangSmith 运行 50 多个生产环境 AI 智能体,将交付周期从 6 个月缩短至 4 天。文章展示了其如何通过 LangSmith 追踪 AI 投资回报率(ROI),并以此支撑企业级 AI 的规模化落地。
信息来源:LangChain:Blog(RSS)
观点 / 方法普通
批量审阅时AI痕迹难以隐藏
提醒所有提交申请、论文或任何由一人审阅多份材料的人:是的,他们能看出来。 在大多数情况下,即使语言被改写,使用AI的痕迹依然显而易见--当你阅读大量材料时,其中的观点和概念开始变得雷同。
信息来源:X:Ethan Mollick (@emollick)
行业动态普通
Ox Alpha 四天处理 26T tokens
4 天内处理了 26T tokens 的 Ox Alpha
信息来源:X:opencode (@opencode)
产品发布 / 更新普通
MTIA 300:Meta 首款内置 NIC 与通信卸载引擎的训练芯片
Meta 发布 MTIA 300,这是其自研加速器家族中首款针对推荐与排序模型训练优化的芯片。芯片封装内集成 12 个 800 Gbps RDMA NIC,提供 1.2 TB/s 总 I/O 带宽,并通过 16 个专用消息引擎卸载通信,使大规模 GEMM 与集合通信并发时计算吞吐损耗低于 0.5%。
信息来源:Meta Engineering Blog(RSS)
观点 / 方法普通
前沿模型各有专长,难有全能者
我越是使用前沿模型,就越不相信存在一个模型能统治一切。 - Opus 5:最擅长用生成的 HTML 教我东西,但冗长且潦草。 - GPT-5.6 Sol:后端很强,前端较弱。 - Kimi K3 / GLM-5.2:日常编码中 90% 的场景便宜又高效,但在写内核这类 AI 研究任务上较弱。 每个实验室都在为 AGI 而训练。但今天的 LLM 仍然是专才。
信息来源:X:Yuchen Jin (@Yuchenj_UW) · GPT / GLM / Kimi
行业动态普通
Google Cloud 技术网络研讨会:如何在 GCP 上控制 Claude Code 成本并衡量 ROI
Anthropic 的 Roy Arsan 与 Google Cloud 的 Ivan Nardini 将于 9 月 1 日中午 12 点(PT)举办网络研讨会,深入探讨如何在 GCP 上通过 Claude apps gateway 设置治理。
信息来源:Google AI:DEV 作者专属(RSS) · Claude
产品发布 / 更新普通
Grok Bot 十分钟将 Doom 移植到新设备
Grok @Bot 在 10 分钟内将 Doom 移植到了一台新设备上。
信息来源:X:Elon Musk (@elonmusk, xAI) · Grok
产品发布 / 更新普通
Qwen3.8 27B 现可接入 Optima 基准测试
您现在可以使用 Optima 对 Qwen3.8 27B 进行基准测试。了解这款可在笔记本电脑上运行的模型,在您的定制用例中,其性能、成本和速度表现如何。 我们还为希望为其用例构建基准测试的企业提供积分以及 Artificial Analysis 团队成员的免费咨询。如果您感兴趣,请告诉我们:https://forms.gle/VxRfD7toBXFBjVZc9 立即在 https://artificialanalysis.ai/optima 构建并运行您的自定义基准测试。
信息来源:X:Artificial Analysis (@ArtificialAnlys) · Qwen
行业动态普通
北京世界人形机器人运动会醉酒机器人
醉酒的机器人。 在北京世界人形机器人运动会上
信息来源:X:Rohan Paul (@rohanpaul_ai)
观点 / 方法普通
SemiAnalysis:AI 资本支出与债务将破纪录增长
SemiAnalysis 预测,到今年年底 AI 累计资本支出将达近 $3T,2020 年代末将增至 $11T+,未偿 AI 债务将达 $7T+。2026 年 AI 债务融资将成为仅次于美国住宅抵押贷款的第二大资产相关债务市场,且是 AI 相关债务发行量低于美国固收发行总量 10% 的最后一年。
信息来源:X:SemiAnalysis (@SemiAnalysis_)
观点 / 方法普通
中国开源模型成对齐研究主流基底
对221个MATS对齐与安全项目的分析显示,2026年72%使用命名模型的项目采用中国开源权重模型,高于美国模型的54%;Qwen占66%,领先Llama(44%)和DeepSeek(32%)。闭源模型仍出现在90%项目中,多作为裁判、监控或前沿基线。中国开源模型正成为对齐研究的实验基底,而美国闭源模型仍是关键评估工具。
信息来源:X:马东锡 NLP (@dongxi_nlp) · DeepSeek / Qwen / Llama
教程 / 实战普通
Databricks 如何从本地 IDE 运行、调试和扩展工作负载
Databricks 工作区专为数据分析和数据工程而构建,现支持从本地 IDE 直接运行、调试和扩展工作负载。该功能旨在弥合本地开发环境与云端 Databricks 平台之间的差距,让开发者无需切换上下文即可完成编码、测试和部署。
信息来源:Databricks:Blog(RSS)
教程 / 实战普通
Databricks 如何用 AI 加速事件调查
Databricks 利用 AI 加速事件调查流程,将原本耗时数小时的排查工作压缩至分钟级。其内部系统通过大语言模型自动关联日志、指标与代码变更,辅助工程师快速定位根因。该方法已在数千起生产事件中验证,显著缩短了平均修复时间(MTTR)。
信息来源:Databricks:Blog(RSS)
观点 / 方法普通
Fences, not Sandboxes:AI 应由法律而非沙箱程序治理
Steve Yegge 认为,AI 的未来应由法律治理,而非依赖试图限制和控制它们的程序。他透露自己每月花费约 12.2 万美元 API token 费用,使用 21 个 Claude Max 账户构建游戏 Wyvern,并组建了由 50-60 个智能体组成的组织,其中仅 Claude Fable 5 被允许通过 Slack 和邮件与约 10 名人类交互。
信息来源:Steve Yegge:Medium(RSS) · Claude
行业动态普通
台湾起诉九人涉嫌伪造文件向中国走私AI服务器,据称涉Nvidia高级经理
台湾基隆检方起诉九人,涉嫌伪造文件掩盖向中国非法出口高端AI服务器、违反美国出口管制,据称包括一名Nvidia高级经理和两名Supermicro在台员工。嫌疑人被控"背信与伪造文件",另有一名相关案件嫌疑人仍在逃。此前美国于3月逮捕Supermicro联合创始人Wally Liaw,指控其自2024年起向中国输送价值25亿美元受限AI服务器。
信息来源:Ars Technica:AI(RSS) · NVIDIA
产品发布 / 更新普通
NVIDIA Groq 3 LPX 全面投产,输出速度破纪录
NVIDIA Groq 3 LPX 已全面投产,为 Vera Rubin 平台新增专用 token 生成加速器。在 Artificial Analysis 基准测试中,运行 Gemma 4 31B(10 万 token 上下文)达到每秒 3400 输出 token,为该模型最快纪录。Nebius 将率先通过其 Token Factory 部署,Groq 紧随其后。
信息来源:X:Kim (@kimmonismus) · NVIDIA
产品发布 / 更新普通
llm-anthropic 0.27 发布:适配 anthropic v1.0.0 Python 库
llm-anthropic 0.27 发布,主要适配近期推出的 anthropic v1.0.0 Python 库,后者将依赖从 httpx 切换至 httpx2。OpenAI 在两周前的 v3.0.0 版本中也做了相同变更。Anthropic 提供了迁移指南,作者借助 Claude Code 中的 Fable 5 完成升级并让测试通过。
信息来源:Simon Willison 博客 · OpenAI / Claude
行业动态普通
软件应能通过提示词改变
我们需要摆脱那些无法用提示词改变的软件。
信息来源:X:Peter Steinberger (@steipete)
产品发布 / 更新普通
Artificial Analysis 联合 Liquid AI 发布手机端小模型评测
Artificial Analysis 与 Liquid AI 合作,在 iPhone 17 Pro 和 Galaxy S26 Ultra 上对 4-bit 或更低精度的小模型进行端到端推理性能与智能水平独立评测。
信息来源:X:Artificial Analysis (@ArtificialAnlys)
教程 / 实战普通
深度学习Python第15-16章教你从零构建LLM
如果你17岁(或任何年龄),想学习从零构建大语言模型,请阅读《Deep Learning with Python》第15-16章,在线可读:https://deeplearningwithpython.io/chapters/chapter16_text-generation/ 特别是第15章,包含了你能找到的关于点积注意力为何有效的极佳解释之一。
信息来源:X:Francois Chollet (@fchollet)
观点 / 方法普通
OpenRouter 周 token 量两年激增 9000 倍
OpenRouter 从 2024 年 1 月约 100 亿 token/周,增长到 2026 年 8 月超过 90 万亿/周,增长了 9000 倍。 如果这一速度持续下去,不知道未来 2.5 年会是什么情况。 而智能体工作流才刚刚开始。智能体可以消耗极其庞大的 token 量。 OpenRouter 表示,智能体工作负载约在 2 月超过了人类 token 使用量,而一次智能体请求消耗的 token 约为正常人类使用的 15 倍。 图表来自 Menlo Ventures。
信息来源:X:Rohan Paul (@rohanpaul_ai)
模型发布 / 更新普通
微软 Skala 1.1 更新提升计算化学精度
Skala 1.1,微软研究院更新的深度学习交换关联泛函,提供了更高的精度、在计算化学生态系统中更广泛的可及性,以及一个用于跟踪计算性能的动态基准。https://msft.it/6011aOXe5
信息来源:X:Microsoft Research (@MSFTResearch)
行业动态普通
Anthropic 推出 500 万美元资助计划,支持 AI 对用户幸福感影响的独立评估
Anthropic 启动一项 500 万美元的资助计划,为研究 AI 如何影响用户幸福感的独立研究提供直接资金、模型访问权限和技术支持。受资助者将完全独立工作,并以开源项目形式发布成果,供任何开发者使用。申请截止日期为 9 月 21 日,入选者将于 10 月 5 日前收到通知。
信息来源:Anthropic:Newsroom(网页) · Claude
论文研究普通
AgentHands:为XR空间对话智能体生成交互式手部手势
Google在CHI 2026发布研究原型AgentHands,利用LLM为XR对话智能体生成与语音同步的富有表现力的手部手势,提供空间锚定的物理指引。该系统通过眼动追踪和场景重建注册物体,由LLM生成内联GestureEvents,并在头显上按词级时间戳协调TTS与动画引擎,实现手势与语音的精准同步。应用场景包括兰花养护交互式教学、3D打印机操作技术讲解和生活方式陪伴。
信息来源:Google Research:Blog(网页)