AI 情报文章归档
浏览 AI圈报 已保存的 5760 条 AI 情报文章,覆盖模型、产品、行业、论文、教程与观点方法六大分类。
已收录文章5760
正式分类6
精选内容3361
全部文章
第 43 / 144 页 · 每页 40 条
教程 / 实战普通
OpenWiki 如何构建自纠错记忆:用证据支撑的声明检测过时知识
OpenWiki 利用证据支撑的声明来检测过时知识、减少模型幻觉,并为不断演进的代码库构建自纠错记忆。该方法通过将知识声明与可验证证据关联,使系统能自动识别并修正已失效的信息,从而提升长期记忆的准确性与可靠性。
信息来源:LangChain:Blog(RSS)
行业动态普通
Hugging Face 与 Sage 联合举办罕见病黑客松
信息来源:X:Thomas Wolf(Hugging Face 联创/CSO) (@Thom_Wolf) · Hugging Face
模型发布 / 更新普通
Apodex 1.1 多 Agent 跑测:暴富案例为 0
Apodex 1.1 用 8 个并行 Agent 实测 AI 副业赚钱项目,在公开采样范围内满足 A 级证据标准的个人收入成功案例为 0,直接戳破暴富营销滤镜。该版本已开源整套多 Agent 架构(35B 权重 + 单机 harness),支持本地单机部署,并配备实时任务看板与独立审查机制。
信息来源:X:阿易 AI Notes (@AYi_AInotes) · Claude
产品发布 / 更新普通
Perplexity 便携电脑登陆 DGX Spark
PERPLEXITY 🔥:Perplexity Pro 和 Max 订阅用户现可在 NVIDIA DGX Spark 上使用全新的 Portable Computer,完全由本地模型驱动! 可用模型:> PPLX 27B 是 Perplexity 新推出的后训练模型。> Qwen 3.8 27B > Nemotron 3.5 Lightning(即将推出) 他们真的做到了!🤖
信息来源:X:Testing Catalog (@testingcatalog) · Qwen / NVIDIA
产品发布 / 更新普通
苹果新款 Mac mini 发布:搭载 M6 与 M5 Pro 芯片
苹果发布搭载 M6 与 M5 Pro 芯片的新款 Mac mini,M6 版 AI 性能较 M4 提升最高 4 倍,CPU 快 40%,存储与图形性能翻倍。M5 Pro 版支持最高 64GB 统一内存与 307GB/s 带宽,LLM 提示词处理较 M2 Pro 快最高 8.5 倍。两款均支持 Wi-Fi 7、蓝牙 6 与 2.5Gb 以太网,今日起接受预购,9 月 22 日开售。
信息来源:Hacker News 热门(buzzing.cc 中文翻译)
观点 / 方法普通
Shopify 或封禁 Claude Code 直至支持 AGENTS.md
Shopify 的 Tobi 表示正考虑封禁 Claude Code,直到 Anthropic 改变立场并支持读取 AGENTS.md 和 .agents/skills 等文件。他认为仅读取 CLAUDE.md 会导致团队成员使用不同工具时出现"脑裂"问题,这种坚持毫无必要。DAIR.AI 的 Elvis Saravia 对此表示认同,称该问题已多次出现且 Anthropic 一直未处理。
信息来源:X:Elvis Saravia (@omarsar0, DAIR.AI) · Claude
产品发布 / 更新普通
Perplexity 推出 Portable Computer 本地智能体运行时
Perplexity 今日在 NVIDIA DGX Spark 上推出 Portable Computer,这是 Perplexity Computer 的完全本地版本,编排 LLM、子智能体 LLM 与智能体 harness 全部在本地硬件运行,无云端依赖。该产品面向算力与电力受限环境,将大量智能体推理迁移至本地设备。
信息来源:X:Aravind Srinivas(Perplexity CEO) (@AravSrinivas) · NVIDIA
论文研究普通
Apodex 1.1 发布,扩展智能体复杂工作能力
Apodex 1.1 扩展面向复杂工作的智能体智能 论文:https://huggingface.co/papers/2608.23283
信息来源:X:AK (@_akhaliq) · Hugging Face
产品发布 / 更新普通
Perplexity 推出便携电脑支持 NVIDIA DGX Spark
今天我们正式在 @NVIDIA DGX Spark 上推出 Portable Computer。 Portable Computer 是 Perplexity Computer 的完全本地版本,整个运行时--编排 LLM、子智能体 LLM、智能体框架--全部在你的本地硬件上运行,不依赖云端。
信息来源:X:Perplexity (@perplexity_ai) · NVIDIA
观点 / 方法普通
AI 不会取代放射科医生,但将彻底改变他们的工作
2016 年 Geoffrey Hinton 曾预测放射科医生五年内将被计算机取代,但该领域从业人数预计未来三十年仍将增长 26% 以上。截至 2026 年初,FDA 批准的 1400 款 AI 医疗设备中约四分之三用于放射科,部分工具能识别人眼不可见的异常或达到甚至超越训练有素放射科医生的水平。一项涵盖 43 项临床试验的分析显示,AI 辅助结肠镜检查比传统方式发现更多息肉。
信息来源:Ars Technica:AI(RSS)
观点 / 方法普通
OpenAI 奥尔特曼承认高估 AI 普及速度:最大阻力是改变用户习惯
OpenAI CEO 奥尔特曼在播客节目中承认,自己和其他 AI 支持者可能高估了 AI 普及的速度,要达到谷歌搜索或 iPhone 那样的普及程度还需更长时间。他认为最大阻力来自人的习惯,用户很难迅速改用 Codex 这样的 AI 原生平台,经济本身的惯性也让人们继续沿用原有工具和方式。奥尔特曼还承认,科技业至今未能让公众真正接受超级智能与 AI 智能体普及的设想。
信息来源:IT之家(RSS) · OpenAI
产品发布 / 更新普通
苹果发布M6与M5 Ultra芯片Mac Studio及Mac mini
苹果发布搭载M6和M5 Ultra芯片的新款Mac Studio及Mac mini。M6为苹果首款2nm芯片,配备12核CPU、12核GPU及双16核神经引擎;M5 Ultra采用首款四芯片封装架构,最高36核CPU、80核GPU,统一内存带宽达1.2TB/s。Mac mini(M6)在LM Studio中LLM提示词处理速度较M1快13.5倍,较M4快4.8倍。
信息来源:X:Testing Catalog (@testingcatalog)
产品发布 / 更新普通
Headlong:面向持久化代理的微型绑定框架
Headlong 是一个开源的代理微框架,核心代码不到 10K 行 Bash,让代理在外部交互之间通过自我引导循环持续思考,而非仅在收到任务时响应。每个代理拥有单一思维流,团队共享时能主动发起对话、自行设定项目并跨成员连接信息。目前为 alpha 研究软件,需在沙箱中运行并使用限额 API 密钥。
信息来源:Hacker News 热门(buzzing.cc 中文翻译)
行业动态普通
Gamma 收购 Accel 投资的 AI 设计初创公司 Lica
演示文稿初创公司 Gamma 收购了 Accel 支持的设计初创公司 Lica,以建立自己的设计研究实验室,Lica 联合创始人将负责领导该部门。Lica 成立于 2023 年,曾获 Accel、South Park Commons 等投资的 400 万美元,专注于为电商网站制作符合品牌准则的营销视频。Gamma 表示希望借助新部门探索多模态演示文稿等不同沟通形式,但未透露具体产品计划。
信息来源:TechCrunch:AI(RSS)
教程 / 实战普通
LangChain 如何构建智能体环境与任务
LangChain 通过三步流程构建合成智能体环境与任务:先生成规格说明,再将规格转化为具体任务,最后用世界规格(world spec)承载共享知识。该方法将环境与任务的创建系统化,为智能体训练与评测提供可复现的基础设施。
信息来源:LangChain:Blog(RSS)
产品发布 / 更新普通
Headlong:开源持续思考型智能体微框架
Headlong 是一个开源微框架,用于构建持续思考的主动型智能体,核心代码不足 10K 行 Bash。与反应式框架不同,Headlong 智能体永不休眠,通过自我引导循环持续生成想法,并自主决定何时回复。内部运行显示其后台思考成本约 $1-$2/小时,曾自主发现并修复一个 bug,全程 48 分钟无人工介入。
信息来源:X:Elvis Saravia (@omarsar0, DAIR.AI)
产品发布 / 更新普通
OpenAI 与博通共研的 Jalapeño 推理芯片亮相,称性能超越英伟达 GB300
OpenAI 在 Hot Chips 大会公布与博通共研的推理芯片 Jalapeño 首批基准测试成绩,在 SemiAnalysis InferenceX 测试中,其单用户 token 处理量和每千瓦吞吐量均超过现有顶尖推理处理器。
信息来源:IT之家(RSS) · OpenAI / NVIDIA
模型发布 / 更新普通
阿里千问预告明晚开源基于下一代 Qwen4 架构的多模态 MoE 模型 Qwen3.8-Flash-Next
阿里千问将于北京时间 08 月 26 日 23:00 在魔搭社区开源 Qwen3.8-Flash-Next 及 Qwen3.8-Flash-Next-FP8 两个版本。该模型是基于下一代 Qwen4 架构构建的多模态 MoE 模型,官方提前发布架构改进,以便社区为完整 Qwen4 模型家族做好准备。
信息来源:IT之家(RSS) · Qwen
行业动态普通
Gatik AI 完成 1 亿美元融资,无人驾驶货运商业化提速
自动驾驶卡车公司 Gatik AI 完成 2 亿美元 D 轮融资,估值达 10 亿美元,投资方包括卡塔尔投资局(QIA)、ARK Invest 等。公司已累计完成超 10 万次完全无人驾驶订单,准时交付率达 99% 以上,签约收入达 6 亿美元,百事可乐(PepsiCo)等客户已在实际业务中依赖其无人驾驶货运服务。
信息来源:X:Rohan Paul (@rohanpaul_ai)
行业动态普通
Gatik 无人驾驶货运运营透明度提升
Gatik 使其无人驾驶货运运营更加透明,用户现可实时查看所有在途卡车动态,并观看其客户供应链内部拍摄的视频系列。该公司近期完成由 QIA 和 Koch Disruptive Technologies 领投的 2 亿美元 D 轮融资,估值达 10 亿美元,百事等客户已在使用其服务。
信息来源:X:Testing Catalog (@testingcatalog)
模型发布 / 更新普通
Qwen 3.8-Flash-Next 将于明天发布(125B a6B)
通义千问(Qwen)宣布 Qwen 3.8-Flash-Next 将于明天发布,该模型参数规模为 125B a6B。模型页面已上线 ModelScope 平台,引发 Hacker News 社区关注,目前获得 103 个 HN 点赞。
信息来源:Hacker News 热门(buzzing.cc 中文翻译) · Qwen
产品发布 / 更新普通
Prime Intellect 开源自我改进框架 Prime Agent
Prime Intellect 推出开源自我改进框架 Prime Agent,面向长时程智能体任务。其持续 IPython REPL 让模型以编程方式处理自身上下文,Continual Harness 跨轨迹保留历史、记忆、技能与提示词,使改进持续累积。
信息来源:X:Elvis Saravia (@omarsar0, DAIR.AI)
产品发布 / 更新普通
OpenAI自研推理芯片Jalapeño在速度和能效上超越英伟达GB200和GB300
OpenAI称其首款自研推理芯片Jalapeño在速度和能效上已超越英伟达GB200和GB300系统。在GPT-OSS 120B、DeepSeek R1 670B和Kimi K2.5 1T模型上,Jalapeño在峰值吞吐下每瓦特AI工作量提升1.5-1.9倍,端到端延迟降低1.7-3.6倍;高交互负载性能提升2.1-4.1倍。
信息来源:X:Kim (@kimmonismus) · OpenAI / GPT / DeepSeek
产品发布 / 更新普通
Prime Agent:开源自改进智能体框架发布
Prime Intellect 发布开源自改进智能体框架 Prime Agent,通过持久 IPython REPL 和 Continual Harness 实现跨轨迹累积改进。同模型下 ARC-AGI-3 RHAE Best@1 从 30% 提升至 95.5%,并在长上下文编码、GPU 内核生成等任务上匹配或超越原生框架。
信息来源:X:DAIR.AI (@dair_ai)
行业动态普通
Gatik 获 2 亿美元融资,无人驾驶货运加速
Gatik 完成 2 亿美元 D 轮融资,估值达 10 亿美元,由 QIA 和 Koch Disruptive Technologies 领投。该公司已在得州、亚利桑那、阿肯色和加拿大实现每日无人驾驶中程货运,超 10 万次交付零安全员,准时率超 99%,现有合同收入超 6 亿美元。资金将用于扩充现有线路车队,以满足超出供给的客户需求。
信息来源:X:Kim (@kimmonismus)
产品发布 / 更新普通
OpenAI Jalapeño 芯片能效达 GB300 的 104 倍
OpenAI 称其新 Jalapeño 芯片在匹配 DeepSeek R1 解码速度下,每千瓦吞吐量达 NVIDIA GB300 的 104.3 倍(12258 对 118 tokens/s/kW)。该芯片功耗 700W,低于 GB300 的 1400W,计划年底部署,Gen 2 已在开发中。
信息来源:X:Rohan Paul (@rohanpaul_ai) · OpenAI / DeepSeek / NVIDIA
模型发布 / 更新普通
商汤 SenseNova U1.5 Lite 开源并上线 Token 计划
商汤 SenseNova U1.5 Lite 已开源并上线 Token 计划,提供免费公开测试版,每 5 小时可享 1,500 次请求。该模型支持图像生成与编辑一体化,具备参考图驱动创作、复杂指令跟随、原生 2K/4K 输出及自动提示词优化等能力。
信息来源:X:商汤 SenseTime (@SenseTime_AI)
产品发布 / 更新普通
OpenAI Jalapeño 芯片基准测试显示:为大规模快速推理而生
OpenAI 在 Hot Chips 大会上公布自研推理芯片 Jalapeño 的首批基准测试结果。在 Semianalysis 的 InferenceX 基准上,Jalapeño 每用户 token 数和每千瓦吞吐量均超过当前最先进的 Nvidia Blackwell 系统。该芯片由 OpenAI 与 Broadcom 合作开发,预计 2026 年底小规模部署,2027 年更大规模上线。
信息来源:TechCrunch:AI(RSS) · OpenAI / NVIDIA
产品发布 / 更新普通
WorkBuddy 接入 Notion 工作区
WorkBuddy 现已连接 @NotionHQ。 将你散落在 Notion 工作区的文档、笔记和知识,汇入 WorkBuddy 中的答案与操作。 你的工作区变得更加互联。
信息来源:X:Tencent WorkBuddy (@WorkBuddy_AI)
观点 / 方法普通
OpenAI Jalapeño 自研芯片优于英伟达
OpenAI Jalapeño:优于英伟达 Blackwell OpenAI 自研 ASIC 与 Rubin 对比,Jalapeño 的 TCO、每 MW 吞吐量,以及火辣细节 https://newsletter.semianalysis.com/p/openai-jalapeno-better-than-nvidia
信息来源:X:SemiAnalysis (@SemiAnalysis_) · OpenAI / NVIDIA
观点 / 方法普通
摩根大通看好 SpaceX 与 Grok 4.6 前景
摩根大通维持对 SpaceX 的增持评级,称对 Grok"越来越乐观",并预计 Grok 4.6 以显著低于同行的成本提供前沿智能。该行估计 Cursor 年经常性收入约 40 亿美元,其数据已让近期 Grok 模型出现"切实改进"。摩根大通预计 2026 年底前每月发布新模型,12 月推出的 Grok 5 将带来重大性能提升。
信息来源:X:cb_doge (@cb_doge) · Grok / Cursor
行业动态普通
腾讯相关人士回应"IEG 重组 AI 游戏部门":报道大量失实,"成立新部门"系误读
针对"腾讯互动娱乐事业群(IEG)重组 AI 游戏部门"的报道,腾讯相关人士回应称内容存在大量失实,所谓"成立新部门"系误读。该人士表示,游戏技术公线本就设有游戏 AI 引擎部,长期对外招募 AI 专业人才,聚焦游戏研运管线的 AI 提效与玩法创新。
信息来源:IT之家(RSS)
观点 / 方法普通
a16z 分享幻灯片:智能是原语,应用是扩散层
a16z 发布由 Danco 制作的幻灯片《Intelligence is the Primitive. Applications are the Diffusion Layer》,原为面向小范围受众准备。幻灯片概述了当前应用层与消费级应用的总体态势,并称若反响良好将定期发布此类内容。
信息来源:a16z:News(RSS)
观点 / 方法普通
超大规模厂商明年资本支出或超万亿美元
我们看到超大规模厂商在资本上投入了大量资金。 他们正在购买土地、购买大量设备、在全球各地雇佣建筑承包商,而这笔投入明年将达到或超过一万亿美元的资本支出。
信息来源:X:SemiAnalysis (@SemiAnalysis_)
观点 / 方法普通
MiniCPM5-1B 双 LoRA 定制化智能助手
开发者 JacobLinCool 为 MiniCPM5-1B 定制两个 LoRA 适配器,将其改造为面向不同项目流程的专用 AI 助手。一个 LoRA 使其成为创意顾问,辅助探索相关项目、对比相似案例与规划方案;另一个 LoRA 使其成为竞赛分类器,分析 README 与代码以识别赛道、奖项及完成状态。该项目展示了轻量微调结合任务适配如何解锁小模型的专用潜力。
信息来源:X:面壁智能 OpenBMB (@OpenBMB)
产品发布 / 更新普通
OpenAI 称其 Jalapeño 芯片推理响应速度优于竞品
OpenAI 发布博客称,其与 Broadcom 合作打造的 AI 推理芯片 Jalapeño 在 InferenceX 基准测试中,性能优于 Nvidia GB200/GB300 超级芯片。
信息来源:The Verge:AI(RSS) · OpenAI / NVIDIA
行业动态普通
Anthropic 因罢工警告让旧金山员工居家办公
Anthropic 在收到罢工警告后让旧金山员工回家。该指令覆盖周一和周二,此前承包商 Allied Universal 警告 Anthropic,其保安可能罢工。 - businessinsider 但代表保安的 SEIU 工会对这一警告提出了异议。
信息来源:X:Rohan Paul (@rohanpaul_ai) · Claude
产品发布 / 更新普通
苹果正式推出 M5 Ultra 芯片,最高 36 核 CPU/80 核 GPU,1.2 TB/s 统一内存带宽
苹果今日在新款 Mac Studio 中推出 M5 Ultra 芯片,首次采用 UltraFusion 技术构建四芯片架构,最高 36 核 CPU、80 核 GPU,统一内存带宽达 1.2 TB/s,比 M3 Ultra 高出 50%。该芯片 AI 峰值 GPU 计算性能较 M3 Ultra 最高提升 4.5 倍,支持 512GB 统一内存,可在设备端运行参数量达数千亿的大语言模型。
信息来源:IT之家(RSS)
论文研究普通
AutoSaddler:自动优化智能体框架的微软新论文
微软等机构提出 AutoSaddler,将智能体框架视为代码,通过失败轨迹离线自动生成补丁,优化提示词、工具配置和控制逻辑。在 GAIA2、SWE-Bench Pro、Terminal-Bench 2.0 上分别提升 9.0、9.6、10.0 分。研究显示深度调试优于浅层反思,定向编辑优于无约束编辑。
信息来源:X:Elvis Saravia (@omarsar0, DAIR.AI)
产品发布 / 更新普通
苹果推出M6与M5 Ultra芯片,将更多AI推理移至Mac桌面端
苹果推出M6和M5 Ultra芯片,将更多AI推理移至Mac桌面端。M5 Ultra Mac Studio最高可配256GB统一内存,10月将推出512GB版本;M6作为苹果首款2nm芯片首发于Mac mini,配备12核CPU、12核GPU及双16核神经引擎。
信息来源:X:Rohan Paul (@rohanpaul_ai)