AI 情报文章归档
浏览 AI圈报 已保存的 5805 条 AI 情报文章,覆盖模型、产品、行业、论文、教程与观点方法六大分类。
已收录文章5805
正式分类6
精选内容3375
全部文章
第 48 / 146 页 · 每页 40 条
产品发布 / 更新普通
Conductor Cloud 进展令人振奋
我们还有很长的路要走,但我对 Conductor Cloud 的进展感到非常兴奋。 不久之后,我们都将合上电脑屏幕 🫡
信息来源:X:Charlie Holtz(@charlieholtz)
论文研究普通
DeepMind 新研究:推理时回灌深层激活可降困惑度
Google DeepMind 新论文提出"Recirculation"方法:推理时将深层激活的一小部分混入浅层,权重不变,即可恢复模型在长上下文中丢失的部分状态。在 Gemma3 上,10 个语言建模数据集中 9 个困惑度下降,12B 模型最高降 35%,但多项选择收益有限;该方法无需重训,但代价是预填充无法并行,且收益不跨模型家族迁移。
信息来源:X:Rohan Paul (@rohanpaul_ai) · Gemini
产品发布 / 更新普通
小米玄戒 O100 原型机、AI Cube 真机首秀:自研芯片加持,内置 Xiaomi MiMo 端侧模型
小米在玄戒芯片技术沟通会上展出两款端侧 AI 原型机。玄戒 O100 原型机采用 O3 与 O100 双芯协同,内置 Xiaomi MiMo 端侧模型,实测推理速度达每秒 295 Tokens。另一款 Xiaomi AI Cube「Prototype」迷你主机集成 O3、O100 与 D100 芯片,配备 80GB 统一内存,可部署 120B 与 3B 端侧模型。
信息来源:IT之家(RSS)
观点 / 方法普通
NVIDIA Groq 3 LPX 跑出 Gemma 4 31B 最快推理速度
Artificial Analysis 实测 NVIDIA Groq 3 LPX 推理机架在私有端点上以 3,431 tokens/s 输出速度运行 Gemma 4 31B,为 100k 上下文下该模型最高实测速度。该机架已全面投产,将于今年晚些时候投入运营;在 10k 和 100k 输入长度下均保持约 3,400 tokens/s 的中位输出速度,长上下文推理性能稳健。
信息来源:X:Artificial Analysis (@ArtificialAnlys) · NVIDIA
产品发布 / 更新普通
千问APP与PC端上线阿里云Token Plan接入功能
千问APP与PC端今日上线阿里云Token Plan接入功能,支持绑定API Key后直接使用Token Plan额度处理复杂任务,无需额外购买。绑定仅需三步,在「工作助理」中执行操作电脑和浏览器、调用skill交付office文档等任务时,消耗的Token将直接从订阅额度中扣除。
信息来源:公众号:千问APP(阿里) · Qwen
产品发布 / 更新普通
英特尔确认 "Diamond Rapids" 至强处理器可扩展至 256 核心
英特尔在 Hot Chips 2026 新闻稿中确认,下一代至强服务器处理器 "Diamond Rapids" 最高配备 256 颗全新核心,全面采用自研技术,结合 Intel 18A-P 制程、Foveros Direct 3D 封装与 UCIe-S 互连。
信息来源:IT之家(RSS)
观点 / 方法普通
匿名打榜的都是二流模型
信息来源:elsewhere:文章(RSS)
观点 / 方法普通
在 AI 时代,为什么焦虑比愤怒更有用
一篇评论文章回应"在科技行业工作怎能不愤怒"的提问,认为面对 AI 与智能体带来的剧变,焦虑比愤怒更合理:愤怒需要归咎对象,而焦虑承认未来的不确定性。作者主张以不确定感和好奇心替代愤怒,并指出 AI 收益正体现在员工业余项目数量上,而非公司利润。
信息来源:Hacker News 热门(buzzing.cc 中文翻译)
行业动态普通
WikiHow 起诉 OpenAI 未经许可爬取超 1.1 万篇教程文章训练 AI
WikiHow 于 8 月 21 日向美国曼哈顿联邦法院起诉 OpenAI,指控其未经许可抓取超过 11,000 篇教程文章用于训练 ChatGPT 及 GPT 大语言模型,并侵犯至少 1,200 项已注册版权。WikiHow 称 ChatGPT 能复现其文本并生成同类教程,减少其收入,要求法院判令赔偿并发布禁令。OpenAI 发言人回应称模型使用公开数据训练,并以合理使用为基础。
信息来源:IT之家(RSS) · OpenAI / ChatGPT / GPT
模型发布 / 更新普通
通义万相 Wan 3.0 上线 Pixmax,限时 7 折
阿里云通义万相 Wan 3.0 已上线 AI 创作平台 Pixmax,主打电影级画质输出。新版本支持任意艺术风格下的视觉一致性、物理真实的流畅运动,以及多模态与混合现实编辑能力。即日起至 8 月 24 日,Pixmax 用户可享 30% 折扣;开发者还可通过 Model Studio 与 Qwen Cloud 获取 API 接入。
信息来源:X:阿里云 / Alibaba Cloud (@alibaba_cloud) · Qwen
行业动态普通
微软员工自报 AI 使用量:各部门差异悬殊,与薪资、晋升无明显关联
微软内部电子表格显示,数百名员工主动公开薪酬数据并记录过去 28 天的 AI 使用金额,中位数约 300 美元,最高达 2.8 万美元,各部门差异悬殊。Business Insider 分析近 600 名美国员工数据后发现,更高的 AI 使用量并未转化为更高的加薪、奖金或晋升机会。该 AI 使用追踪工具目前仍处于早期测试阶段。
信息来源:IT之家(RSS)
行业动态普通
北京人形机器人赛惊现真假难辨瞬间
你不能只看一眼。 它几乎看起来像人类。然后又不那么像了。 在北京世界人形机器人运动会上
信息来源:X:Rohan Paul (@rohanpaul_ai)
行业动态普通
Hugging Face 年化收入两月激增50%破1.5亿美元
Hugging Face 的年化收入在两个月内跃升 50%,突破 1.5 亿美元。 增长来自其模型中心周边的付费算力、存储和订阅服务,将开源模型需求转化为基础设施收入。 - The Information。
信息来源:X:Rohan Paul (@rohanpaul_ai) · Hugging Face
观点 / 方法普通
高盛合伙人警告:华尔街普及 AI 或削弱金融从业者思考能力
高盛合伙人 Chris Churchman 警告,AI 在华尔街的快速普及可能削弱下一代金融从业者的思考能力,导致认知能力萎缩,无法再从第一性原理出发思考。他负责的机构客户数字平台 Marquee 的 AI 平台目前仅向高盛内部员工开放,且开发中最大挑战是确保 AI 答案 100% 准确并接受审计。Churchman 表示,银行需在使用 AI 与保护"师徒式"培养体系之间找到平衡。
信息来源:IT之家(RSS)
产品发布 / 更新普通
ChatGPT 恢复 Plus 5 小时使用上限
OpenAI 宣布明天起恢复 ChatGPT、Work 和 Codex 的 Plus 账户 5 小时使用上限,此前曾推迟该计划。此举旨在平滑计算负载以维持每周用量慷慨,并避免新用户意外耗尽额度。未来数月 Pro $100 和 Pro $200 订阅不受此限制。
信息来源:X:Tibo (@thsottiaux) · OpenAI / ChatGPT
模型发布 / 更新普通
小鹏第二代 VLA 首次重大升级:响应速度提升 3 倍,G9L 全球首发搭载
小鹏汽车宣布第二代 VLA 630 版首次重大升级,端侧模型参数量提高 3.5 倍,为行业主流 VLA 模型的 15 倍;端到端响应速度提升 300%。小鹏 G9L 将全球首发搭载第二代 VLA 全新版本,体验日活动定于 8 月 27 日举行。
信息来源:IT之家(RSS)
行业动态普通
Sierra 在韩国推出服务,为首尔最复杂企业提供高级 AI 智能体
Sierra 宣布在首尔开设办公室,正式进入韩国市场。该公司将面向韩国大型复杂行业的企业客户,提供其高级 AI 智能体服务,以满足当地最严苛的业务需求。
信息来源:Sierra:Blog(RSS)
行业动态普通
天骄机器人跳远7.97米夺冠
天骄团队的人形机器人在北京第二届世界人形机器人运动会上,以7.97米的跳远成绩夺得金牌。距离迈克·鲍威尔8.95米的男子世界纪录仅差0.98米。2025年时,机器人最好成绩仅为1.25米。
信息来源:X:Rohan Paul (@rohanpaul_ai)
观点 / 方法普通
AI 取代人类的经济临界点在哪里
小北借 Blockbuster 被 Netflix 颠覆的历史指出,技术革命的关键是底层条件跨过临界点,而非新发明本身。对 AI 而言,临界点是 AI 完成任务成本低于人类、且成功率高于商业可接受阈值。当两个条件同时成立,变化会突然加速,而旧世界存量巨大时最易误判。
信息来源:X:小北 (@frxiaobei)
产品发布 / 更新普通
英伟达 Groq 3 LPX 机架全面量产,今年上线
英伟达周一宣布,Groq 3 LPX 机架已进入全面量产阶段,标志着其 200 亿美元收购 Groq 所获技术正式商业化。该机架将 256 颗 Groq 3 芯片封装在一起,据 Artificial Analysis 基准测试,处理速度可达每秒 3,400 个 Token,并将与 Vera CPU 和 Rubin GPU 一同部署在云服务商 Nebius 平台,于今年晚些时候上线。
信息来源:IT之家(RSS) · NVIDIA
产品发布 / 更新普通
MiniMax H3 生态集成索引发布
MiniMax 发布 Awesome MiniMax H3 Integrations 索引,收录围绕 H3 构建的各类集成,涵盖 24GB VRAM 本地 ComfyUI 到企业级 SGLang 与 vLLM-Omni 部署。
信息来源:X:MiniMax (@MiniMax_AI)
观点 / 方法普通
Ox Alpha 三天处理 11.6T tokens,创 OpenRouter 纪录
Ox Alpha 三天内处理 11.6T tokens,是 OpenRouter 此前最大模型发布量的 2.6 倍,且有望今日突破 6T tokens。该模型拥有 1.05M-token 上下文窗口,专为持续智能体工作设计,单次会话可承载远超普通聊天的文本量。这种规模得益于编码智能体在单任务中通过长上下文、重试和重复工具调用大幅放大 token 消耗。
信息来源:X:Rohan Paul (@rohanpaul_ai)
行业动态普通
Luma Dream Lab 周报首期:创意专业人士的每周探索
/Dream Lab 周报/ 第 1 期 本系列展示我们的创意专业人士及其每周将 Luma 打造为全球最佳创意工具的探索历程。
信息来源:X:Luma AI (@LumaLabsAI)
观点 / 方法普通
BestBlogs 早报 08-25:AI Coding 转向环境与验证驱动、Agent 治理、AI 工程技能图谱、NVIDIA Groq 3 LPX、GPT-5.6 集成 Kiro
大淘宝技术提出 AI Coding 应从 Spec 驱动转向环境与验证驱动,内部案例改码仅 1 小时但上线耗时 3 周。Steve Yegge 主张用可执行治理系统"围栏"管理约 50-60 个 Agent;吴恩达详解 AI 工程六类能力。
信息来源:X:洪明 (@hongming731) · GPT / NVIDIA
教程 / 实战普通
早报:AI Coding 后,团队如何重建验证与治理
今日早报聚焦 AI 编码后的交付瓶颈:生码仅占研发链路 20-30%,需将构建、测试、日志等环节改造为 Agent 可调用的闭环。Steve Yegge 在约 50-60 个 Agent 的软件工厂中,用 450 条法律式构件建立"围栏"治理系统。吴恩达则拆解 AI 工程六类能力,强调基于评估的开发与数据、运维协同。
信息来源:X:洪明 (@hongming731)
行业动态普通
险些崩盘的AI对冲基金Situational Awareness正遭SEC调查
由OpenAI校友Leopold Aschenbrenner领导的AI对冲基金Situational Awareness正被美国证券交易委员会(SEC)调查。据《纽约时报》报道,SEC已向其交易和融资银行发出传票,要求"保留相关信息",但该基金尚未被指控任何不当行为。该公司在7月底AI股下跌中损失数十亿美元,其表示将"全力配合任何监管要求"。
信息来源:TechCrunch:AI(RSS) · OpenAI
产品发布 / 更新普通
微软 AI 智能体系统 Aion 曝光:以 Copilot 为核心、重塑桌面体验
微软 Project Aion(内部名 CopilotOS)曝光,定位为面向企业、没有开始菜单的 AI 系统,可在运行 AOSP、Win3 或 Windows 11 的 AI 专用设备上运行。
信息来源:IT之家(RSS)
观点 / 方法普通
老板们要求员工将工作信息从私密 Slack 私信移至公开频道,以便 AI 智能体读取使用
许多老板要求员工将有用工作信息从私密 Slack 私信移至公开公司频道,以便 AI 智能体读取并用于工作。WSJ 报道,若员工私下讨论客户不满原因,AI 智能体可能永远看不到该背景;在可搜索频道讨论则可用于准备客户简报或总结决策。
信息来源:X:Rohan Paul (@rohanpaul_ai)
行业动态普通
wikiHow 起诉 OpenAI 盗用文章训练 GPT
wikiHow 起诉 OpenAI,指控其未经许可抓取超 1.1 万篇文章训练 GPT 模型,侵犯至少 1200 项注册版权。诉讼还称 ChatGPT 的回答可替代 wikiHow 页面,将争议从训练延伸至市场替代。案件于 8 月 21 日在纽约南区法院提起,仍处诉状阶段;OpenAI 主张合理使用,且美国法律不保护文章中的程序与方法,为其提供潜在抗辩。
信息来源:X:Rohan Paul (@rohanpaul_ai) · OpenAI / ChatGPT / GPT
观点 / 方法普通
中国网络上一部分人坚称唐朝从未存在过
中国互联网上一小部分声音坚称唐朝(公元618年至907年)从未存在过,这一说法源于历史网红"乔宇"5月发布的视频,其用占星数据"证明"唐朝不存在。该话题在微博上已有数千万浏览量,甚至有人致电西安旅游局要求关闭景点。官媒《人民日报》发文称该说法"荒谬",并警告历史虚无主义将削弱文化自信。
信息来源:Hacker News 热门(buzzing.cc 中文翻译)
行业动态普通
马斯克:SpaceX 计划明年第四季度发射搭载英伟达芯片的 AI 卫星
马斯克表示,SpaceX 首批搭载英伟达芯片的 AI 卫星将于明年第四季度首次发射,并于 2028 年实现大规模部署。SpaceX 与英伟达合作设计了针对太空环境优化的 Vera Rubin NVL72 系统,每个轨道数据中心将比传统计算机机架更简单、便宜、高密度且轻量化。SpaceX 已向 FCC 申请部署最多 100 万颗卫星的星座,并选定英伟达作为独家技术供应商。
信息来源:IT之家(RSS) · NVIDIA
产品发布 / 更新普通
AgentX:InferenceX 新智能体推理基准
推出 AgentX:InferenceX 新的智能体推理性能基准。(1/2)🧵
信息来源:X:SemiAnalysis (@SemiAnalysis_)
论文研究普通
Best Practice Critic Optimization:一种稳定的基于评论家的强化学习训练方案
BPCO 提出一种结合 DPPO、奖励范围限定的价值预测、蒙特卡洛价值目标、未归一化策略优势及长度自适应广义优势估计的训练方案,以解决基于评论家的强化学习训练不稳定的问题。在 1.5B 至 30B-A3B 混合专家模型的数学推理任务中,BPCO 一致优于强评论家基线,并在每个提示仅采样一个响应的情况下达到或超过基于组采样的基线。该方案同样适用于基于评分标准的奖励学习,代码已开源。
信息来源:HuggingFace Daily Papers(社区热门论文) · Hugging Face
论文研究普通
FrontierChallenge:评估科学智能体端到端工作流完成度的新基准
FrontierChallenge 是一个跨领域科学工作流基准,包含 300 个端到端任务,论文发布并评估其中 97 个,覆盖量子化学、分子动力学、材料表征、分析化学、生命科学及电化学/环境领域。
信息来源:HuggingFace Daily Papers(社区热门论文) · Hugging Face
论文研究普通
评估许可究竟意味着什么?Inspect Evals 提交级快照中的声明相对推理普查
一项针对 Inspect Evals 全部 124 个评估单元的普查显示,其中 110 个因缺乏所需历史证据或语义基础而无法进行确定性推理。该审计通过冻结基底、基础族与声明查询的形式化框架,对评估声明与指标之间的许可关系进行了分类,输出类型化停止点、不稳定见证与稳定子结构,而非单一的稳健性标签。
信息来源:HuggingFace Daily Papers(社区热门论文) · Hugging Face
教程 / 实战精选
如何在编辑器里实时挑选最佳 AI 模型
OpenRouter 提出一套模型选型框架:先定义任务,从实时用量和第三方基准中筛选候选,再对比各提供商的定价与延迟,最后用自有提示词测试。判断标准是"每完成任务的成本"而非"每 token 成本"。其 MCP 服务器可直接在 Claude Code、Cursor 等编辑器中查询实时排名、价格和基准,并用 openrouter/auto-beta 按请求路由。
信息来源:OpenRouter:Announcements(RSS) · Claude / Cursor
论文研究普通
LibriBrain100:百小时宽深 MEG 数据集,推动神经语音解码规模化
LibriBrain100 发布,将原有 MEG 语音解码数据集规模扩大一倍以上,提供超 100 小时自然连续语音聆听数据。其中单被试 80 小时数据创下深度内被试神经数据新纪录,为同类数据集的 8 倍;基于现有解码模型,该数据集在词分类基准上取得 SOTA 表现。数据集附带标准划分、开源 Python 库及公开排行榜竞赛,旨在加速非侵入式脑机接口研究。
信息来源:HuggingFace Daily Papers(社区热门论文) · Hugging Face
产品发布 / 更新普通
OpenAI 推出 ChatGPT Work 和 Codex 的 Admin 插件
OpenAI 为 ChatGPT Work 和 Codex 推出 Admin 插件,让管理员在单一对话中完成查看工作区活动、管理成员与权限、调整用量限制及审批支出请求等操作。该插件遵循用户现有角色和权限,不扩大访问范围,并可将待处理的用量请求路由至 Slack 或 Microsoft Teams 审批。OpenAI IT 团队部署的工作流已解决约 45% 的工单量。
信息来源:OpenAI:官网动态(RSS · 排除企业/客户案例) · OpenAI / ChatGPT
论文研究普通
Game2World Engine:解锁野外游戏视频用于世界模型训练
研究团队提出全栈框架G2WEngine,自动提取并合成UI覆盖层,构建含96K合成视频和1,079段野外片段的Game2World数据集。基于该数据训练的GameCleaner模型在UI去除任务上平均AAR达95.36,较最强时序掩码基线提升57.3%;使用去UI数据训练的世界模型VideoReward提升6.83%。
信息来源:HuggingFace Daily Papers(社区热门论文) · Hugging Face
论文研究普通
D^3-MOPD:面向高效多教师蒸馏的自适应动态域调度
D^3-MOPD 提出一种零开销调度器,利用训练中已有的逐域反向 KL 信号在线调整数据混合比例,解决固定混合在域收敛速率差异下的算力浪费问题。在 Qwen3.6-35B-A3B 学生模型从四个域专家教师蒸馏的实验中,该方法将平均学生-教师性能差距缩小 97%(vanilla MOPD 为 63%),以约 3 倍更少的 rollout 步骤达到相同峰值性能,并在七项基准中三项超越专家教师。
信息来源:HuggingFace Daily Papers(社区热门论文) · Qwen / Hugging Face