AI 情报文章归档
浏览 AI圈报 已保存的 5711 条 AI 情报文章,覆盖模型、产品、行业、论文、教程与观点方法六大分类。
已收录文章5711
正式分类6
精选内容3361
全部文章
第 32 / 143 页 · 每页 40 条
模型发布 / 更新普通
智谱Ox Alpha开源,屠榜模型揭晓
彭博确认匿名屠榜的Ox Alpha是智谱GLM系列新迭代,今晚开源权重。该模型上线首日登顶OpenRouter调用量榜首,打破DeepSeek 56天霸榜纪录,前五大应用累计调用达4万亿Token;DeepSWE基准10任务过8个(80%),支持104.8万Token超长上下文和多模态。
信息来源:X:阿易 AI Notes (@AYi_AInotes) · DeepSeek / GLM
观点 / 方法普通
OpenAI 预计今年底实现 AGI,Astra 已可自主科研
OpenAI CEO Sam Altman 表示,公司预计在 2026 年底前拥有一个可称为 AGI 的内部系统。OpenAI 已基于其基准内部构建了自主 AI 研究员 Astra,能实现实验想法、运行实验并返回结果,或完成原本需人类研究员一周的工作。Altman 预测 Astra 将带来最大影响,成为首个"以有意义方式发明新事物"的模型。
信息来源:X:Kim (@kimmonismus) · OpenAI
观点 / 方法普通
Grok Bot 凭据保险库:密钥不暴露给模型
Grok Bot 新增凭据保险库,可安全存储密钥,模型在调用时经特殊访问路径,全程不接触明文凭据。用户指令触发工具调用时,主机仅凭工具名查找对应 API key 并构造真实 HTTP 请求,凭据只在最终构造处出现。该方案简化了智能体密钥管理,被视为推动大规模采用的关键创新。
信息来源:X:Eric Zakariasson (@ericzakariasson) · Grok
行业动态普通
Waymo:无人驾驶出租车严重事故率仅为人驾的 1/16,下一站慕尼黑
Waymo 公布数据称,其完全自动驾驶车队累计超 3.5 亿公里,造成重伤事故数量仅为人类驾驶员的 1/16,导致行人受伤事故数量为 1/14。慕尼黑将成为其继英国和日本之后第三个海外市场,初期车辆由人工驾驶进行道路测绘,计划明年底前后正式启动商业网约车服务。
信息来源:IT之家(RSS)
产品发布 / 更新普通
Particle 推出 Radar:让播客可搜索、可供 AI 智能体使用
Particle 推出播客搜索引擎 Radar,可转录并理解 13 万多个播客的音频内容,提取关键引述和高光片段,并支持按人物、公司、品牌等实体追踪提及与设置提醒。Radar 已吸引对冲基金等 API 客户,定价为每席位每月 29 美元,企业版每月 399 美元含 20 席位,API 用户另议。Radar 还提供播客广告搜索、政治倾向分析等工具,未来计划扩展至 YouTube 视频等音频形式。
信息来源:TechCrunch:AI(RSS)
模型发布 / 更新普通
阿里云发布 Qwen3.8-Flash 多模态 MoE 模型
阿里云发布 Qwen3.8-Flash,一款多模态 MoE 模型,为 Qwen4 架构的早期预览,现已开放权重。该模型拥有 125B 参数,每 token 仅激活 6B,训练成本仅为 Qwen3.7-Plus 的 1/9,性能全面超越后者。其 API 定价为每百万输入 token 0.16 美元、输出 0.47 美元,原生支持 262K 上下文,可扩展至 1M。
信息来源:X:阿里云 / Alibaba Cloud (@alibaba_cloud) · Qwen
观点 / 方法普通
蚂蚁百灵Ling-3.0-tiny登移动端智能前沿
据Artificial Analysis,Ling-3.0-tiny位于移动端智能-速度帕累托前沿:在iPhone 17 Pro上16K上下文得分59,耗时5.7秒。同时以66分在64K智能评测中排名第一。将更强智能带入更小设备。
信息来源:X:蚂蚁百灵 (@AntLingAGI)
观点 / 方法普通
OpenAI 推出 $visualize 可视化功能
$visualize 【引用 @kagigz】:如果你和我一样是视觉型学习者,这条就是为你准备的! 在 ChatGPT Work/Codex 中试试 `$visualize`,把任何信息变成漂亮的可视化图表 https://www.youtube.com/watch?v=jzmNh8lbSp8
信息来源:X:OpenAI Developers (@OpenAIDevs) · OpenAI / ChatGPT
论文研究普通
英特尔 18A-P 工艺详解:0.5V 低电压频率跃升 30%,Diamond Rapids 与 Nova Lake 率先搭载
英特尔在 Hot Chips 2026 上公布 18A-P 制程细节,基于量产芯片测试,该制程在 0.5V 工作电压下实现 30% 频率提升,相同功耗下性能提升超 9%,相同性能下功耗降低超 18%。18A-P 通过 RibbonFET 晶体管、背面供电及新增金属层等手段优化,将率先用于 Diamond Rapids 至强和 Nova Lake 酷睿处理器,计划于 2027 年推出。
信息来源:IT之家(RSS)
产品发布 / 更新普通
Perplexity Computer 推出背景 Dream 智能体
Perplexity Computer 为 Max 用户推出后台 Dream 智能体,持续从文件和连接应用中摄取上下文,构建多跳上下文图谱。新评测显示正确性提升 9.3 点、时效性提升 8.0、召回率提升 8.9,同时 token 消耗减少 15%。其自改进记忆系统 Brain 可将会话、文件和来源编译为结构化知识库。
信息来源:X:Aravind Srinivas(Perplexity CEO) (@AravSrinivas)
模型发布 / 更新精选
Qwen3.8-Flash 开源,Qwen4 架构预览
通义千问发布 Qwen3.8-Flash,一款多模态 MoE 模型,作为 Qwen4 架构的早期预览并开放权重。该模型总参数 125B,每 token 仅激活 6B,训练成本仅为 Qwen3.7-Plus 的 1/9,性能全面超越后者。生产版 API 定价 $0.16/1M 输入 tokens 和 $0.47/1M 输出 tokens,原生上下文 262K,可扩展至 1M。
信息来源:X:通义千问 / Qwen (@Alibaba_Qwen) · Qwen
模型发布 / 更新普通
Z.ai 揭晓 Ox Alpha 实为 GLM-5.3-Flash
Z.ai 证实此前神秘模型 Ox Alpha 实为 GLM-5.3-Flash,其每日 100 万亿 token 的流量由数万块国产 AI 芯片支撑,而非 NVIDIA GPU 集群。
信息来源:X:Rohan Paul (@rohanpaul_ai) · GLM / NVIDIA
模型发布 / 更新普通
微信开源多模态嵌入模型 WeMM-Embedding
微信开源其多模态嵌入模型 WeMM-Embedding,9B 版本在 MMEB-v2 和 MMEB-v3 双榜登顶。2B 小版本跑分超越上一代 8B 开源顶流,靠几亿级数据对齐与细粒度蒸馏实现。该模型已部署于视频号、公众号、朋友圈和电商搜索推荐,支持文字、多图、长视频混合输入,维度截断至 256 维仍保留近 99% 性能,可大幅降低向量数据库存储与检索成本。
信息来源:X:阿易 AI Notes (@AYi_AInotes)
教程 / 实战普通
如何让 LLM 提速 3 倍:投机解码原理详解
投机解码通过让一个小模型预先草拟多个候选 token,再由大模型在单次前向传播中并行验证,可将生成速度提升 2-3 倍,且输出在统计上与单独运行大模型完全一致。70B 参数模型每生成一个 token 需从 GPU 内存读取约 140 GB 权重,而生成阶段计算利用率仅 20-40%,投机解码正是利用这部分闲置算力。文章还探讨了草稿来源的四种方式及投机解码失效的场景。
信息来源:ByteByteGo(RSS)
观点 / 方法普通
Viktor 如何从访谈中挖掘未发布观点
Kim 将一段 Google I/O 访谈交给 AI 员工 Viktor,后者对比其已发布内容,找出三个未用观点并定位到访谈具体时间点。Kim 采纳其中两个,并强调 Viktor 未编造观点,而是找到其原有想法并追溯来源。
信息来源:X:Kim (@kimmonismus)
模型发布 / 更新普通
Qwen3.8-Flash-Next 与 GLM-5.3-Flash 发布,开源模型逼近前沿
Qwen3.8-Flash-Next(125B MoE,6B 激活)在 8/9 项基准上超越 Claude Opus 4.6 Max;GLM-5.3-Flash(320B 总参,18B 激活)在 Terminal-Bench 2.1 得 84.3 分,逼近 Opus 4.8 的 85.0。两者均为 MIT 许可、原生多模态、1M 上下文,但完整权重需专业工作站或本地服务器才能运行。
信息来源:X:Kim (@kimmonismus) · Qwen / Claude / GLM
产品发布 / 更新普通
Perplexity Brain 记忆系统评测提升显著
Brain 是 Perplexity Computer 的自我改进记忆系统。它将会话、文件和来源编译成结构化的知识维基。 新的评测基于我们最初的结果,正确性提升 9.3 分,时效性提升 8.0 分,召回率提升 8.9 分,同时 token 使用量减少 15%。
信息来源:X:Perplexity (@perplexity_ai)
产品发布 / 更新普通
Google Cloud 在 Cloud TPU 上为长上下文多模态嵌入推理实现企业级精度
Google Cloud 将原生 TPU 支持集成进 vLLM,并针对 Qwen3 Embedding 模型系列优化,在 Cloud TPU 上实现长上下文(文本 4K+、多模态 15K+ tokens)多模态嵌入推理。
信息来源:Google Developers Blog(RSS) · Qwen
观点 / 方法普通
比尔·盖茨新文呼吁制定连贯AI计划,Gary Marcus称其呼应自身观点
Gary Marcus盛赞比尔·盖茨新文章,称其呼应了自己2024年著作《Taming Silicon Valley》的诸多主题。盖茨强调当前决策的持久重要性,指出AI在生物恐怖主义、深度伪造、虚假信息、网络攻击等方面的风险,并警告"AI可能阻碍孩子发展、取代人际关系"。盖茨呼吁建立国内外AI治理框架,并让公民社会而非仅政府和科技公司参与制定系统性计划。
信息来源:Gary Marcus:The Road to AI We Can Trust(RSS)
观点 / 方法普通
ChatGPT Work 登录网站不泄露密码,权限如酒店门卡
ChatGPT Work 现可在网页和移动端登录网站办事,官方强调 ChatGPT 全程看不到用户名和密码。作者以酒店门卡类比:Agent 应只获限时、限范围的访问权限,而非长期凭证。当前不少 Agent 系统仍将 API Key、Cookie 直接塞进运行环境,相当于交出总钥匙,后续还需管清可进网站、权限时长、操作确认与收回机制。
信息来源:X:小北 (@frxiaobei) · ChatGPT
模型发布 / 更新普通
Qwen3.8-Flash:高效多模态MoE模型,Qwen4架构早期预览
阿里发布Qwen3.8-Flash,一款多模态MoE模型,也是Qwen4架构的早期预览,现已开源权重。该模型总参数量125B,每token仅激活6B,原生上下文262K,可扩展至1M。
信息来源:X:Elvis Saravia (@omarsar0, DAIR.AI) · Qwen
论文研究普通
AWS 新研究量化智能体切换成本
AWS AI Labs 新论文提出"交接税"(handoff tax)概念,量化智能体运行中在弱模型与强模型间切换的实际代价。在 Claude 和 GPT 模型配对测试中,全程轨迹升级仅能恢复弱强模型间不到一半的质量差距,却带来显著成本溢价;而降级切换则处于更优的成本-质量平衡点。
信息来源:X:Elvis Saravia (@omarsar0, DAIR.AI) · GPT / Claude
行业动态普通
第二届世界人形机器人运动会闭幕:智元首次参赛登顶双榜第一,超 2500 小时真实数据免费开放
第二届世界人形机器人运动会8月26日晚在北京国家速滑馆闭幕,16国666支队伍、2056台机器人围绕51个赛项竞技。首次参赛的智元机器人凭借全量产机型斩获18金16银12铜,位列金牌榜和奖牌榜双第一。组委会发布全球首个世界级人形机器人运动会全量数据集,总时长超2500小时,涵盖12个应用场景,免费向社会开放。
信息来源:IT之家(RSS)
模型发布 / 更新普通
阿里 Qwen 团队发布 Qwen3.8-Flash-Next:125B 多模态 MoE 模型,仅 6B 参数激活,预览 Qwen4 架构
阿里 Qwen 团队发布开源权重多模态 MoE 模型 Qwen3.8-Flash-Next,125B 主干搭配 51B N-gram 嵌入表和 4B 多 token 预测模块,每个 token 仅激活 6B 参数,被视为 Qwen4 架构的早期预览。
信息来源:MarkTechPost(RSS) · Qwen
产品发布 / 更新普通
ChatGPT 上线赠送积分功能
ChatGPT 用户现在可以赠送积分 🔥 用户可选择购买积分数量。积分可通过链接或电子邮件赠送。 > "接收者的账户必须使用相同币种才能领取此礼物。" > "如果礼物在 30 天内未被领取,你将收到自动退款。积分在领取后 365 天过期。" 现在人人都可以当 @thsottiaux 了 👀
信息来源:X:Testing Catalog (@testingcatalog) · ChatGPT
观点 / 方法普通
教师需更新对AI能力与普及的认知
我知道这对那些从未要求AI改变现状的教师来说要求很多,但如果你在教书,且过去6个月里没有更新你对AI能做什么(多得多)、它的错误率(低得多)以及它在学生中的普及度(几乎全覆盖)的认知,你需要更新了。
信息来源:X:Ethan Mollick (@emollick)
行业动态普通
Krea AI 扩充创意团队招聘启事
我们正在扩充创意团队 寻找动态设计师、电影制作人和 AI 创作者。 点击下方申请 👇
信息来源:X:Krea AI (@krea_ai)
模型发布 / 更新普通
前 Meta 科学家创办的 Perceptron 推出工业视觉模型 Isaac 0.5
由两位前 Meta FAIR 研究员创立的 Perceptron 推出视觉模型 Isaac 0.5,帮助机器在仓库、工厂等工业环境中感知、推理并行动,支持视觉引导机器人导航及提取视频信息。该模型以开放权重发布,训练数据含百万小时通用视频与 ego video。公司近期完成 2100 万美元融资。
信息来源:TechCrunch:AI(RSS)
模型发布 / 更新普通
可灵AI带你进入前所未见的世界
欢迎来到一个你从未见过的世界 👀
信息来源:X:可灵 Kling AI (@Kling_ai)
行业动态普通
Cohere参与德国联邦内阁会议共商AI发展
加拿大和德国不仅仅是在讨论技术的未来。 我们正在建设它。
信息来源:X:Cohere(@cohere)
模型发布 / 更新普通
GLM-5.3-Flash 发布:320B-A18B 全面超越 GLM-5.2
智谱发布 GLM-5.3-Flash(320B-A18B),体积不到 GLM-5.2 一半,却在所有基准测试中全面超越后者。该模型原生多模态、支持 1M-token 上下文窗口,以 MIT 许可证开源,此前以 Ox Alpha 代号预览,完全运行于国产 AI 芯片。Databricks 将尽快为客户接入并实现超快运行。
信息来源:X:Yuchen Jin (@Yuchenj_UW) · GLM
模型发布 / 更新普通
智谱匿名模型Ox Alpha今晚开源,屠榜OpenRouter
在 OpenRouter 上匿名屠榜、调用量超 DeepSeek 一倍的 Ox Alpha 被证实为智谱出品,官方确认今晚开源权重。该模型以 Flash 级速度和成本实现前沿实战能力,支持 1M 上下文与图片视频多模态,推理优先架构,社区测试在 10 个高难度 Coding 任务中拿下 80% 过关率,全量 DeepSWE 跑出 64.6%。
信息来源:X:阿易 AI Notes (@AYi_AInotes) · DeepSeek / GLM
产品发布 / 更新普通
苹果部分语言版本 M5 Ultra Mac Studio 新闻稿提及基于 PCIe Gen6 的固态硬盘架构
苹果昨日推出搭载 M5 Ultra 的 Mac Studio,但仅有部分语言版本新闻稿提及基于 PCIe Gen 6 的固态硬盘架构。在 6 种语言版本中,简体中文、繁体中文、法语和德语等 4 种提及了"PCIe Gen 6",而英文和西班牙语版本则没有这部分内容。若属实,M5 Ultra 版 Mac Studio 将成为首款支持该 PCIe 规范的消费级设备。
信息来源:IT之家(RSS)
模型发布 / 更新普通
智谱发布GLM-5.3-Flash开源多模态模型
ZHIPU AI 🔥:GLM-5.3-Flash(Ox Alpha)已正式发布! > GLM-5.3-Flash 是一款 320B-A18B 多模态模型。 > 采用 MIT 许可证。 > 此前名为 Ox Alpha,是 OpenRouter 上的一个隐身模型。 看来 GLM-5.3-Flash 和 Gemini 3.7 Flash 确实是"好朋友"。
信息来源:X:Testing Catalog (@testingcatalog) · Gemini / GLM
模型发布 / 更新普通
GLM-5.3-Flash 百T日活竟由中国芯片支撑
Ox Alpha 已揭晓为 GLM-5.3-Flash,但令人震惊的是,每天 100T tokens 的服务竟运行在中国芯片上。(1/3)🧵
信息来源:X:SemiAnalysis (@SemiAnalysis_) · GLM
模型发布 / 更新普通
GLM-5.3-Flash发布:多模态1M上下文
智谱发布GLM-5.3-Flash,原生多模态并支持1M token上下文窗口,性能对标Opus-4.8。该320B-A18B模型以MIT许可证开源,此前代号Ox Alpha,完全运行于国产AI芯片,现已通过HuggingFace、API等全平台上线。
信息来源:X:Elvis Saravia (@omarsar0, DAIR.AI) · GLM / Hugging Face
行业动态普通
WSJ 报道 Aschenbrenner 45B 美元基金杠杆风险
WSJ 报道 Leopold Aschenbrenner 凭借横跨 FTX Future Fund、OpenAI、Anthropic 及硅谷顶级投资人的特殊人脉,将 AI 技术判断转化为管理 45B 美元的对冲基金。
信息来源:X:Rohan Paul (@rohanpaul_ai) · OpenAI / Claude
模型发布 / 更新普通
阿里发布 Qwen3.8-Flash-Next,主打"极致成本效率"
阿里 Qwen 团队发布多模态 MoE 模型 Qwen3.8-Flash-Next,作为 Qwen4 的架构预览,总参数 1250 亿但每 token 仅激活 60 亿,并引入 510 亿参数的 N-gram 嵌入层,可运行于系统内存。
信息来源:The Decoder:AI News(RSS) · Qwen
观点 / 方法普通
比尔·盖茨:动荡的人工智能时代已经到来
比尔·盖茨在 Gates Notes 撰文指出,人工智能正将世界带入一个动荡时期,其影响将远超以往的技术变革。他认为 AI 将深刻改变工作、教育、医疗等社会核心领域,并带来前所未有的机遇与挑战。盖茨呼吁社会以更审慎和负责任的态度应对这一快速演进的浪潮。
信息来源:Hacker News 热门(buzzing.cc 中文翻译)
观点 / 方法普通
比尔·盖茨提议征收"机器人税"并设立"人类保留"岗位以缓解AI冲击
比尔·盖茨在Gates Notes发表长文,提出两项应对AI劳动力冲击的新政策建议:对使用机器人征税,以减缓用机器替代人力的趋势,并为再培训和强化安全网筹集资金;同时将部分岗位设为"人类保留"(Human Reserved),禁止AI介入,例如告知患者不治之症这类场景。他还认为AI员工呼吁放缓AI发展的公开信"Pacing The Frontier"是好事,但怀疑其可持续性。
信息来源:TechCrunch:AI(RSS)