AI 情报文章归档
浏览 AI圈报 已保存的 5721 条 AI 情报文章,覆盖模型、产品、行业、论文、教程与观点方法六大分类。
已收录文章5721
正式分类6
精选内容3361
全部文章
第 33 / 144 页 · 每页 40 条
模型发布 / 更新普通
GLM-5.3-Flash 发布:320B-A18B 全面超越 GLM-5.2
智谱发布 GLM-5.3-Flash(320B-A18B),体积不到 GLM-5.2 一半,却在所有基准测试中全面超越后者。该模型原生多模态、支持 1M-token 上下文窗口,以 MIT 许可证开源,此前以 Ox Alpha 代号预览,完全运行于国产 AI 芯片。Databricks 将尽快为客户接入并实现超快运行。
信息来源:X:Yuchen Jin (@Yuchenj_UW) · GLM
模型发布 / 更新普通
智谱匿名模型Ox Alpha今晚开源,屠榜OpenRouter
在 OpenRouter 上匿名屠榜、调用量超 DeepSeek 一倍的 Ox Alpha 被证实为智谱出品,官方确认今晚开源权重。该模型以 Flash 级速度和成本实现前沿实战能力,支持 1M 上下文与图片视频多模态,推理优先架构,社区测试在 10 个高难度 Coding 任务中拿下 80% 过关率,全量 DeepSWE 跑出 64.6%。
信息来源:X:阿易 AI Notes (@AYi_AInotes) · DeepSeek / GLM
产品发布 / 更新普通
苹果部分语言版本 M5 Ultra Mac Studio 新闻稿提及基于 PCIe Gen6 的固态硬盘架构
苹果昨日推出搭载 M5 Ultra 的 Mac Studio,但仅有部分语言版本新闻稿提及基于 PCIe Gen 6 的固态硬盘架构。在 6 种语言版本中,简体中文、繁体中文、法语和德语等 4 种提及了"PCIe Gen 6",而英文和西班牙语版本则没有这部分内容。若属实,M5 Ultra 版 Mac Studio 将成为首款支持该 PCIe 规范的消费级设备。
信息来源:IT之家(RSS)
模型发布 / 更新普通
智谱发布GLM-5.3-Flash开源多模态模型
ZHIPU AI 🔥:GLM-5.3-Flash(Ox Alpha)已正式发布! > GLM-5.3-Flash 是一款 320B-A18B 多模态模型。 > 采用 MIT 许可证。 > 此前名为 Ox Alpha,是 OpenRouter 上的一个隐身模型。 看来 GLM-5.3-Flash 和 Gemini 3.7 Flash 确实是"好朋友"。
信息来源:X:Testing Catalog (@testingcatalog) · Gemini / GLM
模型发布 / 更新普通
GLM-5.3-Flash 百T日活竟由中国芯片支撑
Ox Alpha 已揭晓为 GLM-5.3-Flash,但令人震惊的是,每天 100T tokens 的服务竟运行在中国芯片上。(1/3)🧵
信息来源:X:SemiAnalysis (@SemiAnalysis_) · GLM
模型发布 / 更新普通
GLM-5.3-Flash发布:多模态1M上下文
智谱发布GLM-5.3-Flash,原生多模态并支持1M token上下文窗口,性能对标Opus-4.8。该320B-A18B模型以MIT许可证开源,此前代号Ox Alpha,完全运行于国产AI芯片,现已通过HuggingFace、API等全平台上线。
信息来源:X:Elvis Saravia (@omarsar0, DAIR.AI) · GLM / Hugging Face
行业动态普通
WSJ 报道 Aschenbrenner 45B 美元基金杠杆风险
WSJ 报道 Leopold Aschenbrenner 凭借横跨 FTX Future Fund、OpenAI、Anthropic 及硅谷顶级投资人的特殊人脉,将 AI 技术判断转化为管理 45B 美元的对冲基金。
信息来源:X:Rohan Paul (@rohanpaul_ai) · OpenAI / Claude
模型发布 / 更新普通
阿里发布 Qwen3.8-Flash-Next,主打"极致成本效率"
阿里 Qwen 团队发布多模态 MoE 模型 Qwen3.8-Flash-Next,作为 Qwen4 的架构预览,总参数 1250 亿但每 token 仅激活 60 亿,并引入 510 亿参数的 N-gram 嵌入层,可运行于系统内存。
信息来源:The Decoder:AI News(RSS) · Qwen
观点 / 方法普通
比尔·盖茨:动荡的人工智能时代已经到来
比尔·盖茨在 Gates Notes 撰文指出,人工智能正将世界带入一个动荡时期,其影响将远超以往的技术变革。他认为 AI 将深刻改变工作、教育、医疗等社会核心领域,并带来前所未有的机遇与挑战。盖茨呼吁社会以更审慎和负责任的态度应对这一快速演进的浪潮。
信息来源:Hacker News 热门(buzzing.cc 中文翻译)
观点 / 方法普通
比尔·盖茨提议征收"机器人税"并设立"人类保留"岗位以缓解AI冲击
比尔·盖茨在Gates Notes发表长文,提出两项应对AI劳动力冲击的新政策建议:对使用机器人征税,以减缓用机器替代人力的趋势,并为再培训和强化安全网筹集资金;同时将部分岗位设为"人类保留"(Human Reserved),禁止AI介入,例如告知患者不治之症这类场景。他还认为AI员工呼吁放缓AI发展的公开信"Pacing The Frontier"是好事,但怀疑其可持续性。
信息来源:TechCrunch:AI(RSS)
观点 / 方法普通
GEN-1.5 物理提示词可控性示例
物理提示词可控性的一个简单示例:相同环境,不同提示词,产生不同行为。 感谢 @JagdeepBhatia8 的建议。 更多关于 GEN-1.5 的内容,请参阅下方评论中的博客文章。
信息来源:X:Generalist (@GeneralistAI)
产品发布 / 更新普通
GLM-5.3-Flash 上线 OpenCode Go 限时双倍用量
GLM-5.3-Flash(原 Ox Alpha)现已在 OpenCode Go 上线,限时提供双倍用量。
信息来源:X:opencode (@opencode) · GLM
观点 / 方法普通
编排成为AI智能体时代客户体验的新挑战
Tata Communications客户交互套件全球负责人Gaurav Anand指出,企业正将对话式AI快速部署到遗留系统上,但缺乏真正集成、可扩展且能无缝编排的平台。
信息来源:VentureBeat:AI(RSS)
模型发布 / 更新普通
GLM-5.3 Flash 发布:18B 激活参数效率惊人
GLM-5.3 Flash(Ox Alpha)正式发布,320B MoE 架构、每 token 仅激活 18B 参数,开源且 MIT 许可,原生多模态,支持 1M 上下文。
信息来源:X:Kim (@kimmonismus) · GLM
模型发布 / 更新普通
智谱开源 GLM-5.3-Flash 原生多模态模型,限时折扣价为 GLM-5.3 的 1/20
智谱上线并开源 GLM-5.3-Flash(320B-A18B),这是 GLM-5 系列首个原生多模态模型,总参数量 320B、激活参数仅 18B。该模型在 AA 综合智能指数取得 57 分,与 Claude Opus 4.8 持平,编程表现亦相当;定价为 GLM-5.3 的 1/10,限时折扣为 1/20,为 Opus 4.8 的 1/40。模型已接入 ZCode 等平台,并开放 API 调用。
信息来源:IT之家(RSS) · Claude / GLM
观点 / 方法普通
智能体编程要取代初级工程师,需要满足哪些条件?
作者提出智能体编程取代初级工程师需满足四个条件,其中三个目前未达成。METR 数据显示,前沿模型在人类 4 小时内完成的任务上成功率不足 10%;OpenAI 因数据污染和测试用例缺陷,于 2026 年 2 月停止报告 SWE-bench Verified。METR 随机对照试验中,开发者自估提速 20%,实际却慢 19%。唯一已满足的条件是企业愿为效率牺牲初级人才梯队。
信息来源:MarkTechPost(RSS) · OpenAI
模型发布 / 更新普通
Z.ai 证实 Ox Alpha 是其 GLM 系列新模型,将于周三开源权重
谜底揭晓:Ox Alpha 由智谱(Z.ai)打造,是其 GLM 系列最新迭代,此前匿名上线 OpenRouter 后已在多项基准测试中登顶。Z.ai 确认将于周三发布 Ox Alpha 权重,供开发者在其基础上构建。该模型被描述为面向编程、持续智能体工作与生产负载的推理模型,其发布加剧了中国高性价比模型对 OpenAI、Anthropic 等高价前沿模型的竞争威胁。
信息来源:TechCrunch:AI(RSS) · OpenAI / Claude / GLM
模型发布 / 更新普通
OpenRouter 揭晓 GLM-5.3-Flash 多模态模型
Ox Alpha 揭晓:@Zai_org 的 GLM-5.3-Flash,GLM-5 系列中首个原生多模态模型。 Ox Alpha 是 OpenRouter 上有史以来最大的模型,6 天内处理了超过 20 万亿 token。 立即继续使用该模型:https://openrouter.ai/z-ai/glm-5.3-flash
信息来源:X:OpenRouter (@OpenRouter) · GLM
论文研究普通
科学家以 AI 解码 60 亿 DNA 碱基"起始子"序列,约 60% 人类基因含该序列
美国加州大学圣迭戈分校研究人员利用高通量 DNA 测序和机器学习技术,解析人类基因中"起始子"(Inr)的 DNA 序列特征。团队分析约 50 万个不同版本"起始子"序列后训练 AI 模型,发现约 60% 的人类基因含有这一序列,并首次实现对"起始子"的较强预测。研究还识别出一种与 TATA 序列相关的新型"起始子",未来可用于分析相关 DNA 突变影响及设计合成启动子。
信息来源:IT之家(RSS)
模型发布 / 更新普通
智谱发布GLM-5.3-Flash,MIT开源320B模型
智谱推出GLM-5.3-Flash,原生多模态,支持1M-token上下文窗口,320B-A18B参数,MIT许可证开源。该模型此前以Ox Alpha代号预览,完全运行于国产AI芯片,现已在HuggingFace、API等全平台上线,主打高性价比。
信息来源:X:智谱 Z.ai (@Zai_org) · GLM / Hugging Face
模型发布 / 更新普通
GLM-5.3-Flash 开源:320B 总参数、AA 指数 57 分,定价为 Opus 4.8 的 1/40
智谱上线并开源 GLM-5.3-Flash(320B-A18B),这是 GLM-5 系列首个原生多模态模型,AA 综合智能指数 57 分,与 Claude Opus 4.8 持平。其定价为 GLM-5.3 的 1/10,限时折扣内为 Opus 4.8 的 1/40,并已接入 ZCode 等平台开放 API 调用。该模型采用稀疏注意力与线性注意力混合架构,推理服务已跑在国产芯片集群上。
信息来源:公众号:智谱(GLM) · Claude / GLM
模型发布 / 更新普通
GLM-5.3 Flash 将发布,性能超 Opus 4.8
即将推出的 Ox Alpha 就是 GLM-5.3 Flash(如预期):总参数 320b,激活参数 18b。 以 1/10 的价格超越 GLM-5.2,在编程和智能体基准测试上接近 Opus 4.8。 大动作即将到来!
信息来源:X:Kim (@kimmonismus) · GLM
行业动态精选
以色列资助的假美国智库试图利用AI进行宣传
一个打着"汉诺威公共政策研究所"旗号的亲以色列网站,在九天内发布了124篇、超56万字的报告,旨在优化内容以引导ChatGPT等AI聊天机器人引用其亲以观点。该网站由美国公司Piro Inc依据《外国代理人登记法》为以色列政府分发内容,其背后是以色列政府数千万美元资助、经Havas Media等第三方转手的更广泛宣传行动。
信息来源:Hacker News 热门(buzzing.cc 中文翻译) · ChatGPT
行业动态普通
美国政府拟取消数据中心空气污染许可的公众评议环节
美国环保署(EPA)计划取消要求各州在空气污染许可申请上征求公众反馈的规定,该变更将适用于包括数据中心在内的"minor source"污染源。哈佛公共卫生学院估计,弗吉尼亚州劳登县Vantage数据中心每年造成5300万至9900万美元的健康损害,为单一设施最高纪录。14个州和3个城市的检察长联名反对,认为此举将"边缘化基本的透明度和民主保障"。
信息来源:Hacker News 热门(buzzing.cc 中文翻译)
模型发布 / 更新普通
Z.ai 证实 Ox Alpha 是 GLM 系列新模型,将发布其权重
Z.ai 证实 Ox Alpha 是 GLM 系列的新模型,并宣布将发布其权重。该消息在 Hacker News 上引发关注,获得 267 个 HN Points。目前尚未披露具体参数量、benchmark 分数或发布时间等更多细节。
信息来源:Hacker News 热门(buzzing.cc 中文翻译) · GLM
观点 / 方法普通
RAG 比你想象的更简单
多数团队把 RAG 架构复杂化了,直接上嵌入、向量数据库和重排序,而用户往往只想找到"如何重置密码"这类文档。文章给出决策因素与分层方案:从纯全文检索(BM25)起步,再引入智能体查询改写(约 $0.001/次,用 GPT-4o-mini),仅在数据证明需要时才升级。对专有术语(如内部框架"Atlas"),精确关键词匹配优于语义理解。
信息来源:Hacker News 热门(buzzing.cc 中文翻译) · GPT
论文研究精选
C2PA相机经不起现实的考验:Android端可被root攻击伪造签名
安全研究员David Buchanan指出,C2PA相机认证在Android平台上可被攻破。通过root权限提升漏洞(如CVE-2026-43499),攻击者可利用StrongBox硬件签名任意数据,伪造C2PA签名图像和视频,且无需硬件攻击。该问题无法通过常规补丁修复,已提前90天向相关方报告。
信息来源:Hacker News 热门(buzzing.cc 中文翻译)
产品发布 / 更新普通
Google Labs 推出多人协作编程工具 Play with Putty
正在试验多人 AI 玩法 【引用 @GoogleLabs】:🚨 全新 LABS 实验 🚨 英雄所见略同?不如一起玩! Play with Putty 是一款协作式 vibe coding 工具,可让你实时共同构建工具和网站。 准备好让你的想象力进入多人模式了吗?前往 http://labs.google/playwithputty 加入候补名单,并分享你的反馈! 仅限美国,18 岁以上
信息来源:X:Josh Woodward (@joshwoodward, Google Labs VP)
论文研究普通
Apodex 1.1 将执行环境作为智能体扩展新维度
Apodex 1.1 将任务状态置于模型消息历史之外,把可执行环境本身作为扩展面,而非仅给智能体增加工具。该模型在 GDPVal、FrontierFinance 和 FrontierScience-Research 上分别提升 9.3、5.6 和 8.3 分。其训练环境包含真实文件、搜索和代码世界,具备状态转换、工具预算、失败条件和任务级验证器,使训练分布包含完整工作轨迹而非仅提示词与答案配对。
信息来源:X:Rohan Paul (@rohanpaul_ai)
论文研究普通
PACE-Bench:动态物理环境下智能体代码自适应评测
清华NLP团队推出PACE-Bench,评测智能体在物理参数突变后修改代码重新适应的能力,含36个基础任务和144组源→目标环境对。最佳成绩为Reflexion+Qwen3-14B的35.9% Pass@2,GPT-5.5达66.7%但仍失败三分之一。基准显示,基于最新模拟结果的反馈比单纯"多思考"更有效,且更多信息并不能消除重新设计的瓶颈。
信息来源:X:面壁智能 OpenBMB (@OpenBMB) · GPT / Qwen
模型发布 / 更新精选
GLM-5.3-Flash:前沿智能进入普惠时代
智谱上线并开源GLM-5.3-Flash(320B-A18B),这是GLM-5系列首个原生多模态模型,在AA综合智能指数取得57分,与Claude Opus 4.8持平。其定价为GLM-5.3的1/10(限时1/20),为Opus 4.8的1/40,并首次在大规模流量中由国产芯片集群提供算力支持。模型已接入ZCode等平台,同步开放API调用。
信息来源:智谱:研究(网页内嵌数据) · Claude / GLM
教程 / 实战普通
DAIR.AI 推出首个交互式 AI 智能体教程
学习 AI 智能体始于理解基础知识,然后动手构建。 我们推出首个交互式 AI 智能体教程,帮助你学习构建智能体技能。
信息来源:X:DAIR.AI (@dair_ai)
观点 / 方法普通
首个交互式AI智能体教程发布
很高兴推出我们的首个交互式AI智能体教程。 学习构建高效的智能体技能。 首先学习理论,然后在我们的新智能体游乐场中使用Pi构建技能。 接下来我应该覆盖哪个主题?
信息来源:X:Elvis Saravia (@omarsar0, DAIR.AI)
模型发布 / 更新普通
Qwen 开源 Qwen3.8-Flash-Next,SGLang 提供 Day-0 支持
Qwen 团队开源多模态 MoE 模型 Qwen3.8-Flash-Next,作为 Qwen4 架构的早期预览版。该模型采用 125B 参数主模型加 51B N-gram Embedding,每 token 激活 6B 参数,共 48 层,MoE 层使用 512 个专家和 top-10 路由。
信息来源:LMSYS:Blog(Chatbot Arena 团队) · Qwen
观点 / 方法普通
宇树机器人股价暴跌45%,估值泡沫引质疑
宇树机器人上市首日股价飙升629.4%,市值一度达618亿美元,但一周内蒸发近半,目前较IPO高点下跌45%。公司虽有真实产品、工厂和利润,但投资者预期已远超技术现实。其股价已成为中国人形机器人行业的定价锚,STAR市场流动性稀缺与无涨跌幅限制加剧了投机波动。
信息来源:X:X.PIN (@thexpin)
模型发布 / 更新普通
通义千问发布 Qwen3.8-Flash,开源 Qwen4 架构早期预览
通义千问发布 Qwen3.8-Flash,作为 Qwen4 架构的早期预览并开源权重。模型总参数 125B 加 51B N-gram 嵌入,每 token 仅激活 6B,训练成本仅为 Qwen3.7-Plus 的 1/9,SWE-bench Pro 得分 62.5,反超 Claude Opus 4.6 Max 的 53.4。
信息来源:X:阿易 AI Notes (@AYi_AInotes) · Qwen / Claude
模型发布 / 更新普通
阿里发布 Qwen3.8 Flash 多模态 MoE 模型
阿里巴巴发布 Qwen3.8 Flash,一款 125B 参数的多模态 MoE 模型,原生支持 262K 上下文,可通过 YaRN 扩展至 1M。API 定价为每百万输入 token $0.16、输出 token $0.47。该模型基于新架构构建,是 Qwen4 架构的前身,在 DeepSWE 1.1 和 SWE-bench Pro 上分别得分 58.7 和 62.5。
信息来源:X:Testing Catalog (@testingcatalog) · Qwen
模型发布 / 更新普通
阿里云 Wan3.0 登顶六大动画评测
阿里云 Wan3.0 在六大动画类别评测中均排名第一,同时在写实视频生成方面表现优异。KoyalAI CEO Mehul Agarwal 从专业电影制作视角对其进行了测试,Wan3.0 现已上线 KoyalAI 平台,并提供 Model Studio 和 Qwen Cloud 的 API 访问。
信息来源:X:阿里云 / Alibaba Cloud (@alibaba_cloud) · Qwen
模型发布 / 更新普通
Qwen3.8-Flash-Next 发布,SGLang 首日支持
通义千问发布 Qwen3.8-Flash-Next,SGLang 即日支持部署。该模型为 125B 主模型,含 51B N-gram 嵌入,每 token 激活 6B 参数。N-gram 嵌入几乎不增加计算成本即可扩展容量,并可通过异步预取驻留内存;GDN+QSA 混合注意力兼顾长任务效率与检索精度。
信息来源:X:通义千问 / Qwen (@Alibaba_Qwen) · Qwen
行业动态普通
MiniMax:M3 Pro 参数规模预计提升至约 3T,大规模国产算力集群将很快上线
MiniMax 在中期业绩电话会上透露,M3 Pro 参数规模预计提升至约 3T,并将扩大强化学习和长程任务训练以提高泛化能力与智能上限。公司正推进 M3 和 H3 的国产芯片适配,大规模国产算力集群将很快上线并逐步承担真实生产流量。2026 财年上半年营业总收入 1.17 亿美元,同比增长 283.1%,亏损收窄 11%。
信息来源:IT之家(RSS)