AI 情报文章归档
浏览 AI圈报 已保存的 5645 条 AI 情报文章,覆盖模型、产品、行业、论文、教程与观点方法六大分类。
已收录文章5645
正式分类6
精选内容3360
全部文章
第 17 / 142 页 · 每页 40 条
行业动态普通
Anthropic 考虑 IPO 允许内部人分批套现
Anthropic 可能会让员工和早期投资者在 IPO 期间套现部分股份,同时要求他们等待比正常情况更长的时间才能出售其余股份。 --The Information 这能让内部人获得流动性,同时避免上市后突然向市场抛售大量股票,有助于 Anthropic 控制波动性。SpaceX 和 Cerebras 在各自 IPO 中均未允许现有股东出售股份,因此 Anthropic 正在考虑为可能是史上最大规模之一的 IPO 采取一种明显不同的做法。
信息来源:X:Rohan Paul (@rohanpaul_ai) · Claude
观点 / 方法普通
Agnes 2.5 Pro Beta 智能指数跃升至 49
Agnes AI 的 Agnes 2.5 Pro Beta 在 Artificial Analysis 智能指数上得分 49,较 Alpha 版提升 9 分,主要得益于智能体能力的大幅增长(Agentic Index 从 25 升至 44),但输出 token 消耗约为前代的两倍。
信息来源:X:Artificial Analysis (@ArtificialAnlys)
行业动态普通
OpenAI 与泰国高教部推出八周加速器,支持泰国 AI 初创企业
OpenAI 与泰国高等教育、科研与创新部(MHESI)在曼谷宣布启动 OpenAI x MHESI AI Accelerator,为期八周,首批遴选 10 家聚焦医疗、健康与教育的初创公司。每家团队将获得 2,000 美元 API 额度、一对一技术指导及 OpenAI 最新前沿模型访问权。这是 OpenAI 与泰国政府的首个公私合作项目,旨在帮助初创企业将原型推进至可部署产品。
信息来源:OpenAI:官网动态(RSS · 排除企业/客户案例) · OpenAI
模型发布 / 更新普通
蚂蚁百灵发布金融增强模型 Ling-3.0-flash-Fin,面向真实金融工作流
蚂蚁集团联合中金等机构发布金融增强模型 Ling-3.0-flash-Fin,延续 Ling-3.0-flash 架构,保持 124B 总参数、5.1B 激活参数,通过金融语料持续预训练强化年报、财务工作簿等复杂内容处理。
信息来源:公众号:蚂蚁百灵(Ling)
产品发布 / 更新普通
PRAXIST Beta 开源,MLE-bench 夺 49 金
Sapient Intelligence 发布并开源自主科研系统 PRAXIST Beta,通过并行 Research Peers 与共享研究图谱跨代累积实验证据。在完整 75 任务 MLE-bench 上,PRAXIST(deepseek-v4-pro)获 49 金、共 60 枚奖牌,超过 Claude Opus 4.8 的 34 金、55 枚。
信息来源:X:Rohan Paul (@rohanpaul_ai) · DeepSeek / Claude
论文研究普通
VGI-Bench:探针视频生成模型视觉智能
VGI-Bench 探针视频生成模型中的视觉智能 论文:https://huggingface.co/papers/2608.19583
信息来源:X:AK (@_akhaliq) · Hugging Face
产品发布 / 更新普通
Show HN:Experiential--开源智能体工作流网关与路由器
Experiential 是一个面向智能体工作流的开源网关与路由器,通过一个 OpenAI 兼容 API 统一托管、BYOK 和本地模型,并支持按用户、智能体、用例及预算控制模型访问。它可将生产流量转化为针对质量、速度和成本优化的自定义路由器或模型。项目支持本地部署(pip install experiential)及托管平台,并默认启用匿名聚合遥测。
信息来源:Hacker News 热门(buzzing.cc 中文翻译) · OpenAI
行业动态普通
阿里云Qwen Work:从问答到自主智能体
阿里云宣布Qwen Work,标志AI从聊天机器人、副驾迈向自主智能体,能收集上下文、推理复杂问题并跨部门执行端到端工作流。Qwen Work实现从"回答问题的AI"到"采取行动的AI"的转变,智能体每次行动都会变得更聪明。9月4日曼谷现场演示实时跨部门工作流。
信息来源:X:阿里云 / Alibaba Cloud (@alibaba_cloud) · Qwen
观点 / 方法普通
阿里云 Wan3.0 登顶视频编辑竞技场
阿里云 Wan3.0 在 Video Edit Arena 中登顶,以 1414 ps 领先 dreamina-seedance-2.5 4 分、MiniMax-H3 22 分。这是 Wan 系列首次进入该竞技场,目前共有 8 家实验室的 10 个模型参与。Wan3.0 已通过 Model Studio 和 Qwen Cloud 开放 API 访问。
信息来源:X:阿里云 / Alibaba Cloud (@alibaba_cloud) · Qwen
行业动态普通
Grok 4.6 登陆微软 Foundry 平台
Grok 现已登陆 Microsoft Foundry 【引用 @cb_doge】:突发:来自 SpaceXAI 的 Grok 4.6 现已可在 Microsoft Foundry Models 中使用。 在 Foundry 上使用 Grok 4.6 进行构建,企业组织可在此比较前沿 AI 模型、运行特定工作负载测试、部署托管端点,并以企业级安全与治理管控进行运营。
信息来源:X:Elon Musk (@elonmusk, xAI) · Grok
行业动态普通
《时代》公布 2026 年全球 AI 百大人物榜:奥尔特曼、马斯克、吴泳铭等登封面
《时代》杂志 8 月 27 日公布 2026 年全球 AI 百大人物榜,系该榜单第四年发布。Anthropic CEO 达里奥·阿莫迪、OpenAI CEO 萨姆·奥尔特曼、埃隆·马斯克、阿里巴巴 CEO 吴泳铭、李飞飞等登上封面。国内入选者还包括字节跳动梁汝波、华为何庭波、中芯国际梁孟松、月之暗面杨植麟、智谱张鹏等。
信息来源:IT之家(RSS) · OpenAI / Claude / GLM
行业动态普通
SK 海力士在美 HBM 生产基地奠基:2029H2 产出首款"美国造"HBM
SK 海力士在美国印第安纳州西拉斐特的 AI 存储器先进封装生产基地奠基,总投资超 40 亿美元,预计 2028 年 10 月完成无尘室建设,2029 年下半年启动新一代 HBM 量产,员工总数有望超 1000 名。该基地将使用韩国生产的先进晶圆,并同步构建先进封装研发测试床,与普渡大学签署研发合作备忘录。
信息来源:IT之家(RSS)
观点 / 方法普通
AI Runtime 上的快速容错 PyTorch 训练
Databricks AI Runtime 通过优化 PyTorch 训练流程,显著提升大规模训练效率,核心指标"goodput"成为衡量训练效率的关键。该方案在故障容错与性能之间取得平衡,减少因节点故障导致的训练中断与重启开销,从而提升整体吞吐量。适用于需要长时间稳定运行的大规模分布式训练场景。
信息来源:Databricks:Blog(RSS)
产品发布 / 更新普通
Claude Code v2.1.250 发布
Anthropic 发布 Claude Code v2.1.250。该智能体编码工具运行于终端,能理解代码库,通过自然语言命令执行日常任务、解释复杂代码并处理 git 工作流,帮助开发者更快编码。
信息来源:Claude Code:GitHub Releases(RSS) · Claude
教程 / 实战普通
Claude Tag 如何驱动 Anthropic 值班
Claude Tag 迄今为止最热门的用例--值班。了解我们如何用 Tag 驱动 Anthropic 的值班工作,并自行配置,这样你就不会在凌晨 3 点被一个 Claude 本可解决的告警吵醒。 https://claude.com/blog/ai-ci-cd-on-call
信息来源:X:Noah Zweben(@noahzweben) · Claude
观点 / 方法普通
晶圆级芯片I/O带宽瓶颈分析
片外带宽一直是晶圆级芯片的短板。WSE-3 拥有惊人的晶圆上 SRAM 带宽,但一旦数据需要离开晶圆,一切都会变慢。这之所以重要,是因为晶圆仅能容纳 44GB 的 SRAM,因此大模型会被分散到多块晶圆上,而每增加一块晶圆,就意味着有更多数据需要穿越这条带宽受限的 I/O 路径。长上下文会让情况更糟,因为 KV 缓存会进一步推高所需晶圆数量。(1/3)🧵 图片来源:Cerebras
信息来源:X:SemiAnalysis (@SemiAnalysis_)
产品发布 / 更新精选
Open ASR 排行榜新增首个全球南方语言:印地语与印度英语评测集
Voice Arena 与 Hugging Face 合作,为 Open ASR 排行榜引入 Monsoon en-IN 和 Monsoon hi-IN 两个评测集,覆盖印地语与印度英语,其中印地语是该排行榜多语言板块首个非欧洲语言。数据集含公开与私有分割,共 4,888 位说话人,并记录 12 项说话人属性,旨在暴露按地区、年龄、性别等维度分布不均的语音识别误差。
信息来源:Hugging Face:Blog(RSS) · Hugging Face
论文研究普通
Agent Seer:从工具规格理解中合成评测场景
Agent Seer 提出一种无需人工构建或实时执行工具即可合成评测场景的方法,利用函数名、自然语言描述和类型化参数模式等工具规格中的语义信息,生成能反映从业者组合工具与多轮迭代的真实测试场景。该方法旨在解决手工构建场景依赖领域专家、难以跨工具生态扩展且静态基准无法跟踪 API 演进的问题。
信息来源:Apple Machine Learning Research(RSS)
论文研究普通
LLM 并非(始终)符合贝叶斯:量化 LLM 概率信念的内部(不)一致性
苹果机器学习研究团队提出一种新方法,将 LLM 视为信息处理规则,利用其与贝叶斯更新的信息处理差距,研究模型如何根据证据更新概率信念的内部(不)一致性。实验评估了 LLM 在医学、科学、法律等复杂领域的信念更新表现,揭示其概率推理与贝叶斯理想之间的系统性偏差。
信息来源:Apple Machine Learning Research(RSS)
观点 / 方法普通
蒸馏「孙割写作.skill」:用 Claude 复刻孙割的白描文风
作者基于孙割爆火小作文的PDF,蒸馏出「孙割写作.skill」并开源。该技能复刻其白描手法、精确数字与意象callback等写作特征,供社区娱乐使用。开源地址见正文。
信息来源:公众号:数字生命卡兹克 · Claude
模型发布 / 更新普通
谷歌推出 Gemini Omni 1.1 Flash 视频生成 AI 模型,最高 4K 分辨率
谷歌推出 Gemini Omni 1.1 Flash 视频生成 AI 模型,最高可生成 4K 视频。新模型支持场景扩展(每次 10 秒步长,单条最长 40 秒)、指定首尾帧及最长 3 秒视频参考。360p 预览生成速度较标准 720p 最高提升 60%,成本仅为三分之一;价格从 360p 每秒 0.03 美元到 4K 每秒 0.3 美元不等。
信息来源:IT之家(RSS) · Gemini
观点 / 方法普通
MIT 特别委员会发布 AI 教学应用报告:提出八项原则与行动建议
MIT 教学、学习与研究培训 AI 应用特别委员会经五个月调研,发布报告呼吁全校行动。报告指出生成式 AI 已全面渗透校园,既带来教学创新,也冲击 p-set、开卷考试、UROP 等本科教育根基,加剧学生孤立并削弱掌握度。委员会提出八项指导原则,并为教师和管理层推荐短期与长期行动,强调 MIT 应引领 AI 时代的高等教育重塑。
信息来源:Hacker News 热门(buzzing.cc 中文翻译)
观点 / 方法普通
BestBlogs 早报 08-28:GLM-5.3-Flash 发布,Anthropic 推进 MHS 标准
BestBlogs 08-28 早报精选 10 条 AI 动态。智谱发布低成本原生多模态模型 GLM-5.3-Flash,总参数 320B、激活 18B,AA 指数 57 分。
信息来源:X:洪明 (@hongming731) · Claude / GLM
观点 / 方法普通
GLM-5.3-Flash 开源,320B 参数主打降本
智谱发布并开源 GLM-5.3-Flash,320B 总参数、18B 激活参数,是 GLM-5 系列首个原生多模态版本。相较上一代,激活参数从 32B 降至 18B,注意力计算量和 KV 缓存分别降低 3.01 倍与 4.44 倍。官方称端到端性能相对同硬件初始基线提高三倍,硬件效率和单 token 成本接近主流 NVIDIA GPU。
信息来源:X:洪明 (@hongming731) · GLM / NVIDIA
论文研究普通
首个文本转SQL模型超越人类基准
Thinking Machines与UIUC、Bridgewater研究人员合作,将专家判断融入RLVR的每个环节,训练出首个在文本转SQL任务上超越人类基准的模型。该方法需前期投入数据清洗与奖励函数对齐,但最终在复杂任务上达到SOTA水平。
信息来源:X:Thinking Machines (@thinkymachines)
模型发布 / 更新精选
Midjourney 开放 V8.2 图像编辑模型测试
Midjourney 开始向所有用户开放其首个 V8.2 图像编辑模型的测试。该模型支持指令编辑、以图生图(最多同时引用 4 张参考图)、局部重绘与扩画,并兼容个性化、moodboards 和 srefs 功能。用户可通过网页端或 Discord 的 `--edit` 命令使用,官方同步更新了 midjourney.com 与 alpha.midjourney.com 的界面。
信息来源:Midjourney:Updates(RSS)
行业动态普通
OpenAI、微软、谷歌等 116 家企业发联名信,呼吁高度重视 AI 时代网络安全
OpenAI、Anthropic、微软、谷歌母公司 Alphabet、亚马逊等 116 家企业和机构签署联名信,呼吁企业与政策制定者将网络安全置于首要位置,在 AI 时代"采取果断行动"强化防御。信中敦促政府推行"可信访问计划",使合规企业可在公众开放前提前接入高阶模型,并要求所有机构将网络防御提升为领导层核心要务,同时为医院、水处理厂等关键基础设施提供专项资金支持。
信息来源:IT之家(RSS) · OpenAI / Claude
行业动态普通
Anthropic 与 OpenAI 高管将亮相 TechCrunch Disrupt 2026 AI 舞台
TechCrunch Disrupt 2026 将于 10 月 13-15 日在旧金山 Moscone Center 举办,AI 舞台由 Google for Startups 呈现。
信息来源:TechCrunch:AI(RSS) · OpenAI / Claude
行业动态普通
宇树科技宣布每年无偿赞助"天才少年",特别优秀者经费不设限
宇树科技8月27日晚宣布,每年将无偿赞助一部分"天才少年",面向高中到硕士毕业前的学生,项目方向不设限,涵盖芯片制造、AGI、可控核聚变等前沿领域。公司将根据项目申请书和过程质量,给予1万元至2万元经费,分阶段无偿赞助,特别优秀的不设限。宇树称此举源于创始人王兴兴早年获约1万元"浙江省新苗计划"资助的经历。
信息来源:IT之家(RSS)
观点 / 方法精选
Gemini 3.5 Transcribe 发布:更精准的实时语音转写模型
Google 推出 Gemini 3.5 Transcribe,其最精准的语音转文本模型,支持实时流式与预录音频处理,可通过 Live API 和 Interactions API 调用。
信息来源:Hacker News 热门(buzzing.cc 中文翻译) · Gemini
产品发布 / 更新普通
Gemini Notebooks 新增 Google Play 图书导入
GOOGLE 🔥:用户现在可以将 Google Play Books 中的精选电子书添加到他们的 Gemini Notebooks 中。 > 第三方订阅、教科书以及搜索中的 AI Mode 和 Gemini App 等更广泛的平台支持即将推出。
信息来源:X:Testing Catalog (@testingcatalog) · Gemini
行业动态普通
规避反垄断审查,消息称英伟达暂停与多家 AI 公司的收益分成协议
英伟达已暂停一项新融资计划中的部分交易,该计划原定向 AI 云服务商提供信用支持以换取营收分成,部分员工担忧其引发反垄断审查。该项目于上周叫停,距宣布不足两个月,英伟达仍可能调整或并入其他业务。发言人回应称该模式仍在正常运作,并正根据市场需求持续优化迭代。
信息来源:IT之家(RSS) · NVIDIA
观点 / 方法普通
研究者发现针对 Claude Code Opus 5 自动模式的高成功率攻击
安全研究员 Johann Rehberger 发现一种针对 Claude Code 自动模式的攻击,通过诱骗其下载并解压 zip 压缩包,进而执行本地恶意代码,据称成功率高达 80%。
信息来源:Simon Willison 博客 · Claude
产品发布 / 更新普通
Gemini Omni 1.1 Flash 支持视频续写扩展场景
使用 Gemini Omni 1.1 Flash 加速你的故事创作。🏎️ 现在,你可以通过创建或上传视频,然后让 Gemini 从上次结束的地方继续扩展场景,从而构建更长的故事或开拓新的创意方向。
信息来源:X:Gemini (@GeminiApp) · Gemini
行业动态普通
OpenAI 在印度向 ChatGPT 用户展示广告
OpenAI 开始在印度向免费 ChatGPT 用户和付费 Go 订阅用户展示广告,赞助单元可出现在相关答案下方。OpenAI 称广告商无法影响回答,也无法访问用户聊天、记忆或个人详情。定向系统可利用当前对话,个性化广告也可能参考过往聊天和记忆,但不会向广告商暴露这些记录。
信息来源:X:Rohan Paul (@rohanpaul_ai) · OpenAI / ChatGPT
观点 / 方法普通
可验证领域模型能力扩展无上限
在可验证领域中,模型能力扩展应保持无上限。模型将不断进步,通过"吸收越来越多的计算宇宙"来实现,而计算宇宙本质上是无限的。
信息来源:X:Francois Chollet (@fchollet)
模型发布 / 更新普通
MiniMax H3 助力 fal 打造 H3 Max
MiniMax 发文祝贺 fal 团队基于 MiniMax H3 推出 H3 Max。fal 对 H3 进行后训练以提升提示词遵循与视觉质量,并协同设计推理栈,在提速同时持续测试质量,仅保留不损失后训练收益的优化。
信息来源:X:MiniMax (@MiniMax_AI)
行业动态精选
英伟达预计 2028 财年销售额达 6730 亿美元
英伟达预计 2028 财年营收增长 70%,年销售额约达 6730 亿美元,将超过苹果和 Alphabet,仅次于亚马逊。CFO Colette Kress 于 8 月 26 日给出该预测,远高于分析师平均预期的 44%。供应而非需求成为近期上限,黄仁勋称内存等部件短缺限制了更高预期,客户群正从超大规模厂商扩展至 ACIE。
信息来源:Hacker News 热门(buzzing.cc 中文翻译) · NVIDIA
产品发布 / 更新普通
Anthropic 推出模型硬件标准,让 AI 智能体控制物理世界
Anthropic 推出模型硬件标准(MHS),这是一套标准化驱动,旨在让 AI 智能体轻松连接并控制任意设备。MHS 可为设备间数据共享提供通用接口和格式,将实验设置时间从数周或数月缩短至"数小时或数分钟"。目前该标准处于研究预览阶段,Anthropic 正与 AWS、Hugging Face、Raspberry Pi 等合作,计划最终将其开源。
信息来源:Ars Technica:AI(RSS) · Claude / Hugging Face
行业动态普通
英伟达暂停部分AI云收入分成协议
WSJ报道,英伟达在对其寻求的控制权担忧加剧后,暂停了部分AI云收入分成协议。 因此,英伟达正从单纯的芯片供应商,转变为芯片供应商+财务后盾+收入分成伙伴+对云客户拥有一定控制权的角色。 据WSJ报道,正是这种额外控制权引发了阻力及潜在的反垄断担忧,英伟达现已暂停部分收入分成协议,同时重新考虑其结构。
信息来源:X:Rohan Paul (@rohanpaul_ai) · NVIDIA