AI 模型发布与更新
追踪 OpenAI、DeepSeek、Qwen、Claude、Gemini、GLM、Grok 等大模型的发布、能力升级、开源权重与 API 变化。
分类文章922
当前页7 / 24
持续更新永久归档
分类文章
按发布时间从新到旧 · 每页 40 条
模型发布 / 更新普通
阿里云万相3.0上线DeeVid AI
Wan3.0 已在 @Deevid_AI 上线。🚀 更低的生成成本。创作更多,探索更多。电影级 AI 视频,更强的动态表现,更丰富的细节。立即开始创作!更多 API 接入:• Model Studio: https://click.alibabacloud.com/m/20000002017/ • Qwen Cloud: https://click.qwencloud.com/m/20000002025/
信息来源:X:阿里云 / Alibaba Cloud (@alibaba_cloud) · Qwen
模型发布 / 更新普通
阿里云万相3.0正式发布,限时优惠30%
这就是 Wan3.0。简单输入,智能创作。让想象照进现实。Wan3.0 现已全面可用。🎉 发布优惠:8月23日至9月23日期间,在阿里云百炼和通义千问云上订阅 Wan3.0(标准版)可享 30% 折扣。
信息来源:X:阿里云 / Alibaba Cloud (@alibaba_cloud) · Qwen
模型发布 / 更新普通
阿里巴巴达摩院推出肝癌 AI 模型 DAMO LiON,可精准识别 1 厘米微小肿瘤
阿里巴巴达摩院联合中国医科大学附属盛京医院等机构研发出肝癌诊断 AI 模型 DAMO LiON,可通过 CT 影像识别微小肝脏癌变病灶。两个月真实世界前瞻临床试验中,该模型发现 15 例原本被遗漏的恶性肿瘤,绝大部分为 1 厘米左右病灶;AI 协助阅片用时减少 27%,对恶性肿瘤敏感性提高 11.5%,相关论文登上《自然·医学》。
信息来源:IT之家(RSS)
模型发布 / 更新普通
千问正式上线 Wan3.0 视频生成模型
千问今日在千问创作 Web 端(c.qianwen.com)及千问 PC&APP 端正式上线 Wan3.0 视频生成模型,该模型自 8 月 6 日首发公测,支持 30 秒视频直出、真实生动的 AI 角色和丰富镜头运镜。同步开启限时优惠,千问创作会员限时 6 折,适用于短剧、漫剧及营销广告创作。
信息来源:公众号:千问APP(阿里) · Qwen
模型发布 / 更新普通
阿里云发布Kimi-K3,2.8T参数支持百万上下文
Kimi-K3 已上线,拥有 2.8T 参数,原生 1M-token 上下文。它专为仓库级工程、视觉创作和自主规划下一步的智能体而构建。现提供 1M-token 免费试用,立即探索:Model Studio:https://click.alibabacloud.com/m/20000002576/ Qwen Cloud:https://click.qwencloud.com/m/20000002584/ #KimiK3 #AlibabaCloud #QwenCloud #M…
信息来源:X:阿里云 / Alibaba Cloud (@alibaba_cloud) · Qwen / Kimi
模型发布 / 更新普通
阿里云视频生成模型 Wan3.0 正式上线,支持单次生成 30 秒视频、文档输入
阿里云视频生成模型 Wan3.0 今日正式上线,单次可生成 30 秒视频,并首次支持 doc、xls、ppt、pdf、md 等文档格式输入。公测十余天来,模型在指令遵循、跨镜头一致性、音频质感及视频编辑等方面持续进化。480P/720P/1080P API 价格分别为 0.3/0.6/1.2 元/秒,8 月 24 日至 9 月 23 日限时 7 折。
信息来源:IT之家(RSS)
模型发布 / 更新普通
JoyAI-Echo-1.5:面向持久故事与交互世界的长时程音视频生成
JoyAI-Echo-1.5 发布,这是一个统一的音视频生成系统,包含长视频与世界模型两个变体。长视频变体通过可组合的跨镜头记忆与说话人线索,实现跨镜头的角色外观和语音身份保持;世界模型变体将导航输入转换为 6-DoF 相机轨迹,支持控制器无关的交互。其世界模型变体在 WBench 上以 81.7 的平均分排名第一。
信息来源:HuggingFace Daily Papers(社区热门论文) · Hugging Face
模型发布 / 更新普通
神秘"隐身模型"Ox Alpha 背后是谁?
名为 Ox Alpha 的神秘新 AI 模型在 OpenRouter 上线,被描述为面向编程、持续智能体工作和生产负载的推理模型,Stripe CEO Patrick Collison 称其"非常出色"。该模型由匿名第三方提供,引发关于其背后开发者的广泛猜测,焦点集中在中国的 Z.ai(GLM 模型)或微软未发布的 MAI 版本上。
信息来源:TechCrunch:AI(RSS) · GLM
模型发布 / 更新普通
Harvey 推出基于 Kimi K3 的后训练模型 Harvey Tenet
Harvey 发布其首个后训练模型 Tenet 研究预览版,基于 Kimi K3 基座,针对长时程法律工作训练。相比基座,Tenet 在 LAB 上完成近两倍保留任务,在 LAB: Contracts 上多 20%,全通过率分别提升 9 和 2 个百分点。目前未公开权重或 API,仅限企业通过 Harvey 平台使用。
信息来源:MarkTechPost(RSS) · Kimi
模型发布 / 更新精选
面壁智能 OpenBMB 推出 MathForm,面向 Lean 4 数学自动形式化的开源框架、数据集与模型
面壁智能 OpenBMB 推出 MathForm,一个面向 Lean 4 数学自动形式化的开源框架、数据集与模型。其 FormalVerse 数据集含 367K+ 已验证示例;在匹配 100K 预算下,基于其训练的模型 Consistency Check 达 60.32%,优于 FineLeanCorpus(46.53%)与 NuminaMath-LEAN(41.49%)。
信息来源:X:面壁智能 OpenBMB (@OpenBMB)
模型发布 / 更新精选
DeepSeek 上线多模态视觉理解模型 V4-Flash-Vision-Exp
DeepSeek 上线多模态视觉理解模型 V4-Flash-Vision-Exp,纯文本能力与 V4-Flash 正式版持平,多模态 Agent 能力接近 Opus-4.8。该模型通过 API 提供,图片按 token 计费,一张最多占 384 tokens,价格与 V4-Flash 一致。同期上线的 Files API 免费,支持图片上传后通过 file_id 复用。
信息来源:公众号:DeepSeek(深度求索) · DeepSeek
模型发布 / 更新普通
DeepSeek 上线 V4-Flash-Vision-Exp 实验性多模态 API,同步推出 Files API
DeepSeek 8-21 宣布 DeepSeek-V4-Flash-Vision-Exp 已在 API 平台可用:这是可接图的实验性多模态模型,文本能力对齐 V4-Flash,用模型名 deepseek-v4-flash-vision-exp 调用,图片可用 base64、外部 URL 或 Files API 传入。同一更新上线 Files API(一次上传后按 file_id 复用)及 DeepSeek Harness 配套更新。官方 changelog 标为 expe…
信息来源:AI Insight · DeepSeek
模型发布 / 更新精选
Hugging Face 发布 LFM2.5 系列 DSpark 草稿模型,推理速度最高提升 3.18 倍
Hugging Face 发布 LFM2.5 系列三款模型的 DSpark 草稿模型检查点,通过投机解码在不改变输出质量的前提下,GPU 吞吐最高提升 3.18 倍,端侧最高 2.87 倍。草稿模型约 300M 参数,LFM2.5-2.6B 函数调用延迟平均降低 57%,已开源支持 llama.cpp 和 SGLang。
信息来源:Hugging Face:Blog(RSS) · Llama / Hugging Face
模型发布 / 更新精选
阿里发布 Qwen-UI-Agent,主打让模型真正"会用"每一块屏幕
阿里巴巴正式推出 Qwen-UI-Agent,一个以真实世界为中心的 GUI 智能体基座模型,覆盖移动端、电脑端、网页端及深度搜索(DeepSearch)环境。
信息来源:IT之家(RSS) · Qwen
模型发布 / 更新精选
Ling-3.0 tiny & flash Base Models 正式开源
蚂蚁百灵开源 Ling-3.0-tiny-base 与 Ling-3.0-flash-base,并同步开放预训练、中期训练及 WSM 合并等共 6 个 checkpoints。tiny-base 总参数 7.9B、激活参数 1.3B,flash-base 总参数 124B、激活参数 5.1B,均采用统一训练方案,适合持续预训练、监督微调、偏好优化及强化学习后训练等场景。
信息来源:公众号:蚂蚁百灵(Ling)
模型发布 / 更新精选
Liquid AI 发布 LFM2.5 系列 QAD Q4_0 量化检查点,恢复 97% 精度损失
Liquid AI 发布基于量化感知蒸馏(QAD)训练的 LFM2.5-230M、350M、1.2B-Instruct 和 2.6B 四款 Q4_0 GGUF 检查点,在保持原生 Q4_0 内存与速度的同时,恢复 BF16 平均精度损失的 97%。
信息来源:Hugging Face:Blog(RSS) · Hugging Face
模型发布 / 更新精选
MOSS-VL技术报告:将实时交互作为一等能力的开源视觉语言模型家族
MOSS-VL是一个将实时交互(边感知边说话)作为一等能力的开源视觉语言模型家族,通过门控交叉注意力让语言解码器在生成时同步处理视觉输入。MOSS-VL-Realtime在四个流式基准中平均成绩居开源模型之首(三项第一、一项第二),在OmniMMI Proactive Alerting上以66.0分大幅领先最佳基线(37.5分)。
信息来源:HuggingFace Daily Papers(社区热门论文) · Hugging Face
模型发布 / 更新精选
Gemini 3.7 Flash 全面上线 Pro 与 Ultra 用户
Gemini 3.7 Flash 现已向 Gemini 聊天中的 Pro 和 Ultra 用户开放。该模型更新提升了多步骤任务的推理与准确性,如智能整合数十个文件和邮件为一份主文档。同时,Gemini Spark 也已运行于 3.7 Flash,通过改进对 Google Workspace 应用的工具调用,让个人 AI 智能体更精准。
信息来源:X:Gemini (@GeminiApp) · Gemini
模型发布 / 更新精选
通义千问开源 Qwen3.8 系列模型
通义千问兑现承诺,开源 Qwen3.8 系列模型。其中 Qwen3.8-27B 为原生多模态稠密模型,仅 27B 参数即全面超越 Qwen3.7-Plus,原生支持 262K 上下文,可通过 YaRN 扩展至 1M tokens,采用 Apache 2.0 许可。Max 级 Qwen3.8-2.4T-A95B 的开放权重也已同步发布。
信息来源:X:通义千问 / Qwen (@Alibaba_Qwen) · Qwen
模型发布 / 更新精选
dots3-note Preview 开源:280B 参数轻量模型,主打长程智能体与多模态推理
小红书技术开源 dots3-note Preview,这是 dots3 系列最轻量模型,总参数 280B、激活参数 16B,支持 512K 上下文及文本、视觉、语音多模态理解,并针对复杂推理和长程 Agent 任务优化。
信息来源:公众号:小红书技术(dots.llm)
模型发布 / 更新普通
智谱发布 GLM-5.3:同基座后训练强化编程与安全,上线 Coding Plan/ZCode,权重拟两周后开源
智谱 8-14 发布 GLM-5.3,已通过 GLM Coding Plan 与 ZCode 提供。与 GLM-5.2 同基座,能力提升主要来自后训练强化,聚焦复杂编程、长程 agent 与漏洞发现类任务;官方称编程较 5.2 约提升 50%、在 Terminal Bench 3.0 与 Agents Last Exam 等公开榜位列开源第一、逼近 Claude Fable 5,网络安全 CyberGym 得 84.5%(以上为 Zhipu 自评/官方数据)。API 与开源…
信息来源:AI Insight · Claude / GLM
模型发布 / 更新普通
阿里开源 Qwen3.8-27B:Apache 2.0 稠密视觉语言模型,消费级 GPU 可跑
阿里 Qwen 8-14 在官方 HuggingFace 组织仓 Qwen/Qwen3.8-27B 开源 Qwen3.8-27B(Apache 2.0),为稠密视觉语言模型(约 28B、BF16 safetensors),原生 262K 上下文、可扩展至 1M,含视觉编码器、可在单张消费级 GPU 跑,兼容 Transformers/vLLM/SGLang;可商用免费、无按 token 费。官方仓仅放 safetensors,GGUF 量化在社区仓。此前一度显示 Upcom…
信息来源:AI Insight · Qwen / Hugging Face
模型发布 / 更新精选
GLM-5.3 发布:编程能力开源第一,并涌现网络安全能力
智谱发布GLM-5.3,基于与GLM-5.2相同的基座,通过极致后训练Scaling提升智能上界,编程能力较前代提升50%,在Terminal Bench 3.0等公开基准中取得开源第一。模型在白盒代码审查等安全任务中表现持平Mythos 5,并在CyberGym测试中得分84.5%。GLM-5.3即日起上线ZCode、AutoClaw等工具,API很快上线,完整模型权重将在两周内开源。
信息来源:智谱:研究(网页内嵌数据) · GLM
模型发布 / 更新精选
DeepSeek V4 Pro 登陆硅基流动,1M 上下文
DeepSeek-V4-Pro-0813 正式上线硅基流动 SiliconFlow,提供 Day-0 支持,具备 1M 上下文窗口及低/高/最大三档推理强度,更侧重编码、工具调用与智能体工作流,仍保持 MIT 开源协议。定价为输入 $1.32/M、输出 $3.96/M、缓存命中 $0.44/M。同系列 DeepSeek-V4-Flash-0731 则面向追求速度与成本效益的日常生产场景。
信息来源:X:硅基流动 SiliconFlow (@SiliconFlowAI) · DeepSeek
模型发布 / 更新精选
Google DeepMind 推出 Gemini 3.7 Flash:面向编程与智能体的最强工作模型
Google DeepMind 发布 Gemini 3.7 Flash,距 3.6 Flash 仅三周,主打编程与智能体任务,输入/输出价格分别为每百万 token $0.75 和 $3.75,为原 3.6 Flash 的一半。
信息来源:Google DeepMind:Blog(RSS) · Gemini
模型发布 / 更新精选
DeepSeek-V4-Pro 正式版上线,Agent 能力大幅增强
DeepSeek-V4-Pro 正式版已在 APP、网页端和 API 同步上线,模型名设为 deepseek-v4-pro 即可使用。其 Agent 能力显著提升,HLE (wo/w tools) 达 42.7/60.0,Terminal Bench 2.1 为 87.9。
信息来源:DeepSeek:API 更新日志 · DeepSeek
模型发布 / 更新精选
小红书开源连续自回归语音合成模型 dots.tts:打造可持续扩展的 TTS 基座
小红书 dots 团队开源 20 亿参数全连续端到端自回归语音合成模型 dots.tts,在 Seed-TTS-Eval 三个子集上取得最佳平均内容准确度和平均说话人相似度。
信息来源:公众号:小红书技术(dots.llm)
模型发布 / 更新普通
Google DeepMind 正式发布 Gemini 3.7 Flash:官方页标注 GA,上线 App/AI Studio/API/Antigravity
Google DeepMind 8-13 正式发布 Gemini 3.7 Flash,官方模型页状态标注为 General availability,已上线 Gemini 应用、Google AI Studio、Gemini API、Antigravity 及 Gemini Enterprise。定位编程、智能体与知识工作的高性价比 workhorse,支持文本/图像/视频/音频/PDF 多模态,官方称在 Flash 级速度下具备进阶推理;引入期定价至 2026-12-31…
信息来源:AI Insight · Gemini
模型发布 / 更新精选
微软首发自研推理模型MAI-Thinking-1
我们的首个推理模型 MAI-Thinking-1 从零开始构建,现已在 Microsoft Foundry 上线。为团队点赞!更多详情如下。
信息来源:X:Mustafa Suleyman(Microsoft AI CEO) (@mustafasuleyman)
模型发布 / 更新精选
MiniMax Music 3.0 发布:新一代开源权重、生产级全能音乐模型
MiniMax 推出 Music 3.0,新一代音乐生成模型,可根据创意概念和可选歌词一次性完成整首歌的作曲、编曲、演奏与制作,最长支持五分钟。
信息来源:MiniMax:Blog(网页)
模型发布 / 更新精选
LTX-2.5 模型登场:AI 生成 10 秒 720P 视频仅需 6.8 秒,原生集成 ComfyUI
LTX 推出 LTX-2.5 模型,原生集成 ComfyUI,在 2 张英伟达 GB200 配置下生成 10 秒 720P 视频仅需 6.8 秒。LTX-2.5 Fast 以每秒 0.09 美元生成带音频 720p 视频,10 秒片段成本 0.90 美元;年度经常性收入低于 1,000 万美元的组织可免费使用。
信息来源:IT之家(RSS) · NVIDIA
模型发布 / 更新精选
xAI 发布 Grok 4.6,强化长时运行智能体能力
xAI 今日发布 Grok 4.6,在 Grok 4.5 基础上重点强化长时运行智能体及更复杂的交互式与视觉工作能力。该模型在多项智能体编码与知识工作基准上达到前沿水平,在 Artificial Analysis Intelligence Index(九项基准综合分)上追平 GPT-5.6 Sol。
信息来源:xAI:News(网页) · GPT / Grok
模型发布 / 更新精选
Cursor 与 SpaceXAI 联合发布 Grok 4.6
Cursor 与 SpaceXAI 今日发布 Grok 4.6,重点强化长时运行智能体与交互式视觉任务,在多项智能体编程与知识工作基准上达到前沿水平,并在 Artificial Analysis Intelligence Index 上追平 GPT-5.6 Sol。
信息来源:Cursor Blog · GPT / Grok / Cursor
模型发布 / 更新精选
SGLang 宣布 Day-0 支持 NVIDIA Nemotron 3.5 Lightning
SGLang 宣布对 NVIDIA Nemotron 3.5 Lightning 提供 Day-0 支持,该开源模型为 30B 总参数、3B 激活参数的混合专家架构,支持最长 1M token 上下文,可从 Hugging Face 下载 BF16 和 NVFP4 权重。模型支持 MTP、DFlash、DSpark 三种投机解码技术,并可通过 OpenAI 兼容 API 接入智能体工作流。
信息来源:LMSYS:Blog(Chatbot Arena 团队) · OpenAI / NVIDIA / Hugging Face
模型发布 / 更新精选
NVIDIA 推出 Nemotron 3.5 Lightning,加速本地智能体任务
NVIDIA 发布 Nemotron 3.5 Lightning,一款可定制的开源 30B 混合专家(MoE)模型,专为常驻智能体设计。相比同类开源模型,其 token 生成速度最高提升 4 倍,任务完成时间缩短 30%。该模型采用开放权重,支持用户微调以匹配特定任务,并可在 RTX PC、DGX Spark 及 Jetson 等设备上运行。
信息来源:NVIDIA Blog(RSS) · NVIDIA
模型发布 / 更新精选
蚂蚁 inclusionAI 开源 Ling-3.0 系列语言基础模型
蚂蚁 inclusionAI 开源 Ling-3.0 系列语言基础模型,含 tiny 与 flash 两个尺寸及预训练、中期训练、合并(WSM)等阶段检查点。该系列采用混合线性注意力与稀疏 MoE 架构,总参数 7.9B,每 token 仅激活 1.3B 参数(128 个路由专家中激活 8 个)。
信息来源:蚂蚁 inclusionAI:HuggingFace 新模型 · Hugging Face
模型发布 / 更新精选
蚂蚁 inclusionAI 开源 Ling-3.0 系列高效语言基础模型
蚂蚁 inclusionAI 开源 Ling-3.0 系列语言基础模型,并发布预训练、中期训练及合并(WSM)等多个阶段检查点。该系列采用高度稀疏(1/64)MoE 架构,512 个路由专家中每 token 仅激活 8 个,激活参数仅 5.1B(Non-emb),总参数 124B,并原生结合 KDA 与 Gated MLA 混合线性注意力以高效处理长上下文。
信息来源:蚂蚁 inclusionAI:HuggingFace 新模型 · Hugging Face
模型发布 / 更新精选
蚂蚁 inclusionAI 开源 Ling-3.0 系列中间训练检查点
蚂蚁 inclusionAI 开源 Ling-3.0 系列高效语言基础模型,并发布预训练、中间训练及合并(WSM)等多个训练阶段检查点,支持继续预训练、微调与研究。
信息来源:蚂蚁 inclusionAI:HuggingFace 新模型 · Hugging Face
模型发布 / 更新精选
Ling-3.0-tiny 正式开源:1.3B 激活参数如何进入真实任务
蚂蚁百灵开源 Ling-3.0-tiny,一款总参数 7.9B、每 Token 仅激活 1.3B 参数的原生混合推理模型,同步提供 BF16、FP8 和 INT4 三个版本。
信息来源:公众号:蚂蚁百灵(Ling)
模型发布 / 更新精选
SGLang 为 Muse Glimmer 提供 Day-0 支持,针对本地智能体工作流优化推理
SGLang 与 Meta Superintelligence Labs 合作,为 30B 参数多模态模型 Muse Glimmer 提供 Day-0 支持,该模型拥有 128k+ token 上下文窗口。
信息来源:LMSYS:Blog(Chatbot Arena 团队)