AI 模型发布与更新
追踪 OpenAI、DeepSeek、Qwen、Claude、Gemini、GLM、Grok 等大模型的发布、能力升级、开源权重与 API 变化。
分类文章921
当前页5 / 24
持续更新永久归档
分类文章
按发布时间从新到旧 · 每页 40 条
模型发布 / 更新精选
Qwen3.8-Flash-Next 开源:Qwen4 架构早期预览
通义千问开源 Qwen3.8-Flash-Next,一款多模态 MoE 模型,也是 Qwen4 架构的早期预览。该模型采用 GDN + QSA 混合注意力等四项升级,总参数 125B,每 token 激活 6B,训练成本约为 Qwen3.7-Plus 的 1/9,编码与办公任务能力更强。
信息来源:Qwen:Blog Retrieval(API) · Qwen
模型发布 / 更新普通
中国开源双响炮:Ox Alpha 与 Qwen3.8-Flash-Next 发布
信息来源:X:Kim (@kimmonismus) · Qwen
模型发布 / 更新普通
IBM 新 Granite 4.2 模型乘上本地 LLM 热潮
IBM 推出开源权重 Granite 4.2 模型,提供 3B、8B 和 30B 三种参数版本,原生支持 128,000-token 上下文窗口。8B 和 30B 版本经过智能体强化学习训练,支持使用终端、搜索网页或调用外部工具。IBM 称其为 Granite 系列中专注于推理的版本,旨在满足开发者对本地部署模型日益增长的兴趣。
信息来源:Ars Technica:AI(RSS)
模型发布 / 更新普通
IBM 发布开源 Granite 4.2 系列,内置智能体能力并采用 Apache 2.0 许可
IBM 发布 Granite 4.2 语言模型,提供 3B、8B 和 30B 三种尺寸,基于约 15 万亿 token 从头训练,支持最高 512,000 token 的上下文窗口,并可在"思考"与"非思考"模式间切换以控制每项任务的计算量。
信息来源:The Decoder:AI News(RSS)
模型发布 / 更新普通
Its official now: Ox Alpha is GLM(-5.3 Flash) by zAI. Offical release tonight via zAI Via Bloomberg…
信息来源:X:Kim (@kimmonismus) · GLM
模型发布 / 更新普通
智谱确认 Ox Alpha 为 GLM 系列新版本,今晚发布权重
智谱证实 Ox Alpha 模型正是其 GLM 系列新版本,将于今晚正式发布该模型权重。该匿名模型此前在 OpenRouter 上线后调用量迅速攀升至榜首,并刷新单日用量纪录;OpenCode 免费套餐声称每日可处理 100 万亿个 token。研究人员通过分词器指纹分析发现其 token 数量与 GLM-5.3 几乎完全吻合,仅存在恒定 75 个 token 的包装层偏差。
信息来源:IT之家(RSS) · GLM
模型发布 / 更新普通
阿里云 Wan 3.0 上线 Media.io 并开放 API
阿里云 Wan 3.0 正式上线 Media.io,可将一个创意或脚本生成完整 AI 故事,支持角色一致、场景连贯与电影级运镜。限时优惠 40% OFF,同时通过 Model Studio 和 Qwen Cloud 提供 API 接入。
信息来源:X:阿里云 / Alibaba Cloud (@alibaba_cloud) · Qwen
模型发布 / 更新普通
Harvey 发布自研模型 Tenet,基于 Kimi K3
OpenAI 支持的律所 AI 公司 Harvey 发布首个自研模型 Tenet,基于中国开源权重模型 Kimi K3,用约 150 块 Nvidia B300 训练两个月。
信息来源:X:X.PIN (@thexpin) · OpenAI / Kimi / NVIDIA
模型发布 / 更新普通
Ox Alpha 六天处理 42T tokens 将揭晓
6 天内处理了 42T tokens 的 Ox Alpha 继 DeepSeek Flash 56 天运行后使用最多的模型 几小时后揭晓
信息来源:X:opencode (@opencode) · DeepSeek
模型发布 / 更新普通
Qwen3.8-Flash-Next 今日发布,6B 激活参数
通义千问(Qwen)即将发布 Qwen3.8-Flash-Next,作为 Qwen4 架构的预览版,今日正式开放。据已下架的 ModelScope 页面显示,该模型采用多模态 MoE 架构,总参数约 176B(125B 主参数 + 51B N-gram 嵌入),但每 token 仅激活 6B 参数。最终 benchmark 表现值得关注。
信息来源:X:Kim (@kimmonismus) · Qwen
模型发布 / 更新普通
小鹏 G9L 首发搭载第二代 VLA 全新版本,X-Foresight 世界预测模型可推演未来 6 秒环境运动轨迹
小鹏汽车副总裁宣布,小鹏 G9L 将首发搭载第二代 VLA 全新版本,具备 30 秒有效时序,首次将记忆加入智驾决策,并通过 X-Foresight 世界预测模型推演未来 6 秒环境运动轨迹。该版本端到端响应速度提升 300%,端侧模型参数量提高 3.5 倍,为行业主流 VLA 模型的 15 倍。小鹏 G9L 已开启预售,预售价 25.98 万元起。
信息来源:IT之家(RSS)
模型发布 / 更新精选
腾讯混元将端侧翻译模型 Hy-MT2-1.8B 压缩至 440MB,已落地哔哩哔哩直播弹幕翻译
腾讯混元将端侧翻译模型 Hy-MT2-1.8B 通过 2-bit 与 1.25-bit 量化方案压缩至 574MB 和 440MB,翻译质量几乎无损,在 FLORES-200 上优于 Microsoft Translator 等商业 API。该模型已联合英特尔完成 x86 适配,并在哔哩哔哩直播弹幕实时翻译中落地,单条弹幕翻译耗时 500~800ms。
信息来源:公众号:腾讯混元
模型发布 / 更新普通
阿里云 Wan3.0 上线 OpenArt,支持更长视频生成
阿里云 Wan3.0 现已在 OpenArt 平台上线,用户可通过 Model Studio 和 Qwen Cloud 获取 API 访问。该版本支持生成更长视频,创作者 @NOSNOWISXVW 展示了从灵感构思到成片的端到端工作流,称长视频生成让叙事节奏更可控。
信息来源:X:阿里云 / Alibaba Cloud (@alibaba_cloud) · Qwen
模型发布 / 更新普通
腾讯混元回应Hy4期待:正在推进
谢谢。我们正在推进中--很快会有更多消息。
信息来源:X:腾讯混元 (@TencentHunyuan)
模型发布 / 更新普通
IBM 发布 Granite 4.2:为开放企业模型带来原生推理与智能体强化学习
IBM 发布 Granite 4.2 开源推理模型家族,提供 3B、8B、30B 三种参数规模,均支持思维链并配备思考/非思考开关,全部以 Apache 2.0 协议开源。
信息来源:MarkTechPost(RSS)
模型发布 / 更新普通
阿里云 Wan 3.0 上线 ArtArch,支持 30 秒生成
阿里云 Wan 3.0 现已上线 ArtArch,支持最长 30 秒的视频生成,主打真实感渲染、电影级动态与更强的场景一致性。用户可通过 Model Studio 和 Qwen Cloud 获取 API 接入。8 月 25 日至 9 月 7 日期间,每位用户可免费生成 100 次,且不限时长。
信息来源:X:阿里云 / Alibaba Cloud (@alibaba_cloud) · Qwen
模型发布 / 更新普通
阿里云万相3.0登陆Replicate支持30秒视频
Wan 3.0 已登陆 @replicate!🚀 原生 30 秒单镜头视频,带同步音频--现已在 Replicate 上线 ↓ 更多 API 接入: • Model Studio: https://click.alibabacloud.com/m/20000002017/ • Qwen Cloud: https://click.qwencloud.com/m/20000002025/
信息来源:X:阿里云 / Alibaba Cloud (@alibaba_cloud) · Qwen
模型发布 / 更新普通
阿里云 Wan 3.0 上线 Flaq AI,主打电影级视频生成
阿里云 Wan 3.0 现已在 @aiflaq 上线,专为电影级视觉与高质量视频生成打造。用户可通过 Model Studio 和 Qwen Cloud 获取 API 访问。Flaq AI 称其"自行车价格、法拉利性能",并用同一提示词对比 Seedance 2.5 后评价"绝对电影级完美"。
信息来源:X:阿里云 / Alibaba Cloud (@alibaba_cloud) · Qwen
模型发布 / 更新普通
阿里云 Wan 3.0 上线 OiiOii AI
阿里云 Wan 3.0 现已上线 OiiOii AI,支持更长视频生成、更强一致性和多参考输入,确保角色、场景与细节在快速动作中保持连贯流畅。API 可通过 Model Studio 和 Qwen Cloud 获取。
信息来源:X:阿里云 / Alibaba Cloud (@alibaba_cloud) · Qwen
模型发布 / 更新普通
曝 OpenAI 已预训练 Bel 模型:超 10T 参数,冲击通用人工智能
消息源 @synthwavedd 爆料称,OpenAI 已完成下一代模型 Bel 的预训练,该模型是 Doug 的直接继任者,总参数超过 10T,并计划将其打造为 GPT-6 之后的基座模型,甚至冲击 AGI 阈值。消息源认为,这些探索可能让 Anthropic 感到压力,OpenAI 认为面对即将发布的 Astra,Anthropic 没有拿得出手的应对方案,主要受算力条件所限。
信息来源:IT之家(RSS) · OpenAI / GPT / Claude
模型发布 / 更新普通
OpenAI 完成超 10T 参数"Bel"预训练
OpenAI 据报已完成代号"Bel"的下一代预训练模型,总参数超 10T,规模接近 GPT-4.5,预计成为 Astra 与 GPT-6 的基础。Anthropic 因算力受限,被认为今年内难以应对 Astra 的公开推出,但预计明年初可重回领先。
信息来源:X:Kim (@kimmonismus) · OpenAI / GPT / Claude
模型发布 / 更新普通
Skild S1 机器人基础模型:视频即提示词
Skild 发布机器人基础模型 S1,用视频演示替代语言指令来定义任务。只需提供 1 段人类视频,S1 即可直接执行长达 10 分钟的多步骤新任务,无需重新训练或微调。若规模化,基础模型训练的高昂数据成本可摊薄至数千个新任务,有望改变机器人学习的经济性。
信息来源:X:Rohan Paul (@rohanpaul_ai)
模型发布 / 更新普通
MAI-Image-2.6登顶图像编辑榜
Microsoft AI 发布 MAI-Image-2.6-Preview,在 Artificial Analysis 图像编辑排行榜登顶第一,文本生成图像位列第二(仅次于 OpenAI 的 GPT Image 2)。该模型在 19 个分类榜单中拿下 5 个第一,现已在 MAI Playground 和 Microsoft Foundry 私有预览中提供。
信息来源:X:Mustafa Suleyman(Microsoft AI CEO) (@mustafasuleyman) · OpenAI / GPT
模型发布 / 更新精选
GlucoFM:面向连续血糖监测的基础模型
Google Research 推出 GlucoFM,一款轻量级自监督 CGM 基础模型,采用双流设计分别建模缓慢血糖趋势与短期波动。在四个队列、七项临床预测任务的 14 项评估中,其 PR-AUC 较最优 GluFormer 变体平均高出 5.8 个百分点,并在 PPGR 预测中取得最低 MAE。模型在 109,066 小时无标注 CGM 数据上预训练,具备跨数据集迁移与少样本适应能力。
信息来源:Google Research:Blog(网页)
模型发布 / 更新精选
WeatherNext 预测气旋:提前五天预警五级飓风
Google AI 发布 WeatherNext 气旋预测模型,可同时预测风暴路径、强度和规模,比现有系统多提供一整天的预警时间。该模型在 2025 飓风季实战测试中,提前五天预测飓风 Melissa 在牙买加的五级登陆,系美国国家飓风中心首次实时使用 AI 模型。模型单场风暴可生成多达 1000 次模拟,代码与权重已开源。
信息来源:X:Google AI (@GoogleAI)
模型发布 / 更新普通
Qwen3.8-Flash-Next 发布引期待
谁已经等不及了?https://huggingface.co/Qwen/Qwen3.8-Flash-Next
信息来源:X:Clément Delangue(Hugging Face CEO) (@ClementDelangue) · Qwen / Hugging Face
模型发布 / 更新普通
Apodex 1.1 多 Agent 跑测:暴富案例为 0
Apodex 1.1 用 8 个并行 Agent 实测 AI 副业赚钱项目,在公开采样范围内满足 A 级证据标准的个人收入成功案例为 0,直接戳破暴富营销滤镜。该版本已开源整套多 Agent 架构(35B 权重 + 单机 harness),支持本地单机部署,并配备实时任务看板与独立审查机制。
信息来源:X:阿易 AI Notes (@AYi_AInotes) · Claude
模型发布 / 更新普通
阿里千问预告明晚开源基于下一代 Qwen4 架构的多模态 MoE 模型 Qwen3.8-Flash-Next
阿里千问将于北京时间 08 月 26 日 23:00 在魔搭社区开源 Qwen3.8-Flash-Next 及 Qwen3.8-Flash-Next-FP8 两个版本。该模型是基于下一代 Qwen4 架构构建的多模态 MoE 模型,官方提前发布架构改进,以便社区为完整 Qwen4 模型家族做好准备。
信息来源:IT之家(RSS) · Qwen
模型发布 / 更新普通
Qwen 3.8-Flash-Next 将于明天发布(125B a6B)
通义千问(Qwen)宣布 Qwen 3.8-Flash-Next 将于明天发布,该模型参数规模为 125B a6B。模型页面已上线 ModelScope 平台,引发 Hacker News 社区关注,目前获得 103 个 HN 点赞。
信息来源:Hacker News 热门(buzzing.cc 中文翻译) · Qwen
模型发布 / 更新普通
商汤 SenseNova U1.5 Lite 开源并上线 Token 计划
商汤 SenseNova U1.5 Lite 已开源并上线 Token 计划,提供免费公开测试版,每 5 小时可享 1,500 次请求。该模型支持图像生成与编辑一体化,具备参考图驱动创作、复杂指令跟随、原生 2K/4K 输出及自动提示词优化等能力。
信息来源:X:商汤 SenseTime (@SenseTime_AI)
模型发布 / 更新普通
阿里云AI Spotlight回归,Wan3.0视频生成
AI Spotlight 携 Wan3.0 回归 Wan3.0 帮你将现有素材转化为可塑、可打磨、可激活的视频。创作视频不再意味着从零开始。 即刻体验:Qwen Cloud: https://click.qwencloud.com/m/20000002025/ Model Studio: https://click.alibabacloud.com/m/20000002017/ #LetsWanIt #AlibabaCloud #Wan3 #QwenCloud #AISpo…
信息来源:X:阿里云 / Alibaba Cloud (@alibaba_cloud) · Qwen
模型发布 / 更新普通
阿里开源 Qwen3.8-Flash-Next,预览 Qwen4 架构
阿里即将开源 Qwen3.8-Flash-Next,这是一款基于下一代架构的开放权重多模态 MoE 模型,该架构将支撑即将推出的 Qwen4 系列。开发者可提前体验 Qwen4 的架构改进。有评论称 Qwen-3.8 27B 表现出色,并对 Qwen-4 27B 充满期待。
信息来源:X:Kim (@kimmonismus) · Qwen
模型发布 / 更新普通
汤森路透推出自有"前沿"模型
汤森路透发布其首个自研大语言模型Thomson,基于开源基础投入4000万美元训练,成本远低于同类前沿模型,且完全由公司自有和控制。早期评估显示Thomson在多项任务上与最新前沿模型持平,尤其在指令遵循和密集专业内容推理上提升显著。公司已向学术机构开放评估,并在Hugging Face发布"small"版本开源权重供学术与非商业使用。
信息来源:Hacker News 热门(buzzing.cc 中文翻译) · Hugging Face
模型发布 / 更新普通
阿里云 Wan3.0 演绎"破碎之心修复店"情感短片
阿里云展示创作者 @VivaReelna1 用 Wan3.0 测试版制作的"破碎之心修复店"情感短片,讲述老匠人将破碎的心一片片修复的故事。Wan3.0 测试版现已在阿里云百炼(Model Studio)和 Qwen Cloud 开放使用。
信息来源:X:阿里云 / Alibaba Cloud (@alibaba_cloud) · Qwen
模型发布 / 更新普通
阿里云 Wan3.0 展示科幻短片角色一致性
阿里云 Wan3.0 beta 上线 VivaReel,官方发布科幻短片《STILL HERE》展示其能力。该片设定于废墟世界,讲述孤独外星人与 LED 面机器人的友谊,突出角色一致性、电影级动态与情感叙事。用户可通过 Qwen Cloud 或阿里云 Model Studio 使用。
信息来源:X:阿里云 / Alibaba Cloud (@alibaba_cloud) · Qwen
模型发布 / 更新普通
汤森路透推出首个大语言模型 Thomson,基于阿里 Qwen3.5-397B 构建
汤森路透推出其首个大语言模型 Thomson,基于阿里 Qwen3.5-397B 构建,总研发投入约 4000 万美元。该模型与帝国理工学院联合重训以保障安全与政治中立,并用自有内容进一步训练。Thomson 在斯坦福 LegalBench 得分 0.823,在 Harvey 法律智能体基准上接近 Opus 4.8。
信息来源:X:X.PIN (@thexpin) · Qwen
模型发布 / 更新普通
通义万相 Wan 3.0 上线 ComfyUI,支持 30 秒视频生成
阿里云通义万相 Wan 3.0 现已上线 ComfyUI,可一次生成完整 30 秒场景,支持 480p 快速迭代至 1080p 高清输出。用户可通过 Model Studio 和 Qwen Cloud 获取更多 API 接入方式。
信息来源:X:阿里云 / Alibaba Cloud (@alibaba_cloud) · Qwen
模型发布 / 更新普通
阿里云 Wan 3.0 上线 OpenRouter
阿里云 Wan 3.0 现已上线 OpenRouter,支持文本、图像或参考素材生成 2-30 秒视频,最高 1080p。发布定价为每秒 $0.05/$0.10/$0.20,各分辨率限时 15% 折扣。用户还可通过 Model Studio 和 Qwen Cloud 获取 API 访问。
信息来源:X:阿里云 / Alibaba Cloud (@alibaba_cloud) · Qwen
模型发布 / 更新普通
通义万相3.0上线Runway支持多参考生成
Wan 3.0 现已上线 @runwayml。🚀 支持多图像、视频和音频参考输入,生成视频与音频,为每次生成带来更多控制。立即在 Runway 上体验。更多 API 接入:• Model Studio:https://click.alibabacloud.com/m/20000002017/ • Qwen Cloud:https://click.qwencloud.com/m/20000002025/
信息来源:X:阿里云 / Alibaba Cloud (@alibaba_cloud) · Qwen
模型发布 / 更新普通
阿里云 Wan 3.0 上线 Pika,支持 20 参考与 30 秒生成
阿里云 Wan 3.0 已登陆 Pika,支持最多 20 个参考、30 秒生成,并增强视觉与音频真实感。Pika API Club 提供比竞品低至 35% 的专属价格,另可通过 Model Studio 与 Qwen Cloud 接入。
信息来源:X:阿里云 / Alibaba Cloud (@alibaba_cloud) · Qwen