AI 模型发布与更新
追踪 OpenAI、DeepSeek、Qwen、Claude、Gemini、GLM、Grok 等大模型的发布、能力升级、开源权重与 API 变化。
分类文章922
当前页6 / 24
持续更新永久归档
分类文章
按发布时间从新到旧 · 每页 40 条
模型发布 / 更新普通
阿里云 Wan 3.0 上线 Pika,支持 20 参考与 30 秒生成
阿里云 Wan 3.0 已登陆 Pika,支持最多 20 个参考、30 秒生成,并增强视觉与音频真实感。Pika API Club 提供比竞品低至 35% 的专属价格,另可通过 Model Studio 与 Qwen Cloud 接入。
信息来源:X:阿里云 / Alibaba Cloud (@alibaba_cloud) · Qwen
模型发布 / 更新普通
阿里云 Wan 3.0 上线 OpenArt,原生 30 秒生成
阿里云 Wan 3.0 现已在 OpenArt 上线,支持单次原生 30 秒视频生成,无需拼接,并保持角色、动作与光影一致,输出最高 1080p。用户可通过 Model Studio 与 Qwen Cloud 获取 API 接入。OpenArt 本周(8 月 24-31 日)升级 Pro 或 Wonder 套餐可无限次生成。
信息来源:X:阿里云 / Alibaba Cloud (@alibaba_cloud) · Qwen
模型发布 / 更新普通
阿里云 Wan 3.0 上线 Picsart 支持 30 秒视频
阿里云 Wan 3.0 正式上线 Picsart,支持原生 30 秒视频生成、同步音频及最多 20 个参考输入,确保跨镜头角色与细节一致。用户可先在 480p 下草稿,最终输出全质量版本,适合产品视频、广告概念等场景。API 已通过 Model Studio 和 Qwen Cloud 开放。
信息来源:X:阿里云 / Alibaba Cloud (@alibaba_cloud) · Qwen
模型发布 / 更新普通
阿里云 Wan 3.0 上线 Flick,支持 30 秒生成
阿里云 Wan 3.0 现已上线 @flickartHQ,支持最长 30 秒的视频生成,为每段镜头带来更多时间与创作自由。Flick 作为早期内测方,使用 Wan 3.0 制作了官方预告片《PHANOS》,称其具备行业领先质量与极具竞争力的定价。API 可通过 Model Studio 和 Qwen Cloud 获取。
信息来源:X:阿里云 / Alibaba Cloud (@alibaba_cloud) · Qwen
模型发布 / 更新普通
阿里云 Wan3.0 发布,视频生成质量飞跃
阿里云发布 Wan3.0 视频生成模型,被评测者评价为"质量持续高水准,而非偶发",相较 Wan2.7 堪称全新模型。该模型支持文生视频(T2V)、图生视频(I2V)和参考生视频(R2V),现已上线 fal 平台,并提供 Model Studio 和 Qwen Cloud 的 API 访问。
信息来源:X:阿里云 / Alibaba Cloud (@alibaba_cloud) · Qwen
模型发布 / 更新普通
Apodex 1.1 发布:Agent Team 拆解复杂研究
Apodex 1.1 模型家族发布,主打异步 Agent Team 功能,可并行协调多智能体拆解复杂任务并持续整合结果。同步开源 FrontierAgent 本地研究工具台及 Apodex 1.1 mini 开放权重模型,后者支持本地运行复杂工作。
信息来源:X:karminski (@karminski3)
模型发布 / 更新普通
通义万相 Wan 3.0 上线 Pixmax,限时 7 折
阿里云通义万相 Wan 3.0 已上线 AI 创作平台 Pixmax,主打电影级画质输出。新版本支持任意艺术风格下的视觉一致性、物理真实的流畅运动,以及多模态与混合现实编辑能力。即日起至 8 月 24 日,Pixmax 用户可享 30% 折扣;开发者还可通过 Model Studio 与 Qwen Cloud 获取 API 接入。
信息来源:X:阿里云 / Alibaba Cloud (@alibaba_cloud) · Qwen
模型发布 / 更新普通
小鹏第二代 VLA 首次重大升级:响应速度提升 3 倍,G9L 全球首发搭载
小鹏汽车宣布第二代 VLA 630 版首次重大升级,端侧模型参数量提高 3.5 倍,为行业主流 VLA 模型的 15 倍;端到端响应速度提升 300%。小鹏 G9L 将全球首发搭载第二代 VLA 全新版本,体验日活动定于 8 月 27 日举行。
信息来源:IT之家(RSS)
模型发布 / 更新普通
WeMM-Embedding:微信多模态嵌入技术报告
微信发布WeMM-Embedding通用多模态嵌入模型系列,支持文本、图像、视频、视觉文档及任意交错多模态输入,提供2B、4B、9B三种参数规模。其中2B版本已在MMEB-v2上超越此前领先的8B开源基线,9B版本以80.6总分创下新SOTA。该系列已在微信视频号、公众号、朋友圈及电商等推荐与搜索场景大规模部署,模型权重与代码已开源。
信息来源:HuggingFace Daily Papers(社区热门论文) · Hugging Face
模型发布 / 更新普通
Fastino 发布 GLiNER2.5:以边界预测取代跨度枚举的信息抽取架构
Fastino 发布 GLiNER2.5,以边界预测取代跨度枚举,移除最大实体宽度限制,支持 4096 词上下文,计算量随序列长度线性增长。多语言检查点在 16 个零样本基准上整体 macro F1 达 56.17(GLiNER2 为 56.09),XNLI 提升 24.75 分。
信息来源:MarkTechPost(RSS)
模型发布 / 更新普通
Grok Voice Think Fast 2.0登顶语音指数榜首
Grok Voice Think Fast 2.0 现已在 Artificial Analysis 语音到语音指数中排名第一。 该指数衡量语音智能体能否对所听到的语音进行推理、解决真实客户问题,并使用智能体工具正确完成任务。
信息来源:X:SpaceXAI (@SpaceXAI) · Grok
模型发布 / 更新普通
Ox Alpha 大更新引期待
Ox Alpha 似乎已经收到了一次重大更新。 你无法想象我对正式发布和模型技术细节有多期待。
信息来源:X:Kim (@kimmonismus)
模型发布 / 更新普通
微软 Skala 1.1 更新提升计算化学精度
Skala 1.1,微软研究院更新的深度学习交换关联泛函,提供了更高的精度、在计算化学生态系统中更广泛的可及性,以及一个用于跟踪计算性能的动态基准。https://msft.it/6011aOXe5
信息来源:X:Microsoft Research (@MSFTResearch)
模型发布 / 更新普通
Apodex 1.1 发布,扩展复杂工作智能体能力
恭喜 @Apodex_AI 的出色工作! Apodex 1.1:扩展面向复杂工作的智能体智能
信息来源:X:马东锡 NLP (@dongxi_nlp)
模型发布 / 更新普通
阿里 Wan3.0 视频生成模型开放测试,支持文本、图片、文档生成最长 30 秒视频
阿里巴巴视频生成模型 Wan3.0 现已开放测试,可基于文本、PDF、网页和 PowerPoint 输入生成最长 30 秒的视频,时长较前代 Wan2.5 翻倍。
信息来源:The Decoder:AI News(RSS)
模型发布 / 更新普通
Ox Alpha 日处理量将达近 6 万亿 token
Ox Alpha 今日处理量有望接近 6 万亿 token。 现在即可通过 ori 在你的编码智能体中使用:$ ori 【你喜欢的 harness】 --model stealth/ox-alpha
信息来源:X:OpenRouter (@OpenRouter)
模型发布 / 更新普通
Ox Alpha 登顶 OpenRouter 且免费可用
这是个很棒的模型。我用它搭配 Pi 玩得很开心。 你可以在我们的 harness 游乐场免费测试 Ox Alpha 搭配 Pi 或 Hermes Agent:https://academy.dair.ai/dashboard/playground
信息来源:X:Elvis Saravia (@omarsar0, DAIR.AI)
模型发布 / 更新普通
GEN-1.5 缩短物理提示到机器人行为时间
我们缩短了从物理提示到机器人行为所需的时间。 任何人教会机器人新技能的速度越快,规模化物理工作就越容易。 更多关于 GEN-1.5 的内容,请阅读下方评论中的博客文章。
信息来源:X:Generalist (@GeneralistAI)
模型发布 / 更新普通
Generalist AI 发布 GEN-1.5:一个从 3-12 秒演示中学会新任务的机器人基础模型
Generalist AI 发布机器人基础模型 GEN-1.5,将 3-12 秒的传感器运动数据放入 30 秒上下文窗口即可执行任务,无需梯度更新或微调。在 10 项操作任务中,单次上下文提示平均成功率达 59%(±10%),每任务用 5 分钟数据做 10 步梯度更新后提升至 83%(±9%)。该能力并非显式训练,而是从超八个月预训练中涌现;目前无公开权重、API 或定价,属研究发布。
信息来源:MarkTechPost(RSS)
模型发布 / 更新普通
LongCat-2.0 登陆 Go,开源 1M 上下文
LongCat-2.0 刚刚在 @opencode 上以 Go 语言版本发布 🐱 试试看,告诉我们你用它构建了什么! 1.6T/48B · 1M 上下文 · 完全开源
信息来源:X:美团 LongCat (@Meituan_LongCat)
模型发布 / 更新普通
路透社母公司汤森路透花 4000 万美元研发 AI 模型,基于阿里千问
汤森路透发布首款大语言模型Thomson,基于阿里千问Qwen3.5-397B构建,研发成本约4000万美元,外界流传的45万美元仅为最后一次训练成本。该模型在Stanford LegalBench得分0.823,落后于Gemini 3.1 Pro和GPT-5.5。汤森路透称不采用闭源模型是因外部模型长期成本较高且无法高自由度调整。
信息来源:IT之家(RSS) · GPT / Qwen / Gemini
模型发布 / 更新普通
LongCat-2.0 开源 Go 版发布
LongCat-2.0 现已在 Go 中可用 1.6T/48B · 1M 上下文窗口 · 完全开源
信息来源:X:opencode (@opencode)
模型发布 / 更新普通
dots3-note 预览版:面向长期任务的开放权重多模态模型
当一项任务持续数小时甚至数周,且外部世界不断变化时,AI 需要具备什么才能保持有用? 目标会演变。新的约束会出现。计划会失败。 认识一下 dots3-note 预览版,这是由 rednote 的 dots 工作室 @dotsstudioai 开发的开放权重多模态模型,面向现实生活中的长期任务自主性。 - 总计 280B / 激活 16B 参数 - 512K 上下文窗口 - 文本、视觉和语音理解 以下介绍它如何学习、自我评估并随时间适应。🧵
信息来源:X:Rohan Paul (@rohanpaul_ai)
模型发布 / 更新普通
Qwen 4 现身测试,多款新模型将至
好戏还在后头:显然还有一个新 Qwen 模型--Qwen 4--已经在测试中了。 所以现在我们有: - 新 Claude 模型(可能是 Opus 5.1 和 Haiku) - Ox Alpha(可能是 GLM-5.3 Flash) - Qwen 4(?) 都已在测试中或被目击。 + GPT Astra 已确认。 没错,接下来几周会很有趣。
信息来源:X:Kim (@kimmonismus) · GPT / Qwen / Claude
模型发布 / 更新普通
Thomson Reuters 斥资 4000 万美元自研法律大模型"Thomson"
Thomson Reuters 基于阿里 Qwen 推出自研法律大模型"Thomson",投入约 4000 万美元,训练数据来自 Westlaw 等自有内容。在 Stanford LegalBench 上 Thomson(0.823)落后于 Gemini 3.1 Pro 和 GPT-5.5,仅在接入独家内容时以 0.83 对 0.82 微弱胜过 GPT 5.4。
信息来源:The Decoder:AI News(RSS) · OpenAI / GPT / Qwen
模型发布 / 更新精选
GPT-5.6 登陆 Kiro,为开发者提升性价比
GPT-5.6 模型家族现已登陆软件开发智能体 Kiro,包含 Sol、Terra 和 Luna 三款模型。在 Terminal-Bench 2.1 测试中,GPT-5.6 Terra 在 Kiro 内完成任务成本降低约 82%。该更新由 OpenAI 与 AWS 合作优化,旨在以更少迭代和更高 token 价值帮助开发者产出更高质量的代码。
信息来源:OpenAI:官网动态(RSS · 排除企业/客户案例) · OpenAI / GPT
模型发布 / 更新普通
PixVerse R2 世界模型如何实现互动影游:实时响应、记忆与长程稳定
PixVerse 发布世界模型 R2,在 R1 连续可交互视频流基础上,支持用户实时输入影响后续场景、故事、角色与关系,并新增 World、Story、Character 三类应用方向。
信息来源:公众号:卡尔的AI沃茨
模型发布 / 更新普通
通义万相3.0上线Leonardo AI平台
Wan 3.0 现已登陆 @LeonardoAi!更清晰。更可控。更强大。现已在 Leonardo 上线。更多 API 接入: • Model Studio: https://click.alibabacloud.com/m/20000002017/ • Qwen Cloud: https://click.qwencloud.com/m/20000002025/
信息来源:X:阿里云 / Alibaba Cloud (@alibaba_cloud) · Qwen
模型发布 / 更新普通
通义万相 Wan 3.0 上线 RunningHub
阿里云通义万相 Wan 3.0 已在 RunningHub 上线,支持原生 30 秒视频生成、多模态参考输入和更强的时序一致性。用户可通过 Web UI 和 API 使用,并可通过 Model Studio 与 Qwen Cloud 获取更多 API 接入。
信息来源:X:阿里云 / Alibaba Cloud (@alibaba_cloud) · Qwen
模型发布 / 更新普通
阿里云 Wan 3.0 上线 Scenario,支持 30 秒视频生成
阿里云 Wan 3.0 视频模型上线 Scenario 平台,支持一次生成最长 30 秒片段、原生同步音频及多模态输入(首帧、尾帧、参考图、视频、音频、文档和 URL),并配备面向复杂输入的思考模式。开发者现可通过 Model Studio 和 Qwen Cloud 获取 API 接入。
信息来源:X:阿里云 / Alibaba Cloud (@alibaba_cloud) · Qwen
模型发布 / 更新普通
万相3.0上线SeaArt,支持多模态输入
Wan 3.0 现已上线 @SeaArt_Ai!🚀 更多输入。更多控制。更多创作可能。用 Wan 3.0 创作。📷✨ 更多 API 接入: • Model Studio: https://click.alibabacloud.com/m/20000002017/ • Qwen Cloud: https://click.qwencloud.com/m/20000002025/
信息来源:X:阿里云 / Alibaba Cloud (@alibaba_cloud) · Qwen
模型发布 / 更新普通
世界模型混战 7 个月,PixVerse 打出第二张牌
PixVerse 在混战 7 个月后推出第二张牌,新功能支持召唤老虎、伪装成巡逻兵、与三星堆青铜器用四川话对话等场景。该更新延续了其在世界模型领域的竞争布局,具体模型版本、参数规模及可用性细节原文未披露。
信息来源:elsewhere:文章(RSS)
模型发布 / 更新普通
阿里云 Wan 3.0 上线 Runware D0
阿里云 Wan 3.0 现已在 Runware D0 上线,支持文生视频、帧与参考模式,可生成 30 秒片段,并支持多达 10 张参考图、5 段参考视频和 5 段参考音频输入,配备复杂多输入提示的思考模式。更多 API 访问可通过 Model Studio 和 Qwen Cloud 获取。
信息来源:X:阿里云 / Alibaba Cloud (@alibaba_cloud) · Qwen
模型发布 / 更新普通
阿里云 Wan3.0 上线 NadouPro,支持 30 秒原生视频
阿里云 Wan3.0 已上线 NadouPro,升级视频生成的长度、多模态参考与真实感,并开放 Model Studio 与 Qwen Cloud 的 API 接入。新版本支持原生 30 秒视频生成、现实级渲染,以及 Omni-Reference 多模态参考,除文本、图像、音频、视频外,还可输入文档、表格、幻灯片和网页等。
信息来源:X:阿里云 / Alibaba Cloud (@alibaba_cloud) · Qwen
模型发布 / 更新普通
阿里云 Wan3.0 上线 Segmind,原生生成 30 秒视频
阿里云 Wan3.0 视频生成模型已在 Segmind 平台上线,支持单次生成 2 至 30 秒视频,无需拼接。该模型具备 Omni-Reference 多模态参考能力,可输入文本、图像、音频、视频及文档等素材,并支持最高 1080p 分辨率与精细面部渲染。用户可通过 PixelFlow 或 API 调用,也可在 Model Studio 和 Qwen Cloud 获取更多访问权限。
信息来源:X:阿里云 / Alibaba Cloud (@alibaba_cloud) · Qwen
模型发布 / 更新普通
阿里云 Wan 3.0 正式发布,原生 30 秒视频生成
阿里云 Wan 3.0 在 SousakuAI 正式发布,支持原生 30 秒长视频生成,具备高一致性与高真实感,并支持从文档和网页生成视频。发布期间 Wan 系列限时 50% OFF,生成速度与等待时间也进一步优化。API 已上线 Model Studio 与 Qwen Cloud。
信息来源:X:阿里云 / Alibaba Cloud (@alibaba_cloud) · Qwen
模型发布 / 更新普通
通义万相 Wan 3.0 上线 FlovaAI 限时优惠
阿里云 Wan 3.0 视频生成模型正式上线 FlovaAI,480P 版本限时低至 $0.013/秒。该版本支持音画同步与自然节奏过渡,带来更沉浸的内容呈现。用户还可通过 Model Studio 和 Qwen Cloud 获取 API 访问。
信息来源:X:阿里云 / Alibaba Cloud (@alibaba_cloud) · Qwen
模型发布 / 更新普通
阿里云Wan3.0上线Magnific支持多模态生成
Wan3.0 现已上线 @magnific。输入文本、图片、网页内容--输出 30 秒电影感视频。更多 API 接入: • Model Studio: https://click.alibabacloud.com/m/20000002017/ • Qwen Cloud: https://click.qwencloud.com/m/20000002025/
信息来源:X:阿里云 / Alibaba Cloud (@alibaba_cloud) · Qwen
模型发布 / 更新普通
阿里云 Wan3.0 上线 TapNow,支持多格式参考
阿里云 Wan3.0 多模态视频生成模型上线 TapNow,支持一次生成最长 30 秒视频,并接受多种参考格式输入。模型在场景中保持运动、光照和物理细节的一致性,现可通过 Model Studio 和 Qwen Cloud 获取 API 访问。
信息来源:X:阿里云 / Alibaba Cloud (@alibaba_cloud) · Qwen
模型发布 / 更新普通
阿里云 Wan3.0 上线 fal,单次生成 30 秒视频
阿里云 Wan3.0 已上线 fal 平台,单次生成原生 30 秒视频,无需拼接。支持文本、图像、音频、视频、网页和文档等多模态输入,并提升真实世界运动渲染效果。更多 API 接入可通过 Model Studio 和 Qwen Cloud 获取。
信息来源:X:阿里云 / Alibaba Cloud (@alibaba_cloud) · Qwen