AI圈报
论文研究普通

Kandinsky 6.0 Video 发布:同步音视频生成的开源基础模型

信息来源:HuggingFace Daily Papers(社区热门论文)·
原始标题:Kandinsky 6.0 Video: Foundation Models for Synchronized Video and Audio Generation

内容摘要

Kandinsky 6.0 Video 发布,包含 3B 的 Lite 和 29B 的 Pro 两个基础扩散模型,支持文生音视频(T2AV)和图生音视频(I2AV),可生成 5 秒带 44 kHz 同步音频(含唇同步)的视频,经内置超分模型提升至 Full-HD(1920×1080)。
内容分类AI 论文与研究
内容层级普通情报
发布时间(北京时间)
本站收录时间(北京时间)
信息来源HuggingFace Daily Papers(社区热门论文)
站内情报编号intel-a1894664d774580104f6c3dd