AI圈报
模型发布 / 更新精选

SANA-Video 2.0:混合线性注意力与注意力残差实现高效视频生成

信息来源:HuggingFace Daily Papers(社区热门论文)·
原始标题:SANA-Video 2.0: Hybrid Linear Attention with Attention Residuals for Efficient Video Generation

内容摘要

SANA-Video 2.0 是一个混合视频扩散 Transformer,提供 5B 和 14B 两种规模,可在单 GPU 上生成最高 720p 视频。其 Hybrid Linear-Softmax Attention 以 3:1 比例混合线性与 softmax 注意力,配合 Block Attention Residuals 将深层有效秩提升约 12%。
内容层级精选情报
发布时间(北京时间)
本站收录时间(北京时间)
信息来源HuggingFace Daily Papers(社区热门论文)
站内情报编号intel-e65355f40a9d41ee7c3f8933