模型发布 / 更新精选
SANA-Video 2.0:混合线性注意力与注意力残差实现高效视频生成
原始标题:SANA-Video 2.0: Hybrid Linear Attention with Attention Residuals for Efficient Video Generation
内容摘要
SANA-Video 2.0 是一个混合视频扩散 Transformer,提供 5B 和 14B 两种规模,可在单 GPU 上生成最高 720p 视频。其 Hybrid Linear-Softmax Attention 以 3:1 比例混合线性与 softmax 注意力,配合 Block Attention Residuals 将深层有效秩提升约 12%。
内容分类AI 模型发布与更新
内容层级精选情报
发布时间(北京时间)
本站收录时间(北京时间)
信息来源HuggingFace Daily Papers(社区热门论文)
站内情报编号intel-e65355f40a9d41ee7c3f8933