SANA-Video 2.0:结合线性注意力的高效视频生成模型
5B/14B规模的混合视频扩散Transformer,在单GPU上生成720p高质量视频,通过混合线性-Softmax注意力以3:1比例平衡线性复杂度和全秩token交互。
查看原文解读生成中或暂时不可用,请稍后刷新重试,或直接查看原文。
5B/14B规模的混合视频扩散Transformer,在单GPU上生成720p高质量视频,通过混合线性-Softmax注意力以3:1比例平衡线性复杂度和全秩token交互。
查看原文