产品简介
SANA-Video 2.0 是一款高效的混合视频扩散Transformer,专为在单GPU上生成720p高质量视频而设计。它通过创新的混合线性注意力与注意力残差技术,在保持线性注意力长序列优势的同时,达到了与全softmax视频DiT相媲美的生成质量。该模型提供5B和14B两种规模,采用统一架构,兼顾效率与性能。
核心功能
- 混合线性注意力:结合线性注意力与注意力残差,避免二次复杂度,支持高效长视频序列生成。
- 单GPU 720p生成:优化设计使得在单GPU上即可生成720p分辨率的高质量视频,降低硬件门槛。
- 统一架构多规模:提供5B和14B参数版本,共享统一架构,灵活适配不同计算资源与质量需求。
适合谁用
以下类型的用户会特别受益于 SANA-Video 2.0:
- 视频内容创作与快速原型设计
- 科研与教育中的视频生成实验
- 资源受限环境下的高质量视频生成
优点亮点
- 单GPU即可运行,部署成本低
- 生成质量媲美全softmax模型
- 长序列处理高效,适合高分辨率视频
价格与方案
开源模型,免费使用
总结与建议
SANA-Video 2.0 通过混合线性注意力与注意力残差技术,在单GPU上实现了720p视频的高效生成,兼顾质量与性能,适合资源受限的高质量视频生成场景。