关键功能

面向最高 720p 输出的高效视频生成模型。
使用 Hybrid Linear-Softmax Attention 降低二次注意力成本。
加入 Attention Residuals,在网络深度方向复用 softmax 锚点特征。
提供 5B 和 14B 两种模型规模说明。
报告了较低 H100 延迟下的强劲 VBench 表现。
使用 Sol-Engine 进一步加速推理。
链接到 NVIDIA 的 Sana GitHub 仓库和 arXiv 论文。
面向可扩展的长视频与高分辨率视频生成。

该模型使用 Hybrid Linear-Softmax Attention,并通过周期性 softmax 锚点和 Block Attention Residuals 在保持长序列计算高效的同时恢复表达能力。它提供 5B 和 14B 两种规模,并结合 Sol-Engine 在 H100 硬件上实现更快推理。


SANA-Video 2.0 适合视频生成研究者、基础设施团队以及寻求高效高分辨率生成的开发者。其架构展示了如何通过精心设计的注意力机制和系统优化,在不明显牺牲质量的前提下降低视频扩散延迟。

在您的网站添加此徽章,以获得更多点赞并登上搜索结果顶部!

嵌入按钮预览 - 浅色主题
嵌入按钮预览 - 深色主题

Subscribe to the AI Search Newsletter

Get top updates in AI to your inbox every weekend. It's free!