SparsePR:面向视频生成和世界模型的免训练稀疏注意力
SparsePR是一种无需额外训练即可加速视频Transformer和世界模型注意力计算的方法。它将响应耦合分区与探针拟合的残差重建相结合,通过少量精确计算的查询行校正稀疏输出。在四个不同的视频生成和世界模型上测试时,SparsePR均降低了注意力重建误差。在实际执行配对密度为22.0%至26.0%的情况下,该方法保持了生成质量,并实现了1.48至2.61倍的端到端加速。
本文来源:Hugging Face,仅供学习参考,版权归原作者所有。