跳到正文
arXiv cs.CV· Yuxi Liu, Haoyu Li, Zekun Zhang, Tengxu Sun, Yixiang Cai, Jiayong Li, Yifei Xia, Tianle Liu, Baole Ai, Ang Wang, Jiamang Wang, Lin Qu, Kai Zhang, Kun Yuan, Bin Cui·· 2 小时前精选AI 评分62

SparkDiffusion:统一框架实现视觉生成最高 265 倍单 GPU 加速

SparkDiffusion: Mitigating the High-Sparsity Trap --- A Unified Framework for up to $265\times$ Single-GPU Acceleration of Visual Generation

AI 导读

arXiv 论文 SparkDiffusion 提出视觉生成加速框架,指出极端注意力稀疏下步内训练损失下降但终端生成质量停滞的“高稀疏陷阱”,并给出先适配稀疏架构、再校正终端分布的分阶段原则。

推荐理由

论文提出高稀疏陷阱并给出分阶段训练方案,读者可了解视频扩散模型在单卡上的加速路径。

来源:arXiv cs.CV · arxiv.org