Efficient Diffusion Training via Min-SNR Weighting Strategy

Hang, Tiankai; Gu, Shuyang; Li, Chen; Bao, Jianmin; Chen, Dong; Hu, Han; Geng, Xin; Guo, Baining

Computer Science > Computer Vision and Pattern Recognition

arXiv:2303.09556 (cs)

[Submitted on 16 Mar 2023 (v1), last revised 11 Mar 2024 (this version, v3)]

Title:Efficient Diffusion Training via Min-SNR Weighting Strategy

Authors:Tiankai Hang, Shuyang Gu, Chen Li, Jianmin Bao, Dong Chen, Han Hu, Xin Geng, Baining Guo

View PDF HTML (experimental)

Abstract:Denoising diffusion models have been a mainstream approach for image generation, however, training these models often suffers from slow convergence. In this paper, we discovered that the slow convergence is partly due to conflicting optimization directions between timesteps. To address this issue, we treat the diffusion training as a multi-task learning problem, and introduce a simple yet effective approach referred to as Min-SNR-$\gamma$. This method adapts loss weights of timesteps based on clamped signal-to-noise ratios, which effectively balances the conflicts among timesteps. Our results demonstrate a significant improvement in converging speed, 3.4$\times$ faster than previous weighting strategies. It is also more effective, achieving a new record FID score of 2.06 on the ImageNet $256\times256$ benchmark using smaller architectures than that employed in previous state-of-the-art. The code is available at this https URL.

Subjects:	Computer Vision and Pattern Recognition (cs.CV)
Cite as:	arXiv:2303.09556 [cs.CV]
	(or arXiv:2303.09556v3 [cs.CV] for this version)
	https://doi.org/10.48550/arXiv.2303.09556

Submission history

From: Tiankai Hang [view email]
[v1] Thu, 16 Mar 2023 17:59:56 UTC (19,778 KB)
[v2] Wed, 22 Mar 2023 12:55:17 UTC (19,778 KB)
[v3] Mon, 11 Mar 2024 04:01:34 UTC (9,554 KB)

Computer Science > Computer Vision and Pattern Recognition

Title:Efficient Diffusion Training via Min-SNR Weighting Strategy

Submission history

Access Paper:

References & Citations

Bookmark

Bibliographic and Citation Tools

Code, Data and Media Associated with this Article

Demos

Recommenders and Search Tools

arXivLabs: experimental projects with community collaborators

Computer Science > Computer Vision and Pattern Recognition

Title:Efficient Diffusion Training via Min-SNR Weighting Strategy

Submission history

Access Paper:

References & Citations

BibTeX formatted citation

Bookmark

Bibliographic and Citation Tools

Code, Data and Media Associated with this Article

Demos

Recommenders and Search Tools

arXivLabs: experimental projects with community collaborators