Aller au contenu principal
2025 conference-paper

Memory Efficient Quantization-Aware Fine-Tuning Diffusion Models through Implementation of L4Q in EfficientDM Framework

0Citations signalées — pas une note de qualité
1Institutions déclarées
1Pays d’affiliation déclarés

Résumé fourni par la source

Rapid evolution of large-scale machine learning models has created unprecedented demands on computational resources, particularly GPU memory, which has emerged as a critical bottleneck in both research and production environments. While recent advances in memory-efficient training techniques have shown promise in addressing efficiency concerns, the fundamental GPU memory bottleneck during training remains unresolved, limiting its applicability in resource-constrained environments and hindering exploration of efficient diffusion models for complex tasks such as image generation. This work proposes an integration of Lowrank Adaptive Learning Quantization for LLMs (L4Q) with Efficient Quantization-Aware Fine-Tuning of Low-Bit Diffusion Models (EfficientDM), a quantization-aware training framework that integrates the immediate gradient flushing mechanism with the temporal calibration strategy. The integration aims to make efficient diffusion model training accessible to researchers with limited computational resources and democratize access to state-of-the-art generative modeling capabilities, enabling broader exploration of diffusion models across diverse application domains. Our experiments demonstrate that this integration yields substantial improvements in both training efficiency and generative quality. Specifically, the proposed method achieves a speed increase of 1.38x in training time, a reduction of 37% in GPU memory usage peak, while also improving FID by 9-19 points. Code is accessible at https://github.com/FirH/L4Q-on-EfficientDM

Ce résumé expose les affirmations des auteurs. BNTIC ne l’interprète pas comme une validation indépendante des résultats.

Contrôle bibliographique ouvert

DOI retrouvé dans Crossref DOI retrouvé ; titre concordant.

Titre Crossref
Memory Efficient Quantization-Aware Fine-Tuning Diffusion Models through Implementation of L4Q in EfficientDM Framework
Date Crossref
20/09/2025
Éditeur
IEEE
Type
proceedings-article

Ce recoupement confirme des métadonnées liées au DOI. Il ne confirme ni la méthode ni les conclusions de l’étude et ne compte pas comme une seconde source scientifique indépendante.

Institutions déclarées

Une affiliation ne permet pas de déduire la nationalité d’un auteur.

Sujets associés

Generative Adversarial Networks and Image SynthesisAdvanced Neuroimaging Techniques and ApplicationsStochastic Gradient Optimization Techniques

BNTIC News n’est pas le producteur de ces données. Recherche à la demande dans Crossref et Europe PMC, sans clé ; OpenAlex reste optionnel. Aucun service payant requis, aucune réponse conservée. Sources et limites.