Accurate Compression of Text-to-Image Diffusion Models via Vector Quantization
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Egiazarian, Vage, Kuznedelev, Denis, Voronov, Anton, Svirschevski, Ruslan, Goin, Michael, Pavlov, Daniil, Alistarh, Dan, Baranchuk, Dmitry |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Switti: Designing Scale-Wise Transformers for Text-to-Image Synthesis
par: Voronov, Anton, et autres
Publié: (2024)
par: Voronov, Anton, et autres
Publié: (2024)
Extreme Compression of Large Language Models via Additive Quantization
par: Egiazarian, Vage, et autres
Publié: (2024)
par: Egiazarian, Vage, et autres
Publié: (2024)
Cache Me If You Must: Adaptive Key-Value Quantization for Large Language Models
par: Shutova, Alina, et autres
Publié: (2025)
par: Shutova, Alina, et autres
Publié: (2025)
EvoPress: Accurate Dynamic Model Compression via Evolutionary Search
par: Sieberling, Oliver, et autres
Publié: (2024)
par: Sieberling, Oliver, et autres
Publié: (2024)
Scale-wise Distillation of Diffusion Models
par: Starodubcev, Nikita, et autres
Publié: (2025)
par: Starodubcev, Nikita, et autres
Publié: (2025)
Hogwild! Inference: Parallel LLM Generation via Concurrent Attention
par: Rodionov, Gleb, et autres
Publié: (2025)
par: Rodionov, Gleb, et autres
Publié: (2025)
Does Diffusion Beat GAN in Image Super Resolution?
par: Kuznedelev, Denis, et autres
Publié: (2024)
par: Kuznedelev, Denis, et autres
Publié: (2024)
WUSH: Near-Optimal Adaptive Transforms for LLM Quantization
par: Chen, Jiale, et autres
Publié: (2025)
par: Chen, Jiale, et autres
Publié: (2025)
AutoJudge: Judge Decoding Without Manual Annotation
par: Garipov, Roman, et autres
Publié: (2025)
par: Garipov, Roman, et autres
Publié: (2025)
Grid Games: The Power of Multiple Grids for Quantizing Large Language Models
par: Egiazarian, Vage, et autres
Publié: (2026)
par: Egiazarian, Vage, et autres
Publié: (2026)
Bridging the Gap Between Promise and Performance for Microscaling FP4 Quantization
par: Egiazarian, Vage, et autres
Publié: (2025)
par: Egiazarian, Vage, et autres
Publié: (2025)
Unified Scaling Laws for Compressed Representations
par: Panferov, Andrei, et autres
Publié: (2025)
par: Panferov, Andrei, et autres
Publié: (2025)
MADrive: Memory-Augmented Driving Scene Modeling
par: Karpikova, Polina, et autres
Publié: (2025)
par: Karpikova, Polina, et autres
Publié: (2025)
Label Privacy in Split Learning for Large Models with Parameter-Efficient Training
par: Zmushko, Philip, et autres
Publié: (2024)
par: Zmushko, Philip, et autres
Publié: (2024)
CasTex: Cascaded Text-to-Texture Synthesis via Explicit Texture Maps and Physically-Based Shading
par: Aliev, Mishan, et autres
Publié: (2025)
par: Aliev, Mishan, et autres
Publié: (2025)
Rethinking Global Text Conditioning in Diffusion Transformers
par: Starodubcev, Nikita, et autres
Publié: (2026)
par: Starodubcev, Nikita, et autres
Publié: (2026)
Invertible Consistency Distillation for Text-Guided Image Editing in Around 7 Steps
par: Starodubcev, Nikita, et autres
Publié: (2024)
par: Starodubcev, Nikita, et autres
Publié: (2024)
Your Student is Better Than Expected: Adaptive Teacher-Student Collaboration for Text-Conditional Diffusion Models
par: Starodubcev, Nikita, et autres
Publié: (2023)
par: Starodubcev, Nikita, et autres
Publié: (2023)
Alchemist: Turning Public Text-to-Image Data into Generative Gold
par: Startsev, Valerii, et autres
Publié: (2025)
par: Startsev, Valerii, et autres
Publié: (2025)
Revisiting Autoregressive Models for Generative Image Classification
par: Sudakov, Ilia, et autres
Publié: (2026)
par: Sudakov, Ilia, et autres
Publié: (2026)
PV-Tuning: Beyond Straight-Through Estimation for Extreme LLM Compression
par: Malinovskii, Vladimir, et autres
Publié: (2024)
par: Malinovskii, Vladimir, et autres
Publié: (2024)
Inverse Bridge Matching Distillation
par: Gushchin, Nikita, et autres
Publié: (2025)
par: Gushchin, Nikita, et autres
Publié: (2025)
MatGPTQ: Accurate and Efficient Post-Training Matryoshka Quantization
par: Kleinegger, Maximilian, et autres
Publié: (2026)
par: Kleinegger, Maximilian, et autres
Publié: (2026)
Registers Matter for Pixel-Space Diffusion Transformers
par: Starodubcev, Nikita, et autres
Publié: (2026)
par: Starodubcev, Nikita, et autres
Publié: (2026)
Model Compression with Exact Budget Constraints via Riemannian Manifolds
par: Helcig, Michael, et autres
Publié: (2026)
par: Helcig, Michael, et autres
Publié: (2026)
The Iterative Optimal Brain Surgeon: Faster Sparse Recovery by Leveraging Second-Order Information
par: Wu, Diyuan, et autres
Publié: (2024)
par: Wu, Diyuan, et autres
Publié: (2024)
Differentiable Vector Quantization for Rate-Distortion Optimization of Generative Image Compression
par: Jiang, Shiyin, et autres
Publié: (2026)
par: Jiang, Shiyin, et autres
Publié: (2026)
ProGIC: Progressive and Lightweight Generative Image Compression with Residual Vector Quantization
par: Cao, Hao, et autres
Publié: (2026)
par: Cao, Hao, et autres
Publié: (2026)
Vector-Quantized Soft Label Compression for Dataset Distillation
par: Abbasi, Ali, et autres
Publié: (2026)
par: Abbasi, Ali, et autres
Publié: (2026)
Learning Optimal Lattice Vector Quantizers for End-to-end Neural Image Compression
par: Zhang, Xi, et autres
Publié: (2024)
par: Zhang, Xi, et autres
Publié: (2024)
Ranni: Taming Text-to-Image Diffusion for Accurate Instruction Following
par: Feng, Yutong, et autres
Publié: (2023)
par: Feng, Yutong, et autres
Publié: (2023)
Compression Scaling Laws:Unifying Sparsity and Quantization
par: Frantar, Elias, et autres
Publié: (2025)
par: Frantar, Elias, et autres
Publié: (2025)
DilateQuant: Accurate and Efficient Diffusion Quantization via Weight Dilation
par: Liu, Xuewen, et autres
Publié: (2024)
par: Liu, Xuewen, et autres
Publié: (2024)
ViDiT-Q: Efficient and Accurate Quantization of Diffusion Transformers for Image and Video Generation
par: Zhao, Tianchen, et autres
Publié: (2024)
par: Zhao, Tianchen, et autres
Publié: (2024)
Towards Accurate Post-training Quantization for Diffusion Models
par: Wang, Changyuan, et autres
Publié: (2023)
par: Wang, Changyuan, et autres
Publié: (2023)
Translation of Text Embedding via Delta Vector to Suppress Strongly Entangled Content in Text-to-Image Diffusion Models
par: Koh, Eunseo, et autres
Publié: (2025)
par: Koh, Eunseo, et autres
Publié: (2025)
Statistically-Lossless Quantization of Large Language Models
par: Helcig, Michael, et autres
Publié: (2026)
par: Helcig, Michael, et autres
Publié: (2026)
Hierarchical Vector-Quantized Latents for Perceptual Low-Resolution Video Compression
par: Kotthapalli, Manikanta, et autres
Publié: (2025)
par: Kotthapalli, Manikanta, et autres
Publié: (2025)
Error Feedback Can Accurately Compress Preconditioners
par: Modoranu, Ionut-Vlad, et autres
Publié: (2023)
par: Modoranu, Ionut-Vlad, et autres
Publié: (2023)
CAGE: Curvature-Aware Gradient Estimation For Accurate Quantization-Aware Training
par: Tabesh, Soroush, et autres
Publié: (2025)
par: Tabesh, Soroush, et autres
Publié: (2025)
Documents similaires
-
Switti: Designing Scale-Wise Transformers for Text-to-Image Synthesis
par: Voronov, Anton, et autres
Publié: (2024) -
Extreme Compression of Large Language Models via Additive Quantization
par: Egiazarian, Vage, et autres
Publié: (2024) -
Cache Me If You Must: Adaptive Key-Value Quantization for Large Language Models
par: Shutova, Alina, et autres
Publié: (2025) -
EvoPress: Accurate Dynamic Model Compression via Evolutionary Search
par: Sieberling, Oliver, et autres
Publié: (2024) -
Scale-wise Distillation of Diffusion Models
par: Starodubcev, Nikita, et autres
Publié: (2025)