QuEST: Low-bit Diffusion Model Quantization via Efficient Selective Finetuning
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Wang, Haoxuan, Shang, Yuzhang, Yuan, Zhihang, Wu, Junyi, Yan, Junchi, Yan, Yan |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2024
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
PTQ4DiT: Post-training Quantization for Diffusion Transformers
von: Wu, Junyi, et al.
Veröffentlicht: (2024)
von: Wu, Junyi, et al.
Veröffentlicht: (2024)
Efficient Multimodal Dataset Distillation via Generative Models
von: Zhao, Zhenghao, et al.
Veröffentlicht: (2025)
von: Zhao, Zhenghao, et al.
Veröffentlicht: (2025)
Dataset Quantization with Active Learning based Adaptive Sampling
von: Zhao, Zhenghao, et al.
Veröffentlicht: (2024)
von: Zhao, Zhenghao, et al.
Veröffentlicht: (2024)
CaO$_2$: Rectifying Inconsistencies in Diffusion-Based Dataset Distillation
von: Wang, Haoxuan, et al.
Veröffentlicht: (2025)
von: Wang, Haoxuan, et al.
Veröffentlicht: (2025)
Distill Video Datasets into Images
von: Zhao, Zhenghao, et al.
Veröffentlicht: (2025)
von: Zhao, Zhenghao, et al.
Veröffentlicht: (2025)
E-CAR: Efficient Continuous Autoregressive Image Generation via Multistage Modeling
von: Yuan, Zhihang, et al.
Veröffentlicht: (2024)
von: Yuan, Zhihang, et al.
Veröffentlicht: (2024)
VGDFR: Diffusion-based Video Generation with Dynamic Latent Frame Rate
von: Yuan, Zhihang, et al.
Veröffentlicht: (2025)
von: Yuan, Zhihang, et al.
Veröffentlicht: (2025)
Efficient Multitask Dense Predictor via Binarization
von: Shang, Yuzhang, et al.
Veröffentlicht: (2024)
von: Shang, Yuzhang, et al.
Veröffentlicht: (2024)
FBPT: A Fully Binary Point Transformer
von: Hou, Zhixing, et al.
Veröffentlicht: (2024)
von: Hou, Zhixing, et al.
Veröffentlicht: (2024)
Supplementing Missing Visions via Dialog for Scene Graph Generations
von: Zhao, Zhenghao, et al.
Veröffentlicht: (2022)
von: Zhao, Zhenghao, et al.
Veröffentlicht: (2022)
Motion Marionette: Rethinking Rigid Motion Transfer via Prior Guidance
von: Wang, Haoxuan, et al.
Veröffentlicht: (2025)
von: Wang, Haoxuan, et al.
Veröffentlicht: (2025)
DKDM: Data-Free Knowledge Distillation for Diffusion Models with Any Architecture
von: Xiang, Qianlong, et al.
Veröffentlicht: (2024)
von: Xiang, Qianlong, et al.
Veröffentlicht: (2024)
Boundary Matters: A Bi-Level Active Finetuning Framework
von: Lu, Han, et al.
Veröffentlicht: (2024)
von: Lu, Han, et al.
Veröffentlicht: (2024)
TraceFlow: Dynamic 3D Reconstruction of Specular Scenes Driven by Ray Tracing
von: Tao, Jiachen, et al.
Veröffentlicht: (2025)
von: Tao, Jiachen, et al.
Veröffentlicht: (2025)
LLaVA-PruMerge: Adaptive Token Reduction for Efficient Large Multimodal Models
von: Shang, Yuzhang, et al.
Veröffentlicht: (2024)
von: Shang, Yuzhang, et al.
Veröffentlicht: (2024)
Robin3D: Improving 3D Large Language Model via Robust Instruction Tuning
von: Kang, Weitai, et al.
Veröffentlicht: (2024)
von: Kang, Weitai, et al.
Veröffentlicht: (2024)
freePruner: A Training-free Approach for Large Multimodal Model Acceleration
von: Xu, Bingxin, et al.
Veröffentlicht: (2024)
von: Xu, Bingxin, et al.
Veröffentlicht: (2024)
Orientation-anchored Hyper-Gaussian for 4D Reconstruction from Casual Videos
von: Wu, Junyi, et al.
Veröffentlicht: (2025)
von: Wu, Junyi, et al.
Veröffentlicht: (2025)
A Simple Low-bit Quantization Framework for Video Snapshot Compressive Imaging
von: Cao, Miao, et al.
Veröffentlicht: (2024)
von: Cao, Miao, et al.
Veröffentlicht: (2024)
BitsFusion: 1.99 bits Weight Quantization of Diffusion Model
von: Sui, Yang, et al.
Veröffentlicht: (2024)
von: Sui, Yang, et al.
Veröffentlicht: (2024)
Online Multi-spectral Neuron Tracing
von: Duan, Bin, et al.
Veröffentlicht: (2024)
von: Duan, Bin, et al.
Veröffentlicht: (2024)
AdaTSQ: Pushing the Pareto Frontier of Diffusion Transformers via Temporal-Sensitivity Quantization
von: Zhang, Shaoqiu, et al.
Veröffentlicht: (2026)
von: Zhang, Shaoqiu, et al.
Veröffentlicht: (2026)
DLFR-VAE: Dynamic Latent Frame Rate VAE for Video Generation
von: Yuan, Zhihang, et al.
Veröffentlicht: (2025)
von: Yuan, Zhihang, et al.
Veröffentlicht: (2025)
6Bit-Diffusion: Inference-Time Mixed-Precision Quantization for Video Diffusion Models
von: Su, Rundong, et al.
Veröffentlicht: (2026)
von: Su, Rundong, et al.
Veröffentlicht: (2026)
X-Field: A Physically Grounded Representation for 3D X-ray Reconstruction
von: Wang, Feiran, et al.
Veröffentlicht: (2025)
von: Wang, Feiran, et al.
Veröffentlicht: (2025)
Finetuning Vision-Language Models as OCR Systems for Low-Resource Languages: A Case Study of Manchu
von: Chung, Yan Hon Michael, et al.
Veröffentlicht: (2025)
von: Chung, Yan Hon Michael, et al.
Veröffentlicht: (2025)
CogniMap3D: Cognitive 3D Mapping and Rapid Retrieval
von: Wang, Feiran, et al.
Veröffentlicht: (2026)
von: Wang, Feiran, et al.
Veröffentlicht: (2026)
EfficientDM: Efficient Quantization-Aware Fine-Tuning of Low-Bit Diffusion Models
von: He, Yefei, et al.
Veröffentlicht: (2023)
von: He, Yefei, et al.
Veröffentlicht: (2023)
TR-DQ: Time-Rotation Diffusion Quantization
von: Shao, Yihua, et al.
Veröffentlicht: (2025)
von: Shao, Yihua, et al.
Veröffentlicht: (2025)
LiteVAR: Compressing Visual Autoregressive Modelling with Efficient Attention and Quantization
von: Xie, Rui, et al.
Veröffentlicht: (2024)
von: Xie, Rui, et al.
Veröffentlicht: (2024)
On the Faithfulness of Vision Transformer Explanations
von: Wu, Junyi, et al.
Veröffentlicht: (2024)
von: Wu, Junyi, et al.
Veröffentlicht: (2024)
Towards Fast, Memory-based and Data-Efficient Vision-Language Policy
von: Li, Haoxuan, et al.
Veröffentlicht: (2025)
von: Li, Haoxuan, et al.
Veröffentlicht: (2025)
Training-Free Adaptive Diffusion with Bounded Difference Approximation Strategy
von: Ye, Hancheng, et al.
Veröffentlicht: (2024)
von: Ye, Hancheng, et al.
Veröffentlicht: (2024)
A Survey of Token Compression for Efficient Multimodal Large Language Models
von: Shao, Kele, et al.
Veröffentlicht: (2025)
von: Shao, Kele, et al.
Veröffentlicht: (2025)
SPEED-Q: Staged Processing with Enhanced Distillation towards Efficient Low-bit On-device VLM Quantization
von: Guo, Tianyu, et al.
Veröffentlicht: (2025)
von: Guo, Tianyu, et al.
Veröffentlicht: (2025)
$γ$-Quant: Towards Learnable Quantization for Low-bit Pattern Recognition
von: Fatima, Mishal, et al.
Veröffentlicht: (2025)
von: Fatima, Mishal, et al.
Veröffentlicht: (2025)
DriveMamba: Task-Centric Scalable State Space Model for Efficient End-to-End Autonomous Driving
von: Su, Haisheng, et al.
Veröffentlicht: (2026)
von: Su, Haisheng, et al.
Veröffentlicht: (2026)
Learning Calibrated Uncertainties for Domain Shift: A Distributionally Robust Learning Approach
von: Wang, Haoxuan, et al.
Veröffentlicht: (2020)
von: Wang, Haoxuan, et al.
Veröffentlicht: (2020)
PackCache: A Training-Free Acceleration Method for Unified Autoregressive Video Generation via Compact KV-Cache
von: Li, Kunyang, et al.
Veröffentlicht: (2026)
von: Li, Kunyang, et al.
Veröffentlicht: (2026)
EA-ViT: Efficient Adaptation for Elastic Vision Transformer
von: Zhu, Chen, et al.
Veröffentlicht: (2025)
von: Zhu, Chen, et al.
Veröffentlicht: (2025)
Ähnliche Einträge
-
PTQ4DiT: Post-training Quantization for Diffusion Transformers
von: Wu, Junyi, et al.
Veröffentlicht: (2024) -
Efficient Multimodal Dataset Distillation via Generative Models
von: Zhao, Zhenghao, et al.
Veröffentlicht: (2025) -
Dataset Quantization with Active Learning based Adaptive Sampling
von: Zhao, Zhenghao, et al.
Veröffentlicht: (2024) -
CaO$_2$: Rectifying Inconsistencies in Diffusion-Based Dataset Distillation
von: Wang, Haoxuan, et al.
Veröffentlicht: (2025) -
Distill Video Datasets into Images
von: Zhao, Zhenghao, et al.
Veröffentlicht: (2025)