An Analysis on Quantizing Diffusion Transformers
Fuente:
arXiv
Guardado en:
| Autores principales: | Yang, Yuewei, Wang, Jialiang, Dai, Xiaoliang, Zhang, Peizhao, Zhang, Hongbo |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
FBNetV5: Neural Architecture Search for Multiple Tasks in One Run
por: Wu, Bichen, et al.
Publicado: (2021)
por: Wu, Bichen, et al.
Publicado: (2021)
Castling-ViT: Compressing Self-Attention via Switching Towards Linear-Angular Attention at Vision Transformer Inference
por: You, Haoran, et al.
Publicado: (2022)
por: You, Haoran, et al.
Publicado: (2022)
Cache Me if You Can: Accelerating Diffusion Models through Block Caching
por: Wimbauer, Felix, et al.
Publicado: (2023)
por: Wimbauer, Felix, et al.
Publicado: (2023)
Auto-CARD: Efficient and Robust Codec Avatar Driving for Real-time Mobile Telepresence
por: Fu, Yonggan, et al.
Publicado: (2023)
por: Fu, Yonggan, et al.
Publicado: (2023)
TreeQ: Pushing the Quantization Boundary of Diffusion Transformer via Tree-Structured Mixed-Precision Search
por: Yang, Kaicheng, et al.
Publicado: (2025)
por: Yang, Kaicheng, et al.
Publicado: (2025)
DVD-Quant: Data-free Video Diffusion Transformers Quantization
por: Li, Zhiteng, et al.
Publicado: (2025)
por: Li, Zhiteng, et al.
Publicado: (2025)
DiTAS: Quantizing Diffusion Transformers via Enhanced Activation Smoothing
por: Dong, Zhenyuan, et al.
Publicado: (2024)
por: Dong, Zhenyuan, et al.
Publicado: (2024)
Llama Learns to Direct: DirectorLLM for Human-Centric Video Generation
por: Song, Kunpeng, et al.
Publicado: (2024)
por: Song, Kunpeng, et al.
Publicado: (2024)
AdaTSQ: Pushing the Pareto Frontier of Diffusion Transformers via Temporal-Sensitivity Quantization
por: Zhang, Shaoqiu, et al.
Publicado: (2026)
por: Zhang, Shaoqiu, et al.
Publicado: (2026)
Quantized Spike-driven Transformer
por: Qiu, Xuerui, et al.
Publicado: (2025)
por: Qiu, Xuerui, et al.
Publicado: (2025)
ViDiT-Q: Efficient and Accurate Quantization of Diffusion Transformers for Image and Video Generation
por: Zhao, Tianchen, et al.
Publicado: (2024)
por: Zhao, Tianchen, et al.
Publicado: (2024)
Diffusion Product Quantization
por: Shao, Jie, et al.
Publicado: (2024)
por: Shao, Jie, et al.
Publicado: (2024)
Q-DiT4SR: Exploration of Detail-Preserving Diffusion Transformer Quantization for Real-World Image Super-Resolution
por: Zhang, Xun, et al.
Publicado: (2026)
por: Zhang, Xun, et al.
Publicado: (2026)
PTQ4DiT: Post-training Quantization for Diffusion Transformers
por: Wu, Junyi, et al.
Publicado: (2024)
por: Wu, Junyi, et al.
Publicado: (2024)
QuantSparse: Comprehensively Compressing Video Diffusion Transformer with Model Quantization and Attention Sparsification
por: Feng, Weilun, et al.
Publicado: (2025)
por: Feng, Weilun, et al.
Publicado: (2025)
Training-free Regional Prompting for Diffusion Transformers
por: Chen, Anthony, et al.
Publicado: (2024)
por: Chen, Anthony, et al.
Publicado: (2024)
Timestep-Aware Correction for Quantized Diffusion Models
por: Yao, Yuzhe, et al.
Publicado: (2024)
por: Yao, Yuzhe, et al.
Publicado: (2024)
CLQ: Cross-Layer Guided Orthogonal-based Quantization for Diffusion Transformers
por: Liu, Kai, et al.
Publicado: (2025)
por: Liu, Kai, et al.
Publicado: (2025)
Q-VDiT: Towards Accurate Quantization and Distillation of Video-Generation Diffusion Transformers
por: Feng, Weilun, et al.
Publicado: (2025)
por: Feng, Weilun, et al.
Publicado: (2025)
LoReTrack: Efficient and Accurate Low-Resolution Transformer Tracking
por: Dong, Shaohua, et al.
Publicado: (2024)
por: Dong, Shaohua, et al.
Publicado: (2024)
Scaling Laws For Diffusion Transformers
por: Liang, Zhengyang, et al.
Publicado: (2024)
por: Liang, Zhengyang, et al.
Publicado: (2024)
HQ-DiT: Efficient Diffusion Transformer with FP4 Hybrid Quantization
por: Liu, Wenxuan, et al.
Publicado: (2024)
por: Liu, Wenxuan, et al.
Publicado: (2024)
Quantized Visual Geometry Grounded Transformer
por: Feng, Weilun, et al.
Publicado: (2025)
por: Feng, Weilun, et al.
Publicado: (2025)
Together, Then Apart: Revisiting Multimodal Survival Analysis via a Min-Max Perspective
por: Liu, Wenjing, et al.
Publicado: (2025)
por: Liu, Wenjing, et al.
Publicado: (2025)
LRQ-DiT: Log-Rotation Post-Training Quantization of Diffusion Transformers for Image and Video Generation
por: Yang, Lianwei, et al.
Publicado: (2025)
por: Yang, Lianwei, et al.
Publicado: (2025)
Hypergraph Convolutional Network based Weakly Supervised Point Cloud Semantic Segmentation with Scene-Level Annotations
por: Lu, Zhuheng, et al.
Publicado: (2022)
por: Lu, Zhuheng, et al.
Publicado: (2022)
Non-Markov Multi-Round Conversational Image Generation with History-Conditioned MLLMs
por: Zhang, Haochen, et al.
Publicado: (2026)
por: Zhang, Haochen, et al.
Publicado: (2026)
AIQViT: Architecture-Informed Post-Training Quantization for Vision Transformers
por: Jiang, Runqing, et al.
Publicado: (2025)
por: Jiang, Runqing, et al.
Publicado: (2025)
Post-Training Quantization for Diffusion Transformer via Hierarchical Timestep Grouping
por: Ding, Ning, et al.
Publicado: (2025)
por: Ding, Ning, et al.
Publicado: (2025)
ConvRot: Rotation-Based Plug-and-Play 4-bit Quantization for Diffusion Transformers
por: Huang, Feice, et al.
Publicado: (2025)
por: Huang, Feice, et al.
Publicado: (2025)
DiTFastAttn: Attention Compression for Diffusion Transformer Models
por: Yuan, Zhihang, et al.
Publicado: (2024)
por: Yuan, Zhihang, et al.
Publicado: (2024)
TR-DQ: Time-Rotation Diffusion Quantization
por: Shao, Yihua, et al.
Publicado: (2025)
por: Shao, Yihua, et al.
Publicado: (2025)
S$^2$Q-VDiT: Accurate Quantized Video Diffusion Transformer with Salient Data and Sparse Token Distillation
por: Feng, Weilun, et al.
Publicado: (2025)
por: Feng, Weilun, et al.
Publicado: (2025)
No Other Representation Component Is Needed: Diffusion Transformers Can Provide Representation Guidance by Themselves
por: Jiang, Dengyang, et al.
Publicado: (2025)
por: Jiang, Dengyang, et al.
Publicado: (2025)
BiDM: Pushing the Limit of Quantization for Diffusion Models
por: Zheng, Xingyu, et al.
Publicado: (2024)
por: Zheng, Xingyu, et al.
Publicado: (2024)
Tora: Trajectory-oriented Diffusion Transformer for Video Generation
por: Zhang, Zhenghao, et al.
Publicado: (2024)
por: Zhang, Zhenghao, et al.
Publicado: (2024)
Q-ARVD: Quantizing Autoregressive Video Diffusion Models
por: Tang, Siao, et al.
Publicado: (2026)
por: Tang, Siao, et al.
Publicado: (2026)
Q-DiT: Accurate Post-Training Quantization for Diffusion Transformers
por: Chen, Lei, et al.
Publicado: (2024)
por: Chen, Lei, et al.
Publicado: (2024)
FP4DiT: Towards Effective Floating Point Quantization for Diffusion Transformers
por: Chen, Ruichen, et al.
Publicado: (2025)
por: Chen, Ruichen, et al.
Publicado: (2025)
SemanticDialect: Semantic-Aware Mixed-Format Quantization for Video Diffusion Transformers
por: Jang, Wonsuk, et al.
Publicado: (2026)
por: Jang, Wonsuk, et al.
Publicado: (2026)
Ejemplares similares
-
FBNetV5: Neural Architecture Search for Multiple Tasks in One Run
por: Wu, Bichen, et al.
Publicado: (2021) -
Castling-ViT: Compressing Self-Attention via Switching Towards Linear-Angular Attention at Vision Transformer Inference
por: You, Haoran, et al.
Publicado: (2022) -
Cache Me if You Can: Accelerating Diffusion Models through Block Caching
por: Wimbauer, Felix, et al.
Publicado: (2023) -
Auto-CARD: Efficient and Robust Codec Avatar Driving for Real-time Mobile Telepresence
por: Fu, Yonggan, et al.
Publicado: (2023) -
TreeQ: Pushing the Quantization Boundary of Diffusion Transformer via Tree-Structured Mixed-Precision Search
por: Yang, Kaicheng, et al.
Publicado: (2025)