PTQ4DiT: Post-training Quantization for Diffusion Transformers
Fuente:
arXiv
Guardado en:
| Autores principales: | Wu, Junyi, Wang, Haoxuan, Shang, Yuzhang, Shah, Mubarak, Yan, Yan |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
QuEST: Low-bit Diffusion Model Quantization via Efficient Selective Finetuning
por: Wang, Haoxuan, et al.
Publicado: (2024)
por: Wang, Haoxuan, et al.
Publicado: (2024)
Q-DiT: Accurate Post-Training Quantization for Diffusion Transformers
por: Chen, Lei, et al.
Publicado: (2024)
por: Chen, Lei, et al.
Publicado: (2024)
Dataset Quantization with Active Learning based Adaptive Sampling
por: Zhao, Zhenghao, et al.
Publicado: (2024)
por: Zhao, Zhenghao, et al.
Publicado: (2024)
CaO$_2$: Rectifying Inconsistencies in Diffusion-Based Dataset Distillation
por: Wang, Haoxuan, et al.
Publicado: (2025)
por: Wang, Haoxuan, et al.
Publicado: (2025)
LRQ-DiT: Log-Rotation Post-Training Quantization of Diffusion Transformers for Image and Video Generation
por: Yang, Lianwei, et al.
Publicado: (2025)
por: Yang, Lianwei, et al.
Publicado: (2025)
FP4DiT: Towards Effective Floating Point Quantization for Diffusion Transformers
por: Chen, Ruichen, et al.
Publicado: (2025)
por: Chen, Ruichen, et al.
Publicado: (2025)
VQ4DiT: Efficient Post-Training Vector Quantization for Diffusion Transformers
por: Deng, Juncan, et al.
Publicado: (2024)
por: Deng, Juncan, et al.
Publicado: (2024)
DiT4Edit: Diffusion Transformer for Image Editing
por: Feng, Kunyu, et al.
Publicado: (2024)
por: Feng, Kunyu, et al.
Publicado: (2024)
HQ-DiT: Efficient Diffusion Transformer with FP4 Hybrid Quantization
por: Liu, Wenxuan, et al.
Publicado: (2024)
por: Liu, Wenxuan, et al.
Publicado: (2024)
Attend Locally, Remember Linearly: Linear Attention as Cross-Frame Memory for Autoregressive Video Diffusion
por: Li, Kunyang, et al.
Publicado: (2026)
por: Li, Kunyang, et al.
Publicado: (2026)
Efficient Multimodal Dataset Distillation via Generative Models
por: Zhao, Zhenghao, et al.
Publicado: (2025)
por: Zhao, Zhenghao, et al.
Publicado: (2025)
PackCache: A Training-Free Acceleration Method for Unified Autoregressive Video Generation via Compact KV-Cache
por: Li, Kunyang, et al.
Publicado: (2026)
por: Li, Kunyang, et al.
Publicado: (2026)
LaVin-DiT: Large Vision Diffusion Transformer
por: Wang, Zhaoqing, et al.
Publicado: (2024)
por: Wang, Zhaoqing, et al.
Publicado: (2024)
Robin3D: Improving 3D Large Language Model via Robust Instruction Tuning
por: Kang, Weitai, et al.
Publicado: (2024)
por: Kang, Weitai, et al.
Publicado: (2024)
PTQ4RIS: Post-Training Quantization for Referring Image Segmentation
por: Jiang, Xiaoyan, et al.
Publicado: (2024)
por: Jiang, Xiaoyan, et al.
Publicado: (2024)
Q-DiT4SR: Exploration of Detail-Preserving Diffusion Transformer Quantization for Real-World Image Super-Resolution
por: Zhang, Xun, et al.
Publicado: (2026)
por: Zhang, Xun, et al.
Publicado: (2026)
Attend to Not Attended: Structure-then-Detail Token Merging for Post-training DiT Acceleration
por: Fang, Haipeng, et al.
Publicado: (2025)
por: Fang, Haipeng, et al.
Publicado: (2025)
S2DiT: Sandwich Diffusion Transformer for Mobile Streaming Video Generation
por: Zhao, Lin, et al.
Publicado: (2026)
por: Zhao, Lin, et al.
Publicado: (2026)
U-DiTs: Downsample Tokens in U-Shaped Diffusion Transformers
por: Tian, Yuchuan, et al.
Publicado: (2024)
por: Tian, Yuchuan, et al.
Publicado: (2024)
PTQ4SAM: Post-Training Quantization for Segment Anything
por: Lv, Chengtao, et al.
Publicado: (2024)
por: Lv, Chengtao, et al.
Publicado: (2024)
PTQ4VM: Post-Training Quantization for Visual Mamba
por: Cho, Younghyun, et al.
Publicado: (2024)
por: Cho, Younghyun, et al.
Publicado: (2024)
PTQ4ViT: Post-training quantization for vision transformers with twin uniform quantization
por: Yuan, Zhihang, et al.
Publicado: (2021)
por: Yuan, Zhihang, et al.
Publicado: (2021)
DiT4SR: Taming Diffusion Transformer for Real-World Image Super-Resolution
por: Duan, Zheng-Peng, et al.
Publicado: (2025)
por: Duan, Zheng-Peng, et al.
Publicado: (2025)
Remix-DiT: Mixing Diffusion Transformers for Multi-Expert Denoising
por: Fang, Gongfan, et al.
Publicado: (2024)
por: Fang, Gongfan, et al.
Publicado: (2024)
Pack-PTQ: Advancing Post-training Quantization of Neural Networks by Pack-wise Reconstruction
por: Li, Changjun, et al.
Publicado: (2025)
por: Li, Changjun, et al.
Publicado: (2025)
Human4DiT: 360-degree Human Video Generation with 4D Diffusion Transformer
por: Shao, Ruizhi, et al.
Publicado: (2024)
por: Shao, Ruizhi, et al.
Publicado: (2024)
AV-DiT: Efficient Audio-Visual Diffusion Transformer for Joint Audio and Video Generation
por: Wang, Kai, et al.
Publicado: (2024)
por: Wang, Kai, et al.
Publicado: (2024)
Distill Video Datasets into Images
por: Zhao, Zhenghao, et al.
Publicado: (2025)
por: Zhao, Zhenghao, et al.
Publicado: (2025)
Inf-DiT: Upsampling Any-Resolution Image with Memory-Efficient Diffusion Transformer
por: Yang, Zhuoyi, et al.
Publicado: (2024)
por: Yang, Zhuoyi, et al.
Publicado: (2024)
$Δ$-DiT: A Training-Free Acceleration Method Tailored for Diffusion Transformers
por: Chen, Pengtao, et al.
Publicado: (2024)
por: Chen, Pengtao, et al.
Publicado: (2024)
DiT as Real-Time Rerenderer: Streaming Video Stylization with Autoregressive Diffusion Transformer
por: Lyu, Hengye, et al.
Publicado: (2026)
por: Lyu, Hengye, et al.
Publicado: (2026)
FBPT: A Fully Binary Point Transformer
por: Hou, Zhixing, et al.
Publicado: (2024)
por: Hou, Zhixing, et al.
Publicado: (2024)
SD-DiT: Unleashing the Power of Self-supervised Discrimination in Diffusion Transformer
por: Zhu, Rui, et al.
Publicado: (2024)
por: Zhu, Rui, et al.
Publicado: (2024)
Hunyuan-DiT: A Powerful Multi-Resolution Diffusion Transformer with Fine-Grained Chinese Understanding
por: Li, Zhimin, et al.
Publicado: (2024)
por: Li, Zhimin, et al.
Publicado: (2024)
MiM-DiT: MoE in MoE with Diffusion Transformers for All-in-One Image Restoration
por: Kong, Lingshun, et al.
Publicado: (2026)
por: Kong, Lingshun, et al.
Publicado: (2026)
UniAnimate-DiT: Human Image Animation with Large-Scale Video Diffusion Transformer
por: Wang, Xiang, et al.
Publicado: (2025)
por: Wang, Xiang, et al.
Publicado: (2025)
RobuQ: Pushing DiTs to W1.58A2 via Robust Activation Quantization
por: Yang, Kaicheng, et al.
Publicado: (2025)
por: Yang, Kaicheng, et al.
Publicado: (2025)
DiT-IC: Aligned Diffusion Transformer for Efficient Image Compression
por: Shi, Junqi, et al.
Publicado: (2026)
por: Shi, Junqi, et al.
Publicado: (2026)
Unveiling Redundancy in Diffusion Transformers (DiTs): A Systematic Study
por: Sun, Xibo, et al.
Publicado: (2024)
por: Sun, Xibo, et al.
Publicado: (2024)
PTQ4ARVG: Post-Training Quantization for AutoRegressive Visual Generation Models
por: Liu, Xuewen, et al.
Publicado: (2026)
por: Liu, Xuewen, et al.
Publicado: (2026)
Ejemplares similares
-
QuEST: Low-bit Diffusion Model Quantization via Efficient Selective Finetuning
por: Wang, Haoxuan, et al.
Publicado: (2024) -
Q-DiT: Accurate Post-Training Quantization for Diffusion Transformers
por: Chen, Lei, et al.
Publicado: (2024) -
Dataset Quantization with Active Learning based Adaptive Sampling
por: Zhao, Zhenghao, et al.
Publicado: (2024) -
CaO$_2$: Rectifying Inconsistencies in Diffusion-Based Dataset Distillation
por: Wang, Haoxuan, et al.
Publicado: (2025) -
LRQ-DiT: Log-Rotation Post-Training Quantization of Diffusion Transformers for Image and Video Generation
por: Yang, Lianwei, et al.
Publicado: (2025)