Unveiling Redundancy in Diffusion Transformers (DiTs): A Systematic Study
Fuente:
arXiv
Salvato in:
| Autori principali: | Sun, Xibo, Fang, Jiarui, Li, Aoyu, Pan, Jinzhe |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
xDiT: an Inference Engine for Diffusion Transformers (DiTs) with Massive Parallelism
di: Fang, Jiarui, et al.
Pubblicazione: (2024)
di: Fang, Jiarui, et al.
Pubblicazione: (2024)
PipeFusion: Patch-level Pipeline Parallelism for Diffusion Transformers Inference
di: Fang, Jiarui, et al.
Pubblicazione: (2024)
di: Fang, Jiarui, et al.
Pubblicazione: (2024)
Rethinking Multi-Condition DiTs: Eliminating Redundant Attention via Position-Alignment and Keyword-Scoping
di: Zhou, Chao, et al.
Pubblicazione: (2026)
di: Zhou, Chao, et al.
Pubblicazione: (2026)
Remix-DiT: Mixing Diffusion Transformers for Multi-Expert Denoising
di: Fang, Gongfan, et al.
Pubblicazione: (2024)
di: Fang, Gongfan, et al.
Pubblicazione: (2024)
Q-DiT: Accurate Post-Training Quantization for Diffusion Transformers
di: Chen, Lei, et al.
Pubblicazione: (2024)
di: Chen, Lei, et al.
Pubblicazione: (2024)
HQ-DiT: Efficient Diffusion Transformer with FP4 Hybrid Quantization
di: Liu, Wenxuan, et al.
Pubblicazione: (2024)
di: Liu, Wenxuan, et al.
Pubblicazione: (2024)
AnchorDiff: Training-Free Concept Grounding for MM-DiTs via Anchor-Based Graph Propagation
di: Zhang, Jian, et al.
Pubblicazione: (2026)
di: Zhang, Jian, et al.
Pubblicazione: (2026)
U-DiTs: Downsample Tokens in U-Shaped Diffusion Transformers
di: Tian, Yuchuan, et al.
Pubblicazione: (2024)
di: Tian, Yuchuan, et al.
Pubblicazione: (2024)
MMFace-DiT: A Dual-Stream Diffusion Transformer for High-Fidelity Multimodal Face Generation
di: Krishnamurthy, Bharath, et al.
Pubblicazione: (2026)
di: Krishnamurthy, Bharath, et al.
Pubblicazione: (2026)
Shiva-DiT: Residual-Based Differentiable Top-$k$ Selection for Efficient Diffusion Transformers
di: Zhang, Jiaji, et al.
Pubblicazione: (2026)
di: Zhang, Jiaji, et al.
Pubblicazione: (2026)
DiT-VTON: Diffusion Transformer Framework for Unified Multi-Category Virtual Try-On and Virtual Try-All with Integrated Image Editing
di: Li, Qi, et al.
Pubblicazione: (2025)
di: Li, Qi, et al.
Pubblicazione: (2025)
VQ4DiT: Efficient Post-Training Vector Quantization for Diffusion Transformers
di: Deng, Juncan, et al.
Pubblicazione: (2024)
di: Deng, Juncan, et al.
Pubblicazione: (2024)
ZigMa: A DiT-style Zigzag Mamba Diffusion Model
di: Hu, Vincent Tao, et al.
Pubblicazione: (2024)
di: Hu, Vincent Tao, et al.
Pubblicazione: (2024)
Ortho-Hydra: Orthogonalized Experts for DiT LoRA
di: Ji, Seunghyun
Pubblicazione: (2026)
di: Ji, Seunghyun
Pubblicazione: (2026)
Why Do DiT Editors Drift? Plug-and-Play Low Frequency Alignment in VAE Latent Space
di: Wang, Xiaoce, et al.
Pubblicazione: (2026)
di: Wang, Xiaoce, et al.
Pubblicazione: (2026)
SD-DiT: Unleashing the Power of Self-supervised Discrimination in Diffusion Transformer
di: Zhu, Rui, et al.
Pubblicazione: (2024)
di: Zhu, Rui, et al.
Pubblicazione: (2024)
Untwisting RoPE: Frequency Control for Shared Attention in DiTs
di: Mikaeili, Aryan, et al.
Pubblicazione: (2026)
di: Mikaeili, Aryan, et al.
Pubblicazione: (2026)
ViTs are Everywhere: A Comprehensive Study Showcasing Vision Transformers in Different Domain
di: Mia, Md Sohag, et al.
Pubblicazione: (2023)
di: Mia, Md Sohag, et al.
Pubblicazione: (2023)
MeshCraft: Exploring Efficient and Controllable Mesh Generation with Flow-based DiTs
di: He, Xianglong, et al.
Pubblicazione: (2025)
di: He, Xianglong, et al.
Pubblicazione: (2025)
OmniDiT: Extending Diffusion Transformer to Omni-VTON Framework
di: Zeng, Weixuan, et al.
Pubblicazione: (2026)
di: Zeng, Weixuan, et al.
Pubblicazione: (2026)
DiT4Edit: Diffusion Transformer for Image Editing
di: Feng, Kunyu, et al.
Pubblicazione: (2024)
di: Feng, Kunyu, et al.
Pubblicazione: (2024)
LaVin-DiT: Large Vision Diffusion Transformer
di: Wang, Zhaoqing, et al.
Pubblicazione: (2024)
di: Wang, Zhaoqing, et al.
Pubblicazione: (2024)
DragFlow: Unleashing DiT Priors with Region Based Supervision for Drag Editing
di: Zhou, Zihan, et al.
Pubblicazione: (2025)
di: Zhou, Zihan, et al.
Pubblicazione: (2025)
DC-DiT: Adaptive Compute and Elastic Inference for Visual Generation via Dynamic Chunking
di: Haridas, Akash, et al.
Pubblicazione: (2026)
di: Haridas, Akash, et al.
Pubblicazione: (2026)
PTQ4DiT: Post-training Quantization for Diffusion Transformers
di: Wu, Junyi, et al.
Pubblicazione: (2024)
di: Wu, Junyi, et al.
Pubblicazione: (2024)
S2DiT: Sandwich Diffusion Transformer for Mobile Streaming Video Generation
di: Zhao, Lin, et al.
Pubblicazione: (2026)
di: Zhao, Lin, et al.
Pubblicazione: (2026)
JointDiT: Enhancing RGB-Depth Joint Modeling with Diffusion Transformers
di: Byung-Ki, Kwon, et al.
Pubblicazione: (2025)
di: Byung-Ki, Kwon, et al.
Pubblicazione: (2025)
LuxDiT: Lighting Estimation with Video Diffusion Transformer
di: Liang, Ruofan, et al.
Pubblicazione: (2025)
di: Liang, Ruofan, et al.
Pubblicazione: (2025)
RobuQ: Pushing DiTs to W1.58A2 via Robust Activation Quantization
di: Yang, Kaicheng, et al.
Pubblicazione: (2025)
di: Yang, Kaicheng, et al.
Pubblicazione: (2025)
Purrturbed but Stable: Human-Cat Invariant Representations Across CNNs, ViTs and Self-Supervised ViTs
di: Shah, Arya, et al.
Pubblicazione: (2025)
di: Shah, Arya, et al.
Pubblicazione: (2025)
EdgeDiT: Hardware-Aware Diffusion Transformers for Efficient On-Device Image Generation
di: Kodavanti, Sravanth, et al.
Pubblicazione: (2026)
di: Kodavanti, Sravanth, et al.
Pubblicazione: (2026)
DiT as Real-Time Rerenderer: Streaming Video Stylization with Autoregressive Diffusion Transformer
di: Lyu, Hengye, et al.
Pubblicazione: (2026)
di: Lyu, Hengye, et al.
Pubblicazione: (2026)
$Δ$-DiT: A Training-Free Acceleration Method Tailored for Diffusion Transformers
di: Chen, Pengtao, et al.
Pubblicazione: (2024)
di: Chen, Pengtao, et al.
Pubblicazione: (2024)
Hunyuan-DiT: A Powerful Multi-Resolution Diffusion Transformer with Fine-Grained Chinese Understanding
di: Li, Zhimin, et al.
Pubblicazione: (2024)
di: Li, Zhimin, et al.
Pubblicazione: (2024)
TAP-ViTs: Task-Adaptive Pruning for On-Device Deployment of Vision Transformers
di: Wang, Zhibo, et al.
Pubblicazione: (2026)
di: Wang, Zhibo, et al.
Pubblicazione: (2026)
Raformer: Redundancy-Aware Transformer for Video Wire Inpainting
di: Ji, Zhong, et al.
Pubblicazione: (2024)
di: Ji, Zhong, et al.
Pubblicazione: (2024)
Octic Vision Transformers: Quicker ViTs Through Equivariance
di: Nordström, David, et al.
Pubblicazione: (2025)
di: Nordström, David, et al.
Pubblicazione: (2025)
Human4DiT: 360-degree Human Video Generation with 4D Diffusion Transformer
di: Shao, Ruizhi, et al.
Pubblicazione: (2024)
di: Shao, Ruizhi, et al.
Pubblicazione: (2024)
AlignDiT: Multimodal Aligned Diffusion Transformer for Synchronized Speech Generation
di: Choi, Jeongsoo, et al.
Pubblicazione: (2025)
di: Choi, Jeongsoo, et al.
Pubblicazione: (2025)
Inf-DiT: Upsampling Any-Resolution Image with Memory-Efficient Diffusion Transformer
di: Yang, Zhuoyi, et al.
Pubblicazione: (2024)
di: Yang, Zhuoyi, et al.
Pubblicazione: (2024)
Documenti analoghi
-
xDiT: an Inference Engine for Diffusion Transformers (DiTs) with Massive Parallelism
di: Fang, Jiarui, et al.
Pubblicazione: (2024) -
PipeFusion: Patch-level Pipeline Parallelism for Diffusion Transformers Inference
di: Fang, Jiarui, et al.
Pubblicazione: (2024) -
Rethinking Multi-Condition DiTs: Eliminating Redundant Attention via Position-Alignment and Keyword-Scoping
di: Zhou, Chao, et al.
Pubblicazione: (2026) -
Remix-DiT: Mixing Diffusion Transformers for Multi-Expert Denoising
di: Fang, Gongfan, et al.
Pubblicazione: (2024) -
Q-DiT: Accurate Post-Training Quantization for Diffusion Transformers
di: Chen, Lei, et al.
Pubblicazione: (2024)