EC-DIT: Scaling Diffusion Transformers with Adaptive Expert-Choice Routing
Fuente:
arXiv
Saved in:
| Main Authors: | Sun, Haotian, Lei, Tao, Zhang, Bowen, Li, Yanghao, Huang, Haoshuo, Pang, Ruoming, Dai, Bo, Du, Nan |
|---|---|
| Format: | Preprint |
| Published: |
2024
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Improve Vision Language Model Chain-of-thought Reasoning
by: Zhang, Ruohong, et al.
Published: (2024)
by: Zhang, Ruohong, et al.
Published: (2024)
Expert Race: A Flexible Routing Strategy for Scaling Diffusion Transformer with Mixture of Experts
by: Yuan, Yike, et al.
Published: (2025)
by: Yuan, Yike, et al.
Published: (2025)
Scaling Laws For Diffusion Transformers
by: Liang, Zhengyang, et al.
Published: (2024)
by: Liang, Zhengyang, et al.
Published: (2024)
Routing Matters in MoE: Scaling Diffusion Transformers with Explicit Routing Guidance
by: Wei, Yujie, et al.
Published: (2025)
by: Wei, Yujie, et al.
Published: (2025)
Noise Matters: Optimizing Matching Noise for Diffusion Classifiers
by: Wang, Yanghao, et al.
Published: (2025)
by: Wang, Yanghao, et al.
Published: (2025)
Inversion Circle Interpolation: Diffusion-based Image Augmentation for Data-scarce Classification
by: Wang, Yanghao, et al.
Published: (2024)
by: Wang, Yanghao, et al.
Published: (2024)
LGEST: Dynamic Spatial-Spectral Expert Routing for Hyperspectral Image Classification
by: Wen, Jiawen, et al.
Published: (2026)
by: Wen, Jiawen, et al.
Published: (2026)
YOLO Meets Mixture-of-Experts: Adaptive Expert Routing for Robust Object Detection
by: Meiraz, Ori, et al.
Published: (2025)
by: Meiraz, Ori, et al.
Published: (2025)
Sparse Mixture-of-Experts Routing in Visual Diffusion Transformers:Diagnosis, Boundary Calibration and Evolutionary Roadmap from Routing Collapse to Selective Deadlock
by: Sha, Haiying
Published: (2026)
by: Sha, Haiying
Published: (2026)
ALTER: All-in-One Layer Pruning and Temporal Expert Routing for Efficient Diffusion Generation
by: Yang, Xiaomeng, et al.
Published: (2025)
by: Yang, Xiaomeng, et al.
Published: (2025)
UniRoute: Unified Routing Mixture-of-Experts for Modality-Adaptive Remote Sensing Change Detection
by: Shu, Qingling, et al.
Published: (2026)
by: Shu, Qingling, et al.
Published: (2026)
FlexiReID: Adaptive Mixture of Expert for Multi-Modal Person Re-Identification
by: Sun, Zhen, et al.
Published: (2025)
by: Sun, Zhen, et al.
Published: (2025)
SDiT: Semantic Region-Adaptive for Diffusion Transformers
by: Lin, Bowen, et al.
Published: (2026)
by: Lin, Bowen, et al.
Published: (2026)
D$^2$iT: Dynamic Diffusion Transformer for Accurate Image Generation
by: Jia, Weinan, et al.
Published: (2025)
by: Jia, Weinan, et al.
Published: (2025)
MANZANO: A Simple and Scalable Unified Multimodal Model with a Hybrid Vision Tokenizer
by: Li, Yanghao, et al.
Published: (2025)
by: Li, Yanghao, et al.
Published: (2025)
RegionRoute: Regional Style Transfer with Diffusion Model
by: Chen, Bowen, et al.
Published: (2026)
by: Chen, Bowen, et al.
Published: (2026)
Mixture of Global and Local Experts with Diffusion Transformer for Controllable Face Generation
by: Zou, Xuechao, et al.
Published: (2025)
by: Zou, Xuechao, et al.
Published: (2025)
Rethinking Cross-Layer Information Routing in Diffusion Transformers
by: Xu, Chao, et al.
Published: (2026)
by: Xu, Chao, et al.
Published: (2026)
Mr. DETR++: Instructive Multi-Route Training for Detection Transformers with Mixture-of-Experts
by: Zhang, Chang-Bin, et al.
Published: (2024)
by: Zhang, Chang-Bin, et al.
Published: (2024)
GEMINUS: Dual-aware Global and Scene-Adaptive Mixture-of-Experts for End-to-End Autonomous Driving
by: Wan, Chi, et al.
Published: (2025)
by: Wan, Chi, et al.
Published: (2025)
Scaling Diffusion Transformers to 16 Billion Parameters
by: Fei, Zhengcong, et al.
Published: (2024)
by: Fei, Zhengcong, et al.
Published: (2024)
NumeriKontrol: Adding Numeric Control to Diffusion Transformers for Instruction-based Image Editing
by: Xu, Zhenyu, et al.
Published: (2025)
by: Xu, Zhenyu, et al.
Published: (2025)
Domain-Expert-Guided Hybrid Mixture-of-Experts for Medical AI: Integrating Data-Driven Learning with Clinical Priors
by: Gu, Jinchen, et al.
Published: (2026)
by: Gu, Jinchen, et al.
Published: (2026)
VORTA: Efficient Video Diffusion via Routing Sparse Attention
by: Sun, Wenhao, et al.
Published: (2025)
by: Sun, Wenhao, et al.
Published: (2025)
UGoDIT: Unsupervised Group Deep Image Prior Via Transferable Weights
by: Liang, Shijun, et al.
Published: (2025)
by: Liang, Shijun, et al.
Published: (2025)
CogVideoX: Text-to-Video Diffusion Models with An Expert Transformer
by: Yang, Zhuoyi, et al.
Published: (2024)
by: Yang, Zhuoyi, et al.
Published: (2024)
Coarse-Guided Visual Generation via Weighted h-Transform Sampling
by: Wang, Yanghao, et al.
Published: (2026)
by: Wang, Yanghao, et al.
Published: (2026)
Delta Score Matters! Spatial Adaptive Multi Guidance in Diffusion Models
by: Li, Haosen, et al.
Published: (2026)
by: Li, Haosen, et al.
Published: (2026)
DreamFuse: Adaptive Image Fusion with Diffusion Transformer
by: Huang, Junjia, et al.
Published: (2025)
by: Huang, Junjia, et al.
Published: (2025)
Variance-Aware Adaptive Weighting for Diffusion Model Training
by: Sun, Nanlong, et al.
Published: (2026)
by: Sun, Nanlong, et al.
Published: (2026)
Scaling Continual Learning to 300+ Tasks with Bi-Level Routing Mixture-of-Experts
by: Lou, Meng, et al.
Published: (2026)
by: Lou, Meng, et al.
Published: (2026)
Reusing Fusion-Time Spectral Reliability for Adaptive Fusion and Expert Routing in RGB-Infrared Object Detection
by: Wu, Yefeng
Published: (2026)
by: Wu, Yefeng
Published: (2026)
EC-Diff: Fast and High-Quality Edge-Cloud Collaborative Inference for Diffusion Models
by: Xie, Jiajian, et al.
Published: (2025)
by: Xie, Jiajian, et al.
Published: (2025)
AMIEOD: Adaptive Multi-Experts Image Enhancement for Object Detection in Low-Illumination Scenes
by: Huang, Xiaochen, et al.
Published: (2026)
by: Huang, Xiaochen, et al.
Published: (2026)
MoASE++: Mixture of Activation Sparsity Experts with Domain-Adaptive On-policy Distillation for Continual Test Time Adaptation
by: Zhang, Ronyu, et al.
Published: (2026)
by: Zhang, Ronyu, et al.
Published: (2026)
Adaptive Training Meets Progressive Scaling: Elevating Efficiency in Diffusion Models
by: Li, Wenhao, et al.
Published: (2023)
by: Li, Wenhao, et al.
Published: (2023)
Switch Diffusion Transformer: Synergizing Denoising Tasks with Sparse Mixture-of-Experts
by: Park, Byeongjun, et al.
Published: (2024)
by: Park, Byeongjun, et al.
Published: (2024)
Human4DiT: 360-degree Human Video Generation with 4D Diffusion Transformer
by: Shao, Ruizhi, et al.
Published: (2024)
by: Shao, Ruizhi, et al.
Published: (2024)
Semantic Routing: Exploring Multi-Layer LLM Feature Weighting for Diffusion Transformers
by: Li, Bozhou, et al.
Published: (2026)
by: Li, Bozhou, et al.
Published: (2026)
MagicTryOn: Harnessing Diffusion Transformer for Garment-Preserving Video Virtual Try-on
by: Li, Guangyuan, et al.
Published: (2025)
by: Li, Guangyuan, et al.
Published: (2025)
Similar Items
-
Improve Vision Language Model Chain-of-thought Reasoning
by: Zhang, Ruohong, et al.
Published: (2024) -
Expert Race: A Flexible Routing Strategy for Scaling Diffusion Transformer with Mixture of Experts
by: Yuan, Yike, et al.
Published: (2025) -
Scaling Laws For Diffusion Transformers
by: Liang, Zhengyang, et al.
Published: (2024) -
Routing Matters in MoE: Scaling Diffusion Transformers with Explicit Routing Guidance
by: Wei, Yujie, et al.
Published: (2025) -
Noise Matters: Optimizing Matching Noise for Diffusion Classifiers
by: Wang, Yanghao, et al.
Published: (2025)