MiM-DiT: MoE in MoE with Diffusion Transformers for All-in-One Image Restoration
Fuente:
arXiv
Salvato in:
| Autori principali: | Kong, Lingshun, Zhang, Jiawei, Duan, Zhengpeng, Wu, Xiaohe, Yang, Yueqi, Wang, Xiaotao, Zou, Dongqing, Lei, Lei, Pan, Jinshan |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
DeblurDiff: Real-World Image Deblurring with Generative Diffusion Models
di: Kong, Lingshun, et al.
Pubblicazione: (2025)
di: Kong, Lingshun, et al.
Pubblicazione: (2025)
Mamoda2.5: Enhancing Unified Multimodal Model with DiT-MoE
di: Shi, Yangming, et al.
Pubblicazione: (2026)
di: Shi, Yangming, et al.
Pubblicazione: (2026)
MoE-PHDS: One MoE checkpoint for flexible runtime sparsity
di: Hannah, Lauren. A, et al.
Pubblicazione: (2025)
di: Hannah, Lauren. A, et al.
Pubblicazione: (2025)
Dense2MoE: Restructuring Diffusion Transformer to MoE for Efficient Text-to-Image Generation
di: Zheng, Youwei, et al.
Pubblicazione: (2025)
di: Zheng, Youwei, et al.
Pubblicazione: (2025)
LLaDA-MoE: A Sparse MoE Diffusion Language Model
di: Zhu, Fengqi, et al.
Pubblicazione: (2025)
di: Zhu, Fengqi, et al.
Pubblicazione: (2025)
OD-MoE: On-Demand Expert Loading for Cacheless Edge-Distributed MoE Inference
di: Wang, Liujianfu, et al.
Pubblicazione: (2025)
di: Wang, Liujianfu, et al.
Pubblicazione: (2025)
GazeFormer-MoE: Context-Aware Gaze Estimation via CLIP and MoE Transformer
di: Zhao, Xinyuan, et al.
Pubblicazione: (2026)
di: Zhao, Xinyuan, et al.
Pubblicazione: (2026)
MoE-Prefill: Zero Redundancy Overheads in MoE Prefill Serving
di: Su, Zhaoyuan, et al.
Pubblicazione: (2026)
di: Su, Zhaoyuan, et al.
Pubblicazione: (2026)
GRACE-MoE: Grouping and Replication with Locality-Aware Routing for Efficient Distributed MoE Inference
di: Han, Yu, et al.
Pubblicazione: (2025)
di: Han, Yu, et al.
Pubblicazione: (2025)
MoE-Lightning: High-Throughput MoE Inference on Memory-constrained GPUs
di: Cao, Shiyi, et al.
Pubblicazione: (2024)
di: Cao, Shiyi, et al.
Pubblicazione: (2024)
Grove MoE: Towards Efficient and Superior MoE LLMs with Adjugate Experts
di: Wu, Haoyuan, et al.
Pubblicazione: (2025)
di: Wu, Haoyuan, et al.
Pubblicazione: (2025)
EPS-MoE: Expert Pipeline Scheduler for Cost-Efficient MoE Inference
di: Qian, Yulei, et al.
Pubblicazione: (2024)
di: Qian, Yulei, et al.
Pubblicazione: (2024)
GW-MoE: Resolving Uncertainty in MoE Router with Global Workspace Theory
di: Wu, Haoze, et al.
Pubblicazione: (2024)
di: Wu, Haoze, et al.
Pubblicazione: (2024)
MoE Lens -- An Expert Is All You Need
di: Chaudhari, Marmik, et al.
Pubblicazione: (2026)
di: Chaudhari, Marmik, et al.
Pubblicazione: (2026)
Pangu Ultra MoE: How to Train Your Big MoE on Ascend NPUs
di: Tang, Yehui, et al.
Pubblicazione: (2025)
di: Tang, Yehui, et al.
Pubblicazione: (2025)
Routing Matters in MoE: Scaling Diffusion Transformers with Explicit Routing Guidance
di: Wei, Yujie, et al.
Pubblicazione: (2025)
di: Wei, Yujie, et al.
Pubblicazione: (2025)
CAT-MoEformer: Context-Aware Temporal MoE Transformer for Beam Prediction
di: Zhou, Changkai, et al.
Pubblicazione: (2026)
di: Zhou, Changkai, et al.
Pubblicazione: (2026)
MoE-Sieve: Routing-Guided LoRA for Efficient MoE Fine-Tuning
di: Manzoni, Andrea
Pubblicazione: (2026)
di: Manzoni, Andrea
Pubblicazione: (2026)
LSH-MoE: Communication-efficient MoE Training via Locality-Sensitive Hashing
di: Nie, Xiaonan, et al.
Pubblicazione: (2024)
di: Nie, Xiaonan, et al.
Pubblicazione: (2024)
SP-MoE: Speculative Decoding and Prefetching for Accelerating MoE-based Model Inference
di: Chen, Liangkun, et al.
Pubblicazione: (2025)
di: Chen, Liangkun, et al.
Pubblicazione: (2025)
Adapted-MoE: Mixture of Experts with Test-Time Adaption for Anomaly Detection
di: Lei, Tianwu, et al.
Pubblicazione: (2024)
di: Lei, Tianwu, et al.
Pubblicazione: (2024)
Sigma-MoE-Tiny Technical Report
di: Hu, Qingguo, et al.
Pubblicazione: (2025)
di: Hu, Qingguo, et al.
Pubblicazione: (2025)
DiT4SR: Taming Diffusion Transformer for Real-World Image Super-Resolution
di: Duan, Zheng-Peng, et al.
Pubblicazione: (2025)
di: Duan, Zheng-Peng, et al.
Pubblicazione: (2025)
BIG-MoE: Bypass Isolated Gating MoE for Generalized Multimodal Face Anti-Spoofing
di: Ma, Yingjie, et al.
Pubblicazione: (2024)
di: Ma, Yingjie, et al.
Pubblicazione: (2024)
MoE-GPS: Guidlines for Prediction Strategy for Dynamic Expert Duplication in MoE Load Balancing
di: Ma, Haiyue, et al.
Pubblicazione: (2025)
di: Ma, Haiyue, et al.
Pubblicazione: (2025)
MoE-Compression: How the Compression Error of Experts Affects the Inference Accuracy of MoE Model?
di: Ma, Songkai, et al.
Pubblicazione: (2025)
di: Ma, Songkai, et al.
Pubblicazione: (2025)
MoE-Infinity: Efficient MoE Inference on Personal Machines with Sparsity-Aware Expert Cache
di: Xue, Leyang, et al.
Pubblicazione: (2024)
di: Xue, Leyang, et al.
Pubblicazione: (2024)
One-for-All Does Not Work! Enhancing Vulnerability Detection by Mixture-of-Experts (MoE)
di: Yang, Xu, et al.
Pubblicazione: (2025)
di: Yang, Xu, et al.
Pubblicazione: (2025)
MoESD: Unveil Speculative Decoding's Potential for Accelerating Sparse MoE
di: Huang, Zongle, et al.
Pubblicazione: (2025)
di: Huang, Zongle, et al.
Pubblicazione: (2025)
MoE-DP: An MoE-Enhanced Diffusion Policy for Robust Long-Horizon Robotic Manipulation with Skill Decomposition and Failure Recovery
di: Cheng, Baiye, et al.
Pubblicazione: (2025)
di: Cheng, Baiye, et al.
Pubblicazione: (2025)
GRIN: GRadient-INformed MoE
di: Liu, Liyuan, et al.
Pubblicazione: (2024)
di: Liu, Liyuan, et al.
Pubblicazione: (2024)
MoE-Gen: High-Throughput MoE Inference on a Single GPU with Module-Based Batching
di: Xu, Tairan, et al.
Pubblicazione: (2025)
di: Xu, Tairan, et al.
Pubblicazione: (2025)
MoE-DiffIR: Task-customized Diffusion Priors for Universal Compressed Image Restoration
di: Ren, Yulin, et al.
Pubblicazione: (2024)
di: Ren, Yulin, et al.
Pubblicazione: (2024)
MiLo: Efficient Quantized MoE Inference with Mixture of Low-Rank Compensators
di: Huang, Beichen, et al.
Pubblicazione: (2025)
di: Huang, Beichen, et al.
Pubblicazione: (2025)
MoE-GS: Mixture of Experts for Dynamic Gaussian Splatting
di: Jin, In-Hwan, et al.
Pubblicazione: (2025)
di: Jin, In-Hwan, et al.
Pubblicazione: (2025)
Staleness-Centric Optimizations for Parallel Diffusion MoE Inference
di: Luo, Jiajun, et al.
Pubblicazione: (2024)
di: Luo, Jiajun, et al.
Pubblicazione: (2024)
KBVQ-MoE: KLT-guided SVD with Bias-Corrected Vector Quantization for MoE Large Language Models
di: Xu, Zukang, et al.
Pubblicazione: (2026)
di: Xu, Zukang, et al.
Pubblicazione: (2026)
MoE-SpAc: Efficient MoE Inference Based on Speculative Activation Utility in Heterogeneous Edge Scenarios
di: Li, Shuhuai, et al.
Pubblicazione: (2026)
di: Li, Shuhuai, et al.
Pubblicazione: (2026)
DTop-p MoE: Sparsity-Controlled Dynamic Top-p MoE for Foundation Model Pre-training
di: Jin, Can, et al.
Pubblicazione: (2025)
di: Jin, Can, et al.
Pubblicazione: (2025)
D$^{2}$MoE: Dual Routing and Dynamic Scheduling for Efficient On-Device MoE-based LLM Serving
di: Wang, Haodong, et al.
Pubblicazione: (2025)
di: Wang, Haodong, et al.
Pubblicazione: (2025)
Documenti analoghi
-
DeblurDiff: Real-World Image Deblurring with Generative Diffusion Models
di: Kong, Lingshun, et al.
Pubblicazione: (2025) -
Mamoda2.5: Enhancing Unified Multimodal Model with DiT-MoE
di: Shi, Yangming, et al.
Pubblicazione: (2026) -
MoE-PHDS: One MoE checkpoint for flexible runtime sparsity
di: Hannah, Lauren. A, et al.
Pubblicazione: (2025) -
Dense2MoE: Restructuring Diffusion Transformer to MoE for Efficient Text-to-Image Generation
di: Zheng, Youwei, et al.
Pubblicazione: (2025) -
LLaDA-MoE: A Sparse MoE Diffusion Language Model
di: Zhu, Fengqi, et al.
Pubblicazione: (2025)