Input Domain Aware MoE: Decoupling Routing Decisions from Task Optimization in Mixture of Experts
Fuente:
arXiv
Salvato in:
| Autori principali: | Hua, Yongxiang, Cao, Haoyu, Tao, Zhou, Li, Bocheng, Wu, Zihao, Liu, Chaohu, Xu, Linli |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
TAG-MoE: Task-Aware Gating for Unified Generative Mixture-of-Experts
di: Xu, Yu, et al.
Pubblicazione: (2026)
di: Xu, Yu, et al.
Pubblicazione: (2026)
DiG: Differential Grounding for Enhancing Fine-Grained Perception in Multimodal Large Language Model
di: Tao, Zhou, et al.
Pubblicazione: (2025)
di: Tao, Zhou, et al.
Pubblicazione: (2025)
Harder Tasks Need More Experts: Dynamic Routing in MoE Models
di: Huang, Quzhe, et al.
Pubblicazione: (2024)
di: Huang, Quzhe, et al.
Pubblicazione: (2024)
BLR-MoE: Boosted Language-Routing Mixture of Experts for Domain-Robust Multilingual E2E ASR
di: Ma, Guodong, et al.
Pubblicazione: (2025)
di: Ma, Guodong, et al.
Pubblicazione: (2025)
CARL-MoE: Communication-Aware Adaptive Routing with Load-Balanced Expert Parallelism for Efficient Mixture-of-Experts Training
di: Jin, Haopeng
Pubblicazione: (2026)
di: Jin, Haopeng
Pubblicazione: (2026)
MH-MoE: Multi-Head Mixture-of-Experts
di: Huang, Shaohan, et al.
Pubblicazione: (2024)
di: Huang, Shaohan, et al.
Pubblicazione: (2024)
ECG-MoE: Mixture-of-Expert Electrocardiogram Foundation Model
di: Xu, Yuhao, et al.
Pubblicazione: (2026)
di: Xu, Yuhao, et al.
Pubblicazione: (2026)
CBDES MoE: Hierarchically Decoupled Mixture-of-Experts for Functional Modules in Autonomous Driving
di: Xiang, Qi, et al.
Pubblicazione: (2025)
di: Xiang, Qi, et al.
Pubblicazione: (2025)
PWC-MoE: Privacy-Aware Wireless Collaborative Mixture of Experts
di: Su, Yang, et al.
Pubblicazione: (2025)
di: Su, Yang, et al.
Pubblicazione: (2025)
Horseshoe Mixtures-of-Experts (HS-MoE)
di: Polson, Nick, et al.
Pubblicazione: (2026)
di: Polson, Nick, et al.
Pubblicazione: (2026)
LAR-MoE: Latent-Aligned Routing for Mixture of Experts in Robotic Imitation Learning
di: Rodriguez, Ariel, et al.
Pubblicazione: (2026)
di: Rodriguez, Ariel, et al.
Pubblicazione: (2026)
AdPO: Enhancing the Adversarial Robustness of Large Vision-Language Models with Preference Optimization
di: Liu, Chaohu, et al.
Pubblicazione: (2025)
di: Liu, Chaohu, et al.
Pubblicazione: (2025)
Elastic MoE: Unlocking the Inference-Time Scalability of Mixture-of-Experts
di: Gu, Naibin, et al.
Pubblicazione: (2025)
di: Gu, Naibin, et al.
Pubblicazione: (2025)
$\infty$-MoE: Generalizing Mixture of Experts to Infinite Experts
di: Takashiro, Shota, et al.
Pubblicazione: (2026)
di: Takashiro, Shota, et al.
Pubblicazione: (2026)
DA-MoE: Towards Dynamic Expert Allocation for Mixture-of-Experts Models
di: Aghdam, Maryam Akhavan, et al.
Pubblicazione: (2024)
di: Aghdam, Maryam Akhavan, et al.
Pubblicazione: (2024)
Grouter: Decoupling Routing from Representation for Accelerated MoE Training
di: Xu, Yuqi, et al.
Pubblicazione: (2026)
di: Xu, Yuqi, et al.
Pubblicazione: (2026)
MVMoE: Multi-Task Vehicle Routing Solver with Mixture-of-Experts
di: Zhou, Jianan, et al.
Pubblicazione: (2024)
di: Zhou, Jianan, et al.
Pubblicazione: (2024)
GRACE-MoE: Grouping and Replication with Locality-Aware Routing for Efficient Distributed MoE Inference
di: Han, Yu, et al.
Pubblicazione: (2025)
di: Han, Yu, et al.
Pubblicazione: (2025)
Break the Visual Perception: Adversarial Attacks Targeting Encoded Visual Tokens of Large Vision-Language Models
di: Wang, Yubo, et al.
Pubblicazione: (2024)
di: Wang, Yubo, et al.
Pubblicazione: (2024)
Statistic-Augmented, Decoupled MoE Routing and Aggregating in Autonomous Driving
di: Kou, Wei-Bin, et al.
Pubblicazione: (2025)
di: Kou, Wei-Bin, et al.
Pubblicazione: (2025)
EAC-MoE: Expert-Selection Aware Compressor for Mixture-of-Experts Large Language Models
di: Chen, Yuanteng, et al.
Pubblicazione: (2025)
di: Chen, Yuanteng, et al.
Pubblicazione: (2025)
Alloc-MoE: Budget-Aware Expert Activation Allocation for Efficient Mixture-of-Experts Inference
di: Liu, Baihui, et al.
Pubblicazione: (2026)
di: Liu, Baihui, et al.
Pubblicazione: (2026)
MoE-Loco: Mixture of Experts for Multitask Locomotion
di: Huang, Runhan, et al.
Pubblicazione: (2025)
di: Huang, Runhan, et al.
Pubblicazione: (2025)
MoE Jetpack: From Dense Checkpoints to Adaptive Mixture of Experts for Vision Tasks
di: Zhu, Xingkui, et al.
Pubblicazione: (2024)
di: Zhu, Xingkui, et al.
Pubblicazione: (2024)
AT-MoE: Adaptive Task-planning Mixture of Experts via LoRA Approach
di: Li, Xurui, et al.
Pubblicazione: (2024)
di: Li, Xurui, et al.
Pubblicazione: (2024)
Faster, Smaller, and Smarter: Task-Aware Expert Merging for Online MoE Inference
di: Han, Ziyi, et al.
Pubblicazione: (2025)
di: Han, Ziyi, et al.
Pubblicazione: (2025)
RQ-MoE: Residual Quantization via Mixture of Experts for Efficient Input-Dependent Vector Compression
di: Zhong, Zhengjia, et al.
Pubblicazione: (2026)
di: Zhong, Zhengjia, et al.
Pubblicazione: (2026)
One-for-All Does Not Work! Enhancing Vulnerability Detection by Mixture-of-Experts (MoE)
di: Yang, Xu, et al.
Pubblicazione: (2025)
di: Yang, Xu, et al.
Pubblicazione: (2025)
MoE++: Accelerating Mixture-of-Experts Methods with Zero-Computation Experts
di: Jin, Peng, et al.
Pubblicazione: (2024)
di: Jin, Peng, et al.
Pubblicazione: (2024)
MoBE: Mixture-of-Basis-Experts for Compressing MoE-based LLMs
di: Chen, Xiaodong, et al.
Pubblicazione: (2025)
di: Chen, Xiaodong, et al.
Pubblicazione: (2025)
MoE-LPR: Multilingual Extension of Large Language Models through Mixture-of-Experts with Language Priors Routing
di: Zhou, Hao, et al.
Pubblicazione: (2024)
di: Zhou, Hao, et al.
Pubblicazione: (2024)
Pangu Pro MoE: Mixture of Grouped Experts for Efficient Sparsity
di: Tang, Yehui, et al.
Pubblicazione: (2025)
di: Tang, Yehui, et al.
Pubblicazione: (2025)
eMoE: Task-aware Memory Efficient Mixture-of-Experts-Based (MoE) Model Inference
di: Tairin, Suraiya, et al.
Pubblicazione: (2025)
di: Tairin, Suraiya, et al.
Pubblicazione: (2025)
BEAM: Binary Expert Activation Masking for Dynamic Routing in MoE
di: Wu, Juntong, et al.
Pubblicazione: (2026)
di: Wu, Juntong, et al.
Pubblicazione: (2026)
AdaMoE: Token-Adaptive Routing with Null Experts for Mixture-of-Experts Language Models
di: Zeng, Zihao, et al.
Pubblicazione: (2024)
di: Zeng, Zihao, et al.
Pubblicazione: (2024)
FluxMoE: Decoupling Expert Residency for High-Performance MoE Serving
di: Liu, Qingxiu, et al.
Pubblicazione: (2026)
di: Liu, Qingxiu, et al.
Pubblicazione: (2026)
VA-MoE: Variables-Adaptive Mixture of Experts for Incremental Weather Forecasting
di: Chen, Hao, et al.
Pubblicazione: (2024)
di: Chen, Hao, et al.
Pubblicazione: (2024)
Mixture of Experts (MoE): A Big Data Perspective
di: Gan, Wensheng, et al.
Pubblicazione: (2025)
di: Gan, Wensheng, et al.
Pubblicazione: (2025)
SDG-MoE: Signed Debate Graph Mixture-of-Experts
di: Kulibaba, Stepan, et al.
Pubblicazione: (2026)
di: Kulibaba, Stepan, et al.
Pubblicazione: (2026)
MoE-GS: Mixture of Experts for Dynamic Gaussian Splatting
di: Jin, In-Hwan, et al.
Pubblicazione: (2025)
di: Jin, In-Hwan, et al.
Pubblicazione: (2025)
Documenti analoghi
-
TAG-MoE: Task-Aware Gating for Unified Generative Mixture-of-Experts
di: Xu, Yu, et al.
Pubblicazione: (2026) -
DiG: Differential Grounding for Enhancing Fine-Grained Perception in Multimodal Large Language Model
di: Tao, Zhou, et al.
Pubblicazione: (2025) -
Harder Tasks Need More Experts: Dynamic Routing in MoE Models
di: Huang, Quzhe, et al.
Pubblicazione: (2024) -
BLR-MoE: Boosted Language-Routing Mixture of Experts for Domain-Robust Multilingual E2E ASR
di: Ma, Guodong, et al.
Pubblicazione: (2025) -
CARL-MoE: Communication-Aware Adaptive Routing with Load-Balanced Expert Parallelism for Efficient Mixture-of-Experts Training
di: Jin, Haopeng
Pubblicazione: (2026)