DirMoE: Dirichlet-routed Mixture of Experts
Fuente:
arXiv
Salvato in:
| Autori principali: | Vahidi, Amirhossein, Asadollahzadeh, Hesam, Attar, Navid Akhavan, Moullet, Marie, Ly, Kevin, Yang, Xingyi, Lotfollahi, Mohammad |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Softmax is not Enough (for Adaptive Conformal Classification)
di: Attar, Navid Akhavan, et al.
Pubblicazione: (2026)
di: Attar, Navid Akhavan, et al.
Pubblicazione: (2026)
DA-MoE: Towards Dynamic Expert Allocation for Mixture-of-Experts Models
di: Aghdam, Maryam Akhavan, et al.
Pubblicazione: (2024)
di: Aghdam, Maryam Akhavan, et al.
Pubblicazione: (2024)
SIGMMA: Hierarchical Graph-Based Multi-Scale Multi-modal Contrastive Alignment of Histopathology Image and Spatial Transcriptome
di: Jeong, Dabin, et al.
Pubblicazione: (2025)
di: Jeong, Dabin, et al.
Pubblicazione: (2025)
Shortest-Path Flow Matching with Mixture-Conditioned Bases for OOD Generalization to Unseen Conditions
di: Rubbi, Andrea, et al.
Pubblicazione: (2026)
di: Rubbi, Andrea, et al.
Pubblicazione: (2026)
Horseshoe Mixtures-of-Experts (HS-MoE)
di: Polson, Nick, et al.
Pubblicazione: (2026)
di: Polson, Nick, et al.
Pubblicazione: (2026)
TRACER: Persistent Regularization for Robust Multimodal Finetuning
di: Asadollahzadeh, Hesam, et al.
Pubblicazione: (2026)
di: Asadollahzadeh, Hesam, et al.
Pubblicazione: (2026)
MoBE: Mixture-of-Basis-Experts for Compressing MoE-based LLMs
di: Chen, Xiaodong, et al.
Pubblicazione: (2025)
di: Chen, Xiaodong, et al.
Pubblicazione: (2025)
$\infty$-MoE: Generalizing Mixture of Experts to Infinite Experts
di: Takashiro, Shota, et al.
Pubblicazione: (2026)
di: Takashiro, Shota, et al.
Pubblicazione: (2026)
FuseMoE: Mixture-of-Experts Transformers for Fleximodal Fusion
di: Han, Xing, et al.
Pubblicazione: (2024)
di: Han, Xing, et al.
Pubblicazione: (2024)
PreMoE: Proactive Inference for Efficient Mixture-of-Experts
di: Pei, Zehua, et al.
Pubblicazione: (2025)
di: Pei, Zehua, et al.
Pubblicazione: (2025)
MoE++: Accelerating Mixture-of-Experts Methods with Zero-Computation Experts
di: Jin, Peng, et al.
Pubblicazione: (2024)
di: Jin, Peng, et al.
Pubblicazione: (2024)
Mixture of Experts Made Intrinsically Interpretable
di: Yang, Xingyi, et al.
Pubblicazione: (2025)
di: Yang, Xingyi, et al.
Pubblicazione: (2025)
PWC-MoE: Privacy-Aware Wireless Collaborative Mixture of Experts
di: Su, Yang, et al.
Pubblicazione: (2025)
di: Su, Yang, et al.
Pubblicazione: (2025)
LightMoE: Reducing Mixture-of-Experts Redundancy through Expert Replacing
di: Hao, Jiawei, et al.
Pubblicazione: (2026)
di: Hao, Jiawei, et al.
Pubblicazione: (2026)
SEER-MoE: Sparse Expert Efficiency through Regularization for Mixture-of-Experts
di: Muzio, Alexandre, et al.
Pubblicazione: (2024)
di: Muzio, Alexandre, et al.
Pubblicazione: (2024)
FLEX-MoE: Federated Mixture-of-Experts with Load-balanced Expert Assignment for Edge Computing
di: Zhang, Boyang, et al.
Pubblicazione: (2025)
di: Zhang, Boyang, et al.
Pubblicazione: (2025)
Sub-MoE: Efficient Mixture-of-Expert LLMs Compression via Subspace Expert Merging
di: Li, Lujun, et al.
Pubblicazione: (2025)
di: Li, Lujun, et al.
Pubblicazione: (2025)
BuddyMoE: Exploiting Expert Redundancy to Accelerate Memory-Constrained Mixture-of-Experts Inference
di: Wang, Yun, et al.
Pubblicazione: (2025)
di: Wang, Yun, et al.
Pubblicazione: (2025)
MoWE : A Mixture of Weather Experts
di: Chakraborty, Dibyajyoti, et al.
Pubblicazione: (2025)
di: Chakraborty, Dibyajyoti, et al.
Pubblicazione: (2025)
Dirichlet-Prior Shaping: Guiding Expert Specialization in Upcycled MoEs
di: Mirvakhabova, Leyla, et al.
Pubblicazione: (2025)
di: Mirvakhabova, Leyla, et al.
Pubblicazione: (2025)
Graph-Conditioned Mixture of Graph Neural Network Experts for Traffic Forecasting
di: Ghaffari, Amirhossein, et al.
Pubblicazione: (2026)
di: Ghaffari, Amirhossein, et al.
Pubblicazione: (2026)
Mixture of Experts (MoE): A Big Data Perspective
di: Gan, Wensheng, et al.
Pubblicazione: (2025)
di: Gan, Wensheng, et al.
Pubblicazione: (2025)
SDG-MoE: Signed Debate Graph Mixture-of-Experts
di: Kulibaba, Stepan, et al.
Pubblicazione: (2026)
di: Kulibaba, Stepan, et al.
Pubblicazione: (2026)
ProbMoE: Differentiable Probabilistic Routing for Mixture-of-Experts
di: Zhao, Heng, et al.
Pubblicazione: (2026)
di: Zhao, Heng, et al.
Pubblicazione: (2026)
MobileMoE: Scaling On-Device Mixture of Experts
di: Chen, Yanbei, et al.
Pubblicazione: (2026)
di: Chen, Yanbei, et al.
Pubblicazione: (2026)
MoPEQ: Mixture of Mixed Precision Quantized Experts
di: Chitty-Venkata, Krishna Teja, et al.
Pubblicazione: (2025)
di: Chitty-Venkata, Krishna Teja, et al.
Pubblicazione: (2025)
HyperMoE: Towards Better Mixture of Experts via Transferring Among Experts
di: Zhao, Hao, et al.
Pubblicazione: (2024)
di: Zhao, Hao, et al.
Pubblicazione: (2024)
MoE-Health: A Mixture of Experts Framework for Robust Multimodal Healthcare Prediction
di: Wang, Xiaoyang, et al.
Pubblicazione: (2025)
di: Wang, Xiaoyang, et al.
Pubblicazione: (2025)
GateTS: Versatile and Efficient Forecasting via Attention-Inspired routed Mixture-of-Experts
di: Yemets, Kyrylo, et al.
Pubblicazione: (2025)
di: Yemets, Kyrylo, et al.
Pubblicazione: (2025)
ReMoE: Fully Differentiable Mixture-of-Experts with ReLU Routing
di: Wang, Ziteng, et al.
Pubblicazione: (2024)
di: Wang, Ziteng, et al.
Pubblicazione: (2024)
FedMoE: Personalized Federated Learning via Heterogeneous Mixture of Experts
di: Mei, Hanzi, et al.
Pubblicazione: (2024)
di: Mei, Hanzi, et al.
Pubblicazione: (2024)
Anchor-MoE: A Mean-Anchored Mixture of Experts For Probabilistic Regression
di: Su, Baozhuo, et al.
Pubblicazione: (2025)
di: Su, Baozhuo, et al.
Pubblicazione: (2025)
HI-MoE: Hierarchical Instance-Conditioned Mixture-of-Experts for Object Detection
di: Vashkelis, Vadim, et al.
Pubblicazione: (2026)
di: Vashkelis, Vadim, et al.
Pubblicazione: (2026)
DriftMoE: A Mixture of Experts Approach to Handle Concept Drifts
di: Aspis, Miguel, et al.
Pubblicazione: (2025)
di: Aspis, Miguel, et al.
Pubblicazione: (2025)
FT-MoE: Sustainable-learning Mixture of Experts for Fault-Tolerant Computing
di: Xiao, Wenjing, et al.
Pubblicazione: (2025)
di: Xiao, Wenjing, et al.
Pubblicazione: (2025)
MoFE: Mixture of Frozen Experts Architecture
di: Seo, Jean, et al.
Pubblicazione: (2025)
di: Seo, Jean, et al.
Pubblicazione: (2025)
SERE: Similarity-based Expert Re-routing for Efficient Batch Decoding in MoE Models
di: Wu, Juntong, et al.
Pubblicazione: (2026)
di: Wu, Juntong, et al.
Pubblicazione: (2026)
LatentMoE: Toward Optimal Accuracy per FLOP and Parameter in Mixture of Experts
di: Elango, Venmugil, et al.
Pubblicazione: (2026)
di: Elango, Venmugil, et al.
Pubblicazione: (2026)
MoE-I$^2$: Compressing Mixture of Experts Models through Inter-Expert Pruning and Intra-Expert Low-Rank Decomposition
di: Yang, Cheng, et al.
Pubblicazione: (2024)
di: Yang, Cheng, et al.
Pubblicazione: (2024)
EAC-MoE: Expert-Selection Aware Compressor for Mixture-of-Experts Large Language Models
di: Chen, Yuanteng, et al.
Pubblicazione: (2025)
di: Chen, Yuanteng, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Softmax is not Enough (for Adaptive Conformal Classification)
di: Attar, Navid Akhavan, et al.
Pubblicazione: (2026) -
DA-MoE: Towards Dynamic Expert Allocation for Mixture-of-Experts Models
di: Aghdam, Maryam Akhavan, et al.
Pubblicazione: (2024) -
SIGMMA: Hierarchical Graph-Based Multi-Scale Multi-modal Contrastive Alignment of Histopathology Image and Spatial Transcriptome
di: Jeong, Dabin, et al.
Pubblicazione: (2025) -
Shortest-Path Flow Matching with Mixture-Conditioned Bases for OOD Generalization to Unseen Conditions
di: Rubbi, Andrea, et al.
Pubblicazione: (2026) -
Horseshoe Mixtures-of-Experts (HS-MoE)
di: Polson, Nick, et al.
Pubblicazione: (2026)