Flex-MoE: Modeling Arbitrary Modality Combination via the Flexible Mixture-of-Experts
Fuente:
arXiv
Salvato in:
| Autori principali: | Yun, Sukwon, Choi, Inyoung, Peng, Jie, Wu, Yangfan, Bao, Jingxuan, Zhang, Qiyiwen, Xin, Jiayi, Long, Qi, Chen, Tianlong |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
I2MoE: Interpretable Multimodal Interaction-aware Mixture-of-Experts
di: Xin, Jiayi, et al.
Pubblicazione: (2025)
di: Xin, Jiayi, et al.
Pubblicazione: (2025)
Hexa-MoE: Efficient and Heterogeneous-aware Training for Mixture-of-Experts
di: Luo, Shuqing, et al.
Pubblicazione: (2024)
di: Luo, Shuqing, et al.
Pubblicazione: (2024)
Skill-Based Mixture-of-Experts: Adaptive Routing for Heterogeneous Reasoning via Inferred Skills
di: Chen, Justin Chih-Yao, et al.
Pubblicazione: (2025)
di: Chen, Justin Chih-Yao, et al.
Pubblicazione: (2025)
Leave It to the Experts: Detecting Knowledge Distillation via MoE Expert Signatures
di: Li, Pingzhi, et al.
Pubblicazione: (2025)
di: Li, Pingzhi, et al.
Pubblicazione: (2025)
$\texttt{MoE-RBench}$: Towards Building Reliable Language Models with Sparse Mixture-of-Experts
di: Chen, Guanjie, et al.
Pubblicazione: (2024)
di: Chen, Guanjie, et al.
Pubblicazione: (2024)
Efficient MAP Estimation of LLM Judgment Performance with Prior Transfer
di: Qu, Huaizhi, et al.
Pubblicazione: (2025)
di: Qu, Huaizhi, et al.
Pubblicazione: (2025)
MoE++: Accelerating Mixture-of-Experts Methods with Zero-Computation Experts
di: Jin, Peng, et al.
Pubblicazione: (2024)
di: Jin, Peng, et al.
Pubblicazione: (2024)
MoE-GS: Mixture of Experts for Dynamic Gaussian Splatting
di: Jin, In-Hwan, et al.
Pubblicazione: (2025)
di: Jin, In-Hwan, et al.
Pubblicazione: (2025)
Mixture of Experts (MoE): A Big Data Perspective
di: Gan, Wensheng, et al.
Pubblicazione: (2025)
di: Gan, Wensheng, et al.
Pubblicazione: (2025)
DAG-MoE: From Simple Mixture to Structural Aggregation in Mixture-of-Experts
di: Feng, Jiarui, et al.
Pubblicazione: (2026)
di: Feng, Jiarui, et al.
Pubblicazione: (2026)
Symphony-MoE: Harmonizing Disparate Pre-trained Models into a Coherent Mixture-of-Experts
di: Wang, Qi, et al.
Pubblicazione: (2025)
di: Wang, Qi, et al.
Pubblicazione: (2025)
Horseshoe Mixtures-of-Experts (HS-MoE)
di: Polson, Nick, et al.
Pubblicazione: (2026)
di: Polson, Nick, et al.
Pubblicazione: (2026)
$\infty$-MoE: Generalizing Mixture of Experts to Infinite Experts
di: Takashiro, Shota, et al.
Pubblicazione: (2026)
di: Takashiro, Shota, et al.
Pubblicazione: (2026)
Advancing MoE Efficiency: A Collaboration-Constrained Routing (C2R) Strategy for Better Expert Parallelism Design
di: Zhang, Mohan, et al.
Pubblicazione: (2025)
di: Zhang, Mohan, et al.
Pubblicazione: (2025)
MoE-GRPO: Optimizing Mixture-of-Experts via Reinforcement Learning in Vision-Language Models
di: Ko, Dohwan, et al.
Pubblicazione: (2026)
di: Ko, Dohwan, et al.
Pubblicazione: (2026)
MH-MoE: Multi-Head Mixture-of-Experts
di: Huang, Shaohan, et al.
Pubblicazione: (2024)
di: Huang, Shaohan, et al.
Pubblicazione: (2024)
MoE-Loco: Mixture of Experts for Multitask Locomotion
di: Huang, Runhan, et al.
Pubblicazione: (2025)
di: Huang, Runhan, et al.
Pubblicazione: (2025)
MegaScale-MoE: Large-Scale Communication-Efficient Training of Mixture-of-Experts Models in Production
di: Jin, Chao, et al.
Pubblicazione: (2025)
di: Jin, Chao, et al.
Pubblicazione: (2025)
Occult: Optimizing Collaborative Communication across Experts for Accelerated Parallel MoE Training and Inference
di: Luo, Shuqing, et al.
Pubblicazione: (2025)
di: Luo, Shuqing, et al.
Pubblicazione: (2025)
MoE3D: Mixture of Experts meets Multi-Modal 3D Understanding
di: Li, Yu, et al.
Pubblicazione: (2025)
di: Li, Yu, et al.
Pubblicazione: (2025)
MoBE: Mixture-of-Basis-Experts for Compressing MoE-based LLMs
di: Chen, Xiaodong, et al.
Pubblicazione: (2025)
di: Chen, Xiaodong, et al.
Pubblicazione: (2025)
Elastic MoE: Unlocking the Inference-Time Scalability of Mixture-of-Experts
di: Gu, Naibin, et al.
Pubblicazione: (2025)
di: Gu, Naibin, et al.
Pubblicazione: (2025)
VA-MoE: Variables-Adaptive Mixture of Experts for Incremental Weather Forecasting
di: Chen, Hao, et al.
Pubblicazione: (2024)
di: Chen, Hao, et al.
Pubblicazione: (2024)
Mew: Multiplexed Immunofluorescence Image Analysis through an Efficient Multiplex Network
di: Yun, Sukwon, et al.
Pubblicazione: (2024)
di: Yun, Sukwon, et al.
Pubblicazione: (2024)
Sub-MoE: Efficient Mixture-of-Expert LLMs Compression via Subspace Expert Merging
di: Li, Lujun, et al.
Pubblicazione: (2025)
di: Li, Lujun, et al.
Pubblicazione: (2025)
S2MoE: Robust Sparse Mixture of Experts via Stochastic Learning
di: Do, Giang, et al.
Pubblicazione: (2025)
di: Do, Giang, et al.
Pubblicazione: (2025)
CBDES MoE: Hierarchically Decoupled Mixture-of-Experts for Functional Modules in Autonomous Driving
di: Xiang, Qi, et al.
Pubblicazione: (2025)
di: Xiang, Qi, et al.
Pubblicazione: (2025)
SDG-MoE: Signed Debate Graph Mixture-of-Experts
di: Kulibaba, Stepan, et al.
Pubblicazione: (2026)
di: Kulibaba, Stepan, et al.
Pubblicazione: (2026)
ECG-MoE: Mixture-of-Expert Electrocardiogram Foundation Model
di: Xu, Yuhao, et al.
Pubblicazione: (2026)
di: Xu, Yuhao, et al.
Pubblicazione: (2026)
MoE-DisCo:Low Economy Cost Training Mixture-of-Experts Models
di: Ye, Xin, et al.
Pubblicazione: (2026)
di: Ye, Xin, et al.
Pubblicazione: (2026)
DA-MoE: Towards Dynamic Expert Allocation for Mixture-of-Experts Models
di: Aghdam, Maryam Akhavan, et al.
Pubblicazione: (2024)
di: Aghdam, Maryam Akhavan, et al.
Pubblicazione: (2024)
SEER-MoE: Sparse Expert Efficiency through Regularization for Mixture-of-Experts
di: Muzio, Alexandre, et al.
Pubblicazione: (2024)
di: Muzio, Alexandre, et al.
Pubblicazione: (2024)
MoE-FFD: Mixture of Experts for Generalized and Parameter-Efficient Face Forgery Detection
di: Kong, Chenqi, et al.
Pubblicazione: (2024)
di: Kong, Chenqi, et al.
Pubblicazione: (2024)
FlexMoRE: A Flexible Mixture of Rank-heterogeneous Experts for Efficient Federatedly-trained Large Language Models
di: Pirchert, Annemette Brok, et al.
Pubblicazione: (2026)
di: Pirchert, Annemette Brok, et al.
Pubblicazione: (2026)
MoE-LLaVA: Mixture of Experts for Large Vision-Language Models
di: Lin, Bin, et al.
Pubblicazione: (2024)
di: Lin, Bin, et al.
Pubblicazione: (2024)
SMoES: Soft Modality-Guided Expert Specialization in MoE-VLMs
di: Bo, Zi-Hao, et al.
Pubblicazione: (2026)
di: Bo, Zi-Hao, et al.
Pubblicazione: (2026)
MoE-SpeQ: Speculative Quantized Decoding with Proactive Expert Prefetching and Offloading for Mixture-of-Experts
di: Wang, Wenfeng, et al.
Pubblicazione: (2025)
di: Wang, Wenfeng, et al.
Pubblicazione: (2025)
AT-MoE: Adaptive Task-planning Mixture of Experts via LoRA Approach
di: Li, Xurui, et al.
Pubblicazione: (2024)
di: Li, Xurui, et al.
Pubblicazione: (2024)
AW-MoE: All-Weather Mixture of Experts for Robust Multi-Modal 3D Object Detection
di: Lin, Hongwei, et al.
Pubblicazione: (2026)
di: Lin, Hongwei, et al.
Pubblicazione: (2026)
MoE-CE: Enhancing Generalization for Deep Learning based Channel Estimation via a Mixture-of-Experts Framework
di: Li, Tianyu, et al.
Pubblicazione: (2025)
di: Li, Tianyu, et al.
Pubblicazione: (2025)
Documenti analoghi
-
I2MoE: Interpretable Multimodal Interaction-aware Mixture-of-Experts
di: Xin, Jiayi, et al.
Pubblicazione: (2025) -
Hexa-MoE: Efficient and Heterogeneous-aware Training for Mixture-of-Experts
di: Luo, Shuqing, et al.
Pubblicazione: (2024) -
Skill-Based Mixture-of-Experts: Adaptive Routing for Heterogeneous Reasoning via Inferred Skills
di: Chen, Justin Chih-Yao, et al.
Pubblicazione: (2025) -
Leave It to the Experts: Detecting Knowledge Distillation via MoE Expert Signatures
di: Li, Pingzhi, et al.
Pubblicazione: (2025) -
$\texttt{MoE-RBench}$: Towards Building Reliable Language Models with Sparse Mixture-of-Experts
di: Chen, Guanjie, et al.
Pubblicazione: (2024)