CoCoAFusE: Beyond Mixtures of Experts via Model Fusion
Fuente:
arXiv
Salvato in:
| Autori principali: | Ugolini, Aurelio Raffa, Tanelli, Mara, Breschi, Valentina |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
SINDy vs Hard Nonlinearities and Hidden Dynamics: a Benchmarking Study
di: Ugolini, Aurelio Raffa, et al.
Pubblicazione: (2024)
di: Ugolini, Aurelio Raffa, et al.
Pubblicazione: (2024)
Explainable Condition Monitoring via Probabilistic Anomaly Detection Applied to Helicopter Transmissions
di: Ugolini, Aurelio Raffa, et al.
Pubblicazione: (2026)
di: Ugolini, Aurelio Raffa, et al.
Pubblicazione: (2026)
Explainable data-driven modeling via mixture of experts: towards effective blending of grey and black-box models
di: Leoni, Jessica, et al.
Pubblicazione: (2024)
di: Leoni, Jessica, et al.
Pubblicazione: (2024)
MoE-DisCo:Low Economy Cost Training Mixture-of-Experts Models
di: Ye, Xin, et al.
Pubblicazione: (2026)
di: Ye, Xin, et al.
Pubblicazione: (2026)
CoSMoEs: Compact Sparse Mixture of Experts
di: Huber, Patrick, et al.
Pubblicazione: (2025)
di: Huber, Patrick, et al.
Pubblicazione: (2025)
FuseMoE: Mixture-of-Experts Transformers for Fleximodal Fusion
di: Han, Xing, et al.
Pubblicazione: (2024)
di: Han, Xing, et al.
Pubblicazione: (2024)
CoMoE: Contrastive Representation for Mixture-of-Experts in Parameter-Efficient Fine-tuning
di: Feng, Jinyuan, et al.
Pubblicazione: (2025)
di: Feng, Jinyuan, et al.
Pubblicazione: (2025)
On Expert Estimation in Hierarchical Mixture of Experts: Beyond Softmax Gating Functions
di: Nguyen, Huy, et al.
Pubblicazione: (2024)
di: Nguyen, Huy, et al.
Pubblicazione: (2024)
Towards Efficient Pareto Set Approximation via Mixture of Experts Based Model Fusion
di: Tang, Anke, et al.
Pubblicazione: (2024)
di: Tang, Anke, et al.
Pubblicazione: (2024)
Beyond Distributive Justice: Hermeneutical Fairness in Ad Delivery
di: Quaresmini, Camilla, et al.
Pubblicazione: (2026)
di: Quaresmini, Camilla, et al.
Pubblicazione: (2026)
Optimal Policy Design for Repeated Decision-Making under Social Influence
di: Ravazzi, Chiara, et al.
Pubblicazione: (2025)
di: Ravazzi, Chiara, et al.
Pubblicazione: (2025)
The epistemic dimension of algorithmic fairness: assessing its impact in innovation diffusion and fair policy making
di: Villa, Eugenia, et al.
Pubblicazione: (2025)
di: Villa, Eugenia, et al.
Pubblicazione: (2025)
Optimal policy design for innovation diffusion: shaping today's incentives for transforming the future
di: Piccinin, Lisa, et al.
Pubblicazione: (2025)
di: Piccinin, Lisa, et al.
Pubblicazione: (2025)
Innovation diffusion dynamics toward long-term behavioral shifts
di: Piccinin, Lisa, et al.
Pubblicazione: (2025)
di: Piccinin, Lisa, et al.
Pubblicazione: (2025)
Optimal policy design for decision problems under social influence
di: Breschi, Valentina, et al.
Pubblicazione: (2024)
di: Breschi, Valentina, et al.
Pubblicazione: (2024)
Fairness-aware design of nudging policies under stochasticity and prejudices
di: Piccinin, Lisa, et al.
Pubblicazione: (2026)
di: Piccinin, Lisa, et al.
Pubblicazione: (2026)
Read-ME: Refactorizing LLMs as Router-Decoupled Mixture of Experts with System Co-Design
di: Cai, Ruisi, et al.
Pubblicazione: (2024)
di: Cai, Ruisi, et al.
Pubblicazione: (2024)
DA-MoE: Towards Dynamic Expert Allocation for Mixture-of-Experts Models
di: Aghdam, Maryam Akhavan, et al.
Pubblicazione: (2024)
di: Aghdam, Maryam Akhavan, et al.
Pubblicazione: (2024)
Beyond Benchmarks: Understanding Mixture-of-Experts Models through Internal Mechanisms
di: Ying, Jiahao, et al.
Pubblicazione: (2025)
di: Ying, Jiahao, et al.
Pubblicazione: (2025)
Pre-gated MoE: An Algorithm-System Co-Design for Fast and Scalable Mixture-of-Expert Inference
di: Hwang, Ranggi, et al.
Pubblicazione: (2023)
di: Hwang, Ranggi, et al.
Pubblicazione: (2023)
Modeling Expert Interactions in Sparse Mixture of Experts via Graph Structures
di: Nguyen-Nhat, Minh-Khoi, et al.
Pubblicazione: (2025)
di: Nguyen-Nhat, Minh-Khoi, et al.
Pubblicazione: (2025)
Mixture of Linear Models Co-supervised by Deep Neural Networks
di: Seo, Beomseok, et al.
Pubblicazione: (2021)
di: Seo, Beomseok, et al.
Pubblicazione: (2021)
Sub-MoE: Efficient Mixture-of-Expert LLMs Compression via Subspace Expert Merging
di: Li, Lujun, et al.
Pubblicazione: (2025)
di: Li, Lujun, et al.
Pubblicazione: (2025)
MLP Fusion: Towards Efficient Fine-tuning of Dense and Mixture-of-Experts Language Models
di: Ai, Mengting, et al.
Pubblicazione: (2023)
di: Ai, Mengting, et al.
Pubblicazione: (2023)
Temporally Extended Mixture-of-Experts Models
di: Shen, Zeyu, et al.
Pubblicazione: (2026)
di: Shen, Zeyu, et al.
Pubblicazione: (2026)
Beyond Sunk Costs: Boosting LLM Pre-training Efficiency via Orthogonal Growth of Mixture-of-Experts
di: Wang, Ruizhe, et al.
Pubblicazione: (2025)
di: Wang, Ruizhe, et al.
Pubblicazione: (2025)
Co-Supervised Learning: Improving Weak-to-Strong Generalization with Hierarchical Mixture of Experts
di: Liu, Yuejiang, et al.
Pubblicazione: (2024)
di: Liu, Yuejiang, et al.
Pubblicazione: (2024)
Continual Traffic Forecasting via Mixture of Experts
di: Lee, Sanghyun, et al.
Pubblicazione: (2024)
di: Lee, Sanghyun, et al.
Pubblicazione: (2024)
HMoE: Heterogeneous Mixture of Experts for Language Modeling
di: Wang, An, et al.
Pubblicazione: (2024)
di: Wang, An, et al.
Pubblicazione: (2024)
Beyond Parameter Count: Implicit Bias in Soft Mixture of Experts
di: Chung, Youngseog, et al.
Pubblicazione: (2024)
di: Chung, Youngseog, et al.
Pubblicazione: (2024)
HyperMoE: Towards Better Mixture of Experts via Transferring Among Experts
di: Zhao, Hao, et al.
Pubblicazione: (2024)
di: Zhao, Hao, et al.
Pubblicazione: (2024)
MoE-Prism: Disentangling Monolithic Experts for Elastic MoE Services via Model-System Co-Designs
di: Xia, Xinfeng, et al.
Pubblicazione: (2025)
di: Xia, Xinfeng, et al.
Pubblicazione: (2025)
Horseshoe Mixtures-of-Experts (HS-MoE)
di: Polson, Nick, et al.
Pubblicazione: (2026)
di: Polson, Nick, et al.
Pubblicazione: (2026)
FedMoE: Personalized Federated Learning via Heterogeneous Mixture of Experts
di: Mei, Hanzi, et al.
Pubblicazione: (2024)
di: Mei, Hanzi, et al.
Pubblicazione: (2024)
CompeteSMoE -- Effective Training of Sparse Mixture of Experts via Competition
di: Pham, Quang, et al.
Pubblicazione: (2024)
di: Pham, Quang, et al.
Pubblicazione: (2024)
Automatic Expert Discovery in LLM Upcycling via Sparse Interpolated Mixture-of-Experts
di: Chen, Shengzhuang, et al.
Pubblicazione: (2025)
di: Chen, Shengzhuang, et al.
Pubblicazione: (2025)
MC#: Mixture Compressor for Mixture-of-Experts Large Models
di: Huang, Wei, et al.
Pubblicazione: (2025)
di: Huang, Wei, et al.
Pubblicazione: (2025)
Varying-Coefficient Mixture of Experts Model
di: Zhao, Qicheng, et al.
Pubblicazione: (2026)
di: Zhao, Qicheng, et al.
Pubblicazione: (2026)
Flex-MoE: Modeling Arbitrary Modality Combination via the Flexible Mixture-of-Experts
di: Yun, Sukwon, et al.
Pubblicazione: (2024)
di: Yun, Sukwon, et al.
Pubblicazione: (2024)
Efficiently Editing Mixture-of-Experts Models with Compressed Experts
di: He, Yifei, et al.
Pubblicazione: (2025)
di: He, Yifei, et al.
Pubblicazione: (2025)
Documenti analoghi
-
SINDy vs Hard Nonlinearities and Hidden Dynamics: a Benchmarking Study
di: Ugolini, Aurelio Raffa, et al.
Pubblicazione: (2024) -
Explainable Condition Monitoring via Probabilistic Anomaly Detection Applied to Helicopter Transmissions
di: Ugolini, Aurelio Raffa, et al.
Pubblicazione: (2026) -
Explainable data-driven modeling via mixture of experts: towards effective blending of grey and black-box models
di: Leoni, Jessica, et al.
Pubblicazione: (2024) -
MoE-DisCo:Low Economy Cost Training Mixture-of-Experts Models
di: Ye, Xin, et al.
Pubblicazione: (2026) -
CoSMoEs: Compact Sparse Mixture of Experts
di: Huber, Patrick, et al.
Pubblicazione: (2025)