MP-ISMoE: Mixed-Precision Interactive Side Mixture-of-Experts for Efficient Transfer Learning
Fuente:
arXiv
Salvato in:
| Autori principali: | Zhang, Yutong, Wu, Zimeng, Liao, Shangcai, Wu, Shujiang, Chen, Jiaxin |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
MP-MoE: Matrix Profile-Guided Mixture of Experts for Precipitation Forecasting
di: Tran, Huyen Ngoc, et al.
Pubblicazione: (2026)
di: Tran, Huyen Ngoc, et al.
Pubblicazione: (2026)
HyperMoE: Towards Better Mixture of Experts via Transferring Among Experts
di: Zhao, Hao, et al.
Pubblicazione: (2024)
di: Zhao, Hao, et al.
Pubblicazione: (2024)
STaMP: Sequence Transformation and Mixed Precision for Low-Precision Activation Quantization
di: Federici, Marco, et al.
Pubblicazione: (2025)
di: Federici, Marco, et al.
Pubblicazione: (2025)
Mixture-of-Experts Meets In-Context Reinforcement Learning
di: Wu, Wenhao, et al.
Pubblicazione: (2025)
di: Wu, Wenhao, et al.
Pubblicazione: (2025)
Efficiently Editing Mixture-of-Experts Models with Compressed Experts
di: He, Yifei, et al.
Pubblicazione: (2025)
di: He, Yifei, et al.
Pubblicazione: (2025)
RaMP: Runtime-Aware Megakernel Polymorphism for Mixture-of-Experts
di: Sharma, Vyom, et al.
Pubblicazione: (2026)
di: Sharma, Vyom, et al.
Pubblicazione: (2026)
MC#: Mixture Compressor for Mixture-of-Experts Large Models
di: Huang, Wei, et al.
Pubblicazione: (2025)
di: Huang, Wei, et al.
Pubblicazione: (2025)
MoEMeta: Mixture-of-Experts Meta Learning for Few-Shot Relational Learning
di: Wu, Han, et al.
Pubblicazione: (2025)
di: Wu, Han, et al.
Pubblicazione: (2025)
Contrastive Learning and Mixture of Experts Enables Precise Vector Embeddings
di: Hallee, Logan, et al.
Pubblicazione: (2024)
di: Hallee, Logan, et al.
Pubblicazione: (2024)
Towards Generalization-Oriented Models for Vehicle Routing Problems with Mixture-of-Experts
di: Miao, Changhao, et al.
Pubblicazione: (2026)
di: Miao, Changhao, et al.
Pubblicazione: (2026)
MoR: Mixture Of Representations For Mixed-Precision Training
di: Su, Bor-Yiing, et al.
Pubblicazione: (2025)
di: Su, Bor-Yiing, et al.
Pubblicazione: (2025)
MP-DPD: Low-Complexity Mixed-Precision Neural Networks for Energy-Efficient Digital Predistortion of Wideband Power Amplifiers
di: Wu, Yizhuo, et al.
Pubblicazione: (2024)
di: Wu, Yizhuo, et al.
Pubblicazione: (2024)
MVMoE: Multi-Task Vehicle Routing Solver with Mixture-of-Experts
di: Zhou, Jianan, et al.
Pubblicazione: (2024)
di: Zhou, Jianan, et al.
Pubblicazione: (2024)
Efficient Handwriting-Based Alzheimer,s Disease Diagnosis Using a Low-Rank Mixture of Experts Deep Learning Framework
di: Wang, Wu, et al.
Pubblicazione: (2026)
di: Wang, Wu, et al.
Pubblicazione: (2026)
Modeling Expert Interactions in Sparse Mixture of Experts via Graph Structures
di: Nguyen-Nhat, Minh-Khoi, et al.
Pubblicazione: (2025)
di: Nguyen-Nhat, Minh-Khoi, et al.
Pubblicazione: (2025)
dFLMoE: Decentralized Federated Learning via Mixture of Experts for Medical Data Analysis
di: Xie, Luyuan, et al.
Pubblicazione: (2025)
di: Xie, Luyuan, et al.
Pubblicazione: (2025)
UniPool: A Globally Shared Expert Pool for Mixture-of-Experts
di: Huang, Minbin, et al.
Pubblicazione: (2026)
di: Huang, Minbin, et al.
Pubblicazione: (2026)
Expert Upcycling: Shifting the Compute-Efficient Frontier of Mixture-of-Experts
di: Dwivedi, Chaitanya, et al.
Pubblicazione: (2026)
di: Dwivedi, Chaitanya, et al.
Pubblicazione: (2026)
Flex-MoE: Modeling Arbitrary Modality Combination via the Flexible Mixture-of-Experts
di: Yun, Sukwon, et al.
Pubblicazione: (2024)
di: Yun, Sukwon, et al.
Pubblicazione: (2024)
Mixture of Experts with Mixture of Precisions for Tuning Quality of Service
di: Imani, HamidReza, et al.
Pubblicazione: (2024)
di: Imani, HamidReza, et al.
Pubblicazione: (2024)
Multi-Head Mixture-of-Experts
di: Wu, Xun, et al.
Pubblicazione: (2024)
di: Wu, Xun, et al.
Pubblicazione: (2024)
Klotski: Efficient Mixture-of-Expert Inference via Expert-Aware Multi-Batch Pipeline
di: Fang, Zhiyuan, et al.
Pubblicazione: (2025)
di: Fang, Zhiyuan, et al.
Pubblicazione: (2025)
PuzzleMoE: Efficient Compression of Large Mixture-of-Experts Models via Sparse Expert Merging and Bit-packed inference
di: Zhao, Yushu, et al.
Pubblicazione: (2025)
di: Zhao, Yushu, et al.
Pubblicazione: (2025)
MoBiE: Efficient Inference of Mixture of Binary Experts under Post-Training Quantization
di: Zhao, Zhixiong, et al.
Pubblicazione: (2026)
di: Zhao, Zhixiong, et al.
Pubblicazione: (2026)
Alloc-MoE: Budget-Aware Expert Activation Allocation for Efficient Mixture-of-Experts Inference
di: Liu, Baihui, et al.
Pubblicazione: (2026)
di: Liu, Baihui, et al.
Pubblicazione: (2026)
Each Rank Could be an Expert: Single-Ranked Mixture of Experts LoRA for Multi-Task Learning
di: Zhao, Ziyu, et al.
Pubblicazione: (2025)
di: Zhao, Ziyu, et al.
Pubblicazione: (2025)
Retrieval-Augmented Mixture of LoRA Experts for Uploadable Machine Learning
di: Zhao, Ziyu, et al.
Pubblicazione: (2024)
di: Zhao, Ziyu, et al.
Pubblicazione: (2024)
Theory on Mixture-of-Experts in Continual Learning
di: Li, Hongbo, et al.
Pubblicazione: (2024)
di: Li, Hongbo, et al.
Pubblicazione: (2024)
CoScale-RL: Efficient Post-Training by Co-Scaling Data and Computation
di: Chen, Yutong, et al.
Pubblicazione: (2026)
di: Chen, Yutong, et al.
Pubblicazione: (2026)
Efficient Quantization of Mixture-of-Experts with Theoretical Generalization Guarantees
di: Chowdhury, Mohammed Nowaz Rabbani, et al.
Pubblicazione: (2026)
di: Chowdhury, Mohammed Nowaz Rabbani, et al.
Pubblicazione: (2026)
RouteHijack: Routing-Aware Attack on Mixture-of-Experts LLMs
di: Xu, Zhiyuan, et al.
Pubblicazione: (2026)
di: Xu, Zhiyuan, et al.
Pubblicazione: (2026)
PERFT: Parameter-Efficient Routed Fine-Tuning for Mixture-of-Expert Model
di: Liu, Yilun, et al.
Pubblicazione: (2024)
di: Liu, Yilun, et al.
Pubblicazione: (2024)
Elastic MoE: Unlocking the Inference-Time Scalability of Mixture-of-Experts
di: Gu, Naibin, et al.
Pubblicazione: (2025)
di: Gu, Naibin, et al.
Pubblicazione: (2025)
MergeMix: Optimizing Mid-Training Data Mixtures via Learnable Model Merging
di: Wang, Jiapeng, et al.
Pubblicazione: (2026)
di: Wang, Jiapeng, et al.
Pubblicazione: (2026)
EAC-MoE: Expert-Selection Aware Compressor for Mixture-of-Experts Large Language Models
di: Chen, Yuanteng, et al.
Pubblicazione: (2025)
di: Chen, Yuanteng, et al.
Pubblicazione: (2025)
MoE++: Accelerating Mixture-of-Experts Methods with Zero-Computation Experts
di: Jin, Peng, et al.
Pubblicazione: (2024)
di: Jin, Peng, et al.
Pubblicazione: (2024)
Not All Experts are Equal: Efficient Expert Pruning and Skipping for Mixture-of-Experts Large Language Models
di: Lu, Xudong, et al.
Pubblicazione: (2024)
di: Lu, Xudong, et al.
Pubblicazione: (2024)
Parameter-Efficient Routed Fine-Tuning: Mixture-of-Experts Demands Mixture of Adaptation Modules
di: Liu, Yilun, et al.
Pubblicazione: (2025)
di: Liu, Yilun, et al.
Pubblicazione: (2025)
Wavelet Mixture of Experts for Time Series Forecasting
di: Zhou, Zheng, et al.
Pubblicazione: (2025)
di: Zhou, Zheng, et al.
Pubblicazione: (2025)
Towards Efficient Federated Learning of Networked Mixture-of-Experts for Mobile Edge Computing
di: Gao, Song, et al.
Pubblicazione: (2025)
di: Gao, Song, et al.
Pubblicazione: (2025)
Documenti analoghi
-
MP-MoE: Matrix Profile-Guided Mixture of Experts for Precipitation Forecasting
di: Tran, Huyen Ngoc, et al.
Pubblicazione: (2026) -
HyperMoE: Towards Better Mixture of Experts via Transferring Among Experts
di: Zhao, Hao, et al.
Pubblicazione: (2024) -
STaMP: Sequence Transformation and Mixed Precision for Low-Precision Activation Quantization
di: Federici, Marco, et al.
Pubblicazione: (2025) -
Mixture-of-Experts Meets In-Context Reinforcement Learning
di: Wu, Wenhao, et al.
Pubblicazione: (2025) -
Efficiently Editing Mixture-of-Experts Models with Compressed Experts
di: He, Yifei, et al.
Pubblicazione: (2025)