PC-MoE: Memory-Efficient and Privacy-Preserving Collaborative Training for Mixture-of-Experts LLMs
Fuente:
arXiv
Salvato in:
| Autori principali: | Zhang, Ze Yu, Ding, Bolin, Low, Bryan Kian Hsiang |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
PWC-MoE: Privacy-Aware Wireless Collaborative Mixture of Experts
di: Su, Yang, et al.
Pubblicazione: (2025)
di: Su, Yang, et al.
Pubblicazione: (2025)
MoBE: Mixture-of-Basis-Experts for Compressing MoE-based LLMs
di: Chen, Xiaodong, et al.
Pubblicazione: (2025)
di: Chen, Xiaodong, et al.
Pubblicazione: (2025)
Self-Interested Agents in Collaborative Machine Learning: An Incentivized Adaptive Data-Centric Framework
di: Vijayan, Nithia, et al.
Pubblicazione: (2024)
di: Vijayan, Nithia, et al.
Pubblicazione: (2024)
Sub-MoE: Efficient Mixture-of-Expert LLMs Compression via Subspace Expert Merging
di: Li, Lujun, et al.
Pubblicazione: (2025)
di: Li, Lujun, et al.
Pubblicazione: (2025)
Joint MoE Scaling Laws: Mixture of Experts Can Be Memory Efficient
di: Ludziejewski, Jan, et al.
Pubblicazione: (2025)
di: Ludziejewski, Jan, et al.
Pubblicazione: (2025)
Horseshoe Mixtures-of-Experts (HS-MoE)
di: Polson, Nick, et al.
Pubblicazione: (2026)
di: Polson, Nick, et al.
Pubblicazione: (2026)
LAER-MoE: Load-Adaptive Expert Re-layout for Efficient Mixture-of-Experts Training
di: Liu, Xinyi, et al.
Pubblicazione: (2026)
di: Liu, Xinyi, et al.
Pubblicazione: (2026)
eMoE: Task-aware Memory Efficient Mixture-of-Experts-Based (MoE) Model Inference
di: Tairin, Suraiya, et al.
Pubblicazione: (2025)
di: Tairin, Suraiya, et al.
Pubblicazione: (2025)
MoE-DisCo:Low Economy Cost Training Mixture-of-Experts Models
di: Ye, Xin, et al.
Pubblicazione: (2026)
di: Ye, Xin, et al.
Pubblicazione: (2026)
$\infty$-MoE: Generalizing Mixture of Experts to Infinite Experts
di: Takashiro, Shota, et al.
Pubblicazione: (2026)
di: Takashiro, Shota, et al.
Pubblicazione: (2026)
Mixture of Experts (MoE): A Big Data Perspective
di: Gan, Wensheng, et al.
Pubblicazione: (2025)
di: Gan, Wensheng, et al.
Pubblicazione: (2025)
CP-MoE: Consistency-Preserving Mixture-of-Experts for Continual Learning
di: Liu, Yang, et al.
Pubblicazione: (2026)
di: Liu, Yang, et al.
Pubblicazione: (2026)
DUET: Optimizing Training Data Mixtures via Feedback from Unseen Evaluation Tasks
di: Chen, Zhiliang, et al.
Pubblicazione: (2025)
di: Chen, Zhiliang, et al.
Pubblicazione: (2025)
Decentralized Sum-of-Nonconvex Optimization
di: Liu, Zhuanghua, et al.
Pubblicazione: (2024)
di: Liu, Zhuanghua, et al.
Pubblicazione: (2024)
TreeGrad-Ranker: Feature Ranking via $O(L)$-Time Gradients for Decision Trees
di: Li, Weida, et al.
Pubblicazione: (2026)
di: Li, Weida, et al.
Pubblicazione: (2026)
Provably Adaptive Linear Approximation for the Shapley Value and Beyond
di: Li, Weida, et al.
Pubblicazione: (2026)
di: Li, Weida, et al.
Pubblicazione: (2026)
FLEX-MoE: Federated Mixture-of-Experts with Load-balanced Expert Assignment for Edge Computing
di: Zhang, Boyang, et al.
Pubblicazione: (2025)
di: Zhang, Boyang, et al.
Pubblicazione: (2025)
DA-MoE: Towards Dynamic Expert Allocation for Mixture-of-Experts Models
di: Aghdam, Maryam Akhavan, et al.
Pubblicazione: (2024)
di: Aghdam, Maryam Akhavan, et al.
Pubblicazione: (2024)
Robustifying and Boosting Training-Free Neural Architecture Search
di: He, Zhenfeng, et al.
Pubblicazione: (2024)
di: He, Zhenfeng, et al.
Pubblicazione: (2024)
MoE++: Accelerating Mixture-of-Experts Methods with Zero-Computation Experts
di: Jin, Peng, et al.
Pubblicazione: (2024)
di: Jin, Peng, et al.
Pubblicazione: (2024)
Alloc-MoE: Budget-Aware Expert Activation Allocation for Efficient Mixture-of-Experts Inference
di: Liu, Baihui, et al.
Pubblicazione: (2026)
di: Liu, Baihui, et al.
Pubblicazione: (2026)
Understanding the Relationship between Prompts and Response Uncertainty in Large Language Models
di: Zhang, Ze Yu, et al.
Pubblicazione: (2024)
di: Zhang, Ze Yu, et al.
Pubblicazione: (2024)
Understanding Domain Generalization: A Noise Robustness Perspective
di: Qiao, Rui, et al.
Pubblicazione: (2024)
di: Qiao, Rui, et al.
Pubblicazione: (2024)
MegaScale-MoE: Large-Scale Communication-Efficient Training of Mixture-of-Experts Models in Production
di: Jin, Chao, et al.
Pubblicazione: (2025)
di: Jin, Chao, et al.
Pubblicazione: (2025)
SDG-MoE: Signed Debate Graph Mixture-of-Experts
di: Kulibaba, Stepan, et al.
Pubblicazione: (2026)
di: Kulibaba, Stepan, et al.
Pubblicazione: (2026)
Fine-tuning Language Models with Generative Adversarial Reward Modelling
di: Yu, Zhang Ze, et al.
Pubblicazione: (2023)
di: Yu, Zhang Ze, et al.
Pubblicazione: (2023)
MoE-Mamba: Efficient Selective State Space Models with Mixture of Experts
di: Pióro, Maciej, et al.
Pubblicazione: (2024)
di: Pióro, Maciej, et al.
Pubblicazione: (2024)
SEER-MoE: Sparse Expert Efficiency through Regularization for Mixture-of-Experts
di: Muzio, Alexandre, et al.
Pubblicazione: (2024)
di: Muzio, Alexandre, et al.
Pubblicazione: (2024)
VA-MoE: Variables-Adaptive Mixture of Experts for Incremental Weather Forecasting
di: Chen, Hao, et al.
Pubblicazione: (2024)
di: Chen, Hao, et al.
Pubblicazione: (2024)
Elastic MoE: Unlocking the Inference-Time Scalability of Mixture-of-Experts
di: Gu, Naibin, et al.
Pubblicazione: (2025)
di: Gu, Naibin, et al.
Pubblicazione: (2025)
Occult: Optimizing Collaborative Communication across Experts for Accelerated Parallel MoE Training and Inference
di: Luo, Shuqing, et al.
Pubblicazione: (2025)
di: Luo, Shuqing, et al.
Pubblicazione: (2025)
Exploiting the Experts: Unauthorized Compression in MoE-LLMs
di: Neogi, Pinaki Prasad Guha, et al.
Pubblicazione: (2025)
di: Neogi, Pinaki Prasad Guha, et al.
Pubblicazione: (2025)
Anchor-MoE: A Mean-Anchored Mixture of Experts For Probabilistic Regression
di: Su, Baozhuo, et al.
Pubblicazione: (2025)
di: Su, Baozhuo, et al.
Pubblicazione: (2025)
FT-MoE: Sustainable-learning Mixture of Experts for Fault-Tolerant Computing
di: Xiao, Wenjing, et al.
Pubblicazione: (2025)
di: Xiao, Wenjing, et al.
Pubblicazione: (2025)
HI-MoE: Hierarchical Instance-Conditioned Mixture-of-Experts for Object Detection
di: Vashkelis, Vadim, et al.
Pubblicazione: (2026)
di: Vashkelis, Vadim, et al.
Pubblicazione: (2026)
MoE-Infinity: Efficient MoE Inference on Personal Machines with Sparsity-Aware Expert Cache
di: Xue, Leyang, et al.
Pubblicazione: (2024)
di: Xue, Leyang, et al.
Pubblicazione: (2024)
INO-SGD: Addressing Utility Imbalance under Individualized Differential Privacy
di: Tian, Xiao, et al.
Pubblicazione: (2026)
di: Tian, Xiao, et al.
Pubblicazione: (2026)
TRACE: TRansformer-based Attribution using Contrastive Embeddings in LLMs
di: Wang, Cheng, et al.
Pubblicazione: (2024)
di: Wang, Cheng, et al.
Pubblicazione: (2024)
X-MoE: Enabling Scalable Training for Emerging Mixture-of-Experts Architectures on HPC Platforms
di: Yuan, Yueming, et al.
Pubblicazione: (2025)
di: Yuan, Yueming, et al.
Pubblicazione: (2025)
L-MoE: End-to-End Training of a Lightweight Mixture of Low-Rank Adaptation Experts
di: Ji, Shihao, et al.
Pubblicazione: (2025)
di: Ji, Shihao, et al.
Pubblicazione: (2025)
Documenti analoghi
-
PWC-MoE: Privacy-Aware Wireless Collaborative Mixture of Experts
di: Su, Yang, et al.
Pubblicazione: (2025) -
MoBE: Mixture-of-Basis-Experts for Compressing MoE-based LLMs
di: Chen, Xiaodong, et al.
Pubblicazione: (2025) -
Self-Interested Agents in Collaborative Machine Learning: An Incentivized Adaptive Data-Centric Framework
di: Vijayan, Nithia, et al.
Pubblicazione: (2024) -
Sub-MoE: Efficient Mixture-of-Expert LLMs Compression via Subspace Expert Merging
di: Li, Lujun, et al.
Pubblicazione: (2025) -
Joint MoE Scaling Laws: Mixture of Experts Can Be Memory Efficient
di: Ludziejewski, Jan, et al.
Pubblicazione: (2025)