Elastic Mixture of Rank-Wise Experts for Knowledge Reuse in Federated Fine-Tuning
Fuente:
arXiv
Salvato in:
| Autori principali: | Wu, Yebo, Li, Jingguang, Guo, Zhijiang, Li, Li |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Memory-Efficient Federated Fine-Tuning of Large Language Models via Layer Pruning
di: Wu, Yebo, et al.
Pubblicazione: (2025)
di: Wu, Yebo, et al.
Pubblicazione: (2025)
Learning Like Humans: Resource-Efficient Federated Fine-Tuning through Cognitive Developmental Stages
di: Wu, Yebo, et al.
Pubblicazione: (2025)
di: Wu, Yebo, et al.
Pubblicazione: (2025)
Beyond End-to-End: Dynamic Chain Optimization for Private LLM Adaptation on the Edge
di: Wu, Yebo, et al.
Pubblicazione: (2026)
di: Wu, Yebo, et al.
Pubblicazione: (2026)
A Survey on Federated Fine-tuning of Large Language Models
di: Wu, Yebo, et al.
Pubblicazione: (2025)
di: Wu, Yebo, et al.
Pubblicazione: (2025)
Bridging Memory Gaps: Scaling Federated Learning for Heterogeneous Clients
di: Wu, Yebo, et al.
Pubblicazione: (2024)
di: Wu, Yebo, et al.
Pubblicazione: (2024)
Breaking the Memory Wall for Heterogeneous Federated Learning via Progressive Training
di: Wu, Yebo, et al.
Pubblicazione: (2024)
di: Wu, Yebo, et al.
Pubblicazione: (2024)
Heterogeneous Federated Fine-Tuning with Parallel One-Rank Adaptation
di: Zhang, Zikai, et al.
Pubblicazione: (2026)
di: Zhang, Zikai, et al.
Pubblicazione: (2026)
ElasticMoE: An Efficient Auto Scaling Method for Mixture-of-Experts Models
di: Singh, Gursimran, et al.
Pubblicazione: (2025)
di: Singh, Gursimran, et al.
Pubblicazione: (2025)
Memory-Efficient Split Federated Learning for LLM Fine-Tuning on Heterogeneous Mobile Devices
di: Chen, Xiaopei, et al.
Pubblicazione: (2025)
di: Chen, Xiaopei, et al.
Pubblicazione: (2025)
FedMoE-DA: Federated Mixture of Experts via Domain Aware Fine-grained Aggregation
di: Zhan, Ziwei, et al.
Pubblicazione: (2024)
di: Zhan, Ziwei, et al.
Pubblicazione: (2024)
Heterogeneity-Aware Memory Efficient Federated Learning via Progressive Layer Freezing
di: Yebo, Wu, et al.
Pubblicazione: (2024)
di: Yebo, Wu, et al.
Pubblicazione: (2024)
Breaking the Memory Wall for Heterogeneous Federated Learning via Model Splitting
di: Tian, Chunlin, et al.
Pubblicazione: (2024)
di: Tian, Chunlin, et al.
Pubblicazione: (2024)
ExpertWeave: Efficiently Serving Expert-Specialized Fine-Tuned Adapters at Scale
di: Shi, Ge, et al.
Pubblicazione: (2025)
di: Shi, Ge, et al.
Pubblicazione: (2025)
Lazarus: Resilient and Elastic Training of Mixture-of-Experts Models
di: Wu, Yongji, et al.
Pubblicazione: (2024)
di: Wu, Yongji, et al.
Pubblicazione: (2024)
Fed-GAME: Personalized Federated Learning with Graph Attention Mixture-of-Experts For Time-Series Forecasting
di: Li, Yi, et al.
Pubblicazione: (2026)
di: Li, Yi, et al.
Pubblicazione: (2026)
Low-Latency Federated Fine-Tuning for Large Language Models Over Wireless Networks
di: Pang, Zhiwen, et al.
Pubblicazione: (2026)
di: Pang, Zhiwen, et al.
Pubblicazione: (2026)
FedQuad: Adaptive Layer-wise LoRA Deployment and Activation Quantization for Federated Fine-Tuning
di: Li, Rukuo, et al.
Pubblicazione: (2025)
di: Li, Rukuo, et al.
Pubblicazione: (2025)
FLoRA: Federated Fine-Tuning Large Language Models with Heterogeneous Low-Rank Adaptations
di: Wang, Ziyao, et al.
Pubblicazione: (2024)
di: Wang, Ziyao, et al.
Pubblicazione: (2024)
Enshrined Proposer Builder Separation in the presence of Maximal Extractable Value
di: Wang, Yitian, et al.
Pubblicazione: (2026)
di: Wang, Yitian, et al.
Pubblicazione: (2026)
RingAda: Pipelining Large Model Fine-Tuning on Edge Devices with Scheduled Layer Unfreezing
di: Li, Liang, et al.
Pubblicazione: (2025)
di: Li, Liang, et al.
Pubblicazione: (2025)
Hexa-MoE: Efficient and Heterogeneous-aware Training for Mixture-of-Experts
di: Luo, Shuqing, et al.
Pubblicazione: (2024)
di: Luo, Shuqing, et al.
Pubblicazione: (2024)
Schedule-Level Shared-Prefix Reuse for LLM RL Training
di: Li, Pengbo, et al.
Pubblicazione: (2026)
di: Li, Pengbo, et al.
Pubblicazione: (2026)
FedFQ: Federated Learning with Fine-Grained Quantization
di: Li, Haowei, et al.
Pubblicazione: (2024)
di: Li, Haowei, et al.
Pubblicazione: (2024)
Split Fine-Tuning for Large Language Models in Wireless Networks
di: Zhang, Songge, et al.
Pubblicazione: (2025)
di: Zhang, Songge, et al.
Pubblicazione: (2025)
HAP: Hybrid Adaptive Parallelism for Efficient Mixture-of-Experts Inference
di: Lin, Haoran, et al.
Pubblicazione: (2025)
di: Lin, Haoran, et al.
Pubblicazione: (2025)
Exploring Selective Layer Fine-Tuning in Federated Learning
di: Sun, Yuchang, et al.
Pubblicazione: (2024)
di: Sun, Yuchang, et al.
Pubblicazione: (2024)
Floe: Federated Specialization for Real-Time LLM-SLM Inference
di: Tian, Chunlin, et al.
Pubblicazione: (2026)
di: Tian, Chunlin, et al.
Pubblicazione: (2026)
CRAFT: Fine-Grained Cost-Aware Expert Replication For Efficient Mixture-of-Experts Serving
di: Zhao, Adrian, et al.
Pubblicazione: (2026)
di: Zhao, Adrian, et al.
Pubblicazione: (2026)
HLoRA: Efficient Federated Learning System for LLM Heterogeneous Fine-Tuning
di: Liu, Qianli, et al.
Pubblicazione: (2025)
di: Liu, Qianli, et al.
Pubblicazione: (2025)
Robust Federated Fine-Tuning in Heterogeneous Networks with Unreliable Connections: An Aggregation View
di: Wang, Yanmeng, et al.
Pubblicazione: (2025)
di: Wang, Yanmeng, et al.
Pubblicazione: (2025)
Stabilizing Decentralized Federated Fine-Tuning via Topology-Aware Alternating LoRA
di: Wang, Xiaoyu, et al.
Pubblicazione: (2026)
di: Wang, Xiaoyu, et al.
Pubblicazione: (2026)
EcoLoRA: Communication-Efficient Federated Fine-Tuning of Large Language Models
di: Liu, Han, et al.
Pubblicazione: (2025)
di: Liu, Han, et al.
Pubblicazione: (2025)
DynaServe: Unified and Elastic Execution for Dynamic Disaggregated LLM Serving
di: Ruan, Chaoyi, et al.
Pubblicazione: (2025)
di: Ruan, Chaoyi, et al.
Pubblicazione: (2025)
PCR: A Prefetch-Enhanced Cache Reuse System for Low-Latency RAG Serving
di: Wang, Wenfeng, et al.
Pubblicazione: (2026)
di: Wang, Wenfeng, et al.
Pubblicazione: (2026)
Toward Cost-Efficient Serving of Mixture-of-Experts with Asynchrony
di: Wang, Shaoyu, et al.
Pubblicazione: (2025)
di: Wang, Shaoyu, et al.
Pubblicazione: (2025)
CacheFL: Privacy-Preserving and Efficient Federated Cache Model Fine-Tuning for Vision-Language Models
di: Yi, Mengjun, et al.
Pubblicazione: (2025)
di: Yi, Mengjun, et al.
Pubblicazione: (2025)
PromptTuner: SLO-Aware Elastic System for LLM Prompt Tuning
di: Gao, Wei, et al.
Pubblicazione: (2026)
di: Gao, Wei, et al.
Pubblicazione: (2026)
ReaLB: Real-Time Load Balancing for Multimodal MoE Inference
di: Wang, Yingping, et al.
Pubblicazione: (2026)
di: Wang, Yingping, et al.
Pubblicazione: (2026)
Communication-Efficient Federated Fine-Tuning
di: Theologitis, Michael, et al.
Pubblicazione: (2025)
di: Theologitis, Michael, et al.
Pubblicazione: (2025)
LAER-MoE: Load-Adaptive Expert Re-layout for Efficient Mixture-of-Experts Training
di: Liu, Xinyi, et al.
Pubblicazione: (2026)
di: Liu, Xinyi, et al.
Pubblicazione: (2026)
Documenti analoghi
-
Memory-Efficient Federated Fine-Tuning of Large Language Models via Layer Pruning
di: Wu, Yebo, et al.
Pubblicazione: (2025) -
Learning Like Humans: Resource-Efficient Federated Fine-Tuning through Cognitive Developmental Stages
di: Wu, Yebo, et al.
Pubblicazione: (2025) -
Beyond End-to-End: Dynamic Chain Optimization for Private LLM Adaptation on the Edge
di: Wu, Yebo, et al.
Pubblicazione: (2026) -
A Survey on Federated Fine-tuning of Large Language Models
di: Wu, Yebo, et al.
Pubblicazione: (2025) -
Bridging Memory Gaps: Scaling Federated Learning for Heterogeneous Clients
di: Wu, Yebo, et al.
Pubblicazione: (2024)