Shard the Gradient, Scale the Model: Serverless Federated Aggregation via Gradient Partitioning
Fuente:
arXiv
Salvato in:
| Autore principale: | Barrak, Amine |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Cost-Performance Analysis: A Comparative Study of CPU-Based Serverless and GPU-Based Training Architectures
di: Barrak, Amine, et al.
Pubblicazione: (2025)
di: Barrak, Amine, et al.
Pubblicazione: (2025)
Scalable and Cost-Efficient ML Inference: Parallel Batch Processing with Serverless Functions
di: Barrak, Amine, et al.
Pubblicazione: (2025)
di: Barrak, Amine, et al.
Pubblicazione: (2025)
Adaptive Consensus Gradients Aggregation for Scaled Distributed Training
di: Choukroun, Yoni, et al.
Pubblicazione: (2024)
di: Choukroun, Yoni, et al.
Pubblicazione: (2024)
SimpleFSDP: Simpler Fully Sharded Data Parallel with torch.compile
di: Zhang, Ruisi, et al.
Pubblicazione: (2024)
di: Zhang, Ruisi, et al.
Pubblicazione: (2024)
Scaling Large Language Model Training on Frontier with Low-Bandwidth Partitioning
di: Xu, Lang, et al.
Pubblicazione: (2025)
di: Xu, Lang, et al.
Pubblicazione: (2025)
RLHFless: Serverless Computing for Efficient RLHF
di: Wei, Rui, et al.
Pubblicazione: (2026)
di: Wei, Rui, et al.
Pubblicazione: (2026)
Helix Parallelism: Rethinking Sharding Strategies for Interactive Multi-Million-Token LLM Decoding
di: Bhatia, Nidhi, et al.
Pubblicazione: (2025)
di: Bhatia, Nidhi, et al.
Pubblicazione: (2025)
Word Frequency Counting Based on Serverless MapReduce
di: Li, Hanzhe, et al.
Pubblicazione: (2026)
di: Li, Hanzhe, et al.
Pubblicazione: (2026)
Gradient Correction in Federated Learning with Adaptive Optimization
di: Chen, Evan, et al.
Pubblicazione: (2025)
di: Chen, Evan, et al.
Pubblicazione: (2025)
Collaborative Split Federated Learning with Parallel Training and Aggregation
di: Papageorgiou, Yiannis, et al.
Pubblicazione: (2025)
di: Papageorgiou, Yiannis, et al.
Pubblicazione: (2025)
Sentinel: An Aggregation Function to Secure Decentralized Federated Learning
di: Feng, Chao, et al.
Pubblicazione: (2023)
di: Feng, Chao, et al.
Pubblicazione: (2023)
Training Heterogeneous Client Models using Knowledge Distillation in Serverless Federated Learning
di: Chadha, Mohak, et al.
Pubblicazione: (2024)
di: Chadha, Mohak, et al.
Pubblicazione: (2024)
Delayed Random Partial Gradient Averaging for Federated Learning
di: Hu, Xinyi
Pubblicazione: (2024)
di: Hu, Xinyi
Pubblicazione: (2024)
ENOVA: Autoscaling towards Cost-effective and Stable Serverless LLM Serving
di: Huang, Tao, et al.
Pubblicazione: (2024)
di: Huang, Tao, et al.
Pubblicazione: (2024)
Accelerating MoE Model Inference with Expert Sharding
di: Balmau, Oana, et al.
Pubblicazione: (2025)
di: Balmau, Oana, et al.
Pubblicazione: (2025)
Remoe: Towards Efficient and Low-Cost MoE Inference in Serverless Computing
di: Liu, Wentao, et al.
Pubblicazione: (2025)
di: Liu, Wentao, et al.
Pubblicazione: (2025)
FedDAG: Clustered Federated Learning via Global Data and Gradient Integration for Heterogeneous Environments
di: Pramanik, Anik, et al.
Pubblicazione: (2026)
di: Pramanik, Anik, et al.
Pubblicazione: (2026)
Byzantine-Robust and Communication-Efficient Distributed Training: Compressive and Cyclic Gradient Coding
di: Li, Chengxi, et al.
Pubblicazione: (2026)
di: Li, Chengxi, et al.
Pubblicazione: (2026)
Enhancing Communication Efficiency in FL with Adaptive Gradient Quantization and Communication Frequency Optimization
di: Tariq, Asadullah, et al.
Pubblicazione: (2025)
di: Tariq, Asadullah, et al.
Pubblicazione: (2025)
FedPAW: Federated Learning with Personalized Aggregation Weights for Urban Vehicle Speed Prediction
di: He, Yuepeng, et al.
Pubblicazione: (2024)
di: He, Yuepeng, et al.
Pubblicazione: (2024)
CG-FedLLM: How to Compress Gradients in Federated Fune-tuning for Large Language Models
di: Wu, Huiwen, et al.
Pubblicazione: (2024)
di: Wu, Huiwen, et al.
Pubblicazione: (2024)
GC-Fed: Gradient Centralized Federated Learning with Partial Client Participation
di: Seo, Jungwon, et al.
Pubblicazione: (2025)
di: Seo, Jungwon, et al.
Pubblicazione: (2025)
Large Language Model Partitioning for Low-Latency Inference at the Edge
di: Kafetzis, Dimitrios, et al.
Pubblicazione: (2025)
di: Kafetzis, Dimitrios, et al.
Pubblicazione: (2025)
Communication-and-Computation Efficient Split Federated Learning: Gradient Aggregation and Resource Management
di: Liang, Yipeng, et al.
Pubblicazione: (2025)
di: Liang, Yipeng, et al.
Pubblicazione: (2025)
FedCGD: Collective Gradient Divergence Optimized Scheduling for Wireless Federated Learning
di: Chen, Tan, et al.
Pubblicazione: (2025)
di: Chen, Tan, et al.
Pubblicazione: (2025)
SelectiveShield: Lightweight Hybrid Defense Against Gradient Leakage in Federated Learning
di: Li, Borui, et al.
Pubblicazione: (2025)
di: Li, Borui, et al.
Pubblicazione: (2025)
PacTrain: Pruning and Adaptive Sparse Gradient Compression for Efficient Collective Communication in Distributed Deep Learning
di: Wang, Yisu, et al.
Pubblicazione: (2025)
di: Wang, Yisu, et al.
Pubblicazione: (2025)
DeF-DReL: Systematic Deployment of Serverless Functions in Fog and Cloud environments using Deep Reinforcement Learning
di: Dehury, Chinmaya Kumar, et al.
Pubblicazione: (2021)
di: Dehury, Chinmaya Kumar, et al.
Pubblicazione: (2021)
A Deep Recurrent-Reinforcement Learning Method for Intelligent AutoScaling of Serverless Functions
di: Agarwal, Siddharth, et al.
Pubblicazione: (2023)
di: Agarwal, Siddharth, et al.
Pubblicazione: (2023)
PeerFL: A Simulator for Peer-to-Peer Federated Learning at Scale
di: Luqman, Alka, et al.
Pubblicazione: (2024)
di: Luqman, Alka, et al.
Pubblicazione: (2024)
SP-Chain: Boosting Intra-Shard and Cross-Shard Security and Performance in Blockchain Sharding
di: Li, Mingzhe, et al.
Pubblicazione: (2024)
di: Li, Mingzhe, et al.
Pubblicazione: (2024)
Green or Fast? Learning to Balance Cold Starts and Idle Carbon in Serverless Computing
di: Sun, Bowen, et al.
Pubblicazione: (2026)
di: Sun, Bowen, et al.
Pubblicazione: (2026)
StableShard: Stable and Scalable Blockchain Sharding with High Concurrency via Collaborative Committees
di: Li, Mingzhe, et al.
Pubblicazione: (2024)
di: Li, Mingzhe, et al.
Pubblicazione: (2024)
Model Agnostic Hybrid Sharding For Heterogeneous Distributed Inference
di: Angione, Claudio, et al.
Pubblicazione: (2024)
di: Angione, Claudio, et al.
Pubblicazione: (2024)
MOPAR: A Model Partitioning Framework for Deep Learning Inference Services on Serverless Platforms
di: Duan, Jiaang, et al.
Pubblicazione: (2024)
di: Duan, Jiaang, et al.
Pubblicazione: (2024)
DynaShard: Secure and Adaptive Blockchain Sharding Protocol with Hybrid Consensus and Dynamic Shard Management
di: Liu, Ao, et al.
Pubblicazione: (2024)
di: Liu, Ao, et al.
Pubblicazione: (2024)
MoEless: Efficient MoE LLM Serving via Serverless Computing
di: Yu, Hanfei, et al.
Pubblicazione: (2026)
di: Yu, Hanfei, et al.
Pubblicazione: (2026)
FedAgg: Adaptive Federated Learning with Aggregated Gradients
di: Yuan, Wenhao, et al.
Pubblicazione: (2023)
di: Yuan, Wenhao, et al.
Pubblicazione: (2023)
Federated Unlearning with Gradient Descent and Conflict Mitigation
di: Pan, Zibin, et al.
Pubblicazione: (2024)
di: Pan, Zibin, et al.
Pubblicazione: (2024)
Boosting Multimodal Federated Learning via Chained Modality Optimization
di: Zhang, Zixin, et al.
Pubblicazione: (2026)
di: Zhang, Zixin, et al.
Pubblicazione: (2026)
Documenti analoghi
-
Cost-Performance Analysis: A Comparative Study of CPU-Based Serverless and GPU-Based Training Architectures
di: Barrak, Amine, et al.
Pubblicazione: (2025) -
Scalable and Cost-Efficient ML Inference: Parallel Batch Processing with Serverless Functions
di: Barrak, Amine, et al.
Pubblicazione: (2025) -
Adaptive Consensus Gradients Aggregation for Scaled Distributed Training
di: Choukroun, Yoni, et al.
Pubblicazione: (2024) -
SimpleFSDP: Simpler Fully Sharded Data Parallel with torch.compile
di: Zhang, Ruisi, et al.
Pubblicazione: (2024) -
Scaling Large Language Model Training on Frontier with Low-Bandwidth Partitioning
di: Xu, Lang, et al.
Pubblicazione: (2025)