Bandwidth-Aware and Overlap-Weighted Compression for Communication-Efficient Federated Learning
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Tang, Zichen, Huang, Junlin, Yan, Rudan, Wang, Yuxin, Tang, Zhenheng, Shi, Shaohuai, Zhou, Amelie Chi, Chu, Xiaowen |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
DreamDDP: Accelerating Data Parallel Distributed LLM Training with Layer-wise Scheduled Partial Synchronization
par: Tang, Zhenheng, et autres
Publié: (2025)
par: Tang, Zhenheng, et autres
Publié: (2025)
Efficient MoE Inference with Fine-Grained Scheduling of Disaggregated Expert Parallelism
par: Pan, Xinglin, et autres
Publié: (2025)
par: Pan, Xinglin, et autres
Publié: (2025)
Fault-Tolerant Hybrid-Parallel Training at Scale with Reliable and Efficient In-memory Checkpointing
par: Wang, Yuxin, et autres
Publié: (2023)
par: Wang, Yuxin, et autres
Publié: (2023)
ZipCCL: Efficient Lossless Data Compression of Communication Collectives for Accelerating LLM Training
par: Lin, Wenxiang, et autres
Publié: (2026)
par: Lin, Wenxiang, et autres
Publié: (2026)
FedImpro: Measuring and Improving Client Update in Federated Learning
par: Tang, Zhenheng, et autres
Publié: (2024)
par: Tang, Zhenheng, et autres
Publié: (2024)
FusionLLM: A Decentralized LLM Training System on Geo-distributed GPUs with Adaptive Compression
par: Tang, Zhenheng, et autres
Publié: (2024)
par: Tang, Zhenheng, et autres
Publié: (2024)
Parm: Efficient Training of Large Sparsely-Activated Models with Dedicated Schedules
par: Pan, Xinglin, et autres
Publié: (2024)
par: Pan, Xinglin, et autres
Publié: (2024)
BurstGPT: A Real-world Workload Dataset to Optimize LLM Serving Systems
par: Wang, Yuxin, et autres
Publié: (2024)
par: Wang, Yuxin, et autres
Publié: (2024)
FuseFL: One-Shot Federated Learning through the Lens of Causality with Progressive Model Fusion
par: Tang, Zhenheng, et autres
Publié: (2024)
par: Tang, Zhenheng, et autres
Publié: (2024)
RcLLM: Accelerating Generative Recommendation via Beyond-Prefix KV Caching
par: Zhao, Zhan, et autres
Publié: (2026)
par: Zhao, Zhan, et autres
Publié: (2026)
HierMoE: Accelerating MoE Training with Hierarchical Token Deduplication and Expert Swap
par: Lin, Wenxiang, et autres
Publié: (2025)
par: Lin, Wenxiang, et autres
Publié: (2025)
Bandwidth-Aware Network Topology Optimization for Decentralized Learning
par: Shen, Yipeng, et autres
Publié: (2025)
par: Shen, Yipeng, et autres
Publié: (2025)
Bandwidth-Aware and Cost-Efficient Pipeline Parallel Scheduling in Geo-Distributed LLM Training
par: Zhang, Han, et autres
Publié: (2026)
par: Zhang, Han, et autres
Publié: (2026)
Towards Communication-Efficient Decentralized Federated Graph Learning over Non-IID Data
par: Wang, Shilong, et autres
Publié: (2025)
par: Wang, Shilong, et autres
Publié: (2025)
Syncopate: Efficient Multi-GPU AI Kernels via Automatic Chunk-Centric Compute-Communication Overlap
par: Qiang, Xinwei, et autres
Publié: (2026)
par: Qiang, Xinwei, et autres
Publié: (2026)
Heterogeneity-Aware Memory Efficient Federated Learning via Progressive Layer Freezing
par: Yebo, Wu, et autres
Publié: (2024)
par: Yebo, Wu, et autres
Publié: (2024)
FedCod: An Efficient Communication Protocol for Cross-Silo Federated Learning with Coding
par: Yan, Peishen, et autres
Publié: (2024)
par: Yan, Peishen, et autres
Publié: (2024)
FairGFL: Privacy-Preserving Fairness-Aware Federated Learning with Overlapping Subgraphs
par: Zhou, Zihao, et autres
Publié: (2025)
par: Zhou, Zihao, et autres
Publié: (2025)
ElasWave: An Elastic-Native System for Scalable Hybrid-Parallel Training
par: Kang, Xueze, et autres
Publié: (2025)
par: Kang, Xueze, et autres
Publié: (2025)
Bandwidth-Aware LLM Inference on Heterogeneous Many-Core Supercomputers
par: Lu, Yao, et autres
Publié: (2026)
par: Lu, Yao, et autres
Publié: (2026)
TileLink: Generating Efficient Compute-Communication Overlapping Kernels using Tile-Centric Primitives
par: Zheng, Size, et autres
Publié: (2025)
par: Zheng, Size, et autres
Publié: (2025)
The Carnot Bound: Limits and Possibilities for Bandwidth-Efficient Consensus
par: Lewis-Pye, Andrew, et autres
Publié: (2026)
par: Lewis-Pye, Andrew, et autres
Publié: (2026)
FourierCompress: Layer-Aware Spectral Activation Compression for Efficient and Accurate Collaborative LLM Inference
par: Ma, Jian, et autres
Publié: (2025)
par: Ma, Jian, et autres
Publié: (2025)
FedSZ: Leveraging Error-Bounded Lossy Compression for Federated Learning Communications
par: Wilkins, Grant, et autres
Publié: (2023)
par: Wilkins, Grant, et autres
Publié: (2023)
Dynamic Client Clustering, Bandwidth Allocation, and Workload Optimization for Semi-synchronous Federated Learning
par: Yu, Liangkun, et autres
Publié: (2024)
par: Yu, Liangkun, et autres
Publié: (2024)
RServe: Overlapping Encoding and Prefill for Efficient LMM Inference
par: Guo, Tianyu, et autres
Publié: (2025)
par: Guo, Tianyu, et autres
Publié: (2025)
Scheduling Deep Learning Jobs in Multi-Tenant GPU Clusters via Wise Resource Sharing
par: Luo, Yizhou, et autres
Publié: (2024)
par: Luo, Yizhou, et autres
Publié: (2024)
Heterogeneity-Aware Cooperative Federated Edge Learning with Adaptive Computation and Communication Compression
par: Zhang, Zhenxiao, et autres
Publié: (2024)
par: Zhang, Zhenxiao, et autres
Publié: (2024)
Lagom: Unleashing the Power of Communication and Computation Overlapping for Distributed LLM Training
par: Xu, Guanbin, et autres
Publié: (2026)
par: Xu, Guanbin, et autres
Publié: (2026)
Cross-region Model Training with Communication-Computation Overlapping and Delay Compensation
par: Zhu, Ying, et autres
Publié: (2025)
par: Zhu, Ying, et autres
Publié: (2025)
Position: LLM Inference Should Be Evaluated as Energy-to-Token Production
par: Liu, Xiang, et autres
Publié: (2026)
par: Liu, Xiang, et autres
Publié: (2026)
FractalSortCPU: Bandwidth-Efficient Compressed Radix Sort on CPU
par: Dang'ana, Michael
Publié: (2026)
par: Dang'ana, Michael
Publié: (2026)
Masked Random Noise for Communication Efficient Federated Learning
par: Li, Shiwei, et autres
Publié: (2024)
par: Li, Shiwei, et autres
Publié: (2024)
Efficient Column-Wise N:M Pruning on RISC-V CPU
par: Chu, Chi-Wei, et autres
Publié: (2025)
par: Chu, Chi-Wei, et autres
Publié: (2025)
Communication-Efficient Model Aggregation with Layer Divergence Feedback in Federated Learning
par: Wang, Liwei, et autres
Publié: (2024)
par: Wang, Liwei, et autres
Publié: (2024)
EcoFed: Efficient Communication for DNN Partitioning-based Federated Learning
par: Wu, Di, et autres
Publié: (2023)
par: Wu, Di, et autres
Publié: (2023)
LCI: a Lightweight Communication Interface for Efficient Asynchronous Multithreaded Communication
par: Yan, Jiakun, et autres
Publié: (2025)
par: Yan, Jiakun, et autres
Publié: (2025)
DualPath: Breaking the Storage Bandwidth Bottleneck in Agentic LLM Inference
par: Wu, Yongtong, et autres
Publié: (2026)
par: Wu, Yongtong, et autres
Publié: (2026)
Fairness-Aware Job Scheduling for Multi-Job Federated Learning
par: Shi, Yuxin, et autres
Publié: (2024)
par: Shi, Yuxin, et autres
Publié: (2024)
Communication-Efficient Federated Learning through Adaptive Weight Clustering and Server-Side Distillation
par: Tsouvalas, Vasileios, et autres
Publié: (2024)
par: Tsouvalas, Vasileios, et autres
Publié: (2024)
Documents similaires
-
DreamDDP: Accelerating Data Parallel Distributed LLM Training with Layer-wise Scheduled Partial Synchronization
par: Tang, Zhenheng, et autres
Publié: (2025) -
Efficient MoE Inference with Fine-Grained Scheduling of Disaggregated Expert Parallelism
par: Pan, Xinglin, et autres
Publié: (2025) -
Fault-Tolerant Hybrid-Parallel Training at Scale with Reliable and Efficient In-memory Checkpointing
par: Wang, Yuxin, et autres
Publié: (2023) -
ZipCCL: Efficient Lossless Data Compression of Communication Collectives for Accelerating LLM Training
par: Lin, Wenxiang, et autres
Publié: (2026) -
FedImpro: Measuring and Improving Client Update in Federated Learning
par: Tang, Zhenheng, et autres
Publié: (2024)