Truncated Non-Uniform Quantization for Distributed SGD
Fuente:
arXiv
Salvato in:
| Autori principali: | Yan, Guangfeng, Li, Tan, Xiao, Yuanzhang, Li, Congduan, Song, Linqi |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Improved Quantization Strategies for Managing Heavy-tailed Gradients in Distributed Learning
di: Yan, Guangfeng, et al.
Pubblicazione: (2024)
di: Yan, Guangfeng, et al.
Pubblicazione: (2024)
Ordered Momentum for Asynchronous SGD
di: Shi, Chang-Wei, et al.
Pubblicazione: (2024)
di: Shi, Chang-Wei, et al.
Pubblicazione: (2024)
Cooperative SGD with Dynamic Mixing Matrices
di: Sarkar, Soumya, et al.
Pubblicazione: (2025)
di: Sarkar, Soumya, et al.
Pubblicazione: (2025)
QSync: Quantization-Minimized Synchronous Distributed Training Across Hybrid Devices
di: Zhao, Juntao, et al.
Pubblicazione: (2024)
di: Zhao, Juntao, et al.
Pubblicazione: (2024)
Order-Optimal Regret in Distributed Kernel Bandits using Uniform Sampling with Shared Randomness
di: Pavlovic, Nikola, et al.
Pubblicazione: (2024)
di: Pavlovic, Nikola, et al.
Pubblicazione: (2024)
Unleashing the Power of Continual Learning on Non-Centralized Devices: A Survey
di: Li, Yichen, et al.
Pubblicazione: (2024)
di: Li, Yichen, et al.
Pubblicazione: (2024)
The Limits and Potentials of Local SGD for Distributed Heterogeneous Learning with Intermittent Communication
di: Patel, Kumar Kshitij, et al.
Pubblicazione: (2024)
di: Patel, Kumar Kshitij, et al.
Pubblicazione: (2024)
Rescaled Asynchronous SGD: Optimal Distributed Optimization under Data and System Heterogeneity
di: Mahran, Ammar, et al.
Pubblicazione: (2026)
di: Mahran, Ammar, et al.
Pubblicazione: (2026)
Birch SGD: A Tree Graph Framework for Local and Asynchronous SGD Methods
di: Tyurin, Alexander, et al.
Pubblicazione: (2025)
di: Tyurin, Alexander, et al.
Pubblicazione: (2025)
Reinforcement Learning for Adaptive Resource Scheduling in Complex System Environments
di: Li, Pochun, et al.
Pubblicazione: (2024)
di: Li, Pochun, et al.
Pubblicazione: (2024)
Virtual Nodes Can Help: Tackling Distribution Shifts in Federated Graph Learning
di: Fu, Xingbo, et al.
Pubblicazione: (2024)
di: Fu, Xingbo, et al.
Pubblicazione: (2024)
SignSGD with Federated Voting
di: Park, Chanho, et al.
Pubblicazione: (2024)
di: Park, Chanho, et al.
Pubblicazione: (2024)
dSTAR: Straggler Tolerant and Byzantine Resilient Distributed SGD
di: Yan, Jiahe, et al.
Pubblicazione: (2024)
di: Yan, Jiahe, et al.
Pubblicazione: (2024)
MindFlayer SGD: Efficient Parallel SGD in the Presence of Heterogeneous and Random Worker Compute Times
di: Maranjyan, Artavazd, et al.
Pubblicazione: (2024)
di: Maranjyan, Artavazd, et al.
Pubblicazione: (2024)
LOSCAR-SGD: Local SGD with Communication-Computation Overlap and Delay-Corrected Sparse Model Averaging
di: Maziane, Yassine, et al.
Pubblicazione: (2026)
di: Maziane, Yassine, et al.
Pubblicazione: (2026)
Priority-Aware Model-Distributed Inference at Edge Networks
di: Li, Teng, et al.
Pubblicazione: (2024)
di: Li, Teng, et al.
Pubblicazione: (2024)
MoE-SpeQ: Speculative Quantized Decoding with Proactive Expert Prefetching and Offloading for Mixture-of-Experts
di: Wang, Wenfeng, et al.
Pubblicazione: (2025)
di: Wang, Wenfeng, et al.
Pubblicazione: (2025)
Homogenizing Non-IID datasets via In-Distribution Knowledge Distillation for Decentralized Learning
di: Ravikumar, Deepak, et al.
Pubblicazione: (2023)
di: Ravikumar, Deepak, et al.
Pubblicazione: (2023)
Distributed Learning based on 1-Bit Gradient Coding in the Presence of Stragglers
di: Li, Chengxi, et al.
Pubblicazione: (2024)
di: Li, Chengxi, et al.
Pubblicazione: (2024)
Minder: Faulty Machine Detection for Large-scale Distributed Model Training
di: Deng, Yangtao, et al.
Pubblicazione: (2024)
di: Deng, Yangtao, et al.
Pubblicazione: (2024)
Enhancing Convergence, Privacy and Fairness for Wireless Personalized Federated Learning: Quantization-Assisted Min-Max Fair Scheduling
di: Zhao, Xiyu, et al.
Pubblicazione: (2025)
di: Zhao, Xiyu, et al.
Pubblicazione: (2025)
AI-Driven Health Monitoring of Distributed Computing Architecture: Insights from XGBoost and SHAP
di: Sun, Xiaoxuan, et al.
Pubblicazione: (2024)
di: Sun, Xiaoxuan, et al.
Pubblicazione: (2024)
Deal: Distributed End-to-End GNN Inference for All Nodes
di: Chen, Shiyang, et al.
Pubblicazione: (2025)
di: Chen, Shiyang, et al.
Pubblicazione: (2025)
AntDT: A Self-Adaptive Distributed Training Framework for Leader and Straggler Nodes
di: Xiao, Youshao, et al.
Pubblicazione: (2024)
di: Xiao, Youshao, et al.
Pubblicazione: (2024)
Flexible Clustered Federated Learning for Client-Level Data Distribution Shift
di: Duan, Moming, et al.
Pubblicazione: (2021)
di: Duan, Moming, et al.
Pubblicazione: (2021)
Preble: Efficient Distributed Prompt Scheduling for LLM Serving
di: Srivatsa, Vikranth, et al.
Pubblicazione: (2024)
di: Srivatsa, Vikranth, et al.
Pubblicazione: (2024)
Energy-Efficient Quantized Federated Learning for Resource-constrained IoT devices
di: Compaoré, Wilfrid Sougrinoma, et al.
Pubblicazione: (2025)
di: Compaoré, Wilfrid Sougrinoma, et al.
Pubblicazione: (2025)
Low-Communication Resilient Distributed Estimation Algorithm Based on Memory Mechanism
di: Li, Wei, et al.
Pubblicazione: (2025)
di: Li, Wei, et al.
Pubblicazione: (2025)
D3FL: Data Distribution and Detrending for Robust Federated Learning in Non-linear Time-series Data
di: Marisetty, Harsha Varun, et al.
Pubblicazione: (2025)
di: Marisetty, Harsha Varun, et al.
Pubblicazione: (2025)
FedSR: A Semi-Decentralized Federated Learning Algorithm for Non-IIDness in IoT System
di: Huang, Jianjun, et al.
Pubblicazione: (2024)
di: Huang, Jianjun, et al.
Pubblicazione: (2024)
FedUHB: Accelerating Federated Unlearning via Polyak Heavy Ball Method
di: Jiang, Yu, et al.
Pubblicazione: (2024)
di: Jiang, Yu, et al.
Pubblicazione: (2024)
SHARe-KAN: Post-Training Vector Quantization for Cache-Resident KAN Inference
di: Smith, Jeff
Pubblicazione: (2025)
di: Smith, Jeff
Pubblicazione: (2025)
Robust Fully-Asynchronous Methods for Distributed Training over General Architecture
di: Zhu, Zehan, et al.
Pubblicazione: (2023)
di: Zhu, Zehan, et al.
Pubblicazione: (2023)
A Unified Solution to Diverse Heterogeneities in One-shot Federated Learning
di: Bai, Jun, et al.
Pubblicazione: (2024)
di: Bai, Jun, et al.
Pubblicazione: (2024)
ChunkFlow: Communication-Aware Chunked Prefetching for Layerwise Offloading in Distributed Diffusion Transformer Inference
di: Meng, Han, et al.
Pubblicazione: (2026)
di: Meng, Han, et al.
Pubblicazione: (2026)
Byzantine-Robust and Communication-Efficient Distributed Learning via Compressed Momentum Filtering
di: Liu, Changxin, et al.
Pubblicazione: (2024)
di: Liu, Changxin, et al.
Pubblicazione: (2024)
GraNNDis: Efficient Unified Distributed Training Framework for Deep GNNs on Large Clusters
di: Song, Jaeyong, et al.
Pubblicazione: (2023)
di: Song, Jaeyong, et al.
Pubblicazione: (2023)
Echo: Simulating Distributed Training At Scale
di: Feng, Yicheng, et al.
Pubblicazione: (2024)
di: Feng, Yicheng, et al.
Pubblicazione: (2024)
Robust Federated Learning against Model Perturbation in Edge Networks
di: Jin, Dongzi, et al.
Pubblicazione: (2025)
di: Jin, Dongzi, et al.
Pubblicazione: (2025)
Distributed Graph Embedding with Information-Oriented Random Walks
di: Fang, Peng, et al.
Pubblicazione: (2023)
di: Fang, Peng, et al.
Pubblicazione: (2023)
Documenti analoghi
-
Improved Quantization Strategies for Managing Heavy-tailed Gradients in Distributed Learning
di: Yan, Guangfeng, et al.
Pubblicazione: (2024) -
Ordered Momentum for Asynchronous SGD
di: Shi, Chang-Wei, et al.
Pubblicazione: (2024) -
Cooperative SGD with Dynamic Mixing Matrices
di: Sarkar, Soumya, et al.
Pubblicazione: (2025) -
QSync: Quantization-Minimized Synchronous Distributed Training Across Hybrid Devices
di: Zhao, Juntao, et al.
Pubblicazione: (2024) -
Order-Optimal Regret in Distributed Kernel Bandits using Uniform Sampling with Shared Randomness
di: Pavlovic, Nikola, et al.
Pubblicazione: (2024)