Distributed Stochastic Gradient Descent with Staleness: A Stochastic Delay Differential Equation Based Framework
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Yu, Siyuan, Chen, Wei, Poor, H. Vincent |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Distributed Deep Learning using Stochastic Gradient Staleness
par: Pham, Viet Hoang, et autres
Publié: (2025)
par: Pham, Viet Hoang, et autres
Publié: (2025)
Trustworthiness of Stochastic Gradient Descent in Distributed Learning
par: Li, Hongyang, et autres
Publié: (2024)
par: Li, Hongyang, et autres
Publié: (2024)
First-Order Softmax Weighted Switching Gradient Method for Distributed Stochastic Minimax Optimization with Stochastic Constraints
par: Luo, Zhankun, et autres
Publié: (2026)
par: Luo, Zhankun, et autres
Publié: (2026)
High-Dimensional Sparse Data Low-rank Representation via Accelerated Asynchronous Parallel Stochastic Gradient Descent
par: Hu, Qicong, et autres
Publié: (2024)
par: Hu, Qicong, et autres
Publié: (2024)
FedStaleWeight: Buffered Asynchronous Federated Learning with Fair Aggregation via Staleness Reweighting
par: Ma, Jeffrey, et autres
Publié: (2024)
par: Ma, Jeffrey, et autres
Publié: (2024)
ADP-VRSGP: Decentralized Learning with Adaptive Differential Privacy via Variance-Reduced Stochastic Gradient Push
par: Wu, Xiaoming, et autres
Publié: (2025)
par: Wu, Xiaoming, et autres
Publié: (2025)
Effectiveness of Distributed Gradient Descent with Local Steps for Overparameterized Models
par: Zhu, Heng, et autres
Publié: (2024)
par: Zhu, Heng, et autres
Publié: (2024)
Tackling Intertwined Data and Device Heterogeneities in Federated Learning with Unlimited Staleness
par: Wang, Haoming, et autres
Publié: (2023)
par: Wang, Haoming, et autres
Publié: (2023)
Asynchronous Federated Stochastic Optimization for Heterogeneous Objectives Under Arbitrary Delays
par: Iakovidou, Charikleia, et autres
Publié: (2024)
par: Iakovidou, Charikleia, et autres
Publié: (2024)
MSPipe: Efficient Temporal GNN Training via Staleness-Aware Pipeline
par: Sheng, Guangming, et autres
Publié: (2024)
par: Sheng, Guangming, et autres
Publié: (2024)
Asynch-SGBDT: Asynchronous Parallel Stochastic Gradient Boosting Decision Tree based on Parameters Server
par: Daning, Cheng, et autres
Publié: (2018)
par: Daning, Cheng, et autres
Publié: (2018)
Hybrid Approach to Parallel Stochastic Gradient Descent
par: Vora, Aakash Sudhirbhai, et autres
Publié: (2024)
par: Vora, Aakash Sudhirbhai, et autres
Publié: (2024)
A Bias-Correction Decentralized Stochastic Gradient Algorithm with Momentum Acceleration
par: Hu, Yuchen, et autres
Publié: (2025)
par: Hu, Yuchen, et autres
Publié: (2025)
Federated Attention: A Distributed Paradigm for Collaborative LLM Inference over Edge Networks
par: Deng, Xiumei, et autres
Publié: (2025)
par: Deng, Xiumei, et autres
Publié: (2025)
Federated Learning on Stochastic Neural Networks
par: Tang, Jingqiao, et autres
Publié: (2025)
par: Tang, Jingqiao, et autres
Publié: (2025)
Towards Communication-efficient Federated Learning via Sparse and Aligned Adaptive Optimization
par: Deng, Xiumei, et autres
Publié: (2024)
par: Deng, Xiumei, et autres
Publié: (2024)
Optimizing Stochastic Gradient Push under Broadcast Communications
par: Nguyen, Tuan, et autres
Publié: (2026)
par: Nguyen, Tuan, et autres
Publié: (2026)
High Dimensional Distributed Gradient Descent with Arbitrary Number of Byzantine Attackers
par: Liu, Wenyu, et autres
Publié: (2023)
par: Liu, Wenyu, et autres
Publié: (2023)
A Hybrid Stochastic Gradient Tracking Method for Distributed Online Optimization Over Time-Varying Directed Networks
par: Shi, Xinli, et autres
Publié: (2025)
par: Shi, Xinli, et autres
Publié: (2025)
SignSGD with Federated Voting
par: Park, Chanho, et autres
Publié: (2024)
par: Park, Chanho, et autres
Publié: (2024)
Unified Analysis of Decentralized Gradient Descent: a Contraction Mapping Framework
par: Larsson, Erik G., et autres
Publié: (2025)
par: Larsson, Erik G., et autres
Publié: (2025)
GPFL: A Gradient Projection-Based Client Selection Framework for Efficient Federated Learning
par: Na, Shijie, et autres
Publié: (2024)
par: Na, Shijie, et autres
Publié: (2024)
AntDT: A Self-Adaptive Distributed Training Framework for Leader and Straggler Nodes
par: Xiao, Youshao, et autres
Publié: (2024)
par: Xiao, Youshao, et autres
Publié: (2024)
Lower Bounds and Accelerated Algorithms in Distributed Stochastic Optimization with Communication Compression
par: He, Yutong, et autres
Publié: (2023)
par: He, Yutong, et autres
Publié: (2023)
Mitigating Staleness in Asynchronous Pipeline Parallelism via Basis Rotation
par: Jung, Hyunji, et autres
Publié: (2026)
par: Jung, Hyunji, et autres
Publié: (2026)
Low-Communication Resilient Distributed Estimation Algorithm Based on Memory Mechanism
par: Li, Wei, et autres
Publié: (2025)
par: Li, Wei, et autres
Publié: (2025)
Communication-Efficient Distributed Learning via Sparse and Adaptive Stochastic Gradient
par: Deng, Xiaoge, et autres
Publié: (2021)
par: Deng, Xiaoge, et autres
Publié: (2021)
FedGCS: A Generative Framework for Efficient Client Selection in Federated Learning via Gradient-based Optimization
par: Ning, Zhiyuan, et autres
Publié: (2024)
par: Ning, Zhiyuan, et autres
Publié: (2024)
Improved Quantization Strategies for Managing Heavy-tailed Gradients in Distributed Learning
par: Yan, Guangfeng, et autres
Publié: (2024)
par: Yan, Guangfeng, et autres
Publié: (2024)
Distributed Learning based on 1-Bit Gradient Coding in the Presence of Stragglers
par: Li, Chengxi, et autres
Publié: (2024)
par: Li, Chengxi, et autres
Publié: (2024)
ECHO-2: A Large-Scale Distributed Rollout Framework for Cost-Efficient Reinforcement Learning
par: Song, Jingwei, et autres
Publié: (2026)
par: Song, Jingwei, et autres
Publié: (2026)
Decentralized Federated Learning Over Imperfect Communication Channels
par: Li, Weicai, et autres
Publié: (2024)
par: Li, Weicai, et autres
Publié: (2024)
Preserving Near-Optimal Gradient Sparsification Cost for Scalable Distributed Deep Learning
par: Yoon, Daegun, et autres
Publié: (2024)
par: Yoon, Daegun, et autres
Publié: (2024)
A-3PO: Accelerating Asynchronous LLM Training with Staleness-aware Proximal Policy Approximation
par: Li, Xiaocan, et autres
Publié: (2025)
par: Li, Xiaocan, et autres
Publié: (2025)
Traversal Learning: A Lossless And Efficient Distributed Learning Framework
par: Batbaatar, Erdenebileg, et autres
Publié: (2025)
par: Batbaatar, Erdenebileg, et autres
Publié: (2025)
MiCRO: Near-Zero Cost Gradient Sparsification for Scaling and Accelerating Distributed DNN Training
par: Yoon, Daegun, et autres
Publié: (2023)
par: Yoon, Daegun, et autres
Publié: (2023)
Rethinking Resource Management in Edge Learning: A Joint Pre-training and Fine-tuning Design Paradigm
par: Lyu, Zhonghao, et autres
Publié: (2024)
par: Lyu, Zhonghao, et autres
Publié: (2024)
EarthSight: A Distributed Framework for Low-Latency Satellite Intelligence
par: Erol, Ansel Kaplan, et autres
Publié: (2025)
par: Erol, Ansel Kaplan, et autres
Publié: (2025)
A Distributed Framework for Causal Modeling of Performance Variability in GPU Traces
par: Lahiry, Ankur, et autres
Publié: (2025)
par: Lahiry, Ankur, et autres
Publié: (2025)
Gradient-based Trajectory Optimization with Parallelized Differentiable Traffic Simulation
par: Son, Sanghyun, et autres
Publié: (2024)
par: Son, Sanghyun, et autres
Publié: (2024)
Documents similaires
-
Distributed Deep Learning using Stochastic Gradient Staleness
par: Pham, Viet Hoang, et autres
Publié: (2025) -
Trustworthiness of Stochastic Gradient Descent in Distributed Learning
par: Li, Hongyang, et autres
Publié: (2024) -
First-Order Softmax Weighted Switching Gradient Method for Distributed Stochastic Minimax Optimization with Stochastic Constraints
par: Luo, Zhankun, et autres
Publié: (2026) -
High-Dimensional Sparse Data Low-rank Representation via Accelerated Asynchronous Parallel Stochastic Gradient Descent
par: Hu, Qicong, et autres
Publié: (2024) -
FedStaleWeight: Buffered Asynchronous Federated Learning with Fair Aggregation via Staleness Reweighting
par: Ma, Jeffrey, et autres
Publié: (2024)