DistRL: An Asynchronous Distributed Reinforcement Learning Framework for On-Device Control Agents
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Wang, Taiyi, Wu, Zhihao, Liu, Jianheng, Hao, Jianye, Wang, Jun, Shao, Kun |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
DistFlow: A Fully Distributed RL Framework for Scalable and Efficient LLM Post-Training
par: Wang, Zhixin, et autres
Publié: (2025)
par: Wang, Zhixin, et autres
Publié: (2025)
Asynchronous Policy Gradient Aggregation for Efficient Distributed Reinforcement Learning
par: Tyurin, Alexander, et autres
Publié: (2025)
par: Tyurin, Alexander, et autres
Publié: (2025)
StarDist: A Code Generator for Distributed Graph Algorithms
par: Nandy, Barenya Kumar, et autres
Publié: (2025)
par: Nandy, Barenya Kumar, et autres
Publié: (2025)
EchoPFL: Asynchronous Personalized Federated Learning on Mobile Devices with On-Demand Staleness Control
par: Li, Xiaochen, et autres
Publié: (2024)
par: Li, Xiaochen, et autres
Publié: (2024)
Distributed Stochastic Momentum Tracking with Local Updates: Achieving Optimal Communication and Iteration Complexities
par: Huang, Kun, et autres
Publié: (2025)
par: Huang, Kun, et autres
Publié: (2025)
Unleashing Efficient Asynchronous RL Post-Training via Staleness-Constrained Rollout Coordination
par: Li, Haoyang, et autres
Publié: (2026)
par: Li, Haoyang, et autres
Publié: (2026)
HetRL: Efficient Reinforcement Learning for LLMs in Heterogeneous Environments
par: He, Yongjun, et autres
Publié: (2025)
par: He, Yongjun, et autres
Publié: (2025)
DistServe: Disaggregating Prefill and Decoding for Goodput-optimized Large Language Model Serving
par: Zhong, Yinmin, et autres
Publié: (2024)
par: Zhong, Yinmin, et autres
Publié: (2024)
OServe: Accelerating LLM Serving via Spatial-Temporal Workload Orchestration
par: Jiang, Youhe, et autres
Publié: (2026)
par: Jiang, Youhe, et autres
Publié: (2026)
Tailoring Gradient Methods for Differentially-Private Distributed Optimization
par: Wang, Yongqiang, et autres
Publié: (2022)
par: Wang, Yongqiang, et autres
Publié: (2022)
Rescaled Asynchronous SGD: Optimal Distributed Optimization under Data and System Heterogeneity
par: Mahran, Ammar, et autres
Publié: (2026)
par: Mahran, Ammar, et autres
Publié: (2026)
Efficient Coordination for Distributed Discrete-Event Systems
par: Jun, Byeonggil, et autres
Publié: (2024)
par: Jun, Byeonggil, et autres
Publié: (2024)
HiRL: Hierarchical Reinforcement Learning for Coordinated Resource Management in Heterogeneous Edge Computing
par: Zhu, Jianyong, et autres
Publié: (2026)
par: Zhu, Jianyong, et autres
Publié: (2026)
Efficient Data-Parallel Continual Learning with Asynchronous Distributed Rehearsal Buffers
par: Bouvier, Thomas, et autres
Publié: (2024)
par: Bouvier, Thomas, et autres
Publié: (2024)
Laminar: A Scalable Asynchronous RL Post-Training Framework
par: Sheng, Guangming, et autres
Publié: (2025)
par: Sheng, Guangming, et autres
Publié: (2025)
Birch SGD: A Tree Graph Framework for Local and Asynchronous SGD Methods
par: Tyurin, Alexander, et autres
Publié: (2025)
par: Tyurin, Alexander, et autres
Publié: (2025)
Fault-Tolerant Decentralized Distributed Asynchronous Federated Learning with Adaptive Termination Detection
par: Akkinepally, Phani Sahasra, et autres
Publié: (2025)
par: Akkinepally, Phani Sahasra, et autres
Publié: (2025)
AReaL-Hex: Accommodating Asynchronous RL Training over Heterogeneous GPUs
par: Yan, Ran, et autres
Publié: (2025)
par: Yan, Ran, et autres
Publié: (2025)
One-Point Feedback for Composite Optimization with Applications to Distributed and Federated Learning
par: Beznosikov, Aleksandr, et autres
Publié: (2021)
par: Beznosikov, Aleksandr, et autres
Publié: (2021)
Asynchronous Federated Learning Using Outdated Local Updates Over TDMA Channel
par: Song, Jaeyoung, et autres
Publié: (2024)
par: Song, Jaeyoung, et autres
Publié: (2024)
Asynchronous Fault-Tolerant Distributed Proper Coloring of Graphs
par: Balliu, Alkida, et autres
Publié: (2024)
par: Balliu, Alkida, et autres
Publié: (2024)
Reducing the Communication of Distributed Model Predictive Control: Autoencoders and Formation Control
par: Schiz, Torben, et autres
Publié: (2025)
par: Schiz, Torben, et autres
Publié: (2025)
DistTrain: Addressing Model and Data Heterogeneity with Disaggregated Training for Multimodal Large Language Models
par: Zhang, Zili, et autres
Publié: (2024)
par: Zhang, Zili, et autres
Publié: (2024)
UDMC: Unified Decision-Making and Control Framework for Urban Autonomous Driving with Motion Prediction of Traffic Participants
par: Liu, Haichao, et autres
Publié: (2025)
par: Liu, Haichao, et autres
Publié: (2025)
A Reinforcement Learning-Driven Task Scheduling Algorithm for Multi-Tenant Distributed Systems
par: Zhang, Xiaopei, et autres
Publié: (2025)
par: Zhang, Xiaopei, et autres
Publié: (2025)
Hybrid Cooperative Co-Evolution Algorithm for Deadlock-prone Distributed Assembly Flowshop Scheduling with Limited buffers Using Petri nets
par: Wang, Siyi, et autres
Publié: (2024)
par: Wang, Siyi, et autres
Publié: (2024)
Canzona: A Unified, Asynchronous, and Load-Balanced Framework for Distributed Matrix-based Optimizers
par: Wang, Liangyu, et autres
Publié: (2026)
par: Wang, Liangyu, et autres
Publié: (2026)
A GPU-Accelerated Distributed Algorithm for Optimal Power Flow in Distribution Systems
par: Ryu, Minseok, et autres
Publié: (2025)
par: Ryu, Minseok, et autres
Publié: (2025)
Autopoiesis: A Self-Evolving System Paradigm for LLM Serving Under Runtime Dynamics
par: Jiang, Youhe, et autres
Publié: (2026)
par: Jiang, Youhe, et autres
Publié: (2026)
ThunderServe: High-performance and Cost-efficient LLM Serving in Cloud Environments
par: Jiang, Youhe, et autres
Publié: (2025)
par: Jiang, Youhe, et autres
Publié: (2025)
Infinite-LLM: Efficient LLM Service for Long Context with DistAttention and Distributed KVCache
par: Lin, Bin, et autres
Publié: (2024)
par: Lin, Bin, et autres
Publié: (2024)
ACGraph: An Efficient Asynchronous Out-of-Core Graph Processing Framework
par: Chen, Dechuang, et autres
Publié: (2025)
par: Chen, Dechuang, et autres
Publié: (2025)
Distributed On-Device LLM Inference With Over-the-Air Computation
par: Zhang, Kai, et autres
Publié: (2025)
par: Zhang, Kai, et autres
Publié: (2025)
DeepCEE: Efficient Cross-Region Model Distributed Training System under Heterogeneous GPUs and Networks
par: Wang, Jinquan, et autres
Publié: (2025)
par: Wang, Jinquan, et autres
Publié: (2025)
Technical Report on Reinforcement Learning Control on the Lucas-Nülle Inverted Pendulum
par: Schenke, Maximilian, et autres
Publié: (2024)
par: Schenke, Maximilian, et autres
Publié: (2024)
SimDC: A High-Fidelity Device Simulation Platform for Device-Cloud Collaborative Computing
par: Pei, Ruiguang, et autres
Publié: (2025)
par: Pei, Ruiguang, et autres
Publié: (2025)
Distribution and Management of Datacenter Load Decoupling
par: Lin, Liuzixuan, et autres
Publié: (2025)
par: Lin, Liuzixuan, et autres
Publié: (2025)
Asynchronous Fault-Tolerant Language Decidability for Runtime Verification of Distributed Systems
par: Castañeda, Armando, et autres
Publié: (2025)
par: Castañeda, Armando, et autres
Publié: (2025)
Distributed Download from an External Data Source in Asynchronous Faulty Settings
par: Augustine, John, et autres
Publié: (2025)
par: Augustine, John, et autres
Publié: (2025)
Federated Semi-Supervised and Semi-Asynchronous Learning for Anomaly Detection in IoT Networks
par: Zhai, Wenbin, et autres
Publié: (2023)
par: Zhai, Wenbin, et autres
Publié: (2023)
Documents similaires
-
DistFlow: A Fully Distributed RL Framework for Scalable and Efficient LLM Post-Training
par: Wang, Zhixin, et autres
Publié: (2025) -
Asynchronous Policy Gradient Aggregation for Efficient Distributed Reinforcement Learning
par: Tyurin, Alexander, et autres
Publié: (2025) -
StarDist: A Code Generator for Distributed Graph Algorithms
par: Nandy, Barenya Kumar, et autres
Publié: (2025) -
EchoPFL: Asynchronous Personalized Federated Learning on Mobile Devices with On-Demand Staleness Control
par: Li, Xiaochen, et autres
Publié: (2024) -
Distributed Stochastic Momentum Tracking with Local Updates: Achieving Optimal Communication and Iteration Complexities
par: Huang, Kun, et autres
Publié: (2025)