Highly Parallelized Reinforcement Learning Training with Relaxed Assignment Dependencies
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | He, Zhouyu, Qiao, Peng, Li, Rongchun, Dou, Yong, Tan, Yusong |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2025
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Generative Pre-Trained Transformer for Symbolic Regression Base In-Context Reinforcement Learning
von: Li, Yanjie, et al.
Veröffentlicht: (2024)
von: Li, Yanjie, et al.
Veröffentlicht: (2024)
Acceleration for Deep Reinforcement Learning using Parallel and Distributed Computing: A Survey
von: Liu, Zhihong, et al.
Veröffentlicht: (2024)
von: Liu, Zhihong, et al.
Veröffentlicht: (2024)
DAWM: Diffusion Action World Models for Offline Reinforcement Learning via Action-Inferred Transitions
von: Li, Zongyue, et al.
Veröffentlicht: (2025)
von: Li, Zongyue, et al.
Veröffentlicht: (2025)
Search-Based Credit Assignment for Offline Preference-Based Reinforcement Learning
von: Gao, Xiancheng, et al.
Veröffentlicht: (2025)
von: Gao, Xiancheng, et al.
Veröffentlicht: (2025)
Pinpointing crucial steps: Attribution-based Credit Assignment for Verifiable Reinforcement Learning
von: Yin, Junxi, et al.
Veröffentlicht: (2025)
von: Yin, Junxi, et al.
Veröffentlicht: (2025)
Sequence Compression Speeds Up Credit Assignment in Reinforcement Learning
von: Ramesh, Aditya A., et al.
Veröffentlicht: (2024)
von: Ramesh, Aditya A., et al.
Veröffentlicht: (2024)
A Survey of Temporal Credit Assignment in Deep Reinforcement Learning
von: Pignatelli, Eduardo, et al.
Veröffentlicht: (2023)
von: Pignatelli, Eduardo, et al.
Veröffentlicht: (2023)
HiPER: Hierarchical Reinforcement Learning with Explicit Credit Assignment for Large Language Model Agents
von: Peng, Jiangweizhi, et al.
Veröffentlicht: (2026)
von: Peng, Jiangweizhi, et al.
Veröffentlicht: (2026)
Transolver is a Linear Transformer: Revisiting Physics-Attention through the Lens of Linear Attention
von: Hu, Wenjie, et al.
Veröffentlicht: (2025)
von: Hu, Wenjie, et al.
Veröffentlicht: (2025)
Learning Solution-Aware Transformers for Efficiently Solving Quadratic Assignment Problem
von: Tan, Zhentao, et al.
Veröffentlicht: (2024)
von: Tan, Zhentao, et al.
Veröffentlicht: (2024)
SOLAR-RL: Semi-Online Long-horizon Assignment Reinforcement Learning
von: Wang, Jichao, et al.
Veröffentlicht: (2026)
von: Wang, Jichao, et al.
Veröffentlicht: (2026)
Latent Reward: LLM-Empowered Credit Assignment in Episodic Reinforcement Learning
von: Qu, Yun, et al.
Veröffentlicht: (2024)
von: Qu, Yun, et al.
Veröffentlicht: (2024)
Double Successive Over-Relaxation Q-Learning with an Extension to Deep Reinforcement Learning
von: R, Shreyas S
Veröffentlicht: (2024)
von: R, Shreyas S
Veröffentlicht: (2024)
NurseSchedRL: Attention-Guided Reinforcement Learning for Nurse-Patient Assignment
von: Koduri, Harsha
Veröffentlicht: (2025)
von: Koduri, Harsha
Veröffentlicht: (2025)
LLM-Guided Reinforcement Learning: Addressing Training Bottlenecks through Policy Modulation
von: Tan, Heng, et al.
Veröffentlicht: (2025)
von: Tan, Heng, et al.
Veröffentlicht: (2025)
Agent Lightning: Train ANY AI Agents with Reinforcement Learning
von: Luo, Xufang, et al.
Veröffentlicht: (2025)
von: Luo, Xufang, et al.
Veröffentlicht: (2025)
Reinforcement Learning for Scalable Train Timetable Rescheduling with Graph Representation
von: Yue, Peng, et al.
Veröffentlicht: (2024)
von: Yue, Peng, et al.
Veröffentlicht: (2024)
Evaluating Feature Dependent Noise in Preference-based Reinforcement Learning
von: Li, Yuxuan, et al.
Veröffentlicht: (2026)
von: Li, Yuxuan, et al.
Veröffentlicht: (2026)
Unsupervised Learning for Quadratic Assignment
von: Min, Yimeng, et al.
Veröffentlicht: (2025)
von: Min, Yimeng, et al.
Veröffentlicht: (2025)
Pgx: Hardware-Accelerated Parallel Game Simulators for Reinforcement Learning
von: Koyamada, Sotetsu, et al.
Veröffentlicht: (2023)
von: Koyamada, Sotetsu, et al.
Veröffentlicht: (2023)
Scaling Behaviors of LLM Reinforcement Learning Post-Training: An Empirical Study in Mathematical Reasoning
von: Tan, Zelin, et al.
Veröffentlicht: (2025)
von: Tan, Zelin, et al.
Veröffentlicht: (2025)
Controllable Flow Matching for Online Reinforcement Learning
von: Wang, Bin, et al.
Veröffentlicht: (2025)
von: Wang, Bin, et al.
Veröffentlicht: (2025)
Energy Consumption in Parallel Neural Network Training
von: Huber, Philipp, et al.
Veröffentlicht: (2025)
von: Huber, Philipp, et al.
Veröffentlicht: (2025)
RLCAD: Reinforcement Learning Training Gym for Revolution Involved CAD Command Sequence Generation
von: Yin, Xiaolong, et al.
Veröffentlicht: (2025)
von: Yin, Xiaolong, et al.
Veröffentlicht: (2025)
The Impact of On-Policy Parallelized Data Collection on Deep Reinforcement Learning Networks
von: Mayor, Walter, et al.
Veröffentlicht: (2025)
von: Mayor, Walter, et al.
Veröffentlicht: (2025)
SIRI: Self-Internalizing Reinforcement Learning with Intrinsic Skills for LLM Agent Training
von: He, Zhongyu, et al.
Veröffentlicht: (2026)
von: He, Zhongyu, et al.
Veröffentlicht: (2026)
AdaGamma: State-Dependent Discounting for Temporal Adaptation in Reinforcement Learning
von: Wang, Yaomin, et al.
Veröffentlicht: (2026)
von: Wang, Yaomin, et al.
Veröffentlicht: (2026)
Dependable Distributed Training of Compressed Machine Learning Models
von: Malandrino, Francesco, et al.
Veröffentlicht: (2024)
von: Malandrino, Francesco, et al.
Veröffentlicht: (2024)
HyperEyes: Dual-Grained Efficiency-Aware Reinforcement Learning for Parallel Multimodal Search Agents
von: Li, Guankai, et al.
Veröffentlicht: (2026)
von: Li, Guankai, et al.
Veröffentlicht: (2026)
ParaDySe: A Parallel-Strategy Switching Framework for Dynamic Sequence Lengths in Transformer
von: Ou, Zhixin, et al.
Veröffentlicht: (2025)
von: Ou, Zhixin, et al.
Veröffentlicht: (2025)
FORLER: Federated Offline Reinforcement Learning with Q-Ensemble and Actor Rectification
von: Qiao, Nan, et al.
Veröffentlicht: (2026)
von: Qiao, Nan, et al.
Veröffentlicht: (2026)
From Observations to Events: Event-Aware World Model for Reinforcement Learning
von: Peng, Zhao-Han, et al.
Veröffentlicht: (2026)
von: Peng, Zhao-Han, et al.
Veröffentlicht: (2026)
HLS-Seek: QoR-Aware Code Generation for High-Level Synthesis via Proxy Comparative Reward Reinforcement Learning
von: Zou, Qingyun, et al.
Veröffentlicht: (2026)
von: Zou, Qingyun, et al.
Veröffentlicht: (2026)
Challenges in Credit Assignment for Multi-Agent Reinforcement Learning in Open Agent Systems
von: Abadi, Alireza Saleh, et al.
Veröffentlicht: (2025)
von: Abadi, Alireza Saleh, et al.
Veröffentlicht: (2025)
Training Large Language Models for Reasoning through Reverse Curriculum Reinforcement Learning
von: Xi, Zhiheng, et al.
Veröffentlicht: (2024)
von: Xi, Zhiheng, et al.
Veröffentlicht: (2024)
Revisiting Plasticity in Visual Reinforcement Learning: Data, Modules and Training Stages
von: Ma, Guozheng, et al.
Veröffentlicht: (2023)
von: Ma, Guozheng, et al.
Veröffentlicht: (2023)
FedDRL: A Trustworthy Federated Learning Model Fusion Method Based on Staged Reinforcement Learning
von: Chen, Leiming, et al.
Veröffentlicht: (2023)
von: Chen, Leiming, et al.
Veröffentlicht: (2023)
Rumor Detection on Social Media with Reinforcement Learning-based Key Propagation Graph Generator
von: Zhang, Yusong, et al.
Veröffentlicht: (2024)
von: Zhang, Yusong, et al.
Veröffentlicht: (2024)
Scheduling Drone and Mobile Charger via Hybrid-Action Deep Reinforcement Learning
von: Dou, Jizhe, et al.
Veröffentlicht: (2024)
von: Dou, Jizhe, et al.
Veröffentlicht: (2024)
Hindsight Credit Assignment for Long-Horizon LLM Agents
von: Tan, Hui-Ze, et al.
Veröffentlicht: (2026)
von: Tan, Hui-Ze, et al.
Veröffentlicht: (2026)
Ähnliche Einträge
-
Generative Pre-Trained Transformer for Symbolic Regression Base In-Context Reinforcement Learning
von: Li, Yanjie, et al.
Veröffentlicht: (2024) -
Acceleration for Deep Reinforcement Learning using Parallel and Distributed Computing: A Survey
von: Liu, Zhihong, et al.
Veröffentlicht: (2024) -
DAWM: Diffusion Action World Models for Offline Reinforcement Learning via Action-Inferred Transitions
von: Li, Zongyue, et al.
Veröffentlicht: (2025) -
Search-Based Credit Assignment for Offline Preference-Based Reinforcement Learning
von: Gao, Xiancheng, et al.
Veröffentlicht: (2025) -
Pinpointing crucial steps: Attribution-based Credit Assignment for Verifiable Reinforcement Learning
von: Yin, Junxi, et al.
Veröffentlicht: (2025)