The Impact of On-Policy Parallelized Data Collection on Deep Reinforcement Learning Networks
Fuente:
arXiv
Salvato in:
| Autori principali: | Mayor, Walter, Obando-Ceron, Johan, Courville, Aaron, Castro, Pablo Samuel |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Stable Deep Reinforcement Learning via Isotropic Gaussian Representations
di: Pasand, Ali Saheb, et al.
Pubblicazione: (2026)
di: Pasand, Ali Saheb, et al.
Pubblicazione: (2026)
In value-based deep reinforcement learning, a pruned network is a good network
di: Obando-Ceron, Johan, et al.
Pubblicazione: (2024)
di: Obando-Ceron, Johan, et al.
Pubblicazione: (2024)
Simplicial Embeddings Improve Sample Efficiency in Actor-Critic Agents
di: Obando-Ceron, Johan, et al.
Pubblicazione: (2025)
di: Obando-Ceron, Johan, et al.
Pubblicazione: (2025)
Mitigating Plasticity Loss in Continual Reinforcement Learning by Reducing Churn
di: Tang, Hongyao, et al.
Pubblicazione: (2025)
di: Tang, Hongyao, et al.
Pubblicazione: (2025)
On the consistency of hyper-parameter selection in value-based deep reinforcement learning
di: Obando-Ceron, Johan, et al.
Pubblicazione: (2024)
di: Obando-Ceron, Johan, et al.
Pubblicazione: (2024)
Don't flatten, tokenize! Unlocking the key to SoftMoE's efficacy in deep RL
di: Sokar, Ghada, et al.
Pubblicazione: (2024)
di: Sokar, Ghada, et al.
Pubblicazione: (2024)
The Courage to Stop: Overcoming Sunk Cost Fallacy in Deep Reinforcement Learning
di: Liu, Jiashun, et al.
Pubblicazione: (2025)
di: Liu, Jiashun, et al.
Pubblicazione: (2025)
A Mechanistic Analysis of Looped Reasoning Language Models
di: Blayney, Hugh, et al.
Pubblicazione: (2026)
di: Blayney, Hugh, et al.
Pubblicazione: (2026)
Adaptive Computation Pruning for the Forgetting Transformer
di: Lin, Zhixuan, et al.
Pubblicazione: (2025)
di: Lin, Zhixuan, et al.
Pubblicazione: (2025)
Neuroplastic Expansion in Deep Reinforcement Learning
di: Liu, Jiashun, et al.
Pubblicazione: (2024)
di: Liu, Jiashun, et al.
Pubblicazione: (2024)
Asymmetric Proximal Policy Optimization: mini-critics boost LLM reasoning
di: Liu, Jiashun, et al.
Pubblicazione: (2025)
di: Liu, Jiashun, et al.
Pubblicazione: (2025)
Stable Gradients for Stable Learning at Scale in Deep Reinforcement Learning
di: Castanyer, Roger Creus, et al.
Pubblicazione: (2025)
di: Castanyer, Roger Creus, et al.
Pubblicazione: (2025)
Mixture of Experts in a Mixture of RL settings
di: Willi, Timon, et al.
Pubblicazione: (2024)
di: Willi, Timon, et al.
Pubblicazione: (2024)
A Survey of State Representation Learning for Deep Reinforcement Learning
di: Echchahed, Ayoub, et al.
Pubblicazione: (2025)
di: Echchahed, Ayoub, et al.
Pubblicazione: (2025)
A Comedy of Estimators: On KL Regularization in RL Training of LLMs
di: Shah, Vedant, et al.
Pubblicazione: (2025)
di: Shah, Vedant, et al.
Pubblicazione: (2025)
Mixtures of Experts Unlock Parameter Scaling for Deep RL
di: Obando-Ceron, Johan, et al.
Pubblicazione: (2024)
di: Obando-Ceron, Johan, et al.
Pubblicazione: (2024)
Mind the GAP! The Challenges of Scale in Pixel-based Deep Reinforcement Learning
di: Sokar, Ghada, et al.
Pubblicazione: (2025)
di: Sokar, Ghada, et al.
Pubblicazione: (2025)
The Formalism-Implementation Gap in Reinforcement Learning Research
di: Castro, Pablo Samuel
Pubblicazione: (2025)
di: Castro, Pablo Samuel
Pubblicazione: (2025)
Measure gradients, not activations! Enhancing neuronal activity in deep reinforcement learning
di: Liu, Jiashun, et al.
Pubblicazione: (2025)
di: Liu, Jiashun, et al.
Pubblicazione: (2025)
Offline Policy Evaluation for Reinforcement Learning with Adaptively Collected Data
di: Madhow, Sunil, et al.
Pubblicazione: (2023)
di: Madhow, Sunil, et al.
Pubblicazione: (2023)
Compositional Discrete Latent Code for High Fidelity, Productive Diffusion Models
di: Lavoie, Samuel, et al.
Pubblicazione: (2025)
di: Lavoie, Samuel, et al.
Pubblicazione: (2025)
Deep Reinforcement Learning for Inventory Networks: Toward Reliable Policy Optimization
di: Alvo, Matias, et al.
Pubblicazione: (2023)
di: Alvo, Matias, et al.
Pubblicazione: (2023)
Rank-1 Approximation of Inverse Fisher for Natural Policy Gradients in Deep Reinforcement Learning
di: Huo, Yingxiao, et al.
Pubblicazione: (2026)
di: Huo, Yingxiao, et al.
Pubblicazione: (2026)
Solving Deep Reinforcement Learning Tasks with Evolution Strategies and Linear Policy Networks
di: Wong, Annie, et al.
Pubblicazione: (2024)
di: Wong, Annie, et al.
Pubblicazione: (2024)
Scaling Up Data Parallelism in Decentralized Deep Learning
di: Xie, Bing, et al.
Pubblicazione: (2025)
di: Xie, Bing, et al.
Pubblicazione: (2025)
Asynchronous RLHF: Faster and More Efficient Off-Policy RL for Language Models
di: Noukhovitch, Michael, et al.
Pubblicazione: (2024)
di: Noukhovitch, Michael, et al.
Pubblicazione: (2024)
Blending Imitation and Reinforcement Learning for Robust Policy Improvement
di: Liu, Xuefeng, et al.
Pubblicazione: (2023)
di: Liu, Xuefeng, et al.
Pubblicazione: (2023)
DeepStock: Reinforcement Learning with Policy Regularizations for Inventory Management
di: Xie, Yaqi, et al.
Pubblicazione: (2026)
di: Xie, Yaqi, et al.
Pubblicazione: (2026)
A Study of Plasticity Loss in On-Policy Deep Reinforcement Learning
di: Juliani, Arthur, et al.
Pubblicazione: (2024)
di: Juliani, Arthur, et al.
Pubblicazione: (2024)
CALE: Continuous Arcade Learning Environment
di: Farebrother, Jesse, et al.
Pubblicazione: (2024)
di: Farebrother, Jesse, et al.
Pubblicazione: (2024)
The Impact of Off-Policy Training Data on Probe Generalisation
di: Kirch, Nathalie, et al.
Pubblicazione: (2025)
di: Kirch, Nathalie, et al.
Pubblicazione: (2025)
The Impact of Quantization and Pruning on Deep Reinforcement Learning Models
di: Lu, Heng, et al.
Pubblicazione: (2024)
di: Lu, Heng, et al.
Pubblicazione: (2024)
Multi-Task Reinforcement Learning Enables Parameter Scaling
di: McLean, Reginald, et al.
Pubblicazione: (2025)
di: McLean, Reginald, et al.
Pubblicazione: (2025)
Studying the Interplay Between the Actor and Critic Representations in Reinforcement Learning
di: Garcin, Samuel, et al.
Pubblicazione: (2025)
di: Garcin, Samuel, et al.
Pubblicazione: (2025)
Adaptive Data Exploitation in Deep Reinforcement Learning
di: Yuan, Mingqi, et al.
Pubblicazione: (2025)
di: Yuan, Mingqi, et al.
Pubblicazione: (2025)
ARM-FM: Automated Reward Machines via Foundation Models for Compositional Reinforcement Learning
di: Castanyer, Roger Creus, et al.
Pubblicazione: (2025)
di: Castanyer, Roger Creus, et al.
Pubblicazione: (2025)
LOQA: Learning with Opponent Q-Learning Awareness
di: Aghajohari, Milad, et al.
Pubblicazione: (2024)
di: Aghajohari, Milad, et al.
Pubblicazione: (2024)
SafeAdapt: Provably Safe Policy Updates in Deep Reinforcement Learning
di: Anisimov, Maksim, et al.
Pubblicazione: (2026)
di: Anisimov, Maksim, et al.
Pubblicazione: (2026)
Efficient Deep Reinforcement Learning with Predictive Processing Proximal Policy Optimization
di: Küçükoğlu, Burcu, et al.
Pubblicazione: (2022)
di: Küçükoğlu, Burcu, et al.
Pubblicazione: (2022)
Optimal Policy Sparsification and Low Rank Decomposition for Deep Reinforcement Learning
di: Goddla, Vikram
Pubblicazione: (2024)
di: Goddla, Vikram
Pubblicazione: (2024)
Documenti analoghi
-
Stable Deep Reinforcement Learning via Isotropic Gaussian Representations
di: Pasand, Ali Saheb, et al.
Pubblicazione: (2026) -
In value-based deep reinforcement learning, a pruned network is a good network
di: Obando-Ceron, Johan, et al.
Pubblicazione: (2024) -
Simplicial Embeddings Improve Sample Efficiency in Actor-Critic Agents
di: Obando-Ceron, Johan, et al.
Pubblicazione: (2025) -
Mitigating Plasticity Loss in Continual Reinforcement Learning by Reducing Churn
di: Tang, Hongyao, et al.
Pubblicazione: (2025) -
On the consistency of hyper-parameter selection in value-based deep reinforcement learning
di: Obando-Ceron, Johan, et al.
Pubblicazione: (2024)