CUER: Corrected Uniform Experience Replay for Off-Policy Continuous Deep Reinforcement Learning Algorithms
Fuente:
arXiv
Salvato in:
| Autori principali: | Yenicesu, Arda Sarp, Mutlu, Furkan B., Kozat, Suleyman S., Oguz, Ozgur S. |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Interpretable Responsibility Sharing as a Heuristic for Task and Motion Planning
di: Yenicesu, Arda Sarp, et al.
Pubblicazione: (2024)
di: Yenicesu, Arda Sarp, et al.
Pubblicazione: (2024)
Enhancing Deep Deterministic Policy Gradients on Continuous Control Tasks with Decoupled Prioritized Experience Replay
di: Lorasdagi, Mehmet Efe, et al.
Pubblicazione: (2025)
di: Lorasdagi, Mehmet Efe, et al.
Pubblicazione: (2025)
Locally Adaptive One-Class Classifier Fusion with Dynamic $\ell$p-Norm Constraints for Robust Anomaly Detection
di: Nourmohammadi, Sepehr, et al.
Pubblicazione: (2024)
di: Nourmohammadi, Sepehr, et al.
Pubblicazione: (2024)
Efficient Diversity-based Experience Replay for Deep Reinforcement Learning
di: Zhao, Kaiyan, et al.
Pubblicazione: (2024)
di: Zhao, Kaiyan, et al.
Pubblicazione: (2024)
When Does Non-Uniform Replay Matter in Reinforcement Learning?
di: Korniak, Michal, et al.
Pubblicazione: (2026)
di: Korniak, Michal, et al.
Pubblicazione: (2026)
CIER: A Novel Experience Replay Approach with Causal Inference in Deep Reinforcement Learning
di: Wang, Jingwen, et al.
Pubblicazione: (2024)
di: Wang, Jingwen, et al.
Pubblicazione: (2024)
H-MaP: An Iterative and Hybrid Sequential Manipulation Planner
di: Cicek, Berk, et al.
Pubblicazione: (2024)
di: Cicek, Berk, et al.
Pubblicazione: (2024)
Off-Policy Correction For Multi-Agent Reinforcement Learning
di: Zawalski, Michał, et al.
Pubblicazione: (2021)
di: Zawalski, Michał, et al.
Pubblicazione: (2021)
Experience Replay Addresses Loss of Plasticity in Continual Learning
di: Wang, Jiuqi, et al.
Pubblicazione: (2025)
di: Wang, Jiuqi, et al.
Pubblicazione: (2025)
Frugal Actor-Critic: Sample Efficient Off-Policy Deep Reinforcement Learning Using Unique Experiences
di: Singh, Nikhil Kumar, et al.
Pubblicazione: (2024)
di: Singh, Nikhil Kumar, et al.
Pubblicazione: (2024)
IDER: IDempotent Experience Replay for Reliable Continual Learning
di: Liu, Zhanwang, et al.
Pubblicazione: (2026)
di: Liu, Zhanwang, et al.
Pubblicazione: (2026)
Off-Policy Corrected Reward Modeling for Reinforcement Learning from Human Feedback
di: Ackermann, Johannes, et al.
Pubblicazione: (2025)
di: Ackermann, Johannes, et al.
Pubblicazione: (2025)
Continual Offline Reinforcement Learning via Diffusion-based Dual Generative Replay
di: Liu, Jinmei, et al.
Pubblicazione: (2024)
di: Liu, Jinmei, et al.
Pubblicazione: (2024)
Towards Off-Policy Reinforcement Learning for Ranking Policies with Human Feedback
di: Xiao, Teng, et al.
Pubblicazione: (2024)
di: Xiao, Teng, et al.
Pubblicazione: (2024)
Prioritized Trajectory Replay: A Replay Memory for Data-driven Reinforcement Learning
di: Liu, Jinyi, et al.
Pubblicazione: (2023)
di: Liu, Jinyi, et al.
Pubblicazione: (2023)
Human-Aware Robot Navigation via Reinforcement Learning with Hindsight Experience Replay and Curriculum Learning
di: Li, Keyu, et al.
Pubblicazione: (2021)
di: Li, Keyu, et al.
Pubblicazione: (2021)
VLM-Guided Experience Replay
di: Sharony, Elad, et al.
Pubblicazione: (2026)
di: Sharony, Elad, et al.
Pubblicazione: (2026)
Experience Replay with Random Reshuffling
di: Fujita, Yasuhiro
Pubblicazione: (2025)
di: Fujita, Yasuhiro
Pubblicazione: (2025)
DQN Performance with Epsilon Greedy Policies and Prioritized Experience Replay
di: Perkins, Daniel, et al.
Pubblicazione: (2025)
di: Perkins, Daniel, et al.
Pubblicazione: (2025)
Scaling Off-Policy Reinforcement Learning with Batch and Weight Normalization
di: Palenicek, Daniel, et al.
Pubblicazione: (2025)
di: Palenicek, Daniel, et al.
Pubblicazione: (2025)
Low-Rank Adaptation for Critic Learning in Off-Policy Reinforcement Learning
di: Zhuang, Yuan, et al.
Pubblicazione: (2026)
di: Zhuang, Yuan, et al.
Pubblicazione: (2026)
Better Generative Replay for Continual Federated Learning
di: Qi, Daiqing, et al.
Pubblicazione: (2023)
di: Qi, Daiqing, et al.
Pubblicazione: (2023)
Scaling Up Data Parallelism in Decentralized Deep Learning
di: Xie, Bing, et al.
Pubblicazione: (2025)
di: Xie, Bing, et al.
Pubblicazione: (2025)
Creating Multi-Level Skill Hierarchies in Reinforcement Learning
di: Evans, Joshua B., et al.
Pubblicazione: (2023)
di: Evans, Joshua B., et al.
Pubblicazione: (2023)
On the Convergence of Experience Replay in Policy Optimization: Characterizing Bias, Variance, and Finite-Time Convergence
di: Zheng, Hua, et al.
Pubblicazione: (2021)
di: Zheng, Hua, et al.
Pubblicazione: (2021)
The Definitive Guide to Policy Gradients in Deep Reinforcement Learning: Theory, Algorithms and Implementations
di: Lehmann, Matthias
Pubblicazione: (2024)
di: Lehmann, Matthias
Pubblicazione: (2024)
Finite-Time Analysis of Temporal Difference Learning with Experience Replay
di: Lim, Han-Dong, et al.
Pubblicazione: (2023)
di: Lim, Han-Dong, et al.
Pubblicazione: (2023)
Adaptive Replay Buffer for Offline-to-Online Reinforcement Learning
di: Song, Chihyeon, et al.
Pubblicazione: (2025)
di: Song, Chihyeon, et al.
Pubblicazione: (2025)
D-SPEAR: Dual-Stream Prioritized Experience Adaptive Replay for Stable Reinforcement Learning in Robotic Manipulation
di: Zhang, Yu, et al.
Pubblicazione: (2026)
di: Zhang, Yu, et al.
Pubblicazione: (2026)
Behaviour Policy Optimization: Provably Lower Variance Return Estimates for Off-Policy Reinforcement Learning
di: Goodall, Alexander W., et al.
Pubblicazione: (2025)
di: Goodall, Alexander W., et al.
Pubblicazione: (2025)
Enabling Off-Policy Imitation Learning with Deep Actor Critic Stabilization
di: Sen, Sayambhu, et al.
Pubblicazione: (2025)
di: Sen, Sayambhu, et al.
Pubblicazione: (2025)
Enabling Option Learning in Sparse Rewards with Hindsight Experience Replay
di: Romio, Gabriel, et al.
Pubblicazione: (2026)
di: Romio, Gabriel, et al.
Pubblicazione: (2026)
ROER: Regularized Optimal Experience Replay
di: Li, Changling, et al.
Pubblicazione: (2024)
di: Li, Changling, et al.
Pubblicazione: (2024)
Search-Based Adversarial Estimates for Improving Sample Efficiency in Off-Policy Reinforcement Learning
di: Malato, Federico, et al.
Pubblicazione: (2025)
di: Malato, Federico, et al.
Pubblicazione: (2025)
SCOPE-RL: A Python Library for Offline Reinforcement Learning and Off-Policy Evaluation
di: Kiyohara, Haruka, et al.
Pubblicazione: (2023)
di: Kiyohara, Haruka, et al.
Pubblicazione: (2023)
Mastering the Game of Go with Self-play Experience Replay
di: Liu, Jingbin, et al.
Pubblicazione: (2026)
di: Liu, Jingbin, et al.
Pubblicazione: (2026)
Provable Effects of Data Replay in Continual Learning: A Feature Learning Perspective
di: Ding, Meng, et al.
Pubblicazione: (2026)
di: Ding, Meng, et al.
Pubblicazione: (2026)
R^3: Replay, Reflection, and Ranking Rewards for LLM Reinforcement Learning
di: Jiang, Zhizheng, et al.
Pubblicazione: (2026)
di: Jiang, Zhizheng, et al.
Pubblicazione: (2026)
CORE: Mitigating Catastrophic Forgetting in Continual Learning through Cognitive Replay
di: Zhang, Jianshu, et al.
Pubblicazione: (2024)
di: Zhang, Jianshu, et al.
Pubblicazione: (2024)
Curricula for Learning Robust Policies with Factored State Representations in Changing Environments
di: Panayiotou, Panayiotis, et al.
Pubblicazione: (2024)
di: Panayiotou, Panayiotis, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Interpretable Responsibility Sharing as a Heuristic for Task and Motion Planning
di: Yenicesu, Arda Sarp, et al.
Pubblicazione: (2024) -
Enhancing Deep Deterministic Policy Gradients on Continuous Control Tasks with Decoupled Prioritized Experience Replay
di: Lorasdagi, Mehmet Efe, et al.
Pubblicazione: (2025) -
Locally Adaptive One-Class Classifier Fusion with Dynamic $\ell$p-Norm Constraints for Robust Anomaly Detection
di: Nourmohammadi, Sepehr, et al.
Pubblicazione: (2024) -
Efficient Diversity-based Experience Replay for Deep Reinforcement Learning
di: Zhao, Kaiyan, et al.
Pubblicazione: (2024) -
When Does Non-Uniform Replay Matter in Reinforcement Learning?
di: Korniak, Michal, et al.
Pubblicazione: (2026)