Experience Replay with Random Reshuffling
Fuente:
arXiv
Guardado en:
| Autor principal: | Fujita, Yasuhiro |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
VLM-Guided Experience Replay
por: Sharony, Elad, et al.
Publicado: (2026)
por: Sharony, Elad, et al.
Publicado: (2026)
Faithful Differentiable Reasoning with Reshuffled Region-based Embeddings
por: Pavlovic, Aleksandar, et al.
Publicado: (2024)
por: Pavlovic, Aleksandar, et al.
Publicado: (2024)
ROER: Regularized Optimal Experience Replay
por: Li, Changling, et al.
Publicado: (2024)
por: Li, Changling, et al.
Publicado: (2024)
Mastering the Game of Go with Self-play Experience Replay
por: Liu, Jingbin, et al.
Publicado: (2026)
por: Liu, Jingbin, et al.
Publicado: (2026)
Finite-Time Analysis of Temporal Difference Learning with Experience Replay
por: Lim, Han-Dong, et al.
Publicado: (2023)
por: Lim, Han-Dong, et al.
Publicado: (2023)
Efficient Diversity-based Experience Replay for Deep Reinforcement Learning
por: Zhao, Kaiyan, et al.
Publicado: (2024)
por: Zhao, Kaiyan, et al.
Publicado: (2024)
Generalized Back-Stepping Experience Replay in Sparse-Reward Environments
por: Lyu, Guwen, et al.
Publicado: (2024)
por: Lyu, Guwen, et al.
Publicado: (2024)
Enabling Option Learning in Sparse Rewards with Hindsight Experience Replay
por: Romio, Gabriel, et al.
Publicado: (2026)
por: Romio, Gabriel, et al.
Publicado: (2026)
Entropy Controllable Direct Preference Optimization
por: Omura, Motoki, et al.
Publicado: (2024)
por: Omura, Motoki, et al.
Publicado: (2024)
On the Convergence of Experience Replay in Policy Optimization: Characterizing Bias, Variance, and Finite-Time Convergence
por: Zheng, Hua, et al.
Publicado: (2021)
por: Zheng, Hua, et al.
Publicado: (2021)
CIER: A Novel Experience Replay Approach with Causal Inference in Deep Reinforcement Learning
por: Wang, Jingwen, et al.
Publicado: (2024)
por: Wang, Jingwen, et al.
Publicado: (2024)
Enhancing LLM Agents for Code Generation with Possibility and Pass-rate Prioritized Experience Replay
por: Chen, Yuyang, et al.
Publicado: (2024)
por: Chen, Yuyang, et al.
Publicado: (2024)
CUER: Corrected Uniform Experience Replay for Off-Policy Continuous Deep Reinforcement Learning Algorithms
por: Yenicesu, Arda Sarp, et al.
Publicado: (2024)
por: Yenicesu, Arda Sarp, et al.
Publicado: (2024)
DQN Performance with Epsilon Greedy Policies and Prioritized Experience Replay
por: Perkins, Daniel, et al.
Publicado: (2025)
por: Perkins, Daniel, et al.
Publicado: (2025)
Sample Efficient Experience Replay in Non-stationary Environments
por: Duan, Tianyang, et al.
Publicado: (2025)
por: Duan, Tianyang, et al.
Publicado: (2025)
Experience Replay Addresses Loss of Plasticity in Continual Learning
por: Wang, Jiuqi, et al.
Publicado: (2025)
por: Wang, Jiuqi, et al.
Publicado: (2025)
Prioritized Trajectory Replay: A Replay Memory for Data-driven Reinforcement Learning
por: Liu, Jinyi, et al.
Publicado: (2023)
por: Liu, Jinyi, et al.
Publicado: (2023)
Human-Aware Robot Navigation via Reinforcement Learning with Hindsight Experience Replay and Curriculum Learning
por: Li, Keyu, et al.
Publicado: (2021)
por: Li, Keyu, et al.
Publicado: (2021)
IDER: IDempotent Experience Replay for Reliable Continual Learning
por: Liu, Zhanwang, et al.
Publicado: (2026)
por: Liu, Zhanwang, et al.
Publicado: (2026)
Investigating the Interplay of Prioritized Replay and Generalization
por: Panahi, Parham Mohammad, et al.
Publicado: (2024)
por: Panahi, Parham Mohammad, et al.
Publicado: (2024)
D-SPEAR: Dual-Stream Prioritized Experience Adaptive Replay for Stable Reinforcement Learning in Robotic Manipulation
por: Zhang, Yu, et al.
Publicado: (2026)
por: Zhang, Yu, et al.
Publicado: (2026)
Catastrophic Forgetting Mitigation via Discrepancy-Weighted Experience Replay
por: Xu, Xinrun, et al.
Publicado: (2025)
por: Xu, Xinrun, et al.
Publicado: (2025)
ARROW: Augmented Replay for RObust World models
por: Alyahya, Abdulaziz, et al.
Publicado: (2026)
por: Alyahya, Abdulaziz, et al.
Publicado: (2026)
Better Generative Replay for Continual Federated Learning
por: Qi, Daiqing, et al.
Publicado: (2023)
por: Qi, Daiqing, et al.
Publicado: (2023)
Adaptive Replay Buffer for Offline-to-Online Reinforcement Learning
por: Song, Chihyeon, et al.
Publicado: (2025)
por: Song, Chihyeon, et al.
Publicado: (2025)
AlphaViT: A flexible game-playing AI for multiple games and variable board sizes
por: Fujita, Kazuhisa
Publicado: (2024)
por: Fujita, Kazuhisa
Publicado: (2024)
Adaptable Hindsight Experience Replay for Search-Based Learning
por: Vazaios, Alexandros, et al.
Publicado: (2025)
por: Vazaios, Alexandros, et al.
Publicado: (2025)
Contextual Experience Replay for Self-Improvement of Language Agents
por: Liu, Yitao, et al.
Publicado: (2025)
por: Liu, Yitao, et al.
Publicado: (2025)
When Does Non-Uniform Replay Matter in Reinforcement Learning?
por: Korniak, Michal, et al.
Publicado: (2026)
por: Korniak, Michal, et al.
Publicado: (2026)
An Efficient Replay for Class-Incremental Learning with Pre-trained Models
por: Yin, Weimin, et al.
Publicado: (2024)
por: Yin, Weimin, et al.
Publicado: (2024)
Heads collapse, features stay: Why Replay needs big buffers
por: Lanzillotta, Giulia, et al.
Publicado: (2025)
por: Lanzillotta, Giulia, et al.
Publicado: (2025)
Data-Free Generative Replay for Class-Incremental Learning on Imbalanced Data
por: Younis, Sohaib, et al.
Publicado: (2024)
por: Younis, Sohaib, et al.
Publicado: (2024)
R^3: Replay, Reflection, and Ranking Rewards for LLM Reinforcement Learning
por: Jiang, Zhizheng, et al.
Publicado: (2026)
por: Jiang, Zhizheng, et al.
Publicado: (2026)
CORE: Mitigating Catastrophic Forgetting in Continual Learning through Cognitive Replay
por: Zhang, Jianshu, et al.
Publicado: (2024)
por: Zhang, Jianshu, et al.
Publicado: (2024)
Prioritized Replay for RL Post-training
por: Fatemi, Mehdi
Publicado: (2026)
por: Fatemi, Mehdi
Publicado: (2026)
Teaching AI to Remember: Insights from Brain-Inspired Replay in Continual Learning
por: Kim, Jina
Publicado: (2025)
por: Kim, Jina
Publicado: (2025)
EFRame: Deeper Reasoning via Exploration-Filter-Replay Reinforcement Learning Framework
por: Wang, Chen, et al.
Publicado: (2025)
por: Wang, Chen, et al.
Publicado: (2025)
Continual Offline Reinforcement Learning via Diffusion-based Dual Generative Replay
por: Liu, Jinmei, et al.
Publicado: (2024)
por: Liu, Jinmei, et al.
Publicado: (2024)
Robust and Resource-Efficient Data-Free Knowledge Distillation by Generative Pseudo Replay
por: Binici, Kuluhan, et al.
Publicado: (2022)
por: Binici, Kuluhan, et al.
Publicado: (2022)
Hindsight Preference Replay Improves Preference-Conditioned Multi-Objective Reinforcement Learning
por: Shianifar, Jonaid, et al.
Publicado: (2026)
por: Shianifar, Jonaid, et al.
Publicado: (2026)
Ejemplares similares
-
VLM-Guided Experience Replay
por: Sharony, Elad, et al.
Publicado: (2026) -
Faithful Differentiable Reasoning with Reshuffled Region-based Embeddings
por: Pavlovic, Aleksandar, et al.
Publicado: (2024) -
ROER: Regularized Optimal Experience Replay
por: Li, Changling, et al.
Publicado: (2024) -
Mastering the Game of Go with Self-play Experience Replay
por: Liu, Jingbin, et al.
Publicado: (2026) -
Finite-Time Analysis of Temporal Difference Learning with Experience Replay
por: Lim, Han-Dong, et al.
Publicado: (2023)