Explore-Go: Leveraging Exploration for Generalisation in Deep Reinforcement Learning
Fuente:
arXiv
Salvato in:
| Autori principali: | Weltevrede, Max, Kaubek, Felix, Spaan, Matthijs T. J., Böhmer, Wendelin |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Exploration Implies Data Augmentation: Reachability and Generalisation in Contextual MDPs
di: Weltevrede, Max, et al.
Pubblicazione: (2024)
di: Weltevrede, Max, et al.
Pubblicazione: (2024)
How Ensembles of Distilled Policies Improve Generalisation in Reinforcement Learning
di: Weltevrede, Max, et al.
Pubblicazione: (2025)
di: Weltevrede, Max, et al.
Pubblicazione: (2025)
Diverse Projection Ensembles for Distributional Reinforcement Learning
di: Zanger, Moritz A., et al.
Pubblicazione: (2023)
di: Zanger, Moritz A., et al.
Pubblicazione: (2023)
Epistemic Monte Carlo Tree Search
di: Oren, Yaniv, et al.
Pubblicazione: (2022)
di: Oren, Yaniv, et al.
Pubblicazione: (2022)
Universal Value-Function Uncertainties
di: Zanger, Moritz A., et al.
Pubblicazione: (2025)
di: Zanger, Moritz A., et al.
Pubblicazione: (2025)
Sparse Masked Attention Policies for Reliable Generalization
di: Horsch, Caroline, et al.
Pubblicazione: (2026)
di: Horsch, Caroline, et al.
Pubblicazione: (2026)
Contextual Similarity Distillation: Ensemble Uncertainties with a Single Model
di: Zanger, Moritz A., et al.
Pubblicazione: (2025)
di: Zanger, Moritz A., et al.
Pubblicazione: (2025)
On the Equivalence of Random Network Distillation, Deep Ensembles, and Bayesian Inference
di: Zanger, Moritz A., et al.
Pubblicazione: (2026)
di: Zanger, Moritz A., et al.
Pubblicazione: (2026)
Reinforcement Learning by Guided Safe Exploration
di: Yang, Qisong, et al.
Pubblicazione: (2023)
di: Yang, Qisong, et al.
Pubblicazione: (2023)
Twice Sequential Monte Carlo for Tree Search
di: Oren, Yaniv, et al.
Pubblicazione: (2025)
di: Oren, Yaniv, et al.
Pubblicazione: (2025)
Value Improved Actor Critic Algorithms
di: Oren, Yaniv, et al.
Pubblicazione: (2024)
di: Oren, Yaniv, et al.
Pubblicazione: (2024)
Generalisation to unseen topologies: Towards control of biological neural network activity
di: Engwegen, Laurens, et al.
Pubblicazione: (2024)
di: Engwegen, Laurens, et al.
Pubblicazione: (2024)
Improving Robustness of AlphaZero Algorithms to Test-Time Environment Changes
di: Tamassia, Isidoro, et al.
Pubblicazione: (2025)
di: Tamassia, Isidoro, et al.
Pubblicazione: (2025)
TransZero: Parallel Tree Expansion in MuZero using Transformer Networks
di: Malmsten, Emil, et al.
Pubblicazione: (2025)
di: Malmsten, Emil, et al.
Pubblicazione: (2025)
Priors Matter: Addressing Misspecification in Bayesian Deep Q-Learning
di: van der Vaart, Pascal R., et al.
Pubblicazione: (2025)
di: van der Vaart, Pascal R., et al.
Pubblicazione: (2025)
Positive Experience Reflection for Agents in Interactive Text Environments
di: Lippmann, Philip, et al.
Pubblicazione: (2024)
di: Lippmann, Philip, et al.
Pubblicazione: (2024)
EfficientTDMPC: Improved MPC Objectives for Sample-Efficient Continuous Control
di: Evers, Thomas, et al.
Pubblicazione: (2026)
di: Evers, Thomas, et al.
Pubblicazione: (2026)
Satisficing Exploration for Deep Reinforcement Learning
di: Arumugam, Dilip, et al.
Pubblicazione: (2024)
di: Arumugam, Dilip, et al.
Pubblicazione: (2024)
A Research Agenda for Usability and Generalisation in Reinforcement Learning
di: Soemers, Dennis J. N. J., et al.
Pubblicazione: (2024)
di: Soemers, Dennis J. N. J., et al.
Pubblicazione: (2024)
Is Exploration or Optimization the Problem for Deep Reinforcement Learning?
di: Berseth, Glen
Pubblicazione: (2025)
di: Berseth, Glen
Pubblicazione: (2025)
Off-Policy Safe Reinforcement Learning with Constrained Optimistic Exploration
di: Li, Guopeng, et al.
Pubblicazione: (2026)
di: Li, Guopeng, et al.
Pubblicazione: (2026)
PMCTS: Particle Monte Carlo Tree Search for Principled Parallelized Inference Time Scaling
di: Oren, Yaniv, et al.
Pubblicazione: (2026)
di: Oren, Yaniv, et al.
Pubblicazione: (2026)
AlphaExploitem: Going Beyond the Nash Equilibrium in Poker by Learning to Exploit Suboptimal Play
di: Murgoci, Vlad, et al.
Pubblicazione: (2026)
di: Murgoci, Vlad, et al.
Pubblicazione: (2026)
Adventurer: Exploration with BiGAN for Deep Reinforcement Learning
di: Liu, Yongshuai, et al.
Pubblicazione: (2025)
di: Liu, Yongshuai, et al.
Pubblicazione: (2025)
RecBayes: Recurrent Bayesian Ad Hoc Teamwork in Large Partially Observable Domains
di: Ribeiro, João G., et al.
Pubblicazione: (2025)
di: Ribeiro, João G., et al.
Pubblicazione: (2025)
To the Max: Reinventing Reward in Reinforcement Learning
di: Veviurko, Grigorii, et al.
Pubblicazione: (2024)
di: Veviurko, Grigorii, et al.
Pubblicazione: (2024)
Leveraging Skills from Unlabeled Prior Data for Efficient Online Exploration
di: Wilcoxson, Max, et al.
Pubblicazione: (2024)
di: Wilcoxson, Max, et al.
Pubblicazione: (2024)
Entropy-Aware Model Initialization for Effective Exploration in Deep Reinforcement Learning
di: Jang, Sooyoung, et al.
Pubblicazione: (2021)
di: Jang, Sooyoung, et al.
Pubblicazione: (2021)
Leveraging Knowledge Distillation for Efficient Deep Reinforcement Learning in Resource-Constrained Environments
di: Meng, Guanlin
Pubblicazione: (2023)
di: Meng, Guanlin
Pubblicazione: (2023)
DeepKnowledge: Generalisation-Driven Deep Learning Testing
di: Missaoui, Sondess, et al.
Pubblicazione: (2024)
di: Missaoui, Sondess, et al.
Pubblicazione: (2024)
Pessimistic Iterative Planning with RNNs for Robust POMDPs
di: Galesloot, Maris F. L., et al.
Pubblicazione: (2024)
di: Galesloot, Maris F. L., et al.
Pubblicazione: (2024)
Skill-aware Mutual Information Optimisation for Generalisation in Reinforcement Learning
di: Yu, Xuehui, et al.
Pubblicazione: (2024)
di: Yu, Xuehui, et al.
Pubblicazione: (2024)
The Cell Must Go On: Agar.io for Continual Reinforcement Learning
di: Mohamed, Mohamed A., et al.
Pubblicazione: (2025)
di: Mohamed, Mohamed A., et al.
Pubblicazione: (2025)
In-context Exploration-Exploitation for Reinforcement Learning
di: Dai, Zhenwen, et al.
Pubblicazione: (2024)
di: Dai, Zhenwen, et al.
Pubblicazione: (2024)
Frequency and Generalisation of Periodic Activation Functions in Reinforcement Learning
di: Mavor-Parker, Augustine N., et al.
Pubblicazione: (2024)
di: Mavor-Parker, Augustine N., et al.
Pubblicazione: (2024)
Understanding Goal Generalisation in Sequential Reinforcement Learning
di: Brown, Jason Ross, et al.
Pubblicazione: (2026)
di: Brown, Jason Ross, et al.
Pubblicazione: (2026)
Quantifying Generalisation in Imitation Learning
di: Gavenski, Nathan, et al.
Pubblicazione: (2025)
di: Gavenski, Nathan, et al.
Pubblicazione: (2025)
Variable-Agnostic Causal Exploration for Reinforcement Learning
di: Nguyen, Minh Hoang, et al.
Pubblicazione: (2024)
di: Nguyen, Minh Hoang, et al.
Pubblicazione: (2024)
Exploration in Knowledge Transfer Utilizing Reinforcement Learning
di: Jedlička, Adam, et al.
Pubblicazione: (2024)
di: Jedlička, Adam, et al.
Pubblicazione: (2024)
Neighboring State-based Exploration for Reinforcement Learning
di: Li, Yu-Teng, et al.
Pubblicazione: (2022)
di: Li, Yu-Teng, et al.
Pubblicazione: (2022)
Documenti analoghi
-
Exploration Implies Data Augmentation: Reachability and Generalisation in Contextual MDPs
di: Weltevrede, Max, et al.
Pubblicazione: (2024) -
How Ensembles of Distilled Policies Improve Generalisation in Reinforcement Learning
di: Weltevrede, Max, et al.
Pubblicazione: (2025) -
Diverse Projection Ensembles for Distributional Reinforcement Learning
di: Zanger, Moritz A., et al.
Pubblicazione: (2023) -
Epistemic Monte Carlo Tree Search
di: Oren, Yaniv, et al.
Pubblicazione: (2022) -
Universal Value-Function Uncertainties
di: Zanger, Moritz A., et al.
Pubblicazione: (2025)