A Research Agenda for Usability and Generalisation in Reinforcement Learning
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Soemers, Dennis J. N. J., Samothrakis, Spyridon, Driessens, Kurt, Winands, Mark H. M. |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
For How Long Should We Be Punching? Learning Action Duration in Fighting Games
par: Nguyen, Hoang Hai, et autres
Publié: (2026)
par: Nguyen, Hoang Hai, et autres
Publié: (2026)
Anytime Sequential Halving in Monte-Carlo Tree Search
par: Sagers, Dominic, et autres
Publié: (2024)
par: Sagers, Dominic, et autres
Publié: (2024)
Games of Knightian Uncertainty as AGI testbeds
par: Samothrakis, Spyridon, et autres
Publié: (2024)
par: Samothrakis, Spyridon, et autres
Publié: (2024)
Out-of-distribution generalisation is hard: evidence from ARC-like tasks
par: Dimitriadis, George, et autres
Publié: (2025)
par: Dimitriadis, George, et autres
Publié: (2025)
Towards a Characterisation of Monte-Carlo Tree Search Performance in Different Games
par: Soemers, Dennis J. N. J., et autres
Publié: (2024)
par: Soemers, Dennis J. N. J., et autres
Publié: (2024)
StratFormer: Adaptive Opponent Modeling and Exploitation in Imperfect-Information Games
par: Caen, Andy, et autres
Publié: (2026)
par: Caen, Andy, et autres
Publié: (2026)
Asymmetric regularization mechanism for GAN training with Variational Inequalities
par: Giagtzoglou, Spyridon C., et autres
Publié: (2026)
par: Giagtzoglou, Spyridon C., et autres
Publié: (2026)
Exploring RL-based LLM Training for Formal Language Tasks with Programmed Rewards
par: Padula, Alexander G., et autres
Publié: (2024)
par: Padula, Alexander G., et autres
Publié: (2024)
Generalized Proof-Number Monte-Carlo Tree Search
par: Kowalski, Jakub, et autres
Publié: (2025)
par: Kowalski, Jakub, et autres
Publié: (2025)
Enhancements for Real-Time Monte-Carlo Tree Search in General Video Game Playing
par: Soemers, Dennis J. N. J., et autres
Publié: (2024)
par: Soemers, Dennis J. N. J., et autres
Publié: (2024)
Proof Number Based Monte-Carlo Tree Search
par: Kowalski, Jakub, et autres
Publié: (2023)
par: Kowalski, Jakub, et autres
Publié: (2023)
Explore-Go: Leveraging Exploration for Generalisation in Deep Reinforcement Learning
par: Weltevrede, Max, et autres
Publié: (2024)
par: Weltevrede, Max, et autres
Publié: (2024)
How Ensembles of Distilled Policies Improve Generalisation in Reinforcement Learning
par: Weltevrede, Max, et autres
Publié: (2025)
par: Weltevrede, Max, et autres
Publié: (2025)
Frequency and Generalisation of Periodic Activation Functions in Reinforcement Learning
par: Mavor-Parker, Augustine N., et autres
Publié: (2024)
par: Mavor-Parker, Augustine N., et autres
Publié: (2024)
Robustness of Algorithms for Causal Structure Learning to Hyperparameter Choice
par: Machlanski, Damian, et autres
Publié: (2023)
par: Machlanski, Damian, et autres
Publié: (2023)
Generalised Probabilistic Modelling and Improved Uncertainty Estimation in Comparative LLM-as-a-judge
par: Fathullah, Yassir, et autres
Publié: (2025)
par: Fathullah, Yassir, et autres
Publié: (2025)
Skill-aware Mutual Information Optimisation for Generalisation in Reinforcement Learning
par: Yu, Xuehui, et autres
Publié: (2024)
par: Yu, Xuehui, et autres
Publié: (2024)
Understanding Goal Generalisation in Sequential Reinforcement Learning
par: Brown, Jason Ross, et autres
Publié: (2026)
par: Brown, Jason Ross, et autres
Publié: (2026)
Best Agent Identification for General Game Playing
par: Stephenson, Matthew, et autres
Publié: (2025)
par: Stephenson, Matthew, et autres
Publié: (2025)
Quantifying Generalisation in Imitation Learning
par: Gavenski, Nathan, et autres
Publié: (2025)
par: Gavenski, Nathan, et autres
Publié: (2025)
The Challenges of Hyperparameter Tuning for Accurate Causal Effect Estimation
par: Machlanski, Damian, et autres
Publié: (2023)
par: Machlanski, Damian, et autres
Publié: (2023)
Variational Quantum Algorithms for Particle Track Reconstruction
par: Lipardi, Vincenzo, et autres
Publié: (2025)
par: Lipardi, Vincenzo, et autres
Publié: (2025)
SAFE-RL: Saliency-Aware Counterfactual Explainer for Deep Reinforcement Learning Policies
par: Samadi, Amir, et autres
Publié: (2024)
par: Samadi, Amir, et autres
Publié: (2024)
Exploration Implies Data Augmentation: Reachability and Generalisation in Contextual MDPs
par: Weltevrede, Max, et autres
Publié: (2024)
par: Weltevrede, Max, et autres
Publié: (2024)
Inverse Reinforcement Learning by Estimating Expertise of Demonstrators
par: Beliaev, Mark, et autres
Publié: (2024)
par: Beliaev, Mark, et autres
Publié: (2024)
Three Dogmas of Reinforcement Learning
par: Abel, David, et autres
Publié: (2024)
par: Abel, David, et autres
Publié: (2024)
Dropout MPC: An Ensemble Neural MPC Approach for Systems with Learned Dynamics
par: Syntakas, Spyridon, et autres
Publié: (2024)
par: Syntakas, Spyridon, et autres
Publié: (2024)
Reinforcement Learning by Guided Safe Exploration
par: Yang, Qisong, et autres
Publié: (2023)
par: Yang, Qisong, et autres
Publié: (2023)
Usability and Performance Analysis of Embedded Development Environment for On-device Learning
par: Scaffi, Enzo, et autres
Publié: (2024)
par: Scaffi, Enzo, et autres
Publié: (2024)
The Formalism-Implementation Gap in Reinforcement Learning Research
par: Castro, Pablo Samuel
Publié: (2025)
par: Castro, Pablo Samuel
Publié: (2025)
Co-Activation Graph Analysis of Safety-Verified and Explainable Deep Reinforcement Learning Policies
par: Gross, Dennis, et autres
Publié: (2025)
par: Gross, Dennis, et autres
Publié: (2025)
Automating Curriculum Learning for Reinforcement Learning using a Skill-Based Bayesian Network
par: Hsiao, Vincent, et autres
Publié: (2025)
par: Hsiao, Vincent, et autres
Publié: (2025)
Integrating Causality with Neurochaos Learning: Proposed Approach and Research Agenda
par: Narendra, Nanjangud C., et autres
Publié: (2025)
par: Narendra, Nanjangud C., et autres
Publié: (2025)
Towards Generalisable Imitation Learning Through Conditioned Transition Estimation and Online Behaviour Alignment
par: Gavenski, Nathan, et autres
Publié: (2026)
par: Gavenski, Nathan, et autres
Publié: (2026)
The Interpretability of Codebooks in Model-Based Reinforcement Learning is Limited
par: Eaton, Kenneth, et autres
Publié: (2024)
par: Eaton, Kenneth, et autres
Publié: (2024)
The Power of Resets in Online Reinforcement Learning
par: Mhammedi, Zakaria, et autres
Publié: (2024)
par: Mhammedi, Zakaria, et autres
Publié: (2024)
Hybrid Inverse Reinforcement Learning
par: Ren, Juntao, et autres
Publié: (2024)
par: Ren, Juntao, et autres
Publié: (2024)
Speculative Sampling with Reinforcement Learning
par: Wang, Chenan, et autres
Publié: (2026)
par: Wang, Chenan, et autres
Publié: (2026)
DeepKnowledge: Generalisation-Driven Deep Learning Testing
par: Missaoui, Sondess, et autres
Publié: (2024)
par: Missaoui, Sondess, et autres
Publié: (2024)
Information Structure in Mappings: An Approach to Learning, Representation, and Generalisation
par: Conklin, Henry
Publié: (2025)
par: Conklin, Henry
Publié: (2025)
Documents similaires
-
For How Long Should We Be Punching? Learning Action Duration in Fighting Games
par: Nguyen, Hoang Hai, et autres
Publié: (2026) -
Anytime Sequential Halving in Monte-Carlo Tree Search
par: Sagers, Dominic, et autres
Publié: (2024) -
Games of Knightian Uncertainty as AGI testbeds
par: Samothrakis, Spyridon, et autres
Publié: (2024) -
Out-of-distribution generalisation is hard: evidence from ARC-like tasks
par: Dimitriadis, George, et autres
Publié: (2025) -
Towards a Characterisation of Monte-Carlo Tree Search Performance in Different Games
par: Soemers, Dennis J. N. J., et autres
Publié: (2024)