Can Learned Optimization Make Reinforcement Learning Less Difficult?
Fuente:
arXiv
Salvato in:
| Autori principali: | Goldie, Alexander David, Lu, Chris, Jackson, Matthew Thomas, Whiteson, Shimon, Foerster, Jakob Nicolaus |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
How Should We Meta-Learn Reinforcement Learning Algorithms?
di: Goldie, Alexander David, et al.
Pubblicazione: (2025)
di: Goldie, Alexander David, et al.
Pubblicazione: (2025)
Discovering Temporally-Aware Reinforcement Learning Algorithms
di: Jackson, Matthew Thomas, et al.
Pubblicazione: (2024)
di: Jackson, Matthew Thomas, et al.
Pubblicazione: (2024)
A Clean Slate for Offline Reinforcement Learning
di: Jackson, Matthew Thomas, et al.
Pubblicazione: (2025)
di: Jackson, Matthew Thomas, et al.
Pubblicazione: (2025)
Policy-Guided Diffusion
di: Jackson, Matthew Thomas, et al.
Pubblicazione: (2024)
di: Jackson, Matthew Thomas, et al.
Pubblicazione: (2024)
SplAgger: Split Aggregation for Meta-Reinforcement Learning
di: Beck, Jacob, et al.
Pubblicazione: (2024)
di: Beck, Jacob, et al.
Pubblicazione: (2024)
HyperVLA: Efficient Inference in Vision-Language-Action Models via Hypernetworks
di: Xiong, Zheng, et al.
Pubblicazione: (2025)
di: Xiong, Zheng, et al.
Pubblicazione: (2025)
Abstraction for Offline Goal-Conditioned Reinforcement Learning
di: Wibault, Clarisse, et al.
Pubblicazione: (2026)
di: Wibault, Clarisse, et al.
Pubblicazione: (2026)
Recurrent Reinforcement Learning with Memoroids
di: Morad, Steven, et al.
Pubblicazione: (2024)
di: Morad, Steven, et al.
Pubblicazione: (2024)
Learning to Drive in New Cities Without Human Demonstrations
di: Wang, Zilin, et al.
Pubblicazione: (2026)
di: Wang, Zilin, et al.
Pubblicazione: (2026)
Adam on Local Time: Addressing Nonstationarity in RL with Relative Adam Timesteps
di: Ellis, Benjamin, et al.
Pubblicazione: (2024)
di: Ellis, Benjamin, et al.
Pubblicazione: (2024)
The Edge-of-Reach Problem in Offline Model-Based Reinforcement Learning
di: Sims, Anya, et al.
Pubblicazione: (2024)
di: Sims, Anya, et al.
Pubblicazione: (2024)
Meta-Learning Objectives for Preference Optimization
di: Alfano, Carlo, et al.
Pubblicazione: (2024)
di: Alfano, Carlo, et al.
Pubblicazione: (2024)
Procedural Generation of Algorithm Discovery Tasks in Machine Learning
di: Goldie, Alexander D., et al.
Pubblicazione: (2026)
di: Goldie, Alexander D., et al.
Pubblicazione: (2026)
Goal-Conditioned Agents that Learn Everything All at Once
di: Matthews, Michael, et al.
Pubblicazione: (2026)
di: Matthews, Michael, et al.
Pubblicazione: (2026)
Kinetix: Investigating the Training of General Agents through Open-Ended Physics-Based Control Tasks
di: Matthews, Michael, et al.
Pubblicazione: (2024)
di: Matthews, Michael, et al.
Pubblicazione: (2024)
A Model-Based Solution to the Offline Multi-Agent Reinforcement Learning Coordination Problem
di: Barde, Paul, et al.
Pubblicazione: (2023)
di: Barde, Paul, et al.
Pubblicazione: (2023)
Rethinking Out-of-Distribution Detection for Reinforcement Learning: Advancing Methods for Evaluation and Detection
di: Nasvytis, Linas, et al.
Pubblicazione: (2024)
di: Nasvytis, Linas, et al.
Pubblicazione: (2024)
Learning Multi-Agent Communication with Contrastive Learning
di: Lo, Yat Long, et al.
Pubblicazione: (2023)
di: Lo, Yat Long, et al.
Pubblicazione: (2023)
Evolution Strategies at the Hyperscale
di: Sarkar, Bidipta, et al.
Pubblicazione: (2025)
di: Sarkar, Bidipta, et al.
Pubblicazione: (2025)
SOReL and TOReL: Two Methods for Fully Offline Reinforcement Learning
di: Fellows, Mattie, et al.
Pubblicazione: (2025)
di: Fellows, Mattie, et al.
Pubblicazione: (2025)
Imagined Autocurricula
di: Güzel, Ahmet H., et al.
Pubblicazione: (2025)
di: Güzel, Ahmet H., et al.
Pubblicazione: (2025)
Train Less, Learn More: Adaptive Efficient Rollout Optimization for Group-Based Reinforcement Learning
di: Zhang, Zhi, et al.
Pubblicazione: (2026)
di: Zhang, Zhi, et al.
Pubblicazione: (2026)
Behaviour Distillation
di: Lupu, Andrei, et al.
Pubblicazione: (2024)
di: Lupu, Andrei, et al.
Pubblicazione: (2024)
Mirror Learning: A Unifying Framework of Policy Optimisation
di: Kuba, Jakub Grudzien, et al.
Pubblicazione: (2022)
di: Kuba, Jakub Grudzien, et al.
Pubblicazione: (2022)
Learning to Reason at the Frontier of Learnability
di: Foster, Thomas, et al.
Pubblicazione: (2025)
di: Foster, Thomas, et al.
Pubblicazione: (2025)
Counterfactual Multi-Agent Policy Gradients
di: Foerster, Jakob, et al.
Pubblicazione: (2017)
di: Foerster, Jakob, et al.
Pubblicazione: (2017)
DITTO: Offline Imitation Learning with World Models
di: DeMoss, Branton, et al.
Pubblicazione: (2023)
di: DeMoss, Branton, et al.
Pubblicazione: (2023)
The AI Scientist: Towards Fully Automated Open-Ended Scientific Discovery
di: Lu, Chris, et al.
Pubblicazione: (2024)
di: Lu, Chris, et al.
Pubblicazione: (2024)
Honesty to Subterfuge: In-Context Reinforcement Learning Can Make Honest Models Reward Hack
di: McKee-Reid, Leo, et al.
Pubblicazione: (2024)
di: McKee-Reid, Leo, et al.
Pubblicazione: (2024)
JaxUED: A simple and useable UED library in Jax
di: Coward, Samuel, et al.
Pubblicazione: (2024)
di: Coward, Samuel, et al.
Pubblicazione: (2024)
Beyond the Boundaries of Proximal Policy Optimization
di: Tan, Charlie B., et al.
Pubblicazione: (2024)
di: Tan, Charlie B., et al.
Pubblicazione: (2024)
Market Making Strategies with Reinforcement Learning
di: Vicente, Óscar Fernández
Pubblicazione: (2025)
di: Vicente, Óscar Fernández
Pubblicazione: (2025)
The Yokai Learning Environment: Tracking Beliefs Over Space and Time
di: Ruhdorfer, Constantin, et al.
Pubblicazione: (2025)
di: Ruhdorfer, Constantin, et al.
Pubblicazione: (2025)
Safe Reinforcement Learning for Real-World Engine Control
di: Bedei, Julian, et al.
Pubblicazione: (2025)
di: Bedei, Julian, et al.
Pubblicazione: (2025)
Learning to Optimize for Reinforcement Learning
di: Lan, Qingfeng, et al.
Pubblicazione: (2023)
di: Lan, Qingfeng, et al.
Pubblicazione: (2023)
Difficult Examples Hurt Unsupervised Contrastive Learning: A Theoretical Perspective
di: Zhang, Yi-Ge, et al.
Pubblicazione: (2025)
di: Zhang, Yi-Ge, et al.
Pubblicazione: (2025)
Less is more -- the Dispatcher/ Executor principle for multi-task Reinforcement Learning
di: Riedmiller, Martin, et al.
Pubblicazione: (2023)
di: Riedmiller, Martin, et al.
Pubblicazione: (2023)
Learning What Reinforcement Learning Can't: Interleaved Online Fine-Tuning for Hardest Questions
di: Ma, Lu, et al.
Pubblicazione: (2025)
di: Ma, Lu, et al.
Pubblicazione: (2025)
JaxMARL: Multi-Agent RL Environments and Algorithms in JAX
di: Rutherford, Alexander, et al.
Pubblicazione: (2023)
di: Rutherford, Alexander, et al.
Pubblicazione: (2023)
The AI Scientist-v2: Workshop-Level Automated Scientific Discovery via Agentic Tree Search
di: Yamada, Yutaro, et al.
Pubblicazione: (2025)
di: Yamada, Yutaro, et al.
Pubblicazione: (2025)
Documenti analoghi
-
How Should We Meta-Learn Reinforcement Learning Algorithms?
di: Goldie, Alexander David, et al.
Pubblicazione: (2025) -
Discovering Temporally-Aware Reinforcement Learning Algorithms
di: Jackson, Matthew Thomas, et al.
Pubblicazione: (2024) -
A Clean Slate for Offline Reinforcement Learning
di: Jackson, Matthew Thomas, et al.
Pubblicazione: (2025) -
Policy-Guided Diffusion
di: Jackson, Matthew Thomas, et al.
Pubblicazione: (2024) -
SplAgger: Split Aggregation for Meta-Reinforcement Learning
di: Beck, Jacob, et al.
Pubblicazione: (2024)