Behaviour Distillation
Fuente:
arXiv
Salvato in:
| Autori principali: | Lupu, Andrei, Lu, Chris, Liesen, Jarek, Lange, Robert Tjarko, Foerster, Jakob |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
NAVIX: Scaling MiniGrid Environments with JAX
di: Pignatelli, Eduardo, et al.
Pubblicazione: (2024)
di: Pignatelli, Eduardo, et al.
Pubblicazione: (2024)
Discovering Minimal Reinforcement Learning Environments
di: Liesen, Jarek, et al.
Pubblicazione: (2024)
di: Liesen, Jarek, et al.
Pubblicazione: (2024)
The AI Scientist: Towards Fully Automated Open-Ended Scientific Discovery
di: Lu, Chris, et al.
Pubblicazione: (2024)
di: Lu, Chris, et al.
Pubblicazione: (2024)
A Clean Slate for Offline Reinforcement Learning
di: Jackson, Matthew Thomas, et al.
Pubblicazione: (2025)
di: Jackson, Matthew Thomas, et al.
Pubblicazione: (2025)
Discovering Temporally-Aware Reinforcement Learning Algorithms
di: Jackson, Matthew Thomas, et al.
Pubblicazione: (2024)
di: Jackson, Matthew Thomas, et al.
Pubblicazione: (2024)
The AI Scientist-v2: Workshop-Level Automated Scientific Discovery via Agentic Tree Search
di: Yamada, Yutaro, et al.
Pubblicazione: (2025)
di: Yamada, Yutaro, et al.
Pubblicazione: (2025)
Imagined Autocurricula
di: Güzel, Ahmet H., et al.
Pubblicazione: (2025)
di: Güzel, Ahmet H., et al.
Pubblicazione: (2025)
DéjàQ: Open-Ended Evolution of Diverse, Learnable and Verifiable Problems
di: Röpke, Willem, et al.
Pubblicazione: (2026)
di: Röpke, Willem, et al.
Pubblicazione: (2026)
Kinetix: Investigating the Training of General Agents through Open-Ended Physics-Based Control Tasks
di: Matthews, Michael, et al.
Pubblicazione: (2024)
di: Matthews, Michael, et al.
Pubblicazione: (2024)
Text-to-LoRA: Instant Transformer Adaption
di: Charakorn, Rujikorn, et al.
Pubblicazione: (2025)
di: Charakorn, Rujikorn, et al.
Pubblicazione: (2025)
Hierarchical Behaviour Spaces
di: Matthews, Michael Tryfan, et al.
Pubblicazione: (2026)
di: Matthews, Michael Tryfan, et al.
Pubblicazione: (2026)
Large Language Models As Evolution Strategies
di: Lange, Robert Tjarko, et al.
Pubblicazione: (2024)
di: Lange, Robert Tjarko, et al.
Pubblicazione: (2024)
Recurrent Reinforcement Learning with Memoroids
di: Morad, Steven, et al.
Pubblicazione: (2024)
di: Morad, Steven, et al.
Pubblicazione: (2024)
JaxMARL: Multi-Agent RL Environments and Algorithms in JAX
di: Rutherford, Alexander, et al.
Pubblicazione: (2023)
di: Rutherford, Alexander, et al.
Pubblicazione: (2023)
Can Learned Optimization Make Reinforcement Learning Less Difficult?
di: Goldie, Alexander David, et al.
Pubblicazione: (2024)
di: Goldie, Alexander David, et al.
Pubblicazione: (2024)
The Decrypto Benchmark for Multi-Agent Reasoning and Theory of Mind
di: Lupu, Andrei, et al.
Pubblicazione: (2025)
di: Lupu, Andrei, et al.
Pubblicazione: (2025)
JaxUED: A simple and useable UED library in Jax
di: Coward, Samuel, et al.
Pubblicazione: (2024)
di: Coward, Samuel, et al.
Pubblicazione: (2024)
The Edge-of-Reach Problem in Offline Model-Based Reinforcement Learning
di: Sims, Anya, et al.
Pubblicazione: (2024)
di: Sims, Anya, et al.
Pubblicazione: (2024)
Knowledge Distillation Neural Network for Predicting Car-following Behaviour of Human-driven and Autonomous Vehicles
di: Adewale, Ayobami, et al.
Pubblicazione: (2024)
di: Adewale, Ayobami, et al.
Pubblicazione: (2024)
Towards Robust Agentic CUDA Kernel Benchmarking, Verification, and Optimization
di: Lange, Robert Tjarko, et al.
Pubblicazione: (2025)
di: Lange, Robert Tjarko, et al.
Pubblicazione: (2025)
Position: Leverage Foundational Models for Black-Box Optimization
di: Song, Xingyou, et al.
Pubblicazione: (2024)
di: Song, Xingyou, et al.
Pubblicazione: (2024)
Mirror Learning: A Unifying Framework of Policy Optimisation
di: Kuba, Jakub Grudzien, et al.
Pubblicazione: (2022)
di: Kuba, Jakub Grudzien, et al.
Pubblicazione: (2022)
Learning Multi-Agent Communication with Contrastive Learning
di: Lo, Yat Long, et al.
Pubblicazione: (2023)
di: Lo, Yat Long, et al.
Pubblicazione: (2023)
Evolution Strategies at the Hyperscale
di: Sarkar, Bidipta, et al.
Pubblicazione: (2025)
di: Sarkar, Bidipta, et al.
Pubblicazione: (2025)
Symmetry-Breaking Augmentations for Ad Hoc Teamwork
di: Hammond, Ravi, et al.
Pubblicazione: (2024)
di: Hammond, Ravi, et al.
Pubblicazione: (2024)
Abstraction for Offline Goal-Conditioned Reinforcement Learning
di: Wibault, Clarisse, et al.
Pubblicazione: (2026)
di: Wibault, Clarisse, et al.
Pubblicazione: (2026)
Rainbow Teaming: Open-Ended Generation of Diverse Adversarial Prompts
di: Samvelyan, Mikayel, et al.
Pubblicazione: (2024)
di: Samvelyan, Mikayel, et al.
Pubblicazione: (2024)
Discovering Preference Optimization Algorithms with and for Large Language Models
di: Lu, Chris, et al.
Pubblicazione: (2024)
di: Lu, Chris, et al.
Pubblicazione: (2024)
DITTO: Offline Imitation Learning with World Models
di: DeMoss, Branton, et al.
Pubblicazione: (2023)
di: DeMoss, Branton, et al.
Pubblicazione: (2023)
A Model-Based Solution to the Offline Multi-Agent Reinforcement Learning Coordination Problem
di: Barde, Paul, et al.
Pubblicazione: (2023)
di: Barde, Paul, et al.
Pubblicazione: (2023)
Beyond the Boundaries of Proximal Policy Optimization
di: Tan, Charlie B., et al.
Pubblicazione: (2024)
di: Tan, Charlie B., et al.
Pubblicazione: (2024)
Rethinking Out-of-Distribution Detection for Reinforcement Learning: Advancing Methods for Evaluation and Detection
di: Nasvytis, Linas, et al.
Pubblicazione: (2024)
di: Nasvytis, Linas, et al.
Pubblicazione: (2024)
Meta-Learning Objectives for Preference Optimization
di: Alfano, Carlo, et al.
Pubblicazione: (2024)
di: Alfano, Carlo, et al.
Pubblicazione: (2024)
Mixture of Experts in a Mixture of RL settings
di: Willi, Timon, et al.
Pubblicazione: (2024)
di: Willi, Timon, et al.
Pubblicazione: (2024)
How Should We Meta-Learn Reinforcement Learning Algorithms?
di: Goldie, Alexander David, et al.
Pubblicazione: (2025)
di: Goldie, Alexander David, et al.
Pubblicazione: (2025)
Analysing the Sample Complexity of Opponent Shaping
di: Fung, Kitty, et al.
Pubblicazione: (2024)
di: Fung, Kitty, et al.
Pubblicazione: (2024)
Policy-Guided Diffusion
di: Jackson, Matthew Thomas, et al.
Pubblicazione: (2024)
di: Jackson, Matthew Thomas, et al.
Pubblicazione: (2024)
Comparing BFGS and OGR for Second-Order Optimization
di: Przybysz, Adrian, et al.
Pubblicazione: (2025)
di: Przybysz, Adrian, et al.
Pubblicazione: (2025)
Refining Minimax Regret for Unsupervised Environment Design
di: Beukman, Michael, et al.
Pubblicazione: (2024)
di: Beukman, Michael, et al.
Pubblicazione: (2024)
SOReL and TOReL: Two Methods for Fully Offline Reinforcement Learning
di: Fellows, Mattie, et al.
Pubblicazione: (2025)
di: Fellows, Mattie, et al.
Pubblicazione: (2025)
Documenti analoghi
-
NAVIX: Scaling MiniGrid Environments with JAX
di: Pignatelli, Eduardo, et al.
Pubblicazione: (2024) -
Discovering Minimal Reinforcement Learning Environments
di: Liesen, Jarek, et al.
Pubblicazione: (2024) -
The AI Scientist: Towards Fully Automated Open-Ended Scientific Discovery
di: Lu, Chris, et al.
Pubblicazione: (2024) -
A Clean Slate for Offline Reinforcement Learning
di: Jackson, Matthew Thomas, et al.
Pubblicazione: (2025) -
Discovering Temporally-Aware Reinforcement Learning Algorithms
di: Jackson, Matthew Thomas, et al.
Pubblicazione: (2024)