DISCOVER: Automated Curricula for Sparse-Reward Reinforcement Learning
Fuente:
arXiv
Salvato in:
| Autori principali: | Diaz-Bone, Leander, Bagatella, Marco, Hübotter, Jonas, Krause, Andreas |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Learning on the Job: Test-Time Curricula for Targeted Reinforcement Learning
di: Hübotter, Jonas, et al.
Pubblicazione: (2025)
di: Hübotter, Jonas, et al.
Pubblicazione: (2025)
Active Fine-Tuning of Multi-Task Policies
di: Bagatella, Marco, et al.
Pubblicazione: (2024)
di: Bagatella, Marco, et al.
Pubblicazione: (2024)
Probabilistic Artificial Intelligence
di: Krause, Andreas, et al.
Pubblicazione: (2025)
di: Krause, Andreas, et al.
Pubblicazione: (2025)
Uncertainty-Aware Robotic World Model Makes Offline Model-Based Reinforcement Learning Work on Real Robots
di: Li, Chenhao, et al.
Pubblicazione: (2025)
di: Li, Chenhao, et al.
Pubblicazione: (2025)
Subwords as Skills: Tokenization for Sparse-Reward Reinforcement Learning
di: Yunis, David, et al.
Pubblicazione: (2023)
di: Yunis, David, et al.
Pubblicazione: (2023)
Reinforcement Learning via Self-Distillation
di: Hübotter, Jonas, et al.
Pubblicazione: (2026)
di: Hübotter, Jonas, et al.
Pubblicazione: (2026)
Efficiently Learning at Test-Time: Active Fine-Tuning of LLMs
di: Hübotter, Jonas, et al.
Pubblicazione: (2024)
di: Hübotter, Jonas, et al.
Pubblicazione: (2024)
Test-time Offline Reinforcement Learning on Goal-related Experience
di: Bagatella, Marco, et al.
Pubblicazione: (2025)
di: Bagatella, Marco, et al.
Pubblicazione: (2025)
A Review of Reward Functions for Reinforcement Learning in the context of Autonomous Driving
di: Abouelazm, Ahmed, et al.
Pubblicazione: (2024)
di: Abouelazm, Ahmed, et al.
Pubblicazione: (2024)
Transductive Active Learning: Theory and Applications
di: Hübotter, Jonas, et al.
Pubblicazione: (2024)
di: Hübotter, Jonas, et al.
Pubblicazione: (2024)
Local Mixtures of Experts: Essentially Free Test-Time Training via Model Merging
di: Bertolissi, Ryo, et al.
Pubblicazione: (2025)
di: Bertolissi, Ryo, et al.
Pubblicazione: (2025)
Feature-Based vs. GAN-Based Learning from Demonstrations: When and Why
di: Li, Chenhao, et al.
Pubblicazione: (2025)
di: Li, Chenhao, et al.
Pubblicazione: (2025)
Beyond Scalar Rewards: Distributional Reinforcement Learning with Preordered Objectives for Safe and Reliable Autonomous Driving
di: Abouelazm, Ahmed, et al.
Pubblicazione: (2026)
di: Abouelazm, Ahmed, et al.
Pubblicazione: (2026)
Constraints as Rewards: Reinforcement Learning for Robots without Reward Functions
di: Ishihara, Yu, et al.
Pubblicazione: (2025)
di: Ishihara, Yu, et al.
Pubblicazione: (2025)
Sampling-Based Safe Reinforcement Learning
di: Vignola, Luca, et al.
Pubblicazione: (2026)
di: Vignola, Luca, et al.
Pubblicazione: (2026)
Causal Action Influence Aware Counterfactual Data Augmentation
di: Urpí, Núria Armengol, et al.
Pubblicazione: (2024)
di: Urpí, Núria Armengol, et al.
Pubblicazione: (2024)
Symmetry-Guided Memory Augmentation for Efficient Locomotion Learning
di: Bao, Kaixi, et al.
Pubblicazione: (2025)
di: Bao, Kaixi, et al.
Pubblicazione: (2025)
Robotic World Model: A Neural Network Simulator for Robust Policy Optimization in Robotics
di: Li, Chenhao, et al.
Pubblicazione: (2025)
di: Li, Chenhao, et al.
Pubblicazione: (2025)
Enabling Option Learning in Sparse Rewards with Hindsight Experience Replay
di: Romio, Gabriel, et al.
Pubblicazione: (2026)
di: Romio, Gabriel, et al.
Pubblicazione: (2026)
Reward-Punishment Reinforcement Learning with Maximum Entropy
di: Wang, Jiexin, et al.
Pubblicazione: (2024)
di: Wang, Jiexin, et al.
Pubblicazione: (2024)
Active Few-Shot Fine-Tuning
di: Hübotter, Jonas, et al.
Pubblicazione: (2024)
di: Hübotter, Jonas, et al.
Pubblicazione: (2024)
Residual Reward Models for Preference-based Reinforcement Learning
di: Cao, Chenyang, et al.
Pubblicazione: (2025)
di: Cao, Chenyang, et al.
Pubblicazione: (2025)
Confidence-Controlled Exploration: Efficient Sparse-Reward Policy Learning for Robot Navigation
di: Patel, Bhrij, et al.
Pubblicazione: (2023)
di: Patel, Bhrij, et al.
Pubblicazione: (2023)
Automating the Refinement of Reinforcement Learning Specifications
di: Ambadkar, Tanmay, et al.
Pubblicazione: (2025)
di: Ambadkar, Tanmay, et al.
Pubblicazione: (2025)
RobotKeyframing: Learning Locomotion with High-Level Objectives via Mixture of Dense and Sparse Rewards
di: Zargarbashi, Fatemeh, et al.
Pubblicazione: (2024)
di: Zargarbashi, Fatemeh, et al.
Pubblicazione: (2024)
Continual Driving Policy Optimization with Closed-Loop Individualized Curricula
di: Niu, Haoyi, et al.
Pubblicazione: (2023)
di: Niu, Haoyi, et al.
Pubblicazione: (2023)
DreamSmooth: Improving Model-based Reinforcement Learning via Reward Smoothing
di: Lee, Vint, et al.
Pubblicazione: (2023)
di: Lee, Vint, et al.
Pubblicazione: (2023)
Off-Dynamics Reinforcement Learning via Domain Adaptation and Reward Augmented Imitation
di: Guo, Yihong, et al.
Pubblicazione: (2024)
di: Guo, Yihong, et al.
Pubblicazione: (2024)
ReinforceGen: Hybrid Skill Policies with Automated Data Generation and Reinforcement Learning
di: Zhou, Zihan, et al.
Pubblicazione: (2025)
di: Zhou, Zihan, et al.
Pubblicazione: (2025)
Text2Reward: Reward Shaping with Language Models for Reinforcement Learning
di: Xie, Tianbao, et al.
Pubblicazione: (2023)
di: Xie, Tianbao, et al.
Pubblicazione: (2023)
CaRL: Learning Scalable Planning Policies with Simple Rewards
di: Jaeger, Bernhard, et al.
Pubblicazione: (2025)
di: Jaeger, Bernhard, et al.
Pubblicazione: (2025)
Majority Voting for Code Generation
di: Launer, Tim, et al.
Pubblicazione: (2026)
di: Launer, Tim, et al.
Pubblicazione: (2026)
RLtools: A Fast, Portable Deep Reinforcement Learning Library for Continuous Control
di: Eschmann, Jonas, et al.
Pubblicazione: (2023)
di: Eschmann, Jonas, et al.
Pubblicazione: (2023)
Scenario-Based Hierarchical Reinforcement Learning for Automated Driving Decision Making
di: Abdelhamid, M. Youssef, et al.
Pubblicazione: (2025)
di: Abdelhamid, M. Youssef, et al.
Pubblicazione: (2025)
Tactical Decision Making for Autonomous Trucks by Deep Reinforcement Learning with Total Cost of Operation Based Reward
di: Pathare, Deepthi, et al.
Pubblicazione: (2024)
di: Pathare, Deepthi, et al.
Pubblicazione: (2024)
Specialization after Generalization: Towards Understanding Test-Time Training in Foundation Models
di: Hübotter, Jonas, et al.
Pubblicazione: (2025)
di: Hübotter, Jonas, et al.
Pubblicazione: (2025)
Diffusion-Reward Adversarial Imitation Learning
di: Lai, Chun-Mao, et al.
Pubblicazione: (2024)
di: Lai, Chun-Mao, et al.
Pubblicazione: (2024)
Jump-Start Reinforcement Learning with Vision-Language-Action Regularization
di: Moroncelli, Angelo, et al.
Pubblicazione: (2026)
di: Moroncelli, Angelo, et al.
Pubblicazione: (2026)
Efficient Preference-Based Reinforcement Learning: Randomized Exploration Meets Experimental Design
di: Schlaginhaufen, Andreas, et al.
Pubblicazione: (2025)
di: Schlaginhaufen, Andreas, et al.
Pubblicazione: (2025)
Redistributing Rewards Across Time and Agents for Multi-Agent Reinforcement Learning
di: Kapoor, Aditya, et al.
Pubblicazione: (2025)
di: Kapoor, Aditya, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Learning on the Job: Test-Time Curricula for Targeted Reinforcement Learning
di: Hübotter, Jonas, et al.
Pubblicazione: (2025) -
Active Fine-Tuning of Multi-Task Policies
di: Bagatella, Marco, et al.
Pubblicazione: (2024) -
Probabilistic Artificial Intelligence
di: Krause, Andreas, et al.
Pubblicazione: (2025) -
Uncertainty-Aware Robotic World Model Makes Offline Model-Based Reinforcement Learning Work on Real Robots
di: Li, Chenhao, et al.
Pubblicazione: (2025) -
Subwords as Skills: Tokenization for Sparse-Reward Reinforcement Learning
di: Yunis, David, et al.
Pubblicazione: (2023)