Accelerating Inverse Reinforcement Learning with Expert Bootstrapping
Fuente:
arXiv
Salvato in:
| Autori principali: | Wu, David, Choudhury, Sanjiban |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Inverse Reinforcement Learning without Reinforcement Learning
di: Swamy, Gokul, et al.
Pubblicazione: (2023)
di: Swamy, Gokul, et al.
Pubblicazione: (2023)
The Virtues of Pessimism in Inverse Reinforcement Learning
di: Wu, David, et al.
Pubblicazione: (2024)
di: Wu, David, et al.
Pubblicazione: (2024)
Hybrid Inverse Reinforcement Learning
di: Ren, Juntao, et al.
Pubblicazione: (2024)
di: Ren, Juntao, et al.
Pubblicazione: (2024)
Aligning LLMs with Domain Invariant Reward Models
di: Wu, David, et al.
Pubblicazione: (2025)
di: Wu, David, et al.
Pubblicazione: (2025)
Process Reward Models for LLM Agents: Practical Framework and Directions
di: Choudhury, Sanjiban
Pubblicazione: (2025)
di: Choudhury, Sanjiban
Pubblicazione: (2025)
Non-Adversarial Inverse Reinforcement Learning via Successor Feature Matching
di: Jain, Arnav Kumar, et al.
Pubblicazione: (2024)
di: Jain, Arnav Kumar, et al.
Pubblicazione: (2024)
Better than Your Teacher: LLM Agents that learn from Privileged AI Feedback
di: Choudhury, Sanjiban, et al.
Pubblicazione: (2024)
di: Choudhury, Sanjiban, et al.
Pubblicazione: (2024)
All Roads Lead to Likelihood: The Value of Reinforcement Learning in Fine-Tuning
di: Swamy, Gokul, et al.
Pubblicazione: (2025)
di: Swamy, Gokul, et al.
Pubblicazione: (2025)
Imitation Learning from a Single Temporally Misaligned Video
di: Huey, William, et al.
Pubblicazione: (2025)
di: Huey, William, et al.
Pubblicazione: (2025)
Distilling Realizable Students from Unrealizable Teachers
di: Kim, Yujin, et al.
Pubblicazione: (2025)
di: Kim, Yujin, et al.
Pubblicazione: (2025)
Inverse Reinforcement Learning with Sub-optimal Experts
di: Poiani, Riccardo, et al.
Pubblicazione: (2024)
di: Poiani, Riccardo, et al.
Pubblicazione: (2024)
Pareto Inverse Reinforcement Learning for Diverse Expert Policy Generation
di: Kim, Woo Kyung, et al.
Pubblicazione: (2024)
di: Kim, Woo Kyung, et al.
Pubblicazione: (2024)
Motion Tracks: A Unified Representation for Human-Robot Transfer in Few-Shot Imitation Learning
di: Ren, Juntao, et al.
Pubblicazione: (2025)
di: Ren, Juntao, et al.
Pubblicazione: (2025)
Context Bootstrapped Reinforcement Learning
di: Agashe, Saaket, et al.
Pubblicazione: (2026)
di: Agashe, Saaket, et al.
Pubblicazione: (2026)
Distributional Inverse Reinforcement Learning
di: Wu, Feiyang, et al.
Pubblicazione: (2025)
di: Wu, Feiyang, et al.
Pubblicazione: (2025)
Efficient Imitation under Misspecification
di: Espinosa-Dice, Nicolas, et al.
Pubblicazione: (2025)
di: Espinosa-Dice, Nicolas, et al.
Pubblicazione: (2025)
InteRACT: Transformer Models for Human Intent Prediction Conditioned on Robot Actions
di: Kedia, Kushal, et al.
Pubblicazione: (2023)
di: Kedia, Kushal, et al.
Pubblicazione: (2023)
Imitation Learning via Focused Satisficing
di: Shah, Rushit N., et al.
Pubblicazione: (2025)
di: Shah, Rushit N., et al.
Pubblicazione: (2025)
Bootstrapping Expectiles in Reinforcement Learning
di: Clavier, Pierre, et al.
Pubblicazione: (2024)
di: Clavier, Pierre, et al.
Pubblicazione: (2024)
Imitation Bootstrapped Reinforcement Learning
di: Hu, Hengyuan, et al.
Pubblicazione: (2023)
di: Hu, Hengyuan, et al.
Pubblicazione: (2023)
One-Shot Imitation under Mismatched Execution
di: Kedia, Kushal, et al.
Pubblicazione: (2024)
di: Kedia, Kushal, et al.
Pubblicazione: (2024)
Accelerating Reinforcement Learning for Wind Farm Control via Expert Demonstrations
di: Nilsen, Marcus Binder, et al.
Pubblicazione: (2026)
di: Nilsen, Marcus Binder, et al.
Pubblicazione: (2026)
A Smooth Sea Never Made a Skilled SAILOR: Robust Imitation via Learning to Search
di: Jain, Arnav Kumar, et al.
Pubblicazione: (2025)
di: Jain, Arnav Kumar, et al.
Pubblicazione: (2025)
On the Effective Horizon of Inverse Reinforcement Learning
di: Xu, Yiqing, et al.
Pubblicazione: (2023)
di: Xu, Yiqing, et al.
Pubblicazione: (2023)
Towards Generalized Inverse Reinforcement Learning
di: Dong, Chaosheng, et al.
Pubblicazione: (2024)
di: Dong, Chaosheng, et al.
Pubblicazione: (2024)
Dynamic Action Interpolation: A Universal Approach for Accelerating Reinforcement Learning with Expert Guidance
di: Cao, Wenjun
Pubblicazione: (2025)
di: Cao, Wenjun
Pubblicazione: (2025)
Inverse Delayed Reinforcement Learning
di: Zhan, Simon Sinong, et al.
Pubblicazione: (2024)
di: Zhan, Simon Sinong, et al.
Pubblicazione: (2024)
LANPO: Bootstrapping Language and Numerical Feedback for Reinforcement Learning in LLMs
di: Li, Ang, et al.
Pubblicazione: (2025)
di: Li, Ang, et al.
Pubblicazione: (2025)
X-Sim: Cross-Embodiment Learning via Real-to-Sim-to-Real
di: Dan, Prithwish, et al.
Pubblicazione: (2025)
di: Dan, Prithwish, et al.
Pubblicazione: (2025)
Can Optimal Transport Improve Federated Inverse Reinforcement Learning?
di: Millard, David, et al.
Pubblicazione: (2026)
di: Millard, David, et al.
Pubblicazione: (2026)
Quantifying the Sensitivity of Inverse Reinforcement Learning to Misspecification
di: Skalse, Joar, et al.
Pubblicazione: (2024)
di: Skalse, Joar, et al.
Pubblicazione: (2024)
Inverse Reinforcement Learning with Multiple Planning Horizons
di: Yao, Jiayu, et al.
Pubblicazione: (2024)
di: Yao, Jiayu, et al.
Pubblicazione: (2024)
Walking the Values in Bayesian Inverse Reinforcement Learning
di: Bajgar, Ondrej, et al.
Pubblicazione: (2024)
di: Bajgar, Ondrej, et al.
Pubblicazione: (2024)
Confidence Aware Inverse Constrained Reinforcement Learning
di: Subramanian, Sriram Ganapathi, et al.
Pubblicazione: (2024)
di: Subramanian, Sriram Ganapathi, et al.
Pubblicazione: (2024)
Vulnerability Analysis of Safe Reinforcement Learning via Inverse Constrained Reinforcement Learning
di: Fan, Jialiang, et al.
Pubblicazione: (2026)
di: Fan, Jialiang, et al.
Pubblicazione: (2026)
Mixture-of-Experts Meets In-Context Reinforcement Learning
di: Wu, Wenhao, et al.
Pubblicazione: (2025)
di: Wu, Wenhao, et al.
Pubblicazione: (2025)
Accelerating Reinforcement Learning Training Using Simulation Surrogate Models
di: Ghasemloo, Mohammadmahdi, et al.
Pubblicazione: (2026)
di: Ghasemloo, Mohammadmahdi, et al.
Pubblicazione: (2026)
PAC Apprenticeship Learning with Bayesian Active Inverse Reinforcement Learning
di: Bajgar, Ondrej, et al.
Pubblicazione: (2025)
di: Bajgar, Ondrej, et al.
Pubblicazione: (2025)
Fast Rates for Inverse Reinforcement Learning
di: Schlaginhaufen, Andreas, et al.
Pubblicazione: (2026)
di: Schlaginhaufen, Andreas, et al.
Pubblicazione: (2026)
Environment Design for Inverse Reinforcement Learning
di: Buening, Thomas Kleine, et al.
Pubblicazione: (2022)
di: Buening, Thomas Kleine, et al.
Pubblicazione: (2022)
Documenti analoghi
-
Inverse Reinforcement Learning without Reinforcement Learning
di: Swamy, Gokul, et al.
Pubblicazione: (2023) -
The Virtues of Pessimism in Inverse Reinforcement Learning
di: Wu, David, et al.
Pubblicazione: (2024) -
Hybrid Inverse Reinforcement Learning
di: Ren, Juntao, et al.
Pubblicazione: (2024) -
Aligning LLMs with Domain Invariant Reward Models
di: Wu, David, et al.
Pubblicazione: (2025) -
Process Reward Models for LLM Agents: Practical Framework and Directions
di: Choudhury, Sanjiban
Pubblicazione: (2025)