Hybrid Inverse Reinforcement Learning
Fuente:
arXiv
Guardado en:
| Autores principales: | Ren, Juntao, Swamy, Gokul, Wu, Zhiwei Steven, Bagnell, J. Andrew, Choudhury, Sanjiban |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Inverse Reinforcement Learning without Reinforcement Learning
por: Swamy, Gokul, et al.
Publicado: (2023)
por: Swamy, Gokul, et al.
Publicado: (2023)
The Virtues of Pessimism in Inverse Reinforcement Learning
por: Wu, David, et al.
Publicado: (2024)
por: Wu, David, et al.
Publicado: (2024)
All Roads Lead to Likelihood: The Value of Reinforcement Learning in Fine-Tuning
por: Swamy, Gokul, et al.
Publicado: (2025)
por: Swamy, Gokul, et al.
Publicado: (2025)
Efficient Imitation under Misspecification
por: Espinosa-Dice, Nicolas, et al.
Publicado: (2025)
por: Espinosa-Dice, Nicolas, et al.
Publicado: (2025)
The Importance of Online Data: Understanding Preference Fine-tuning via Coverage
por: Song, Yuda, et al.
Publicado: (2024)
por: Song, Yuda, et al.
Publicado: (2024)
Process Reward Models for LLM Agents: Practical Framework and Directions
por: Choudhury, Sanjiban
Publicado: (2025)
por: Choudhury, Sanjiban
Publicado: (2025)
Motion Tracks: A Unified Representation for Human-Robot Transfer in Few-Shot Imitation Learning
por: Ren, Juntao, et al.
Publicado: (2025)
por: Ren, Juntao, et al.
Publicado: (2025)
Non-Adversarial Inverse Reinforcement Learning via Successor Feature Matching
por: Jain, Arnav Kumar, et al.
Publicado: (2024)
por: Jain, Arnav Kumar, et al.
Publicado: (2024)
Accelerating Inverse Reinforcement Learning with Expert Bootstrapping
por: Wu, David, et al.
Publicado: (2024)
por: Wu, David, et al.
Publicado: (2024)
Better than Your Teacher: LLM Agents that learn from Privileged AI Feedback
por: Choudhury, Sanjiban, et al.
Publicado: (2024)
por: Choudhury, Sanjiban, et al.
Publicado: (2024)
A Smooth Sea Never Made a Skilled SAILOR: Robust Imitation via Learning to Search
por: Jain, Arnav Kumar, et al.
Publicado: (2025)
por: Jain, Arnav Kumar, et al.
Publicado: (2025)
Imitation Learning via Focused Satisficing
por: Shah, Rushit N., et al.
Publicado: (2025)
por: Shah, Rushit N., et al.
Publicado: (2025)
Your Learned Constraint is Secretly a Backward Reachable Tube
por: Qadri, Mohamad, et al.
Publicado: (2025)
por: Qadri, Mohamad, et al.
Publicado: (2025)
A Minimaximalist Approach to Reinforcement Learning from Human Feedback
por: Swamy, Gokul, et al.
Publicado: (2024)
por: Swamy, Gokul, et al.
Publicado: (2024)
InteRACT: Transformer Models for Human Intent Prediction Conditioned on Robot Actions
por: Kedia, Kushal, et al.
Publicado: (2023)
por: Kedia, Kushal, et al.
Publicado: (2023)
Hybrid Reinforcement Learning from Offline Observation Alone
por: Song, Yuda, et al.
Publicado: (2024)
por: Song, Yuda, et al.
Publicado: (2024)
One-Shot Imitation under Mismatched Execution
por: Kedia, Kushal, et al.
Publicado: (2024)
por: Kedia, Kushal, et al.
Publicado: (2024)
Kernel Density Bayesian Inverse Reinforcement Learning
por: Mandyam, Aishwarya, et al.
Publicado: (2023)
por: Mandyam, Aishwarya, et al.
Publicado: (2023)
TROFI: Trajectory-Ranked Offline Inverse Reinforcement Learning
por: Sestini, Alessandro, et al.
Publicado: (2025)
por: Sestini, Alessandro, et al.
Publicado: (2025)
Multi-Agent Imitation Learning: Value is Easy, Regret is Hard
por: Tang, Jingwu, et al.
Publicado: (2024)
por: Tang, Jingwu, et al.
Publicado: (2024)
Provable Multi-Party Reinforcement Learning with Diverse Human Feedback
por: Zhong, Huiying, et al.
Publicado: (2024)
por: Zhong, Huiying, et al.
Publicado: (2024)
Stackelberg Coupling of Online Representation Learning and Reinforcement Learning
por: Martinez, Fernando, et al.
Publicado: (2025)
por: Martinez, Fernando, et al.
Publicado: (2025)
X-Sim: Cross-Embodiment Learning via Real-to-Sim-to-Real
por: Dan, Prithwish, et al.
Publicado: (2025)
por: Dan, Prithwish, et al.
Publicado: (2025)
Fast Rates for Inverse Reinforcement Learning
por: Schlaginhaufen, Andreas, et al.
Publicado: (2026)
por: Schlaginhaufen, Andreas, et al.
Publicado: (2026)
On the Effective Horizon of Inverse Reinforcement Learning
por: Xu, Yiqing, et al.
Publicado: (2023)
por: Xu, Yiqing, et al.
Publicado: (2023)
Environment Design for Inverse Reinforcement Learning
por: Buening, Thomas Kleine, et al.
Publicado: (2022)
por: Buening, Thomas Kleine, et al.
Publicado: (2022)
Recursive Deep Inverse Reinforcement Learning
por: Ghanem, Paul, et al.
Publicado: (2025)
por: Ghanem, Paul, et al.
Publicado: (2025)
Inverse Reinforcement Learning With Constraint Recovery
por: Das, Nirjhar, et al.
Publicado: (2023)
por: Das, Nirjhar, et al.
Publicado: (2023)
Inverse Reinforcement Learning with Switching Rewards and History Dependency for Characterizing Animal Behaviors
por: Ke, Jingyang, et al.
Publicado: (2025)
por: Ke, Jingyang, et al.
Publicado: (2025)
Inverse Delayed Reinforcement Learning
por: Zhan, Simon Sinong, et al.
Publicado: (2024)
por: Zhan, Simon Sinong, et al.
Publicado: (2024)
In-Context Reinforcement Learning via Communicative World Models
por: Martinez-Lopez, Fernando, et al.
Publicado: (2025)
por: Martinez-Lopez, Fernando, et al.
Publicado: (2025)
Safe Reinforcement Learning using Finite-Horizon Gradient-based Estimation
por: Dai, Juntao, et al.
Publicado: (2024)
por: Dai, Juntao, et al.
Publicado: (2024)
Partial Identifiability and Misspecification in Inverse Reinforcement Learning
por: Skalse, Joar, et al.
Publicado: (2024)
por: Skalse, Joar, et al.
Publicado: (2024)
Inverse Reinforcement Learning with Sub-optimal Experts
por: Poiani, Riccardo, et al.
Publicado: (2024)
por: Poiani, Riccardo, et al.
Publicado: (2024)
Inverse Reinforcement Learning by Estimating Expertise of Demonstrators
por: Beliaev, Mark, et al.
Publicado: (2024)
por: Beliaev, Mark, et al.
Publicado: (2024)
Is Optimal Transport Necessary for Inverse Reinforcement Learning?
por: Dong, Zixuan, et al.
Publicado: (2025)
por: Dong, Zixuan, et al.
Publicado: (2025)
Towards Interpretable Deep Reinforcement Learning Models via Inverse Reinforcement Learning
por: Xie, Sean, et al.
Publicado: (2022)
por: Xie, Sean, et al.
Publicado: (2022)
Pushing the Limits of Inverse Lithography with Generative Reinforcement Learning
por: Yang, Haoyu, et al.
Publicado: (2026)
por: Yang, Haoyu, et al.
Publicado: (2026)
Is Inverse Reinforcement Learning Harder than Standard Reinforcement Learning? A Theoretical Perspective
por: Zhao, Lei, et al.
Publicado: (2023)
por: Zhao, Lei, et al.
Publicado: (2023)
Inverse Reinforcement Learning from Non-Stationary Learning Agents
por: Sivakumar, Kavinayan P., et al.
Publicado: (2024)
por: Sivakumar, Kavinayan P., et al.
Publicado: (2024)
Ejemplares similares
-
Inverse Reinforcement Learning without Reinforcement Learning
por: Swamy, Gokul, et al.
Publicado: (2023) -
The Virtues of Pessimism in Inverse Reinforcement Learning
por: Wu, David, et al.
Publicado: (2024) -
All Roads Lead to Likelihood: The Value of Reinforcement Learning in Fine-Tuning
por: Swamy, Gokul, et al.
Publicado: (2025) -
Efficient Imitation under Misspecification
por: Espinosa-Dice, Nicolas, et al.
Publicado: (2025) -
The Importance of Online Data: Understanding Preference Fine-tuning via Coverage
por: Song, Yuda, et al.
Publicado: (2024)