Inverse Reinforcement Learning by Estimating Expertise of Demonstrators
Fuente:
arXiv
Salvato in:
| Autori principali: | Beliaev, Mark, Pedarsani, Ramtin |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
REALM: Reliable Expertise-Aware Language Model Fine-Tuning from Noisy Annotations
di: Ghiasvand, Sajjad, et al.
Pubblicazione: (2026)
di: Ghiasvand, Sajjad, et al.
Pubblicazione: (2026)
Conflict-Aware Adversarial Training
di: Xue, Zhiyu, et al.
Pubblicazione: (2024)
di: Xue, Zhiyu, et al.
Pubblicazione: (2024)
Inverse-RLignment: Large Language Model Alignment from Demonstrations through Inverse Reinforcement Learning
di: Sun, Hao, et al.
Pubblicazione: (2024)
di: Sun, Hao, et al.
Pubblicazione: (2024)
Inverse Reinforcement Learning without an Optimal Demonstrator: A Feasible Reward Set Approach
di: Kim, Kihyun, et al.
Pubblicazione: (2026)
di: Kim, Kihyun, et al.
Pubblicazione: (2026)
Enhancing the Safety of Medical Vision-Language Models by Synthetic Demonstrations
di: Xue, Zhiyu, et al.
Pubblicazione: (2025)
di: Xue, Zhiyu, et al.
Pubblicazione: (2025)
When Demonstrations Meet Generative World Models: A Maximum Likelihood Framework for Offline Inverse Reinforcement Learning
di: Zeng, Siliang, et al.
Pubblicazione: (2023)
di: Zeng, Siliang, et al.
Pubblicazione: (2023)
Pricing for Multi-modal Pickup and Delivery Problems with Heterogeneous Users
di: Beliaev, Mark, et al.
Pubblicazione: (2023)
di: Beliaev, Mark, et al.
Pubblicazione: (2023)
Hybrid Inverse Reinforcement Learning
di: Ren, Juntao, et al.
Pubblicazione: (2024)
di: Ren, Juntao, et al.
Pubblicazione: (2024)
Demonstration Guided Multi-Objective Reinforcement Learning
di: Lu, Junlin, et al.
Pubblicazione: (2024)
di: Lu, Junlin, et al.
Pubblicazione: (2024)
Fast Rates for Inverse Reinforcement Learning
di: Schlaginhaufen, Andreas, et al.
Pubblicazione: (2026)
di: Schlaginhaufen, Andreas, et al.
Pubblicazione: (2026)
On the Effective Horizon of Inverse Reinforcement Learning
di: Xu, Yiqing, et al.
Pubblicazione: (2023)
di: Xu, Yiqing, et al.
Pubblicazione: (2023)
Environment Design for Inverse Reinforcement Learning
di: Buening, Thomas Kleine, et al.
Pubblicazione: (2022)
di: Buening, Thomas Kleine, et al.
Pubblicazione: (2022)
Recursive Deep Inverse Reinforcement Learning
di: Ghanem, Paul, et al.
Pubblicazione: (2025)
di: Ghanem, Paul, et al.
Pubblicazione: (2025)
Inverse Reinforcement Learning With Constraint Recovery
di: Das, Nirjhar, et al.
Pubblicazione: (2023)
di: Das, Nirjhar, et al.
Pubblicazione: (2023)
Defining Expertise: Applications to Treatment Effect Estimation
di: Hüyük, Alihan, et al.
Pubblicazione: (2024)
di: Hüyük, Alihan, et al.
Pubblicazione: (2024)
Partial Identifiability and Misspecification in Inverse Reinforcement Learning
di: Skalse, Joar, et al.
Pubblicazione: (2024)
di: Skalse, Joar, et al.
Pubblicazione: (2024)
Inverse Reinforcement Learning with Sub-optimal Experts
di: Poiani, Riccardo, et al.
Pubblicazione: (2024)
di: Poiani, Riccardo, et al.
Pubblicazione: (2024)
Is Optimal Transport Necessary for Inverse Reinforcement Learning?
di: Dong, Zixuan, et al.
Pubblicazione: (2025)
di: Dong, Zixuan, et al.
Pubblicazione: (2025)
Kernel Density Bayesian Inverse Reinforcement Learning
di: Mandyam, Aishwarya, et al.
Pubblicazione: (2023)
di: Mandyam, Aishwarya, et al.
Pubblicazione: (2023)
Towards Interpretable Deep Reinforcement Learning Models via Inverse Reinforcement Learning
di: Xie, Sean, et al.
Pubblicazione: (2022)
di: Xie, Sean, et al.
Pubblicazione: (2022)
Skill-Enhanced Reinforcement Learning Acceleration from Heterogeneous Demonstrations
di: Zhang, Hanping, et al.
Pubblicazione: (2024)
di: Zhang, Hanping, et al.
Pubblicazione: (2024)
UNIQ: Offline Inverse Q-learning for Avoiding Undesirable Demonstrations
di: Hoang, Huy, et al.
Pubblicazione: (2024)
di: Hoang, Huy, et al.
Pubblicazione: (2024)
Is Inverse Reinforcement Learning Harder than Standard Reinforcement Learning? A Theoretical Perspective
di: Zhao, Lei, et al.
Pubblicazione: (2023)
di: Zhao, Lei, et al.
Pubblicazione: (2023)
Inverse Reinforcement Learning from Non-Stationary Learning Agents
di: Sivakumar, Kavinayan P., et al.
Pubblicazione: (2024)
di: Sivakumar, Kavinayan P., et al.
Pubblicazione: (2024)
Multi-Agent Inverse Q-Learning from Demonstrations
di: Haynam, Nathaniel, et al.
Pubblicazione: (2025)
di: Haynam, Nathaniel, et al.
Pubblicazione: (2025)
Provably Efficient Exploration in Inverse Constrained Reinforcement Learning
di: Yue, Bo, et al.
Pubblicazione: (2024)
di: Yue, Bo, et al.
Pubblicazione: (2024)
TROFI: Trajectory-Ranked Offline Inverse Reinforcement Learning
di: Sestini, Alessandro, et al.
Pubblicazione: (2025)
di: Sestini, Alessandro, et al.
Pubblicazione: (2025)
Blockchain-assisted Demonstration Cloning for Multi-Agent Deep Reinforcement Learning
di: Alagha, Ahmed, et al.
Pubblicazione: (2025)
di: Alagha, Ahmed, et al.
Pubblicazione: (2025)
SPEX: Scaling Feature Interaction Explanations for LLMs
di: Kang, Justin Singh, et al.
Pubblicazione: (2025)
di: Kang, Justin Singh, et al.
Pubblicazione: (2025)
Robustness and Adaptability of Reinforcement Learning based Cooperative Autonomous Driving in Mixed-autonomy Traffic
di: Valiente, Rodolfo, et al.
Pubblicazione: (2022)
di: Valiente, Rodolfo, et al.
Pubblicazione: (2022)
Inverse Delayed Reinforcement Learning
di: Zhan, Simon Sinong, et al.
Pubblicazione: (2024)
di: Zhan, Simon Sinong, et al.
Pubblicazione: (2024)
Attention-Driven Multi-Agent Reinforcement Learning: Enhancing Decisions with Expertise-Informed Tasks
di: Kuroswiski, Andre R, et al.
Pubblicazione: (2024)
di: Kuroswiski, Andre R, et al.
Pubblicazione: (2024)
Trajectory Modeling via Random Utility Inverse Reinforcement Learning
di: Pitombeira-Neto, Anselmo R., et al.
Pubblicazione: (2021)
di: Pitombeira-Neto, Anselmo R., et al.
Pubblicazione: (2021)
Learning Individual Intrinsic Reward in Multi-Agent Reinforcement Learning via Incorporating Generalized Human Expertise
di: Wu, Xuefei, et al.
Pubblicazione: (2025)
di: Wu, Xuefei, et al.
Pubblicazione: (2025)
Learning Rewards, Not Labels: Adversarial Inverse Reinforcement Learning for Machinery Fault Detection
di: Neupane, Dhiraj, et al.
Pubblicazione: (2026)
di: Neupane, Dhiraj, et al.
Pubblicazione: (2026)
Reverse Forward Curriculum Learning for Extreme Sample and Demonstration Efficiency in Reinforcement Learning
di: Tao, Stone, et al.
Pubblicazione: (2024)
di: Tao, Stone, et al.
Pubblicazione: (2024)
LLMPi: Optimizing LLMs for High-Throughput on Raspberry Pi
di: Ardakani, Mahsa, et al.
Pubblicazione: (2025)
di: Ardakani, Mahsa, et al.
Pubblicazione: (2025)
Decentralized Low-Rank Fine-Tuning of Large Language Models
di: Ghiasvand, Sajjad, et al.
Pubblicazione: (2025)
di: Ghiasvand, Sajjad, et al.
Pubblicazione: (2025)
Towards the Transferability of Rewards Recovered via Regularized Inverse Reinforcement Learning
di: Schlaginhaufen, Andreas, et al.
Pubblicazione: (2024)
di: Schlaginhaufen, Andreas, et al.
Pubblicazione: (2024)
Rethinking Inverse Reinforcement Learning: from Data Alignment to Task Alignment
di: Zhou, Weichao, et al.
Pubblicazione: (2024)
di: Zhou, Weichao, et al.
Pubblicazione: (2024)
Documenti analoghi
-
REALM: Reliable Expertise-Aware Language Model Fine-Tuning from Noisy Annotations
di: Ghiasvand, Sajjad, et al.
Pubblicazione: (2026) -
Conflict-Aware Adversarial Training
di: Xue, Zhiyu, et al.
Pubblicazione: (2024) -
Inverse-RLignment: Large Language Model Alignment from Demonstrations through Inverse Reinforcement Learning
di: Sun, Hao, et al.
Pubblicazione: (2024) -
Inverse Reinforcement Learning without an Optimal Demonstrator: A Feasible Reward Set Approach
di: Kim, Kihyun, et al.
Pubblicazione: (2026) -
Enhancing the Safety of Medical Vision-Language Models by Synthetic Demonstrations
di: Xue, Zhiyu, et al.
Pubblicazione: (2025)