Towards the Transferability of Rewards Recovered via Regularized Inverse Reinforcement Learning
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Schlaginhaufen, Andreas, Kamgarpour, Maryam |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Fast Rates for Inverse Reinforcement Learning
par: Schlaginhaufen, Andreas, et autres
Publié: (2026)
par: Schlaginhaufen, Andreas, et autres
Publié: (2026)
Efficient Preference-Based Reinforcement Learning: Randomized Exploration Meets Experimental Design
par: Schlaginhaufen, Andreas, et autres
Publié: (2025)
par: Schlaginhaufen, Andreas, et autres
Publié: (2025)
Convergence of a model-free entropy-regularized inverse reinforcement learning algorithm
par: Renard, Titouan, et autres
Publié: (2024)
par: Renard, Titouan, et autres
Publié: (2024)
Generalizing Behavior via Inverse Reinforcement Learning with Closed-Form Reward Centroids
par: Lazzati, Filippo, et autres
Publié: (2025)
par: Lazzati, Filippo, et autres
Publié: (2025)
Towards Interpretable Deep Reinforcement Learning Models via Inverse Reinforcement Learning
par: Xie, Sean, et autres
Publié: (2022)
par: Xie, Sean, et autres
Publié: (2022)
Learning Rewards, Not Labels: Adversarial Inverse Reinforcement Learning for Machinery Fault Detection
par: Neupane, Dhiraj, et autres
Publié: (2026)
par: Neupane, Dhiraj, et autres
Publié: (2026)
Reinforcement Learning with LTL and $ω$-Regular Objectives via Optimality-Preserving Translation to Average Rewards
par: Le, Xuan-Bach, et autres
Publié: (2024)
par: Le, Xuan-Bach, et autres
Publié: (2024)
TW-CRL: Time-Weighted Contrastive Reward Learning for Efficient Inverse Reinforcement Learning
par: Li, Yuxuan, et autres
Publié: (2025)
par: Li, Yuxuan, et autres
Publié: (2025)
Enhancing Inverse Reinforcement Learning through Encoding Dynamic Information in Reward Shaping
par: Zhan, Simon Sinong, et autres
Publié: (2024)
par: Zhan, Simon Sinong, et autres
Publié: (2024)
Inverse Reinforcement Learning with Switching Rewards and History Dependency for Characterizing Animal Behaviors
par: Ke, Jingyang, et autres
Publié: (2025)
par: Ke, Jingyang, et autres
Publié: (2025)
Decision-Focused Model-based Reinforcement Learning for Reward Transfer
par: Sharma, Abhishek, et autres
Publié: (2023)
par: Sharma, Abhishek, et autres
Publié: (2023)
IR$^3$: Contrastive Inverse Reinforcement Learning for Interpretable Detection and Mitigation of Reward Hacking
par: Beigi, Mohammad, et autres
Publié: (2026)
par: Beigi, Mohammad, et autres
Publié: (2026)
Inverse Reinforcement Learning without an Optimal Demonstrator: A Feasible Reward Set Approach
par: Kim, Kihyun, et autres
Publié: (2026)
par: Kim, Kihyun, et autres
Publié: (2026)
Inverse Reinforcement Learning with Dynamic Reward Scaling for LLM Alignment
par: Cheng, Ruoxi, et autres
Publié: (2025)
par: Cheng, Ruoxi, et autres
Publié: (2025)
Centralized Reward Agent for Knowledge Sharing and Transfer in Multi-Task Reinforcement Learning
par: Ma, Haozhe, et autres
Publié: (2024)
par: Ma, Haozhe, et autres
Publié: (2024)
Provably Efficient Reward Transfer in Reinforcement Learning with Discrete Markov Decision Processes
par: Vora, Kevin, et autres
Publié: (2025)
par: Vora, Kevin, et autres
Publié: (2025)
Gradient Regularization Prevents Reward Hacking in Reinforcement Learning from Human Feedback and Verifiable Rewards
par: Ackermann, Johannes, et autres
Publié: (2026)
par: Ackermann, Johannes, et autres
Publié: (2026)
Contextual Pre-planning on Reward Machine Abstractions for Enhanced Transfer in Deep Reinforcement Learning
par: Azran, Guy, et autres
Publié: (2023)
par: Azran, Guy, et autres
Publié: (2023)
Learning to Recover: Dynamic Reward Shaping with Wheel-Leg Coordination for Fallen Robots
par: Deng, Boyuan, et autres
Publié: (2025)
par: Deng, Boyuan, et autres
Publié: (2025)
DISCOVER: Automated Curricula for Sparse-Reward Reinforcement Learning
par: Diaz-Bone, Leander, et autres
Publié: (2025)
par: Diaz-Bone, Leander, et autres
Publié: (2025)
Hybrid Inverse Reinforcement Learning
par: Ren, Juntao, et autres
Publié: (2024)
par: Ren, Juntao, et autres
Publié: (2024)
Trajectory Modeling via Random Utility Inverse Reinforcement Learning
par: Pitombeira-Neto, Anselmo R., et autres
Publié: (2021)
par: Pitombeira-Neto, Anselmo R., et autres
Publié: (2021)
Offline Reinforcement Learning with Imputed Rewards
par: Romeo, Carlo, et autres
Publié: (2024)
par: Romeo, Carlo, et autres
Publié: (2024)
Reinforcement Learning with Exogenous States and Rewards
par: Trimponias, George, et autres
Publié: (2023)
par: Trimponias, George, et autres
Publié: (2023)
Reinforcement Learning with Symbolic Reward Machines
par: Krug, Thomas, et autres
Publié: (2026)
par: Krug, Thomas, et autres
Publié: (2026)
Reinforcement Learning with Stochastic Reward Machines
par: Corazza, Jan, et autres
Publié: (2025)
par: Corazza, Jan, et autres
Publié: (2025)
Unsupervised Zero-Shot Reinforcement Learning via Functional Reward Encodings
par: Frans, Kevin, et autres
Publié: (2024)
par: Frans, Kevin, et autres
Publié: (2024)
Reinforcement Learning With Sparse-Executing Actions via Sparsity Regularization
par: Pang, Jing-Cheng, et autres
Publié: (2021)
par: Pang, Jing-Cheng, et autres
Publié: (2021)
Non-Adversarial Inverse Reinforcement Learning via Successor Feature Matching
par: Jain, Arnav Kumar, et autres
Publié: (2024)
par: Jain, Arnav Kumar, et autres
Publié: (2024)
On the Effective Horizon of Inverse Reinforcement Learning
par: Xu, Yiqing, et autres
Publié: (2023)
par: Xu, Yiqing, et autres
Publié: (2023)
Environment Design for Inverse Reinforcement Learning
par: Buening, Thomas Kleine, et autres
Publié: (2022)
par: Buening, Thomas Kleine, et autres
Publié: (2022)
Recursive Deep Inverse Reinforcement Learning
par: Ghanem, Paul, et autres
Publié: (2025)
par: Ghanem, Paul, et autres
Publié: (2025)
Inverse Reinforcement Learning With Constraint Recovery
par: Das, Nirjhar, et autres
Publié: (2023)
par: Das, Nirjhar, et autres
Publié: (2023)
StructRL: Recovering Dynamic Programming Structure from Learning Dynamics in Distributional Reinforcement Learning
par: Nowak, Ivo
Publié: (2026)
par: Nowak, Ivo
Publié: (2026)
Constrained Meta Reinforcement Learning with Provable Test-Time Safety
par: Ni, Tingting, et autres
Publié: (2026)
par: Ni, Tingting, et autres
Publié: (2026)
Trust Region Reward Optimization and Proximal Inverse Reward Optimization Algorithm
par: Chen, Yang, et autres
Publié: (2025)
par: Chen, Yang, et autres
Publié: (2025)
Mitigating Reward Over-Optimization in RLHF via Behavior-Supported Regularization
par: Dai, Juntao, et autres
Publié: (2025)
par: Dai, Juntao, et autres
Publié: (2025)
Reward Generation via Large Vision-Language Model in Offline Reinforcement Learning
par: Lee, Younghwan, et autres
Publié: (2025)
par: Lee, Younghwan, et autres
Publié: (2025)
Efficient Reinforcement Learning in Probabilistic Reward Machines
par: Lin, Xiaofeng, et autres
Publié: (2024)
par: Lin, Xiaofeng, et autres
Publié: (2024)
Beyond Rewards in Reinforcement Learning for Cyber Defence
par: Bates, Elizabeth, et autres
Publié: (2026)
par: Bates, Elizabeth, et autres
Publié: (2026)
Documents similaires
-
Fast Rates for Inverse Reinforcement Learning
par: Schlaginhaufen, Andreas, et autres
Publié: (2026) -
Efficient Preference-Based Reinforcement Learning: Randomized Exploration Meets Experimental Design
par: Schlaginhaufen, Andreas, et autres
Publié: (2025) -
Convergence of a model-free entropy-regularized inverse reinforcement learning algorithm
par: Renard, Titouan, et autres
Publié: (2024) -
Generalizing Behavior via Inverse Reinforcement Learning with Closed-Form Reward Centroids
par: Lazzati, Filippo, et autres
Publié: (2025) -
Towards Interpretable Deep Reinforcement Learning Models via Inverse Reinforcement Learning
par: Xie, Sean, et autres
Publié: (2022)