Environment Design for Inverse Reinforcement Learning
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Buening, Thomas Kleine, Villin, Victor, Dimitrakakis, Christos |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2022
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
A Minimax Approach to Ad Hoc Teamwork
von: Villin, Victor, et al.
Veröffentlicht: (2025)
von: Villin, Victor, et al.
Veröffentlicht: (2025)
Causal Imitation Learning under Expert-Observable and Expert-Unobservable Confounding
von: Shao, Daqian, et al.
Veröffentlicht: (2025)
von: Shao, Daqian, et al.
Veröffentlicht: (2025)
Strategic Linear Contextual Bandits
von: Buening, Thomas Kleine, et al.
Veröffentlicht: (2024)
von: Buening, Thomas Kleine, et al.
Veröffentlicht: (2024)
Fair Contracts in Principal-Agent Games with Heterogeneous Types
von: Tłuczek, Jakub, et al.
Veröffentlicht: (2025)
von: Tłuczek, Jakub, et al.
Veröffentlicht: (2025)
Stackelberg Learning from Human Feedback: Preference Optimization as a Sequential Game
von: Pásztor, Barna, et al.
Veröffentlicht: (2025)
von: Pásztor, Barna, et al.
Veröffentlicht: (2025)
MAVRL: Learning Reward Functions from Multiple Feedback Types with Amortized Variational Inference
von: Baur, Raphaël, et al.
Veröffentlicht: (2026)
von: Baur, Raphaël, et al.
Veröffentlicht: (2026)
Reinforcement Learning via Self-Distillation
von: Hübotter, Jonas, et al.
Veröffentlicht: (2026)
von: Hübotter, Jonas, et al.
Veröffentlicht: (2026)
Inference of Altruism and Intrinsic Rewards in Multi-Agent Systems
von: Villin, Victor, et al.
Veröffentlicht: (2025)
von: Villin, Victor, et al.
Veröffentlicht: (2025)
Aligning Language Models from User Interactions
von: Buening, Thomas Kleine, et al.
Veröffentlicht: (2026)
von: Buening, Thomas Kleine, et al.
Veröffentlicht: (2026)
Strategyproof Reinforcement Learning from Human Feedback
von: Buening, Thomas Kleine, et al.
Veröffentlicht: (2025)
von: Buening, Thomas Kleine, et al.
Veröffentlicht: (2025)
Multi-Agent Reinforcement Learning for Inverse Design in Photonic Integrated Circuits
von: Mahlau, Yannik, et al.
Veröffentlicht: (2025)
von: Mahlau, Yannik, et al.
Veröffentlicht: (2025)
Hybrid Inverse Reinforcement Learning
von: Ren, Juntao, et al.
Veröffentlicht: (2024)
von: Ren, Juntao, et al.
Veröffentlicht: (2024)
Fast Rates for Inverse Reinforcement Learning
von: Schlaginhaufen, Andreas, et al.
Veröffentlicht: (2026)
von: Schlaginhaufen, Andreas, et al.
Veröffentlicht: (2026)
On the Effective Horizon of Inverse Reinforcement Learning
von: Xu, Yiqing, et al.
Veröffentlicht: (2023)
von: Xu, Yiqing, et al.
Veröffentlicht: (2023)
Recursive Deep Inverse Reinforcement Learning
von: Ghanem, Paul, et al.
Veröffentlicht: (2025)
von: Ghanem, Paul, et al.
Veröffentlicht: (2025)
Inverse Reinforcement Learning With Constraint Recovery
von: Das, Nirjhar, et al.
Veröffentlicht: (2023)
von: Das, Nirjhar, et al.
Veröffentlicht: (2023)
Learning Equilibria in Matching Games with Bandit Feedback
von: Athanasopoulos, Andreas, et al.
Veröffentlicht: (2025)
von: Athanasopoulos, Andreas, et al.
Veröffentlicht: (2025)
Towards Interpretable Deep Reinforcement Learning Models via Inverse Reinforcement Learning
von: Xie, Sean, et al.
Veröffentlicht: (2022)
von: Xie, Sean, et al.
Veröffentlicht: (2022)
Partial Identifiability and Misspecification in Inverse Reinforcement Learning
von: Skalse, Joar, et al.
Veröffentlicht: (2024)
von: Skalse, Joar, et al.
Veröffentlicht: (2024)
Is Optimal Transport Necessary for Inverse Reinforcement Learning?
von: Dong, Zixuan, et al.
Veröffentlicht: (2025)
von: Dong, Zixuan, et al.
Veröffentlicht: (2025)
Inverse Reinforcement Learning with Sub-optimal Experts
von: Poiani, Riccardo, et al.
Veröffentlicht: (2024)
von: Poiani, Riccardo, et al.
Veröffentlicht: (2024)
Kernel Density Bayesian Inverse Reinforcement Learning
von: Mandyam, Aishwarya, et al.
Veröffentlicht: (2023)
von: Mandyam, Aishwarya, et al.
Veröffentlicht: (2023)
Inverse Reinforcement Learning by Estimating Expertise of Demonstrators
von: Beliaev, Mark, et al.
Veröffentlicht: (2024)
von: Beliaev, Mark, et al.
Veröffentlicht: (2024)
Is Inverse Reinforcement Learning Harder than Standard Reinforcement Learning? A Theoretical Perspective
von: Zhao, Lei, et al.
Veröffentlicht: (2023)
von: Zhao, Lei, et al.
Veröffentlicht: (2023)
Inverse Reinforcement Learning from Non-Stationary Learning Agents
von: Sivakumar, Kavinayan P., et al.
Veröffentlicht: (2024)
von: Sivakumar, Kavinayan P., et al.
Veröffentlicht: (2024)
Inverse Design in Distributed Circuits Using Single-Step Reinforcement Learning
von: Li, Jiayu, et al.
Veröffentlicht: (2025)
von: Li, Jiayu, et al.
Veröffentlicht: (2025)
Provably Efficient Exploration in Inverse Constrained Reinforcement Learning
von: Yue, Bo, et al.
Veröffentlicht: (2024)
von: Yue, Bo, et al.
Veröffentlicht: (2024)
TROFI: Trajectory-Ranked Offline Inverse Reinforcement Learning
von: Sestini, Alessandro, et al.
Veröffentlicht: (2025)
von: Sestini, Alessandro, et al.
Veröffentlicht: (2025)
DRED: Zero-Shot Transfer in Reinforcement Learning via Data-Regularised Environment Design
von: Garcin, Samuel, et al.
Veröffentlicht: (2024)
von: Garcin, Samuel, et al.
Veröffentlicht: (2024)
Inverse Delayed Reinforcement Learning
von: Zhan, Simon Sinong, et al.
Veröffentlicht: (2024)
von: Zhan, Simon Sinong, et al.
Veröffentlicht: (2024)
Inverse-RLignment: Large Language Model Alignment from Demonstrations through Inverse Reinforcement Learning
von: Sun, Hao, et al.
Veröffentlicht: (2024)
von: Sun, Hao, et al.
Veröffentlicht: (2024)
AIMatDesign: Knowledge-Augmented Reinforcement Learning for Inverse Materials Design under Data Scarcity
von: Yu, Yeyong, et al.
Veröffentlicht: (2025)
von: Yu, Yeyong, et al.
Veröffentlicht: (2025)
Transformer-Based Reinforcement Learning for Autonomous Orbital Collision Avoidance in Partially Observable Environments
von: Georges, Thomas, et al.
Veröffentlicht: (2026)
von: Georges, Thomas, et al.
Veröffentlicht: (2026)
Trajectory Modeling via Random Utility Inverse Reinforcement Learning
von: Pitombeira-Neto, Anselmo R., et al.
Veröffentlicht: (2021)
von: Pitombeira-Neto, Anselmo R., et al.
Veröffentlicht: (2021)
Learning Rewards, Not Labels: Adversarial Inverse Reinforcement Learning for Machinery Fault Detection
von: Neupane, Dhiraj, et al.
Veröffentlicht: (2026)
von: Neupane, Dhiraj, et al.
Veröffentlicht: (2026)
The Role of Environment Access in Agnostic Reinforcement Learning
von: Krishnamurthy, Akshay, et al.
Veröffentlicht: (2025)
von: Krishnamurthy, Akshay, et al.
Veröffentlicht: (2025)
Towards the Transferability of Rewards Recovered via Regularized Inverse Reinforcement Learning
von: Schlaginhaufen, Andreas, et al.
Veröffentlicht: (2024)
von: Schlaginhaufen, Andreas, et al.
Veröffentlicht: (2024)
Rethinking Inverse Reinforcement Learning: from Data Alignment to Task Alignment
von: Zhou, Weichao, et al.
Veröffentlicht: (2024)
von: Zhou, Weichao, et al.
Veröffentlicht: (2024)
GRACE: A Language Model Framework for Explainable Inverse Reinforcement Learning
von: Sapora, Silvia, et al.
Veröffentlicht: (2025)
von: Sapora, Silvia, et al.
Veröffentlicht: (2025)
Non-Adversarial Inverse Reinforcement Learning via Successor Feature Matching
von: Jain, Arnav Kumar, et al.
Veröffentlicht: (2024)
von: Jain, Arnav Kumar, et al.
Veröffentlicht: (2024)
Ähnliche Einträge
-
A Minimax Approach to Ad Hoc Teamwork
von: Villin, Victor, et al.
Veröffentlicht: (2025) -
Causal Imitation Learning under Expert-Observable and Expert-Unobservable Confounding
von: Shao, Daqian, et al.
Veröffentlicht: (2025) -
Strategic Linear Contextual Bandits
von: Buening, Thomas Kleine, et al.
Veröffentlicht: (2024) -
Fair Contracts in Principal-Agent Games with Heterogeneous Types
von: Tłuczek, Jakub, et al.
Veröffentlicht: (2025) -
Stackelberg Learning from Human Feedback: Preference Optimization as a Sequential Game
von: Pásztor, Barna, et al.
Veröffentlicht: (2025)