Non-Adversarial Inverse Reinforcement Learning via Successor Feature Matching
Fuente:
arXiv
Salvato in:
| Autori principali: | Jain, Arnav Kumar, Wiltzer, Harley, Farebrother, Jesse, Rish, Irina, Berseth, Glen, Choudhury, Sanjiban |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
A Distributional Analogue to the Successor Representation
di: Wiltzer, Harley, et al.
Pubblicazione: (2024)
di: Wiltzer, Harley, et al.
Pubblicazione: (2024)
Enabling Realtime Reinforcement Learning at Scale with Staggered Asynchronous Inference
di: Riemer, Matthew, et al.
Pubblicazione: (2024)
di: Riemer, Matthew, et al.
Pubblicazione: (2024)
Is Exploration or Optimization the Problem for Deep Reinforcement Learning?
di: Berseth, Glen
Pubblicazione: (2025)
di: Berseth, Glen
Pubblicazione: (2025)
Foundations of Multivariate Distributional Reinforcement Learning
di: Wiltzer, Harley, et al.
Pubblicazione: (2024)
di: Wiltzer, Harley, et al.
Pubblicazione: (2024)
Improving Deep Reinforcement Learning by Reducing the Chain Effect of Value and Policy Churn
di: Tang, Hongyao, et al.
Pubblicazione: (2024)
di: Tang, Hongyao, et al.
Pubblicazione: (2024)
Hybrid Inverse Reinforcement Learning
di: Ren, Juntao, et al.
Pubblicazione: (2024)
di: Ren, Juntao, et al.
Pubblicazione: (2024)
SegDAC: Visual Generalization in Reinforcement Learning via Dynamic Object Tokens
di: Brown, Alexandre, et al.
Pubblicazione: (2025)
di: Brown, Alexandre, et al.
Pubblicazione: (2025)
Process Reward Models for LLM Agents: Practical Framework and Directions
di: Choudhury, Sanjiban
Pubblicazione: (2025)
di: Choudhury, Sanjiban
Pubblicazione: (2025)
CALE: Continuous Arcade Learning Environment
di: Farebrother, Jesse, et al.
Pubblicazione: (2024)
di: Farebrother, Jesse, et al.
Pubblicazione: (2024)
Surprise-Adaptive Intrinsic Motivation for Unsupervised Reinforcement Learning
di: Hugessen, Adriana, et al.
Pubblicazione: (2024)
di: Hugessen, Adriana, et al.
Pubblicazione: (2024)
Better than Your Teacher: LLM Agents that learn from Privileged AI Feedback
di: Choudhury, Sanjiban, et al.
Pubblicazione: (2024)
di: Choudhury, Sanjiban, et al.
Pubblicazione: (2024)
Multi-Turn Code Generation Through Single-Step Rewards
di: Jain, Arnav Kumar, et al.
Pubblicazione: (2025)
di: Jain, Arnav Kumar, et al.
Pubblicazione: (2025)
Stacked Universal Successor Feature Approximators for Safety in Reinforcement Learning
di: Cannon, Ian, et al.
Pubblicazione: (2024)
di: Cannon, Ian, et al.
Pubblicazione: (2024)
ARM-FM: Automated Reward Machines via Foundation Models for Compositional Reinforcement Learning
di: Castanyer, Roger Creus, et al.
Pubblicazione: (2025)
di: Castanyer, Roger Creus, et al.
Pubblicazione: (2025)
Accelerating Inverse Reinforcement Learning with Expert Bootstrapping
di: Wu, David, et al.
Pubblicazione: (2024)
di: Wu, David, et al.
Pubblicazione: (2024)
Mitigating Plasticity Loss in Continual Reinforcement Learning by Reducing Churn
di: Tang, Hongyao, et al.
Pubblicazione: (2025)
di: Tang, Hongyao, et al.
Pubblicazione: (2025)
Temporal Representations for Exploration: Learning Complex Exploratory Behavior without Extrinsic Rewards
di: Mohamed, Faisal, et al.
Pubblicazione: (2026)
di: Mohamed, Faisal, et al.
Pubblicazione: (2026)
Improving Intrinsic Exploration by Creating Stationary Objectives
di: Castanyer, Roger Creus, et al.
Pubblicazione: (2023)
di: Castanyer, Roger Creus, et al.
Pubblicazione: (2023)
Imitation Learning via Focused Satisficing
di: Shah, Rushit N., et al.
Pubblicazione: (2025)
di: Shah, Rushit N., et al.
Pubblicazione: (2025)
Intelligent Switching for Reset-Free RL
di: Patil, Darshan, et al.
Pubblicazione: (2024)
di: Patil, Darshan, et al.
Pubblicazione: (2024)
Handling Delay in Real-Time Reinforcement Learning
di: Anokhin, Ivan, et al.
Pubblicazione: (2025)
di: Anokhin, Ivan, et al.
Pubblicazione: (2025)
Warming Up for Zeroth-Order Federated Pre-Training with Low Resource Clients
di: Legate, Gwen, et al.
Pubblicazione: (2025)
di: Legate, Gwen, et al.
Pubblicazione: (2025)
Ensemble Successor Representations for Task Generalization in Offline-to-Online Reinforcement Learning
di: Wang, Changhong, et al.
Pubblicazione: (2024)
di: Wang, Changhong, et al.
Pubblicazione: (2024)
Motion Tracks: A Unified Representation for Human-Robot Transfer in Few-Shot Imitation Learning
di: Ren, Juntao, et al.
Pubblicazione: (2025)
di: Ren, Juntao, et al.
Pubblicazione: (2025)
Learning Successor Features with Distributed Hebbian Temporal Memory
di: Dzhivelikian, Evgenii, et al.
Pubblicazione: (2023)
di: Dzhivelikian, Evgenii, et al.
Pubblicazione: (2023)
Efficient Imitation under Misspecification
di: Espinosa-Dice, Nicolas, et al.
Pubblicazione: (2025)
di: Espinosa-Dice, Nicolas, et al.
Pubblicazione: (2025)
Decoupling Exploration and Exploitation for Unsupervised Pre-training with Successor Features
di: Kim, JaeYoon, et al.
Pubblicazione: (2024)
di: Kim, JaeYoon, et al.
Pubblicazione: (2024)
Quality-Diversity Actor-Critic: Learning High-Performing and Diverse Behaviors via Value and Successor Features Critics
di: Grillotti, Luca, et al.
Pubblicazione: (2024)
di: Grillotti, Luca, et al.
Pubblicazione: (2024)
Self-Predictive Representations for Combinatorial Generalization in Behavioral Cloning
di: Lawson, Daniel, et al.
Pubblicazione: (2025)
di: Lawson, Daniel, et al.
Pubblicazione: (2025)
Inverse Reinforcement Learning without Reinforcement Learning
di: Swamy, Gokul, et al.
Pubblicazione: (2023)
di: Swamy, Gokul, et al.
Pubblicazione: (2023)
InteRACT: Transformer Models for Human Intent Prediction Conditioned on Robot Actions
di: Kedia, Kushal, et al.
Pubblicazione: (2023)
di: Kedia, Kushal, et al.
Pubblicazione: (2023)
Temporal Difference Flows
di: Farebrother, Jesse, et al.
Pubblicazione: (2025)
di: Farebrother, Jesse, et al.
Pubblicazione: (2025)
Learning Rewards, Not Labels: Adversarial Inverse Reinforcement Learning for Machinery Fault Detection
di: Neupane, Dhiraj, et al.
Pubblicazione: (2026)
di: Neupane, Dhiraj, et al.
Pubblicazione: (2026)
Learning Temporal Distances: Contrastive Successor Features Can Provide a Metric Structure for Decision-Making
di: Myers, Vivek, et al.
Pubblicazione: (2024)
di: Myers, Vivek, et al.
Pubblicazione: (2024)
X-Sim: Cross-Embodiment Learning via Real-to-Sim-to-Real
di: Dan, Prithwish, et al.
Pubblicazione: (2025)
di: Dan, Prithwish, et al.
Pubblicazione: (2025)
Inverse Reinforcement Learning from Non-Stationary Learning Agents
di: Sivakumar, Kavinayan P., et al.
Pubblicazione: (2024)
di: Sivakumar, Kavinayan P., et al.
Pubblicazione: (2024)
Compositional Planning with Jumpy World Models
di: Farebrother, Jesse, et al.
Pubblicazione: (2026)
di: Farebrother, Jesse, et al.
Pubblicazione: (2026)
One-Shot Imitation under Mismatched Execution
di: Kedia, Kushal, et al.
Pubblicazione: (2024)
di: Kedia, Kushal, et al.
Pubblicazione: (2024)
Towards Interpretable Deep Reinforcement Learning Models via Inverse Reinforcement Learning
di: Xie, Sean, et al.
Pubblicazione: (2022)
di: Xie, Sean, et al.
Pubblicazione: (2022)
Modeling Behavioral Preferences of Cyber Adversaries Using Inverse Reinforcement Learning
di: Shinde, Aditya, et al.
Pubblicazione: (2025)
di: Shinde, Aditya, et al.
Pubblicazione: (2025)
Documenti analoghi
-
A Distributional Analogue to the Successor Representation
di: Wiltzer, Harley, et al.
Pubblicazione: (2024) -
Enabling Realtime Reinforcement Learning at Scale with Staggered Asynchronous Inference
di: Riemer, Matthew, et al.
Pubblicazione: (2024) -
Is Exploration or Optimization the Problem for Deep Reinforcement Learning?
di: Berseth, Glen
Pubblicazione: (2025) -
Foundations of Multivariate Distributional Reinforcement Learning
di: Wiltzer, Harley, et al.
Pubblicazione: (2024) -
Improving Deep Reinforcement Learning by Reducing the Chain Effect of Value and Policy Churn
di: Tang, Hongyao, et al.
Pubblicazione: (2024)