A Dual Approach to Imitation Learning from Observations with Offline Datasets
Fuente:
arXiv
Guardado en:
| Autores principales: | Sikchi, Harshit, Chuck, Caleb, Zhang, Amy, Niekum, Scott |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Dual RL: Unification and New Methods for Reinforcement and Imitation Learning
por: Sikchi, Harshit, et al.
Publicado: (2023)
por: Sikchi, Harshit, et al.
Publicado: (2023)
SMORE: Score Models for Offline Goal-Conditioned Reinforcement Learning
por: Sikchi, Harshit, et al.
Publicado: (2023)
por: Sikchi, Harshit, et al.
Publicado: (2023)
RLZero: Direct Policy Inference from Language Without In-Domain Supervision
por: Sikchi, Harshit, et al.
Publicado: (2024)
por: Sikchi, Harshit, et al.
Publicado: (2024)
An Optimal Discriminator Weighted Imitation Perspective for Reinforcement Learning
por: Xu, Haoran, et al.
Publicado: (2025)
por: Xu, Haoran, et al.
Publicado: (2025)
Regularized Latent Dynamics Prediction is a Strong Baseline For Behavioral Foundation Models
por: Jajoo, Pranaya, et al.
Publicado: (2026)
por: Jajoo, Pranaya, et al.
Publicado: (2026)
Fast Adaptation with Behavioral Foundation Models
por: Sikchi, Harshit, et al.
Publicado: (2025)
por: Sikchi, Harshit, et al.
Publicado: (2025)
Learning Action-based Representations Using Invariance
por: Rudolph, Max, et al.
Publicado: (2024)
por: Rudolph, Max, et al.
Publicado: (2024)
Imitation Learning from Observation through Optimal Transport
por: Chang, Wei-Di, et al.
Publicado: (2023)
por: Chang, Wei-Di, et al.
Publicado: (2023)
Contrastive Preference Learning: Learning from Human Feedback without RL
por: Hejna, Joey, et al.
Publicado: (2023)
por: Hejna, Joey, et al.
Publicado: (2023)
Null Counterfactual Factor Interactions for Goal-Conditioned Reinforcement Learning
por: Chuck, Caleb, et al.
Publicado: (2025)
por: Chuck, Caleb, et al.
Publicado: (2025)
Granger Causal Interaction Skill Chains
por: Chuck, Caleb, et al.
Publicado: (2023)
por: Chuck, Caleb, et al.
Publicado: (2023)
Dual-Force: Enhanced Offline Diversity Maximization under Imitation Constraints
por: Kolev, Pavel, et al.
Publicado: (2025)
por: Kolev, Pavel, et al.
Publicado: (2025)
Automated Discovery of Functional Actual Causes in Complex Environments
por: Chuck, Caleb, et al.
Publicado: (2024)
por: Chuck, Caleb, et al.
Publicado: (2024)
Robot Air Hockey: A Manipulation Testbed for Robot Learning with Reinforcement Learning
por: Chuck, Caleb, et al.
Publicado: (2024)
por: Chuck, Caleb, et al.
Publicado: (2024)
Offline Imitation Learning Through Graph Search and Retrieval
por: Yin, Zhao-Heng, et al.
Publicado: (2024)
por: Yin, Zhao-Heng, et al.
Publicado: (2024)
Imitation Learning from Observation with Automatic Discount Scheduling
por: Liu, Yuyang, et al.
Publicado: (2023)
por: Liu, Yuyang, et al.
Publicado: (2023)
Using Non-Expert Data to Robustify Imitation Learning via Offline Reinforcement Learning
por: Huang, Kevin, et al.
Publicado: (2025)
por: Huang, Kevin, et al.
Publicado: (2025)
A Recipe for Stable Offline Multi-agent Reinforcement Learning
por: Lee, Dongsu, et al.
Publicado: (2026)
por: Lee, Dongsu, et al.
Publicado: (2026)
Offline Diversity Maximization Under Imitation Constraints
por: Vlastelica, Marin, et al.
Publicado: (2023)
por: Vlastelica, Marin, et al.
Publicado: (2023)
Proto Successor Measure: Representing the Behavior Space of an RL Agent
por: Agarwal, Siddhant, et al.
Publicado: (2024)
por: Agarwal, Siddhant, et al.
Publicado: (2024)
Robotic Manipulation Datasets for Offline Compositional Reinforcement Learning
por: Hussing, Marcel, et al.
Publicado: (2023)
por: Hussing, Marcel, et al.
Publicado: (2023)
From Imitation to Optimization: A Comparative Study of Offline Learning for Autonomous Driving
por: Guillen-Perez, Antonio
Publicado: (2025)
por: Guillen-Perez, Antonio
Publicado: (2025)
SkiLD: Unsupervised Skill Discovery Guided by Factor Interactions
por: Wang, Zizhao, et al.
Publicado: (2024)
por: Wang, Zizhao, et al.
Publicado: (2024)
Compositional Conservatism: A Transductive Approach in Offline Reinforcement Learning
por: Song, Yeda, et al.
Publicado: (2024)
por: Song, Yeda, et al.
Publicado: (2024)
SCIZOR: A Self-Supervised Approach to Data Curation for Large-Scale Imitation Learning
por: Zhang, Yu, et al.
Publicado: (2025)
por: Zhang, Yu, et al.
Publicado: (2025)
CREStE: Scalable Mapless Navigation with Internet Scale Priors and Counterfactual Guidance
por: Zhang, Arthur, et al.
Publicado: (2025)
por: Zhang, Arthur, et al.
Publicado: (2025)
Video-Enhanced Offline Reinforcement Learning: A Model-Based Approach
por: Pan, Minting, et al.
Publicado: (2025)
por: Pan, Minting, et al.
Publicado: (2025)
A Simple Approach to Constraint-Aware Imitation Learning with Application to Autonomous Racing
por: Cao, Shengfan, et al.
Publicado: (2025)
por: Cao, Shengfan, et al.
Publicado: (2025)
Scaling Laws for Reward Model Overoptimization in Direct Alignment Algorithms
por: Rafailov, Rafael, et al.
Publicado: (2024)
por: Rafailov, Rafael, et al.
Publicado: (2024)
RILe: Reinforced Imitation Learning
por: Albaba, Mert, et al.
Publicado: (2024)
por: Albaba, Mert, et al.
Publicado: (2024)
Generalization Capability for Imitation Learning
por: Wang, Yixiao
Publicado: (2025)
por: Wang, Yixiao
Publicado: (2025)
Causal Flow Q-Learning for Robust Offline Reinforcement Learning
por: Li, Mingxuan, et al.
Publicado: (2026)
por: Li, Mingxuan, et al.
Publicado: (2026)
One-Shot Imitation Learning with Invariance Matching for Robotic Manipulation
por: Zhang, Xinyu, et al.
Publicado: (2024)
por: Zhang, Xinyu, et al.
Publicado: (2024)
Diffusion-Reward Adversarial Imitation Learning
por: Lai, Chun-Mao, et al.
Publicado: (2024)
por: Lai, Chun-Mao, et al.
Publicado: (2024)
RIZE: Adaptive Regularization for Imitation Learning
por: Karimi, Adib, et al.
Publicado: (2025)
por: Karimi, Adib, et al.
Publicado: (2025)
Learning to Drive by Imitating Surrounding Vehicles
por: Sonmez, Yasin, et al.
Publicado: (2025)
por: Sonmez, Yasin, et al.
Publicado: (2025)
A Clean Slate for Offline Reinforcement Learning
por: Jackson, Matthew Thomas, et al.
Publicado: (2025)
por: Jackson, Matthew Thomas, et al.
Publicado: (2025)
Diffusion Policies with Value-Conditional Optimization for Offline Reinforcement Learning
por: Ma, Yunchang, et al.
Publicado: (2025)
por: Ma, Yunchang, et al.
Publicado: (2025)
Memory-Consistent Neural Networks for Imitation Learning
por: Sridhar, Kaustubh, et al.
Publicado: (2023)
por: Sridhar, Kaustubh, et al.
Publicado: (2023)
Self-evolved Imitation Learning in Simulated World
por: Ye, Yifan, et al.
Publicado: (2025)
por: Ye, Yifan, et al.
Publicado: (2025)
Ejemplares similares
-
Dual RL: Unification and New Methods for Reinforcement and Imitation Learning
por: Sikchi, Harshit, et al.
Publicado: (2023) -
SMORE: Score Models for Offline Goal-Conditioned Reinforcement Learning
por: Sikchi, Harshit, et al.
Publicado: (2023) -
RLZero: Direct Policy Inference from Language Without In-Domain Supervision
por: Sikchi, Harshit, et al.
Publicado: (2024) -
An Optimal Discriminator Weighted Imitation Perspective for Reinforcement Learning
por: Xu, Haoran, et al.
Publicado: (2025) -
Regularized Latent Dynamics Prediction is a Strong Baseline For Behavioral Foundation Models
por: Jajoo, Pranaya, et al.
Publicado: (2026)