SEABO: A Simple Search-Based Method for Offline Imitation Learning
Fuente:
arXiv
Guardado en:
| Autores principales: | Lyu, Jiafei, Ma, Xiaoteng, Wan, Le, Liu, Runze, Li, Xiu, Lu, Zongqing |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Mildly Conservative Q-Learning for Offline Reinforcement Learning
por: Lyu, Jiafei, et al.
Publicado: (2022)
por: Lyu, Jiafei, et al.
Publicado: (2022)
Understanding What Affects the Generalization Gap in Visual Reinforcement Learning: Theory and Empirical Evidence
por: Lyu, Jiafei, et al.
Publicado: (2024)
por: Lyu, Jiafei, et al.
Publicado: (2024)
PROF: An LLM-based Reward Code Preference Optimization Framework for Offline Imitation Learning
por: Sun, Shengjie, et al.
Publicado: (2025)
por: Sun, Shengjie, et al.
Publicado: (2025)
Cross-Domain Policy Adaptation by Capturing Representation Mismatch
por: Lyu, Jiafei, et al.
Publicado: (2024)
por: Lyu, Jiafei, et al.
Publicado: (2024)
ODRL: A Benchmark for Off-Dynamics Reinforcement Learning
por: Lyu, Jiafei, et al.
Publicado: (2024)
por: Lyu, Jiafei, et al.
Publicado: (2024)
ADG: Ambient Diffusion-Guided Dataset Recovery for Corruption-Robust Offline Reinforcement Learning
por: Liu, Zeyuan, et al.
Publicado: (2025)
por: Liu, Zeyuan, et al.
Publicado: (2025)
Mind the Model, Not the Agent: The Primacy Bias in Model-based RL
por: Qiao, Zhongjian, et al.
Publicado: (2023)
por: Qiao, Zhongjian, et al.
Publicado: (2023)
A Two-stage Reinforcement Learning-based Approach for Multi-entity Task Allocation
por: Gong, Aicheng, et al.
Publicado: (2024)
por: Gong, Aicheng, et al.
Publicado: (2024)
SUMO: Search-Based Uncertainty Estimation for Model-Based Offline Reinforcement Learning
por: Qiao, Zhongjian, et al.
Publicado: (2024)
por: Qiao, Zhongjian, et al.
Publicado: (2024)
Offline Imitation Learning Through Graph Search and Retrieval
por: Yin, Zhao-Heng, et al.
Publicado: (2024)
por: Yin, Zhao-Heng, et al.
Publicado: (2024)
Debiased Model-based Representations for Sample-efficient Continuous Control
por: Lyu, Jiafei, et al.
Publicado: (2026)
por: Lyu, Jiafei, et al.
Publicado: (2026)
How to Leverage Diverse Demonstrations in Offline Imitation Learning
por: Yue, Sheng, et al.
Publicado: (2024)
por: Yue, Sheng, et al.
Publicado: (2024)
Offline Imitation Learning with Model-based Reverse Augmentation
por: Shao, Jie-Jing, et al.
Publicado: (2024)
por: Shao, Jie-Jing, et al.
Publicado: (2024)
DITTO: Offline Imitation Learning with World Models
por: DeMoss, Branton, et al.
Publicado: (2023)
por: DeMoss, Branton, et al.
Publicado: (2023)
Temporal Difference Learning with Constrained Initial Representations
por: Lyu, Jiafei, et al.
Publicado: (2026)
por: Lyu, Jiafei, et al.
Publicado: (2026)
Simple Ingredients for Offline Reinforcement Learning
por: Cetin, Edoardo, et al.
Publicado: (2024)
por: Cetin, Edoardo, et al.
Publicado: (2024)
Search-Based Credit Assignment for Offline Preference-Based Reinforcement Learning
por: Gao, Xiancheng, et al.
Publicado: (2025)
por: Gao, Xiancheng, et al.
Publicado: (2025)
OLLIE: Imitation Learning from Offline Pretraining to Online Finetuning
por: Yue, Sheng, et al.
Publicado: (2024)
por: Yue, Sheng, et al.
Publicado: (2024)
Balance Equation-based Distributionally Robust Offline Imitation Learning
por: Agrawal, Rishabh, et al.
Publicado: (2025)
por: Agrawal, Rishabh, et al.
Publicado: (2025)
SPRINQL: Sub-optimal Demonstrations driven Offline Imitation Learning
por: Hoang, Huy, et al.
Publicado: (2024)
por: Hoang, Huy, et al.
Publicado: (2024)
TDMPBC: Self-Imitative Reinforcement Learning for Humanoid Robot Control
por: Zhuang, Zifeng, et al.
Publicado: (2025)
por: Zhuang, Zifeng, et al.
Publicado: (2025)
Imitation from Diverse Behaviors: Wasserstein Quality Diversity Imitation Learning with Single-Step Archive Exploration
por: Yu, Xingrui, et al.
Publicado: (2024)
por: Yu, Xingrui, et al.
Publicado: (2024)
Efficient Online RL Fine Tuning with Offline Pre-trained Policy Only
por: Xiao, Wei, et al.
Publicado: (2025)
por: Xiao, Wei, et al.
Publicado: (2025)
Align Your Intents: Offline Imitation Learning via Optimal Transport
por: Bobrin, Maksim, et al.
Publicado: (2024)
por: Bobrin, Maksim, et al.
Publicado: (2024)
A Dual Approach to Imitation Learning from Observations with Offline Datasets
por: Sikchi, Harshit, et al.
Publicado: (2024)
por: Sikchi, Harshit, et al.
Publicado: (2024)
World Models with Hints of Large Language Models for Goal Achieving
por: Liu, Zeyuan, et al.
Publicado: (2024)
por: Liu, Zeyuan, et al.
Publicado: (2024)
Markov Balance Satisfaction Improves Performance in Strictly Batch Offline Imitation Learning
por: Agrawal, Rishabh, et al.
Publicado: (2024)
por: Agrawal, Rishabh, et al.
Publicado: (2024)
Bayes Adaptive Monte Carlo Tree Search for Offline Model-based Reinforcement Learning
por: Chen, Jiayu, et al.
Publicado: (2024)
por: Chen, Jiayu, et al.
Publicado: (2024)
Offline Diversity Maximization Under Imitation Constraints
por: Vlastelica, Marin, et al.
Publicado: (2023)
por: Vlastelica, Marin, et al.
Publicado: (2023)
SafeMIL: Learning Offline Safe Imitation Policy from Non-Preferred Trajectories
por: Burnwal, Returaj, et al.
Publicado: (2025)
por: Burnwal, Returaj, et al.
Publicado: (2025)
Learning What to Do and What Not To Do: Offline Imitation from Expert and Undesirable Demonstrations
por: Hoang, Huy, et al.
Publicado: (2025)
por: Hoang, Huy, et al.
Publicado: (2025)
Graph Ranking Contrastive Learning: A Extremely Simple yet Efficient Method
por: Hu, Yulan, et al.
Publicado: (2023)
por: Hu, Yulan, et al.
Publicado: (2023)
DIDA: Denoised Imitation Learning based on Domain Adaptation
por: Huang, Kaichen, et al.
Publicado: (2024)
por: Huang, Kaichen, et al.
Publicado: (2024)
Fully Decentralized Cooperative Multi-Agent Reinforcement Learning: A Survey
por: Jiang, Jiechuan, et al.
Publicado: (2024)
por: Jiang, Jiechuan, et al.
Publicado: (2024)
A Simple Unified Uncertainty-Guided Framework for Offline-to-Online Reinforcement Learning
por: Guo, Siyuan, et al.
Publicado: (2023)
por: Guo, Siyuan, et al.
Publicado: (2023)
Using Non-Expert Data to Robustify Imitation Learning via Offline Reinforcement Learning
por: Huang, Kevin, et al.
Publicado: (2025)
por: Huang, Kevin, et al.
Publicado: (2025)
Offline Trajectory Optimization for Offline Reinforcement Learning
por: Zhao, Ziqi, et al.
Publicado: (2024)
por: Zhao, Ziqi, et al.
Publicado: (2024)
OSIL: Learning Offline Safe Imitation Policies with Safety Inferred from Non-preferred Trajectories
por: Burnwal, Returaj, et al.
Publicado: (2026)
por: Burnwal, Returaj, et al.
Publicado: (2026)
A Survey of Imitation Learning Methods, Environments and Metrics
por: Gavenski, Nathan, et al.
Publicado: (2024)
por: Gavenski, Nathan, et al.
Publicado: (2024)
PEARL: Zero-shot Cross-task Preference Alignment and Robust Reward Learning for Robotic Manipulation
por: Liu, Runze, et al.
Publicado: (2023)
por: Liu, Runze, et al.
Publicado: (2023)
Ejemplares similares
-
Mildly Conservative Q-Learning for Offline Reinforcement Learning
por: Lyu, Jiafei, et al.
Publicado: (2022) -
Understanding What Affects the Generalization Gap in Visual Reinforcement Learning: Theory and Empirical Evidence
por: Lyu, Jiafei, et al.
Publicado: (2024) -
PROF: An LLM-based Reward Code Preference Optimization Framework for Offline Imitation Learning
por: Sun, Shengjie, et al.
Publicado: (2025) -
Cross-Domain Policy Adaptation by Capturing Representation Mismatch
por: Lyu, Jiafei, et al.
Publicado: (2024) -
ODRL: A Benchmark for Off-Dynamics Reinforcement Learning
por: Lyu, Jiafei, et al.
Publicado: (2024)