Online Adaptation for Enhancing Imitation Learning Policies
Fuente:
arXiv
Salvato in:
| Autori principali: | Malato, Federico, Hautamaki, Ville |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Search-Based Adversarial Estimates for Improving Sample Efficiency in Off-Policy Reinforcement Learning
di: Malato, Federico, et al.
Pubblicazione: (2025)
di: Malato, Federico, et al.
Pubblicazione: (2025)
Zero-shot World Models via Search in Memory
di: Malato, Federico, et al.
Pubblicazione: (2025)
di: Malato, Federico, et al.
Pubblicazione: (2025)
Zero-shot Imitation Policy via Search in Demonstration Dataset
di: Malato, Federco, et al.
Pubblicazione: (2024)
di: Malato, Federco, et al.
Pubblicazione: (2024)
DIDA: Denoised Imitation Learning based on Domain Adaptation
di: Huang, Kaichen, et al.
Pubblicazione: (2024)
di: Huang, Kaichen, et al.
Pubblicazione: (2024)
Blending Imitation and Reinforcement Learning for Robust Policy Improvement
di: Liu, Xuefeng, et al.
Pubblicazione: (2023)
di: Liu, Xuefeng, et al.
Pubblicazione: (2023)
OLLIE: Imitation Learning from Offline Pretraining to Online Finetuning
di: Yue, Sheng, et al.
Pubblicazione: (2024)
di: Yue, Sheng, et al.
Pubblicazione: (2024)
AdaFlow: Imitation Learning with Variance-Adaptive Flow-Based Policies
di: Hu, Xixi, et al.
Pubblicazione: (2024)
di: Hu, Xixi, et al.
Pubblicazione: (2024)
Enabling Off-Policy Imitation Learning with Deep Actor Critic Stabilization
di: Sen, Sayambhu, et al.
Pubblicazione: (2025)
di: Sen, Sayambhu, et al.
Pubblicazione: (2025)
Coupled Distributional Random Expert Distillation for World Model Online Imitation Learning
di: Li, Shangzhe, et al.
Pubblicazione: (2025)
di: Li, Shangzhe, et al.
Pubblicazione: (2025)
Scaling Combinatorial Optimization Neural Improvement Heuristics with Online Search and Adaptation
di: Verdù, Federico Julian Camerota, et al.
Pubblicazione: (2024)
di: Verdù, Federico Julian Camerota, et al.
Pubblicazione: (2024)
Shortcut Learning in Binary Classifier Black Boxes: Applications to Voice Anti-Spoofing and Biometrics
di: Sahidullah, Md, et al.
Pubblicazione: (2026)
di: Sahidullah, Md, et al.
Pubblicazione: (2026)
Diverse Policies Recovering via Pointwise Mutual Information Weighted Imitation Learning
di: Yang, Hanlin, et al.
Pubblicazione: (2024)
di: Yang, Hanlin, et al.
Pubblicazione: (2024)
Contextualized Policy Recovery: Modeling and Interpreting Medical Decisions with Adaptive Imitation Learning
di: Deuschel, Jannik, et al.
Pubblicazione: (2023)
di: Deuschel, Jannik, et al.
Pubblicazione: (2023)
COSBO: Conservative Offline Simulation-Based Policy Optimization
di: Kargar, Eshagh, et al.
Pubblicazione: (2024)
di: Kargar, Eshagh, et al.
Pubblicazione: (2024)
Towards Generalisable Imitation Learning Through Conditioned Transition Estimation and Online Behaviour Alignment
di: Gavenski, Nathan, et al.
Pubblicazione: (2026)
di: Gavenski, Nathan, et al.
Pubblicazione: (2026)
Off-Dynamics Reinforcement Learning via Domain Adaptation and Reward Augmented Imitation
di: Guo, Yihong, et al.
Pubblicazione: (2024)
di: Guo, Yihong, et al.
Pubblicazione: (2024)
COIN: Chance-Constrained Imitation Learning for Uncertainty-aware Adaptive Resource Oversubscription Policy
di: Wang, Lu, et al.
Pubblicazione: (2024)
di: Wang, Lu, et al.
Pubblicazione: (2024)
SafeMIL: Learning Offline Safe Imitation Policy from Non-Preferred Trajectories
di: Burnwal, Returaj, et al.
Pubblicazione: (2025)
di: Burnwal, Returaj, et al.
Pubblicazione: (2025)
Symbolic Imitation Learning: From Black-Box to Explainable Driving Policies
di: Sharifi, Iman, et al.
Pubblicazione: (2023)
di: Sharifi, Iman, et al.
Pubblicazione: (2023)
OSIL: Learning Offline Safe Imitation Policies with Safety Inferred from Non-preferred Trajectories
di: Burnwal, Returaj, et al.
Pubblicazione: (2026)
di: Burnwal, Returaj, et al.
Pubblicazione: (2026)
Asymmetric On-Policy Distillation: Bridging Exploitation and Imitation at the Token Level
di: Jia, Nan, et al.
Pubblicazione: (2026)
di: Jia, Nan, et al.
Pubblicazione: (2026)
Flow-Based Policy for Online Reinforcement Learning
di: Lv, Lei, et al.
Pubblicazione: (2025)
di: Lv, Lei, et al.
Pubblicazione: (2025)
Imitation Bootstrapped Reinforcement Learning
di: Hu, Hengyuan, et al.
Pubblicazione: (2023)
di: Hu, Hengyuan, et al.
Pubblicazione: (2023)
Quantifying Generalisation in Imitation Learning
di: Gavenski, Nathan, et al.
Pubblicazione: (2025)
di: Gavenski, Nathan, et al.
Pubblicazione: (2025)
Learning to Learn-at-Test-Time: Language Agents with Learnable Adaptation Policies
di: Lou, Zhanzhi, et al.
Pubblicazione: (2026)
di: Lou, Zhanzhi, et al.
Pubblicazione: (2026)
Low-Rank Adaptation for Critic Learning in Off-Policy Reinforcement Learning
di: Zhuang, Yuan, et al.
Pubblicazione: (2026)
di: Zhuang, Yuan, et al.
Pubblicazione: (2026)
A Note on Hybrid Online Reinforcement and Imitation Learning for LLMs: Formulations and Algorithms
di: Li, Yingru, et al.
Pubblicazione: (2025)
di: Li, Yingru, et al.
Pubblicazione: (2025)
Adversarial Imitation Learning via Boosting
di: Chang, Jonathan D., et al.
Pubblicazione: (2024)
di: Chang, Jonathan D., et al.
Pubblicazione: (2024)
Denoising-based Contractive Imitation Learning
di: Shen, Macheng, et al.
Pubblicazione: (2025)
di: Shen, Macheng, et al.
Pubblicazione: (2025)
Noise-Guided Transport for Imitation Learning
di: Blondé, Lionel, et al.
Pubblicazione: (2025)
di: Blondé, Lionel, et al.
Pubblicazione: (2025)
Imitation Learning via Focused Satisficing
di: Shah, Rushit N., et al.
Pubblicazione: (2025)
di: Shah, Rushit N., et al.
Pubblicazione: (2025)
Sample-efficient Adversarial Imitation Learning
di: Jung, Dahuin, et al.
Pubblicazione: (2023)
di: Jung, Dahuin, et al.
Pubblicazione: (2023)
Boolean Satisfiability via Imitation Learning
di: Zhang, Zewei, et al.
Pubblicazione: (2025)
di: Zhang, Zewei, et al.
Pubblicazione: (2025)
Imitation Learning as Return Distribution Matching
di: Lazzati, Filippo, et al.
Pubblicazione: (2025)
di: Lazzati, Filippo, et al.
Pubblicazione: (2025)
Debiased Offline Representation Learning for Fast Online Adaptation in Non-stationary Dynamics
di: Zhang, Xinyu, et al.
Pubblicazione: (2024)
di: Zhang, Xinyu, et al.
Pubblicazione: (2024)
Imitation from Diverse Behaviors: Wasserstein Quality Diversity Imitation Learning with Single-Step Archive Exploration
di: Yu, Xingrui, et al.
Pubblicazione: (2024)
di: Yu, Xingrui, et al.
Pubblicazione: (2024)
Semi-Supervised One-Shot Imitation Learning
di: Wu, Philipp, et al.
Pubblicazione: (2024)
di: Wu, Philipp, et al.
Pubblicazione: (2024)
Imitating Cost-Constrained Behaviors in Reinforcement Learning
di: Shao, Qian, et al.
Pubblicazione: (2024)
di: Shao, Qian, et al.
Pubblicazione: (2024)
Reinforcement Learning via Implicit Imitation Guidance
di: Dong, Perry, et al.
Pubblicazione: (2025)
di: Dong, Perry, et al.
Pubblicazione: (2025)
Confounded Causal Imitation Learning with Instrumental Variables
di: Zeng, Yan, et al.
Pubblicazione: (2025)
di: Zeng, Yan, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Search-Based Adversarial Estimates for Improving Sample Efficiency in Off-Policy Reinforcement Learning
di: Malato, Federico, et al.
Pubblicazione: (2025) -
Zero-shot World Models via Search in Memory
di: Malato, Federico, et al.
Pubblicazione: (2025) -
Zero-shot Imitation Policy via Search in Demonstration Dataset
di: Malato, Federco, et al.
Pubblicazione: (2024) -
DIDA: Denoised Imitation Learning based on Domain Adaptation
di: Huang, Kaichen, et al.
Pubblicazione: (2024) -
Blending Imitation and Reinforcement Learning for Robust Policy Improvement
di: Liu, Xuefeng, et al.
Pubblicazione: (2023)