Zero-shot Imitation Policy via Search in Demonstration Dataset
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Malato, Federco, Leopold, Florian, Melnik, Andrew, Hautamaki, Ville |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Online Adaptation for Enhancing Imitation Learning Policies
par: Malato, Federico, et autres
Publié: (2024)
par: Malato, Federico, et autres
Publié: (2024)
Search-Based Adversarial Estimates for Improving Sample Efficiency in Off-Policy Reinforcement Learning
par: Malato, Federico, et autres
Publié: (2025)
par: Malato, Federico, et autres
Publié: (2025)
Zero-shot World Models via Search in Memory
par: Malato, Federico, et autres
Publié: (2025)
par: Malato, Federico, et autres
Publié: (2025)
Natural Language as Policies: Reasoning for Coordinate-Level Embodied Control with LLMs
par: Mikami, Yusuke, et autres
Publié: (2024)
par: Mikami, Yusuke, et autres
Publié: (2024)
Zero-shot Imitation Learning by Latent Topology Mapping
par: Jacobson, Maxwell J., et autres
Publié: (2026)
par: Jacobson, Maxwell J., et autres
Publié: (2026)
SAIL: Faster-than-Demonstration Execution of Imitation Learning Policies
par: Arachchige, Nadun Ranawaka, et autres
Publié: (2025)
par: Arachchige, Nadun Ranawaka, et autres
Publié: (2025)
Meta-Learning Approaches for Improving Detection of Unseen Speech Deepfakes
par: Kukanov, Ivan, et autres
Publié: (2024)
par: Kukanov, Ivan, et autres
Publié: (2024)
Zero-shot cross-modal transfer of Reinforcement Learning policies through a Global Workspace
par: Maytié, Léopold, et autres
Publié: (2024)
par: Maytié, Léopold, et autres
Publié: (2024)
Imitation Learning with Precisely Labeled Human Demonstrations
par: Song, Yilong
Publié: (2025)
par: Song, Yilong
Publié: (2025)
One-shot Imitation in a Non-Stationary Environment via Multi-Modal Skill
par: Shin, Sangwoo, et autres
Publié: (2024)
par: Shin, Sangwoo, et autres
Publié: (2024)
ESPADA: Execution Speedup via Semantics Aware Demonstration Data Downsampling for Imitation Learning
par: Kim, Byung-ju, et autres
Publié: (2025)
par: Kim, Byung-ju, et autres
Publié: (2025)
Imitation Learning from Suboptimal Demonstrations via Meta-Learning An Action Ranker
par: Fan, Jiangdong, et autres
Publié: (2024)
par: Fan, Jiangdong, et autres
Publié: (2024)
UniGen: Universal Domain Generalization for Sentiment Classification via Zero-shot Dataset Generation
par: Choi, Juhwan, et autres
Publié: (2024)
par: Choi, Juhwan, et autres
Publié: (2024)
How to Leverage Diverse Demonstrations in Offline Imitation Learning
par: Yue, Sheng, et autres
Publié: (2024)
par: Yue, Sheng, et autres
Publié: (2024)
Prompt-based Visual Alignment for Zero-shot Policy Transfer
par: Gao, Haihan, et autres
Publié: (2024)
par: Gao, Haihan, et autres
Publié: (2024)
Learning to Discern: Imitating Heterogeneous Human Demonstrations with Preference and Representation Learning
par: Kuhar, Sachit, et autres
Publié: (2023)
par: Kuhar, Sachit, et autres
Publié: (2023)
SPRINQL: Sub-optimal Demonstrations driven Offline Imitation Learning
par: Hoang, Huy, et autres
Publié: (2024)
par: Hoang, Huy, et autres
Publié: (2024)
Efficient Imitation Without Demonstrations via Value-Penalized Auxiliary Control from Examples
par: Ablett, Trevor, et autres
Publié: (2024)
par: Ablett, Trevor, et autres
Publié: (2024)
Grounding Language Models with Semantic Digital Twins for Robotic Planning
par: Naeem, Mehreen, et autres
Publié: (2025)
par: Naeem, Mehreen, et autres
Publié: (2025)
Zero-shot Interactive Perception
par: Sripada, Venkatesh, et autres
Publié: (2026)
par: Sripada, Venkatesh, et autres
Publié: (2026)
Temporal Logic Imitation: Learning Plan-Satisficing Motion Policies from Demonstrations
par: Wang, Yanwei, et autres
Publié: (2022)
par: Wang, Yanwei, et autres
Publié: (2022)
Imitation Learning of Correlated Policies in Stackelberg Games
par: Wang, Kuang-Da, et autres
Publié: (2025)
par: Wang, Kuang-Da, et autres
Publié: (2025)
Self-Augmented Robot Trajectory: Efficient Imitation Learning via Safe Self-augmentation with Demonstrator-annotated Precision
par: Oh, Hanbit, et autres
Publié: (2025)
par: Oh, Hanbit, et autres
Publié: (2025)
LMAct: A Benchmark for In-Context Imitation Learning with Long Multimodal Demonstrations
par: Ruoss, Anian, et autres
Publié: (2024)
par: Ruoss, Anian, et autres
Publié: (2024)
DIRIGENt: End-To-End Robotic Imitation of Human Demonstrations Based on a Diffusion Model
par: Spisak, Josua, et autres
Publié: (2025)
par: Spisak, Josua, et autres
Publié: (2025)
ROAR: Reinforcing Original to Augmented Data Ratio Dynamics for Wav2Vec2.0 Based ASR
par: Singh, Vishwanath Pratap, et autres
Publié: (2024)
par: Singh, Vishwanath Pratap, et autres
Publié: (2024)
Hierarchical Imitation Learning of Team Behavior from Heterogeneous Demonstrations
par: Seo, Sangwon, et autres
Publié: (2025)
par: Seo, Sangwon, et autres
Publié: (2025)
Beyond-Expert Performance with Limited Demonstrations: Efficient Imitation Learning with Double Exploration
par: Zhao, Heyang, et autres
Publié: (2025)
par: Zhao, Heyang, et autres
Publié: (2025)
Mitigating Many-shot Jailbreak Attacks with One Single Demonstration
par: Chen, Kejia, et autres
Publié: (2026)
par: Chen, Kejia, et autres
Publié: (2026)
Enhancing Zero-shot Commonsense Reasoning by Integrating Visual Knowledge via Machine Imagination
par: Park, Hyuntae, et autres
Publié: (2026)
par: Park, Hyuntae, et autres
Publié: (2026)
ZeroDL: Zero-shot Distribution Learning for Text Clustering via Large Language Models
par: Jo, Hwiyeol, et autres
Publié: (2024)
par: Jo, Hwiyeol, et autres
Publié: (2024)
Improving Zero-shot Generalization of Learned Prompts via Unsupervised Knowledge Distillation
par: Mistretta, Marco, et autres
Publié: (2024)
par: Mistretta, Marco, et autres
Publié: (2024)
Closed-loop Teaching via Demonstrations to Improve Policy Transparency
par: Lee, Michael S., et autres
Publié: (2024)
par: Lee, Michael S., et autres
Publié: (2024)
STEVE-Audio: Expanding the Goal Conditioning Modalities of Embodied Agents in Minecraft
par: Lenzen, Nicholas, et autres
Publié: (2024)
par: Lenzen, Nicholas, et autres
Publié: (2024)
COSBO: Conservative Offline Simulation-Based Policy Optimization
par: Kargar, Eshagh, et autres
Publié: (2024)
par: Kargar, Eshagh, et autres
Publié: (2024)
Zero-shot Graph Reasoning via Retrieval Augmented Framework with LLMs
par: Li, Hanqing, et autres
Publié: (2025)
par: Li, Hanqing, et autres
Publié: (2025)
Robotic Manipulation by Imitating Generated Videos Without Physical Demonstrations
par: Patel, Shivansh, et autres
Publié: (2025)
par: Patel, Shivansh, et autres
Publié: (2025)
Diverse Policies Recovering via Pointwise Mutual Information Weighted Imitation Learning
par: Yang, Hanlin, et autres
Publié: (2024)
par: Yang, Hanlin, et autres
Publié: (2024)
Learning What to Do and What Not To Do: Offline Imitation from Expert and Undesirable Demonstrations
par: Hoang, Huy, et autres
Publié: (2025)
par: Hoang, Huy, et autres
Publié: (2025)
Refinement of Accelerated Demonstrations via Incremental Iterative Reference Learning Control for Fast Contact-Rich Imitation Learning
par: Yamane, Koki, et autres
Publié: (2026)
par: Yamane, Koki, et autres
Publié: (2026)
Documents similaires
-
Online Adaptation for Enhancing Imitation Learning Policies
par: Malato, Federico, et autres
Publié: (2024) -
Search-Based Adversarial Estimates for Improving Sample Efficiency in Off-Policy Reinforcement Learning
par: Malato, Federico, et autres
Publié: (2025) -
Zero-shot World Models via Search in Memory
par: Malato, Federico, et autres
Publié: (2025) -
Natural Language as Policies: Reasoning for Coordinate-Level Embodied Control with LLMs
par: Mikami, Yusuke, et autres
Publié: (2024) -
Zero-shot Imitation Learning by Latent Topology Mapping
par: Jacobson, Maxwell J., et autres
Publié: (2026)