Imitation Learning from a Single Temporally Misaligned Video
Fuente:
arXiv
Guardado en:
| Autores principales: | Huey, William, Wang, Huaxiaoyue, Wu, Anne, Artzi, Yoav, Choudhury, Sanjiban |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Accelerating Inverse Reinforcement Learning with Expert Bootstrapping
por: Wu, David, et al.
Publicado: (2024)
por: Wu, David, et al.
Publicado: (2024)
Process Reward Models for LLM Agents: Practical Framework and Directions
por: Choudhury, Sanjiban
Publicado: (2025)
por: Choudhury, Sanjiban
Publicado: (2025)
Aligning LLMs with Domain Invariant Reward Models
por: Wu, David, et al.
Publicado: (2025)
por: Wu, David, et al.
Publicado: (2025)
Efficient Imitation under Misspecification
por: Espinosa-Dice, Nicolas, et al.
Publicado: (2025)
por: Espinosa-Dice, Nicolas, et al.
Publicado: (2025)
A Surprising Failure? Multimodal LLMs and the NLVR Challenge
por: Wu, Anne, et al.
Publicado: (2024)
por: Wu, Anne, et al.
Publicado: (2024)
Imitation Learning via Focused Satisficing
por: Shah, Rushit N., et al.
Publicado: (2025)
por: Shah, Rushit N., et al.
Publicado: (2025)
Motion Tracks: A Unified Representation for Human-Robot Transfer in Few-Shot Imitation Learning
por: Ren, Juntao, et al.
Publicado: (2025)
por: Ren, Juntao, et al.
Publicado: (2025)
Better than Your Teacher: LLM Agents that learn from Privileged AI Feedback
por: Choudhury, Sanjiban, et al.
Publicado: (2024)
por: Choudhury, Sanjiban, et al.
Publicado: (2024)
No Mean Feat: Simple, Strong Baselines for Context Compression
por: Feldman, Yair, et al.
Publicado: (2025)
por: Feldman, Yair, et al.
Publicado: (2025)
One-Shot Imitation under Mismatched Execution
por: Kedia, Kushal, et al.
Publicado: (2024)
por: Kedia, Kushal, et al.
Publicado: (2024)
CoGen: Learning from Feedback with Coupled Comprehension and Generation
por: Gul, Mustafa Omer, et al.
Publicado: (2024)
por: Gul, Mustafa Omer, et al.
Publicado: (2024)
Knot So Simple: A Minimalistic Environment for Spatial Reasoning
por: Chen, Zizhao, et al.
Publicado: (2025)
por: Chen, Zizhao, et al.
Publicado: (2025)
Inverse Reinforcement Learning without Reinforcement Learning
por: Swamy, Gokul, et al.
Publicado: (2023)
por: Swamy, Gokul, et al.
Publicado: (2023)
A Smooth Sea Never Made a Skilled SAILOR: Robust Imitation via Learning to Search
por: Jain, Arnav Kumar, et al.
Publicado: (2025)
por: Jain, Arnav Kumar, et al.
Publicado: (2025)
Talk Less, Interact Better: Evaluating In-context Conversational Adaptation in Multimodal LLMs
por: Hua, Yilun, et al.
Publicado: (2024)
por: Hua, Yilun, et al.
Publicado: (2024)
Post-training for Efficient Communication via Convention Formation
por: Hua, Yilun, et al.
Publicado: (2025)
por: Hua, Yilun, et al.
Publicado: (2025)
The Virtues of Pessimism in Inverse Reinforcement Learning
por: Wu, David, et al.
Publicado: (2024)
por: Wu, David, et al.
Publicado: (2024)
Retrospective Learning from Interactions
por: Chen, Zizhao, et al.
Publicado: (2024)
por: Chen, Zizhao, et al.
Publicado: (2024)
Distilling Realizable Students from Unrealizable Teachers
por: Kim, Yujin, et al.
Publicado: (2025)
por: Kim, Yujin, et al.
Publicado: (2025)
All Roads Lead to Likelihood: The Value of Reinforcement Learning in Fine-Tuning
por: Swamy, Gokul, et al.
Publicado: (2025)
por: Swamy, Gokul, et al.
Publicado: (2025)
Hybrid Inverse Reinforcement Learning
por: Ren, Juntao, et al.
Publicado: (2024)
por: Ren, Juntao, et al.
Publicado: (2024)
SteP: Stacked LLM Policies for Web Actions
por: Sodhi, Paloma, et al.
Publicado: (2023)
por: Sodhi, Paloma, et al.
Publicado: (2023)
LLMs Are In-Context Bandit Reinforcement Learners
por: Monea, Giovanni, et al.
Publicado: (2024)
por: Monea, Giovanni, et al.
Publicado: (2024)
InteRACT: Transformer Models for Human Intent Prediction Conditioned on Robot Actions
por: Kedia, Kushal, et al.
Publicado: (2023)
por: Kedia, Kushal, et al.
Publicado: (2023)
Non-Adversarial Inverse Reinforcement Learning via Successor Feature Matching
por: Jain, Arnav Kumar, et al.
Publicado: (2024)
por: Jain, Arnav Kumar, et al.
Publicado: (2024)
Multi-Turn Code Generation Through Single-Step Rewards
por: Jain, Arnav Kumar, et al.
Publicado: (2025)
por: Jain, Arnav Kumar, et al.
Publicado: (2025)
PAGAR: Taming Reward Misalignment in Inverse Reinforcement Learning-Based Imitation Learning with Protagonist Antagonist Guided Adversarial Reward
por: Zhou, Weichao, et al.
Publicado: (2023)
por: Zhou, Weichao, et al.
Publicado: (2023)
IncDSI: Incrementally Updatable Document Retrieval
por: Kishore, Varsha, et al.
Publicado: (2023)
por: Kishore, Varsha, et al.
Publicado: (2023)
STAIR: Addressing Stage Misalignment through Temporal-Aligned Preference Reinforcement Learning
por: Luan, Yao, et al.
Publicado: (2025)
por: Luan, Yao, et al.
Publicado: (2025)
TARDIS: Mitigating Temporal Misalignment via Representation Steering
por: Shin, Changho, et al.
Publicado: (2025)
por: Shin, Changho, et al.
Publicado: (2025)
Temporal Misalignment Attacks against Multimodal Perception in Autonomous Driving
por: Shahriar, Md Hasan, et al.
Publicado: (2025)
por: Shahriar, Md Hasan, et al.
Publicado: (2025)
Expert Proximity as Surrogate Rewards for Single Demonstration Imitation Learning
por: Chiang, Chia-Cheng, et al.
Publicado: (2024)
por: Chiang, Chia-Cheng, et al.
Publicado: (2024)
Imitation from Diverse Behaviors: Wasserstein Quality Diversity Imitation Learning with Single-Step Archive Exploration
por: Yu, Xingrui, et al.
Publicado: (2024)
por: Yu, Xingrui, et al.
Publicado: (2024)
Scaling Laws for Imitation Learning in Single-Agent Games
por: Tuyls, Jens, et al.
Publicado: (2023)
por: Tuyls, Jens, et al.
Publicado: (2023)
Imitation Learning from Purified Demonstrations
por: Wang, Yunke, et al.
Publicado: (2023)
por: Wang, Yunke, et al.
Publicado: (2023)
X-Sim: Cross-Embodiment Learning via Real-to-Sim-to-Real
por: Dan, Prithwish, et al.
Publicado: (2025)
por: Dan, Prithwish, et al.
Publicado: (2025)
PRISM: Performer RS-IMLE for Single-pass Multisensory Imitation Learning
por: Bhaskar, Amisha, et al.
Publicado: (2026)
por: Bhaskar, Amisha, et al.
Publicado: (2026)
Learning Representations in Video Game Agents with Supervised Contrastive Imitation Learning
por: Celemin, Carlos, et al.
Publicado: (2025)
por: Celemin, Carlos, et al.
Publicado: (2025)
Visually Robust Adversarial Imitation Learning from Videos with Contrastive Learning
por: Giammarino, Vittorio, et al.
Publicado: (2024)
por: Giammarino, Vittorio, et al.
Publicado: (2024)
Efficient Imitation Learning with Conservative World Models
por: Kolev, Victor, et al.
Publicado: (2024)
por: Kolev, Victor, et al.
Publicado: (2024)
Ejemplares similares
-
Accelerating Inverse Reinforcement Learning with Expert Bootstrapping
por: Wu, David, et al.
Publicado: (2024) -
Process Reward Models for LLM Agents: Practical Framework and Directions
por: Choudhury, Sanjiban
Publicado: (2025) -
Aligning LLMs with Domain Invariant Reward Models
por: Wu, David, et al.
Publicado: (2025) -
Efficient Imitation under Misspecification
por: Espinosa-Dice, Nicolas, et al.
Publicado: (2025) -
A Surprising Failure? Multimodal LLMs and the NLVR Challenge
por: Wu, Anne, et al.
Publicado: (2024)