MotIF: Motion Instruction Fine-tuning
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Hwang, Minyoung, Hejna, Joey, Sadigh, Dorsa, Bisk, Yonatan |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
ANAVI: Audio Noise Awareness using Visuals of Indoor environments for NAVIgation
par: Jain, Vidhi, et autres
Publié: (2024)
par: Jain, Vidhi, et autres
Publié: (2024)
Efficiently Generating Expressive Quadruped Behaviors via Language-Guided Preference Learning
par: Clark, Jaden, et autres
Publié: (2025)
par: Clark, Jaden, et autres
Publié: (2025)
Data Retrieval with Importance Weights for Few-Shot Imitation Learning
par: Xie, Amber, et autres
Publié: (2025)
par: Xie, Amber, et autres
Publié: (2025)
What's the Move? Hybrid Imitation Learning via Salient Points
par: Sundaresan, Priya, et autres
Publié: (2024)
par: Sundaresan, Priya, et autres
Publié: (2024)
Physically Grounded Vision-Language Models for Robotic Manipulation
par: Gao, Jensen, et autres
Publié: (2023)
par: Gao, Jensen, et autres
Publié: (2023)
Explore until Confident: Efficient Exploration for Embodied Question Answering
par: Ren, Allen Z., et autres
Publié: (2024)
par: Ren, Allen Z., et autres
Publié: (2024)
RAVEN: Resilient Aerial Navigation via Open-Set Semantic Memory and Behavior Adaptation
par: Kim, Seungchan, et autres
Publié: (2025)
par: Kim, Seungchan, et autres
Publié: (2025)
Forecast-PEFT: Parameter-Efficient Fine-Tuning for Pre-trained Motion Forecasting Models
par: Wang, Jifeng, et autres
Publié: (2024)
par: Wang, Jifeng, et autres
Publié: (2024)
RT-Affordance: Affordances are Versatile Intermediate Representations for Robot Manipulation
par: Nasiriany, Soroush, et autres
Publié: (2024)
par: Nasiriany, Soroush, et autres
Publié: (2024)
Unified Video Action Model
par: Li, Shuang, et autres
Publié: (2025)
par: Li, Shuang, et autres
Publié: (2025)
Phoenix: A Motion-based Self-Reflection Framework for Fine-grained Robotic Action Correction
par: Xia, Wenke, et autres
Publié: (2025)
par: Xia, Wenke, et autres
Publié: (2025)
WAM-Flow: Parallel Coarse-to-Fine Motion Planning via Discrete Flow Matching for Autonomous Driving
par: Xu, Yifang, et autres
Publié: (2025)
par: Xu, Yifang, et autres
Publié: (2025)
Motion Generation from Fine-grained Textual Descriptions
par: Li, Kunhang, et autres
Publié: (2024)
par: Li, Kunhang, et autres
Publié: (2024)
Cross-Modal Instructions for Robot Motion Generation
par: Barron, William, et autres
Publié: (2025)
par: Barron, William, et autres
Publié: (2025)
RobotArena $\infty$: Scalable Robot Benchmarking via Real-to-Sim Translation
par: Jangir, Yash, et autres
Publié: (2025)
par: Jangir, Yash, et autres
Publié: (2025)
HomeRobot: Open-Vocabulary Mobile Manipulation
par: Yenamandra, Sriram, et autres
Publié: (2023)
par: Yenamandra, Sriram, et autres
Publié: (2023)
So You Think You Can Scale Up Autonomous Robot Data Collection?
par: Mirchandani, Suvir, et autres
Publié: (2024)
par: Mirchandani, Suvir, et autres
Publié: (2024)
RetroMotion: Retrocausal Motion Forecasting Models are Instructable
par: Wagner, Royden, et autres
Publié: (2025)
par: Wagner, Royden, et autres
Publié: (2025)
Robotic Visual Instruction
par: Li, Yanbang, et autres
Publié: (2025)
par: Li, Yanbang, et autres
Publié: (2025)
Affordance RAG: Hierarchical Multimodal Retrieval with Affordance-Aware Embodied Memory for Mobile Manipulation
par: Korekata, Ryosuke, et autres
Publié: (2025)
par: Korekata, Ryosuke, et autres
Publié: (2025)
REM: Evaluating LLM Embodied Spatial Reasoning through Multi-Frame Trajectories
par: Thompson, Jacob, et autres
Publié: (2025)
par: Thompson, Jacob, et autres
Publié: (2025)
Open-World Motion Forecasting
par: Schischka, Nicolas, et autres
Publié: (2026)
par: Schischka, Nicolas, et autres
Publié: (2026)
PhyGile: Physics-Prefix Guided Motion Generation for Agile General Humanoid Motion Tracking
par: Bao, Jiacheng, et autres
Publié: (2026)
par: Bao, Jiacheng, et autres
Publié: (2026)
KDMOS:Knowledge Distillation for Motion Segmentation
par: Cao, Chunyu, et autres
Publié: (2025)
par: Cao, Chunyu, et autres
Publié: (2025)
Vega: Learning to Drive with Natural Language Instructions
par: Zuo, Sicheng, et autres
Publié: (2026)
par: Zuo, Sicheng, et autres
Publié: (2026)
Visual SLAMMOT Considering Multiple Motion Models
par: Tian, Peilin, et autres
Publié: (2024)
par: Tian, Peilin, et autres
Publié: (2024)
Large Trajectory Models are Scalable Motion Predictors and Planners
par: Sun, Qiao, et autres
Publié: (2023)
par: Sun, Qiao, et autres
Publié: (2023)
KI-PMF: Knowledge Integrated Plausible Motion Forecasting
par: Vivekanandan, Abhishek, et autres
Publié: (2023)
par: Vivekanandan, Abhishek, et autres
Publié: (2023)
Chain of World: World Model Thinking in Latent Motion
par: Yang, Fuxiang, et autres
Publié: (2026)
par: Yang, Fuxiang, et autres
Publié: (2026)
VISREAS: Complex Visual Reasoning with Unanswerable Questions
par: Akter, Syeda Nahida, et autres
Publié: (2024)
par: Akter, Syeda Nahida, et autres
Publié: (2024)
RAP: Retrieval-Augmented Planner for Adaptive Procedure Planning in Instructional Videos
par: Zare, Ali, et autres
Publié: (2024)
par: Zare, Ali, et autres
Publié: (2024)
LIAM: Multimodal Transformer for Language Instructions, Images, Actions and Semantic Maps
par: Wang, Yihao, et autres
Publié: (2025)
par: Wang, Yihao, et autres
Publié: (2025)
Grounding 3D Object Affordance with Language Instructions, Visual Observations and Interactions
par: Zhu, He, et autres
Publié: (2025)
par: Zhu, He, et autres
Publié: (2025)
MPVO: Motion-Prior based Visual Odometry for PointGoal Navigation
par: Paul, Sayan, et autres
Publié: (2024)
par: Paul, Sayan, et autres
Publié: (2024)
Flow-guided Motion Prediction with Semantics and Dynamic Occupancy Grid Maps
par: Asghar, Rabbia, et autres
Publié: (2024)
par: Asghar, Rabbia, et autres
Publié: (2024)
Navigating Motion Agents in Dynamic and Cluttered Environments through LLM Reasoning
par: Zhao, Yubo, et autres
Publié: (2025)
par: Zhao, Yubo, et autres
Publié: (2025)
Long-term Traffic Simulation with Interleaved Autoregressive Motion and Scenario Generation
par: Yang, Xiuyu, et autres
Publié: (2025)
par: Yang, Xiuyu, et autres
Publié: (2025)
IRASim: A Fine-Grained World Model for Robot Manipulation
par: Zhu, Fangqi, et autres
Publié: (2024)
par: Zhu, Fangqi, et autres
Publié: (2024)
RoomTour3D: Geometry-Aware Video-Instruction Tuning for Embodied Navigation
par: Han, Mingfei, et autres
Publié: (2024)
par: Han, Mingfei, et autres
Publié: (2024)
SmartPretrain: Model-Agnostic and Dataset-Agnostic Representation Learning for Motion Prediction
par: Zhou, Yang, et autres
Publié: (2024)
par: Zhou, Yang, et autres
Publié: (2024)
Documents similaires
-
ANAVI: Audio Noise Awareness using Visuals of Indoor environments for NAVIgation
par: Jain, Vidhi, et autres
Publié: (2024) -
Efficiently Generating Expressive Quadruped Behaviors via Language-Guided Preference Learning
par: Clark, Jaden, et autres
Publié: (2025) -
Data Retrieval with Importance Weights for Few-Shot Imitation Learning
par: Xie, Amber, et autres
Publié: (2025) -
What's the Move? Hybrid Imitation Learning via Salient Points
par: Sundaresan, Priya, et autres
Publié: (2024) -
Physically Grounded Vision-Language Models for Robotic Manipulation
par: Gao, Jensen, et autres
Publié: (2023)