PartInstruct: Part-level Instruction Following for Fine-grained Robot Manipulation
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Yin, Yifan, Han, Zhengtao, Aarya, Shivam, Wang, Jianxin, Xu, Shuhang, Peng, Jiawei, Wang, Angtian, Yuille, Alan, Shu, Tianmin |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Pragmatic Embodied Spoken Instruction Following in Human-Robot Collaboration with Theory of Mind
par: Ying, Lance, et autres
Publié: (2024)
par: Ying, Lance, et autres
Publié: (2024)
InstructAttribute: Fine-grained Object Attributes editing with Instruction
par: Yin, Xingxi, et autres
Publié: (2025)
par: Yin, Xingxi, et autres
Publié: (2025)
InstructPart: Task-Oriented Part Segmentation with Instruction Reasoning
par: Wan, Zifu, et autres
Publié: (2025)
par: Wan, Zifu, et autres
Publié: (2025)
VoGE: A Differentiable Volume Renderer using Gaussian Ellipsoids for Analysis-by-Synthesis
par: Wang, Angtian, et autres
Publié: (2022)
par: Wang, Angtian, et autres
Publié: (2022)
GOMA: Proactive Embodied Cooperative Communication via Goal-Oriented Mental Alignment
par: Ying, Lance, et autres
Publié: (2024)
par: Ying, Lance, et autres
Publié: (2024)
Structure-Aware Sparse-View X-ray 3D Reconstruction
par: Cai, Yuanhao, et autres
Publié: (2023)
par: Cai, Yuanhao, et autres
Publié: (2023)
From Pixel to Cancer: Cellular Automata in Computed Tomography
par: Lai, Yuxiang, et autres
Publié: (2024)
par: Lai, Yuxiang, et autres
Publié: (2024)
Generative World Explorer
par: Lu, Taiming, et autres
Publié: (2024)
par: Lu, Taiming, et autres
Publié: (2024)
Name That Part: 3D Part Segmentation and Naming
par: Paul, Soumava, et autres
Publié: (2025)
par: Paul, Soumava, et autres
Publié: (2025)
Compositional 4D Dynamic Scenes Understanding with Physics Priors for Video Question Answering
par: Wang, Xingrui, et autres
Publié: (2024)
par: Wang, Xingrui, et autres
Publié: (2024)
NOVUM: Neural Object Volumes for Robust Object Classification
par: Jesslen, Artur, et autres
Publié: (2023)
par: Jesslen, Artur, et autres
Publié: (2023)
Robotic Programmer: Video Instructed Policy Code Generation for Robotic Manipulation
par: Xie, Senwei, et autres
Publié: (2025)
par: Xie, Senwei, et autres
Publié: (2025)
Multi-modal Instruction Tuned LLMs with Fine-grained Visual Perception
par: He, Junwen, et autres
Publié: (2024)
par: He, Junwen, et autres
Publié: (2024)
Learning a Category-level Object Pose Estimator without Pose Annotations
par: Tian, Fengrui, et autres
Publié: (2024)
par: Tian, Fengrui, et autres
Publié: (2024)
InstructVLA: Vision-Language-Action Instruction Tuning from Understanding to Manipulation
par: Yang, Shuai, et autres
Publié: (2025)
par: Yang, Shuai, et autres
Publié: (2025)
From Pixels to Objects: A Hierarchical Approach for Part and Object Segmentation Using Local and Global Aggregation
par: Xie, Yunfei, et autres
Publié: (2024)
par: Xie, Yunfei, et autres
Publié: (2024)
Radiative Gaussian Splatting for Efficient X-ray Novel View Synthesis
par: Cai, Yuanhao, et autres
Publié: (2024)
par: Cai, Yuanhao, et autres
Publié: (2024)
HECTOR: Hybrid Editable Compositional Object References for Video Generation
par: Zhang, Guofeng, et autres
Publié: (2026)
par: Zhang, Guofeng, et autres
Publié: (2026)
Learning to Instruct for Visual Instruction Tuning
par: Zhou, Zhihan, et autres
Publié: (2025)
par: Zhou, Zhihan, et autres
Publié: (2025)
Instruct2Act: From Human Instruction to Actions Sequencing and Execution via Robot Action Network for Robotic Manipulation
par: Sharma, Archit, et autres
Publié: (2026)
par: Sharma, Archit, et autres
Publié: (2026)
FREAK: A Fine-grained Hallucination Evaluation Benchmark for Advanced MLLMs
par: Yin, Zhihan, et autres
Publié: (2026)
par: Yin, Zhihan, et autres
Publié: (2026)
VIP: Vision Instructed Pre-training for Robotic Manipulation
par: Li, Zhuoling, et autres
Publié: (2024)
par: Li, Zhuoling, et autres
Publié: (2024)
ArgInstruct: Specialized Instruction Fine-Tuning for Computational Argumentation
par: Stahl, Maja, et autres
Publié: (2025)
par: Stahl, Maja, et autres
Publié: (2025)
GhostObjects: Instructing Robots by Manipulating Spatially Aligned Virtual Twins in Augmented Reality
par: Wang, Lauren W., et autres
Publié: (2025)
par: Wang, Lauren W., et autres
Publié: (2025)
CoFineLLM: Conformal Finetuning of LLMs for Language-Instructed Robot Planning
par: Wang, Jun, et autres
Publié: (2025)
par: Wang, Jun, et autres
Publié: (2025)
CoVis: A Collaborative Framework for Fine-grained Graphic Visual Understanding
par: Deng, Xiaoyu, et autres
Publié: (2024)
par: Deng, Xiaoyu, et autres
Publié: (2024)
InstructIR: High-Quality Image Restoration Following Human Instructions
par: Conde, Marcos V., et autres
Publié: (2024)
par: Conde, Marcos V., et autres
Publié: (2024)
LexInstructEval: Lexical Instruction Following Evaluation for Large Language Models
par: Ren, Huimin, et autres
Publié: (2025)
par: Ren, Huimin, et autres
Publié: (2025)
LychSim: A Controllable and Interactive Simulation Framework for Vision Research
par: Ma, Wufei, et autres
Publié: (2026)
par: Ma, Wufei, et autres
Publié: (2026)
T2I-VeRW: Part-level Fine-grained Perception for Text-to-Image Vehicle Retrieval
par: Wang, Xiao, et autres
Publié: (2026)
par: Wang, Xiao, et autres
Publié: (2026)
GenEx: Generating an Explorable World
par: Lu, Taiming, et autres
Publié: (2024)
par: Lu, Taiming, et autres
Publié: (2024)
CoPa: General Robotic Manipulation through Spatial Constraints of Parts with Foundation Models
par: Huang, Haoxu, et autres
Publié: (2024)
par: Huang, Haoxu, et autres
Publié: (2024)
iNeMo: Incremental Neural Mesh Models for Robust Class-Incremental Learning
par: Fischer, Tom, et autres
Publié: (2024)
par: Fischer, Tom, et autres
Publié: (2024)
ATI: Any Trajectory Instruction for Controllable Video Generation
par: Wang, Angtian, et autres
Publié: (2025)
par: Wang, Angtian, et autres
Publié: (2025)
Ada-Instruct: Adapting Instruction Generators for Complex Reasoning
par: Cui, Wanyun, et autres
Publié: (2023)
par: Cui, Wanyun, et autres
Publié: (2023)
InstructRetro: Instruction Tuning post Retrieval-Augmented Pretraining
par: Wang, Boxin, et autres
Publié: (2023)
par: Wang, Boxin, et autres
Publié: (2023)
Speckle Skin‐Based Multimodal Tactile Perception for Fine Robotic Manipulation
par: Jiayuan Zhang, et autres
Publié: (2026)
par: Jiayuan Zhang, et autres
Publié: (2026)
InstructAV: Instruction Fine-tuning Large Language Models for Authorship Verification
par: Hu, Yujia, et autres
Publié: (2024)
par: Hu, Yujia, et autres
Publié: (2024)
InstructTTSEval: Benchmarking Complex Natural-Language Instruction Following in Text-to-Speech Systems
par: Huang, Kexin, et autres
Publié: (2025)
par: Huang, Kexin, et autres
Publié: (2025)
InstructAny2Pix: Flexible Visual Editing via Multimodal Instruction Following
par: Li, Shufan, et autres
Publié: (2023)
par: Li, Shufan, et autres
Publié: (2023)
Documents similaires
-
Pragmatic Embodied Spoken Instruction Following in Human-Robot Collaboration with Theory of Mind
par: Ying, Lance, et autres
Publié: (2024) -
InstructAttribute: Fine-grained Object Attributes editing with Instruction
par: Yin, Xingxi, et autres
Publié: (2025) -
InstructPart: Task-Oriented Part Segmentation with Instruction Reasoning
par: Wan, Zifu, et autres
Publié: (2025) -
VoGE: A Differentiable Volume Renderer using Gaussian Ellipsoids for Analysis-by-Synthesis
par: Wang, Angtian, et autres
Publié: (2022) -
GOMA: Proactive Embodied Cooperative Communication via Goal-Oriented Mental Alignment
par: Ying, Lance, et autres
Publié: (2024)