UniDiffGrasp: A Unified Framework Integrating VLM Reasoning and VLM-Guided Part Diffusion for Open-Vocabulary Constrained Grasping with Dual Arms
Fuente:
arXiv
Salvato in:
| Autori principali: | Guo, Xueyang, Hu, Hongwei, Song, Chengye, Chen, Jiale, Zhao, Zilin, Fu, Yu, Guan, Bowen, Liu, Zhenze |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Open-Vocabulary Part-Based Grasping
di: van Oort, Tjeard, et al.
Pubblicazione: (2024)
di: van Oort, Tjeard, et al.
Pubblicazione: (2024)
AffordGrasp: In-Context Affordance Reasoning for Open-Vocabulary Task-Oriented Grasping in Clutter
di: Tang, Yingbo, et al.
Pubblicazione: (2025)
di: Tang, Yingbo, et al.
Pubblicazione: (2025)
Viewpoint-Agnostic Grasp Pipeline using VLM and Partial Observations
di: Almeida, Dilermando, et al.
Pubblicazione: (2026)
di: Almeida, Dilermando, et al.
Pubblicazione: (2026)
OVAL-Grasp: Open-Vocabulary Affordance Localization for Task Oriented Grasping
di: Tong, Edmond, et al.
Pubblicazione: (2025)
di: Tong, Edmond, et al.
Pubblicazione: (2025)
DAGDiff: Guiding Dual-Arm Grasp Diffusion to Stable and Collision-Free Grasps
di: Karim, Md Faizal, et al.
Pubblicazione: (2025)
di: Karim, Md Faizal, et al.
Pubblicazione: (2025)
GLOVER: Generalizable Open-Vocabulary Affordance Reasoning for Task-Oriented Grasping
di: Ma, Teli, et al.
Pubblicazione: (2024)
di: Ma, Teli, et al.
Pubblicazione: (2024)
OVGNet: A Unified Visual-Linguistic Framework for Open-Vocabulary Robotic Grasping
di: Meng, Li, et al.
Pubblicazione: (2024)
di: Meng, Li, et al.
Pubblicazione: (2024)
UniMorphGrasp: Diffusion Model with Morphology-Awareness for Cross-Embodiment Dexterous Grasp Generation
di: Wu, Zhiyuan, et al.
Pubblicazione: (2026)
di: Wu, Zhiyuan, et al.
Pubblicazione: (2026)
Exploiting VLM Localizability and Semantics for Open Vocabulary Action Detection
di: Bao, Wentao, et al.
Pubblicazione: (2024)
di: Bao, Wentao, et al.
Pubblicazione: (2024)
Unleashing the Multi-View Fusion Potential: Noise Correction in VLM for Open-Vocabulary 3D Scene Understanding
di: Yin, Xingyilang, et al.
Pubblicazione: (2025)
di: Yin, Xingyilang, et al.
Pubblicazione: (2025)
DUET-VLM: Dual stage Unified Efficient Token reduction for VLM Training and Inference
di: Singh, Aditya Kumar, et al.
Pubblicazione: (2026)
di: Singh, Aditya Kumar, et al.
Pubblicazione: (2026)
UniFucGrasp: Human-Hand-Inspired Unified Functional Grasp Annotation Strategy and Dataset for Diverse Dexterous Hands
di: Lin, Haoran, et al.
Pubblicazione: (2025)
di: Lin, Haoran, et al.
Pubblicazione: (2025)
UniGraspTransformer: Simplified Policy Distillation for Scalable Dexterous Robotic Grasping
di: Wang, Wenbo, et al.
Pubblicazione: (2024)
di: Wang, Wenbo, et al.
Pubblicazione: (2024)
Reflective VLM Planning for Dual-Arm Desktop Cleaning: Bridging Open-Vocabulary Perception and Precise Manipulation
di: Liu, Yufan, et al.
Pubblicazione: (2025)
di: Liu, Yufan, et al.
Pubblicazione: (2025)
OVGrasp: Open-Vocabulary Grasping Assistance via Multimodal Intent Detection
di: Hu, Chen, et al.
Pubblicazione: (2025)
di: Hu, Chen, et al.
Pubblicazione: (2025)
Using VLM Reasoning to Constrain Task and Motion Planning
di: Yan, Muyang, et al.
Pubblicazione: (2025)
di: Yan, Muyang, et al.
Pubblicazione: (2025)
Leveraging Extrinsic Dexterity for Occluded Grasping on Grasp Constraining Walls
di: Kobashi, Keita, et al.
Pubblicazione: (2025)
di: Kobashi, Keita, et al.
Pubblicazione: (2025)
Fast-dVLM: Efficient Block-Diffusion VLM via Direct Conversion from Autoregressive VLM
di: Wu, Chengyue, et al.
Pubblicazione: (2026)
di: Wu, Chengyue, et al.
Pubblicazione: (2026)
FastGrasp: Efficient Grasp Synthesis with Diffusion
di: Wu, Xiaofei, et al.
Pubblicazione: (2024)
di: Wu, Xiaofei, et al.
Pubblicazione: (2024)
VLM-SFD: VLM-Assisted Siamese Flow Diffusion Framework for Dual-Arm Cooperative Manipulation
di: Chen, Jiaming, et al.
Pubblicazione: (2025)
di: Chen, Jiaming, et al.
Pubblicazione: (2025)
DexGrasp-Diffusion: Diffusion-based Unified Functional Grasp Synthesis Method for Multi-Dexterous Robotic Hands
di: Zhang, Zhengshen, et al.
Pubblicazione: (2024)
di: Zhang, Zhengshen, et al.
Pubblicazione: (2024)
HGDiffuser: Efficient Task-Oriented Grasp Generation via Human-Guided Grasp Diffusion Models
di: Huang, Dehao, et al.
Pubblicazione: (2025)
di: Huang, Dehao, et al.
Pubblicazione: (2025)
VERDI: VLM-Embedded Reasoning for Autonomous Driving
di: Feng, Bowen, et al.
Pubblicazione: (2025)
di: Feng, Bowen, et al.
Pubblicazione: (2025)
GES-UniGrasp: A Two-Stage Dexterous Grasping Strategy With Geometry-Based Expert Selection
di: Xu, Fangting, et al.
Pubblicazione: (2025)
di: Xu, Fangting, et al.
Pubblicazione: (2025)
Dynamic VLM-Guided Negative Prompting for Diffusion Models
di: Chang, Hoyeon, et al.
Pubblicazione: (2025)
di: Chang, Hoyeon, et al.
Pubblicazione: (2025)
UGG: Unified Generative Grasping
di: Lu, Jiaxin, et al.
Pubblicazione: (2023)
di: Lu, Jiaxin, et al.
Pubblicazione: (2023)
VCoT-Grasp: Grasp Foundation Models with Visual Chain-of-Thought Reasoning for Language-driven Grasp Generation
di: Zhang, Haoran, et al.
Pubblicazione: (2025)
di: Zhang, Haoran, et al.
Pubblicazione: (2025)
EO-VLM: VLM-Guided Energy Overload Attacks on Vision Models
di: Seo, Minjae, et al.
Pubblicazione: (2025)
di: Seo, Minjae, et al.
Pubblicazione: (2025)
VLM-RL: A Unified Vision Language Models and Reinforcement Learning Framework for Safe Autonomous Driving
di: Huang, Zilin, et al.
Pubblicazione: (2024)
di: Huang, Zilin, et al.
Pubblicazione: (2024)
ThinkGrasp: A Vision-Language System for Strategic Part Grasping in Clutter
di: Qian, Yaoyao, et al.
Pubblicazione: (2024)
di: Qian, Yaoyao, et al.
Pubblicazione: (2024)
Perceiving, Reasoning, Adapting: A Dual-Layer Framework for VLM-Guided Precision Robotic Manipulation
di: Jia, Qingxuan, et al.
Pubblicazione: (2025)
di: Jia, Qingxuan, et al.
Pubblicazione: (2025)
GraspCoT: Integrating Physical Property Reasoning for 6-DoF Grasping under Flexible Language Instructions
di: Chu, Xiaomeng, et al.
Pubblicazione: (2025)
di: Chu, Xiaomeng, et al.
Pubblicazione: (2025)
VLM-Guided Experience Replay
di: Sharony, Elad, et al.
Pubblicazione: (2026)
di: Sharony, Elad, et al.
Pubblicazione: (2026)
AffordGrasp: Cross-Modal Diffusion for Affordance-Aware Grasp Synthesis
di: Wu, Xiaofei, et al.
Pubblicazione: (2026)
di: Wu, Xiaofei, et al.
Pubblicazione: (2026)
GraspLDP: Towards Generalizable Grasping Policy via Latent Diffusion
di: Xiang, Enda, et al.
Pubblicazione: (2026)
di: Xiang, Enda, et al.
Pubblicazione: (2026)
Critic-V: VLM Critics Help Catch VLM Errors in Multimodal Reasoning
di: Zhang, Di, et al.
Pubblicazione: (2024)
di: Zhang, Di, et al.
Pubblicazione: (2024)
ActiveGrasp: Information-Guided Active Grasping with Calibrated Energy-based Model
di: Lei, Boshu, et al.
Pubblicazione: (2025)
di: Lei, Boshu, et al.
Pubblicazione: (2025)
Grasp-HGN: Grasping the Unexpected
di: Zandigohar, Mehrshad, et al.
Pubblicazione: (2025)
di: Zandigohar, Mehrshad, et al.
Pubblicazione: (2025)
SeqVLM: Proposal-Guided Multi-View Sequences Reasoning via VLM for Zero-Shot 3D Visual Grounding
di: Lin, Jiawen, et al.
Pubblicazione: (2025)
di: Lin, Jiawen, et al.
Pubblicazione: (2025)
ClickDiff: Click to Induce Semantic Contact Map for Controllable Grasp Generation with Diffusion Models
di: Li, Peiming, et al.
Pubblicazione: (2024)
di: Li, Peiming, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Open-Vocabulary Part-Based Grasping
di: van Oort, Tjeard, et al.
Pubblicazione: (2024) -
AffordGrasp: In-Context Affordance Reasoning for Open-Vocabulary Task-Oriented Grasping in Clutter
di: Tang, Yingbo, et al.
Pubblicazione: (2025) -
Viewpoint-Agnostic Grasp Pipeline using VLM and Partial Observations
di: Almeida, Dilermando, et al.
Pubblicazione: (2026) -
OVAL-Grasp: Open-Vocabulary Affordance Localization for Task Oriented Grasping
di: Tong, Edmond, et al.
Pubblicazione: (2025) -
DAGDiff: Guiding Dual-Arm Grasp Diffusion to Stable and Collision-Free Grasps
di: Karim, Md Faizal, et al.
Pubblicazione: (2025)