A Joint Modeling of Vision-Language-Action for Target-oriented Grasping in Clutter
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Xu, Kechun, Zhao, Shuqi, Zhou, Zhongxiang, Li, Zizhang, Pi, Huaijin, Wang, Yue, Xiong, Rong |
|---|---|
| Format: | Preprint |
| Publié: |
2023
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
ExploreVLM: Closed-Loop Robot Exploration Task Planning with Vision-Language Models
par: Lou, Zhichen, et autres
Publié: (2025)
par: Lou, Zhichen, et autres
Publié: (2025)
Toward Embodiment Equivariant Vision-Language-Action Policy
par: Chen, Anzhe, et autres
Publié: (2025)
par: Chen, Anzhe, et autres
Publié: (2025)
Grasp, See, and Place: Efficient Unknown Object Rearrangement with Policy Structure Prior
par: Xu, Kechun, et autres
Publié: (2024)
par: Xu, Kechun, et autres
Publié: (2024)
Efficient Alignment of Unconditioned Action Prior for Language-conditioned Pick and Place in Clutter
par: Xu, Kechun, et autres
Publié: (2025)
par: Xu, Kechun, et autres
Publié: (2025)
Seeing to Act, Prompting to Specify: A Bayesian Factorization of Vision Language Action Policy
par: Xu, Kechun, et autres
Publié: (2025)
par: Xu, Kechun, et autres
Publié: (2025)
ThinkGrasp: A Vision-Language System for Strategic Part Grasping in Clutter
par: Qian, Yaoyao, et autres
Publié: (2024)
par: Qian, Yaoyao, et autres
Publié: (2024)
HMT-Grasp: A Hybrid Mamba-Transformer Approach for Robot Grasping in Cluttered Environments
par: Xiong, Songsong, et autres
Publié: (2024)
par: Xiong, Songsong, et autres
Publié: (2024)
Corner-Grasp: Multi-Action Grasp Detection and Active Gripper Adaptation for Grasping in Cluttered Environments
par: Son, Yeong Gwang, et autres
Publié: (2025)
par: Son, Yeong Gwang, et autres
Publié: (2025)
Self-Supervised Learning for Joint Pushing and Grasping Policies in Highly Cluttered Environments
par: Wang, Yongliang, et autres
Publié: (2022)
par: Wang, Yongliang, et autres
Publié: (2022)
Disambiguate Gripper State in Grasp-Based Tasks: Pseudo-Tactile as Feedback Enables Pure Simulation Learning
par: Yang, Yifei, et autres
Publié: (2025)
par: Yang, Yifei, et autres
Publié: (2025)
ClutterDexGrasp: A Sim-to-Real System for General Dexterous Grasping in Cluttered Scenes
par: Chen, Zeyuan, et autres
Publié: (2025)
par: Chen, Zeyuan, et autres
Publié: (2025)
Clutter-Robust Vision-Language-Action Models through Object-Centric and Geometry Grounding
par: Vo, Khoa, et autres
Publié: (2025)
par: Vo, Khoa, et autres
Publié: (2025)
Pyramid-Monozone Synergistic Grasping Policy in Dense Clutter
par: Li, Chenghao, et autres
Publié: (2024)
par: Li, Chenghao, et autres
Publié: (2024)
FutureVLA: Joint Visuomotor Prediction for Vision-Language-Action Model
par: Xu, Xiaoxu, et autres
Publié: (2026)
par: Xu, Xiaoxu, et autres
Publié: (2026)
Graspness Discovery in Clutters for Fast and Accurate Grasp Detection
par: Wang, Chenxi, et autres
Publié: (2024)
par: Wang, Chenxi, et autres
Publié: (2024)
AffordGrasp: In-Context Affordance Reasoning for Open-Vocabulary Task-Oriented Grasping in Clutter
par: Tang, Yingbo, et autres
Publié: (2025)
par: Tang, Yingbo, et autres
Publié: (2025)
Learning Dual-Arm Push and Grasp Synergy in Dense Clutter
par: Wang, Yongliang, et autres
Publié: (2024)
par: Wang, Yongliang, et autres
Publié: (2024)
GraspView: Active Perception Scoring and Best-View Optimization for Robotic Grasping in Cluttered Environments
par: Wang, Shenglin, et autres
Publié: (2025)
par: Wang, Shenglin, et autres
Publié: (2025)
DexSinGrasp: Learning a Unified Policy for Dexterous Object Singulation and Grasping in Densely Cluttered Environments
par: Xu, Lixin, et autres
Publié: (2025)
par: Xu, Lixin, et autres
Publié: (2025)
AdaClearGrasp: Learning Adaptive Clearing for Zero-Shot Robust Dexterous Grasping in Densely Cluttered Environments
par: Chen, Zixuan, et autres
Publié: (2026)
par: Chen, Zixuan, et autres
Publié: (2026)
Revisit Mixture Models for Multi-Agent Simulation: Experimental Study within a Unified Framework
par: Lin, Longzhong, et autres
Publié: (2025)
par: Lin, Longzhong, et autres
Publié: (2025)
Single-View Shape Completion for Robotic Grasping in Clutter
par: Kashyap, Abhishek, et autres
Publié: (2025)
par: Kashyap, Abhishek, et autres
Publié: (2025)
Collapse and Collision Aware Grasping for Cluttered Shelf Picking
par: Pathak, Abhinav, et autres
Publié: (2025)
par: Pathak, Abhinav, et autres
Publié: (2025)
CLAW: A Vision-Language-Action Framework for Weight-Aware Robotic Grasping
par: An, Zijian, et autres
Publié: (2025)
par: An, Zijian, et autres
Publié: (2025)
DexGraspVLA: A Vision-Language-Action Framework Towards General Dexterous Grasping
par: Zhong, Yifan, et autres
Publié: (2025)
par: Zhong, Yifan, et autres
Publié: (2025)
INVIGORATE: Interactive Visual Grounding and Grasping in Clutter
par: Zhang, Hanbo, et autres
Publié: (2021)
par: Zhang, Hanbo, et autres
Publié: (2021)
DDGC: Generative Deep Dexterous Grasping in Clutter
par: Lundell, Jens, et autres
Publié: (2021)
par: Lundell, Jens, et autres
Publié: (2021)
VISO-Grasp: Vision-Language Informed Spatial Object-centric 6-DoF Active View Planning and Grasping in Clutter and Invisibility
par: Shi, Yitian, et autres
Publié: (2025)
par: Shi, Yitian, et autres
Publié: (2025)
6-DoF Grasp Detection in Clutter with Enhanced Receptive Field and Graspable Balance Sampling
par: Wang, Hanwen, et autres
Publié: (2024)
par: Wang, Hanwen, et autres
Publié: (2024)
A Collision-Aware Cable Grasping Method in Cluttered Environment
par: Zhang, Lei, et autres
Publié: (2024)
par: Zhang, Lei, et autres
Publié: (2024)
Sim-Grasp: Learning 6-DOF Grasp Policies for Cluttered Environments Using a Synthetic Benchmark
par: Li, Juncheng, et autres
Publié: (2024)
par: Li, Juncheng, et autres
Publié: (2024)
Reshaping Action Error Distributions for Reliable Vision-Language-Action Models
par: Bai, Shuanghao, et autres
Publié: (2026)
par: Bai, Shuanghao, et autres
Publié: (2026)
GarmentPile++: Affordance-Driven Cluttered Garments Retrieval with Vision-Language Reasoning
par: Li, Mingleyang, et autres
Publié: (2026)
par: Li, Mingleyang, et autres
Publié: (2026)
Grounding 3D Object Affordance with Language Instructions, Visual Observations and Interactions
par: Zhu, He, et autres
Publié: (2025)
par: Zhu, He, et autres
Publié: (2025)
Learning A Simulation-based Visual Policy for Real-world Peg In Unseen Holes
par: Xie, Liang, et autres
Publié: (2022)
par: Xie, Liang, et autres
Publié: (2022)
AeroGrab: A Unified Framework for Aerial Grasping in Cluttered Environments
par: Singh, Shivansh Pratap, et autres
Publié: (2026)
par: Singh, Shivansh Pratap, et autres
Publié: (2026)
Embodied Interpretability: Linking Causal Understanding to Generalization in Vision-Language-Action Models
par: Zhang, Hanxin, et autres
Publié: (2026)
par: Zhang, Hanxin, et autres
Publié: (2026)
X-DiffVLA: X-Embodied Diffusion Action Heads for Vision-Language-Action Models
par: Li, Boyu, et autres
Publié: (2026)
par: Li, Boyu, et autres
Publié: (2026)
Unified Diffusion VLA: Vision-Language-Action Model via Joint Discrete Denoising Diffusion Process
par: Chen, Jiayi, et autres
Publié: (2025)
par: Chen, Jiayi, et autres
Publié: (2025)
GraspClutter6D: A Large-scale Real-world Dataset for Robust Perception and Grasping in Cluttered Scenes
par: Back, Seunghyeok, et autres
Publié: (2025)
par: Back, Seunghyeok, et autres
Publié: (2025)
Documents similaires
-
ExploreVLM: Closed-Loop Robot Exploration Task Planning with Vision-Language Models
par: Lou, Zhichen, et autres
Publié: (2025) -
Toward Embodiment Equivariant Vision-Language-Action Policy
par: Chen, Anzhe, et autres
Publié: (2025) -
Grasp, See, and Place: Efficient Unknown Object Rearrangement with Policy Structure Prior
par: Xu, Kechun, et autres
Publié: (2024) -
Efficient Alignment of Unconditioned Action Prior for Language-conditioned Pick and Place in Clutter
par: Xu, Kechun, et autres
Publié: (2025) -
Seeing to Act, Prompting to Specify: A Bayesian Factorization of Vision Language Action Policy
par: Xu, Kechun, et autres
Publié: (2025)