VLM-SFD: VLM-Assisted Siamese Flow Diffusion Framework for Dual-Arm Cooperative Manipulation
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Chen, Jiaming, Jiang, Yiyu, Huang, Aoshen, Li, Yang, Pan, Wei |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Skill-Aware Diffusion for Generalizable Robotic Manipulation
par: Huang, Aoshen, et autres
Publié: (2026)
par: Huang, Aoshen, et autres
Publié: (2026)
VLM-TDP: VLM-guided Trajectory-conditioned Diffusion Policy for Robust Long-Horizon Manipulation
par: Huang, Kefeng, et autres
Publié: (2025)
par: Huang, Kefeng, et autres
Publié: (2025)
Reflective VLM Planning for Dual-Arm Desktop Cleaning: Bridging Open-Vocabulary Perception and Precise Manipulation
par: Liu, Yufan, et autres
Publié: (2025)
par: Liu, Yufan, et autres
Publié: (2025)
Perceiving, Reasoning, Adapting: A Dual-Layer Framework for VLM-Guided Precision Robotic Manipulation
par: Jia, Qingxuan, et autres
Publié: (2025)
par: Jia, Qingxuan, et autres
Publié: (2025)
Rethinking Intermediate Representation for VLM-based Robot Manipulation
par: Tang, Weiliang, et autres
Publié: (2025)
par: Tang, Weiliang, et autres
Publié: (2025)
UniDiffGrasp: A Unified Framework Integrating VLM Reasoning and VLM-Guided Part Diffusion for Open-Vocabulary Constrained Grasping with Dual Arms
par: Guo, Xueyang, et autres
Publié: (2025)
par: Guo, Xueyang, et autres
Publié: (2025)
AERMANI-VLM: Structured Prompting and Reasoning for Aerial Manipulation with Vision Language Models
par: Mishra, Sarthak, et autres
Publié: (2025)
par: Mishra, Sarthak, et autres
Publié: (2025)
Image-Based Visual Servoing for Enhanced Cooperation of Dual-Arm Manipulation
par: Zhang, Zizhe, et autres
Publié: (2024)
par: Zhang, Zizhe, et autres
Publié: (2024)
A Dual Process VLA: Efficient Robotic Manipulation Leveraging VLM
par: Han, ByungOk, et autres
Publié: (2024)
par: Han, ByungOk, et autres
Publié: (2024)
Simulation to Rules: A Dual-VLM Framework for Formal Visual Planning
par: Hao, Yilun, et autres
Publié: (2025)
par: Hao, Yilun, et autres
Publié: (2025)
BagIt! An Adaptive Dual-Arm Manipulation of Fabric Bags for Object Bagging
par: Zhou, Peng, et autres
Publié: (2025)
par: Zhou, Peng, et autres
Publié: (2025)
CoDriveVLM: VLM-Enhanced Urban Cooperative Dispatching and Motion Planning for Future Autonomous Mobility on Demand Systems
par: Liu, Haichao, et autres
Publié: (2025)
par: Liu, Haichao, et autres
Publié: (2025)
Gentle Manipulation Policy Learning via Demonstrations from VLM Planned Atomic Skills
par: Zhou, Jiayu, et autres
Publié: (2025)
par: Zhou, Jiayu, et autres
Publié: (2025)
ProcVLM: Learning Procedure-Grounded Progress Rewards for Robotic Manipulation
par: Feng, Youhe, et autres
Publié: (2026)
par: Feng, Youhe, et autres
Publié: (2026)
CompliantVLA-adaptor: VLM-Guided Variable Impedance Action for Safe Contact-Rich Manipulation
par: Zhang, Heng, et autres
Publié: (2026)
par: Zhang, Heng, et autres
Publié: (2026)
GoalVLM: VLM-driven Object Goal Navigation for Multi-Agent System
par: James, MoniJesu, et autres
Publié: (2026)
par: James, MoniJesu, et autres
Publié: (2026)
VLM-Grounder: A VLM Agent for Zero-Shot 3D Visual Grounding
par: Xu, Runsen, et autres
Publié: (2024)
par: Xu, Runsen, et autres
Publié: (2024)
Executable Analytic Concepts as the Missing Link Between VLM Insight and Precise Manipulation
par: Sun, Mingyang, et autres
Publié: (2025)
par: Sun, Mingyang, et autres
Publié: (2025)
Large VLM-based Vision-Language-Action Models for Robotic Manipulation: A Survey
par: Shao, Rui, et autres
Publié: (2025)
par: Shao, Rui, et autres
Publié: (2025)
Robot Collapse: Supply Chain Backdoor Attacks Against VLM-based Robotic Manipulation
par: Wang, Xianlong, et autres
Publié: (2024)
par: Wang, Xianlong, et autres
Publié: (2024)
HCLM: A Hierarchical Framework for Cooperative Loco-Manipulation with Dual Quadrupeds
par: Li, Qixuan, et autres
Publié: (2026)
par: Li, Qixuan, et autres
Publié: (2026)
Towards Logic-Aware Manipulation: A Knowledge Primitive for VLM-Based Assistants in Smart Manufacturing
par: Chen, Suchang, et autres
Publié: (2025)
par: Chen, Suchang, et autres
Publié: (2025)
iFlyBot-VLM Technical Report
par: Nie, Xin, et autres
Publié: (2025)
par: Nie, Xin, et autres
Publié: (2025)
VLM-MPC: Vision Language Foundation Model (VLM)-Guided Model Predictive Controller (MPC) for Autonomous Driving
par: Long, Keke, et autres
Publié: (2024)
par: Long, Keke, et autres
Publié: (2024)
RadarSFD: Single-Frame Diffusion with Pretrained Priors for Radar Point Clouds
par: Zhao, Bin, et autres
Publié: (2025)
par: Zhao, Bin, et autres
Publié: (2025)
3D FlowMatch Actor: Unified 3D Policy for Single- and Dual-Arm Manipulation
par: Gkanatsios, Nikolaos, et autres
Publié: (2025)
par: Gkanatsios, Nikolaos, et autres
Publié: (2025)
SwarmVLM: VLM-Guided Impedance Control for Autonomous Navigation of Heterogeneous Robots in Dynamic Warehousing
par: Zafar, Malaika, et autres
Publié: (2025)
par: Zafar, Malaika, et autres
Publié: (2025)
SoraNav: Adaptive UAV Task-Centric Navigation via Zeroshot VLM Reasoning
par: Song, Hongyu, et autres
Publié: (2025)
par: Song, Hongyu, et autres
Publié: (2025)
HumanoidVLM: Vision-Language-Guided Impedance Control for Contact-Rich Humanoid Manipulation
par: Mahmoud, Yara, et autres
Publié: (2026)
par: Mahmoud, Yara, et autres
Publié: (2026)
MetaWorld-X: Hierarchical World Modeling via VLM-Orchestrated Experts for Humanoid Loco-Manipulation
par: Shen, Yutong, et autres
Publié: (2026)
par: Shen, Yutong, et autres
Publié: (2026)
VLM-Vac: Enhancing Smart Vacuums through VLM Knowledge Distillation and Language-Guided Experience Replay
par: Mirjalili, Reihaneh, et autres
Publié: (2024)
par: Mirjalili, Reihaneh, et autres
Publié: (2024)
CoINS: Counterfactual Interactive Navigation via Skill-Aware VLM
par: Zhou, Kangjie, et autres
Publié: (2026)
par: Zhou, Kangjie, et autres
Publié: (2026)
Score the Steps, Not Just the Goal: VLM-Based Subgoal Evaluation for Robotic Manipulation
par: ElMallah, Ramy, et autres
Publié: (2025)
par: ElMallah, Ramy, et autres
Publié: (2025)
From Code to Action: Hierarchical Learning of Diffusion-VLM Policies
par: Peschl, Markus, et autres
Publié: (2025)
par: Peschl, Markus, et autres
Publié: (2025)
HapticVLM: VLM-Driven Texture Recognition Aimed at Intelligent Haptic Interaction
par: Khan, Muhammad Haris, et autres
Publié: (2025)
par: Khan, Muhammad Haris, et autres
Publié: (2025)
VLM-Auto: VLM-based Autonomous Driving Assistant with Human-like Behavior and Understanding for Complex Road Scenes
par: Guo, Ziang, et autres
Publié: (2024)
par: Guo, Ziang, et autres
Publié: (2024)
A Unified Calibration Framework for Coordinate and Kinematic Parameters in Dual-Arm Robots
par: Huang, Tianyu, et autres
Publié: (2026)
par: Huang, Tianyu, et autres
Publié: (2026)
APEX: Ambidextrous Dual-Arm Robotic Manipulation Using Collision-Free Generative Diffusion Models
par: Dastider, Apan, et autres
Publié: (2024)
par: Dastider, Apan, et autres
Publié: (2024)
RoboDexVLM: Visual Language Model-Enabled Task Planning and Motion Control for Dexterous Robot Manipulation
par: Liu, Haichao, et autres
Publié: (2025)
par: Liu, Haichao, et autres
Publié: (2025)
VLM-UDMC: VLM-Enhanced Unified Decision-Making and Motion Control for Urban Autonomous Driving
par: Liu, Haichao, et autres
Publié: (2025)
par: Liu, Haichao, et autres
Publié: (2025)
Documents similaires
-
Skill-Aware Diffusion for Generalizable Robotic Manipulation
par: Huang, Aoshen, et autres
Publié: (2026) -
VLM-TDP: VLM-guided Trajectory-conditioned Diffusion Policy for Robust Long-Horizon Manipulation
par: Huang, Kefeng, et autres
Publié: (2025) -
Reflective VLM Planning for Dual-Arm Desktop Cleaning: Bridging Open-Vocabulary Perception and Precise Manipulation
par: Liu, Yufan, et autres
Publié: (2025) -
Perceiving, Reasoning, Adapting: A Dual-Layer Framework for VLM-Guided Precision Robotic Manipulation
par: Jia, Qingxuan, et autres
Publié: (2025) -
Rethinking Intermediate Representation for VLM-based Robot Manipulation
par: Tang, Weiliang, et autres
Publié: (2025)