UniHM: Unified Dexterous Hand Manipulation with Vision Language Model
Fuente:
arXiv
Guardado en:
| Autores principales: | Zhang, Zhenhao, Liu, Jiaxin, Shi, Ye, Wang, Jingya |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
UniHM: Universal Human Motion Generation with Object Interactions in Indoor Scenes
por: Geng, Zichen, et al.
Publicado: (2025)
por: Geng, Zichen, et al.
Publicado: (2025)
UniFucGrasp: Human-Hand-Inspired Unified Functional Grasp Annotation Strategy and Dataset for Diverse Dexterous Hands
por: Lin, Haoran, et al.
Publicado: (2025)
por: Lin, Haoran, et al.
Publicado: (2025)
Uni-NaVid: A Video-based Vision-Language-Action Model for Unifying Embodied Navigation Tasks
por: Zhang, Jiazhao, et al.
Publicado: (2024)
por: Zhang, Jiazhao, et al.
Publicado: (2024)
Dexterous Manipulation Policies from RGB Human Videos via 3D Hand-Object Trajectory Reconstruction
por: Chen, Hongyi, et al.
Publicado: (2026)
por: Chen, Hongyi, et al.
Publicado: (2026)
Uni-LaViRA: Language-Vision-Robot Actions Translation for Unified Embodied Navigation
por: Ding, Hongyu, et al.
Publicado: (2026)
por: Ding, Hongyu, et al.
Publicado: (2026)
DexVLG: Dexterous Vision-Language-Grasp Model at Scale
por: He, Jiawei, et al.
Publicado: (2025)
por: He, Jiawei, et al.
Publicado: (2025)
RoboUniView: Visual-Language Model with Unified View Representation for Robotic Manipulation
por: Liu, Fanfan, et al.
Publicado: (2024)
por: Liu, Fanfan, et al.
Publicado: (2024)
OpenHOI: Open-World Hand-Object Interaction Synthesis with Multimodal Large Language Model
por: Zhang, Zhenhao, et al.
Publicado: (2025)
por: Zhang, Zhenhao, et al.
Publicado: (2025)
FlowHOI: Flow-based Semantics-Grounded Generation of Hand-Object Interactions for Dexterous Robot Manipulation
por: Zeng, Huajian, et al.
Publicado: (2026)
por: Zeng, Huajian, et al.
Publicado: (2026)
Uni-Hand: Universal Hand Motion Forecasting in Egocentric Views
por: Ma, Junyi, et al.
Publicado: (2025)
por: Ma, Junyi, et al.
Publicado: (2025)
FunGrasp: Functional Grasping for Diverse Dexterous Hands
por: Huang, Linyi, et al.
Publicado: (2024)
por: Huang, Linyi, et al.
Publicado: (2024)
DexHandDiff: Interaction-aware Diffusion Planning for Adaptive Dexterous Manipulation
por: Liang, Zhixuan, et al.
Publicado: (2024)
por: Liang, Zhixuan, et al.
Publicado: (2024)
Unified Vision-Language-Action Model
por: Wang, Yuqi, et al.
Publicado: (2025)
por: Wang, Yuqi, et al.
Publicado: (2025)
METIS: Multi-Source Egocentric Training for Integrated Dexterous Vision-Language-Action Model
por: Fu, Yankai, et al.
Publicado: (2025)
por: Fu, Yankai, et al.
Publicado: (2025)
ManipLVM-R1: Reinforcement Learning for Reasoning in Embodied Manipulation with Large Vision-Language Models
por: Song, Zirui, et al.
Publicado: (2025)
por: Song, Zirui, et al.
Publicado: (2025)
DexNDM: Closing the Reality Gap for Dexterous In-Hand Rotation via Joint-Wise Neural Dynamics Model
por: Liu, Xueyi, et al.
Publicado: (2025)
por: Liu, Xueyi, et al.
Publicado: (2025)
Dex1B: Learning with 1B Demonstrations for Dexterous Manipulation
por: Ye, Jianglong, et al.
Publicado: (2025)
por: Ye, Jianglong, et al.
Publicado: (2025)
VTAO-BiManip: Masked Visual-Tactile-Action Pre-training with Object Understanding for Bimanual Dexterous Manipulation
por: Sun, Zhengnan, et al.
Publicado: (2025)
por: Sun, Zhengnan, et al.
Publicado: (2025)
MemoryVLA: Perceptual-Cognitive Memory in Vision-Language-Action Models for Robotic Manipulation
por: Shi, Hao, et al.
Publicado: (2025)
por: Shi, Hao, et al.
Publicado: (2025)
Structural Action Transformer for 3D Dexterous Manipulation
por: Lei, Xiaohan, et al.
Publicado: (2026)
por: Lei, Xiaohan, et al.
Publicado: (2026)
Learning Continuous Grasping Function with a Dexterous Hand from Human Demonstrations
por: Ye, Jianglong, et al.
Publicado: (2022)
por: Ye, Jianglong, et al.
Publicado: (2022)
Online Adaptation for Myographic Control of Natural Dexterous Hand and Finger Movements
por: Betthauser, Joseph L., et al.
Publicado: (2024)
por: Betthauser, Joseph L., et al.
Publicado: (2024)
SparseDFF: Sparse-View Feature Distillation for One-Shot Dexterous Manipulation
por: Wang, Qianxu, et al.
Publicado: (2023)
por: Wang, Qianxu, et al.
Publicado: (2023)
AnyTeleop: A General Vision-Based Dexterous Robot Arm-Hand Teleoperation System
por: Qin, Yuzhe, et al.
Publicado: (2023)
por: Qin, Yuzhe, et al.
Publicado: (2023)
UniLACT: Depth-Aware RGB Latent Action Learning for Vision-Language-Action Models
por: Govind, Manish Kumar, et al.
Publicado: (2026)
por: Govind, Manish Kumar, et al.
Publicado: (2026)
Exploring the Limits of Vision-Language-Action Manipulations in Cross-task Generalization
por: Zhou, Jiaming, et al.
Publicado: (2025)
por: Zhou, Jiaming, et al.
Publicado: (2025)
QuasiSim: Parameterized Quasi-Physical Simulators for Dexterous Manipulations Transfer
por: Liu, Xueyi, et al.
Publicado: (2024)
por: Liu, Xueyi, et al.
Publicado: (2024)
AnyDexGrasp: General Dexterous Grasping for Different Hands with Human-level Learning Efficiency
por: Fang, Hao-Shu, et al.
Publicado: (2025)
por: Fang, Hao-Shu, et al.
Publicado: (2025)
CyberDemo: Augmenting Simulated Human Demonstration for Real-World Dexterous Manipulation
por: Wang, Jun, et al.
Publicado: (2024)
por: Wang, Jun, et al.
Publicado: (2024)
UniDriveVLA: Unifying Understanding, Perception, and Action Planning for Autonomous Driving
por: Li, Yongkang, et al.
Publicado: (2026)
por: Li, Yongkang, et al.
Publicado: (2026)
ManipTrans: Efficient Dexterous Bimanual Manipulation Transfer via Residual Learning
por: Li, Kailin, et al.
Publicado: (2025)
por: Li, Kailin, et al.
Publicado: (2025)
Large VLM-based Vision-Language-Action Models for Robotic Manipulation: A Survey
por: Shao, Rui, et al.
Publicado: (2025)
por: Shao, Rui, et al.
Publicado: (2025)
SaPaVe: Towards Active Perception and Manipulation in Vision-Language-Action Models for Robotics
por: Liu, Mengzhen, et al.
Publicado: (2026)
por: Liu, Mengzhen, et al.
Publicado: (2026)
Bimanual Grasp Synthesis for Dexterous Robot Hands
por: Shao, Yanming, et al.
Publicado: (2024)
por: Shao, Yanming, et al.
Publicado: (2024)
UniCal: Unified Neural Sensor Calibration
por: Yang, Ze, et al.
Publicado: (2024)
por: Yang, Ze, et al.
Publicado: (2024)
RealDex: Towards Human-like Grasping for Robotic Dexterous Hand
por: Liu, Yumeng, et al.
Publicado: (2024)
por: Liu, Yumeng, et al.
Publicado: (2024)
HRDexDB: A Large-Scale Dataset of Dexterous Human and Robotic Hand Grasps
por: Lim, Jongbin, et al.
Publicado: (2026)
por: Lim, Jongbin, et al.
Publicado: (2026)
BitVLA: 1-bit Vision-Language-Action Models for Robotics Manipulation
por: Wang, Hongyu, et al.
Publicado: (2025)
por: Wang, Hongyu, et al.
Publicado: (2025)
Observe Then Act: Asynchronous Active Vision-Action Model for Robotic Manipulation
por: Wang, Guokang, et al.
Publicado: (2024)
por: Wang, Guokang, et al.
Publicado: (2024)
Mobile Robot Navigation Using Hand-Drawn Maps: A Vision Language Model Approach
por: Tan, Aaron Hao, et al.
Publicado: (2025)
por: Tan, Aaron Hao, et al.
Publicado: (2025)
Ejemplares similares
-
UniHM: Universal Human Motion Generation with Object Interactions in Indoor Scenes
por: Geng, Zichen, et al.
Publicado: (2025) -
UniFucGrasp: Human-Hand-Inspired Unified Functional Grasp Annotation Strategy and Dataset for Diverse Dexterous Hands
por: Lin, Haoran, et al.
Publicado: (2025) -
Uni-NaVid: A Video-based Vision-Language-Action Model for Unifying Embodied Navigation Tasks
por: Zhang, Jiazhao, et al.
Publicado: (2024) -
Dexterous Manipulation Policies from RGB Human Videos via 3D Hand-Object Trajectory Reconstruction
por: Chen, Hongyi, et al.
Publicado: (2026) -
Uni-LaViRA: Language-Vision-Robot Actions Translation for Unified Embodied Navigation
por: Ding, Hongyu, et al.
Publicado: (2026)