Language-Grounded Decoupled Action Representation for Robotic Manipulation
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Weng, Wuding, Wu, Tongshu, Chen, Liucheng, Xie, Siyu, Wang, Zheng, Xu, Xing, Song, Jingkuan, Shen, Heng Tao |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Beyond the Majority: Long-tail Imitation Learning for Robotic Manipulation
par: Zhu, Junhong, et autres
Publié: (2026)
par: Zhu, Junhong, et autres
Publié: (2026)
InSpire: Vision-Language-Action Models with Intrinsic Spatial Reasoning
par: Zhang, Ji, et autres
Publié: (2025)
par: Zhang, Ji, et autres
Publié: (2025)
Policy Contrastive Decoding for Robotic Foundation Models
par: Wu, Shihan, et autres
Publié: (2025)
par: Wu, Shihan, et autres
Publié: (2025)
DSO-VSA: a Variable Stiffness Actuator with Decoupled Stiffness and Output Characteristics for Rehabilitation Robotics
par: Zhang, Maozeng, et autres
Publié: (2025)
par: Zhang, Maozeng, et autres
Publié: (2025)
MiVLA: Towards Generalizable Vision-Language-Action Model with Human-Robot Mutual Imitation Pre-training
par: Yin, Zhenhan, et autres
Publié: (2025)
par: Yin, Zhenhan, et autres
Publié: (2025)
Sim-and-Human Co-training for Data-Efficient and Generalizable Robotic Manipulation
par: Fang, Kaipeng, et autres
Publié: (2026)
par: Fang, Kaipeng, et autres
Publié: (2026)
Action-aware Dynamic Pruning for Efficient Vision-Language-Action Manipulation
par: Pei, Xiaohuan, et autres
Publié: (2025)
par: Pei, Xiaohuan, et autres
Publié: (2025)
Audio-VLA: Adding Contact Audio Perception to Vision-Language-Action Model for Robotic Manipulation
par: Wei, Xiangyi, et autres
Publié: (2025)
par: Wei, Xiangyi, et autres
Publié: (2025)
Human2Robot: Learning Robot Actions from Paired Human-Robot Videos
par: Xie, Sicheng, et autres
Publié: (2025)
par: Xie, Sicheng, et autres
Publié: (2025)
Shortcut Learning in Generalist Robot Policies: The Role of Dataset Diversity and Fragmentation
par: Xing, Youguang, et autres
Publié: (2025)
par: Xing, Youguang, et autres
Publié: (2025)
CrayonRobo: Object-Centric Prompt-Driven Vision-Language-Action Model for Robotic Manipulation
par: Li, Xiaoqi, et autres
Publié: (2025)
par: Li, Xiaoqi, et autres
Publié: (2025)
A Survey on Efficient Vision-Language-Action Models
par: Yu, Zhaoshu, et autres
Publié: (2025)
par: Yu, Zhaoshu, et autres
Publié: (2025)
PLanAR: Planning-Language-Grounded Agentic Reasoning for Robot Manipulation
par: Guo, Pengyuan, et autres
Publié: (2026)
par: Guo, Pengyuan, et autres
Publié: (2026)
GroundSLAM: A Robust Visual SLAM System for Warehouse Robots Using Ground Textures
par: Xu, Kuan, et autres
Publié: (2017)
par: Xu, Kuan, et autres
Publié: (2017)
RoboGround: Robotic Manipulation with Grounded Vision-Language Priors
par: Huang, Haifeng, et autres
Publié: (2025)
par: Huang, Haifeng, et autres
Publié: (2025)
LaVA-Man: Learning Visual Action Representations for Robot Manipulation
par: Zhu, Chaoran, et autres
Publié: (2025)
par: Zhu, Chaoran, et autres
Publié: (2025)
MAP-VLA: Memory-Augmented Prompting for Vision-Language-Action Model in Robotic Manipulation
par: Li, Runhao, et autres
Publié: (2025)
par: Li, Runhao, et autres
Publié: (2025)
FedVLA: Federated Vision-Language-Action Learning with Dual Gating Mixture-of-Experts for Robotic Manipulation
par: Miao, Cui, et autres
Publié: (2025)
par: Miao, Cui, et autres
Publié: (2025)
Imagine2Act: Leveraging Object-Action Motion Consistency from Imagined Goals for Robotic Manipulation
par: Heng, Liang, et autres
Publié: (2025)
par: Heng, Liang, et autres
Publié: (2025)
VLA-Cache: Efficient Vision-Language-Action Manipulation via Adaptive Token Caching
par: Xu, Siyu, et autres
Publié: (2025)
par: Xu, Siyu, et autres
Publié: (2025)
CubeRobot: Grounding Language in Rubik's Cube Manipulation via Vision-Language Model
par: Wang, Feiyang, et autres
Publié: (2025)
par: Wang, Feiyang, et autres
Publié: (2025)
Affordance Field Intervention: Enabling VLAs to Escape Memory Traps in Robotic Manipulation
par: Xu, Siyu, et autres
Publié: (2025)
par: Xu, Siyu, et autres
Publié: (2025)
VLATest: Testing and Evaluating Vision-Language-Action Models for Robotic Manipulation
par: Wang, Zhijie, et autres
Publié: (2024)
par: Wang, Zhijie, et autres
Publié: (2024)
SG-VLA: Learning Spatially-Grounded Vision-Language-Action Models for Mobile Manipulation
par: Tu, Ruisen, et autres
Publié: (2026)
par: Tu, Ruisen, et autres
Publié: (2026)
Learning Action Manifold with Multi-view Latent Priors for Robotic Manipulation
par: Xiao, Junjin, et autres
Publié: (2026)
par: Xiao, Junjin, et autres
Publié: (2026)
Experiences from Benchmarking Vision-Language-Action Models for Robotic Manipulation
par: Zhang, Yihao, et autres
Publié: (2025)
par: Zhang, Yihao, et autres
Publié: (2025)
Learning Geometrically-Grounded 3D Visual Representations for View-Generalizable Robotic Manipulation
par: Zhang, Di, et autres
Publié: (2026)
par: Zhang, Di, et autres
Publié: (2026)
MLA: A Multisensory Language-Action Model for Multimodal Understanding and Forecasting in Robotic Manipulation
par: Liu, Zhuoyang, et autres
Publié: (2025)
par: Liu, Zhuoyang, et autres
Publié: (2025)
Rethinking Bimanual Robotic Manipulation: Learning with Decoupled Interaction Framework
par: Jiang, Jian-Jian, et autres
Publié: (2025)
par: Jiang, Jian-Jian, et autres
Publié: (2025)
Rethinking Intermediate Representation for VLM-based Robot Manipulation
par: Tang, Weiliang, et autres
Publié: (2025)
par: Tang, Weiliang, et autres
Publié: (2025)
Hybrid Consistency Policy: Decoupling Multi-Modal Diversity and Real-Time Efficiency in Robotic Manipulation
par: Zhao, Qianyou, et autres
Publié: (2025)
par: Zhao, Qianyou, et autres
Publié: (2025)
DA-PTQ: Drift-Aware Post-Training Quantization for Efficient Vision-Language-Action Models
par: Xu, Siyuan, et autres
Publié: (2026)
par: Xu, Siyuan, et autres
Publié: (2026)
Bridging Language and Action: A Survey of Language-Conditioned Robot Manipulation
par: Yao, Xiangtong, et autres
Publié: (2023)
par: Yao, Xiangtong, et autres
Publié: (2023)
Grounding Sim-to-Real Generalization in Dexterous Manipulation: An Empirical Study with Vision-Language-Action Models
par: Jin, Ruixing, et autres
Publié: (2026)
par: Jin, Ruixing, et autres
Publié: (2026)
InternVLA-A1: Unifying Understanding, Generation and Action for Robotic Manipulation
par: Cai, Junhao, et autres
Publié: (2026)
par: Cai, Junhao, et autres
Publié: (2026)
DAM-VLA: A Dynamic Action Model-Based Vision-Language-Action Framework for Robot Manipulation
par: Peng, Xiongfeng, et autres
Publié: (2026)
par: Peng, Xiongfeng, et autres
Publié: (2026)
LADEV: A Language-Driven Testing and Evaluation Platform for Vision-Language-Action Models in Robotic Manipulation
par: Wang, Zhijie, et autres
Publié: (2024)
par: Wang, Zhijie, et autres
Publié: (2024)
Interpretable Robotic Manipulation from Language
par: Zheng, Boyuan, et autres
Publié: (2024)
par: Zheng, Boyuan, et autres
Publié: (2024)
Action-Sketcher: From Reasoning to Action via Visual Sketches for Long-Horizon Robotic Manipulation
par: Tan, Huajie, et autres
Publié: (2026)
par: Tan, Huajie, et autres
Publié: (2026)
VLAS: Vision-Language-Action Model With Speech Instructions For Customized Robot Manipulation
par: Zhao, Wei, et autres
Publié: (2025)
par: Zhao, Wei, et autres
Publié: (2025)
Documents similaires
-
Beyond the Majority: Long-tail Imitation Learning for Robotic Manipulation
par: Zhu, Junhong, et autres
Publié: (2026) -
InSpire: Vision-Language-Action Models with Intrinsic Spatial Reasoning
par: Zhang, Ji, et autres
Publié: (2025) -
Policy Contrastive Decoding for Robotic Foundation Models
par: Wu, Shihan, et autres
Publié: (2025) -
DSO-VSA: a Variable Stiffness Actuator with Decoupled Stiffness and Output Characteristics for Rehabilitation Robotics
par: Zhang, Maozeng, et autres
Publié: (2025) -
MiVLA: Towards Generalizable Vision-Language-Action Model with Human-Robot Mutual Imitation Pre-training
par: Yin, Zhenhan, et autres
Publié: (2025)