Language-Grounded Decoupled Action Representation for Robotic Manipulation
Fuente:
arXiv
Guardado en:
| Autores principales: | Weng, Wuding, Wu, Tongshu, Chen, Liucheng, Xie, Siyu, Wang, Zheng, Xu, Xing, Song, Jingkuan, Shen, Heng Tao |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Beyond the Majority: Long-tail Imitation Learning for Robotic Manipulation
por: Zhu, Junhong, et al.
Publicado: (2026)
por: Zhu, Junhong, et al.
Publicado: (2026)
InSpire: Vision-Language-Action Models with Intrinsic Spatial Reasoning
por: Zhang, Ji, et al.
Publicado: (2025)
por: Zhang, Ji, et al.
Publicado: (2025)
Policy Contrastive Decoding for Robotic Foundation Models
por: Wu, Shihan, et al.
Publicado: (2025)
por: Wu, Shihan, et al.
Publicado: (2025)
DSO-VSA: a Variable Stiffness Actuator with Decoupled Stiffness and Output Characteristics for Rehabilitation Robotics
por: Zhang, Maozeng, et al.
Publicado: (2025)
por: Zhang, Maozeng, et al.
Publicado: (2025)
MiVLA: Towards Generalizable Vision-Language-Action Model with Human-Robot Mutual Imitation Pre-training
por: Yin, Zhenhan, et al.
Publicado: (2025)
por: Yin, Zhenhan, et al.
Publicado: (2025)
Sim-and-Human Co-training for Data-Efficient and Generalizable Robotic Manipulation
por: Fang, Kaipeng, et al.
Publicado: (2026)
por: Fang, Kaipeng, et al.
Publicado: (2026)
Action-aware Dynamic Pruning for Efficient Vision-Language-Action Manipulation
por: Pei, Xiaohuan, et al.
Publicado: (2025)
por: Pei, Xiaohuan, et al.
Publicado: (2025)
Audio-VLA: Adding Contact Audio Perception to Vision-Language-Action Model for Robotic Manipulation
por: Wei, Xiangyi, et al.
Publicado: (2025)
por: Wei, Xiangyi, et al.
Publicado: (2025)
Human2Robot: Learning Robot Actions from Paired Human-Robot Videos
por: Xie, Sicheng, et al.
Publicado: (2025)
por: Xie, Sicheng, et al.
Publicado: (2025)
Shortcut Learning in Generalist Robot Policies: The Role of Dataset Diversity and Fragmentation
por: Xing, Youguang, et al.
Publicado: (2025)
por: Xing, Youguang, et al.
Publicado: (2025)
CrayonRobo: Object-Centric Prompt-Driven Vision-Language-Action Model for Robotic Manipulation
por: Li, Xiaoqi, et al.
Publicado: (2025)
por: Li, Xiaoqi, et al.
Publicado: (2025)
A Survey on Efficient Vision-Language-Action Models
por: Yu, Zhaoshu, et al.
Publicado: (2025)
por: Yu, Zhaoshu, et al.
Publicado: (2025)
PLanAR: Planning-Language-Grounded Agentic Reasoning for Robot Manipulation
por: Guo, Pengyuan, et al.
Publicado: (2026)
por: Guo, Pengyuan, et al.
Publicado: (2026)
GroundSLAM: A Robust Visual SLAM System for Warehouse Robots Using Ground Textures
por: Xu, Kuan, et al.
Publicado: (2017)
por: Xu, Kuan, et al.
Publicado: (2017)
RoboGround: Robotic Manipulation with Grounded Vision-Language Priors
por: Huang, Haifeng, et al.
Publicado: (2025)
por: Huang, Haifeng, et al.
Publicado: (2025)
LaVA-Man: Learning Visual Action Representations for Robot Manipulation
por: Zhu, Chaoran, et al.
Publicado: (2025)
por: Zhu, Chaoran, et al.
Publicado: (2025)
MAP-VLA: Memory-Augmented Prompting for Vision-Language-Action Model in Robotic Manipulation
por: Li, Runhao, et al.
Publicado: (2025)
por: Li, Runhao, et al.
Publicado: (2025)
FedVLA: Federated Vision-Language-Action Learning with Dual Gating Mixture-of-Experts for Robotic Manipulation
por: Miao, Cui, et al.
Publicado: (2025)
por: Miao, Cui, et al.
Publicado: (2025)
Imagine2Act: Leveraging Object-Action Motion Consistency from Imagined Goals for Robotic Manipulation
por: Heng, Liang, et al.
Publicado: (2025)
por: Heng, Liang, et al.
Publicado: (2025)
VLA-Cache: Efficient Vision-Language-Action Manipulation via Adaptive Token Caching
por: Xu, Siyu, et al.
Publicado: (2025)
por: Xu, Siyu, et al.
Publicado: (2025)
CubeRobot: Grounding Language in Rubik's Cube Manipulation via Vision-Language Model
por: Wang, Feiyang, et al.
Publicado: (2025)
por: Wang, Feiyang, et al.
Publicado: (2025)
Affordance Field Intervention: Enabling VLAs to Escape Memory Traps in Robotic Manipulation
por: Xu, Siyu, et al.
Publicado: (2025)
por: Xu, Siyu, et al.
Publicado: (2025)
VLATest: Testing and Evaluating Vision-Language-Action Models for Robotic Manipulation
por: Wang, Zhijie, et al.
Publicado: (2024)
por: Wang, Zhijie, et al.
Publicado: (2024)
SG-VLA: Learning Spatially-Grounded Vision-Language-Action Models for Mobile Manipulation
por: Tu, Ruisen, et al.
Publicado: (2026)
por: Tu, Ruisen, et al.
Publicado: (2026)
Learning Action Manifold with Multi-view Latent Priors for Robotic Manipulation
por: Xiao, Junjin, et al.
Publicado: (2026)
por: Xiao, Junjin, et al.
Publicado: (2026)
Experiences from Benchmarking Vision-Language-Action Models for Robotic Manipulation
por: Zhang, Yihao, et al.
Publicado: (2025)
por: Zhang, Yihao, et al.
Publicado: (2025)
Learning Geometrically-Grounded 3D Visual Representations for View-Generalizable Robotic Manipulation
por: Zhang, Di, et al.
Publicado: (2026)
por: Zhang, Di, et al.
Publicado: (2026)
MLA: A Multisensory Language-Action Model for Multimodal Understanding and Forecasting in Robotic Manipulation
por: Liu, Zhuoyang, et al.
Publicado: (2025)
por: Liu, Zhuoyang, et al.
Publicado: (2025)
Rethinking Bimanual Robotic Manipulation: Learning with Decoupled Interaction Framework
por: Jiang, Jian-Jian, et al.
Publicado: (2025)
por: Jiang, Jian-Jian, et al.
Publicado: (2025)
Rethinking Intermediate Representation for VLM-based Robot Manipulation
por: Tang, Weiliang, et al.
Publicado: (2025)
por: Tang, Weiliang, et al.
Publicado: (2025)
Hybrid Consistency Policy: Decoupling Multi-Modal Diversity and Real-Time Efficiency in Robotic Manipulation
por: Zhao, Qianyou, et al.
Publicado: (2025)
por: Zhao, Qianyou, et al.
Publicado: (2025)
DA-PTQ: Drift-Aware Post-Training Quantization for Efficient Vision-Language-Action Models
por: Xu, Siyuan, et al.
Publicado: (2026)
por: Xu, Siyuan, et al.
Publicado: (2026)
Bridging Language and Action: A Survey of Language-Conditioned Robot Manipulation
por: Yao, Xiangtong, et al.
Publicado: (2023)
por: Yao, Xiangtong, et al.
Publicado: (2023)
Grounding Sim-to-Real Generalization in Dexterous Manipulation: An Empirical Study with Vision-Language-Action Models
por: Jin, Ruixing, et al.
Publicado: (2026)
por: Jin, Ruixing, et al.
Publicado: (2026)
InternVLA-A1: Unifying Understanding, Generation and Action for Robotic Manipulation
por: Cai, Junhao, et al.
Publicado: (2026)
por: Cai, Junhao, et al.
Publicado: (2026)
DAM-VLA: A Dynamic Action Model-Based Vision-Language-Action Framework for Robot Manipulation
por: Peng, Xiongfeng, et al.
Publicado: (2026)
por: Peng, Xiongfeng, et al.
Publicado: (2026)
LADEV: A Language-Driven Testing and Evaluation Platform for Vision-Language-Action Models in Robotic Manipulation
por: Wang, Zhijie, et al.
Publicado: (2024)
por: Wang, Zhijie, et al.
Publicado: (2024)
Interpretable Robotic Manipulation from Language
por: Zheng, Boyuan, et al.
Publicado: (2024)
por: Zheng, Boyuan, et al.
Publicado: (2024)
Action-Sketcher: From Reasoning to Action via Visual Sketches for Long-Horizon Robotic Manipulation
por: Tan, Huajie, et al.
Publicado: (2026)
por: Tan, Huajie, et al.
Publicado: (2026)
VLAS: Vision-Language-Action Model With Speech Instructions For Customized Robot Manipulation
por: Zhao, Wei, et al.
Publicado: (2025)
por: Zhao, Wei, et al.
Publicado: (2025)
Ejemplares similares
-
Beyond the Majority: Long-tail Imitation Learning for Robotic Manipulation
por: Zhu, Junhong, et al.
Publicado: (2026) -
InSpire: Vision-Language-Action Models with Intrinsic Spatial Reasoning
por: Zhang, Ji, et al.
Publicado: (2025) -
Policy Contrastive Decoding for Robotic Foundation Models
por: Wu, Shihan, et al.
Publicado: (2025) -
DSO-VSA: a Variable Stiffness Actuator with Decoupled Stiffness and Output Characteristics for Rehabilitation Robotics
por: Zhang, Maozeng, et al.
Publicado: (2025) -
MiVLA: Towards Generalizable Vision-Language-Action Model with Human-Robot Mutual Imitation Pre-training
por: Yin, Zhenhan, et al.
Publicado: (2025)