Learning Geometrically-Grounded 3D Visual Representations for View-Generalizable Robotic Manipulation
Fuente:
arXiv
Salvato in:
| Autori principali: | Zhang, Di, Duan, Weicheng, Gu, Dasen, Lu, Hongye, Zhang, Hai, Yu, Hang, Zhao, Junqiao, Chen, Guang |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
KineDex: Learning Tactile-Informed Visuomotor Policies via Kinesthetic Teaching for Dexterous Manipulation
di: Zhang, Di, et al.
Pubblicazione: (2025)
di: Zhang, Di, et al.
Pubblicazione: (2025)
Point What You Mean: Visually Grounded Instruction Policy
di: Yu, Hang, et al.
Pubblicazione: (2025)
di: Yu, Hang, et al.
Pubblicazione: (2025)
OmniD: Generalizable Robot Manipulation Policy via Image-Based BEV Representation
di: Mao, Jilei, et al.
Pubblicazione: (2025)
di: Mao, Jilei, et al.
Pubblicazione: (2025)
ManiVID-3D: Generalizable View-Invariant Reinforcement Learning for Robotic Manipulation via Disentangled 3D Representations
di: Li, Zheng, et al.
Pubblicazione: (2025)
di: Li, Zheng, et al.
Pubblicazione: (2025)
RGMP: Recurrent Geometric-prior Multimodal Policy for Generalizable Humanoid Robot Manipulation
di: Li, Xuetao, et al.
Pubblicazione: (2025)
di: Li, Xuetao, et al.
Pubblicazione: (2025)
Generalizable Geometric Prior and Recurrent Spiking Feature Learning for Humanoid Robot Manipulation
di: Li, Xuetao, et al.
Pubblicazione: (2026)
di: Li, Xuetao, et al.
Pubblicazione: (2026)
ReinboT: Amplifying Robot Visual-Language Manipulation with Reinforcement Learning
di: Zhang, Hongyin, et al.
Pubblicazione: (2025)
di: Zhang, Hongyin, et al.
Pubblicazione: (2025)
PrimitiveVLA: Learning Reusable Motion Primitives for Efficient and Generalizable Robotic Manipulation
di: Li, Yutai, et al.
Pubblicazione: (2026)
di: Li, Yutai, et al.
Pubblicazione: (2026)
Skill-Aware Diffusion for Generalizable Robotic Manipulation
di: Huang, Aoshen, et al.
Pubblicazione: (2026)
di: Huang, Aoshen, et al.
Pubblicazione: (2026)
Learning to Manipulate Anywhere: A Visual Generalizable Framework For Reinforcement Learning
di: Yuan, Zhecheng, et al.
Pubblicazione: (2024)
di: Yuan, Zhecheng, et al.
Pubblicazione: (2024)
Language-Grounded Decoupled Action Representation for Robotic Manipulation
di: Weng, Wuding, et al.
Pubblicazione: (2026)
di: Weng, Wuding, et al.
Pubblicazione: (2026)
DexRepNet++: Learning Dexterous Robotic Manipulation with Geometric and Spatial Hand-Object Representations
di: Liu, Qingtao, et al.
Pubblicazione: (2026)
di: Liu, Qingtao, et al.
Pubblicazione: (2026)
Learning Structural Latent Points for Efficient Visual Representations in Robotic Manipulation
di: Jiang, Yicheng, et al.
Pubblicazione: (2026)
di: Jiang, Yicheng, et al.
Pubblicazione: (2026)
RoboUniView: Visual-Language Model with Unified View Representation for Robotic Manipulation
di: Liu, Fanfan, et al.
Pubblicazione: (2024)
di: Liu, Fanfan, et al.
Pubblicazione: (2024)
Veo-Act: How Far Can Frontier Video Models Advance Generalizable Robot Manipulation?
di: Zhang, Zhongru, et al.
Pubblicazione: (2026)
di: Zhang, Zhongru, et al.
Pubblicazione: (2026)
LaVA-Man: Learning Visual Action Representations for Robot Manipulation
di: Zhu, Chaoran, et al.
Pubblicazione: (2025)
di: Zhu, Chaoran, et al.
Pubblicazione: (2025)
FMB: a Functional Manipulation Benchmark for Generalizable Robotic Learning
di: Luo, Jianlan, et al.
Pubblicazione: (2024)
di: Luo, Jianlan, et al.
Pubblicazione: (2024)
Gondola: Grounded Vision Language Planning for Generalizable Robotic Manipulation
di: Chen, Shizhe, et al.
Pubblicazione: (2025)
di: Chen, Shizhe, et al.
Pubblicazione: (2025)
Language-Guided Object-Centric Diffusion Policy for Generalizable and Collision-Aware Robotic Manipulation
di: Li, Hang, et al.
Pubblicazione: (2024)
di: Li, Hang, et al.
Pubblicazione: (2024)
CAGE: Causal Attention Enables Data-Efficient Generalizable Robotic Manipulation
di: Xia, Shangning, et al.
Pubblicazione: (2024)
di: Xia, Shangning, et al.
Pubblicazione: (2024)
ProcVLM: Learning Procedure-Grounded Progress Rewards for Robotic Manipulation
di: Feng, Youhe, et al.
Pubblicazione: (2026)
di: Feng, Youhe, et al.
Pubblicazione: (2026)
Focus On What Matters: Separated Models For Visual-Based RL Generalization
di: Zhang, Di, et al.
Pubblicazione: (2024)
di: Zhang, Di, et al.
Pubblicazione: (2024)
ArrayBot: Reinforcement Learning for Generalizable Distributed Manipulation through Touch
di: Xue, Zhengrong, et al.
Pubblicazione: (2023)
di: Xue, Zhengrong, et al.
Pubblicazione: (2023)
ACSAC: Adaptive Chunk Size Actor-Critic with Causal Transformer Q-Network
di: Chen, Qian, et al.
Pubblicazione: (2026)
di: Chen, Qian, et al.
Pubblicazione: (2026)
Versatile and Generalizable Manipulation via Goal-Conditioned Reinforcement Learning with Grounded Object Detection
di: Wang, Huiyi, et al.
Pubblicazione: (2025)
di: Wang, Huiyi, et al.
Pubblicazione: (2025)
Merging and Disentangling Views in Visual Reinforcement Learning for Robotic Manipulation
di: Almuzairee, Abdulaziz, et al.
Pubblicazione: (2025)
di: Almuzairee, Abdulaziz, et al.
Pubblicazione: (2025)
DYMO-Hair: Generalizable Volumetric Dynamics Modeling for Robot Hair Manipulation
di: Zhao, Chengyang, et al.
Pubblicazione: (2025)
di: Zhao, Chengyang, et al.
Pubblicazione: (2025)
PLanAR: Planning-Language-Grounded Agentic Reasoning for Robot Manipulation
di: Guo, Pengyuan, et al.
Pubblicazione: (2026)
di: Guo, Pengyuan, et al.
Pubblicazione: (2026)
GP3: A 3D Geometry-Aware Policy with Multi-View Images for Robotic Manipulation
di: Qian, Quanhao, et al.
Pubblicazione: (2025)
di: Qian, Quanhao, et al.
Pubblicazione: (2025)
Learning Generalizable 3D Manipulation With 10 Demonstrations
di: Ren, Yu, et al.
Pubblicazione: (2024)
di: Ren, Yu, et al.
Pubblicazione: (2024)
O$^3$Afford: One-Shot 3D Object-to-Object Affordance Grounding for Generalizable Robotic Manipulation
di: Tian, Tongxuan, et al.
Pubblicazione: (2025)
di: Tian, Tongxuan, et al.
Pubblicazione: (2025)
VistaBot: View-Robust Robot Manipulation via Spatiotemporal-Aware View Synthesis
di: Gu, Songen, et al.
Pubblicazione: (2026)
di: Gu, Songen, et al.
Pubblicazione: (2026)
Cortical Policy: A Dual-Stream View Transformer for Robotic Manipulation
di: Zhang, Xuening, et al.
Pubblicazione: (2026)
di: Zhang, Xuening, et al.
Pubblicazione: (2026)
Generalizable Coarse-to-Fine Robot Manipulation via Language-Aligned 3D Keypoints
di: Hu, Jianshu, et al.
Pubblicazione: (2025)
di: Hu, Jianshu, et al.
Pubblicazione: (2025)
Dexterity-BEV: Aligning 3D World and Actions for Generalizable Robot Policies Learning
di: Zhou, Huayi, et al.
Pubblicazione: (2026)
di: Zhou, Huayi, et al.
Pubblicazione: (2026)
VolumeDP: Modeling Volumetric Representation for Manipulation Policy Learning
di: Zhou, Tianxing, et al.
Pubblicazione: (2026)
di: Zhou, Tianxing, et al.
Pubblicazione: (2026)
Transferring Foundation Models for Generalizable Robotic Manipulation
di: Yang, Jiange, et al.
Pubblicazione: (2023)
di: Yang, Jiange, et al.
Pubblicazione: (2023)
Learning Surgical Robotic Manipulation with 3D Spatial Priors
di: Sheng, Yu, et al.
Pubblicazione: (2026)
di: Sheng, Yu, et al.
Pubblicazione: (2026)
RoboView-Bias: Benchmarking Visual Bias in Embodied Agents for Robotic Manipulation
di: Liu, Enguang, et al.
Pubblicazione: (2025)
di: Liu, Enguang, et al.
Pubblicazione: (2025)
CL3R: 3D Reconstruction and Contrastive Learning for Enhanced Robotic Manipulation Representations
di: Cui, Wenbo, et al.
Pubblicazione: (2025)
di: Cui, Wenbo, et al.
Pubblicazione: (2025)
Documenti analoghi
-
KineDex: Learning Tactile-Informed Visuomotor Policies via Kinesthetic Teaching for Dexterous Manipulation
di: Zhang, Di, et al.
Pubblicazione: (2025) -
Point What You Mean: Visually Grounded Instruction Policy
di: Yu, Hang, et al.
Pubblicazione: (2025) -
OmniD: Generalizable Robot Manipulation Policy via Image-Based BEV Representation
di: Mao, Jilei, et al.
Pubblicazione: (2025) -
ManiVID-3D: Generalizable View-Invariant Reinforcement Learning for Robotic Manipulation via Disentangled 3D Representations
di: Li, Zheng, et al.
Pubblicazione: (2025) -
RGMP: Recurrent Geometric-prior Multimodal Policy for Generalizable Humanoid Robot Manipulation
di: Li, Xuetao, et al.
Pubblicazione: (2025)