No Need for Real 3D: Fusing 2D Vision with Pseudo 3D Representations for Robotic Manipulation Learning
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Yu, Run, Liu, Yangdi, Wei, Wen-Da, Li, Chen |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
FP3: A 3D Foundation Policy for Robotic Manipulation
par: Yang, Rujia, et autres
Publié: (2025)
par: Yang, Rujia, et autres
Publié: (2025)
EmbodiedMAE: A Unified 3D Multi-Modal Representation for Robot Manipulation
par: Dong, Zibin, et autres
Publié: (2025)
par: Dong, Zibin, et autres
Publié: (2025)
CL3R: 3D Reconstruction and Contrastive Learning for Enhanced Robotic Manipulation Representations
par: Cui, Wenbo, et autres
Publié: (2025)
par: Cui, Wenbo, et autres
Publié: (2025)
ManiCM: Real-time 3D Diffusion Policy via Consistency Model for Robotic Manipulation
par: Lu, Guanxing, et autres
Publié: (2024)
par: Lu, Guanxing, et autres
Publié: (2024)
BridgeVLA: Input-Output Alignment for Efficient 3D Manipulation Learning with Vision-Language Models
par: Li, Peiyan, et autres
Publié: (2025)
par: Li, Peiyan, et autres
Publié: (2025)
UMI-3D: Extending Universal Manipulation Interface from Vision-Limited to 3D Spatial Perception
par: Wang, Ziming
Publié: (2026)
par: Wang, Ziming
Publié: (2026)
PointWorld: Scaling 3D World Models for In-The-Wild Robotic Manipulation
par: Huang, Wenlong, et autres
Publié: (2026)
par: Huang, Wenlong, et autres
Publié: (2026)
AnchorDP3: 3D Affordance Guided Sparse Diffusion Policy for Robotic Manipulation
par: Zhao, Ziyan, et autres
Publié: (2025)
par: Zhao, Ziyan, et autres
Publié: (2025)
Scaling Sim-to-Real Reinforcement Learning for Robot VLAs with Generative 3D Worlds
par: Choi, Andrew, et autres
Publié: (2026)
par: Choi, Andrew, et autres
Publié: (2026)
ManipDreamer3D : Synthesizing Plausible Robotic Manipulation Video with Occupancy-aware 3D Trajectory
par: Li, Ying, et autres
Publié: (2025)
par: Li, Ying, et autres
Publié: (2025)
GP3: A 3D Geometry-Aware Policy with Multi-View Images for Robotic Manipulation
par: Qian, Quanhao, et autres
Publié: (2025)
par: Qian, Quanhao, et autres
Publié: (2025)
A3D: Adaptive Affordance Assembly with Dual-Arm Manipulation
par: Liang, Jiaqi, et autres
Publié: (2026)
par: Liang, Jiaqi, et autres
Publié: (2026)
Dynamic Manipulation of Deformable Objects in 3D: Simulation, Benchmark and Learning Strategy
par: Lan, Guanzhou, et autres
Publié: (2025)
par: Lan, Guanzhou, et autres
Publié: (2025)
Part-Guided 3D RL for Sim2Real Articulated Object Manipulation
par: Xie, Pengwei, et autres
Publié: (2024)
par: Xie, Pengwei, et autres
Publié: (2024)
Integrating LMM Planners and 3D Skill Policies for Generalizable Manipulation
par: Li, Yuelei, et autres
Publié: (2025)
par: Li, Yuelei, et autres
Publié: (2025)
ManiSoft: Towards Vision-Language Manipulation for Soft Continuum Robotics
par: Wei, Ziyu, et autres
Publié: (2026)
par: Wei, Ziyu, et autres
Publié: (2026)
Is Diversity All You Need for Scalable Robotic Manipulation?
par: Shi, Modi, et autres
Publié: (2025)
par: Shi, Modi, et autres
Publié: (2025)
3D-Grounded Vision-Language Framework for Robotic Task Planning: Automated Prompt Synthesis and Supervised Reasoning
par: Tang, Guoqin, et autres
Publié: (2025)
par: Tang, Guoqin, et autres
Publié: (2025)
SonarSweep: Fusing Sonar and Vision for Robust 3D Reconstruction via Plane Sweeping
par: Chen, Lingpeng, et autres
Publié: (2025)
par: Chen, Lingpeng, et autres
Publié: (2025)
Manipulating Elasto-Plastic Objects With 3D Occupancy and Learning-Based Predictive Control
par: Zhang, Zhen, et autres
Publié: (2025)
par: Zhang, Zhen, et autres
Publié: (2025)
3DSGrasp: 3D Shape-Completion for Robotic Grasp
par: Mohammadi, Seyed S., et autres
Publié: (2023)
par: Mohammadi, Seyed S., et autres
Publié: (2023)
DynaRend: Learning 3D Dynamics via Masked Future Rendering for Robotic Manipulation
par: Tian, Jingyi, et autres
Publié: (2025)
par: Tian, Jingyi, et autres
Publié: (2025)
Collective Intelligence for 2D Push Manipulations with Mobile Robots
par: Kuroki, So, et autres
Publié: (2022)
par: Kuroki, So, et autres
Publié: (2022)
Phys2Real: Fusing VLM Priors with Interactive Online Adaptation for Uncertainty-Aware Sim-to-Real Manipulation
par: Wang, Maggie, et autres
Publié: (2025)
par: Wang, Maggie, et autres
Publié: (2025)
AssemblyComplete: 3D Combinatorial Construction with Deep Reinforcement Learning
par: Chen, Alan, et autres
Publié: (2024)
par: Chen, Alan, et autres
Publié: (2024)
OccVLA: Vision-Language-Action Model with Implicit 3D Occupancy Supervision
par: Liu, Ruixun, et autres
Publié: (2025)
par: Liu, Ruixun, et autres
Publié: (2025)
RL-100: Performant Robotic Manipulation with Real-World Reinforcement Learning
par: Lei, Kun, et autres
Publié: (2025)
par: Lei, Kun, et autres
Publié: (2025)
D-SPEAR: Dual-Stream Prioritized Experience Adaptive Replay for Stable Reinforcement Learning in Robotic Manipulation
par: Zhang, Yu, et autres
Publié: (2026)
par: Zhang, Yu, et autres
Publié: (2026)
3DGSNav: Enhancing Vision-Language Model Reasoning for Object Navigation via Active 3D Gaussian Splatting
par: Zheng, Wancai, et autres
Publié: (2026)
par: Zheng, Wancai, et autres
Publié: (2026)
Learning Structural Latent Points for Efficient Visual Representations in Robotic Manipulation
par: Jiang, Yicheng, et autres
Publié: (2026)
par: Jiang, Yicheng, et autres
Publié: (2026)
DeformerNet: Learning Bimanual Manipulation of 3D Deformable Objects
par: Thach, Bao, et autres
Publié: (2023)
par: Thach, Bao, et autres
Publié: (2023)
FlowBot3D: Learning 3D Articulation Flow to Manipulate Articulated Objects
par: Eisner, Ben, et autres
Publié: (2022)
par: Eisner, Ben, et autres
Publié: (2022)
3D-ViTac: Learning Fine-Grained Manipulation with Visuo-Tactile Sensing
par: Huang, Binghao, et autres
Publié: (2024)
par: Huang, Binghao, et autres
Publié: (2024)
RoboSpatial: Teaching Spatial Understanding to 2D and 3D Vision-Language Models for Robotics
par: Song, Chan Hee, et autres
Publié: (2024)
par: Song, Chan Hee, et autres
Publié: (2024)
Build on Priors: Vision--Language--Guided Neuro-Symbolic Imitation Learning for Data-Efficient Real-World Robot Manipulation
par: Lorang, Pierrick, et autres
Publié: (2026)
par: Lorang, Pierrick, et autres
Publié: (2026)
GaussianPU: A Hybrid 2D-3D Upsampling Framework for Enhancing Color Point Clouds via 3D Gaussian Splatting
par: Guo, Zixuan, et autres
Publié: (2024)
par: Guo, Zixuan, et autres
Publié: (2024)
Lifelong Language-Conditioned Robotic Manipulation Learning
par: Wang, Xudong, et autres
Publié: (2026)
par: Wang, Xudong, et autres
Publié: (2026)
Pre-training Auto-regressive Robotic Models with 4D Representations
par: Niu, Dantong, et autres
Publié: (2025)
par: Niu, Dantong, et autres
Publié: (2025)
Grounding Vision and Language to 3D Masks for Long-Horizon Box Rearrangement
par: Malik, Ashish, et autres
Publié: (2026)
par: Malik, Ashish, et autres
Publié: (2026)
CLAMP: Contrastive Learning for 3D Multi-View Action-Conditioned Robotic Manipulation Pretraining
par: Liu, I-Chun Arthur, et autres
Publié: (2026)
par: Liu, I-Chun Arthur, et autres
Publié: (2026)
Documents similaires
-
FP3: A 3D Foundation Policy for Robotic Manipulation
par: Yang, Rujia, et autres
Publié: (2025) -
EmbodiedMAE: A Unified 3D Multi-Modal Representation for Robot Manipulation
par: Dong, Zibin, et autres
Publié: (2025) -
CL3R: 3D Reconstruction and Contrastive Learning for Enhanced Robotic Manipulation Representations
par: Cui, Wenbo, et autres
Publié: (2025) -
ManiCM: Real-time 3D Diffusion Policy via Consistency Model for Robotic Manipulation
par: Lu, Guanxing, et autres
Publié: (2024) -
BridgeVLA: Input-Output Alignment for Efficient 3D Manipulation Learning with Vision-Language Models
par: Li, Peiyan, et autres
Publié: (2025)