VoxAct-B: Voxel-Based Acting and Stabilizing Policy for Bimanual Manipulation
Fuente:
arXiv
Guardado en:
| Autores principales: | Liu, I-Chun Arthur, He, Sicheng, Seita, Daniel, Sukhatme, Gaurav |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
CRAFT: Video Diffusion for Bimanual Robot Data Generation
por: Chen, Jason, et al.
Publicado: (2026)
por: Chen, Jason, et al.
Publicado: (2026)
ROPA: Synthetic Robot Pose Generation for RGB-D Bimanual Data Augmentation
por: Chen, Jason, et al.
Publicado: (2025)
por: Chen, Jason, et al.
Publicado: (2025)
D-CODA: Diffusion for Coordinated Dual-Arm Data Augmentation
por: Liu, I-Chun Arthur, et al.
Publicado: (2025)
por: Liu, I-Chun Arthur, et al.
Publicado: (2025)
Zero-Shot Generalization of Vision-Based RL Without Data Augmentation
por: Batra, Sumeet, et al.
Publicado: (2024)
por: Batra, Sumeet, et al.
Publicado: (2024)
SCOOP'D: Learning Mixed-Liquid-Solid Scooping via Sim2Real Generative Policy
por: Wang, Kuanning, et al.
Publicado: (2025)
por: Wang, Kuanning, et al.
Publicado: (2025)
VoxNeRF: Bridging Voxel Representation and Neural Radiance Fields for Enhanced Indoor View Synthesis
por: Wang, Sen, et al.
Publicado: (2023)
por: Wang, Sen, et al.
Publicado: (2023)
VoxAfford: Multi-Scale Voxel-Token Fusion for Open-Vocabulary 3D Affordance Detection
por: Sun, Haowen, et al.
Publicado: (2026)
por: Sun, Haowen, et al.
Publicado: (2026)
PerAct2: Benchmarking and Learning for Robotic Bimanual Manipulation Tasks
por: Grotz, Markus, et al.
Publicado: (2024)
por: Grotz, Markus, et al.
Publicado: (2024)
Planning-Guided Diffusion Policy Learning for Generalizable Contact-Rich Bimanual Manipulation
por: Li, Xuanlin, et al.
Publicado: (2024)
por: Li, Xuanlin, et al.
Publicado: (2024)
ManipTrans: Efficient Dexterous Bimanual Manipulation Transfer via Residual Learning
por: Li, Kailin, et al.
Publicado: (2025)
por: Li, Kailin, et al.
Publicado: (2025)
H-RDT: Human Manipulation Enhanced Bimanual Robotic Manipulation
por: Bi, Hongzhe, et al.
Publicado: (2025)
por: Bi, Hongzhe, et al.
Publicado: (2025)
AnyPos: Automated Task-Agnostic Actions for Bimanual Manipulation
por: Tan, Hengkai, et al.
Publicado: (2025)
por: Tan, Hengkai, et al.
Publicado: (2025)
You Only Teach Once: Learn One-Shot Bimanual Robotic Manipulation from Video Demonstrations
por: Zhou, Huayi, et al.
Publicado: (2025)
por: Zhou, Huayi, et al.
Publicado: (2025)
VTAO-BiManip: Masked Visual-Tactile-Action Pre-training with Object Understanding for Bimanual Dexterous Manipulation
por: Sun, Zhengnan, et al.
Publicado: (2025)
por: Sun, Zhengnan, et al.
Publicado: (2025)
Observe Then Act: Asynchronous Active Vision-Action Model for Robotic Manipulation
por: Wang, Guokang, et al.
Publicado: (2024)
por: Wang, Guokang, et al.
Publicado: (2024)
RDT-1B: a Diffusion Foundation Model for Bimanual Manipulation
por: Liu, Songming, et al.
Publicado: (2024)
por: Liu, Songming, et al.
Publicado: (2024)
Large Pre-Trained Models for Bimanual Manipulation in 3D
por: Yurchyk, Hanna, et al.
Publicado: (2025)
por: Yurchyk, Hanna, et al.
Publicado: (2025)
Towards a Generalizable Bimanual Foundation Policy via Flow-based Video Prediction
por: Fan, Chenyou, et al.
Publicado: (2025)
por: Fan, Chenyou, et al.
Publicado: (2025)
Learning to See and Act: Task-Aware Virtual View Exploration for Robotic Manipulation
por: Bai, Yongjie, et al.
Publicado: (2025)
por: Bai, Yongjie, et al.
Publicado: (2025)
Think Small, Act Big: Primitive Prompt Learning for Lifelong Robot Manipulation
por: Yao, Yuanqi, et al.
Publicado: (2025)
por: Yao, Yuanqi, et al.
Publicado: (2025)
AnoVox: A Benchmark for Multimodal Anomaly Detection in Autonomous Driving
por: Bogdoll, Daniel, et al.
Publicado: (2024)
por: Bogdoll, Daniel, et al.
Publicado: (2024)
DexMan: Learning Bimanual Dexterous Manipulation from Human and Generated Videos
por: Hsieh, Jhen, et al.
Publicado: (2025)
por: Hsieh, Jhen, et al.
Publicado: (2025)
PEAfowl: Perception-Enhanced Multi-View Vision-Language-Action for Bimanual Manipulation
por: Fan, Qingyu, et al.
Publicado: (2026)
por: Fan, Qingyu, et al.
Publicado: (2026)
3D Dynamics-Aware Manipulation: Endowing Manipulation Policies with 3D Foresight
por: He, Yuxin, et al.
Publicado: (2025)
por: He, Yuxin, et al.
Publicado: (2025)
Fast Visuomotor Policy for Robotic Manipulation
por: Jia, Jingkai, et al.
Publicado: (2025)
por: Jia, Jingkai, et al.
Publicado: (2025)
HVOFusion: Incremental Mesh Reconstruction Using Hybrid Voxel Octree
por: Liu, Shaofan, et al.
Publicado: (2024)
por: Liu, Shaofan, et al.
Publicado: (2024)
D-REX: Differentiable Real-to-Sim-to-Real Engine for Learning Dexterous Grasping
por: Lou, Haozhe, et al.
Publicado: (2026)
por: Lou, Haozhe, et al.
Publicado: (2026)
InterACT: Inter-dependency Aware Action Chunking with Hierarchical Attention Transformers for Bimanual Manipulation
por: Lee, Andrew, et al.
Publicado: (2024)
por: Lee, Andrew, et al.
Publicado: (2024)
BiFold: Bimanual Cloth Folding with Language Guidance
por: Barbany, Oriol, et al.
Publicado: (2025)
por: Barbany, Oriol, et al.
Publicado: (2025)
V-MORALS: Visual Morse Graph-Aided Estimation of Regions of Attraction in a Learned Latent Space
por: Aladin, Faiz, et al.
Publicado: (2026)
por: Aladin, Faiz, et al.
Publicado: (2026)
StructBiHOI: Structured Articulation Modeling for Long--Horizon Bimanual Hand--Object Interaction Generation
por: Wang, Zhi, et al.
Publicado: (2026)
por: Wang, Zhi, et al.
Publicado: (2026)
Demystifying Action Space Design for Robotic Manipulation Policies
por: Feng, Yuchun, et al.
Publicado: (2026)
por: Feng, Yuchun, et al.
Publicado: (2026)
Not All Voxels Are Equal: Hardness-Aware Semantic Scene Completion with Self-Distillation
por: Wang, Song, et al.
Publicado: (2024)
por: Wang, Song, et al.
Publicado: (2024)
HANDFUL: Sequential Grasp-Conditioned Dexterous Manipulation with Resource Awareness
por: Foong, Ethan, et al.
Publicado: (2026)
por: Foong, Ethan, et al.
Publicado: (2026)
VXP: Voxel-Cross-Pixel Large-scale Image-LiDAR Place Recognition
por: Li, Yun-Jin, et al.
Publicado: (2024)
por: Li, Yun-Jin, et al.
Publicado: (2024)
ESCAPE: Episodic Spatial Memory and Adaptive Execution Policy for Long-Horizon Mobile Manipulation
por: Qian, Jingjing, et al.
Publicado: (2026)
por: Qian, Jingjing, et al.
Publicado: (2026)
CLAMP: Contrastive Learning for 3D Multi-View Action-Conditioned Robotic Manipulation Pretraining
por: Liu, I-Chun Arthur, et al.
Publicado: (2026)
por: Liu, I-Chun Arthur, et al.
Publicado: (2026)
StereoPolicy: Improving Robotic Manipulation Policies via Stereo Perception
por: Han, Evans, et al.
Publicado: (2026)
por: Han, Evans, et al.
Publicado: (2026)
Track2Act: Predicting Point Tracks from Internet Videos enables Generalizable Robot Manipulation
por: Bharadhwaj, Homanga, et al.
Publicado: (2024)
por: Bharadhwaj, Homanga, et al.
Publicado: (2024)
ABPolicy: Asynchronous B-Spline Flow Policy for Real-Time and Smooth Robotic Manipulation
por: Yang, Fan, et al.
Publicado: (2026)
por: Yang, Fan, et al.
Publicado: (2026)
Ejemplares similares
-
CRAFT: Video Diffusion for Bimanual Robot Data Generation
por: Chen, Jason, et al.
Publicado: (2026) -
ROPA: Synthetic Robot Pose Generation for RGB-D Bimanual Data Augmentation
por: Chen, Jason, et al.
Publicado: (2025) -
D-CODA: Diffusion for Coordinated Dual-Arm Data Augmentation
por: Liu, I-Chun Arthur, et al.
Publicado: (2025) -
Zero-Shot Generalization of Vision-Based RL Without Data Augmentation
por: Batra, Sumeet, et al.
Publicado: (2024) -
SCOOP'D: Learning Mixed-Liquid-Solid Scooping via Sim2Real Generative Policy
por: Wang, Kuanning, et al.
Publicado: (2025)