VinT-6D: A Large-Scale Object-in-hand Dataset from Vision, Touch and Proprioception
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Wan, Zhaoliang, Ling, Yonggen, Yi, Senlin, Qi, Lu, Lee, Wangwei, Lu, Minglei, Yang, Sicheng, Teng, Xiao, Lu, Peng, Yang, Xu, Yang, Ming-Hsuan, Cheng, Hui |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Category-level Object Detection, Pose Estimation and Reconstruction from Stereo Images
par: Zhang, Chuanrui, et autres
Publié: (2024)
par: Zhang, Chuanrui, et autres
Publié: (2024)
Training-free score-based diffusion for parameter-dependent stochastic dynamical systems
par: Yang, Minglei, et autres
Publié: (2026)
par: Yang, Minglei, et autres
Publié: (2026)
RAPID Hand: A Robust, Affordable, Perception-Integrated, Dexterous Manipulation Platform for Generalist Robot Autonomy
par: Wan, Zhaoliang, et autres
Publié: (2025)
par: Wan, Zhaoliang, et autres
Publié: (2025)
When would Vision-Proprioception Policies Fail in Robotic Manipulation?
par: Lu, Jingxian, et autres
Publié: (2026)
par: Lu, Jingxian, et autres
Publié: (2026)
One Flight Over the Gap: A Survey from Perspective to Panoramic Vision
par: Lin, Xin, et autres
Publié: (2025)
par: Lin, Xin, et autres
Publié: (2025)
STRNet: Visual Navigation with Spatio-Temporal Representation through Dynamic Graph Aggregation
par: Ren, Hao, et autres
Publié: (2026)
par: Ren, Hao, et autres
Publié: (2026)
Spatial-Temporal Multi-level Association for Video Object Segmentation
par: Miao, Deshui, et autres
Publié: (2024)
par: Miao, Deshui, et autres
Publié: (2024)
Layout-your-3D: Controllable and Precise 3D Generation with 2D Blueprint
par: Zhou, Junwei, et autres
Publié: (2024)
par: Zhou, Junwei, et autres
Publié: (2024)
CoCo4D: Comprehensive and Complex 4D Scene Generation
par: Zhou, Junwei, et autres
Publié: (2025)
par: Zhou, Junwei, et autres
Publié: (2025)
LaVin-DiT: Large Vision Diffusion Transformer
par: Wang, Zhaoqing, et autres
Publié: (2024)
par: Wang, Zhaoqing, et autres
Publié: (2024)
Beyond Boundaries: Leveraging Vision Foundation Models for Source-Free Object Detection
par: Yao, Huizai, et autres
Publié: (2025)
par: Yao, Huizai, et autres
Publié: (2025)
Touch100k: A Large-Scale Touch-Language-Vision Dataset for Touch-Centric Multimodal Representation
par: Cheng, Ning, et autres
Publié: (2024)
par: Cheng, Ning, et autres
Publié: (2024)
Scaling Video Pretraining for Surgical Foundation Models
par: Lu, Sicheng, et autres
Publié: (2026)
par: Lu, Sicheng, et autres
Publié: (2026)
Territoires du Vin
Publié: (2021)
Publié: (2021)
Vin et altérité
Publié: (2022)
Publié: (2022)
Restage4D: Reanimating Deformable 3D Reconstruction from a Single Video
par: He, Jixuan, et autres
Publié: (2025)
par: He, Jixuan, et autres
Publié: (2025)
Learning Spatial-Semantic Features for Robust Video Object Segmentation
par: Li, Xin, et autres
Publié: (2024)
par: Li, Xin, et autres
Publié: (2024)
PromptRR: Diffusion Models as Prompt Generators for Single Image Reflection Removal
par: Wang, Tao, et autres
Publié: (2024)
par: Wang, Tao, et autres
Publié: (2024)
Unified Dense Prediction of Video Diffusion
par: Yang, Lehan, et autres
Publié: (2025)
par: Yang, Lehan, et autres
Publié: (2025)
Video Prediction Transformers without Recurrence or Convolution
par: Tang, Yujin, et autres
Publié: (2024)
par: Tang, Yujin, et autres
Publié: (2024)
Learning Deblurring Texture Prior from Unpaired Data with Diffusion Model
par: Liu, Chengxu, et autres
Publié: (2025)
par: Liu, Chengxu, et autres
Publié: (2025)
CSL: Class-Agnostic Structure-Constrained Learning for Segmentation Including the Unseen
par: Zhang, Hao, et autres
Publié: (2023)
par: Zhang, Hao, et autres
Publié: (2023)
Frequency Domain-Based Diffusion Model for Unpaired Image Dehazing
par: Liu, Chengxu, et autres
Publié: (2025)
par: Liu, Chengxu, et autres
Publié: (2025)
UniPR: Unified Object-level Real-to-Sim Perception and Reconstruction from a Single Stereo Pair
par: Zhang, Chuanrui, et autres
Publié: (2026)
par: Zhang, Chuanrui, et autres
Publié: (2026)
Conditional Pseudo-Reversible Normalizing Flow for Surrogate Modeling in Quantifying Uncertainty Propagation
par: Yang, Minglei, et autres
Publié: (2024)
par: Yang, Minglei, et autres
Publié: (2024)
Hierarchical Audio-Visual-Proprioceptive Fusion for Precise Robotic Manipulation
par: Li, Siyuan, et autres
Publié: (2026)
par: Li, Siyuan, et autres
Publié: (2026)
AnyRotate: Gravity-Invariant In-Hand Object Rotation with Sim-to-Real Touch
par: Yang, Max, et autres
Publié: (2024)
par: Yang, Max, et autres
Publié: (2024)
DVGT-2: Vision-Geometry-Action Model for Autonomous Driving at Scale
par: Zuo, Sicheng, et autres
Publié: (2026)
par: Zuo, Sicheng, et autres
Publié: (2026)
Bioactive Feed Additives in Poultry Reproductive Physiology
par: Wenjie Lu, et autres
Publié: (2025)
par: Wenjie Lu, et autres
Publié: (2025)
RobuRCDet: Enhancing Robustness of Radar-Camera Fusion in Bird's Eye View for 3D Object Detection
par: Yue, Jingtong, et autres
Publié: (2025)
par: Yue, Jingtong, et autres
Publié: (2025)
Fly360: Omnidirectional Obstacle Avoidance within Drone View
par: Zhang, Xiangkai, et autres
Publié: (2026)
par: Zhang, Xiangkai, et autres
Publié: (2026)
Training Dataset for CNXT-Ti-LT Landslide Susceptibility Mapping
par: Luo, Senlin, et autres
Publié: (2026)
par: Luo, Senlin, et autres
Publié: (2026)
Reason3D: Searching and Reasoning 3D Segmentation via Large Language Model
par: Huang, Kuan-Chih, et autres
Publié: (2024)
par: Huang, Kuan-Chih, et autres
Publié: (2024)
Training Class-Imbalanced Diffusion Model Via Overlap Optimization
par: Yan, Divin, et autres
Publié: (2024)
par: Yan, Divin, et autres
Publié: (2024)
Weakly Supervised 3D Object Detection via Multi-Level Visual Guidance
par: Huang, Kuan-Chih, et autres
Publié: (2023)
par: Huang, Kuan-Chih, et autres
Publié: (2023)
Fisher-Preserving Guidance: Training-Free Manifold Constraints for Safe Diffusion Control
par: Ren, Hao, et autres
Publié: (2026)
par: Ren, Hao, et autres
Publié: (2026)
Simplifying, Stabilizing and Scaling Continuous-Time Consistency Models
par: Lu, Cheng, et autres
Publié: (2024)
par: Lu, Cheng, et autres
Publié: (2024)
The moduli space of HCMU surfaces
par: Lu, Sicheng, et autres
Publié: (2025)
par: Lu, Sicheng, et autres
Publié: (2025)
Moduli Space of Dihedral Spherical Surfaces and Measured Foliations
par: Lu, Sicheng, et autres
Publié: (2023)
par: Lu, Sicheng, et autres
Publié: (2023)
Counting mapping class group orbits under shearing coordinates
par: Lu, Sicheng, et autres
Publié: (2021)
par: Lu, Sicheng, et autres
Publié: (2021)
Documents similaires
-
Category-level Object Detection, Pose Estimation and Reconstruction from Stereo Images
par: Zhang, Chuanrui, et autres
Publié: (2024) -
Training-free score-based diffusion for parameter-dependent stochastic dynamical systems
par: Yang, Minglei, et autres
Publié: (2026) -
RAPID Hand: A Robust, Affordable, Perception-Integrated, Dexterous Manipulation Platform for Generalist Robot Autonomy
par: Wan, Zhaoliang, et autres
Publié: (2025) -
When would Vision-Proprioception Policies Fail in Robotic Manipulation?
par: Lu, Jingxian, et autres
Publié: (2026) -
One Flight Over the Gap: A Survey from Perspective to Panoramic Vision
par: Lin, Xin, et autres
Publié: (2025)