Latent Object Characteristics Recognition with Visual to Haptic-Audio Cross-modal Transfer Learning
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Saito, Namiko, Moura, Joao, Uchida, Hiroki, Vijayakumar, Sethu |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Learning Visuotactile Estimation and Control for Non-prehensile Manipulation under Occlusions
par: Ferrandis, Juan Del Aguila, et autres
Publié: (2024)
par: Ferrandis, Juan Del Aguila, et autres
Publié: (2024)
Understanding Particles From Video: Property Estimation of Granular Materials via Visuo-Haptic Learning
par: Zhang, Zeqing, et autres
Publié: (2024)
par: Zhang, Zeqing, et autres
Publié: (2024)
Control-oriented Clustering of Visual Latent Representation
par: Qi, Han, et autres
Publié: (2024)
par: Qi, Han, et autres
Publié: (2024)
V-MORALS: Visual Morse Graph-Aided Estimation of Regions of Attraction in a Learned Latent Space
par: Aladin, Faiz, et autres
Publié: (2026)
par: Aladin, Faiz, et autres
Publié: (2026)
Explicit Contact Optimization in Whole-Body Contact-Rich Manipulation
par: Leve, Victor, et autres
Publié: (2024)
par: Leve, Victor, et autres
Publié: (2024)
Visual Sync: Multi-Camera Synchronization via Cross-View Object Motion
par: Liu, Shaowei, et autres
Publié: (2025)
par: Liu, Shaowei, et autres
Publié: (2025)
Attentive Feature Aggregation or: How Policies Learn to Stop Worrying about Robustness and Attend to Task-Relevant Visual Cues
par: Tsagkas, Nikolaos, et autres
Publié: (2025)
par: Tsagkas, Nikolaos, et autres
Publié: (2025)
Closing the Visual Sim-to-Real Gap with Object-Composable NeRFs
par: Mishra, Nikhil, et autres
Publié: (2024)
par: Mishra, Nikhil, et autres
Publié: (2024)
Shelf-Supervised Cross-Modal Pre-Training for 3D Object Detection
par: Khurana, Mehar, et autres
Publié: (2024)
par: Khurana, Mehar, et autres
Publié: (2024)
DoughNet: A Visual Predictive Model for Topological Manipulation of Deformable Objects
par: Bauer, Dominik, et autres
Publié: (2024)
par: Bauer, Dominik, et autres
Publié: (2024)
Learning Action-Conditional and Object-Centric Gaussian Splatting World Models for Rigid Objects
par: Kreber, Jens U., et autres
Publié: (2026)
par: Kreber, Jens U., et autres
Publié: (2026)
Learning Visual Feature-Based World Models via Residual Latent Action
par: Zhang, Xinyu, et autres
Publié: (2026)
par: Zhang, Xinyu, et autres
Publié: (2026)
CON: Continual Object Navigation via Data-Free Inter-Agent Knowledge Transfer in Unseen and Unfamiliar Places
par: Terashima, Kouki, et autres
Publié: (2024)
par: Terashima, Kouki, et autres
Publié: (2024)
Continuous Object State Recognition for Cooking Robots Using Pre-Trained Vision-Language Models and Black-box Optimization
par: Kawaharazuka, Kento, et autres
Publié: (2024)
par: Kawaharazuka, Kento, et autres
Publié: (2024)
Model-Agnostic Open-Set Air-to-Air Visual Object Detection for Reliable UAV Perception
par: Loukovitis, Spyridon, et autres
Publié: (2025)
par: Loukovitis, Spyridon, et autres
Publié: (2025)
Audio-3DVG: Unified Audio -- Point Cloud Fusion for 3D Visual Grounding
par: Cao-Dinh, Duc, et autres
Publié: (2025)
par: Cao-Dinh, Duc, et autres
Publié: (2025)
Towards Lifelong Aerial Autonomy: Geometric Memory Management for Continual Visual Place Recognition in Dynamic Environments
par: Shao, Xingyu, et autres
Publié: (2026)
par: Shao, Xingyu, et autres
Publié: (2026)
FALCON: Future-Aware Learning with Contextual Object-Centric Pretraining for UAV Action Recognition
par: Xian, Ruiqi, et autres
Publié: (2024)
par: Xian, Ruiqi, et autres
Publié: (2024)
ACE: A Cross-Platform Visual-Exoskeletons System for Low-Cost Dexterous Teleoperation
par: Yang, Shiqi, et autres
Publié: (2024)
par: Yang, Shiqi, et autres
Publié: (2024)
Enabling Visual Recognition at Radio Frequency
par: Lai, Haowen, et autres
Publié: (2024)
par: Lai, Haowen, et autres
Publié: (2024)
Entity-Centric Reinforcement Learning for Object Manipulation from Pixels
par: Haramati, Dan, et autres
Publié: (2024)
par: Haramati, Dan, et autres
Publié: (2024)
Hearing Touch: Audio-Visual Pretraining for Contact-Rich Manipulation
par: Mejia, Jared, et autres
Publié: (2024)
par: Mejia, Jared, et autres
Publié: (2024)
SegDAC: Visual Generalization in Reinforcement Learning via Dynamic Object Tokens
par: Brown, Alexandre, et autres
Publié: (2025)
par: Brown, Alexandre, et autres
Publié: (2025)
Transferable Tactile Transformers for Representation Learning Across Diverse Sensors and Tasks
par: Zhao, Jialiang, et autres
Publié: (2024)
par: Zhao, Jialiang, et autres
Publié: (2024)
Machine Learning-Based Vehicle Intention Trajectory Recognition and Prediction for Autonomous Driving
par: Yu, Hanyi, et autres
Publié: (2024)
par: Yu, Hanyi, et autres
Publié: (2024)
CoIRL-AD: Collaborative-Competitive Imitation-Reinforcement Learning in Latent World Models for Autonomous Driving
par: Zheng, Xiaoji, et autres
Publié: (2025)
par: Zheng, Xiaoji, et autres
Publié: (2025)
ObjectReact: Learning Object-Relative Control for Visual Navigation
par: Garg, Sourav, et autres
Publié: (2025)
par: Garg, Sourav, et autres
Publié: (2025)
Robustness Evaluation of Machine Learning Models for Robot Arm Action Recognition in Noisy Environments
par: Motamedi, Elaheh, et autres
Publié: (2024)
par: Motamedi, Elaheh, et autres
Publié: (2024)
Tracking Object Positions in Reinforcement Learning: A Metric for Keypoint Detection (extended version)
par: Cramer, Emma, et autres
Publié: (2023)
par: Cramer, Emma, et autres
Publié: (2023)
Squint: Fast Visual Reinforcement Learning for Sim-to-Real Robotics
par: Almuzairee, Abdulaziz, et autres
Publié: (2026)
par: Almuzairee, Abdulaziz, et autres
Publié: (2026)
Scaling Proprioceptive-Visual Learning with Heterogeneous Pre-trained Transformers
par: Wang, Lirui, et autres
Publié: (2024)
par: Wang, Lirui, et autres
Publié: (2024)
A Recipe for Unbounded Data Augmentation in Visual Reinforcement Learning
par: Almuzairee, Abdulaziz, et autres
Publié: (2024)
par: Almuzairee, Abdulaziz, et autres
Publié: (2024)
Grounding Bodily Awareness in Visual Representations for Efficient Policy Learning
par: Wang, Junlin, et autres
Publié: (2025)
par: Wang, Junlin, et autres
Publié: (2025)
Merging and Disentangling Views in Visual Reinforcement Learning for Robotic Manipulation
par: Almuzairee, Abdulaziz, et autres
Publié: (2025)
par: Almuzairee, Abdulaziz, et autres
Publié: (2025)
Learning Precise Affordances from Egocentric Videos for Robotic Manipulation
par: Li, Gen, et autres
Publié: (2024)
par: Li, Gen, et autres
Publié: (2024)
Web2Grasp: Learning Functional Grasps from Web Images of Hand-Object Interactions
par: Chen, Hongyi, et autres
Publié: (2025)
par: Chen, Hongyi, et autres
Publié: (2025)
Learning Part-Aware Dense 3D Feature Field for Generalizable Articulated Object Manipulation
par: Chen, Yue, et autres
Publié: (2026)
par: Chen, Yue, et autres
Publié: (2026)
Particle-Grid Neural Dynamics for Learning Deformable Object Models from RGB-D Videos
par: Zhang, Kaifeng, et autres
Publié: (2025)
par: Zhang, Kaifeng, et autres
Publié: (2025)
Motus: A Unified Latent Action World Model
par: Bi, Hongzhe, et autres
Publié: (2025)
par: Bi, Hongzhe, et autres
Publié: (2025)
Disturbance-Free Surgical Video Generation from Multi-Camera Shadowless Lamps for Open Surgery
par: Kato, Yuna, et autres
Publié: (2025)
par: Kato, Yuna, et autres
Publié: (2025)
Documents similaires
-
Learning Visuotactile Estimation and Control for Non-prehensile Manipulation under Occlusions
par: Ferrandis, Juan Del Aguila, et autres
Publié: (2024) -
Understanding Particles From Video: Property Estimation of Granular Materials via Visuo-Haptic Learning
par: Zhang, Zeqing, et autres
Publié: (2024) -
Control-oriented Clustering of Visual Latent Representation
par: Qi, Han, et autres
Publié: (2024) -
V-MORALS: Visual Morse Graph-Aided Estimation of Regions of Attraction in a Learned Latent Space
par: Aladin, Faiz, et autres
Publié: (2026) -
Explicit Contact Optimization in Whole-Body Contact-Rich Manipulation
par: Leve, Victor, et autres
Publié: (2024)