MultiDiffSense: Diffusion-Based Multi-Modal Visuo-Tactile Image Generation Conditioned on Object Shape and Contact Pose
Fuente:
arXiv
Guardado en:
| Autores principales: | Bhouri, Sirine, Wei, Lan, Zheng, Jian-Qing, Zhang, Dandan |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Visuo-Tactile Object Pose Estimation for a Multi-Finger Robot Hand with Low-Resolution In-Hand Tactile Sensing
por: Mack, Lukas, et al.
Publicado: (2025)
por: Mack, Lukas, et al.
Publicado: (2025)
SARL: Spatially-Aware Self-Supervised Representation Learning for Visuo-Tactile Perception
por: Khurana, Gurmeher, et al.
Publicado: (2025)
por: Khurana, Gurmeher, et al.
Publicado: (2025)
ArtReg: Visuo-Tactile based Pose Tracking and Manipulation of Unseen Articulated Objects
por: Murali, Prajval Kumar, et al.
Publicado: (2025)
por: Murali, Prajval Kumar, et al.
Publicado: (2025)
Visuo-Acoustic Hand Pose and Contact Estimation
por: Mao, Yuemin, et al.
Publicado: (2025)
por: Mao, Yuemin, et al.
Publicado: (2025)
DiffBody: Diffusion-based Pose and Shape Editing of Human Images
por: Okuyama, Yuta, et al.
Publicado: (2024)
por: Okuyama, Yuta, et al.
Publicado: (2024)
Cross-Modal Visuo-Tactile Object Perception
por: Dutta, Anirvan, et al.
Publicado: (2026)
por: Dutta, Anirvan, et al.
Publicado: (2026)
Diff9D: Diffusion-Based Domain-Generalized Category-Level 9-DoF Object Pose Estimation
por: Liu, Jian, et al.
Publicado: (2025)
por: Liu, Jian, et al.
Publicado: (2025)
DiffPose-Animal: A Language-Conditioned Diffusion Framework for Animal Pose Estimation
por: Xiong, Tianyu, et al.
Publicado: (2025)
por: Xiong, Tianyu, et al.
Publicado: (2025)
MM-Diff: High-Fidelity Image Personalization via Multi-Modal Condition Integration
por: Wei, Zhichao, et al.
Publicado: (2024)
por: Wei, Zhichao, et al.
Publicado: (2024)
CVAM-Pose: Conditional Variational Autoencoder for Multi-Object Monocular Pose Estimation
por: Zhao, Jianyu, et al.
Publicado: (2024)
por: Zhao, Jianyu, et al.
Publicado: (2024)
AortaDiff: Volume-Guided Conditional Diffusion Models for Multi-Branch Aortic Surface Generation
por: An, Delin, et al.
Publicado: (2025)
por: An, Delin, et al.
Publicado: (2025)
MMO-IG: Multi-Class and Multi-Scale Object Image Generation for Remote Sensing
por: Yang, Chuang, et al.
Publicado: (2024)
por: Yang, Chuang, et al.
Publicado: (2024)
MonoDiff9D: Monocular Category-Level 9D Object Pose Estimation via Diffusion Model
por: Liu, Jian, et al.
Publicado: (2025)
por: Liu, Jian, et al.
Publicado: (2025)
Multi-modal Pose Diffuser: A Multimodal Generative Conditional Pose Prior
por: Ta, Calvin-Khang, et al.
Publicado: (2024)
por: Ta, Calvin-Khang, et al.
Publicado: (2024)
Physics-Informed Machine Learning for Efficient Sim-to-Real Data Augmentation in Micro-Object Pose Estimation
por: Tan, Zongcai, et al.
Publicado: (2025)
por: Tan, Zongcai, et al.
Publicado: (2025)
Diffusion-Based Cross-Modal Feature Extraction for Multi-Label Classification
por: Lan, Tian, et al.
Publicado: (2025)
por: Lan, Tian, et al.
Publicado: (2025)
AMM-Diff: Adaptive Multi-Modality Diffusion Network for Missing Modality Imputation
por: Kebaili, Aghiles, et al.
Publicado: (2025)
por: Kebaili, Aghiles, et al.
Publicado: (2025)
V-HOP: Visuo-Haptic 6D Object Pose Tracking
por: Li, Hongyu, et al.
Publicado: (2025)
por: Li, Hongyu, et al.
Publicado: (2025)
ViTaSCOPE: Visuo-tactile Implicit Representation for In-hand Pose and Extrinsic Contact Estimation
por: Lee, Jayjun, et al.
Publicado: (2025)
por: Lee, Jayjun, et al.
Publicado: (2025)
DiffSensei: Bridging Multi-Modal LLMs and Diffusion Models for Customized Manga Generation
por: Wu, Jianzong, et al.
Publicado: (2024)
por: Wu, Jianzong, et al.
Publicado: (2024)
Cocktail: Mixing Multi-Modality Controls for Text-Conditional Image Generation
por: Hu, Minghui, et al.
Publicado: (2023)
por: Hu, Minghui, et al.
Publicado: (2023)
Universal Visuo-Tactile Video Understanding for Embodied Interaction
por: Xie, Yifan, et al.
Publicado: (2025)
por: Xie, Yifan, et al.
Publicado: (2025)
Active Cross-Modal Visuo-Tactile Perception of Deformable Linear Objects
por: Mazza, Raffaele, et al.
Publicado: (2026)
por: Mazza, Raffaele, et al.
Publicado: (2026)
CRS-Diff: Controllable Remote Sensing Image Generation with Diffusion Model
por: Tang, Datao, et al.
Publicado: (2024)
por: Tang, Datao, et al.
Publicado: (2024)
A Digital Twin Framework for Virtual Visuo-Haptic Teleoperation of Complex-Shaped Optical Microrobots
por: Tan, Zongcai, et al.
Publicado: (2026)
por: Tan, Zongcai, et al.
Publicado: (2026)
VisuoTactile 6D Pose Estimation of an In-Hand Object using Vision and Tactile Sensor Data
por: Dikhale, Snehal s., et al.
Publicado: (2026)
por: Dikhale, Snehal s., et al.
Publicado: (2026)
Generative Modeling of Shape-Dependent Self-Contact Human Poses
por: Ohkawa, Takehiko, et al.
Publicado: (2025)
por: Ohkawa, Takehiko, et al.
Publicado: (2025)
Jointly Conditioned Diffusion Model for Multi-View Pose-Guided Person Image Synthesis
por: Xie, Chengyu, et al.
Publicado: (2025)
por: Xie, Chengyu, et al.
Publicado: (2025)
FedDiff: Diffusion Model Driven Federated Learning for Multi-Modal and Multi-Clients
por: Li, DaiXun, et al.
Publicado: (2023)
por: Li, DaiXun, et al.
Publicado: (2023)
DiffPop: Plausibility-Guided Object Placement Diffusion for Image Composition
por: Liu, Jiacheng, et al.
Publicado: (2024)
por: Liu, Jiacheng, et al.
Publicado: (2024)
DiffEye: Diffusion-Based Continuous Eye-Tracking Data Generation Conditioned on Natural Images
por: Kara, Ozgur, et al.
Publicado: (2025)
por: Kara, Ozgur, et al.
Publicado: (2025)
Pinching Visuo-haptic Display: Investigating Cross-Modal Effects of Visual Textures on Electrostatic Cloth Tactile Sensations
por: Kitagishi, Takekazu, et al.
Publicado: (2025)
por: Kitagishi, Takekazu, et al.
Publicado: (2025)
DM$^3$T: Harmonizing Modalities via Diffusion for Multi-Object Tracking
por: Li, Weiran, et al.
Publicado: (2025)
por: Li, Weiran, et al.
Publicado: (2025)
CoopDiff: Anticipating 3D Human-object Interactions via Contact-consistent Decoupled Diffusion
por: Lin, Xiaotong, et al.
Publicado: (2025)
por: Lin, Xiaotong, et al.
Publicado: (2025)
UniDiff: Parameter-Efficient Adaptation of Diffusion Models for Land Cover Classification with Multi-Modal Remotely Sensed Imagery and Sparse Annotations
por: Hu, Yuzhen, et al.
Publicado: (2025)
por: Hu, Yuzhen, et al.
Publicado: (2025)
Visuo-Tactile based Predictive Cross Modal Perception for Object Exploration in Robotics
por: Dutta, Anirvan, et al.
Publicado: (2024)
por: Dutta, Anirvan, et al.
Publicado: (2024)
M^3Detection: Multi-Frame Multi-Level Feature Fusion for Multi-Modal 3D Object Detection with Camera and 4D Imaging Radar
por: Li, Xiaozhi, et al.
Publicado: (2025)
por: Li, Xiaozhi, et al.
Publicado: (2025)
6D-Diff: A Keypoint Diffusion Framework for 6D Object Pose Estimation
por: Xu, Li, et al.
Publicado: (2023)
por: Xu, Li, et al.
Publicado: (2023)
DiffProxy: Multi-View Human Mesh Recovery via Diffusion-Generated Dense Proxies
por: Wang, Renke, et al.
Publicado: (2026)
por: Wang, Renke, et al.
Publicado: (2026)
LowDiff: Efficient Diffusion Sampling with Low-Resolution Condition
por: Xu, Jiuyi, et al.
Publicado: (2025)
por: Xu, Jiuyi, et al.
Publicado: (2025)
Ejemplares similares
-
Visuo-Tactile Object Pose Estimation for a Multi-Finger Robot Hand with Low-Resolution In-Hand Tactile Sensing
por: Mack, Lukas, et al.
Publicado: (2025) -
SARL: Spatially-Aware Self-Supervised Representation Learning for Visuo-Tactile Perception
por: Khurana, Gurmeher, et al.
Publicado: (2025) -
ArtReg: Visuo-Tactile based Pose Tracking and Manipulation of Unseen Articulated Objects
por: Murali, Prajval Kumar, et al.
Publicado: (2025) -
Visuo-Acoustic Hand Pose and Contact Estimation
por: Mao, Yuemin, et al.
Publicado: (2025) -
DiffBody: Diffusion-based Pose and Shape Editing of Human Images
por: Okuyama, Yuta, et al.
Publicado: (2024)