Hearing the Room Through the Shape of the Drum: Modal-Guided Sound Recovery from Multi-Point Surface Vibrations
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Bagon, Shai, Kichler, Matan, Sheinin, Mark |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Learning to See Inside Opaque Liquid Containers using Speckle Vibrometry
par: Kichler, Matan, et autres
Publié: (2025)
par: Kichler, Matan, et autres
Publié: (2025)
Cross-Modal Knowledge Distillation from Spatial Transcriptomics to Histology
par: Hizmi, Arbel, et autres
Publié: (2026)
par: Hizmi, Arbel, et autres
Publié: (2026)
DINO-Tracker: Taming DINO for Self-Supervised Point Tracking in a Single Video
par: Tumanyan, Narek, et autres
Publié: (2024)
par: Tumanyan, Narek, et autres
Publié: (2024)
CapeX: Category-Agnostic Pose Estimation from Textual Point Explanation
par: Rusanovsky, Matan, et autres
Publié: (2024)
par: Rusanovsky, Matan, et autres
Publié: (2024)
What's in the Image? A Deep-Dive into the Vision of Vision Language Models
par: Kaduri, Omri, et autres
Publié: (2024)
par: Kaduri, Omri, et autres
Publié: (2024)
Talking Points: Describing and Localizing Pixels
par: Rusanovsky, Matan, et autres
Publié: (2025)
par: Rusanovsky, Matan, et autres
Publié: (2025)
Sampling-Aware 3D Spatial Analysis in Multiplexed Imaging
par: Harlev, Ido, et autres
Publié: (2026)
par: Harlev, Ido, et autres
Publié: (2026)
Color-Encoded Illumination for High-Speed Volumetric Scene Reconstruction
par: Novikov, David, et autres
Publié: (2026)
par: Novikov, David, et autres
Publié: (2026)
Memories of Forgotten Concepts
par: Rusanovsky, Matan, et autres
Publié: (2024)
par: Rusanovsky, Matan, et autres
Publié: (2024)
DMF-Net: Image-Guided Point Cloud Completion with Dual-Channel Modality Fusion and Shape-Aware Upsampling Transformer
par: Mao, Aihua, et autres
Publié: (2024)
par: Mao, Aihua, et autres
Publié: (2024)
US-X Complete: A Multi-Modal Approach to Anatomical 3D Shape Recovery
par: Gafencu, Miruna-Alexandra, et autres
Publié: (2025)
par: Gafencu, Miruna-Alexandra, et autres
Publié: (2025)
PointArena: Probing Multimodal Grounding Through Language-Guided Pointing
par: Cheng, Long, et autres
Publié: (2025)
par: Cheng, Long, et autres
Publié: (2025)
Hearing Hands: Generating Sounds from Physical Interactions in 3D Scenes
par: Dou, Yiming, et autres
Publié: (2025)
par: Dou, Yiming, et autres
Publié: (2025)
Multi-View Foundation Models
par: Segre, Leo, et autres
Publié: (2025)
par: Segre, Leo, et autres
Publié: (2025)
Garment Recovery with Shape and Deformation Priors
par: Li, Ren, et autres
Publié: (2023)
par: Li, Ren, et autres
Publié: (2023)
MM-LDM: Multi-Modal Latent Diffusion Model for Sounding Video Generation
par: Sun, Mingzhen, et autres
Publié: (2024)
par: Sun, Mingzhen, et autres
Publié: (2024)
NeuralBoneReg: An Instance-Specific Label-Free Point Cloud-Based Method for Multi-Modal Bone Surface Registration
par: Wu, Luohong, et autres
Publié: (2025)
par: Wu, Luohong, et autres
Publié: (2025)
Multi-Modal Guided Multi-Source Domain Adaptation for Object Detection
par: Lee, Sangin, et autres
Publié: (2026)
par: Lee, Sangin, et autres
Publié: (2026)
Learning to Hear by Seeing: It's Time for Vision Language Models to Understand Artistic Emotion from Sight and Sound
par: Zhang, Dengming, et autres
Publié: (2025)
par: Zhang, Dengming, et autres
Publié: (2025)
TAMM: TriAdapter Multi-Modal Learning for 3D Shape Understanding
par: Zhang, Zhihao, et autres
Publié: (2024)
par: Zhang, Zhihao, et autres
Publié: (2024)
Hearing and Seeing Through CLIP: A Framework for Self-Supervised Sound Source Localization
par: Park, Sooyoung, et autres
Publié: (2025)
par: Park, Sooyoung, et autres
Publié: (2025)
Audio-Guided Visual Editing with Complex Multi-Modal Prompts
par: Kim, Hyeonyu, et autres
Publié: (2025)
par: Kim, Hyeonyu, et autres
Publié: (2025)
PointGauss: Point Cloud-Guided Multi-Object Segmentation for Gaussian Splatting
par: Sun, Wentao, et autres
Publié: (2025)
par: Sun, Wentao, et autres
Publié: (2025)
Seeing Sound, Hearing Sight: Uncovering Modality Bias and Conflict of AI models in Sound Localization
par: Jia, Yanhao, et autres
Publié: (2025)
par: Jia, Yanhao, et autres
Publié: (2025)
Jailbreak Large Vision-Language Models Through Multi-Modal Linkage
par: Wang, Yu, et autres
Publié: (2024)
par: Wang, Yu, et autres
Publié: (2024)
Approximately Piecewise E(3) Equivariant Point Networks
par: Atzmon, Matan, et autres
Publié: (2024)
par: Atzmon, Matan, et autres
Publié: (2024)
A Graph-Based Approach for Category-Agnostic Pose Estimation
par: Hirschorn, Or, et autres
Publié: (2023)
par: Hirschorn, Or, et autres
Publié: (2023)
Edge Weight Prediction For Category-Agnostic Pose Estimation
par: Hirschorn, Or, et autres
Publié: (2024)
par: Hirschorn, Or, et autres
Publié: (2024)
MMMS: Multi-Modal Multi-Surface Interactive Segmentation
par: Schön, Robin, et autres
Publié: (2025)
par: Schön, Robin, et autres
Publié: (2025)
REGNav: Room Expert Guided Image-Goal Navigation
par: Li, Pengna, et autres
Publié: (2025)
par: Li, Pengna, et autres
Publié: (2025)
Multi-scale Latent Point Consistency Models for 3D Shape Generation
par: Du, Bi'an, et autres
Publié: (2024)
par: Du, Bi'an, et autres
Publié: (2024)
GuidedRec: Guiding Ill-Posed Unsupervised Volumetric Recovery
par: Cafaro, Alexandre, et autres
Publié: (2024)
par: Cafaro, Alexandre, et autres
Publié: (2024)
STMI: Segmentation-Guided Token Modulation with Cross-Modal Hypergraph Interaction for Multi-Modal Object Re-Identification
par: Xu, Xingguo, et autres
Publié: (2026)
par: Xu, Xingguo, et autres
Publié: (2026)
Unlocking Multi-Spectral Data for Multi-Modal Models with Guided Inputs and Chain-of-Thought Reasoning
par: Kim, Dahun, et autres
Publié: (2026)
par: Kim, Dahun, et autres
Publié: (2026)
Patient4D: Temporally Consistent Patient Body Mesh Recovery from Monocular Operating Room Video
par: Tu, Mingxiao, et autres
Publié: (2026)
par: Tu, Mingxiao, et autres
Publié: (2026)
NumGrad-Pull: Numerical Gradient Guided Tri-plane Representation for Surface Reconstruction from Point Clouds
par: Cui, Ruikai, et autres
Publié: (2024)
par: Cui, Ruikai, et autres
Publié: (2024)
Preserving Topological and Geometric Embeddings for Point Cloud Recovery
par: Zhou, Kaiyue, et autres
Publié: (2025)
par: Zhou, Kaiyue, et autres
Publié: (2025)
PointNorm-Net: Self-Supervised Normal Prediction of 3D Point Clouds via Multi-Modal Distribution Estimation
par: Zhang, Jie, et autres
Publié: (2023)
par: Zhang, Jie, et autres
Publié: (2023)
Optimize the Unseen -- Fast NeRF Cleanup with Free Space Prior
par: Segre, Leo, et autres
Publié: (2024)
par: Segre, Leo, et autres
Publié: (2024)
VF-NeRF: Viewshed Fields for Rigid NeRF Registration
par: Segre, Leo, et autres
Publié: (2024)
par: Segre, Leo, et autres
Publié: (2024)
Documents similaires
-
Learning to See Inside Opaque Liquid Containers using Speckle Vibrometry
par: Kichler, Matan, et autres
Publié: (2025) -
Cross-Modal Knowledge Distillation from Spatial Transcriptomics to Histology
par: Hizmi, Arbel, et autres
Publié: (2026) -
DINO-Tracker: Taming DINO for Self-Supervised Point Tracking in a Single Video
par: Tumanyan, Narek, et autres
Publié: (2024) -
CapeX: Category-Agnostic Pose Estimation from Textual Point Explanation
par: Rusanovsky, Matan, et autres
Publié: (2024) -
What's in the Image? A Deep-Dive into the Vision of Vision Language Models
par: Kaduri, Omri, et autres
Publié: (2024)