Sim2Real Transfer for Audio-Visual Navigation with Frequency-Adaptive Acoustic Field Prediction
Fuente:
arXiv
Salvato in:
| Autori principali: | Chen, Changan, Ramos, Jordi, Tomar, Anshul, Grauman, Kristen |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
ActiveRIR: Active Audio-Visual Exploration for Acoustic Environment Modeling
di: Somayazulu, Arjun, et al.
Pubblicazione: (2024)
di: Somayazulu, Arjun, et al.
Pubblicazione: (2024)
Disentangled Acoustic Fields For Multimodal Physical Scene Understanding
di: Yin, Jie, et al.
Pubblicazione: (2024)
di: Yin, Jie, et al.
Pubblicazione: (2024)
Audio Spatially-Guided Fusion for Audio-Visual Navigation
di: Zhou, Xinyu, et al.
Pubblicazione: (2026)
di: Zhou, Xinyu, et al.
Pubblicazione: (2026)
On Adversarial Attacks In Acoustic Drone Localization
di: Shor, Tamir, et al.
Pubblicazione: (2025)
di: Shor, Tamir, et al.
Pubblicazione: (2025)
Generalizable Audio-Visual Navigation via Binaural Difference Attention and Action Transition Prediction
di: Li, Jia, et al.
Pubblicazione: (2026)
di: Li, Jia, et al.
Pubblicazione: (2026)
Learning Spatial Features from Audio-Visual Correspondence in Egocentric Videos
di: Majumder, Sagnik, et al.
Pubblicazione: (2023)
di: Majumder, Sagnik, et al.
Pubblicazione: (2023)
Soft Acoustic Curvature Sensor: Design and Development
di: Sofla, Mohammad Sheikh, et al.
Pubblicazione: (2024)
di: Sofla, Mohammad Sheikh, et al.
Pubblicazione: (2024)
Spatial-Aware Conditioned Fusion for Audio-Visual Navigation
di: Wu, Shaohang, et al.
Pubblicazione: (2026)
di: Wu, Shaohang, et al.
Pubblicazione: (2026)
AIM: Acoustic Inertial Measurement for Indoor Drone Localization and Tracking
di: Sun, Yimiao, et al.
Pubblicazione: (2025)
di: Sun, Yimiao, et al.
Pubblicazione: (2025)
SmoothSync: Dual-Stream Diffusion Transformers for Jitter-Robust Beat-Synchronized Gesture Generation from Quantized Audio
di: Jiang, Yujiao, et al.
Pubblicazione: (2026)
di: Jiang, Yujiao, et al.
Pubblicazione: (2026)
Reliability-Aware Geometric Fusion for Robust Audio-Visual Navigation
di: Liu, Teng, et al.
Pubblicazione: (2026)
di: Liu, Teng, et al.
Pubblicazione: (2026)
SonicSense: Object Perception from In-Hand Acoustic Vibration
di: Liu, Jiaxun, et al.
Pubblicazione: (2024)
di: Liu, Jiaxun, et al.
Pubblicazione: (2024)
Audio Array-Based 3D UAV Trajectory Estimation with LiDAR Pseudo-Labeling
di: Lei, Allen, et al.
Pubblicazione: (2024)
di: Lei, Allen, et al.
Pubblicazione: (2024)
Evaluating Hallucinations in Audio-Visual Multimodal LLMs with Spoken Queries under Diverse Acoustic Conditions
di: Park, Hansol, et al.
Pubblicazione: (2025)
di: Park, Hansol, et al.
Pubblicazione: (2025)
SoundingActions: Learning How Actions Sound from Narrated Egocentric Videos
di: Chen, Changan, et al.
Pubblicazione: (2024)
di: Chen, Changan, et al.
Pubblicazione: (2024)
AND: Audio Network Dissection for Interpreting Deep Acoustic Models
di: Wu, Tung-Yu, et al.
Pubblicazione: (2024)
di: Wu, Tung-Yu, et al.
Pubblicazione: (2024)
Action2Sound: Ambient-Aware Generation of Action Sounds from Egocentric Videos
di: Chen, Changan, et al.
Pubblicazione: (2024)
di: Chen, Changan, et al.
Pubblicazione: (2024)
Real Acoustic Fields: An Audio-Visual Room Acoustics Dataset and Benchmark
di: Chen, Ziyang, et al.
Pubblicazione: (2024)
di: Chen, Ziyang, et al.
Pubblicazione: (2024)
AAT: Adapting Audio Transformer for Various Acoustics Recognition Tasks
di: Liang, Yun, et al.
Pubblicazione: (2024)
di: Liang, Yun, et al.
Pubblicazione: (2024)
Audio Atlas: Visualizing and Exploring Audio Datasets
di: Lanzendörfer, Luca A., et al.
Pubblicazione: (2024)
di: Lanzendörfer, Luca A., et al.
Pubblicazione: (2024)
Stable Audio Open
di: Evans, Zach, et al.
Pubblicazione: (2024)
di: Evans, Zach, et al.
Pubblicazione: (2024)
Variational Bayesian Adaptive Learning of Deep Latent Variables for Acoustic Knowledge Transfer
di: Hu, Hu, et al.
Pubblicazione: (2025)
di: Hu, Hu, et al.
Pubblicazione: (2025)
DEAF: A Benchmark for Diagnostic Evaluation of Acoustic Faithfulness in Audio Language Models
di: Xiong, Jiaqi, et al.
Pubblicazione: (2026)
di: Xiong, Jiaqi, et al.
Pubblicazione: (2026)
Neural Speech Tracking in a Virtual Acoustic Environment: Audio-Visual Benefit for Unscripted Continuous Speech
di: Daeglau, Mareike, et al.
Pubblicazione: (2025)
di: Daeglau, Mareike, et al.
Pubblicazione: (2025)
SPEAR: Receiver-to-Receiver Acoustic Neural Warping Field
di: He, Yuhang, et al.
Pubblicazione: (2024)
di: He, Yuhang, et al.
Pubblicazione: (2024)
LoSATok: Low-dimensional Semantic-Acoustic Tokenizer for Cross-Domain Audio Understanding and Generation
di: Zhang, Zhisheng, et al.
Pubblicazione: (2026)
di: Zhang, Zhisheng, et al.
Pubblicazione: (2026)
LLM-Guided Reinforcement Learning for Audio-Visual Speech Enhancement
di: Chen, Chih-Ning, et al.
Pubblicazione: (2026)
di: Chen, Chih-Ning, et al.
Pubblicazione: (2026)
Past, Present, and Future of Spatial Audio and Room Acoustics
di: Koyama, Shoichi, et al.
Pubblicazione: (2025)
di: Koyama, Shoichi, et al.
Pubblicazione: (2025)
Audio Signal Processing Using Time Domain Mel-Frequency Wavelet Coefficient
di: Sebastian, Rinku, et al.
Pubblicazione: (2025)
di: Sebastian, Rinku, et al.
Pubblicazione: (2025)
Unveiling Visual Biases in Audio-Visual Localization Benchmarks
di: Chen, Liangyu, et al.
Pubblicazione: (2024)
di: Chen, Liangyu, et al.
Pubblicazione: (2024)
Resounding Acoustic Fields with Reciprocity
di: Lan, Zitong, et al.
Pubblicazione: (2025)
di: Lan, Zitong, et al.
Pubblicazione: (2025)
NAT: Neural Acoustic Transfer for Interactive Scenes in Real Time
di: Jin, Xutong, et al.
Pubblicazione: (2025)
di: Jin, Xutong, et al.
Pubblicazione: (2025)
Efficient Autoregressive Audio Modeling via Next-Scale Prediction
di: Qiu, Kai, et al.
Pubblicazione: (2024)
di: Qiu, Kai, et al.
Pubblicazione: (2024)
Hyperdimensional Intelligent Sensing for Efficient Real-Time Audio Processing on Extreme Edge
di: Yun, Sanggeon, et al.
Pubblicazione: (2025)
di: Yun, Sanggeon, et al.
Pubblicazione: (2025)
Physics-Informed Transfer Learning for Data-Driven Sound Source Reconstruction in Near-Field Acoustic Holography
di: Luan, Xinmeng, et al.
Pubblicazione: (2025)
di: Luan, Xinmeng, et al.
Pubblicazione: (2025)
Structural and Statistical Audio Texture Knowledge Distillation for Acoustic Classification
di: Ritu, Jarin, et al.
Pubblicazione: (2025)
di: Ritu, Jarin, et al.
Pubblicazione: (2025)
CoPlay: Audio-agnostic Cognitive Scaling for Acoustic Sensing
di: Li, Yin, et al.
Pubblicazione: (2024)
di: Li, Yin, et al.
Pubblicazione: (2024)
SoundCompass: Navigating Target Sound Extraction With Effective Directional Clue Integration In Complex Acoustic Scenes
di: Choi, Dayun, et al.
Pubblicazione: (2025)
di: Choi, Dayun, et al.
Pubblicazione: (2025)
Time-Frequency-Based Attention Cache Memory Model for Real-Time Speech Separation
di: Chen, Guo, et al.
Pubblicazione: (2025)
di: Chen, Guo, et al.
Pubblicazione: (2025)
The Multimodal Information Based Speech Processing (MISP) 2025 Challenge: Audio-Visual Diarization and Recognition
di: Gao, Ming, et al.
Pubblicazione: (2025)
di: Gao, Ming, et al.
Pubblicazione: (2025)
Documenti analoghi
-
ActiveRIR: Active Audio-Visual Exploration for Acoustic Environment Modeling
di: Somayazulu, Arjun, et al.
Pubblicazione: (2024) -
Disentangled Acoustic Fields For Multimodal Physical Scene Understanding
di: Yin, Jie, et al.
Pubblicazione: (2024) -
Audio Spatially-Guided Fusion for Audio-Visual Navigation
di: Zhou, Xinyu, et al.
Pubblicazione: (2026) -
On Adversarial Attacks In Acoustic Drone Localization
di: Shor, Tamir, et al.
Pubblicazione: (2025) -
Generalizable Audio-Visual Navigation via Binaural Difference Attention and Action Transition Prediction
di: Li, Jia, et al.
Pubblicazione: (2026)