Efficient and Microphone-Fault-Tolerant 3D Sound Source Localization
Fuente:
arXiv
Salvato in:
| Autori principali: | Yang, Yiyuan, Xu, Shitong, Trigoni, Niki, Markham, Andrew |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Pre-training Feature Guided Diffusion Model for Speech Enhancement
di: Yang, Yiyuan, et al.
Pubblicazione: (2024)
di: Yang, Yiyuan, et al.
Pubblicazione: (2024)
Target Speaker Extraction through Comparing Noisy Positive and Negative Audio Enrollments
di: Xu, Shitong, et al.
Pubblicazione: (2025)
di: Xu, Shitong, et al.
Pubblicazione: (2025)
SPEAR: Receiver-to-Receiver Acoustic Neural Warping Field
di: He, Yuhang, et al.
Pubblicazione: (2024)
di: He, Yuhang, et al.
Pubblicazione: (2024)
SoundLoc3D: Invisible 3D Sound Source Localization and Classification Using a Multimodal RGB-D Acoustic Camera
di: He, Yuhang, et al.
Pubblicazione: (2024)
di: He, Yuhang, et al.
Pubblicazione: (2024)
Epic-Sounds: A Large-scale Dataset of Actions That Sound
di: Huh, Jaesung, et al.
Pubblicazione: (2023)
di: Huh, Jaesung, et al.
Pubblicazione: (2023)
SHAMaNS: Sound Localization with Hybrid Alpha-Stable Spatial Measure and Neural Steerer
di: Di Carlo, Diego, et al.
Pubblicazione: (2025)
di: Di Carlo, Diego, et al.
Pubblicazione: (2025)
Microphone Conversion: Mitigating Device Variability in Sound Event Classification
di: Ryu, Myeonghoon, et al.
Pubblicazione: (2024)
di: Ryu, Myeonghoon, et al.
Pubblicazione: (2024)
Audio Simulation for Sound Source Localization in Virtual Evironment
di: Di Yuan, Yi, et al.
Pubblicazione: (2024)
di: Di Yuan, Yi, et al.
Pubblicazione: (2024)
Music Source Restoration
di: Zang, Yongyi, et al.
Pubblicazione: (2025)
di: Zang, Yongyi, et al.
Pubblicazione: (2025)
DOA-Aware Audio-Visual Self-Supervised Learning for Sound Event Localization and Detection
di: Fujita, Yoto, et al.
Pubblicazione: (2024)
di: Fujita, Yoto, et al.
Pubblicazione: (2024)
Dual Knowledge Distillation for Efficient Sound Event Detection
di: Xiao, Yang, et al.
Pubblicazione: (2024)
di: Xiao, Yang, et al.
Pubblicazione: (2024)
Let There Be Sound: Reconstructing High Quality Speech from Silent Videos
di: Kim, Ji-Hoon, et al.
Pubblicazione: (2023)
di: Kim, Ji-Hoon, et al.
Pubblicazione: (2023)
Hybrid Disagreement-Diversity Active Learning for Bioacoustic Sound Event Detection
di: Zhang, Shiqi, et al.
Pubblicazione: (2025)
di: Zhang, Shiqi, et al.
Pubblicazione: (2025)
wav2pos: Sound Source Localization using Masked Autoencoders
di: Berg, Axel, et al.
Pubblicazione: (2024)
di: Berg, Axel, et al.
Pubblicazione: (2024)
Learning Source Disentanglement in Neural Audio Codec
di: Bie, Xiaoyu, et al.
Pubblicazione: (2024)
di: Bie, Xiaoyu, et al.
Pubblicazione: (2024)
TACNET: Temporal Audio Source Counting Network
di: Ahmadnejad, Amirreza, et al.
Pubblicazione: (2023)
di: Ahmadnejad, Amirreza, et al.
Pubblicazione: (2023)
A Conditioned UNet for Music Source Separation
di: O'Hanlon, Ken, et al.
Pubblicazione: (2025)
di: O'Hanlon, Ken, et al.
Pubblicazione: (2025)
MIMII-Agent: Leveraging LLMs with Function Calling for Relative Evaluation of Anomalous Sound Detection
di: Purohit, Harsh, et al.
Pubblicazione: (2025)
di: Purohit, Harsh, et al.
Pubblicazione: (2025)
Training-Free Multi-Step Audio Source Separation
di: Zang, Yongyi, et al.
Pubblicazione: (2025)
di: Zang, Yongyi, et al.
Pubblicazione: (2025)
On Temporal Guidance and Iterative Refinement in Audio Source Separation
di: Morocutti, Tobias, et al.
Pubblicazione: (2025)
di: Morocutti, Tobias, et al.
Pubblicazione: (2025)
Geometry-Aware Optimization for Respiratory Sound Classification: Enhancing Sensitivity with SAM-Optimized Audio Spectrogram Transformers
di: Işık, Atakan, et al.
Pubblicazione: (2025)
di: Işık, Atakan, et al.
Pubblicazione: (2025)
Text-Queried Audio Source Separation via Hierarchical Modeling
di: Yin, Xinlei, et al.
Pubblicazione: (2025)
di: Yin, Xinlei, et al.
Pubblicazione: (2025)
AU-Harness: An Open-Source Toolkit for Holistic Evaluation of Audio LLMs
di: Nguyen, Hoang, et al.
Pubblicazione: (2025)
di: Nguyen, Hoang, et al.
Pubblicazione: (2025)
Single-Microphone-Based Sound Source Localization for Mobile Robots in Reverberant Environments
di: Wang, Jiang, et al.
Pubblicazione: (2025)
di: Wang, Jiang, et al.
Pubblicazione: (2025)
Facing the Music: Tackling Singing Voice Separation in Cinematic Audio Source Separation
di: Watcharasupat, Karn N., et al.
Pubblicazione: (2024)
di: Watcharasupat, Karn N., et al.
Pubblicazione: (2024)
SELD-Mamba: Selective State-Space Model for Sound Event Localization and Detection with Source Distance Estimation
di: Mu, Da, et al.
Pubblicazione: (2024)
di: Mu, Da, et al.
Pubblicazione: (2024)
Leveraging Spatial Cues from Cochlear Implant Microphones to Efficiently Enhance Speech Separation in Real-World Listening Scenes
di: Olalere, Feyisayo, et al.
Pubblicazione: (2025)
di: Olalere, Feyisayo, et al.
Pubblicazione: (2025)
DisMix: Disentangling Mixtures of Musical Instruments for Source-level Pitch and Timbre Manipulation
di: Luo, Yin-Jyun, et al.
Pubblicazione: (2024)
di: Luo, Yin-Jyun, et al.
Pubblicazione: (2024)
An Experimental Study on Joint Modeling for Sound Event Localization and Detection with Source Distance Estimation
di: Dong, Yuxuan, et al.
Pubblicazione: (2025)
di: Dong, Yuxuan, et al.
Pubblicazione: (2025)
Robust COVID-19 Detection from Cough Sounds using Deep Neural Decision Tree and Forest: A Comprehensive Cross-Datasets Evaluation
di: Islam, Rofiqul, et al.
Pubblicazione: (2025)
di: Islam, Rofiqul, et al.
Pubblicazione: (2025)
D3RM: A Discrete Denoising Diffusion Refinement Model for Piano Transcription
di: Kim, Hounsu, et al.
Pubblicazione: (2025)
di: Kim, Hounsu, et al.
Pubblicazione: (2025)
PhaseCoder: Microphone Geometry-Agnostic Spatial Audio Understanding for Multimodal LLMs
di: Dementyev, Artem, et al.
Pubblicazione: (2026)
di: Dementyev, Artem, et al.
Pubblicazione: (2026)
Multi-Microphone and Multi-Modal Emotion Recognition in Reverberant Environment
di: Cohen, Ohad, et al.
Pubblicazione: (2024)
di: Cohen, Ohad, et al.
Pubblicazione: (2024)
Weakly Supervised Detection and Temporal Localization of Whale Calls in Long-Duration Bioacoustic Data
di: Nihal, Ragib Amin, et al.
Pubblicazione: (2025)
di: Nihal, Ragib Amin, et al.
Pubblicazione: (2025)
SpatialEmb: Extract and Encode Spatial Information for 1-Stage Multi-channel Multi-speaker ASR on Arbitrary Microphone Arrays
di: Shao, Yiwen, et al.
Pubblicazione: (2026)
di: Shao, Yiwen, et al.
Pubblicazione: (2026)
Efficient Multi-Model Fusion with Adversarial Complementary Representation Learning
di: Kang, Zuheng, et al.
Pubblicazione: (2024)
di: Kang, Zuheng, et al.
Pubblicazione: (2024)
Challenge on Sound Scene Synthesis: Evaluating Text-to-Audio Generation
di: Lee, Junwon, et al.
Pubblicazione: (2024)
di: Lee, Junwon, et al.
Pubblicazione: (2024)
KAD: No More FAD! An Effective and Efficient Evaluation Metric for Audio Generation
di: Chung, Yoonjin, et al.
Pubblicazione: (2025)
di: Chung, Yoonjin, et al.
Pubblicazione: (2025)
LiteASR: Efficient Automatic Speech Recognition with Low-Rank Approximation
di: Kamahori, Keisuke, et al.
Pubblicazione: (2025)
di: Kamahori, Keisuke, et al.
Pubblicazione: (2025)
Gen-A: Generalizing Ambisonics Neural Encoding to Unseen Microphone Arrays
di: Heikkinen, Mikko, et al.
Pubblicazione: (2025)
di: Heikkinen, Mikko, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Pre-training Feature Guided Diffusion Model for Speech Enhancement
di: Yang, Yiyuan, et al.
Pubblicazione: (2024) -
Target Speaker Extraction through Comparing Noisy Positive and Negative Audio Enrollments
di: Xu, Shitong, et al.
Pubblicazione: (2025) -
SPEAR: Receiver-to-Receiver Acoustic Neural Warping Field
di: He, Yuhang, et al.
Pubblicazione: (2024) -
SoundLoc3D: Invisible 3D Sound Source Localization and Classification Using a Multimodal RGB-D Acoustic Camera
di: He, Yuhang, et al.
Pubblicazione: (2024) -
Epic-Sounds: A Large-scale Dataset of Actions That Sound
di: Huh, Jaesung, et al.
Pubblicazione: (2023)