Dependence on Early and Late Reverberation of Single-Channel Speaker Distance Estimation
Fuente:
arXiv
Salvato in:
| Autori principali: | Neri, Michael, Politis, Archontis, Virtanen, Tuomas |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Speaker Distance Estimation in Enclosures from Single-Channel Audio
di: Neri, Michael, et al.
Pubblicazione: (2024)
di: Neri, Michael, et al.
Pubblicazione: (2024)
Inter-Speaker Relative Cues for Text-Guided Target Speech Extraction
di: Dai, Wang, et al.
Pubblicazione: (2025)
di: Dai, Wang, et al.
Pubblicazione: (2025)
Moving Speaker Separation via Parallel Spectral-Spatial Processing
di: Wang, Yuzhu, et al.
Pubblicazione: (2026)
di: Wang, Yuzhu, et al.
Pubblicazione: (2026)
Attractor-Based Speech Separation of Multiple Utterances by Unknown Number of Speakers
di: Wang, Yuzhu, et al.
Pubblicazione: (2025)
di: Wang, Yuzhu, et al.
Pubblicazione: (2025)
Gaunt coefficients for complex and real spherical harmonics with applications to spherical array processing and Ambisonics
di: Politis, Archontis
Pubblicazione: (2024)
di: Politis, Archontis
Pubblicazione: (2024)
Neural Ambisonics encoding for compact irregular microphone arrays
di: Heikkinen, Mikko, et al.
Pubblicazione: (2024)
di: Heikkinen, Mikko, et al.
Pubblicazione: (2024)
Permutation Invariant Recurrent Neural Networks for Sound Source Tracking Applications
di: Diaz-Guerra, David, et al.
Pubblicazione: (2023)
di: Diaz-Guerra, David, et al.
Pubblicazione: (2023)
Discriminating real and synthetic super-resolved audio samples using embedding-based classifiers
di: Silaev, Mikhail, et al.
Pubblicazione: (2026)
di: Silaev, Mikhail, et al.
Pubblicazione: (2026)
Acoustic Simulation Framework for Multi-channel Replay Speech Detection
di: Neri, Michael, et al.
Pubblicazione: (2025)
di: Neri, Michael, et al.
Pubblicazione: (2025)
Multi-Utterance Speech Separation and Association Trained on Short Segments
di: Wang, Yuzhu, et al.
Pubblicazione: (2025)
di: Wang, Yuzhu, et al.
Pubblicazione: (2025)
Towards Improving Speaker Distance Estimation through Generative Impulse Response Augmentation
di: Ratnarajah, Anton, et al.
Pubblicazione: (2026)
di: Ratnarajah, Anton, et al.
Pubblicazione: (2026)
Evaluating the Temporal Detection Capability of Integrated Gradients Applied on Sound Classifier
di: Dumpis, Martynas, et al.
Pubblicazione: (2026)
di: Dumpis, Martynas, et al.
Pubblicazione: (2026)
Reverberation-based Features for Sound Event Localization and Detection with Distance Estimation
di: Berghi, Davide, et al.
Pubblicazione: (2025)
di: Berghi, Davide, et al.
Pubblicazione: (2025)
Gen-A: Generalizing Ambisonics Neural Encoding to Unseen Microphone Arrays
di: Heikkinen, Mikko, et al.
Pubblicazione: (2025)
di: Heikkinen, Mikko, et al.
Pubblicazione: (2025)
Inter-Speaker Relative Cues for Two-Stage Text-Guided Target Speech Extraction
di: Dai, Wang, et al.
Pubblicazione: (2026)
di: Dai, Wang, et al.
Pubblicazione: (2026)
U-DREAM: Unsupervised Dereverberation guided by a Reverberation Model
di: Bahrman, Louis, et al.
Pubblicazione: (2025)
di: Bahrman, Louis, et al.
Pubblicazione: (2025)
Score-informed Music Source Separation: Improving Synthetic-to-real Generalization in Classical Music
di: Tunturi, Eetu, et al.
Pubblicazione: (2025)
di: Tunturi, Eetu, et al.
Pubblicazione: (2025)
Towards Low-Latency Tracking of Multiple Speakers With Short-Context Speaker Embeddings
di: Iatariene, Taous, et al.
Pubblicazione: (2025)
di: Iatariene, Taous, et al.
Pubblicazione: (2025)
Multi-Channel Replay Speech Detection using Acoustic Maps
di: Neri, Michael, et al.
Pubblicazione: (2026)
di: Neri, Michael, et al.
Pubblicazione: (2026)
Impact of Microphone Array Mismatches to Learning-based Replay Speech Detection
di: Neri, Michael, et al.
Pubblicazione: (2025)
di: Neri, Michael, et al.
Pubblicazione: (2025)
Multi-channel Replay Speech Detection using an Adaptive Learnable Beamformer
di: Neri, Michael, et al.
Pubblicazione: (2025)
di: Neri, Michael, et al.
Pubblicazione: (2025)
Towards Spatial Audio Understanding via Question Answering
di: Sudarsanam, Parthasaarathy, et al.
Pubblicazione: (2025)
di: Sudarsanam, Parthasaarathy, et al.
Pubblicazione: (2025)
CrossSpeech++: Cross-lingual Speech Synthesis with Decoupled Language and Speaker Generation
di: Kim, Ji-Hoon, et al.
Pubblicazione: (2024)
di: Kim, Ji-Hoon, et al.
Pubblicazione: (2024)
Sound Event Detection and Localization with Distance Estimation
di: Krause, Daniel Aleksander, et al.
Pubblicazione: (2024)
di: Krause, Daniel Aleksander, et al.
Pubblicazione: (2024)
Reference Channel Selection by Multi-Channel Masking for End-to-End Multi-Channel Speech Enhancement
di: Dai, Wang, et al.
Pubblicazione: (2024)
di: Dai, Wang, et al.
Pubblicazione: (2024)
Single-stage TTS with Masked Audio Token Modeling and Semantic Knowledge Distillation
di: Gállego, Gerard I., et al.
Pubblicazione: (2024)
di: Gállego, Gerard I., et al.
Pubblicazione: (2024)
A Method for Capturing and Reproducing Directional Reverberation in Six Degrees of Freedom
di: Alary, Benoit, et al.
Pubblicazione: (2021)
di: Alary, Benoit, et al.
Pubblicazione: (2021)
Comparison of Frequency-Fusion Mechanisms for Binaural Direction-of-Arrival Estimation for Multiple Speakers
di: Fejgin, Daniel, et al.
Pubblicazione: (2024)
di: Fejgin, Daniel, et al.
Pubblicazione: (2024)
Hybrid Disagreement-Diversity Active Learning for Bioacoustic Sound Event Detection
di: Zhang, Shiqi, et al.
Pubblicazione: (2025)
di: Zhang, Shiqi, et al.
Pubblicazione: (2025)
Exploiting an External Microphone for Binaural RTF-Vector-Based Direction of Arrival Estimation for Multiple Speakers
di: Fejgin, Daniel, et al.
Pubblicazione: (2023)
di: Fejgin, Daniel, et al.
Pubblicazione: (2023)
Completing Sets of Prototype Transfer Functions for Subspace-based Direction of Arrival Estimation of Multiple Speakers
di: Fejgin, Daniel, et al.
Pubblicazione: (2025)
di: Fejgin, Daniel, et al.
Pubblicazione: (2025)
Directional Selective Fixed-Filter Active Noise Control Based on a Convolutional Neural Network in Reverberant Environments
di: Wang, Boxiang, et al.
Pubblicazione: (2026)
di: Wang, Boxiang, et al.
Pubblicazione: (2026)
FlexIO: Flexible Single- and Multi-Channel Speech Separation and Enhancement
di: Masuyama, Yoshiki, et al.
Pubblicazione: (2025)
di: Masuyama, Yoshiki, et al.
Pubblicazione: (2025)
SpeakerBeam-SS: Real-time Target Speaker Extraction with Lightweight Conv-TasNet and State Space Modeling
di: Sato, Hiroshi, et al.
Pubblicazione: (2024)
di: Sato, Hiroshi, et al.
Pubblicazione: (2024)
DeWinder: Single-Channel Wind Noise Reduction using Ultrasound Sensing
di: Yuan, Kuang, et al.
Pubblicazione: (2024)
di: Yuan, Kuang, et al.
Pubblicazione: (2024)
Tracking of Intermittent and Moving Speakers : Dataset and Metrics
di: Iatariene, Taous, et al.
Pubblicazione: (2025)
di: Iatariene, Taous, et al.
Pubblicazione: (2025)
Beyond Omnidirectional: Neural Ambisonics Encoding for Arbitrary Microphone Directivity Patterns using Cross-Attention
di: Heikkinen, Mikko, et al.
Pubblicazione: (2026)
di: Heikkinen, Mikko, et al.
Pubblicazione: (2026)
AI-Generated Music Detection in Broadcast Monitoring
di: López-Ayala, David, et al.
Pubblicazione: (2026)
di: López-Ayala, David, et al.
Pubblicazione: (2026)
Speech Enhancement Based on Drifting Models
di: Xu, Liang, et al.
Pubblicazione: (2026)
di: Xu, Liang, et al.
Pubblicazione: (2026)
Robust Generative Audio Quality Assessment: Disentangling Quality from Spurious Correlations
di: Huang, Kuan-Tang, et al.
Pubblicazione: (2026)
di: Huang, Kuan-Tang, et al.
Pubblicazione: (2026)
Documenti analoghi
-
Speaker Distance Estimation in Enclosures from Single-Channel Audio
di: Neri, Michael, et al.
Pubblicazione: (2024) -
Inter-Speaker Relative Cues for Text-Guided Target Speech Extraction
di: Dai, Wang, et al.
Pubblicazione: (2025) -
Moving Speaker Separation via Parallel Spectral-Spatial Processing
di: Wang, Yuzhu, et al.
Pubblicazione: (2026) -
Attractor-Based Speech Separation of Multiple Utterances by Unknown Number of Speakers
di: Wang, Yuzhu, et al.
Pubblicazione: (2025) -
Gaunt coefficients for complex and real spherical harmonics with applications to spherical array processing and Ambisonics
di: Politis, Archontis
Pubblicazione: (2024)