GAN-Based Multi-Microphone Spatial Target Speaker Extraction
Fuente:
arXiv
Salvato in:
| Autori principali: | Shetu, Shrishti Saha, Habets, Emanuël A. P., Brendel, Andreas |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Leveraging Discriminative Latent Representations for Conditioning GAN-Based Speech Enhancement
di: Shetu, Shrishti Saha, et al.
Pubblicazione: (2025)
di: Shetu, Shrishti Saha, et al.
Pubblicazione: (2025)
GAN-Based Speech Enhancement for Low SNR Using Latent Feature Conditioning
di: Shetu, Shrishti Saha, et al.
Pubblicazione: (2024)
di: Shetu, Shrishti Saha, et al.
Pubblicazione: (2024)
Comparative Analysis Of Discriminative Deep Learning-Based Noise Reduction Methods In Low SNR Scenarios
di: Shetu, Shrishti Saha, et al.
Pubblicazione: (2024)
di: Shetu, Shrishti Saha, et al.
Pubblicazione: (2024)
Align-ULCNet: Towards Low-Complexity and Robust Acoustic Echo and Noise Reduction
di: Shetu, Shrishti Saha, et al.
Pubblicazione: (2024)
di: Shetu, Shrishti Saha, et al.
Pubblicazione: (2024)
Low-Complexity Neural Wind Noise Reduction for Audio Recordings
di: Eftekhari, Hesam, et al.
Pubblicazione: (2025)
di: Eftekhari, Hesam, et al.
Pubblicazione: (2025)
Training Strategies for Modality Dropout Resilient Multi-Modal Target Speaker Extraction
di: Korse, Srikanth, et al.
Pubblicazione: (2025)
di: Korse, Srikanth, et al.
Pubblicazione: (2025)
A Hybrid Approach for Low-Complexity Joint Acoustic Echo and Noise Reduction
di: Shetu, Shrishti Saha, et al.
Pubblicazione: (2024)
di: Shetu, Shrishti Saha, et al.
Pubblicazione: (2024)
Ultra Low Complexity Deep Learning Based Noise Suppression
di: Shetu, Shrishti Saha, et al.
Pubblicazione: (2023)
di: Shetu, Shrishti Saha, et al.
Pubblicazione: (2023)
Room Impulse Response Completion Using Signal-Prediction Diffusion Models Conditioned on Simulated Early Reflections
di: Xu, Zeyu, et al.
Pubblicazione: (2026)
di: Xu, Zeyu, et al.
Pubblicazione: (2026)
Blind Acoustic Parameter Estimation Through Task-Agnostic Embeddings Using Latent Approximations
di: Götz, Philipp, et al.
Pubblicazione: (2024)
di: Götz, Philipp, et al.
Pubblicazione: (2024)
Neural Directional Filtering Using a Compact Microphone Array
di: Huang, Weilong, et al.
Pubblicazione: (2025)
di: Huang, Weilong, et al.
Pubblicazione: (2025)
Neural Directional Filtering: Far-Field Directivity Control With a Small Microphone Array
di: Wechsler, Julian, et al.
Pubblicazione: (2024)
di: Wechsler, Julian, et al.
Pubblicazione: (2024)
Sample Rate Offset Compensated Acoustic Echo Cancellation For Multi-Device Scenarios
di: Korse, Srikanth, et al.
Pubblicazione: (2025)
di: Korse, Srikanth, et al.
Pubblicazione: (2025)
Multi-View Based Audio Visual Target Speaker Extraction
di: Yang, Peijun, et al.
Pubblicazione: (2026)
di: Yang, Peijun, et al.
Pubblicazione: (2026)
NDF+: Joint Neural Directional Filtering and Diffuse Sound Extraction
di: Huang, Weilong, et al.
Pubblicazione: (2026)
di: Huang, Weilong, et al.
Pubblicazione: (2026)
Multi-Level Speaker Representation for Target Speaker Extraction
di: Zhang, Ke, et al.
Pubblicazione: (2024)
di: Zhang, Ke, et al.
Pubblicazione: (2024)
Stereo Reproduction in the Presence of Sample Rate Offsets
di: Korse, Srikanth, et al.
Pubblicazione: (2025)
di: Korse, Srikanth, et al.
Pubblicazione: (2025)
MC-LExt: Multi-Channel Target Speaker Extraction with Onset-Prompted Speaker Conditioning Mechanism
di: Ling, Tongtao, et al.
Pubblicazione: (2025)
di: Ling, Tongtao, et al.
Pubblicazione: (2025)
Flexible Multi-Channel Target Speaker Extraction Using Geometry-Conditioned Spatially Selective Non-linear Filters
di: Li, Jiatong, et al.
Pubblicazione: (2026)
di: Li, Jiatong, et al.
Pubblicazione: (2026)
Neural Ambisonic Encoding For Multi-Speaker Scenarios Using A Circular Microphone Array
di: Qiao, Yue, et al.
Pubblicazione: (2024)
di: Qiao, Yue, et al.
Pubblicazione: (2024)
Neural Directional Filtering with Configurable Directivity Pattern at Inference
di: Huang, Weilong, et al.
Pubblicazione: (2025)
di: Huang, Weilong, et al.
Pubblicazione: (2025)
Navigating PESQ: Up-to-Date Versions and Open Implementations
di: Torcoli, Matteo, et al.
Pubblicazione: (2025)
di: Torcoli, Matteo, et al.
Pubblicazione: (2025)
Acoustic Teleportation via Disentangled Neural Audio Codec Representations
di: Grundhuber, Philipp, et al.
Pubblicazione: (2025)
di: Grundhuber, Philipp, et al.
Pubblicazione: (2025)
Dynamic Slimmable Networks for Efficient Speech Separation
di: Elminshawi, Mohamed, et al.
Pubblicazione: (2025)
di: Elminshawi, Mohamed, et al.
Pubblicazione: (2025)
Adaptive Deterministic Flow Matching for Target Speaker Extraction
di: Hsieh, Tsun-An, et al.
Pubblicazione: (2025)
di: Hsieh, Tsun-An, et al.
Pubblicazione: (2025)
EvoTSE: Evolving Enrollment for Target Speaker Extraction
di: Liu, Zikai, et al.
Pubblicazione: (2026)
di: Liu, Zikai, et al.
Pubblicazione: (2026)
Data-driven Joint Detection and Localization of Acoustic Reflectors
di: Bicer, H. Nazim, et al.
Pubblicazione: (2024)
di: Bicer, H. Nazim, et al.
Pubblicazione: (2024)
Target Speaker Extraction with Curriculum Learning
di: Liu, Yun, et al.
Pubblicazione: (2024)
di: Liu, Yun, et al.
Pubblicazione: (2024)
Enhancing Target Speaker Extraction with Explicit Speaker Consistency Modeling
di: Wu, Shu, et al.
Pubblicazione: (2025)
di: Wu, Shu, et al.
Pubblicazione: (2025)
VoxATtack: A Multimodal Attack on Voice Anonymization Systems
di: Aloradi, Ahmad, et al.
Pubblicazione: (2025)
di: Aloradi, Ahmad, et al.
Pubblicazione: (2025)
Robust Speech Activity Detection in the Presence of Singing Voice
di: Grundhuber, Philipp, et al.
Pubblicazione: (2025)
di: Grundhuber, Philipp, et al.
Pubblicazione: (2025)
On the Relation Between Speech Quality and Quantized Latent Representations of Neural Codecs
di: Halimeh, Mhd Modar, et al.
Pubblicazione: (2025)
di: Halimeh, Mhd Modar, et al.
Pubblicazione: (2025)
TGIF: Talker Group-Informed Familiarization of Target Speaker Extraction
di: Hsieh, Tsun-An, et al.
Pubblicazione: (2025)
di: Hsieh, Tsun-An, et al.
Pubblicazione: (2025)
Detect, Attend and Extract: Keyword Guided Target Speaker Extraction
di: Li, Haoyu, et al.
Pubblicazione: (2026)
di: Li, Haoyu, et al.
Pubblicazione: (2026)
USEF-TSE: Universal Speaker Embedding Free Target Speaker Extraction
di: Zeng, Bang, et al.
Pubblicazione: (2024)
di: Zeng, Bang, et al.
Pubblicazione: (2024)
Multi-Channel Multi-Speaker ASR Using Target Speaker's Solo Segment
di: Shao, Yiwen, et al.
Pubblicazione: (2024)
di: Shao, Yiwen, et al.
Pubblicazione: (2024)
Improved Feature Extraction Network for Neuro-Oriented Target Speaker Extraction
di: Fan, Cunhang, et al.
Pubblicazione: (2025)
di: Fan, Cunhang, et al.
Pubblicazione: (2025)
Listen to Extract: Onset-Prompted Target Speaker Extraction
di: Shen, Pengjie, et al.
Pubblicazione: (2025)
di: Shen, Pengjie, et al.
Pubblicazione: (2025)
Binaural Target Speaker Extraction using Individualized HRTF
di: Ellinson, Yoav, et al.
Pubblicazione: (2025)
di: Ellinson, Yoav, et al.
Pubblicazione: (2025)
On the effectiveness of enrollment speech augmentation for Target Speaker Extraction
di: Li, Junjie, et al.
Pubblicazione: (2024)
di: Li, Junjie, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Leveraging Discriminative Latent Representations for Conditioning GAN-Based Speech Enhancement
di: Shetu, Shrishti Saha, et al.
Pubblicazione: (2025) -
GAN-Based Speech Enhancement for Low SNR Using Latent Feature Conditioning
di: Shetu, Shrishti Saha, et al.
Pubblicazione: (2024) -
Comparative Analysis Of Discriminative Deep Learning-Based Noise Reduction Methods In Low SNR Scenarios
di: Shetu, Shrishti Saha, et al.
Pubblicazione: (2024) -
Align-ULCNet: Towards Low-Complexity and Robust Acoustic Echo and Noise Reduction
di: Shetu, Shrishti Saha, et al.
Pubblicazione: (2024) -
Low-Complexity Neural Wind Noise Reduction for Audio Recordings
di: Eftekhari, Hesam, et al.
Pubblicazione: (2025)