Mask-Weighted Spatial Likelihood Coding for Speaker-Independent Joint Localization and Mask Estimation
Fuente:
arXiv
Salvato in:
| Autori principali: | Kienegger, Jakob, Mannanova, Alina, Gerkmann, Timo |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Self-Steering Deep Non-Linear Spatially Selective Filters for Efficient Extraction of Moving Speakers under Weak Guidance
di: Kienegger, Jakob, et al.
Pubblicazione: (2025)
di: Kienegger, Jakob, et al.
Pubblicazione: (2025)
Adaptive Rotary Steering with Joint Autoregression for Robust Extraction of Closely Moving Speakers in Dynamic Scenarios
di: Kienegger, Jakob, et al.
Pubblicazione: (2026)
di: Kienegger, Jakob, et al.
Pubblicazione: (2026)
Autoregressive Guidance of Deep Spatially Selective Filters using Bayesian Tracking for Efficient Extraction of Moving Speakers
di: Kienegger, Jakob, et al.
Pubblicazione: (2026)
di: Kienegger, Jakob, et al.
Pubblicazione: (2026)
Steering Deep Non-Linear Spatially Selective Filters for Weakly Guided Extraction of Moving Speakers in Dynamic Scenarios
di: Kienegger, Jakob, et al.
Pubblicazione: (2025)
di: Kienegger, Jakob, et al.
Pubblicazione: (2025)
An Analysis of Joint Nonlinear Spatial Filtering for Spatial Aliasing Reduction
di: Mannanova, Alina, et al.
Pubblicazione: (2025)
di: Mannanova, Alina, et al.
Pubblicazione: (2025)
Multi-channel Speech Separation Using Spatially Selective Deep Non-linear Filters
di: Tesch, Kristina, et al.
Pubblicazione: (2023)
di: Tesch, Kristina, et al.
Pubblicazione: (2023)
Unsupervised Blind Joint Dereverberation and Room Acoustics Estimation with Diffusion Models
di: Lemercier, Jean-Marie, et al.
Pubblicazione: (2024)
di: Lemercier, Jean-Marie, et al.
Pubblicazione: (2024)
An Analysis of the Variance of Diffusion-based Speech Enhancement
di: Lay, Bunlong, et al.
Pubblicazione: (2024)
di: Lay, Bunlong, et al.
Pubblicazione: (2024)
Are Modern Speech Enhancement Systems Vulnerable to Adversarial Attacks?
di: Makarov, Rostislav, et al.
Pubblicazione: (2025)
di: Makarov, Rostislav, et al.
Pubblicazione: (2025)
Bone-conduction Guided Multimodal Speech Enhancement with Conditional Diffusion Models
di: Khanagha, Sina, et al.
Pubblicazione: (2026)
di: Khanagha, Sina, et al.
Pubblicazione: (2026)
HRTF Estimation using a Score-based Prior
di: Thuillier, Etienne, et al.
Pubblicazione: (2024)
di: Thuillier, Etienne, et al.
Pubblicazione: (2024)
LMD: A Learnable Mask Network to Detect Adversarial Examples for Speaker Verification
di: Chen, Xing, et al.
Pubblicazione: (2022)
di: Chen, Xing, et al.
Pubblicazione: (2022)
Real-Time Streaming Mel Vocoding with Generative Flow Matching
di: Welker, Simon, et al.
Pubblicazione: (2025)
di: Welker, Simon, et al.
Pubblicazione: (2025)
The PESQetarian: On the Relevance of Goodhart's Law for Speech Enhancement
di: de Oliveira, Danilo, et al.
Pubblicazione: (2024)
di: de Oliveira, Danilo, et al.
Pubblicazione: (2024)
Wind Noise Reduction with a Diffusion-based Stochastic Regeneration Model
di: Lemercier, Jean-Marie, et al.
Pubblicazione: (2023)
di: Lemercier, Jean-Marie, et al.
Pubblicazione: (2023)
StoRM: A Diffusion-based Stochastic Regeneration Model for Speech Enhancement and Dereverberation
di: Lemercier, Jean-Marie, et al.
Pubblicazione: (2022)
di: Lemercier, Jean-Marie, et al.
Pubblicazione: (2022)
Diffusion Buffer for Online Generative Speech Enhancement
di: Lay, Bunlong, et al.
Pubblicazione: (2025)
di: Lay, Bunlong, et al.
Pubblicazione: (2025)
wav2pos: Sound Source Localization using Masked Autoencoders
di: Berg, Axel, et al.
Pubblicazione: (2024)
di: Berg, Axel, et al.
Pubblicazione: (2024)
BUDDy: Single-Channel Blind Unsupervised Dereverberation with Diffusion Models
di: Moliner, Eloi, et al.
Pubblicazione: (2024)
di: Moliner, Eloi, et al.
Pubblicazione: (2024)
Speech Enhancement and Dereverberation with Diffusion-based Generative Models
di: Richter, Julius, et al.
Pubblicazione: (2022)
di: Richter, Julius, et al.
Pubblicazione: (2022)
Non-intrusive Speech Quality Assessment with Diffusion Models Trained on Clean Speech
di: de Oliveira, Danilo, et al.
Pubblicazione: (2024)
di: de Oliveira, Danilo, et al.
Pubblicazione: (2024)
Diffusion Models for Audio Restoration
di: Lemercier, Jean-Marie, et al.
Pubblicazione: (2024)
di: Lemercier, Jean-Marie, et al.
Pubblicazione: (2024)
Can Masked Autoencoders Also Listen to Birds?
di: Rauch, Lukas, et al.
Pubblicazione: (2025)
di: Rauch, Lukas, et al.
Pubblicazione: (2025)
From Diet to Free Lunch: Estimating Auxiliary Signal Properties using Dynamic Pruning Masks in Speech Enhancement Networks
di: Miccini, Riccardo, et al.
Pubblicazione: (2026)
di: Miccini, Riccardo, et al.
Pubblicazione: (2026)
Discrete Unit based Masking for Improving Disentanglement in Voice Conversion
di: Lee, Philip H., et al.
Pubblicazione: (2024)
di: Lee, Philip H., et al.
Pubblicazione: (2024)
Text-Independent Speaker Identification Using Audio Looping With Margin Based Loss Functions
di: Garcia, Elliot Q C, et al.
Pubblicazione: (2025)
di: Garcia, Elliot Q C, et al.
Pubblicazione: (2025)
Investigating Confidence Estimation Measures for Speaker Diarization
di: Chowdhury, Anurag, et al.
Pubblicazione: (2024)
di: Chowdhury, Anurag, et al.
Pubblicazione: (2024)
EARS: An Anechoic Fullband Speech Dataset Benchmarked for Speech Enhancement and Dereverberation
di: Richter, Julius, et al.
Pubblicazione: (2024)
di: Richter, Julius, et al.
Pubblicazione: (2024)
Single and Few-step Diffusion for Generative Speech Enhancement
di: Lay, Bunlong, et al.
Pubblicazione: (2023)
di: Lay, Bunlong, et al.
Pubblicazione: (2023)
Improving Speaker-independent Speech Emotion Recognition Using Dynamic Joint Distribution Adaptation
di: Lu, Cheng, et al.
Pubblicazione: (2024)
di: Lu, Cheng, et al.
Pubblicazione: (2024)
Maximum Likelihood Estimation of the Direction of Sound In A Reverberant Noisy Environment
di: Mansour, Mohamed F.
Pubblicazione: (2024)
di: Mansour, Mohamed F.
Pubblicazione: (2024)
ReverbFX: A Dataset of Room Impulse Responses Derived from Reverb Effect Plugins for Singing Voice Dereverberation
di: Richter, Julius, et al.
Pubblicazione: (2025)
di: Richter, Julius, et al.
Pubblicazione: (2025)
An Experimental Study on Joint Modeling for Sound Event Localization and Detection with Source Distance Estimation
di: Dong, Yuxuan, et al.
Pubblicazione: (2025)
di: Dong, Yuxuan, et al.
Pubblicazione: (2025)
ControlSpeech: Towards Simultaneous and Independent Zero-shot Speaker Cloning and Zero-shot Language Style Control
di: Ji, Shengpeng, et al.
Pubblicazione: (2024)
di: Ji, Shengpeng, et al.
Pubblicazione: (2024)
MaskGCT: Zero-Shot Text-to-Speech with Masked Generative Codec Transformer
di: Wang, Yuancheng, et al.
Pubblicazione: (2024)
di: Wang, Yuancheng, et al.
Pubblicazione: (2024)
BACHI: Boundary-Aware Symbolic Chord Recognition Through Masked Iterative Decoding on Pop and Classical Music
di: Yao, Mingyang, et al.
Pubblicazione: (2025)
di: Yao, Mingyang, et al.
Pubblicazione: (2025)
Investigating Training Objectives for Generative Speech Enhancement
di: Richter, Julius, et al.
Pubblicazione: (2024)
di: Richter, Julius, et al.
Pubblicazione: (2024)
Do We Need EMA for Diffusion-Based Speech Enhancement? Toward a Magnitude-Preserving Network Architecture
di: Richter, Julius, et al.
Pubblicazione: (2025)
di: Richter, Julius, et al.
Pubblicazione: (2025)
Adversarial Speaker Distillation for Countermeasure Model on Automatic Speaker Verification
di: Liao, Yen-Lun, et al.
Pubblicazione: (2022)
di: Liao, Yen-Lun, et al.
Pubblicazione: (2022)
HiddenSpeaker: Generate Imperceptible Unlearnable Audios for Speaker Verification System
di: Zhang, Zhisheng, et al.
Pubblicazione: (2024)
di: Zhang, Zhisheng, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Self-Steering Deep Non-Linear Spatially Selective Filters for Efficient Extraction of Moving Speakers under Weak Guidance
di: Kienegger, Jakob, et al.
Pubblicazione: (2025) -
Adaptive Rotary Steering with Joint Autoregression for Robust Extraction of Closely Moving Speakers in Dynamic Scenarios
di: Kienegger, Jakob, et al.
Pubblicazione: (2026) -
Autoregressive Guidance of Deep Spatially Selective Filters using Bayesian Tracking for Efficient Extraction of Moving Speakers
di: Kienegger, Jakob, et al.
Pubblicazione: (2026) -
Steering Deep Non-Linear Spatially Selective Filters for Weakly Guided Extraction of Moving Speakers in Dynamic Scenarios
di: Kienegger, Jakob, et al.
Pubblicazione: (2025) -
An Analysis of Joint Nonlinear Spatial Filtering for Spatial Aliasing Reduction
di: Mannanova, Alina, et al.
Pubblicazione: (2025)