BERP: A Blind Estimator of Room Parameters for Single-Channel Noisy Speech Signals
Fuente:
arXiv
Salvato in:
| Autori principali: | Wang, Lijun, Lu, Yixian, Gao, Ziyan, Li, Kai, Huang, Jianqiang, Kong, Yuntao, Okada, Shogo |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Single-Channel Target Speech Extraction Utilizing Distance and Room Clues
di: Shi, Runwu, et al.
Pubblicazione: (2025)
di: Shi, Runwu, et al.
Pubblicazione: (2025)
SS-BRPE: Self-Supervised Blind Room Parameter Estimation Using Attention Mechanisms
di: Wang, Chunxi, et al.
Pubblicazione: (2024)
di: Wang, Chunxi, et al.
Pubblicazione: (2024)
DARAS: Dynamic Audio-Room Acoustic Synthesis for Blind Room Impulse Response Estimation
di: Wang, Chunxi, et al.
Pubblicazione: (2025)
di: Wang, Chunxi, et al.
Pubblicazione: (2025)
Improved Remixing Process for Domain Adaptation-Based Speech Enhancement by Mitigating Data Imbalance in Signal-to-Noise Ratio
di: Li, Li, et al.
Pubblicazione: (2024)
di: Li, Li, et al.
Pubblicazione: (2024)
A Fast and Lightweight Model for Causal Audio-Visual Speech Separation
di: Sang, Wendi, et al.
Pubblicazione: (2025)
di: Sang, Wendi, et al.
Pubblicazione: (2025)
Continual Test-time Adaptation for End-to-end Speech Recognition on Noisy Speech
di: Lin, Guan-Ting, et al.
Pubblicazione: (2024)
di: Lin, Guan-Ting, et al.
Pubblicazione: (2024)
Technical Report of Nomi Team in the Environmental Sound Deepfake Detection Challenge 2026
di: Mawalim, Candy Olivia, et al.
Pubblicazione: (2025)
di: Mawalim, Candy Olivia, et al.
Pubblicazione: (2025)
Distance Based Single-Channel Target Speech Extraction
di: Shi, Runwu, et al.
Pubblicazione: (2024)
di: Shi, Runwu, et al.
Pubblicazione: (2024)
Unsupervised Single-Channel Speech Separation with a Diffusion Prior under Speaker-Embedding Guidance
di: Shi, Runwu, et al.
Pubblicazione: (2025)
di: Shi, Runwu, et al.
Pubblicazione: (2025)
Confidence-based Filtering for Speech Dataset Curation with Generative Speech Enhancement Using Discrete Tokens
di: Yamauchi, Kazuki, et al.
Pubblicazione: (2026)
di: Yamauchi, Kazuki, et al.
Pubblicazione: (2026)
Study of Lightweight Transformer Architectures for Single-Channel Speech Enhancement
di: Zhao, Haixin, et al.
Pubblicazione: (2025)
di: Zhao, Haixin, et al.
Pubblicazione: (2025)
DCF-DS: Deep Cascade Fusion of Diarization and Separation for Speech Recognition under Realistic Single-Channel Conditions
di: Niu, Shu-Tong, et al.
Pubblicazione: (2024)
di: Niu, Shu-Tong, et al.
Pubblicazione: (2024)
Blind Localization of Early Room Reflections with Arbitrary Microphone Array
di: Hadadi, Yogev, et al.
Pubblicazione: (2024)
di: Hadadi, Yogev, et al.
Pubblicazione: (2024)
Speaker Distance Estimation in Enclosures from Single-Channel Audio
di: Neri, Michael, et al.
Pubblicazione: (2024)
di: Neri, Michael, et al.
Pubblicazione: (2024)
Unsupervised Blind Joint Dereverberation and Room Acoustics Estimation with Diffusion Models
di: Lemercier, Jean-Marie, et al.
Pubblicazione: (2024)
di: Lemercier, Jean-Marie, et al.
Pubblicazione: (2024)
Room Impulse Response Generation Conditioned on Acoustic Parameters
di: Arellano, Silvia, et al.
Pubblicazione: (2025)
di: Arellano, Silvia, et al.
Pubblicazione: (2025)
Online Single-Channel Audio-Based Sound Speed Estimation for Robust Multi-Channel Audio Control
di: Fuglsig, Andreas Jonas, et al.
Pubblicazione: (2026)
di: Fuglsig, Andreas Jonas, et al.
Pubblicazione: (2026)
Multi-Channel MOSRA: Mean Opinion Score and Room Acoustics Estimation Using Simulated Data and a Teacher Model
di: Coldenhoff, Jozef, et al.
Pubblicazione: (2023)
di: Coldenhoff, Jozef, et al.
Pubblicazione: (2023)
UBGAN: Enhancing Coded Speech with Blind and Guided Bandwidth Extension
di: Gupta, Kishan, et al.
Pubblicazione: (2025)
di: Gupta, Kishan, et al.
Pubblicazione: (2025)
Noisy Disentanglement with Tri-stage Training for Noise-Robust Speech Recognition
di: Chen, Shuangyuan, et al.
Pubblicazione: (2025)
di: Chen, Shuangyuan, et al.
Pubblicazione: (2025)
BUDDy: Single-Channel Blind Unsupervised Dereverberation with Diffusion Models
di: Moliner, Eloi, et al.
Pubblicazione: (2024)
di: Moliner, Eloi, et al.
Pubblicazione: (2024)
From Human Speech to Ocean Signals: Transferring Speech Large Models for Underwater Acoustic Target Recognition
di: Huang, Mengcheng, et al.
Pubblicazione: (2026)
di: Huang, Mengcheng, et al.
Pubblicazione: (2026)
Blind Source Separation in Biomedical Signals Using Variational Methods
di: Torabi, Yasaman, et al.
Pubblicazione: (2025)
di: Torabi, Yasaman, et al.
Pubblicazione: (2025)
Frequency & Channel Attention Network for Small Footprint Noisy Spoken Keyword Spotting
di: Lin, Yuanxi, et al.
Pubblicazione: (2024)
di: Lin, Yuanxi, et al.
Pubblicazione: (2024)
Harmonic Detection from Noisy Speech with Auditory Frame Gain for Intelligibility Enhancement
di: Queiroz, A., et al.
Pubblicazione: (2024)
di: Queiroz, A., et al.
Pubblicazione: (2024)
PhoenixCodec: Taming Neural Speech Coding for Extreme Low-Resource Scenarios
di: Wan, Zixiang, et al.
Pubblicazione: (2025)
di: Wan, Zixiang, et al.
Pubblicazione: (2025)
MEAN-RIR: Multi-Modal Environment-Aware Network for Robust Room Impulse Response Estimation
di: Chen, Jiajian, et al.
Pubblicazione: (2025)
di: Chen, Jiajian, et al.
Pubblicazione: (2025)
A Study of the Scale Invariant Signal to Distortion Ratio in Speech Separation with Noisy References
di: Jepsen, Simon Dahl, et al.
Pubblicazione: (2025)
di: Jepsen, Simon Dahl, et al.
Pubblicazione: (2025)
Audio-Visual Speech Enhancement in Noisy Environments via Emotion-Based Contextual Cues
di: Hussain, Tassadaq, et al.
Pubblicazione: (2024)
di: Hussain, Tassadaq, et al.
Pubblicazione: (2024)
Harmonic Summation-Based Robust Pitch Estimation in Noisy and Reverberant Environments
di: Singh, Anup, et al.
Pubblicazione: (2025)
di: Singh, Anup, et al.
Pubblicazione: (2025)
Single-Microphone Speaker Separation and Voice Activity Detection in Noisy and Reverberant Environments
di: Opochinsky, Renana, et al.
Pubblicazione: (2024)
di: Opochinsky, Renana, et al.
Pubblicazione: (2024)
Multi-modal Speech Enhancement with Limited Electromyography Channels
di: Feng, Fuyuan, et al.
Pubblicazione: (2025)
di: Feng, Fuyuan, et al.
Pubblicazione: (2025)
Attention-Based Beamformer For Multi-Channel Speech Enhancement
di: Bai, Jinglin, et al.
Pubblicazione: (2024)
di: Bai, Jinglin, et al.
Pubblicazione: (2024)
RaD-Net: A Repairing and Denoising Network for Speech Signal Improvement
di: Liu, Mingshuai, et al.
Pubblicazione: (2024)
di: Liu, Mingshuai, et al.
Pubblicazione: (2024)
Explicit Estimation of Magnitude and Phase Spectra in Parallel for High-Quality Speech Enhancement
di: Lu, Ye-Xin, et al.
Pubblicazione: (2023)
di: Lu, Ye-Xin, et al.
Pubblicazione: (2023)
Sparse Direction of Arrival Estimation Method Based on Vector Signal Reconstruction with a Single Vector Sensor
di: Guo, Jiabin
Pubblicazione: (2024)
di: Guo, Jiabin
Pubblicazione: (2024)
Multi-Channel Differential ASR for Robust Wearer Speech Recognition on Smart Glasses
di: Yang, Yufeng, et al.
Pubblicazione: (2025)
di: Yang, Yufeng, et al.
Pubblicazione: (2025)
Quality Assessment of Noisy and Enhanced Speech with Limited Data: UWB-NTIS System for VoiceMOS 2024
di: Kunešová, Marie, et al.
Pubblicazione: (2025)
di: Kunešová, Marie, et al.
Pubblicazione: (2025)
Gencho: Room Impulse Response Generation from Reverberant Speech and Text via Diffusion Transformers
di: Lin, Jackie, et al.
Pubblicazione: (2026)
di: Lin, Jackie, et al.
Pubblicazione: (2026)
Diffusion-based Signal Refiner for Speech Enhancement and Separation
di: Hirano, Masato, et al.
Pubblicazione: (2023)
di: Hirano, Masato, et al.
Pubblicazione: (2023)
Documenti analoghi
-
Single-Channel Target Speech Extraction Utilizing Distance and Room Clues
di: Shi, Runwu, et al.
Pubblicazione: (2025) -
SS-BRPE: Self-Supervised Blind Room Parameter Estimation Using Attention Mechanisms
di: Wang, Chunxi, et al.
Pubblicazione: (2024) -
DARAS: Dynamic Audio-Room Acoustic Synthesis for Blind Room Impulse Response Estimation
di: Wang, Chunxi, et al.
Pubblicazione: (2025) -
Improved Remixing Process for Domain Adaptation-Based Speech Enhancement by Mitigating Data Imbalance in Signal-to-Noise Ratio
di: Li, Li, et al.
Pubblicazione: (2024) -
A Fast and Lightweight Model for Causal Audio-Visual Speech Separation
di: Sang, Wendi, et al.
Pubblicazione: (2025)