Salvato in:
| Autori principali: | Wang, Dahan, Gao, Jun, Lei, Tong, Hu, Yuxiang, Zhu, Changbao, Chen, Kai, Lu, Jing |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | https://arxiv.org/abs/2602.18355 |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Adaptive Convolution for CNN-based Speech Enhancement Models
di: Wang, Dahan, et al.
Pubblicazione: (2025)
di: Wang, Dahan, et al.
Pubblicazione: (2025)
UL-UNAS: Ultra-Lightweight U-Nets for Real-Time Speech Enhancement via Network Architecture Search
di: Rong, Xiaobin, et al.
Pubblicazione: (2025)
di: Rong, Xiaobin, et al.
Pubblicazione: (2025)
TS-URGENet: A Three-stage Universal Robust and Generalizable Speech Enhancement Network
di: Rong, Xiaobin, et al.
Pubblicazione: (2025)
di: Rong, Xiaobin, et al.
Pubblicazione: (2025)
FNSE-SBGAN: Far-field Speech Enhancement with Schrodinger Bridge and Generative Adversarial Networks
di: Lei, Tong, et al.
Pubblicazione: (2025)
di: Lei, Tong, et al.
Pubblicazione: (2025)
SNR-Progressive Model with Harmonic Compensation for Low-SNR Speech Enhancement
di: Hou, Zhongshu, et al.
Pubblicazione: (2024)
di: Hou, Zhongshu, et al.
Pubblicazione: (2024)
UniPASE: A Generative Model for Universal Speech Enhancement with High Fidelity and Low Hallucinations
di: Rong, Xiaobin, et al.
Pubblicazione: (2026)
di: Rong, Xiaobin, et al.
Pubblicazione: (2026)
FlowSE: Efficient and High-Quality Speech Enhancement via Flow Matching
di: Wang, Ziqian, et al.
Pubblicazione: (2025)
di: Wang, Ziqian, et al.
Pubblicazione: (2025)
StuPASE: Towards Low-Hallucination Studio-Quality Generative Speech Enhancement
di: Rong, Xiaobin, et al.
Pubblicazione: (2026)
di: Rong, Xiaobin, et al.
Pubblicazione: (2026)
MeanSE: Efficient Generative Speech Enhancement with Mean Flows
di: Wang, Jiahe, et al.
Pubblicazione: (2025)
di: Wang, Jiahe, et al.
Pubblicazione: (2025)
SELM: Speech Enhancement Using Discrete Tokens and Language Models
di: Wang, Ziqian, et al.
Pubblicazione: (2023)
di: Wang, Ziqian, et al.
Pubblicazione: (2023)
Schrödinger Bridge for Generative Speech Enhancement
di: Jukić, Ante, et al.
Pubblicazione: (2024)
di: Jukić, Ante, et al.
Pubblicazione: (2024)
Diffusion-based Speech Enhancement with Schrödinger Bridge and Symmetric Noise Schedule
di: Wang, Siyi, et al.
Pubblicazione: (2024)
di: Wang, Siyi, et al.
Pubblicazione: (2024)
Noise-aware Speech Enhancement using Diffusion Probabilistic Model
di: Hu, Yuchen, et al.
Pubblicazione: (2023)
di: Hu, Yuchen, et al.
Pubblicazione: (2023)
MeanFlowSE: One-Step Generative Speech Enhancement via MeanFlow
di: Zhu, Yike, et al.
Pubblicazione: (2025)
di: Zhu, Yike, et al.
Pubblicazione: (2025)
Schrodinger Bridges Beat Diffusion Models on Text-to-Speech Synthesis
di: Chen, Zehua, et al.
Pubblicazione: (2023)
di: Chen, Zehua, et al.
Pubblicazione: (2023)
Bridging the Gap: Integrating Pre-trained Speech Enhancement and Recognition Models for Robust Speech Recognition
di: Wang, Kuan-Chen, et al.
Pubblicazione: (2024)
di: Wang, Kuan-Chen, et al.
Pubblicazione: (2024)
PASE: Leveraging the Phonological Prior of WavLM for Low-Hallucination Generative Speech Enhancement
di: Rong, Xiaobin, et al.
Pubblicazione: (2025)
di: Rong, Xiaobin, et al.
Pubblicazione: (2025)
Schrödinger Bridge Consistency Trajectory Models for Speech Enhancement
di: Nishigori, Shuichiro, et al.
Pubblicazione: (2025)
di: Nishigori, Shuichiro, et al.
Pubblicazione: (2025)
A Variance-Preserving Interpolation Approach for Diffusion Models with Applications to Single Channel Speech Enhancement and Recognition
di: Guo, Zilu, et al.
Pubblicazione: (2024)
di: Guo, Zilu, et al.
Pubblicazione: (2024)
GenSE: Generative Speech Enhancement via Language Models using Hierarchical Modeling
di: Yao, Jixun, et al.
Pubblicazione: (2025)
di: Yao, Jixun, et al.
Pubblicazione: (2025)
Schrödinger Bridge Mamba for One-Step Speech Enhancement
di: Yang, Jing, et al.
Pubblicazione: (2025)
di: Yang, Jing, et al.
Pubblicazione: (2025)
Robust Speech Recognition with Schrödinger Bridge-Based Speech Enhancement
di: Nasretdinov, Rauf, et al.
Pubblicazione: (2025)
di: Nasretdinov, Rauf, et al.
Pubblicazione: (2025)
FlowSE-GRPO: Training Flow Matching Speech Enhancement via Online Reinforcement Learning
di: Wang, Haoxu, et al.
Pubblicazione: (2026)
di: Wang, Haoxu, et al.
Pubblicazione: (2026)
ProSE: Diffusion Priors for Speech Enhancement
di: Kumar, Sonal, et al.
Pubblicazione: (2025)
di: Kumar, Sonal, et al.
Pubblicazione: (2025)
FlowSE: Flow Matching-based Speech Enhancement
di: Lee, Seonggyu, et al.
Pubblicazione: (2025)
di: Lee, Seonggyu, et al.
Pubblicazione: (2025)
GAP-URGENet: A Generative-Predictive Fusion Framework for Universal Speech Enhancement
di: Rong, Xiaobin, et al.
Pubblicazione: (2026)
di: Rong, Xiaobin, et al.
Pubblicazione: (2026)
AMDM-SE: Attention-based Multichannel Diffusion Model for Speech Enhancement
di: Opochinsky, Renana, et al.
Pubblicazione: (2026)
di: Opochinsky, Renana, et al.
Pubblicazione: (2026)
Selective State Space Model for Monaural Speech Enhancement
di: Chen, Moran, et al.
Pubblicazione: (2024)
di: Chen, Moran, et al.
Pubblicazione: (2024)
Anonymization, Not Elimination: Utility-Preserved Speech Anonymization
di: Xiao, Yunchong, et al.
Pubblicazione: (2026)
di: Xiao, Yunchong, et al.
Pubblicazione: (2026)
Rethinking Speech Representation Aggregation in Speech Enhancement: A Phonetic Mutual Information Perspective
di: Han, Seungu, et al.
Pubblicazione: (2026)
di: Han, Seungu, et al.
Pubblicazione: (2026)
Rethinking Processing Distortions: Disentangling the Impact of Speech Enhancement Errors on Speech Recognition Performance
di: Ochiai, Tsubasa, et al.
Pubblicazione: (2024)
di: Ochiai, Tsubasa, et al.
Pubblicazione: (2024)
Group Relative Policy Optimization for Text-to-Speech with Large Language Models
di: Liu, Chang, et al.
Pubblicazione: (2025)
di: Liu, Chang, et al.
Pubblicazione: (2025)
Dynamic Frequency-Adaptive Knowledge Distillation for Speech Enhancement
di: Yuan, Xihao, et al.
Pubblicazione: (2025)
di: Yuan, Xihao, et al.
Pubblicazione: (2025)
Reducing the Gap Between Pretrained Speech Enhancement and Recognition Models Using a Real Speech-Trained Bridging Module
di: Cui, Zhongjian, et al.
Pubblicazione: (2025)
di: Cui, Zhongjian, et al.
Pubblicazione: (2025)
Absorbing Discrete Diffusion for Speech Enhancement
di: Gonzalez, Philippe
Pubblicazione: (2026)
di: Gonzalez, Philippe
Pubblicazione: (2026)
A Lightweight Hybrid Dual Channel Speech Enhancement System under Low-SNR Conditions
di: Wang, Zheng, et al.
Pubblicazione: (2025)
di: Wang, Zheng, et al.
Pubblicazione: (2025)
VoiceBridge: General Speech Restoration with One-step Latent Bridge Models
di: Zhang, Chi, et al.
Pubblicazione: (2025)
di: Zhang, Chi, et al.
Pubblicazione: (2025)
A Semantic Information-based Hierarchical Speech Enhancement Method Using Factorized Codec and Diffusion Model
di: Xiang, Yang, et al.
Pubblicazione: (2025)
di: Xiang, Yang, et al.
Pubblicazione: (2025)
Plugin Speech Enhancement: A Universal Speech Enhancement Framework Inspired by Dynamic Neural Network
di: Chen, Yanan, et al.
Pubblicazione: (2024)
di: Chen, Yanan, et al.
Pubblicazione: (2024)
Complex-Cycle-Consistent Diffusion Model for Monaural Speech Enhancement
di: Li, Yi, et al.
Pubblicazione: (2024)
di: Li, Yi, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Adaptive Convolution for CNN-based Speech Enhancement Models
di: Wang, Dahan, et al.
Pubblicazione: (2025) -
UL-UNAS: Ultra-Lightweight U-Nets for Real-Time Speech Enhancement via Network Architecture Search
di: Rong, Xiaobin, et al.
Pubblicazione: (2025) -
TS-URGENet: A Three-stage Universal Robust and Generalizable Speech Enhancement Network
di: Rong, Xiaobin, et al.
Pubblicazione: (2025) -
FNSE-SBGAN: Far-field Speech Enhancement with Schrodinger Bridge and Generative Adversarial Networks
di: Lei, Tong, et al.
Pubblicazione: (2025) -
SNR-Progressive Model with Harmonic Compensation for Low-SNR Speech Enhancement
di: Hou, Zhongshu, et al.
Pubblicazione: (2024)