MDDM: A Multi-view Discriminative Enhanced Diffusion-based Model for Speech Enhancement
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Xu, Nan, Huang, Zhaolong, Zhi, Xiaonan |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
A Universal Harmonic Discriminator for High-quality GAN-based Vocoder
par: Xu, Nan, et autres
Publié: (2025)
par: Xu, Nan, et autres
Publié: (2025)
Diffusion-based Generative Modeling with Discriminative Guidance for Streamable Speech Enhancement
par: Li, Chenda, et autres
Publié: (2024)
par: Li, Chenda, et autres
Publié: (2024)
ArrayDPS-Refine: Generative Refinement of Discriminative Multi-Channel Speech Enhancement
par: Xu, Zhongweiyang, et autres
Publié: (2026)
par: Xu, Zhongweiyang, et autres
Publié: (2026)
The Effect of Training Dataset Size on Discriminative and Diffusion-Based Speech Enhancement Systems
par: Gonzalez, Philippe, et autres
Publié: (2024)
par: Gonzalez, Philippe, et autres
Publié: (2024)
Unified Diffusion Refinement for Multi-Channel Speech Enhancement and Separation
par: Xu, Zhongweiyang, et autres
Publié: (2026)
par: Xu, Zhongweiyang, et autres
Publié: (2026)
AMDM-SE: Attention-based Multichannel Diffusion Model for Speech Enhancement
par: Opochinsky, Renana, et autres
Publié: (2026)
par: Opochinsky, Renana, et autres
Publié: (2026)
Leveraging Discriminative Latent Representations for Conditioning GAN-Based Speech Enhancement
par: Shetu, Shrishti Saha, et autres
Publié: (2025)
par: Shetu, Shrishti Saha, et autres
Publié: (2025)
Rethinking Flow and Diffusion Bridge Models for Speech Enhancement
par: Wang, Dahan, et autres
Publié: (2026)
par: Wang, Dahan, et autres
Publié: (2026)
SaD: A Scenario-Aware Discriminator for Speech Enhancement
par: Yuan, Xihao, et autres
Publié: (2025)
par: Yuan, Xihao, et autres
Publié: (2025)
A Hybrid Discriminative and Generative System for Universal Speech Enhancement
par: Liu, Yinghao, et autres
Publié: (2026)
par: Liu, Yinghao, et autres
Publié: (2026)
TripleC Learning and Lightweight Speech Enhancement for Multi-Condition Target Speech Extraction
par: Huang, Ziling
Publié: (2025)
par: Huang, Ziling
Publié: (2025)
A Semantic Information-based Hierarchical Speech Enhancement Method Using Factorized Codec and Diffusion Model
par: Xiang, Yang, et autres
Publié: (2025)
par: Xiang, Yang, et autres
Publié: (2025)
ProSE: Diffusion Priors for Speech Enhancement
par: Kumar, Sonal, et autres
Publié: (2025)
par: Kumar, Sonal, et autres
Publié: (2025)
Diffusion-based Signal Refiner for Speech Enhancement and Separation
par: Hirano, Masato, et autres
Publié: (2023)
par: Hirano, Masato, et autres
Publié: (2023)
Absorbing Discrete Diffusion for Speech Enhancement
par: Gonzalez, Philippe
Publié: (2026)
par: Gonzalez, Philippe
Publié: (2026)
Evaluating the Impact of Discriminative and Generative E2E Speech Enhancement Models on Syllable Stress Preservation
par: Bharadwaj, Rangavajjala Sankara, et autres
Publié: (2024)
par: Bharadwaj, Rangavajjala Sankara, et autres
Publié: (2024)
Complex-Cycle-Consistent Diffusion Model for Monaural Speech Enhancement
par: Li, Yi, et autres
Publié: (2024)
par: Li, Yi, et autres
Publié: (2024)
Diffusion-based Speech Enhancement with Schrödinger Bridge and Symmetric Noise Schedule
par: Wang, Siyi, et autres
Publié: (2024)
par: Wang, Siyi, et autres
Publié: (2024)
A Variance-Preserving Interpolation Approach for Diffusion Models with Applications to Single Channel Speech Enhancement and Recognition
par: Guo, Zilu, et autres
Publié: (2024)
par: Guo, Zilu, et autres
Publié: (2024)
Multi-modal Speech Enhancement with Limited Electromyography Channels
par: Feng, Fuyuan, et autres
Publié: (2025)
par: Feng, Fuyuan, et autres
Publié: (2025)
Speech Enhancement and Dereverberation with Diffusion-based Generative Models
par: Richter, Julius, et autres
Publié: (2022)
par: Richter, Julius, et autres
Publié: (2022)
Exploring Length Generalization For Transformer-based Speech Enhancement
par: Zhang, Qiquan, et autres
Publié: (2025)
par: Zhang, Qiquan, et autres
Publié: (2025)
Combining Deterministic Enhanced Conditions with Dual-Streaming Encoding for Diffusion-Based Speech Enhancement
par: Shi, Hao, et autres
Publié: (2025)
par: Shi, Hao, et autres
Publié: (2025)
Objective and Subjective Evaluation of Diffusion-Based Speech Enhancement for Dysarthric Speech
par: de Groot, Dimme, et autres
Publié: (2025)
par: de Groot, Dimme, et autres
Publié: (2025)
Adaptive Convolution for CNN-based Speech Enhancement Models
par: Wang, Dahan, et autres
Publié: (2025)
par: Wang, Dahan, et autres
Publié: (2025)
ARiSE: Auto-Regressive Multi-Channel Speech Enhancement
par: Shen, Pengjie, et autres
Publié: (2025)
par: Shen, Pengjie, et autres
Publié: (2025)
Investigation of Speech and Noise Latent Representations in Single-channel VAE-based Speech Enhancement
par: Li, Jiatong, et autres
Publié: (2025)
par: Li, Jiatong, et autres
Publié: (2025)
A Semi-spontaneous Dutch Speech Dataset for Speech Enhancement and Speech Recognition
par: de Groot, Dimme, et autres
Publié: (2026)
par: de Groot, Dimme, et autres
Publié: (2026)
DDTSE: Discriminative Diffusion Model for Target Speech Extraction
par: Zhang, Leying, et autres
Publié: (2023)
par: Zhang, Leying, et autres
Publié: (2023)
Selective State Space Model for Monaural Speech Enhancement
par: Chen, Moran, et autres
Publié: (2024)
par: Chen, Moran, et autres
Publié: (2024)
Diffusion Buffer: Online Diffusion-based Speech Enhancement with Sub-Second Latency
par: Lay, Bunlong, et autres
Publié: (2025)
par: Lay, Bunlong, et autres
Publié: (2025)
Influence of Clean Speech Characteristics on Speech Enhancement Performance
par: Hou, Mingchi, et autres
Publié: (2025)
par: Hou, Mingchi, et autres
Publié: (2025)
An Analysis of the Variance of Diffusion-based Speech Enhancement
par: Lay, Bunlong, et autres
Publié: (2024)
par: Lay, Bunlong, et autres
Publié: (2024)
Speech Enhancement based on cascaded two flows
par: Lee, Seonggyu, et autres
Publié: (2025)
par: Lee, Seonggyu, et autres
Publié: (2025)
Reference Channel Selection by Multi-Channel Masking for End-to-End Multi-Channel Speech Enhancement
par: Dai, Wang, et autres
Publié: (2024)
par: Dai, Wang, et autres
Publié: (2024)
Advances in Microphone Array Processing and Multichannel Speech Enhancement
par: Huang, Gongping, et autres
Publié: (2025)
par: Huang, Gongping, et autres
Publié: (2025)
Generalizability of Predictive and Generative Speech Enhancement Models to Pathological Speakers
par: Hou, Mingchi, et autres
Publié: (2025)
par: Hou, Mingchi, et autres
Publié: (2025)
VNet: A GAN-based Multi-Tier Discriminator Network for Speech Synthesis Vocoders
par: Cao, Yubing, et autres
Publié: (2024)
par: Cao, Yubing, et autres
Publié: (2024)
Investigating the Effects of Diffusion-based Conditional Generative Speech Models Used for Speech Enhancement on Dysarthric Speech
par: Reszka, Joanna, et autres
Publié: (2024)
par: Reszka, Joanna, et autres
Publié: (2024)
Assessing the Impact of Noise and Speech Enhancement on the Intelligibility of Speech Codecs
par: Behringer, Lyonel, et autres
Publié: (2026)
par: Behringer, Lyonel, et autres
Publié: (2026)
Documents similaires
-
A Universal Harmonic Discriminator for High-quality GAN-based Vocoder
par: Xu, Nan, et autres
Publié: (2025) -
Diffusion-based Generative Modeling with Discriminative Guidance for Streamable Speech Enhancement
par: Li, Chenda, et autres
Publié: (2024) -
ArrayDPS-Refine: Generative Refinement of Discriminative Multi-Channel Speech Enhancement
par: Xu, Zhongweiyang, et autres
Publié: (2026) -
The Effect of Training Dataset Size on Discriminative and Diffusion-Based Speech Enhancement Systems
par: Gonzalez, Philippe, et autres
Publié: (2024) -
Unified Diffusion Refinement for Multi-Channel Speech Enhancement and Separation
par: Xu, Zhongweiyang, et autres
Publié: (2026)