CMGAN: Conformer-Based Metric-GAN for Monaural Speech Enhancement
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Abdulatif, Sherif, Cao, Ruizhe, Yang, Bin |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2022
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
CMGAN: Conformer-based Metric GAN for Speech Enhancement
von: Cao, Ruizhe, et al.
Veröffentlicht: (2022)
von: Cao, Ruizhe, et al.
Veröffentlicht: (2022)
Mamba-SEUNet: Mamba UNet for Monaural Speech Enhancement
von: Wang, Junyu, et al.
Veröffentlicht: (2024)
von: Wang, Junyu, et al.
Veröffentlicht: (2024)
Monaural Speech Enhancement with Complex Convolutional Block Attention Module and Joint Time Frequency Losses
von: Zhao, Shengkui, et al.
Veröffentlicht: (2021)
von: Zhao, Shengkui, et al.
Veröffentlicht: (2021)
EffiFusion-GAN: Efficient Fusion Generative Adversarial Network for Speech Enhancement
von: Wen, Bin, et al.
Veröffentlicht: (2025)
von: Wen, Bin, et al.
Veröffentlicht: (2025)
Multi-Metric Preference Alignment for Generative Speech Restoration
von: Zhang, Junan, et al.
Veröffentlicht: (2025)
von: Zhang, Junan, et al.
Veröffentlicht: (2025)
Schrödinger Bridge Mamba for One-Step Speech Enhancement
von: Yang, Jing, et al.
Veröffentlicht: (2025)
von: Yang, Jing, et al.
Veröffentlicht: (2025)
Pre-training Feature Guided Diffusion Model for Speech Enhancement
von: Yang, Yiyuan, et al.
Veröffentlicht: (2024)
von: Yang, Yiyuan, et al.
Veröffentlicht: (2024)
Self-Supervised Speech Quality Estimation and Enhancement Using Only Clean Speech
von: Fu, Szu-Wei, et al.
Veröffentlicht: (2024)
von: Fu, Szu-Wei, et al.
Veröffentlicht: (2024)
Single and Few-step Diffusion for Generative Speech Enhancement
von: Lay, Bunlong, et al.
Veröffentlicht: (2023)
von: Lay, Bunlong, et al.
Veröffentlicht: (2023)
Compose Yourself: Average-Velocity Flow Matching for One-Step Speech Enhancement
von: Yang, Gang, et al.
Veröffentlicht: (2025)
von: Yang, Gang, et al.
Veröffentlicht: (2025)
Alternating Approach-Putt Models for Multi-Stage Speech Enhancement
von: Jeong, Iksoon, et al.
Veröffentlicht: (2025)
von: Jeong, Iksoon, et al.
Veröffentlicht: (2025)
Speech Enhancement Using Continuous Embeddings of Neural Audio Codec
von: Li, Haoyang, et al.
Veröffentlicht: (2025)
von: Li, Haoyang, et al.
Veröffentlicht: (2025)
Complex-Cycle-Consistent Diffusion Model for Monaural Speech Enhancement
von: Li, Yi, et al.
Veröffentlicht: (2024)
von: Li, Yi, et al.
Veröffentlicht: (2024)
Personalized Speech Enhancement Without a Separate Speaker Embedding Model
von: Pärnamaa, Tanel, et al.
Veröffentlicht: (2024)
von: Pärnamaa, Tanel, et al.
Veröffentlicht: (2024)
Towards Lightweight Adaptation of Speech Enhancement Models in Real-World Environments
von: Cheng, Longbiao, et al.
Veröffentlicht: (2026)
von: Cheng, Longbiao, et al.
Veröffentlicht: (2026)
FRCRN: Boosting Feature Representation using Frequency Recurrence for Monaural Speech Enhancement
von: Zhao, Shengkui, et al.
Veröffentlicht: (2022)
von: Zhao, Shengkui, et al.
Veröffentlicht: (2022)
aTENNuate: Optimized Real-time Speech Enhancement with Deep SSMs on Raw Audio
von: Pei, Yan Ru, et al.
Veröffentlicht: (2024)
von: Pei, Yan Ru, et al.
Veröffentlicht: (2024)
Noise-aware Speech Enhancement using Diffusion Probabilistic Model
von: Hu, Yuchen, et al.
Veröffentlicht: (2023)
von: Hu, Yuchen, et al.
Veröffentlicht: (2023)
Mitigating Unauthorized Speech Synthesis for Voice Protection
von: Zhang, Zhisheng, et al.
Veröffentlicht: (2024)
von: Zhang, Zhisheng, et al.
Veröffentlicht: (2024)
When De-noising Hurts: A Systematic Study of Speech Enhancement Effects on Modern Medical ASR Systems
von: Chondhekar, Sujal, et al.
Veröffentlicht: (2025)
von: Chondhekar, Sujal, et al.
Veröffentlicht: (2025)
Unrestricted Global Phase Bias-Aware Single-channel Speech Enhancement with Conformer-based Metric GAN
von: Zhang, Shiqi, et al.
Veröffentlicht: (2024)
von: Zhang, Shiqi, et al.
Veröffentlicht: (2024)
TRAMBA: A Hybrid Transformer and Mamba Architecture for Practical Audio and Bone Conduction Speech Super Resolution and Enhancement on Mobile and Wearable Platforms
von: Sui, Yueyuan, et al.
Veröffentlicht: (2024)
von: Sui, Yueyuan, et al.
Veröffentlicht: (2024)
Purification Before Fusion: Toward Mask-Free Speech Enhancement for Robust Audio-Visual Speech Recognition
von: Wu, Linzhi, et al.
Veröffentlicht: (2026)
von: Wu, Linzhi, et al.
Veröffentlicht: (2026)
LORT: Locally Refined Convolution and Taylor Transformer for Monaural Speech Enhancement
von: Wang, Junyu, et al.
Veröffentlicht: (2025)
von: Wang, Junyu, et al.
Veröffentlicht: (2025)
JenGAN: Stacked Shifted Filters in GAN-Based Speech Synthesis
von: Cho, Hyunjae, et al.
Veröffentlicht: (2024)
von: Cho, Hyunjae, et al.
Veröffentlicht: (2024)
EVA-GAN: Enhanced Various Audio Generation via Scalable Generative Adversarial Networks
von: Liao, Shijia, et al.
Veröffentlicht: (2024)
von: Liao, Shijia, et al.
Veröffentlicht: (2024)
Self-Supervised Disentangled Representation Learning for Robust Target Speech Extraction
von: Mu, Zhaoxi, et al.
Veröffentlicht: (2023)
von: Mu, Zhaoxi, et al.
Veröffentlicht: (2023)
DCTX-Conformer: Dynamic context carry-over for low latency unified streaming and non-streaming Conformer ASR
von: Huybrechts, Goeric, et al.
Veröffentlicht: (2023)
von: Huybrechts, Goeric, et al.
Veröffentlicht: (2023)
Spectral Masking with Explicit Time-Context Windowing for Neural Network-Based Monaural Speech Enhancement
von: Fiorio, Luan Vinícius, et al.
Veröffentlicht: (2024)
von: Fiorio, Luan Vinícius, et al.
Veröffentlicht: (2024)
Speech Unlearning
von: Cheng, Jiali, et al.
Veröffentlicht: (2025)
von: Cheng, Jiali, et al.
Veröffentlicht: (2025)
An Empirical Study on the Impact of Positional Encoding in Transformer-based Monaural Speech Enhancement
von: Zhang, Qiquan, et al.
Veröffentlicht: (2024)
von: Zhang, Qiquan, et al.
Veröffentlicht: (2024)
DiffEditor: Enhancing Speech Editing with Semantic Enrichment and Acoustic Consistency
von: Chen, Yang, et al.
Veröffentlicht: (2024)
von: Chen, Yang, et al.
Veröffentlicht: (2024)
Survey of End-to-End Multi-Speaker Automatic Speech Recognition for Monaural Audio
von: He, Xinlu, et al.
Veröffentlicht: (2025)
von: He, Xinlu, et al.
Veröffentlicht: (2025)
GenTranslate: Large Language Models are Generative Multilingual Speech and Machine Translators
von: Hu, Yuchen, et al.
Veröffentlicht: (2024)
von: Hu, Yuchen, et al.
Veröffentlicht: (2024)
AnyEnhance: A Unified Generative Model with Prompt-Guidance and Self-Critic for Voice Enhancement
von: Zhang, Junan, et al.
Veröffentlicht: (2025)
von: Zhang, Junan, et al.
Veröffentlicht: (2025)
Large Language Models are Efficient Learners of Noise-Robust Speech Recognition
von: Hu, Yuchen, et al.
Veröffentlicht: (2024)
von: Hu, Yuchen, et al.
Veröffentlicht: (2024)
Collaborative Watermarking for Adversarial Speech Synthesis
von: Juvela, Lauri, et al.
Veröffentlicht: (2023)
von: Juvela, Lauri, et al.
Veröffentlicht: (2023)
Scaling Speech Tokenizers with Diffusion Autoencoders
von: Wang, Yuancheng, et al.
Veröffentlicht: (2026)
von: Wang, Yuancheng, et al.
Veröffentlicht: (2026)
Enhancing Synthetic Training Data for Speech Commands: From ASR-Based Filtering to Domain Adaptation in SSL Latent Space
von: Quintas, Sebastião, et al.
Veröffentlicht: (2024)
von: Quintas, Sebastião, et al.
Veröffentlicht: (2024)
KAD: No More FAD! An Effective and Efficient Evaluation Metric for Audio Generation
von: Chung, Yoonjin, et al.
Veröffentlicht: (2025)
von: Chung, Yoonjin, et al.
Veröffentlicht: (2025)
Ähnliche Einträge
-
CMGAN: Conformer-based Metric GAN for Speech Enhancement
von: Cao, Ruizhe, et al.
Veröffentlicht: (2022) -
Mamba-SEUNet: Mamba UNet for Monaural Speech Enhancement
von: Wang, Junyu, et al.
Veröffentlicht: (2024) -
Monaural Speech Enhancement with Complex Convolutional Block Attention Module and Joint Time Frequency Losses
von: Zhao, Shengkui, et al.
Veröffentlicht: (2021) -
EffiFusion-GAN: Efficient Fusion Generative Adversarial Network for Speech Enhancement
von: Wen, Bin, et al.
Veröffentlicht: (2025) -
Multi-Metric Preference Alignment for Generative Speech Restoration
von: Zhang, Junan, et al.
Veröffentlicht: (2025)