GAP-URGENet: A Generative-Predictive Fusion Framework for Universal Speech Enhancement
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Rong, Xiaobin, Wang, Yushi, Wang, Zheng, Lu, Jing |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
TS-URGENet: A Three-stage Universal Robust and Generalizable Speech Enhancement Network
par: Rong, Xiaobin, et autres
Publié: (2025)
par: Rong, Xiaobin, et autres
Publié: (2025)
Adaptive Convolution for CNN-based Speech Enhancement Models
par: Wang, Dahan, et autres
Publié: (2025)
par: Wang, Dahan, et autres
Publié: (2025)
UniPASE: A Generative Model for Universal Speech Enhancement with High Fidelity and Low Hallucinations
par: Rong, Xiaobin, et autres
Publié: (2026)
par: Rong, Xiaobin, et autres
Publié: (2026)
Universal Speech Enhancement with Regression and Generative Mamba
par: Chao, Rong, et autres
Publié: (2025)
par: Chao, Rong, et autres
Publié: (2025)
A Hybrid Discriminative and Generative System for Universal Speech Enhancement
par: Liu, Yinghao, et autres
Publié: (2026)
par: Liu, Yinghao, et autres
Publié: (2026)
Plugin Speech Enhancement: A Universal Speech Enhancement Framework Inspired by Dynamic Neural Network
par: Chen, Yanan, et autres
Publié: (2024)
par: Chen, Yanan, et autres
Publié: (2024)
Speech Emotion Recognition Using Fine-Tuned DWFormer:A Study on Track 1 of the IERPChallenge 2024
par: Wang, Honghong, et autres
Publié: (2025)
par: Wang, Honghong, et autres
Publié: (2025)
FUSE: Universal Speech Enhancement using Multi-Stage Fusion of Sparse Compression and Token Generation Models for the URGENT 2025 Challenge
par: Goswami, Nabarun, et autres
Publié: (2025)
par: Goswami, Nabarun, et autres
Publié: (2025)
Speech Enhancement with Overlapped-Frame Information Fusion and Causal Self-Attention
par: Zhang, Yuewei, et autres
Publié: (2025)
par: Zhang, Yuewei, et autres
Publié: (2025)
URGENT Challenge: Universality, Robustness, and Generalizability For Speech Enhancement
par: Zhang, Wangyou, et autres
Publié: (2024)
par: Zhang, Wangyou, et autres
Publié: (2024)
Low-latency Speech Enhancement via Speech Token Generation
par: Xue, Huaying, et autres
Publié: (2023)
par: Xue, Huaying, et autres
Publié: (2023)
Leveraging LLM for Stuttering Speech: A Unified Architecture Bridging Recognition and Event Detection
par: Huang, Shangkun, et autres
Publié: (2025)
par: Huang, Shangkun, et autres
Publié: (2025)
SNR-Progressive Model with Harmonic Compensation for Low-SNR Speech Enhancement
par: Hou, Zhongshu, et autres
Publié: (2024)
par: Hou, Zhongshu, et autres
Publié: (2024)
Speech Enhancement with Dual-path Multi-Channel Linear Prediction Filter and Multi-norm Beamforming
par: Qin, Chengyuan, et autres
Publié: (2025)
par: Qin, Chengyuan, et autres
Publié: (2025)
A Lightweight Fourier-based Network for Binaural Speech Enhancement with Spatial Cue Preservation
par: Lu, Xikun, et autres
Publié: (2025)
par: Lu, Xikun, et autres
Publié: (2025)
Combined Generative and Predictive Modeling for Speech Super-resolution
par: Wang, Heming, et autres
Publié: (2024)
par: Wang, Heming, et autres
Publié: (2024)
Universal Score-based Speech Enhancement with High Content Preservation
par: Scheibler, Robin, et autres
Publié: (2024)
par: Scheibler, Robin, et autres
Publié: (2024)
Toward Universal Speech Enhancement for Diverse Input Conditions
par: Zhang, Wangyou, et autres
Publié: (2023)
par: Zhang, Wangyou, et autres
Publié: (2023)
Geneses: Unified Generative Speech Enhancement and Separation
par: Asai, Kohei, et autres
Publié: (2026)
par: Asai, Kohei, et autres
Publié: (2026)
Investigating Training Objectives for Generative Speech Enhancement
par: Richter, Julius, et autres
Publié: (2024)
par: Richter, Julius, et autres
Publié: (2024)
Efficient Speech Enhancement via Embeddings from Pre-trained Generative Audioencoders
par: Sun, Xingwei, et autres
Publié: (2025)
par: Sun, Xingwei, et autres
Publié: (2025)
Robust Audio-Visual Speech Enhancement: Correcting Misassignments in Complex Environments with Advanced Post-Processing
par: Ren, Wenze, et autres
Publié: (2024)
par: Ren, Wenze, et autres
Publié: (2024)
Leveraging Joint Spectral and Spatial Learning with MAMBA for Multichannel Speech Enhancement
par: Ren, Wenze, et autres
Publié: (2024)
par: Ren, Wenze, et autres
Publié: (2024)
LORT: Locally Refined Convolution and Taylor Transformer for Monaural Speech Enhancement
par: Wang, Junyu, et autres
Publié: (2025)
par: Wang, Junyu, et autres
Publié: (2025)
EffiFusion-GAN: Efficient Fusion Generative Adversarial Network for Speech Enhancement
par: Wen, Bin, et autres
Publié: (2025)
par: Wen, Bin, et autres
Publié: (2025)
MeanFlowSE: One-Step Generative Speech Enhancement via MeanFlow
par: Zhu, Yike, et autres
Publié: (2025)
par: Zhu, Yike, et autres
Publié: (2025)
Dynamic Frequency-Adaptive Knowledge Distillation for Speech Enhancement
par: Yuan, Xihao, et autres
Publié: (2025)
par: Yuan, Xihao, et autres
Publié: (2025)
Few-step Adversarial Schrödinger Bridge for Generative Speech Enhancement
par: Han, Seungu, et autres
Publié: (2025)
par: Han, Seungu, et autres
Publié: (2025)
A Two-Stage Framework in Cross-Spectrum Domain for Real-Time Speech Enhancement
par: Zhang, Yuewei, et autres
Publié: (2024)
par: Zhang, Yuewei, et autres
Publié: (2024)
ICASSP 2026 URGENT Speech Enhancement Challenge
par: Li, Chenda, et autres
Publié: (2026)
par: Li, Chenda, et autres
Publié: (2026)
WTFormer: A Wavelet Conformer Network for MIMO Speech Enhancement with Spatial Cues Peservation
par: Han, Lu, et autres
Publié: (2025)
par: Han, Lu, et autres
Publié: (2025)
Confidence-based Filtering for Speech Dataset Curation with Generative Speech Enhancement Using Discrete Tokens
par: Yamauchi, Kazuki, et autres
Publié: (2026)
par: Yamauchi, Kazuki, et autres
Publié: (2026)
Leveraging Mamba with Full-Face Vision for Audio-Visual Speech Enhancement
par: Chao, Rong, et autres
Publié: (2025)
par: Chao, Rong, et autres
Publié: (2025)
Diffusion-based Generative Modeling with Discriminative Guidance for Streamable Speech Enhancement
par: Li, Chenda, et autres
Publié: (2024)
par: Li, Chenda, et autres
Publié: (2024)
Dual-View Predictive Diffusion: Lightweight Speech Enhancement via Spectrogram-Image Synergy
par: Xue, Ke, et autres
Publié: (2026)
par: Xue, Ke, et autres
Publié: (2026)
Causal Speech Enhancement with Predicting Semantics based on Quantized Self-supervised Learning Features
par: Tsunoo, Emiru, et autres
Publié: (2024)
par: Tsunoo, Emiru, et autres
Publié: (2024)
GALD-SE: Guided Anisotropic Lightweight Diffusion for Efficient Speech Enhancement
par: Wang, Chengzhong, et autres
Publié: (2024)
par: Wang, Chengzhong, et autres
Publié: (2024)
ctPuLSE: Close-Talk, and Pseudo-Label Based Far-Field, Speech Enhancement
par: Wang, Zhong-Qiu
Publié: (2024)
par: Wang, Zhong-Qiu
Publié: (2024)
Reducing the Gap Between Pretrained Speech Enhancement and Recognition Models Using a Real Speech-Trained Bridging Module
par: Cui, Zhongjian, et autres
Publié: (2025)
par: Cui, Zhongjian, et autres
Publié: (2025)
Robust Speech Recognition with Schrödinger Bridge-Based Speech Enhancement
par: Nasretdinov, Rauf, et autres
Publié: (2025)
par: Nasretdinov, Rauf, et autres
Publié: (2025)
Documents similaires
-
TS-URGENet: A Three-stage Universal Robust and Generalizable Speech Enhancement Network
par: Rong, Xiaobin, et autres
Publié: (2025) -
Adaptive Convolution for CNN-based Speech Enhancement Models
par: Wang, Dahan, et autres
Publié: (2025) -
UniPASE: A Generative Model for Universal Speech Enhancement with High Fidelity and Low Hallucinations
par: Rong, Xiaobin, et autres
Publié: (2026) -
Universal Speech Enhancement with Regression and Generative Mamba
par: Chao, Rong, et autres
Publié: (2025) -
A Hybrid Discriminative and Generative System for Universal Speech Enhancement
par: Liu, Yinghao, et autres
Publié: (2026)