DisContSE: Single-Step Diffusion Speech Enhancement Based on Joint Discrete and Continuous Embeddings
Fuente:
arXiv
Guardado en:
| Autores principales: | Fu, Yihui, Fingscheidt, Tim |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Interspeech 2025 URGENT Speech Enhancement Challenge
por: Saijo, Kohei, et al.
Publicado: (2025)
por: Saijo, Kohei, et al.
Publicado: (2025)
ICASSP 2026 URGENT Speech Enhancement Challenge
por: Li, Chenda, et al.
Publicado: (2026)
por: Li, Chenda, et al.
Publicado: (2026)
P.808 Multilingual Speech Enhancement Testing: Approach and Results of URGENT 2025 Challenge
por: Sach, Marvin, et al.
Publicado: (2025)
por: Sach, Marvin, et al.
Publicado: (2025)
Less is More: Data Curation Matters in Scaling Speech Enhancement
por: Li, Chenda, et al.
Publicado: (2025)
por: Li, Chenda, et al.
Publicado: (2025)
DiffVQE: Hybrid Diffusion Voice Quality Enhancement Under Acoustic Echo and Noise
por: Girao, Haljan Lugo, et al.
Publicado: (2026)
por: Girao, Haljan Lugo, et al.
Publicado: (2026)
ProSE: Diffusion Priors for Speech Enhancement
por: Kumar, Sonal, et al.
Publicado: (2025)
por: Kumar, Sonal, et al.
Publicado: (2025)
Lessons Learned from the URGENT 2024 Speech Enhancement Challenge
por: Zhang, Wangyou, et al.
Publicado: (2025)
por: Zhang, Wangyou, et al.
Publicado: (2025)
URGENT-PK: Perceptually-Aligned Ranking Model Designed for Speech Enhancement Competition
por: Wang, Jiahe, et al.
Publicado: (2025)
por: Wang, Jiahe, et al.
Publicado: (2025)
Absorbing Discrete Diffusion for Speech Enhancement
por: Gonzalez, Philippe
Publicado: (2026)
por: Gonzalez, Philippe
Publicado: (2026)
AMDM-SE: Attention-based Multichannel Diffusion Model for Speech Enhancement
por: Opochinsky, Renana, et al.
Publicado: (2026)
por: Opochinsky, Renana, et al.
Publicado: (2026)
Non-Causal to Causal SSL-Supported Transfer Learning: Towards a High-Performance Low-Latency Speech Vocoder
por: Shi, Renzheng, et al.
Publicado: (2024)
por: Shi, Renzheng, et al.
Publicado: (2024)
Efficient High-Performance Bark-Scale Neural Network for Residual Echo and Noise Suppression
por: Seidel, Ernst, et al.
Publicado: (2024)
por: Seidel, Ernst, et al.
Publicado: (2024)
MeanFlowSE: One-Step Generative Speech Enhancement via MeanFlow
por: Zhu, Yike, et al.
Publicado: (2025)
por: Zhu, Yike, et al.
Publicado: (2025)
URGENT Challenge: Universality, Robustness, and Generalizability For Speech Enhancement
por: Zhang, Wangyou, et al.
Publicado: (2024)
por: Zhang, Wangyou, et al.
Publicado: (2024)
GALD-SE: Guided Anisotropic Lightweight Diffusion for Efficient Speech Enhancement
por: Wang, Chengzhong, et al.
Publicado: (2024)
por: Wang, Chengzhong, et al.
Publicado: (2024)
ARiSE: Auto-Regressive Multi-Channel Speech Enhancement
por: Shen, Pengjie, et al.
Publicado: (2025)
por: Shen, Pengjie, et al.
Publicado: (2025)
MeanSE: Efficient Generative Speech Enhancement with Mean Flows
por: Wang, Jiahe, et al.
Publicado: (2025)
por: Wang, Jiahe, et al.
Publicado: (2025)
SenSE: Semantic-Aware High-Fidelity Universal Speech Enhancement
por: Li, Xingchen, et al.
Publicado: (2025)
por: Li, Xingchen, et al.
Publicado: (2025)
Diffusion-Based Speech Enhancement with Joint Generative and Predictive Decoders
por: Shi, Hao, et al.
Publicado: (2023)
por: Shi, Hao, et al.
Publicado: (2023)
FlowSE: Flow Matching-based Speech Enhancement
por: Lee, Seonggyu, et al.
Publicado: (2025)
por: Lee, Seonggyu, et al.
Publicado: (2025)
PAS-SE: Personalized Auxiliary-Sensor Speech Enhancement for Voice Pickup in Hearables
por: Ohlenbusch, Mattes, et al.
Publicado: (2025)
por: Ohlenbusch, Mattes, et al.
Publicado: (2025)
Objective and Subjective Evaluation of Diffusion-Based Speech Enhancement for Dysarthric Speech
por: de Groot, Dimme, et al.
Publicado: (2025)
por: de Groot, Dimme, et al.
Publicado: (2025)
The Effect of Training Dataset Size on Discriminative and Diffusion-Based Speech Enhancement Systems
por: Gonzalez, Philippe, et al.
Publicado: (2024)
por: Gonzalez, Philippe, et al.
Publicado: (2024)
A Variance-Preserving Interpolation Approach for Diffusion Models with Applications to Single Channel Speech Enhancement and Recognition
por: Guo, Zilu, et al.
Publicado: (2024)
por: Guo, Zilu, et al.
Publicado: (2024)
SE Territory: Monaural Speech Enhancement Meets the Fixed Virtual Perceptual Space Mapping
por: Xu, Xinmeng, et al.
Publicado: (2023)
por: Xu, Xinmeng, et al.
Publicado: (2023)
Neural Kalman Filters for Acoustic Echo Cancellation
por: Seidel, Ernst, et al.
Publicado: (2025)
por: Seidel, Ernst, et al.
Publicado: (2025)
Rethinking Flow and Diffusion Bridge Models for Speech Enhancement
por: Wang, Dahan, et al.
Publicado: (2026)
por: Wang, Dahan, et al.
Publicado: (2026)
From Continuous to Discrete: Cross-Domain Collaborative General Speech Enhancement via Hierarchical Language Models
por: Mu, Zhaoxi, et al.
Publicado: (2025)
por: Mu, Zhaoxi, et al.
Publicado: (2025)
Investigation of Speech and Noise Latent Representations in Single-channel VAE-based Speech Enhancement
por: Li, Jiatong, et al.
Publicado: (2025)
por: Li, Jiatong, et al.
Publicado: (2025)
SELM: Speech Enhancement Using Discrete Tokens and Language Models
por: Wang, Ziqian, et al.
Publicado: (2023)
por: Wang, Ziqian, et al.
Publicado: (2023)
FlowSE-GRPO: Training Flow Matching Speech Enhancement via Online Reinforcement Learning
por: Wang, Haoxu, et al.
Publicado: (2026)
por: Wang, Haoxu, et al.
Publicado: (2026)
Discrete Diffusion for Generative Modeling of Text-Aligned Speech Tokens
por: Ku, Pin-Jui, et al.
Publicado: (2025)
por: Ku, Pin-Jui, et al.
Publicado: (2025)
Test-Time Adaptation for Speech Enhancement via Domain Invariant Embedding Transformation
por: Raichle, Tobias, et al.
Publicado: (2025)
por: Raichle, Tobias, et al.
Publicado: (2025)
Unified Diffusion Refinement for Multi-Channel Speech Enhancement and Separation
por: Xu, Zhongweiyang, et al.
Publicado: (2026)
por: Xu, Zhongweiyang, et al.
Publicado: (2026)
FlowSE: Efficient and High-Quality Speech Enhancement via Flow Matching
por: Wang, Ziqian, et al.
Publicado: (2025)
por: Wang, Ziqian, et al.
Publicado: (2025)
Restorative Speech Enhancement: A Progressive Approach Using SE and Codec Modules
por: Chiang, Hsin-Tien, et al.
Publicado: (2024)
por: Chiang, Hsin-Tien, et al.
Publicado: (2024)
Confidence-based Filtering for Speech Dataset Curation with Generative Speech Enhancement Using Discrete Tokens
por: Yamauchi, Kazuki, et al.
Publicado: (2026)
por: Yamauchi, Kazuki, et al.
Publicado: (2026)
An Exploration of Length Generalization in Transformer-Based Speech Enhancement
por: Zhang, Qiquan, et al.
Publicado: (2024)
por: Zhang, Qiquan, et al.
Publicado: (2024)
Conditional Latent Diffusion-Based Speech Enhancement Via Dual Context Learning
por: Zhao, Shengkui, et al.
Publicado: (2025)
por: Zhao, Shengkui, et al.
Publicado: (2025)
Unsupervised Single-Channel Speech Separation with a Diffusion Prior under Speaker-Embedding Guidance
por: Shi, Runwu, et al.
Publicado: (2025)
por: Shi, Runwu, et al.
Publicado: (2025)
Ejemplares similares
-
Interspeech 2025 URGENT Speech Enhancement Challenge
por: Saijo, Kohei, et al.
Publicado: (2025) -
ICASSP 2026 URGENT Speech Enhancement Challenge
por: Li, Chenda, et al.
Publicado: (2026) -
P.808 Multilingual Speech Enhancement Testing: Approach and Results of URGENT 2025 Challenge
por: Sach, Marvin, et al.
Publicado: (2025) -
Less is More: Data Curation Matters in Scaling Speech Enhancement
por: Li, Chenda, et al.
Publicado: (2025) -
DiffVQE: Hybrid Diffusion Voice Quality Enhancement Under Acoustic Echo and Noise
por: Girao, Haljan Lugo, et al.
Publicado: (2026)