StuPASE: Towards Low-Hallucination Studio-Quality Generative Speech Enhancement
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Rong, Xiaobin, Gao, Jun, Wang, Zheng, Yesilbursa, Mansur, Wojcicki, Kamil, Lu, Jing |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2026
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
PASE: Leveraging the Phonological Prior of WavLM for Low-Hallucination Generative Speech Enhancement
von: Rong, Xiaobin, et al.
Veröffentlicht: (2025)
von: Rong, Xiaobin, et al.
Veröffentlicht: (2025)
UniPASE: A Generative Model for Universal Speech Enhancement with High Fidelity and Low Hallucinations
von: Rong, Xiaobin, et al.
Veröffentlicht: (2026)
von: Rong, Xiaobin, et al.
Veröffentlicht: (2026)
Assessing speech quality metrics for evaluation of neural audio codecs under clean speech conditions
von: Mack, Wolfgang, et al.
Veröffentlicht: (2025)
von: Mack, Wolfgang, et al.
Veröffentlicht: (2025)
GAP-URGENet: A Generative-Predictive Fusion Framework for Universal Speech Enhancement
von: Rong, Xiaobin, et al.
Veröffentlicht: (2026)
von: Rong, Xiaobin, et al.
Veröffentlicht: (2026)
A Lightweight Hybrid Dual Channel Speech Enhancement System under Low-SNR Conditions
von: Wang, Zheng, et al.
Veröffentlicht: (2025)
von: Wang, Zheng, et al.
Veröffentlicht: (2025)
Crowdsourced Multilingual Speech Intelligibility Testing
von: Lechler, Laura, et al.
Veröffentlicht: (2024)
von: Lechler, Laura, et al.
Veröffentlicht: (2024)
Low-Resource Audio Codec (LRAC): 2025 Challenge Description
von: Wojcicki, Kamil, et al.
Veröffentlicht: (2025)
von: Wojcicki, Kamil, et al.
Veröffentlicht: (2025)
Reducing Linguistic Hallucination in LM-Based Speech Enhancement via Noise-Invariant Acoustic-Semantic Distillation
von: Wang, Zheng, et al.
Veröffentlicht: (2026)
von: Wang, Zheng, et al.
Veröffentlicht: (2026)
Adaptive Convolution for CNN-based Speech Enhancement Models
von: Wang, Dahan, et al.
Veröffentlicht: (2025)
von: Wang, Dahan, et al.
Veröffentlicht: (2025)
UL-UNAS: Ultra-Lightweight U-Nets for Real-Time Speech Enhancement via Network Architecture Search
von: Rong, Xiaobin, et al.
Veröffentlicht: (2025)
von: Rong, Xiaobin, et al.
Veröffentlicht: (2025)
TS-URGENet: A Three-stage Universal Robust and Generalizable Speech Enhancement Network
von: Rong, Xiaobin, et al.
Veröffentlicht: (2025)
von: Rong, Xiaobin, et al.
Veröffentlicht: (2025)
Rethinking Flow and Diffusion Bridge Models for Speech Enhancement
von: Wang, Dahan, et al.
Veröffentlicht: (2026)
von: Wang, Dahan, et al.
Veröffentlicht: (2026)
Low-latency Speech Enhancement via Speech Token Generation
von: Xue, Huaying, et al.
Veröffentlicht: (2023)
von: Xue, Huaying, et al.
Veröffentlicht: (2023)
Hallucination in Perceptual Metric-Driven Speech Enhancement Networks
von: Close, George, et al.
Veröffentlicht: (2024)
von: Close, George, et al.
Veröffentlicht: (2024)
SNR-Progressive Model with Harmonic Compensation for Low-SNR Speech Enhancement
von: Hou, Zhongshu, et al.
Veröffentlicht: (2024)
von: Hou, Zhongshu, et al.
Veröffentlicht: (2024)
Speech Quality-Based Localization of Low-Quality Speech and Text-to-Speech Synthesis Artefacts
von: Kuhlmann, Michael, et al.
Veröffentlicht: (2026)
von: Kuhlmann, Michael, et al.
Veröffentlicht: (2026)
SpeechLLM-as-Judges: Towards General and Interpretable Speech Quality Evaluation
von: Wang, Hui, et al.
Veröffentlicht: (2025)
von: Wang, Hui, et al.
Veröffentlicht: (2025)
FNSE-SBGAN: Far-field Speech Enhancement with Schrodinger Bridge and Generative Adversarial Networks
von: Lei, Tong, et al.
Veröffentlicht: (2025)
von: Lei, Tong, et al.
Veröffentlicht: (2025)
Universal Speech Enhancement with Regression and Generative Mamba
von: Chao, Rong, et al.
Veröffentlicht: (2025)
von: Chao, Rong, et al.
Veröffentlicht: (2025)
Schrödinger Bridge for Generative Speech Enhancement
von: Jukić, Ante, et al.
Veröffentlicht: (2024)
von: Jukić, Ante, et al.
Veröffentlicht: (2024)
Explicit Estimation of Magnitude and Phase Spectra in Parallel for High-Quality Speech Enhancement
von: Lu, Ye-Xin, et al.
Veröffentlicht: (2023)
von: Lu, Ye-Xin, et al.
Veröffentlicht: (2023)
VoCodec: An Efficient Lightweight Low-Bitrate Speech Codec
von: Yang, Leyan, et al.
Veröffentlicht: (2026)
von: Yang, Leyan, et al.
Veröffentlicht: (2026)
FlowSE: Efficient and High-Quality Speech Enhancement via Flow Matching
von: Wang, Ziqian, et al.
Veröffentlicht: (2025)
von: Wang, Ziqian, et al.
Veröffentlicht: (2025)
Towards Ultra-Low-Power Neuromorphic Speech Enhancement with Spiking-FullSubNet
von: Hao, Xiang, et al.
Veröffentlicht: (2024)
von: Hao, Xiang, et al.
Veröffentlicht: (2024)
Complex Recurrent Variational Autoencoder with Application to Speech Enhancement
von: Xie, Yuying, et al.
Veröffentlicht: (2022)
von: Xie, Yuying, et al.
Veröffentlicht: (2022)
Exploring Length Generalization For Transformer-based Speech Enhancement
von: Zhang, Qiquan, et al.
Veröffentlicht: (2025)
von: Zhang, Qiquan, et al.
Veröffentlicht: (2025)
An Exploration of Length Generalization in Transformer-Based Speech Enhancement
von: Zhang, Qiquan, et al.
Veröffentlicht: (2024)
von: Zhang, Qiquan, et al.
Veröffentlicht: (2024)
ClearerVoice-Studio: Bridging Advanced Speech Processing Research and Practical Deployment
von: Zhao, Shengkui, et al.
Veröffentlicht: (2025)
von: Zhao, Shengkui, et al.
Veröffentlicht: (2025)
Towards Frame-level Quality Predictions of Synthetic Speech
von: Kuhlmann, Michael, et al.
Veröffentlicht: (2025)
von: Kuhlmann, Michael, et al.
Veröffentlicht: (2025)
French Listening Tests for the Assessment of Intelligibility, Quality, and Identity of Body-Conducted Speech Enhancement
von: Joubaud, Thomas, et al.
Veröffentlicht: (2025)
von: Joubaud, Thomas, et al.
Veröffentlicht: (2025)
From Hallucination to Articulation: Language Model-Driven Losses for Ultra Low-Bitrate Neural Speech Coding
von: Yi, Jayeon, et al.
Veröffentlicht: (2026)
von: Yi, Jayeon, et al.
Veröffentlicht: (2026)
FastEnhancer: Speed-Optimized Streaming Neural Speech Enhancement
von: Ahn, Sunghwan, et al.
Veröffentlicht: (2025)
von: Ahn, Sunghwan, et al.
Veröffentlicht: (2025)
A Hybrid Discriminative and Generative System for Universal Speech Enhancement
von: Liu, Yinghao, et al.
Veröffentlicht: (2026)
von: Liu, Yinghao, et al.
Veröffentlicht: (2026)
MeanSE: Efficient Generative Speech Enhancement with Mean Flows
von: Wang, Jiahe, et al.
Veröffentlicht: (2025)
von: Wang, Jiahe, et al.
Veröffentlicht: (2025)
Generalizability of Predictive and Generative Speech Enhancement Models to Pathological Speakers
von: Hou, Mingchi, et al.
Veröffentlicht: (2025)
von: Hou, Mingchi, et al.
Veröffentlicht: (2025)
Mel-FullSubNet: Mel-Spectrogram Enhancement for Improving Both Speech Quality and ASR
von: Zhou, Rui, et al.
Veröffentlicht: (2024)
von: Zhou, Rui, et al.
Veröffentlicht: (2024)
Tracking Listener Attention: Gaze-Guided Audio-Visual Speech Enhancement Framework
von: Yang, Hsiang-Cheng, et al.
Veröffentlicht: (2026)
von: Yang, Hsiang-Cheng, et al.
Veröffentlicht: (2026)
Plugin Speech Enhancement: A Universal Speech Enhancement Framework Inspired by Dynamic Neural Network
von: Chen, Yanan, et al.
Veröffentlicht: (2024)
von: Chen, Yanan, et al.
Veröffentlicht: (2024)
Influence of Clean Speech Characteristics on Speech Enhancement Performance
von: Hou, Mingchi, et al.
Veröffentlicht: (2025)
von: Hou, Mingchi, et al.
Veröffentlicht: (2025)
Low Bitrate High-Quality RVQGAN-based Discrete Speech Tokenizer
von: Shechtman, Slava, et al.
Veröffentlicht: (2024)
von: Shechtman, Slava, et al.
Veröffentlicht: (2024)
Ähnliche Einträge
-
PASE: Leveraging the Phonological Prior of WavLM for Low-Hallucination Generative Speech Enhancement
von: Rong, Xiaobin, et al.
Veröffentlicht: (2025) -
UniPASE: A Generative Model for Universal Speech Enhancement with High Fidelity and Low Hallucinations
von: Rong, Xiaobin, et al.
Veröffentlicht: (2026) -
Assessing speech quality metrics for evaluation of neural audio codecs under clean speech conditions
von: Mack, Wolfgang, et al.
Veröffentlicht: (2025) -
GAP-URGENet: A Generative-Predictive Fusion Framework for Universal Speech Enhancement
von: Rong, Xiaobin, et al.
Veröffentlicht: (2026) -
A Lightweight Hybrid Dual Channel Speech Enhancement System under Low-SNR Conditions
von: Wang, Zheng, et al.
Veröffentlicht: (2025)