Dynamically Slimmable Speech Enhancement Network with Metric-Guided Training
Fuente:
arXiv
Salvato in:
| Autori principali: | Zhao, Haixin, Yang, Kaixuan, Madhu, Nilesh |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Study of Lightweight Transformer Architectures for Single-Channel Speech Enhancement
di: Zhao, Haixin, et al.
Pubblicazione: (2025)
di: Zhao, Haixin, et al.
Pubblicazione: (2025)
Dynamic Slimmable Networks for Efficient Speech Separation
di: Elminshawi, Mohamed, et al.
Pubblicazione: (2025)
di: Elminshawi, Mohamed, et al.
Pubblicazione: (2025)
Enhanced Deep Speech Separation in Clustered Ad Hoc Distributed Microphone Environments
di: Kim, Jihyun, et al.
Pubblicazione: (2024)
di: Kim, Jihyun, et al.
Pubblicazione: (2024)
Unified Architecture and Unsupervised Speech Disentanglement for Speaker Embedding-Free Enrollment in Personalized Speech Enhancement
di: Huang, Ziling, et al.
Pubblicazione: (2025)
di: Huang, Ziling, et al.
Pubblicazione: (2025)
Hallucination in Perceptual Metric-Driven Speech Enhancement Networks
di: Close, George, et al.
Pubblicazione: (2024)
di: Close, George, et al.
Pubblicazione: (2024)
SEF-PNet: Speaker Encoder-Free Personalized Speech Enhancement with Local and Global Contexts Aggregation
di: Huang, Ziling, et al.
Pubblicazione: (2025)
di: Huang, Ziling, et al.
Pubblicazione: (2025)
Plugin Speech Enhancement: A Universal Speech Enhancement Framework Inspired by Dynamic Neural Network
di: Chen, Yanan, et al.
Pubblicazione: (2024)
di: Chen, Yanan, et al.
Pubblicazione: (2024)
Unsupervised Face-Masked Speech Enhancement Using Generative Adversarial Networks With Human-in-the-Loop Assessment Metrics
di: Wang, Syu-Siang, et al.
Pubblicazione: (2024)
di: Wang, Syu-Siang, et al.
Pubblicazione: (2024)
Tracking Listener Attention: Gaze-Guided Audio-Visual Speech Enhancement Framework
di: Yang, Hsiang-Cheng, et al.
Pubblicazione: (2026)
di: Yang, Hsiang-Cheng, et al.
Pubblicazione: (2026)
FlowSE-GRPO: Training Flow Matching Speech Enhancement via Online Reinforcement Learning
di: Wang, Haoxu, et al.
Pubblicazione: (2026)
di: Wang, Haoxu, et al.
Pubblicazione: (2026)
Investigating Training Objectives for Generative Speech Enhancement
di: Richter, Julius, et al.
Pubblicazione: (2024)
di: Richter, Julius, et al.
Pubblicazione: (2024)
The Effect of Training Dataset Size on Discriminative and Diffusion-Based Speech Enhancement Systems
di: Gonzalez, Philippe, et al.
Pubblicazione: (2024)
di: Gonzalez, Philippe, et al.
Pubblicazione: (2024)
Improving Speech Enhancement with Multi-Metric Supervision from Learned Quality Assessment
di: Wang, Wei, et al.
Pubblicazione: (2025)
di: Wang, Wei, et al.
Pubblicazione: (2025)
Binaural Speech Enhancement Using Deep Complex Convolutional Transformer Networks
di: Tokala, Vikas, et al.
Pubblicazione: (2024)
di: Tokala, Vikas, et al.
Pubblicazione: (2024)
Influence of Clean Speech Characteristics on Speech Enhancement Performance
di: Hou, Mingchi, et al.
Pubblicazione: (2025)
di: Hou, Mingchi, et al.
Pubblicazione: (2025)
Enroll-on-Wakeup: A First Comparative Study of Target Speech Extraction for Seamless Interaction in Real Noisy Human-Machine Dialogue Scenarios
di: Yang, Yiming, et al.
Pubblicazione: (2026)
di: Yang, Yiming, et al.
Pubblicazione: (2026)
PLDNet: PLD-Guided Lightweight Deep Network Boosted by Efficient Attention for Handheld Dual-Microphone Speech Enhancement
di: Zhou, Nan, et al.
Pubblicazione: (2024)
di: Zhou, Nan, et al.
Pubblicazione: (2024)
Test-Time Adaptation For Speech Enhancement Via Mask Polarization
di: Raichle, Tobias, et al.
Pubblicazione: (2026)
di: Raichle, Tobias, et al.
Pubblicazione: (2026)
Long-Context Modeling Networks for Monaural Speech Enhancement: A Comparative Study
di: Zhang, Qiquan, et al.
Pubblicazione: (2025)
di: Zhang, Qiquan, et al.
Pubblicazione: (2025)
A Semi-spontaneous Dutch Speech Dataset for Speech Enhancement and Speech Recognition
di: de Groot, Dimme, et al.
Pubblicazione: (2026)
di: de Groot, Dimme, et al.
Pubblicazione: (2026)
Assessing the Impact of Noise and Speech Enhancement on the Intelligibility of Speech Codecs
di: Behringer, Lyonel, et al.
Pubblicazione: (2026)
di: Behringer, Lyonel, et al.
Pubblicazione: (2026)
Dynamic Frequency-Adaptive Knowledge Distillation for Speech Enhancement
di: Yuan, Xihao, et al.
Pubblicazione: (2025)
di: Yuan, Xihao, et al.
Pubblicazione: (2025)
GALD-SE: Guided Anisotropic Lightweight Diffusion for Efficient Speech Enhancement
di: Wang, Chengzhong, et al.
Pubblicazione: (2024)
di: Wang, Chengzhong, et al.
Pubblicazione: (2024)
WTFormer: A Wavelet Conformer Network for MIMO Speech Enhancement with Spatial Cues Peservation
di: Han, Lu, et al.
Pubblicazione: (2025)
di: Han, Lu, et al.
Pubblicazione: (2025)
Data Augmentation for Pathological Speech Enhancement
di: Hou, Mingchi, et al.
Pubblicazione: (2026)
di: Hou, Mingchi, et al.
Pubblicazione: (2026)
Schrödinger Bridge for Generative Speech Enhancement
di: Jukić, Ante, et al.
Pubblicazione: (2024)
di: Jukić, Ante, et al.
Pubblicazione: (2024)
Distributed Asynchronous Device Speech Enhancement via Windowed Cross-Attention
di: Yang, Gene-Ping, et al.
Pubblicazione: (2025)
di: Yang, Gene-Ping, et al.
Pubblicazione: (2025)
UL-UNAS: Ultra-Lightweight U-Nets for Real-Time Speech Enhancement via Network Architecture Search
di: Rong, Xiaobin, et al.
Pubblicazione: (2025)
di: Rong, Xiaobin, et al.
Pubblicazione: (2025)
FNSE-SBGAN: Far-field Speech Enhancement with Schrodinger Bridge and Generative Adversarial Networks
di: Lei, Tong, et al.
Pubblicazione: (2025)
di: Lei, Tong, et al.
Pubblicazione: (2025)
Binaural Speech Enhancement Using Complex Convolutional Recurrent Networks
di: Tokala, Vikas, et al.
Pubblicazione: (2025)
di: Tokala, Vikas, et al.
Pubblicazione: (2025)
MeanSE: Efficient Generative Speech Enhancement with Mean Flows
di: Wang, Jiahe, et al.
Pubblicazione: (2025)
di: Wang, Jiahe, et al.
Pubblicazione: (2025)
Unrestricted Global Phase Bias-Aware Single-channel Speech Enhancement with Conformer-based Metric GAN
di: Zhang, Shiqi, et al.
Pubblicazione: (2024)
di: Zhang, Shiqi, et al.
Pubblicazione: (2024)
Test-Time Adaptation for Speech Enhancement via Domain Invariant Embedding Transformation
di: Raichle, Tobias, et al.
Pubblicazione: (2025)
di: Raichle, Tobias, et al.
Pubblicazione: (2025)
Interspeech 2025 URGENT Speech Enhancement Challenge
di: Saijo, Kohei, et al.
Pubblicazione: (2025)
di: Saijo, Kohei, et al.
Pubblicazione: (2025)
ProSE: Diffusion Priors for Speech Enhancement
di: Kumar, Sonal, et al.
Pubblicazione: (2025)
di: Kumar, Sonal, et al.
Pubblicazione: (2025)
Enhancement of Dysarthric Speech Reconstruction by Contrastive Learning
di: Fatemeh, Keshvari, et al.
Pubblicazione: (2024)
di: Fatemeh, Keshvari, et al.
Pubblicazione: (2024)
On Speech Pre-emphasis as a Simple and Inexpensive Method to Boost Speech Enhancement
di: López-Espejo, Iván, et al.
Pubblicazione: (2024)
di: López-Espejo, Iván, et al.
Pubblicazione: (2024)
SE Territory: Monaural Speech Enhancement Meets the Fixed Virtual Perceptual Space Mapping
di: Xu, Xinmeng, et al.
Pubblicazione: (2023)
di: Xu, Xinmeng, et al.
Pubblicazione: (2023)
Investigation of Speech and Noise Latent Representations in Single-channel VAE-based Speech Enhancement
di: Li, Jiatong, et al.
Pubblicazione: (2025)
di: Li, Jiatong, et al.
Pubblicazione: (2025)
TripleC Learning and Lightweight Speech Enhancement for Multi-Condition Target Speech Extraction
di: Huang, Ziling
Pubblicazione: (2025)
di: Huang, Ziling
Pubblicazione: (2025)
Documenti analoghi
-
Study of Lightweight Transformer Architectures for Single-Channel Speech Enhancement
di: Zhao, Haixin, et al.
Pubblicazione: (2025) -
Dynamic Slimmable Networks for Efficient Speech Separation
di: Elminshawi, Mohamed, et al.
Pubblicazione: (2025) -
Enhanced Deep Speech Separation in Clustered Ad Hoc Distributed Microphone Environments
di: Kim, Jihyun, et al.
Pubblicazione: (2024) -
Unified Architecture and Unsupervised Speech Disentanglement for Speaker Embedding-Free Enrollment in Personalized Speech Enhancement
di: Huang, Ziling, et al.
Pubblicazione: (2025) -
Hallucination in Perceptual Metric-Driven Speech Enhancement Networks
di: Close, George, et al.
Pubblicazione: (2024)