Dynamically Slimmable Speech Enhancement Network with Metric-Guided Training
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Zhao, Haixin, Yang, Kaixuan, Madhu, Nilesh |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2025
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Study of Lightweight Transformer Architectures for Single-Channel Speech Enhancement
von: Zhao, Haixin, et al.
Veröffentlicht: (2025)
von: Zhao, Haixin, et al.
Veröffentlicht: (2025)
Dynamic Slimmable Networks for Efficient Speech Separation
von: Elminshawi, Mohamed, et al.
Veröffentlicht: (2025)
von: Elminshawi, Mohamed, et al.
Veröffentlicht: (2025)
Enhanced Deep Speech Separation in Clustered Ad Hoc Distributed Microphone Environments
von: Kim, Jihyun, et al.
Veröffentlicht: (2024)
von: Kim, Jihyun, et al.
Veröffentlicht: (2024)
Unified Architecture and Unsupervised Speech Disentanglement for Speaker Embedding-Free Enrollment in Personalized Speech Enhancement
von: Huang, Ziling, et al.
Veröffentlicht: (2025)
von: Huang, Ziling, et al.
Veröffentlicht: (2025)
Hallucination in Perceptual Metric-Driven Speech Enhancement Networks
von: Close, George, et al.
Veröffentlicht: (2024)
von: Close, George, et al.
Veröffentlicht: (2024)
SEF-PNet: Speaker Encoder-Free Personalized Speech Enhancement with Local and Global Contexts Aggregation
von: Huang, Ziling, et al.
Veröffentlicht: (2025)
von: Huang, Ziling, et al.
Veröffentlicht: (2025)
Plugin Speech Enhancement: A Universal Speech Enhancement Framework Inspired by Dynamic Neural Network
von: Chen, Yanan, et al.
Veröffentlicht: (2024)
von: Chen, Yanan, et al.
Veröffentlicht: (2024)
Unsupervised Face-Masked Speech Enhancement Using Generative Adversarial Networks With Human-in-the-Loop Assessment Metrics
von: Wang, Syu-Siang, et al.
Veröffentlicht: (2024)
von: Wang, Syu-Siang, et al.
Veröffentlicht: (2024)
Tracking Listener Attention: Gaze-Guided Audio-Visual Speech Enhancement Framework
von: Yang, Hsiang-Cheng, et al.
Veröffentlicht: (2026)
von: Yang, Hsiang-Cheng, et al.
Veröffentlicht: (2026)
FlowSE-GRPO: Training Flow Matching Speech Enhancement via Online Reinforcement Learning
von: Wang, Haoxu, et al.
Veröffentlicht: (2026)
von: Wang, Haoxu, et al.
Veröffentlicht: (2026)
Investigating Training Objectives for Generative Speech Enhancement
von: Richter, Julius, et al.
Veröffentlicht: (2024)
von: Richter, Julius, et al.
Veröffentlicht: (2024)
The Effect of Training Dataset Size on Discriminative and Diffusion-Based Speech Enhancement Systems
von: Gonzalez, Philippe, et al.
Veröffentlicht: (2024)
von: Gonzalez, Philippe, et al.
Veröffentlicht: (2024)
Improving Speech Enhancement with Multi-Metric Supervision from Learned Quality Assessment
von: Wang, Wei, et al.
Veröffentlicht: (2025)
von: Wang, Wei, et al.
Veröffentlicht: (2025)
Binaural Speech Enhancement Using Deep Complex Convolutional Transformer Networks
von: Tokala, Vikas, et al.
Veröffentlicht: (2024)
von: Tokala, Vikas, et al.
Veröffentlicht: (2024)
Influence of Clean Speech Characteristics on Speech Enhancement Performance
von: Hou, Mingchi, et al.
Veröffentlicht: (2025)
von: Hou, Mingchi, et al.
Veröffentlicht: (2025)
Enroll-on-Wakeup: A First Comparative Study of Target Speech Extraction for Seamless Interaction in Real Noisy Human-Machine Dialogue Scenarios
von: Yang, Yiming, et al.
Veröffentlicht: (2026)
von: Yang, Yiming, et al.
Veröffentlicht: (2026)
PLDNet: PLD-Guided Lightweight Deep Network Boosted by Efficient Attention for Handheld Dual-Microphone Speech Enhancement
von: Zhou, Nan, et al.
Veröffentlicht: (2024)
von: Zhou, Nan, et al.
Veröffentlicht: (2024)
Test-Time Adaptation For Speech Enhancement Via Mask Polarization
von: Raichle, Tobias, et al.
Veröffentlicht: (2026)
von: Raichle, Tobias, et al.
Veröffentlicht: (2026)
Long-Context Modeling Networks for Monaural Speech Enhancement: A Comparative Study
von: Zhang, Qiquan, et al.
Veröffentlicht: (2025)
von: Zhang, Qiquan, et al.
Veröffentlicht: (2025)
A Semi-spontaneous Dutch Speech Dataset for Speech Enhancement and Speech Recognition
von: de Groot, Dimme, et al.
Veröffentlicht: (2026)
von: de Groot, Dimme, et al.
Veröffentlicht: (2026)
Assessing the Impact of Noise and Speech Enhancement on the Intelligibility of Speech Codecs
von: Behringer, Lyonel, et al.
Veröffentlicht: (2026)
von: Behringer, Lyonel, et al.
Veröffentlicht: (2026)
Dynamic Frequency-Adaptive Knowledge Distillation for Speech Enhancement
von: Yuan, Xihao, et al.
Veröffentlicht: (2025)
von: Yuan, Xihao, et al.
Veröffentlicht: (2025)
GALD-SE: Guided Anisotropic Lightweight Diffusion for Efficient Speech Enhancement
von: Wang, Chengzhong, et al.
Veröffentlicht: (2024)
von: Wang, Chengzhong, et al.
Veröffentlicht: (2024)
WTFormer: A Wavelet Conformer Network for MIMO Speech Enhancement with Spatial Cues Peservation
von: Han, Lu, et al.
Veröffentlicht: (2025)
von: Han, Lu, et al.
Veröffentlicht: (2025)
Data Augmentation for Pathological Speech Enhancement
von: Hou, Mingchi, et al.
Veröffentlicht: (2026)
von: Hou, Mingchi, et al.
Veröffentlicht: (2026)
Schrödinger Bridge for Generative Speech Enhancement
von: Jukić, Ante, et al.
Veröffentlicht: (2024)
von: Jukić, Ante, et al.
Veröffentlicht: (2024)
Distributed Asynchronous Device Speech Enhancement via Windowed Cross-Attention
von: Yang, Gene-Ping, et al.
Veröffentlicht: (2025)
von: Yang, Gene-Ping, et al.
Veröffentlicht: (2025)
UL-UNAS: Ultra-Lightweight U-Nets for Real-Time Speech Enhancement via Network Architecture Search
von: Rong, Xiaobin, et al.
Veröffentlicht: (2025)
von: Rong, Xiaobin, et al.
Veröffentlicht: (2025)
FNSE-SBGAN: Far-field Speech Enhancement with Schrodinger Bridge and Generative Adversarial Networks
von: Lei, Tong, et al.
Veröffentlicht: (2025)
von: Lei, Tong, et al.
Veröffentlicht: (2025)
Binaural Speech Enhancement Using Complex Convolutional Recurrent Networks
von: Tokala, Vikas, et al.
Veröffentlicht: (2025)
von: Tokala, Vikas, et al.
Veröffentlicht: (2025)
MeanSE: Efficient Generative Speech Enhancement with Mean Flows
von: Wang, Jiahe, et al.
Veröffentlicht: (2025)
von: Wang, Jiahe, et al.
Veröffentlicht: (2025)
Unrestricted Global Phase Bias-Aware Single-channel Speech Enhancement with Conformer-based Metric GAN
von: Zhang, Shiqi, et al.
Veröffentlicht: (2024)
von: Zhang, Shiqi, et al.
Veröffentlicht: (2024)
Test-Time Adaptation for Speech Enhancement via Domain Invariant Embedding Transformation
von: Raichle, Tobias, et al.
Veröffentlicht: (2025)
von: Raichle, Tobias, et al.
Veröffentlicht: (2025)
Interspeech 2025 URGENT Speech Enhancement Challenge
von: Saijo, Kohei, et al.
Veröffentlicht: (2025)
von: Saijo, Kohei, et al.
Veröffentlicht: (2025)
ProSE: Diffusion Priors for Speech Enhancement
von: Kumar, Sonal, et al.
Veröffentlicht: (2025)
von: Kumar, Sonal, et al.
Veröffentlicht: (2025)
Enhancement of Dysarthric Speech Reconstruction by Contrastive Learning
von: Fatemeh, Keshvari, et al.
Veröffentlicht: (2024)
von: Fatemeh, Keshvari, et al.
Veröffentlicht: (2024)
On Speech Pre-emphasis as a Simple and Inexpensive Method to Boost Speech Enhancement
von: López-Espejo, Iván, et al.
Veröffentlicht: (2024)
von: López-Espejo, Iván, et al.
Veröffentlicht: (2024)
SE Territory: Monaural Speech Enhancement Meets the Fixed Virtual Perceptual Space Mapping
von: Xu, Xinmeng, et al.
Veröffentlicht: (2023)
von: Xu, Xinmeng, et al.
Veröffentlicht: (2023)
Investigation of Speech and Noise Latent Representations in Single-channel VAE-based Speech Enhancement
von: Li, Jiatong, et al.
Veröffentlicht: (2025)
von: Li, Jiatong, et al.
Veröffentlicht: (2025)
TripleC Learning and Lightweight Speech Enhancement for Multi-Condition Target Speech Extraction
von: Huang, Ziling
Veröffentlicht: (2025)
von: Huang, Ziling
Veröffentlicht: (2025)
Ähnliche Einträge
-
Study of Lightweight Transformer Architectures for Single-Channel Speech Enhancement
von: Zhao, Haixin, et al.
Veröffentlicht: (2025) -
Dynamic Slimmable Networks for Efficient Speech Separation
von: Elminshawi, Mohamed, et al.
Veröffentlicht: (2025) -
Enhanced Deep Speech Separation in Clustered Ad Hoc Distributed Microphone Environments
von: Kim, Jihyun, et al.
Veröffentlicht: (2024) -
Unified Architecture and Unsupervised Speech Disentanglement for Speaker Embedding-Free Enrollment in Personalized Speech Enhancement
von: Huang, Ziling, et al.
Veröffentlicht: (2025) -
Hallucination in Perceptual Metric-Driven Speech Enhancement Networks
von: Close, George, et al.
Veröffentlicht: (2024)