DISPATCH: Distilling Selective Patches for Speech Enhancement
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Kim, Dohwan, Choi, Jung-Woo |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
RAF: Relativistic Adversarial Feedback For Universal Speech Synthesis
par: Lee, Yongjoon, et autres
Publié: (2026)
par: Lee, Yongjoon, et autres
Publié: (2026)
SEMamba++: A General Speech Restoration Framework Leveraging Global, Local, and Periodic Spectral Patterns
par: Lee, Yongjoon, et autres
Publié: (2026)
par: Lee, Yongjoon, et autres
Publié: (2026)
Speech-Declipping Transformer with Complex Spectrogram and Learnerble Temporal Features
par: Kwon, Younghoo, et autres
Publié: (2024)
par: Kwon, Younghoo, et autres
Publié: (2024)
Dynamic Frequency-Adaptive Knowledge Distillation for Speech Enhancement
par: Yuan, Xihao, et autres
Publié: (2025)
par: Yuan, Xihao, et autres
Publié: (2025)
Robust One-step Speech Enhancement via Consistency Distillation
par: Xu, Liang, et autres
Publié: (2025)
par: Xu, Liang, et autres
Publié: (2025)
Inter-channel Conv-TasNet for multichannel speech enhancement
par: Lee, Dongheon, et autres
Publié: (2021)
par: Lee, Dongheon, et autres
Publié: (2021)
FlowAVSE: Efficient Audio-Visual Speech Enhancement with Conditional Flow Matching
par: Jung, Chaeyoung, et autres
Publié: (2024)
par: Jung, Chaeyoung, et autres
Publié: (2024)
Distil-DCCRN: A Small-footprint DCCRN Leveraging Feature-based Knowledge Distillation in Speech Enhancement
par: Han, Runduo, et autres
Publié: (2024)
par: Han, Runduo, et autres
Publié: (2024)
DeFT-Mamba: Universal Multichannel Sound Separation and Polyphonic Audio Classification
par: Lee, Dongheon, et autres
Publié: (2024)
par: Lee, Dongheon, et autres
Publié: (2024)
3D Room Geometry Inference from Multichannel Room Impulse Response using Deep Neural Network
par: Yeon, Inmo, et autres
Publié: (2024)
par: Yeon, Inmo, et autres
Publié: (2024)
Improving Design of Input Condition Invariant Speech Enhancement
par: Zhang, Wangyou, et autres
Publié: (2024)
par: Zhang, Wangyou, et autres
Publié: (2024)
Leveraging Local and Global Knowledge Integration with Time-Frequency Calibrated Distillation for Speech Enhancement
par: Cheng, Jiaming, et autres
Publié: (2025)
par: Cheng, Jiaming, et autres
Publié: (2025)
Geometry-Constrained EEG Channel Selection for Brain-Assisted Speech Enhancement
par: Zuo, Keying, et autres
Publié: (2024)
par: Zuo, Keying, et autres
Publié: (2024)
Contrastive Knowledge Distillation for Embedding Refinement in Personalized Speech Enhancement
par: Serre, Thomas, et autres
Publié: (2026)
par: Serre, Thomas, et autres
Publié: (2026)
DeepASA: An Object-Oriented Multi-Purpose Network for Auditory Scene Analysis
par: Lee, Dongheon, et autres
Publié: (2025)
par: Lee, Dongheon, et autres
Publié: (2025)
Beyond Performance Plateaus: A Comprehensive Study on Scalability in Speech Enhancement
par: Zhang, Wangyou, et autres
Publié: (2024)
par: Zhang, Wangyou, et autres
Publié: (2024)
Plugin Speech Enhancement: A Universal Speech Enhancement Framework Inspired by Dynamic Neural Network
par: Chen, Yanan, et autres
Publié: (2024)
par: Chen, Yanan, et autres
Publié: (2024)
Robust Speech Recognition with Schrödinger Bridge-Based Speech Enhancement
par: Nasretdinov, Rauf, et autres
Publié: (2025)
par: Nasretdinov, Rauf, et autres
Publié: (2025)
Absorbing Discrete Diffusion for Speech Enhancement
par: Gonzalez, Philippe
Publié: (2026)
par: Gonzalez, Philippe
Publié: (2026)
Objective and Subjective Evaluation of Diffusion-Based Speech Enhancement for Dysarthric Speech
par: de Groot, Dimme, et autres
Publié: (2025)
par: de Groot, Dimme, et autres
Publié: (2025)
Advancing Electrolaryngeal Speech Enhancement Through Speech-Text Representation Learning
par: Ma, Ding, et autres
Publié: (2026)
par: Ma, Ding, et autres
Publié: (2026)
BSDB-Net: Band-Split Dual-Branch Network with Selective State Spaces Mechanism for Monaural Speech Enhancement
par: Fan, Cunhang, et autres
Publié: (2024)
par: Fan, Cunhang, et autres
Publié: (2024)
Variational Autoencoder for Personalized Pathological Speech Enhancement
par: Hou, Mingchi, et autres
Publié: (2025)
par: Hou, Mingchi, et autres
Publié: (2025)
Universal Speech Enhancement with Regression and Generative Mamba
par: Chao, Rong, et autres
Publié: (2025)
par: Chao, Rong, et autres
Publié: (2025)
ICASSP 2026 URGENT Speech Enhancement Challenge
par: Li, Chenda, et autres
Publié: (2026)
par: Li, Chenda, et autres
Publié: (2026)
Investigating Training Objectives for Generative Speech Enhancement
par: Richter, Julius, et autres
Publié: (2024)
par: Richter, Julius, et autres
Publié: (2024)
Geneses: Unified Generative Speech Enhancement and Separation
par: Asai, Kohei, et autres
Publié: (2026)
par: Asai, Kohei, et autres
Publié: (2026)
SoundCompass: Navigating Target Sound Extraction With Effective Directional Clue Integration In Complex Acoustic Scenes
par: Choi, Dayun, et autres
Publié: (2025)
par: Choi, Dayun, et autres
Publié: (2025)
Multichannel-to-Multichannel Target Sound Extraction Using Direction and Timestamp Clues
par: Choi, Dayun, et autres
Publié: (2024)
par: Choi, Dayun, et autres
Publié: (2024)
Using Speech Foundational Models in Loss Functions for Hearing Aid Speech Enhancement
par: Sutherland, Robert, et autres
Publié: (2024)
par: Sutherland, Robert, et autres
Publié: (2024)
EDNet: A Versatile Speech Enhancement Framework with Gating Mamba Mechanism and Phase Shift-Invariant Training
par: Kwak, Doyeop, et autres
Publié: (2025)
par: Kwak, Doyeop, et autres
Publié: (2025)
Rethinking Speech Representation Aggregation in Speech Enhancement: A Phonetic Mutual Information Perspective
par: Han, Seungu, et autres
Publié: (2026)
par: Han, Seungu, et autres
Publié: (2026)
Rethinking Processing Distortions: Disentangling the Impact of Speech Enhancement Errors on Speech Recognition Performance
par: Ochiai, Tsubasa, et autres
Publié: (2024)
par: Ochiai, Tsubasa, et autres
Publié: (2024)
Adaptive Convolution for CNN-based Speech Enhancement Models
par: Wang, Dahan, et autres
Publié: (2025)
par: Wang, Dahan, et autres
Publié: (2025)
Schrödinger Bridge Consistency Trajectory Models for Speech Enhancement
par: Nishigori, Shuichiro, et autres
Publié: (2025)
par: Nishigori, Shuichiro, et autres
Publié: (2025)
Multi-modal Speech Enhancement with Limited Electromyography Channels
par: Feng, Fuyuan, et autres
Publié: (2025)
par: Feng, Fuyuan, et autres
Publié: (2025)
Reverse Attention for Lightweight Speech Enhancement on Edge Devices
par: Ojha, Shuubham, et autres
Publié: (2025)
par: Ojha, Shuubham, et autres
Publié: (2025)
Amplifying Artifacts with Speech Enhancement in Voice Anti-spoofing
par: Trachu, Thanapat, et autres
Publié: (2025)
par: Trachu, Thanapat, et autres
Publié: (2025)
Evaluating Speech Enhancement Systems Through Listening Effort
par: Gelderblom, Femke B., et autres
Publié: (2024)
par: Gelderblom, Femke B., et autres
Publié: (2024)
Diffusion-based Signal Refiner for Speech Enhancement and Separation
par: Hirano, Masato, et autres
Publié: (2023)
par: Hirano, Masato, et autres
Publié: (2023)
Documents similaires
-
RAF: Relativistic Adversarial Feedback For Universal Speech Synthesis
par: Lee, Yongjoon, et autres
Publié: (2026) -
SEMamba++: A General Speech Restoration Framework Leveraging Global, Local, and Periodic Spectral Patterns
par: Lee, Yongjoon, et autres
Publié: (2026) -
Speech-Declipping Transformer with Complex Spectrogram and Learnerble Temporal Features
par: Kwon, Younghoo, et autres
Publié: (2024) -
Dynamic Frequency-Adaptive Knowledge Distillation for Speech Enhancement
par: Yuan, Xihao, et autres
Publié: (2025) -
Robust One-step Speech Enhancement via Consistency Distillation
par: Xu, Liang, et autres
Publié: (2025)