Where Does Speech Enhancement Adapt? Probing Study Under Controlled Degradation
Fuente:
arXiv
Guardado en:
| Autores principales: | Amar, Yair, Ivry, Amir, Cohen, Israel |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Task-Aware Answer Preservation under Audio Compression for Large Audio Language Models
por: Ivry, Amir
Publicado: (2026)
por: Ivry, Amir
Publicado: (2026)
LALM-as-a-Judge: Benchmarking Large Audio-Language Models for Safety Evaluation in Multi-Turn Spoken Dialogues
por: Ivry, Amir, et al.
Publicado: (2026)
por: Ivry, Amir, et al.
Publicado: (2026)
A Framework for Robust Speaker Verification in Highly Noisy Environments Leveraging Both Noisy and Enhanced Audio
por: Katav, Adam, et al.
Publicado: (2025)
por: Katav, Adam, et al.
Publicado: (2025)
MAPSS: Manifold-based Assessment of Perceptual Source Separation
por: Ivry, Amir, et al.
Publicado: (2025)
por: Ivry, Amir, et al.
Publicado: (2025)
Does Single-channel Speech Enhancement Improve Keyword Spotting Accuracy? A Case Study
por: Brueggeman, Avamarie, et al.
Publicado: (2023)
por: Brueggeman, Avamarie, et al.
Publicado: (2023)
Rapidly Adapting to New Voice Spoofing: Few-Shot Detection of Synthesized Speech Under Distribution Shifts
por: Garg, Ashi, et al.
Publicado: (2025)
por: Garg, Ashi, et al.
Publicado: (2025)
Audio-Visual Feature Synchronization for Robust Speech Enhancement in Hearing Aids
por: Saleem, Nasir, et al.
Publicado: (2025)
por: Saleem, Nasir, et al.
Publicado: (2025)
Too Good to Be True: A Study on Modern Automatic Speech Recognition for the Evaluation of Speech Enhancement
por: de Oliveira, Danilo, et al.
Publicado: (2026)
por: de Oliveira, Danilo, et al.
Publicado: (2026)
Influence of Clean Speech Characteristics on Speech Enhancement Performance
por: Hou, Mingchi, et al.
Publicado: (2025)
por: Hou, Mingchi, et al.
Publicado: (2025)
Adapting Speech Foundation Models for Unified Multimodal Speech Recognition with Large Language Models
por: Zhang, Jing-Xuan, et al.
Publicado: (2025)
por: Zhang, Jing-Xuan, et al.
Publicado: (2025)
Speech Quality Embeddings for Improved Detection and Classification of Degradations in Speech Signals
por: Kuhlmann, Michael, et al.
Publicado: (2026)
por: Kuhlmann, Michael, et al.
Publicado: (2026)
A Semi-spontaneous Dutch Speech Dataset for Speech Enhancement and Speech Recognition
por: de Groot, Dimme, et al.
Publicado: (2026)
por: de Groot, Dimme, et al.
Publicado: (2026)
Assessing the Impact of Noise and Speech Enhancement on the Intelligibility of Speech Codecs
por: Behringer, Lyonel, et al.
Publicado: (2026)
por: Behringer, Lyonel, et al.
Publicado: (2026)
Long-Context Modeling Networks for Monaural Speech Enhancement: A Comparative Study
por: Zhang, Qiquan, et al.
Publicado: (2025)
por: Zhang, Qiquan, et al.
Publicado: (2025)
Data Augmentation for Pathological Speech Enhancement
por: Hou, Mingchi, et al.
Publicado: (2026)
por: Hou, Mingchi, et al.
Publicado: (2026)
Schrödinger Bridge for Generative Speech Enhancement
por: Jukić, Ante, et al.
Publicado: (2024)
por: Jukić, Ante, et al.
Publicado: (2024)
Audio-Visual Speech Enhancement in Noisy Environments via Emotion-Based Contextual Cues
por: Hussain, Tassadaq, et al.
Publicado: (2024)
por: Hussain, Tassadaq, et al.
Publicado: (2024)
Cochleagram-based Noise Adapted Speaker Identification System for Distorted Speech
por: Ahmed, Sabbir, et al.
Publicado: (2025)
por: Ahmed, Sabbir, et al.
Publicado: (2025)
Interspeech 2025 URGENT Speech Enhancement Challenge
por: Saijo, Kohei, et al.
Publicado: (2025)
por: Saijo, Kohei, et al.
Publicado: (2025)
ProSE: Diffusion Priors for Speech Enhancement
por: Kumar, Sonal, et al.
Publicado: (2025)
por: Kumar, Sonal, et al.
Publicado: (2025)
Enhancement of Dysarthric Speech Reconstruction by Contrastive Learning
por: Fatemeh, Keshvari, et al.
Publicado: (2024)
por: Fatemeh, Keshvari, et al.
Publicado: (2024)
An Efficient Neural Network for Modeling Human Auditory Neurograms for Speech
por: Zohar, Eylon, et al.
Publicado: (2025)
por: Zohar, Eylon, et al.
Publicado: (2025)
On Speech Pre-emphasis as a Simple and Inexpensive Method to Boost Speech Enhancement
por: López-Espejo, Iván, et al.
Publicado: (2024)
por: López-Espejo, Iván, et al.
Publicado: (2024)
Investigation of Speech and Noise Latent Representations in Single-channel VAE-based Speech Enhancement
por: Li, Jiatong, et al.
Publicado: (2025)
por: Li, Jiatong, et al.
Publicado: (2025)
TripleC Learning and Lightweight Speech Enhancement for Multi-Condition Target Speech Extraction
por: Huang, Ziling
Publicado: (2025)
por: Huang, Ziling
Publicado: (2025)
Study of Lightweight Transformer Architectures for Single-Channel Speech Enhancement
por: Zhao, Haixin, et al.
Publicado: (2025)
por: Zhao, Haixin, et al.
Publicado: (2025)
Ultra-Low Latency Speech Enhancement - A Comprehensive Study
por: Wu, Haibin, et al.
Publicado: (2024)
por: Wu, Haibin, et al.
Publicado: (2024)
Exploring Length Generalization For Transformer-based Speech Enhancement
por: Zhang, Qiquan, et al.
Publicado: (2025)
por: Zhang, Qiquan, et al.
Publicado: (2025)
Advances in Microphone Array Processing and Multichannel Speech Enhancement
por: Huang, Gongping, et al.
Publicado: (2025)
por: Huang, Gongping, et al.
Publicado: (2025)
Flexible Multichannel Speech Enhancement for Noise-Robust Frontend
por: Jukić, Ante, et al.
Publicado: (2024)
por: Jukić, Ante, et al.
Publicado: (2024)
An Exploration of Length Generalization in Transformer-Based Speech Enhancement
por: Zhang, Qiquan, et al.
Publicado: (2024)
por: Zhang, Qiquan, et al.
Publicado: (2024)
Complex Recurrent Variational Autoencoder with Application to Speech Enhancement
por: Xie, Yuying, et al.
Publicado: (2022)
por: Xie, Yuying, et al.
Publicado: (2022)
Rethinking Flow and Diffusion Bridge Models for Speech Enhancement
por: Wang, Dahan, et al.
Publicado: (2026)
por: Wang, Dahan, et al.
Publicado: (2026)
Selective State Space Model for Monaural Speech Enhancement
por: Chen, Moran, et al.
Publicado: (2024)
por: Chen, Moran, et al.
Publicado: (2024)
Plugin Speech Enhancement: A Universal Speech Enhancement Framework Inspired by Dynamic Neural Network
por: Chen, Yanan, et al.
Publicado: (2024)
por: Chen, Yanan, et al.
Publicado: (2024)
ARiSE: Auto-Regressive Multi-Channel Speech Enhancement
por: Shen, Pengjie, et al.
Publicado: (2025)
por: Shen, Pengjie, et al.
Publicado: (2025)
MeanSE: Efficient Generative Speech Enhancement with Mean Flows
por: Wang, Jiahe, et al.
Publicado: (2025)
por: Wang, Jiahe, et al.
Publicado: (2025)
Dynamically Slimmable Speech Enhancement Network with Metric-Guided Training
por: Zhao, Haixin, et al.
Publicado: (2025)
por: Zhao, Haixin, et al.
Publicado: (2025)
Generalizability of Predictive and Generative Speech Enhancement Models to Pathological Speakers
por: Hou, Mingchi, et al.
Publicado: (2025)
por: Hou, Mingchi, et al.
Publicado: (2025)
FastEnhancer: Speed-Optimized Streaming Neural Speech Enhancement
por: Ahn, Sunghwan, et al.
Publicado: (2025)
por: Ahn, Sunghwan, et al.
Publicado: (2025)
Ejemplares similares
-
Task-Aware Answer Preservation under Audio Compression for Large Audio Language Models
por: Ivry, Amir
Publicado: (2026) -
LALM-as-a-Judge: Benchmarking Large Audio-Language Models for Safety Evaluation in Multi-Turn Spoken Dialogues
por: Ivry, Amir, et al.
Publicado: (2026) -
A Framework for Robust Speaker Verification in Highly Noisy Environments Leveraging Both Noisy and Enhanced Audio
por: Katav, Adam, et al.
Publicado: (2025) -
MAPSS: Manifold-based Assessment of Perceptual Source Separation
por: Ivry, Amir, et al.
Publicado: (2025) -
Does Single-channel Speech Enhancement Improve Keyword Spotting Accuracy? A Case Study
por: Brueggeman, Avamarie, et al.
Publicado: (2023)