Enregistré dans:
| Auteurs principaux: | Yadav, Manuj, Kim, Jungsoo, Hongisto, Valtteri, Cabrera, Densil, de Dear, Richard |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | https://arxiv.org/abs/2501.15744 |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Real-time auralization for performers on virtual stages
par: Accolti, Ernesto, et autres
Publié: (2023)
par: Accolti, Ernesto, et autres
Publié: (2023)
De-crackling Virtual Analog Controls with Asymptotically Stable Recurrent Neural Networks
par: Kallinen, Valtteri, et autres
Publié: (2025)
par: Kallinen, Valtteri, et autres
Publié: (2025)
Audiovisual angle and voice incongruence do not affect audiovisual verbal short-term memory in virtual reality
par: Ermert, Cosima A., et autres
Publié: (2024)
par: Ermert, Cosima A., et autres
Publié: (2024)
Adversarial speech for voice privacy protection from Personalized Speech generation
par: Chen, Shihao, et autres
Publié: (2024)
par: Chen, Shihao, et autres
Publié: (2024)
Physics-informed neural network for acoustic resonance analysis in a one-dimensional acoustic tube
par: Yokota, Kazuya, et autres
Publié: (2023)
par: Yokota, Kazuya, et autres
Publié: (2023)
Computationally-efficient and perceptually-motivated rendering of diffuse reflections in room acoustics simulation
par: Ewert, Stephan D., et autres
Publié: (2023)
par: Ewert, Stephan D., et autres
Publié: (2023)
Analysing the Masked predictive coding training criterion for pre-training a Speech Representation Model
par: Yadav, Hemant, et autres
Publié: (2023)
par: Yadav, Hemant, et autres
Publié: (2023)
NAST: Noise Aware Speech Tokenization for Speech Language Models
par: Messica, Shoval, et autres
Publié: (2024)
par: Messica, Shoval, et autres
Publié: (2024)
Communication conditions in virtual acoustic scenes in an underground station
par: Hládek, Ľuboš, et autres
Publié: (2021)
par: Hládek, Ľuboš, et autres
Publié: (2021)
Robust DOA estimation using deep acoustic imaging
par: Roman, Adrian S., et autres
Publié: (2024)
par: Roman, Adrian S., et autres
Publié: (2024)
An interpretable speech foundation model for depression detection by revealing prediction-relevant acoustic features from long speech
par: Deng, Qingkun, et autres
Publié: (2024)
par: Deng, Qingkun, et autres
Publié: (2024)
A toolbox for rendering virtual acoustic environments in the context of audiology
par: Grimm, Giso, et autres
Publié: (2018)
par: Grimm, Giso, et autres
Publié: (2018)
Guiding the underwater acoustic target recognition with interpretable contrastive learning
par: Xie, Yuan, et autres
Publié: (2024)
par: Xie, Yuan, et autres
Publié: (2024)
Efficient Extraction of Noise-Robust Discrete Units from Self-Supervised Speech Models
par: Poncelet, Jakob, et autres
Publié: (2024)
par: Poncelet, Jakob, et autres
Publié: (2024)
On the relevance of acoustic measurements for creating realistic virtual acoustic environments
par: Gündert, Siegfried, et autres
Publié: (2023)
par: Gündert, Siegfried, et autres
Publié: (2023)
Cascaded noise reduction and acoustic echo cancellation based on an extended noise reduction
par: Roebben, Arnout, et autres
Publié: (2024)
par: Roebben, Arnout, et autres
Publié: (2024)
Investigating differences in lab-quality and remote recording methods with dynamic acoustic measures
par: Zhang, Cong, et autres
Publié: (2024)
par: Zhang, Cong, et autres
Publié: (2024)
Deep, data-driven modeling of room acoustics: literature review and research perspectives
par: van Waterschoot, Toon
Publié: (2025)
par: van Waterschoot, Toon
Publié: (2025)
A state-space representation of the boundary integral equation for room acoustic modelling
par: Ali, Randall, et autres
Publié: (2026)
par: Ali, Randall, et autres
Publié: (2026)
Noise-Aware Speech Separation with Contrastive Learning
par: Zhang, Zizheng, et autres
Publié: (2023)
par: Zhang, Zizheng, et autres
Publié: (2023)
A circular microphone array with virtual microphones based on acoustics-informed neural networks
par: Zhao, Sipei, et autres
Publié: (2024)
par: Zhao, Sipei, et autres
Publié: (2024)
AxLSTMs: learning self-supervised audio representations with xLSTMs
par: Yadav, Sarthak, et autres
Publié: (2024)
par: Yadav, Sarthak, et autres
Publié: (2024)
Temporal Pooling Strategies for Training-Free Anomalous Sound Detection with Self-Supervised Audio Embeddings
par: Wilkinghoff, Kevin, et autres
Publié: (2026)
par: Wilkinghoff, Kevin, et autres
Publié: (2026)
Automatic acoustic detection of birds through deep learning: the first Bird Audio Detection challenge
par: Stowell, Dan, et autres
Publié: (2018)
par: Stowell, Dan, et autres
Publié: (2018)
A Neural Speech Codec for Noise Robust Speech Coding
par: Huang, Jiayi, et autres
Publié: (2023)
par: Huang, Jiayi, et autres
Publié: (2023)
NTC-KWS: Noise-aware CTC for Robust Keyword Spotting
par: Xi, Yu, et autres
Publié: (2024)
par: Xi, Yu, et autres
Publié: (2024)
DGSNA: Dynamic Generative Scene-based Noise Addition method
par: Chen, Zihao, et autres
Publié: (2024)
par: Chen, Zihao, et autres
Publié: (2024)
Transient Noise Removal via Diffusion-based Speech Inpainting
par: Moradi, Mordehay, et autres
Publié: (2025)
par: Moradi, Mordehay, et autres
Publié: (2025)
InsectSet459: an open dataset of insect sounds for bioacoustic machine learning
par: Faiß, Marius, et autres
Publié: (2025)
par: Faiß, Marius, et autres
Publié: (2025)
Theory and investigation of acoustic multiple-input multiple-output systems based on spherical arrays in a room
par: Morgenstern, Hai, et autres
Publié: (2024)
par: Morgenstern, Hai, et autres
Publié: (2024)
Gradient weighting for speaker verification in extremely low Signal-to-Noise Ratio
par: Ma, Yi, et autres
Publié: (2024)
par: Ma, Yi, et autres
Publié: (2024)
VC-ENHANCE: Speech Restoration with Integrated Noise Suppression and Voice Conversion
par: Byun, Kyungguen, et autres
Publié: (2024)
par: Byun, Kyungguen, et autres
Publié: (2024)
Dual-Branch Knowledge Distillation for Noise-Robust Synthetic Speech Detection
par: Fan, Cunhang, et autres
Publié: (2023)
par: Fan, Cunhang, et autres
Publié: (2023)
Noisy Disentanglement with Tri-stage Training for Noise-Robust Speech Recognition
par: Chen, Shuangyuan, et autres
Publié: (2025)
par: Chen, Shuangyuan, et autres
Publié: (2025)
Diffusion-based Speech Enhancement with Schrödinger Bridge and Symmetric Noise Schedule
par: Wang, Siyi, et autres
Publié: (2024)
par: Wang, Siyi, et autres
Publié: (2024)
Suppressing Noise Disparity in Training Data for Automatic Pathological Speech Detection
par: Amiri, Mahdi, et autres
Publié: (2024)
par: Amiri, Mahdi, et autres
Publié: (2024)
E2E-AEC: Implementing an end-to-end neural network learning approach for acoustic echo cancellation
par: Jiang, Yiheng, et autres
Publié: (2026)
par: Jiang, Yiheng, et autres
Publié: (2026)
Real-time multichannel deep speech enhancement in hearing aids: Comparing monaural and binaural processing in complex acoustic scenarios
par: Westhausen, Nils L., et autres
Publié: (2024)
par: Westhausen, Nils L., et autres
Publié: (2024)
Noise-to-mask Ratio Loss for Deep Neural Network based Audio Watermarking
par: Moritz, Martin, et autres
Publié: (2024)
par: Moritz, Martin, et autres
Publié: (2024)
Towards Bitrate-Efficient and Noise-Robust Speech Coding with Variable Bitrate RVQ
par: Chae, Yunkee, et autres
Publié: (2025)
par: Chae, Yunkee, et autres
Publié: (2025)
Documents similaires
-
Real-time auralization for performers on virtual stages
par: Accolti, Ernesto, et autres
Publié: (2023) -
De-crackling Virtual Analog Controls with Asymptotically Stable Recurrent Neural Networks
par: Kallinen, Valtteri, et autres
Publié: (2025) -
Audiovisual angle and voice incongruence do not affect audiovisual verbal short-term memory in virtual reality
par: Ermert, Cosima A., et autres
Publié: (2024) -
Adversarial speech for voice privacy protection from Personalized Speech generation
par: Chen, Shihao, et autres
Publié: (2024) -
Physics-informed neural network for acoustic resonance analysis in a one-dimensional acoustic tube
par: Yokota, Kazuya, et autres
Publié: (2023)