XANE: eXplainable Acoustic Neural Embeddings
Fuente:
arXiv
Salvato in:
| Autori principali: | Dumpala, Sri Harsha, Sharma, Dushyant, Sastri, Chandramouli Shama, Kruchinin, Stanislav, Fosburgh, James, Naylor, Patrick A. |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
XANE Background Acoustic Embeddings: Ablation and Clustering Analysis
di: Sharma, Dushyant, et al.
Pubblicazione: (2024)
di: Sharma, Dushyant, et al.
Pubblicazione: (2024)
Test-Time Training for Depression Detection
di: Dumpala, Sri Harsha, et al.
Pubblicazione: (2024)
di: Dumpala, Sri Harsha, et al.
Pubblicazione: (2024)
Self-Supervised Embeddings for Detecting Individual Symptoms of Depression
di: Dumpala, Sri Harsha, et al.
Pubblicazione: (2024)
di: Dumpala, Sri Harsha, et al.
Pubblicazione: (2024)
Predicting Individual Depression Symptoms from Acoustic Features During Speech
di: Rodriguez, Sebastian, et al.
Pubblicazione: (2024)
di: Rodriguez, Sebastian, et al.
Pubblicazione: (2024)
The Neural-SRP method for positional sound source localization
di: Grinstein, Eric, et al.
Pubblicazione: (2024)
di: Grinstein, Eric, et al.
Pubblicazione: (2024)
Proceedings of The second international workshop on eXplainable AI for the Arts (XAIxArts)
di: Bryan-Kinns, Nick, et al.
Pubblicazione: (2024)
di: Bryan-Kinns, Nick, et al.
Pubblicazione: (2024)
Zero Shot Text to Speech Augmentation for Automatic Speech Recognition on Low-Resource Accented Speech Corpora
di: Nespoli, Francesco, et al.
Pubblicazione: (2024)
di: Nespoli, Francesco, et al.
Pubblicazione: (2024)
Neural Kalman Filters for Acoustic Echo Cancellation
di: Seidel, Ernst, et al.
Pubblicazione: (2025)
di: Seidel, Ernst, et al.
Pubblicazione: (2025)
Acoustic Volume Rendering for Neural Impulse Response Fields
di: Lan, Zitong, et al.
Pubblicazione: (2024)
di: Lan, Zitong, et al.
Pubblicazione: (2024)
Uncertainty Quantification in Machine Learning for Joint Speaker Diarization and Identification
di: McKnight, Simon W., et al.
Pubblicazione: (2023)
di: McKnight, Simon W., et al.
Pubblicazione: (2023)
SAC: Neural Speech Codec with Semantic-Acoustic Dual-Stream Quantization
di: Chen, Wenxi, et al.
Pubblicazione: (2025)
di: Chen, Wenxi, et al.
Pubblicazione: (2025)
Sound Field Reconstruction Using a Compact Acoustics-informed Neural Network
di: Ma, Fei, et al.
Pubblicazione: (2024)
di: Ma, Fei, et al.
Pubblicazione: (2024)
Identification of Physical Properties in Acoustic Tubes Using Physics-Informed Neural Networks
di: Yokota, Kazuya, et al.
Pubblicazione: (2024)
di: Yokota, Kazuya, et al.
Pubblicazione: (2024)
VoiceRestore: Flow-Matching Transformers for Speech Recording Quality Restoration
di: Kirdey, Stanislav
Pubblicazione: (2025)
di: Kirdey, Stanislav
Pubblicazione: (2025)
The Reasonable Effectiveness of Speaker Embeddings for Violence Detection
di: Jain, Sarthak, et al.
Pubblicazione: (2024)
di: Jain, Sarthak, et al.
Pubblicazione: (2024)
SAMOS: A Neural MOS Prediction Model Leveraging Semantic Representations and Acoustic Features
di: Shi, Yu-Fei, et al.
Pubblicazione: (2024)
di: Shi, Yu-Fei, et al.
Pubblicazione: (2024)
Phase-Retrieval-Based Physics-Informed Neural Networks For Acoustic Magnitude Field Reconstruction
di: Schrader, Karl, et al.
Pubblicazione: (2026)
di: Schrader, Karl, et al.
Pubblicazione: (2026)
Evaluation of Virtual Acoustic Environments with Different Acoustic Level of Detail
di: Fichna, Stefan, et al.
Pubblicazione: (2023)
di: Fichna, Stefan, et al.
Pubblicazione: (2023)
Steered Response Power for Sound Source Localization: A Tutorial Review
di: Grinstein, Eric, et al.
Pubblicazione: (2024)
di: Grinstein, Eric, et al.
Pubblicazione: (2024)
Neural Speech Tracking in a Virtual Acoustic Environment: Audio-Visual Benefit for Unscripted Continuous Speech
di: Daeglau, Mareike, et al.
Pubblicazione: (2025)
di: Daeglau, Mareike, et al.
Pubblicazione: (2025)
Investigation of Deep Neural Network Acoustic Modelling Approaches for Low Resource Accented Mandarin Speech Recognition
di: Xie, Xurong, et al.
Pubblicazione: (2022)
di: Xie, Xurong, et al.
Pubblicazione: (2022)
Text2FX: Harnessing CLAP Embeddings for Text-Guided Audio Effects
di: Chu, Annie, et al.
Pubblicazione: (2024)
di: Chu, Annie, et al.
Pubblicazione: (2024)
Physics-Informed Direction-Aware Neural Acoustic Fields
di: Masuyama, Yoshiki, et al.
Pubblicazione: (2025)
di: Masuyama, Yoshiki, et al.
Pubblicazione: (2025)
When Voice Matters: Evidence of Gender Disparity in Positional Bias of SpeechLLMs
di: Satish, Shree Harsha Bokkahalli, et al.
Pubblicazione: (2025)
di: Satish, Shree Harsha Bokkahalli, et al.
Pubblicazione: (2025)
A Theoretical Framework for Acoustic Neighbor Embeddings
di: Jeon, Woojay
Pubblicazione: (2024)
di: Jeon, Woojay
Pubblicazione: (2024)
Sound Field Synthesis with Acoustic Waves
di: Mansour, Mohamed F.
Pubblicazione: (2024)
di: Mansour, Mohamed F.
Pubblicazione: (2024)
Continual Learning for Acoustic Event Classification
di: Xiao, Yang
Pubblicazione: (2025)
di: Xiao, Yang
Pubblicazione: (2025)
NAT: Neural Acoustic Transfer for Interactive Scenes in Real Time
di: Jin, Xutong, et al.
Pubblicazione: (2025)
di: Jin, Xutong, et al.
Pubblicazione: (2025)
Acoustic BPE for Speech Generation with Discrete Tokens
di: Shen, Feiyu, et al.
Pubblicazione: (2023)
di: Shen, Feiyu, et al.
Pubblicazione: (2023)
HASRD: Hierarchical Acoustic and Semantic Representation Disentanglement
di: Hussein, Amir, et al.
Pubblicazione: (2025)
di: Hussein, Amir, et al.
Pubblicazione: (2025)
FADI-AEC: Fast Score Based Diffusion Model Guided by Far-end Signal for Acoustic Echo Cancellation
di: Liu, Yang, et al.
Pubblicazione: (2024)
di: Liu, Yang, et al.
Pubblicazione: (2024)
Towards Neural Audio Codec Source Parsing
di: Phukan, Orchid Chetia, et al.
Pubblicazione: (2025)
di: Phukan, Orchid Chetia, et al.
Pubblicazione: (2025)
On Time Delay Interpolation for Improved Acoustic Reflector Localization
di: Rosseel, Hannes, et al.
Pubblicazione: (2025)
di: Rosseel, Hannes, et al.
Pubblicazione: (2025)
Production and Manufacturing of 3D Printed Acoustic Guitars
di: Tran, Timothy, et al.
Pubblicazione: (2025)
di: Tran, Timothy, et al.
Pubblicazione: (2025)
Sensitivity of Room Impulse Responses in Changing Acoustic Environment
di: Prawda, Karolina
Pubblicazione: (2025)
di: Prawda, Karolina
Pubblicazione: (2025)
Past, Present, and Future of Spatial Audio and Room Acoustics
di: Koyama, Shoichi, et al.
Pubblicazione: (2025)
di: Koyama, Shoichi, et al.
Pubblicazione: (2025)
Improving Acoustic Scene Classification in Low-Resource Conditions
di: Chen, Zhi, et al.
Pubblicazione: (2024)
di: Chen, Zhi, et al.
Pubblicazione: (2024)
Room Impulse Response Generation Conditioned on Acoustic Parameters
di: Arellano, Silvia, et al.
Pubblicazione: (2025)
di: Arellano, Silvia, et al.
Pubblicazione: (2025)
Data-driven Joint Detection and Localization of Acoustic Reflectors
di: Bicer, H. Nazim, et al.
Pubblicazione: (2024)
di: Bicer, H. Nazim, et al.
Pubblicazione: (2024)
Abusive Speech Detection in Indic Languages Using Acoustic Features
di: Spiesberger, Anika A., et al.
Pubblicazione: (2024)
di: Spiesberger, Anika A., et al.
Pubblicazione: (2024)
Documenti analoghi
-
XANE Background Acoustic Embeddings: Ablation and Clustering Analysis
di: Sharma, Dushyant, et al.
Pubblicazione: (2024) -
Test-Time Training for Depression Detection
di: Dumpala, Sri Harsha, et al.
Pubblicazione: (2024) -
Self-Supervised Embeddings for Detecting Individual Symptoms of Depression
di: Dumpala, Sri Harsha, et al.
Pubblicazione: (2024) -
Predicting Individual Depression Symptoms from Acoustic Features During Speech
di: Rodriguez, Sebastian, et al.
Pubblicazione: (2024) -
The Neural-SRP method for positional sound source localization
di: Grinstein, Eric, et al.
Pubblicazione: (2024)