BINAQUAL: A Full-Reference Objective Localization Similarity Metric for Binaural Audio
Fuente:
arXiv
Guardado en:
| Autores principales: | Panah, Davoud Shariat, Barry, Dan, Ragano, Alessandro, Skoglund, Jan, Hines, Andrew |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Binamix -- A Python Library for Generating Binaural Audio Datasets
por: Barry, Dan, et al.
Publicado: (2025)
por: Barry, Dan, et al.
Publicado: (2025)
NOMAD: Unsupervised Learning of Perceptual Embeddings for Speech Enhancement and Non-matching Reference Audio Quality Assessment
por: Ragano, Alessandro, et al.
Publicado: (2023)
por: Ragano, Alessandro, et al.
Publicado: (2023)
SCOREQ: Speech Quality Assessment with Contrastive Regression
por: Ragano, Alessandro, et al.
Publicado: (2024)
por: Ragano, Alessandro, et al.
Publicado: (2024)
Binaspect -- A Python Library for Binaural Audio Analysis, Visualization & Feature Generation
por: Barry, Dan, et al.
Publicado: (2025)
por: Barry, Dan, et al.
Publicado: (2025)
Reduce, Reuse, Recycle: Is Perturbed Data better than Other Language augmentation for Low Resource Self-Supervised Speech Models
por: Ullah, Asad, et al.
Publicado: (2023)
por: Ullah, Asad, et al.
Publicado: (2023)
Beyond Correlation: Evaluating Multimedia Quality Models with the Constrained Concordance Index
por: Ragano, Alessandro, et al.
Publicado: (2024)
por: Ragano, Alessandro, et al.
Publicado: (2024)
Deep Learning for Personalized Binaural Audio Reproduction
por: Lu, Xikun, et al.
Publicado: (2025)
por: Lu, Xikun, et al.
Publicado: (2025)
Lightweight Implicit Neural Network for Binaural Audio Synthesis
por: Lu, Xikun, et al.
Publicado: (2025)
por: Lu, Xikun, et al.
Publicado: (2025)
BANC: Towards Efficient Binaural Audio Neural Codec for Overlapping Speech
por: Ratnarajah, Anton, et al.
Publicado: (2023)
por: Ratnarajah, Anton, et al.
Publicado: (2023)
AudioBERTScore: Objective Evaluation of Environmental Sound Synthesis Based on Similarity of Audio embedding Sequences
por: Kishi, Minoru, et al.
Publicado: (2025)
por: Kishi, Minoru, et al.
Publicado: (2025)
Respiratory Inhaler Sound Event Classification Using Self-Supervised Learning
por: Panah, Davoud Shariat, et al.
Publicado: (2025)
por: Panah, Davoud Shariat, et al.
Publicado: (2025)
A Reference-free Metric for Language-Queried Audio Source Separation using Contrastive Language-Audio Pretraining
por: Xiao, Feiyang, et al.
Publicado: (2024)
por: Xiao, Feiyang, et al.
Publicado: (2024)
Binaural Sound Event Localization and Detection based on HRTF Cues for Humanoid Robots
por: Lee, Gyeong-Tae, et al.
Publicado: (2025)
por: Lee, Gyeong-Tae, et al.
Publicado: (2025)
Binaural Sound Event Localization and Detection Neural Network based on HRTF Localization Cues for Humanoid Robots
por: Lee, Gyeong-Tae
Publicado: (2025)
por: Lee, Gyeong-Tae
Publicado: (2025)
Stereo Audio Rendering for Personal Sound Zones Using a Binaural Spatially Adaptive Neural Network (BSANN)
por: Jiang, Hao, et al.
Publicado: (2026)
por: Jiang, Hao, et al.
Publicado: (2026)
AuralNet: Hierarchical Attention-based 3D Binaural Localization of Overlapping Speakers
por: Fu, Linya, et al.
Publicado: (2025)
por: Fu, Linya, et al.
Publicado: (2025)
Do Music Source Separation Models Preserve Spatial Information in Binaural Audio?
por: Namballa, Richa, et al.
Publicado: (2025)
por: Namballa, Richa, et al.
Publicado: (2025)
Neural Speech and Audio Coding: Modern AI Technology Meets Traditional Codecs
por: Kim, Minje, et al.
Publicado: (2024)
por: Kim, Minje, et al.
Publicado: (2024)
TTMBA: Towards Text To Multiple Sources Binaural Audio Generation
por: He, Yuxuan, et al.
Publicado: (2025)
por: He, Yuxuan, et al.
Publicado: (2025)
BAST: Binaural Audio Spectrogram Transformer for Binaural Sound Localization
por: Kuang, Sheng, et al.
Publicado: (2022)
por: Kuang, Sheng, et al.
Publicado: (2022)
Perceptually Transparent Binaural Auralization of Simulated Sound Fields
por: Ahrens, Jens
Publicado: (2024)
por: Ahrens, Jens
Publicado: (2024)
Binaural Target Speaker Extraction using Individualized HRTF
por: Ellinson, Yoav, et al.
Publicado: (2025)
por: Ellinson, Yoav, et al.
Publicado: (2025)
Ambisonics Binaural Rendering via Masked Magnitude Least Squares
por: Berebi, Or, et al.
Publicado: (2025)
por: Berebi, Or, et al.
Publicado: (2025)
Binaural rendering from microphone array signals of arbitrary geometry
por: Iijima, Naoto, et al.
Publicado: (2021)
por: Iijima, Naoto, et al.
Publicado: (2021)
SHroom: A Python Framework for Ambisonics Room Acoustics Simulation and Binaural Rendering
por: Gayer, Yhonatan
Publicado: (2026)
por: Gayer, Yhonatan
Publicado: (2026)
Assessing the Alignment of Audio Representations with Timbre Similarity Ratings
por: Tian, Haokun, et al.
Publicado: (2025)
por: Tian, Haokun, et al.
Publicado: (2025)
Masked Audio Modeling with CLAP and Multi-Objective Learning
por: Xin, Yifei, et al.
Publicado: (2024)
por: Xin, Yifei, et al.
Publicado: (2024)
HRTF-guided Binaural Target Speaker Extraction with Real-World Validation
por: Ellinson, Yoav, et al.
Publicado: (2026)
por: Ellinson, Yoav, et al.
Publicado: (2026)
A Lightweight Fourier-based Network for Binaural Speech Enhancement with Spatial Cue Preservation
por: Lu, Xikun, et al.
Publicado: (2025)
por: Lu, Xikun, et al.
Publicado: (2025)
Evaluating Sound Similarity Metrics for Differentiable, Iterative Sound-Matching
por: Salimi, Amir, et al.
Publicado: (2025)
por: Salimi, Amir, et al.
Publicado: (2025)
Generalizable Audio-Visual Navigation via Binaural Difference Attention and Action Transition Prediction
por: Li, Jia, et al.
Publicado: (2026)
por: Li, Jia, et al.
Publicado: (2026)
Non-Intrusive Binaural Speech Intelligibility Prediction Using Mamba for Hearing-Impaired Listeners
por: Yamamoto, Katsuhiko, et al.
Publicado: (2025)
por: Yamamoto, Katsuhiko, et al.
Publicado: (2025)
Binaural sound source localization using a hybrid time and frequency domain model
por: Geva, Gil, et al.
Publicado: (2024)
por: Geva, Gil, et al.
Publicado: (2024)
Optimal Transport Audio Distance with Learned Riemannian Ground Metrics
por: Jeong, Wonwoo
Publicado: (2026)
por: Jeong, Wonwoo
Publicado: (2026)
The Extended SONICOM HRTF Dataset and Spatial Audio Metrics Toolbox
por: Poole, Katarina C., et al.
Publicado: (2025)
por: Poole, Katarina C., et al.
Publicado: (2025)
Leveraging Mamba with Full-Face Vision for Audio-Visual Speech Enhancement
por: Chao, Rong, et al.
Publicado: (2025)
por: Chao, Rong, et al.
Publicado: (2025)
Binaural Selective Attention Model for Target Speaker Extraction
por: Meng, Hanyu, et al.
Publicado: (2024)
por: Meng, Hanyu, et al.
Publicado: (2024)
Feasibility of iMagLS-BSM -- ILD Informed Binaural Signal Matching with Arbitrary Microphone Arrays
por: Berebi, Or, et al.
Publicado: (2024)
por: Berebi, Or, et al.
Publicado: (2024)
Performance and Robustness of Signal-Dependent vs. Signal-Independent Binaural Signal Matching with Wearable Microphone Arrays
por: Berger, Ami, et al.
Publicado: (2024)
por: Berger, Ami, et al.
Publicado: (2024)
Multi-Speaker DOA Estimation in Binaural Hearing Aids using Deep Learning and Speaker Count Fusion
por: Jazaeri, Farnaz, et al.
Publicado: (2025)
por: Jazaeri, Farnaz, et al.
Publicado: (2025)
Ejemplares similares
-
Binamix -- A Python Library for Generating Binaural Audio Datasets
por: Barry, Dan, et al.
Publicado: (2025) -
NOMAD: Unsupervised Learning of Perceptual Embeddings for Speech Enhancement and Non-matching Reference Audio Quality Assessment
por: Ragano, Alessandro, et al.
Publicado: (2023) -
SCOREQ: Speech Quality Assessment with Contrastive Regression
por: Ragano, Alessandro, et al.
Publicado: (2024) -
Binaspect -- A Python Library for Binaural Audio Analysis, Visualization & Feature Generation
por: Barry, Dan, et al.
Publicado: (2025) -
Reduce, Reuse, Recycle: Is Perturbed Data better than Other Language augmentation for Low Resource Self-Supervised Speech Models
por: Ullah, Asad, et al.
Publicado: (2023)