Deep Learning for Personalized Binaural Audio Reproduction
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Lu, Xikun, Chen, Yunda, Chen, Zehua, Wang, Jie, Liu, Mingxing, Hu, Hongmei, Zheng, Chengshi, Bleeck, Stefan, Sang, Jinqiu |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Lightweight Implicit Neural Network for Binaural Audio Synthesis
par: Lu, Xikun, et autres
Publié: (2025)
par: Lu, Xikun, et autres
Publié: (2025)
A Lightweight Fourier-based Network for Binaural Speech Enhancement with Spatial Cue Preservation
par: Lu, Xikun, et autres
Publié: (2025)
par: Lu, Xikun, et autres
Publié: (2025)
Advancing Hearing Assessment: An ASR-Based Frequency-Specific Speech Test for Diagnosing Presbycusis
par: Bleeck, Stefan
Publié: (2025)
par: Bleeck, Stefan
Publié: (2025)
(SimPhon Speech Test): A Data-Driven Method for In Silico Design and Validation of a Phonetically Balanced Speech Test
par: Bleeck, Stefan
Publié: (2025)
par: Bleeck, Stefan
Publié: (2025)
Behind the Scenes: Mechanistic Interpretability of LoRA-adapted Whisper for Speech Emotion Recognition
par: Ma, Yujian, et autres
Publié: (2025)
par: Ma, Yujian, et autres
Publié: (2025)
Stereo Audio Rendering for Personal Sound Zones Using a Binaural Spatially Adaptive Neural Network (BSANN)
par: Jiang, Hao, et autres
Publié: (2026)
par: Jiang, Hao, et autres
Publié: (2026)
Binamix -- A Python Library for Generating Binaural Audio Datasets
par: Barry, Dan, et autres
Publié: (2025)
par: Barry, Dan, et autres
Publié: (2025)
BANC: Towards Efficient Binaural Audio Neural Codec for Overlapping Speech
par: Ratnarajah, Anton, et autres
Publié: (2023)
par: Ratnarajah, Anton, et autres
Publié: (2023)
BINAQUAL: A Full-Reference Objective Localization Similarity Metric for Binaural Audio
par: Panah, Davoud Shariat, et autres
Publié: (2025)
par: Panah, Davoud Shariat, et autres
Publié: (2025)
Array-Aware Ambisonics and HRTF Encoding for Binaural Reproduction With Wearable Arrays
par: Gayer, Yhonatan, et autres
Publié: (2025)
par: Gayer, Yhonatan, et autres
Publié: (2025)
Ambisonics Binaural Rendering via Masked Magnitude Least Squares
par: Berebi, Or, et autres
Publié: (2025)
par: Berebi, Or, et autres
Publié: (2025)
BSM-iMagLS: ILD Informed Binaural Signal Matching for Reproduction with Head-Mounted Microphone Arrays
par: Berebi, Or, et autres
Publié: (2025)
par: Berebi, Or, et autres
Publié: (2025)
Whisper-PMFA: Partial Multi-Scale Feature Aggregation for Speaker Verification using Whisper Models
par: Zhao, Yiyang, et autres
Publié: (2024)
par: Zhao, Yiyang, et autres
Publié: (2024)
Multi-Speaker DOA Estimation in Binaural Hearing Aids using Deep Learning and Speaker Count Fusion
par: Jazaeri, Farnaz, et autres
Publié: (2025)
par: Jazaeri, Farnaz, et autres
Publié: (2025)
CCStereo: Audio-Visual Contextual and Contrastive Learning for Binaural Audio Generation
par: Chen, Yuanhong, et autres
Publié: (2025)
par: Chen, Yuanhong, et autres
Publié: (2025)
Do Music Source Separation Models Preserve Spatial Information in Binaural Audio?
par: Namballa, Richa, et autres
Publié: (2025)
par: Namballa, Richa, et autres
Publié: (2025)
TTMBA: Towards Text To Multiple Sources Binaural Audio Generation
par: He, Yuxuan, et autres
Publié: (2025)
par: He, Yuxuan, et autres
Publié: (2025)
Perceptually Transparent Binaural Auralization of Simulated Sound Fields
par: Ahrens, Jens
Publié: (2024)
par: Ahrens, Jens
Publié: (2024)
Binaural Target Speaker Extraction using Individualized HRTF
par: Ellinson, Yoav, et autres
Publié: (2025)
par: Ellinson, Yoav, et autres
Publié: (2025)
Neural Vocoders as Speech Enhancers
par: Li, Andong, et autres
Publié: (2025)
par: Li, Andong, et autres
Publié: (2025)
Binaural rendering from microphone array signals of arbitrary geometry
par: Iijima, Naoto, et autres
Publié: (2021)
par: Iijima, Naoto, et autres
Publié: (2021)
Zero-Shot Fake Video Detection by Audio-Visual Consistency
par: Li, Xiaolou, et autres
Publié: (2024)
par: Li, Xiaolou, et autres
Publié: (2024)
BAST: Binaural Audio Spectrogram Transformer for Binaural Sound Localization
par: Kuang, Sheng, et autres
Publié: (2022)
par: Kuang, Sheng, et autres
Publié: (2022)
Generalized Fake Audio Detection via Deep Stable Learning
par: Wang, Zhiyong, et autres
Publié: (2024)
par: Wang, Zhiyong, et autres
Publié: (2024)
HRTF-guided Binaural Target Speaker Extraction with Real-World Validation
par: Ellinson, Yoav, et autres
Publié: (2026)
par: Ellinson, Yoav, et autres
Publié: (2026)
A Lightweight and Real-Time Binaural Speech Enhancement Model with Spatial Cues Preservation
par: Wang, Jingyuan, et autres
Publié: (2024)
par: Wang, Jingyuan, et autres
Publié: (2024)
SHroom: A Python Framework for Ambisonics Room Acoustics Simulation and Binaural Rendering
par: Gayer, Yhonatan
Publié: (2026)
par: Gayer, Yhonatan
Publié: (2026)
Binaural Sound Event Localization and Detection based on HRTF Cues for Humanoid Robots
par: Lee, Gyeong-Tae, et autres
Publié: (2025)
par: Lee, Gyeong-Tae, et autres
Publié: (2025)
A Fast and Lightweight Model for Causal Audio-Visual Speech Separation
par: Sang, Wendi, et autres
Publié: (2025)
par: Sang, Wendi, et autres
Publié: (2025)
Generalizable Audio-Visual Navigation via Binaural Difference Attention and Action Transition Prediction
par: Li, Jia, et autres
Publié: (2026)
par: Li, Jia, et autres
Publié: (2026)
A Joint Noise Disentanglement and Adversarial Training Framework for Robust Speaker Verification
par: Xing, Xujiang, et autres
Publié: (2024)
par: Xing, Xujiang, et autres
Publié: (2024)
AuralNet: Hierarchical Attention-based 3D Binaural Localization of Overlapping Speakers
par: Fu, Linya, et autres
Publié: (2025)
par: Fu, Linya, et autres
Publié: (2025)
Non-Intrusive Binaural Speech Intelligibility Prediction Using Mamba for Hearing-Impaired Listeners
par: Yamamoto, Katsuhiko, et autres
Publié: (2025)
par: Yamamoto, Katsuhiko, et autres
Publié: (2025)
Binaural sound source localization using a hybrid time and frequency domain model
par: Geva, Gil, et autres
Publié: (2024)
par: Geva, Gil, et autres
Publié: (2024)
Spatial Reconstructed Local Attention Res2Net with F0 Subband for Fake Speech Detection
par: Fan, Cunhang, et autres
Publié: (2023)
par: Fan, Cunhang, et autres
Publié: (2023)
MOSS-Audio-Tokenizer: Scaling Audio Tokenizers for Future Audio Foundation Models
par: Gong, Yitian, et autres
Publié: (2026)
par: Gong, Yitian, et autres
Publié: (2026)
Binaural Selective Attention Model for Target Speaker Extraction
par: Meng, Hanyu, et autres
Publié: (2024)
par: Meng, Hanyu, et autres
Publié: (2024)
AUV: Teaching Audio Universal Vector Quantization with Single Nested Codebook
par: Chen, Yushen, et autres
Publié: (2025)
par: Chen, Yushen, et autres
Publié: (2025)
Spatial Speech Translation: Translating Across Space With Binaural Hearables
par: Chen, Tuochao, et autres
Publié: (2025)
par: Chen, Tuochao, et autres
Publié: (2025)
Binaural Sound Event Localization and Detection Neural Network based on HRTF Localization Cues for Humanoid Robots
par: Lee, Gyeong-Tae
Publié: (2025)
par: Lee, Gyeong-Tae
Publié: (2025)
Documents similaires
-
Lightweight Implicit Neural Network for Binaural Audio Synthesis
par: Lu, Xikun, et autres
Publié: (2025) -
A Lightweight Fourier-based Network for Binaural Speech Enhancement with Spatial Cue Preservation
par: Lu, Xikun, et autres
Publié: (2025) -
Advancing Hearing Assessment: An ASR-Based Frequency-Specific Speech Test for Diagnosing Presbycusis
par: Bleeck, Stefan
Publié: (2025) -
(SimPhon Speech Test): A Data-Driven Method for In Silico Design and Validation of a Phonetically Balanced Speech Test
par: Bleeck, Stefan
Publié: (2025) -
Behind the Scenes: Mechanistic Interpretability of LoRA-adapted Whisper for Speech Emotion Recognition
par: Ma, Yujian, et autres
Publié: (2025)