DNN based HRIRs Identification with a Continuously Rotating Speaker Array
Fuente:
arXiv
Salvato in:
| Autori principali: | Ko, Byeong-Yun, Min, Deokki, Nam, Hyeonuk, Park, Yong-Hwa |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Towards Understanding of Frequency Dependence on Sound Event Detection
di: Nam, Hyeonuk, et al.
Pubblicazione: (2025)
di: Nam, Hyeonuk, et al.
Pubblicazione: (2025)
Self Training and Ensembling Frequency Dependent Networks with Coarse Prediction Pooling and Sound Event Bounding Boxes
di: Nam, Hyeonuk, et al.
Pubblicazione: (2024)
di: Nam, Hyeonuk, et al.
Pubblicazione: (2024)
Diversifying and Expanding Frequency-Adaptive Convolution Kernels for Sound Event Detection
di: Nam, Hyeonuk, et al.
Pubblicazione: (2024)
di: Nam, Hyeonuk, et al.
Pubblicazione: (2024)
Temporal Attention Pooling for Frequency Dynamic Convolution in Sound Event Detection
di: Nam, Hyeonuk, et al.
Pubblicazione: (2025)
di: Nam, Hyeonuk, et al.
Pubblicazione: (2025)
JiTTER: Jigsaw Temporal Transformer for Event Reconstruction for Self-Supervised Sound Event Detection
di: Nam, Hyeonuk, et al.
Pubblicazione: (2025)
di: Nam, Hyeonuk, et al.
Pubblicazione: (2025)
Pushing the Limit of Sound Event Detection with Multi-Dilated Frequency Dynamic Convolution
di: Nam, Hyeonuk, et al.
Pubblicazione: (2024)
di: Nam, Hyeonuk, et al.
Pubblicazione: (2024)
Binaural Sound Event Localization and Detection based on HRTF Cues for Humanoid Robots
di: Lee, Gyeong-Tae, et al.
Pubblicazione: (2025)
di: Lee, Gyeong-Tae, et al.
Pubblicazione: (2025)
Frequency Dynamic Convolutions for Sound Event Detection
di: Nam, Hyeonuk
Pubblicazione: (2025)
di: Nam, Hyeonuk
Pubblicazione: (2025)
Auditory Intelligence: Understanding the World Through Sound
di: Nam, Hyeonuk
Pubblicazione: (2025)
di: Nam, Hyeonuk
Pubblicazione: (2025)
SRP-PHAT-NET: A Reliability-Driven DNN for Reverberant Speaker Localization
di: Shaybet, Bar, et al.
Pubblicazione: (2025)
di: Shaybet, Bar, et al.
Pubblicazione: (2025)
Rhythm Features for Speaker Identification
di: Mehlman, Nick, et al.
Pubblicazione: (2025)
di: Mehlman, Nick, et al.
Pubblicazione: (2025)
Boosting Unknown-number Speaker Separation with Transformer Decoder-based Attractor
di: Lee, Younglo, et al.
Pubblicazione: (2024)
di: Lee, Younglo, et al.
Pubblicazione: (2024)
Cochleagram-based Noise Adapted Speaker Identification System for Distorted Speech
di: Ahmed, Sabbir, et al.
Pubblicazione: (2025)
di: Ahmed, Sabbir, et al.
Pubblicazione: (2025)
Pretraining Multi-Speaker Identification for Neural Speaker Diarization
di: Horiguchi, Shota, et al.
Pubblicazione: (2025)
di: Horiguchi, Shota, et al.
Pubblicazione: (2025)
Explainable DNN-based Beamformer with Postfilter
di: Cohen, Adi, et al.
Pubblicazione: (2024)
di: Cohen, Adi, et al.
Pubblicazione: (2024)
LG Uplus System with Multi-Speaker IDs and Discriminator-based Sub-Judges for the WildSpoof Challenge
di: Park, Jinyoung, et al.
Pubblicazione: (2025)
di: Park, Jinyoung, et al.
Pubblicazione: (2025)
VoxBlink2: A 100K+ Speaker Recognition Corpus and the Open-Set Speaker-Identification Benchmark
di: Lin, Yuke, et al.
Pubblicazione: (2024)
di: Lin, Yuke, et al.
Pubblicazione: (2024)
Hybrid Decoding: Rapid Pass and Selective Detailed Correction for Sequence Models
di: Lim, Yunkyu, et al.
Pubblicazione: (2025)
di: Lim, Yunkyu, et al.
Pubblicazione: (2025)
Neural Ambisonic Encoding For Multi-Speaker Scenarios Using A Circular Microphone Array
di: Qiao, Yue, et al.
Pubblicazione: (2024)
di: Qiao, Yue, et al.
Pubblicazione: (2024)
A Toolkit for Joint Speaker Diarization and Identification with Application to Speaker-Attributed ASR
di: Morrone, Giovanni, et al.
Pubblicazione: (2024)
di: Morrone, Giovanni, et al.
Pubblicazione: (2024)
Multi-Channel Multi-Speaker ASR Using Target Speaker's Solo Segment
di: Shao, Yiwen, et al.
Pubblicazione: (2024)
di: Shao, Yiwen, et al.
Pubblicazione: (2024)
DiffAttack: Diffusion-based Timbre-reserved Adversarial Attack in Speaker Identification
di: Wang, Qing, et al.
Pubblicazione: (2025)
di: Wang, Qing, et al.
Pubblicazione: (2025)
SpeakerRPL v2: Robust Open-set Speaker Identification through Enhanced Few-shot Foundation Tuning and Model Fusion
di: Chen, Zhiyong, et al.
Pubblicazione: (2026)
di: Chen, Zhiyong, et al.
Pubblicazione: (2026)
Emotion Recognition in Multi-Speaker Conversations through Speaker Identification, Knowledge Distillation, and Hierarchical Fusion
di: Li, Xiao, et al.
Pubblicazione: (2025)
di: Li, Xiao, et al.
Pubblicazione: (2025)
Array Geometry-Robust Attention-Based Neural Beamformer for Moving Speakers
di: Tammen, Marvin, et al.
Pubblicazione: (2024)
di: Tammen, Marvin, et al.
Pubblicazione: (2024)
Adversarial Training of Denoising Diffusion Model Using Dual Discriminators for High-Fidelity Multi-Speaker TTS
di: Ko, Myeongjin, et al.
Pubblicazione: (2023)
di: Ko, Myeongjin, et al.
Pubblicazione: (2023)
Multi-Label Training for Text-Independent Speaker Identification
di: Xue, Yuqi
Pubblicazione: (2022)
di: Xue, Yuqi
Pubblicazione: (2022)
Enhancing Open-Set Speaker Identification through Rapid Tuning with Speaker Reciprocal Points and Negative Sample
di: Chen, Zhiyong, et al.
Pubblicazione: (2024)
di: Chen, Zhiyong, et al.
Pubblicazione: (2024)
Rec-RIR: Monaural Blind Room Impulse Response Identification via DNN-based Reverberant Speech Reconstruction in STFT Domain
di: Wang, Pengyu, et al.
Pubblicazione: (2025)
di: Wang, Pengyu, et al.
Pubblicazione: (2025)
Design and Analysis of Binaural Signal Matching with Arbitrary Microphone Arrays and Listener Head Rotations
di: Madmoni, Lior, et al.
Pubblicazione: (2024)
di: Madmoni, Lior, et al.
Pubblicazione: (2024)
Libri2Vox Dataset: Target Speaker Extraction with Diverse Speaker Conditions and Synthetic Data
di: Liu, Yun, et al.
Pubblicazione: (2024)
di: Liu, Yun, et al.
Pubblicazione: (2024)
openFEAT: Improving Speaker Identification by Open-set Few-shot Embedding Adaptation with Transformer
di: C, Kishan K, et al.
Pubblicazione: (2022)
di: C, Kishan K, et al.
Pubblicazione: (2022)
Stack Less, Repeat More: A Block Reusing Approach for Progressive Speech Enhancement
di: Kim, Jangyeon, et al.
Pubblicazione: (2025)
di: Kim, Jangyeon, et al.
Pubblicazione: (2025)
Query-Based Asymmetric Modeling with Decoupled Input-Output Rates for Speech Restoration
di: Shin, Ui-Hyeop, et al.
Pubblicazione: (2025)
di: Shin, Ui-Hyeop, et al.
Pubblicazione: (2025)
NanoVoice: Efficient Speaker-Adaptive Text-to-Speech for Multiple Speakers
di: Park, Nohil, et al.
Pubblicazione: (2024)
di: Park, Nohil, et al.
Pubblicazione: (2024)
Uncertainty Quantification in Machine Learning for Joint Speaker Diarization and Identification
di: McKnight, Simon W., et al.
Pubblicazione: (2023)
di: McKnight, Simon W., et al.
Pubblicazione: (2023)
Study on Inter and Intra Speaker Variability in Speaker Recognition
di: Okhotnikov, Anton, et al.
Pubblicazione: (2024)
di: Okhotnikov, Anton, et al.
Pubblicazione: (2024)
Target Speaker Extraction with Curriculum Learning
di: Liu, Yun, et al.
Pubblicazione: (2024)
di: Liu, Yun, et al.
Pubblicazione: (2024)
Disentangled Representation Learning for Environment-agnostic Speaker Recognition
di: Nam, KiHyun, et al.
Pubblicazione: (2024)
di: Nam, KiHyun, et al.
Pubblicazione: (2024)
SEED: Speaker Embedding Enhancement Diffusion Model
di: Nam, KiHyun, et al.
Pubblicazione: (2025)
di: Nam, KiHyun, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Towards Understanding of Frequency Dependence on Sound Event Detection
di: Nam, Hyeonuk, et al.
Pubblicazione: (2025) -
Self Training and Ensembling Frequency Dependent Networks with Coarse Prediction Pooling and Sound Event Bounding Boxes
di: Nam, Hyeonuk, et al.
Pubblicazione: (2024) -
Diversifying and Expanding Frequency-Adaptive Convolution Kernels for Sound Event Detection
di: Nam, Hyeonuk, et al.
Pubblicazione: (2024) -
Temporal Attention Pooling for Frequency Dynamic Convolution in Sound Event Detection
di: Nam, Hyeonuk, et al.
Pubblicazione: (2025) -
JiTTER: Jigsaw Temporal Transformer for Event Reconstruction for Self-Supervised Sound Event Detection
di: Nam, Hyeonuk, et al.
Pubblicazione: (2025)