Physics-Guided Variational Model for Unsupervised Sound Source Tracking
Fuente:
arXiv
Salvato in:
| Autori principali: | Fiorio, Luan Vinícius, Nikoloska, Ivana, Defraene, Bruno, Young, Alex, David, Johan, Aarts, Ronald M. |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Categorical Unsupervised Variational Acoustic Clustering
di: Fiorio, Luan Vinícius, et al.
Pubblicazione: (2025)
di: Fiorio, Luan Vinícius, et al.
Pubblicazione: (2025)
Unsupervised Variational Acoustic Clustering
di: Fiorio, Luan Vinícius, et al.
Pubblicazione: (2025)
di: Fiorio, Luan Vinícius, et al.
Pubblicazione: (2025)
Clustering of Acoustic Environments with Variational Autoencoders for Hearing Devices
di: Fiorio, Luan Vinícius, et al.
Pubblicazione: (2025)
di: Fiorio, Luan Vinícius, et al.
Pubblicazione: (2025)
Target Speaker Selection for Neural Network Beamforming in Multi-Speaker Scenarios
di: Fiorio, Luan Vinícius, et al.
Pubblicazione: (2025)
di: Fiorio, Luan Vinícius, et al.
Pubblicazione: (2025)
Hybrid Real- And Complex-Valued Neural Network Concept For Low-Complexity Phase-Aware Speech Enhancement
di: Fiorio, Luan Vinícius, et al.
Pubblicazione: (2025)
di: Fiorio, Luan Vinícius, et al.
Pubblicazione: (2025)
Spectral Masking with Explicit Time-Context Windowing for Neural Network-Based Monaural Speech Enhancement
di: Fiorio, Luan Vinícius, et al.
Pubblicazione: (2024)
di: Fiorio, Luan Vinícius, et al.
Pubblicazione: (2024)
Importance-Weighted Domain Adaptation for Sound Source Tracking
di: Zhong, Bingxiang, et al.
Pubblicazione: (2025)
di: Zhong, Bingxiang, et al.
Pubblicazione: (2025)
Physics-Informed Transfer Learning for Data-Driven Sound Source Reconstruction in Near-Field Acoustic Holography
di: Luan, Xinmeng, et al.
Pubblicazione: (2025)
di: Luan, Xinmeng, et al.
Pubblicazione: (2025)
Causal Spatio-Temporal Sound Field Reconstruction
di: Sundström, David, et al.
Pubblicazione: (2026)
di: Sundström, David, et al.
Pubblicazione: (2026)
Physics-Informed Deep Learning for Nonlinear Friction Model of Bow-string Interaction
di: Luan, Xinmeng, et al.
Pubblicazione: (2025)
di: Luan, Xinmeng, et al.
Pubblicazione: (2025)
Self-Guided Target Sound Extraction and Classification Through Universal Sound Separation Model and Multiple Clues
di: Kwon, Younghoo, et al.
Pubblicazione: (2025)
di: Kwon, Younghoo, et al.
Pubblicazione: (2025)
Unsupervised Improved MVDR Beamforming for Sound Enhancement
di: Kealey, Jacob, et al.
Pubblicazione: (2024)
di: Kealey, Jacob, et al.
Pubblicazione: (2024)
Leveraging Sound Source Trajectories for Universal Sound Separation
di: Wu, Donghang, et al.
Pubblicazione: (2024)
di: Wu, Donghang, et al.
Pubblicazione: (2024)
Period Singer: Integrating Periodic and Aperiodic Variational Autoencoders for Natural-Sounding End-to-End Singing Voice Synthesis
di: Kim, Taewoo, et al.
Pubblicazione: (2024)
di: Kim, Taewoo, et al.
Pubblicazione: (2024)
Is MixIT Really Unsuitable for Correlated Sources? Exploring MixIT for Unsupervised Pre-training in Music Source Separation
di: Saijo, Kohei, et al.
Pubblicazione: (2025)
di: Saijo, Kohei, et al.
Pubblicazione: (2025)
Eliminating Quantization Errors in Classification-Based Sound Source Localization
di: Feng, Linfeng, et al.
Pubblicazione: (2023)
di: Feng, Linfeng, et al.
Pubblicazione: (2023)
Sound Source Separation Using Latent Variational Block-Wise Disentanglement
di: Helwani, Karim, et al.
Pubblicazione: (2024)
di: Helwani, Karim, et al.
Pubblicazione: (2024)
Permutation Invariant Recurrent Neural Networks for Sound Source Tracking Applications
di: Diaz-Guerra, David, et al.
Pubblicazione: (2023)
di: Diaz-Guerra, David, et al.
Pubblicazione: (2023)
Retrieval-Augmented Approach for Unsupervised Anomalous Sound Detection and Captioning without Model Training
di: Ogura, Ryoya, et al.
Pubblicazione: (2024)
di: Ogura, Ryoya, et al.
Pubblicazione: (2024)
Uncertainty Quantification and Risk Control for Multi-Speaker Sound Source Localization
di: Rozenfeld, Vadim, et al.
Pubblicazione: (2026)
di: Rozenfeld, Vadim, et al.
Pubblicazione: (2026)
Fast Algorithm for Moving Sound Source
di: Yang, Dong
Pubblicazione: (2025)
di: Yang, Dong
Pubblicazione: (2025)
Low-complexity Attention-based Unsupervised Anomalous Sound Detection exploiting Separable Convolutions and Angular Loss
di: Neri, Michael, et al.
Pubblicazione: (2024)
di: Neri, Michael, et al.
Pubblicazione: (2024)
SANN-PSZ: Spatially Adaptive Neural Network for Head-Tracked Personal Sound Zones
di: Qiao, Yue, et al.
Pubblicazione: (2024)
di: Qiao, Yue, et al.
Pubblicazione: (2024)
UCIL: An Unsupervised Class Incremental Learning Approach for Sound Event Detection
di: Xiao, Yang, et al.
Pubblicazione: (2024)
di: Xiao, Yang, et al.
Pubblicazione: (2024)
Inference-Adaptive Neural Steering for Real-Time Area-Based Sound Source Separation
di: Strauss, Martin, et al.
Pubblicazione: (2024)
di: Strauss, Martin, et al.
Pubblicazione: (2024)
Sound Field Translation and Mixed Source Model for Virtual Applications with Perceptual Validation
di: Birnie, Lachlan, et al.
Pubblicazione: (2020)
di: Birnie, Lachlan, et al.
Pubblicazione: (2020)
ACES: Evaluating Automated Audio Captioning Models on the Semantics of Sounds
di: Wijngaard, Gijs, et al.
Pubblicazione: (2024)
di: Wijngaard, Gijs, et al.
Pubblicazione: (2024)
Unsupervised Single-Channel Audio Separation with Diffusion Source Priors
di: Shi, Runwu, et al.
Pubblicazione: (2025)
di: Shi, Runwu, et al.
Pubblicazione: (2025)
A Steered Response Power Method for Sound Source Localization With Generic Acoustic Models
di: Müller, Kaspar, et al.
Pubblicazione: (2025)
di: Müller, Kaspar, et al.
Pubblicazione: (2025)
MVANet: Multi-Stage Video Attention Network for Sound Event Localization and Detection with Source Distance Estimation
di: Hong, Hengyi, et al.
Pubblicazione: (2024)
di: Hong, Hengyi, et al.
Pubblicazione: (2024)
Where's That Voice Coming? Continual Learning for Sound Source Localization
di: Xiao, Yang, et al.
Pubblicazione: (2024)
di: Xiao, Yang, et al.
Pubblicazione: (2024)
Robust Fixed-Filter Sound Zone Control with Audio-Based Position Tracking
di: Bhattacharjee, Sankha Subhra, et al.
Pubblicazione: (2024)
di: Bhattacharjee, Sankha Subhra, et al.
Pubblicazione: (2024)
Class-Aware Permutation-Invariant Signal-to-Distortion Ratio for Semantic Segmentation of Sound Scene with Same-Class Sources
di: Nguyen, Binh Thien, et al.
Pubblicazione: (2026)
di: Nguyen, Binh Thien, et al.
Pubblicazione: (2026)
Tracking Listener Attention: Gaze-Guided Audio-Visual Speech Enhancement Framework
di: Yang, Hsiang-Cheng, et al.
Pubblicazione: (2026)
di: Yang, Hsiang-Cheng, et al.
Pubblicazione: (2026)
MUSHRA-1S: A scalable and sensitive test approach for evaluating top-tier speech processing systems
di: Lechler, Laura, et al.
Pubblicazione: (2025)
di: Lechler, Laura, et al.
Pubblicazione: (2025)
Sound Field Reconstruction Using Physics-Informed Boundary Integral Networks
di: Damiano, Stefano, et al.
Pubblicazione: (2025)
di: Damiano, Stefano, et al.
Pubblicazione: (2025)
Analytic Class Incremental Learning for Sound Source Localization with Privacy Protection
di: Qian, Xinyuan, et al.
Pubblicazione: (2024)
di: Qian, Xinyuan, et al.
Pubblicazione: (2024)
TF-Mamba: A Time-Frequency Network for Sound Source Localization
di: Xiao, Yang, et al.
Pubblicazione: (2024)
di: Xiao, Yang, et al.
Pubblicazione: (2024)
Steered Response Power for Sound Source Localization: A Tutorial Review
di: Grinstein, Eric, et al.
Pubblicazione: (2024)
di: Grinstein, Eric, et al.
Pubblicazione: (2024)
Exploring Text-Queried Sound Event Detection with Audio Source Separation
di: Yin, Han, et al.
Pubblicazione: (2024)
di: Yin, Han, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Categorical Unsupervised Variational Acoustic Clustering
di: Fiorio, Luan Vinícius, et al.
Pubblicazione: (2025) -
Unsupervised Variational Acoustic Clustering
di: Fiorio, Luan Vinícius, et al.
Pubblicazione: (2025) -
Clustering of Acoustic Environments with Variational Autoencoders for Hearing Devices
di: Fiorio, Luan Vinícius, et al.
Pubblicazione: (2025) -
Target Speaker Selection for Neural Network Beamforming in Multi-Speaker Scenarios
di: Fiorio, Luan Vinícius, et al.
Pubblicazione: (2025) -
Hybrid Real- And Complex-Valued Neural Network Concept For Low-Complexity Phase-Aware Speech Enhancement
di: Fiorio, Luan Vinícius, et al.
Pubblicazione: (2025)