Conformal Prediction for Manifold-based Source Localization with Gaussian Processes
Fuente:
arXiv
Salvato in:
| Autori principali: | Rozenfeld, Vadim, Goldshtein, Bracha Laufer |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Uncertainty Quantification and Risk Control for Multi-Speaker Sound Source Localization
di: Rozenfeld, Vadim, et al.
Pubblicazione: (2026)
di: Rozenfeld, Vadim, et al.
Pubblicazione: (2026)
MAPSS: Manifold-based Assessment of Perceptual Source Separation
di: Ivry, Amir, et al.
Pubblicazione: (2025)
di: Ivry, Amir, et al.
Pubblicazione: (2025)
LipVoicer: Generating Speech from Silent Videos Guided by Lip Reading
di: Yemini, Yochai, et al.
Pubblicazione: (2023)
di: Yemini, Yochai, et al.
Pubblicazione: (2023)
CNN-based Robust Sound Source Localization with SRP-PHAT for the Extreme Edge
di: Yin, Jun, et al.
Pubblicazione: (2025)
di: Yin, Jun, et al.
Pubblicazione: (2025)
NEST: Self-supervised Fast Conformer as All-purpose Seasoning to Speech Processing Tasks
di: Huang, He, et al.
Pubblicazione: (2024)
di: Huang, He, et al.
Pubblicazione: (2024)
Where's That Voice Coming? Continual Learning for Sound Source Localization
di: Xiao, Yang, et al.
Pubblicazione: (2024)
di: Xiao, Yang, et al.
Pubblicazione: (2024)
Analytic Class Incremental Learning for Sound Source Localization with Privacy Protection
di: Qian, Xinyuan, et al.
Pubblicazione: (2024)
di: Qian, Xinyuan, et al.
Pubblicazione: (2024)
TF-Mamba: A Time-Frequency Network for Sound Source Localization
di: Xiao, Yang, et al.
Pubblicazione: (2024)
di: Xiao, Yang, et al.
Pubblicazione: (2024)
Steered Response Power for Sound Source Localization: A Tutorial Review
di: Grinstein, Eric, et al.
Pubblicazione: (2024)
di: Grinstein, Eric, et al.
Pubblicazione: (2024)
GRAFX: An Open-Source Library for Audio Processing Graphs in PyTorch
di: Lee, Sungho, et al.
Pubblicazione: (2024)
di: Lee, Sungho, et al.
Pubblicazione: (2024)
An Efficient GPU-based Implementation for Noise Robust Sound Source Localization
di: Lin, Zirui, et al.
Pubblicazione: (2025)
di: Lin, Zirui, et al.
Pubblicazione: (2025)
Determined Blind Source Separation with Sinkhorn Divergence-based Optimal Allocation of the Source Power
di: Wang, Jianyu, et al.
Pubblicazione: (2025)
di: Wang, Jianyu, et al.
Pubblicazione: (2025)
IPDnet: A Universal Direct-Path IPD Estimation Network for Sound Source Localization
di: Wang, Yabo, et al.
Pubblicazione: (2024)
di: Wang, Yabo, et al.
Pubblicazione: (2024)
A Steered Response Power Method for Sound Source Localization With Generic Acoustic Models
di: Müller, Kaspar, et al.
Pubblicazione: (2025)
di: Müller, Kaspar, et al.
Pubblicazione: (2025)
Efficient Area-based and Speaker-Agnostic Source Separation
di: Strauss, Martin, et al.
Pubblicazione: (2024)
di: Strauss, Martin, et al.
Pubblicazione: (2024)
SingMOS: An extensive Open-Source Singing Voice Dataset for MOS Prediction
di: Tang, Yuxun, et al.
Pubblicazione: (2024)
di: Tang, Yuxun, et al.
Pubblicazione: (2024)
Conformer-based Ultrasound-to-Speech Conversion
di: Ibrahimov, Ibrahim, et al.
Pubblicazione: (2025)
di: Ibrahimov, Ibrahim, et al.
Pubblicazione: (2025)
Combining Audio and Non-Audio Inputs in Evolved Neural Networks for Ovenbird
di: Hernandez, Sergio Poo, et al.
Pubblicazione: (2025)
di: Hernandez, Sergio Poo, et al.
Pubblicazione: (2025)
Unrestricted Global Phase Bias-Aware Single-channel Speech Enhancement with Conformer-based Metric GAN
di: Zhang, Shiqi, et al.
Pubblicazione: (2024)
di: Zhang, Shiqi, et al.
Pubblicazione: (2024)
SYKI-SVC: Advancing Singing Voice Conversion with Post-Processing Innovations and an Open-Source Professional Testset
di: Zhou, Yiquan, et al.
Pubblicazione: (2025)
di: Zhou, Yiquan, et al.
Pubblicazione: (2025)
Interpreting End-to-End Deep Learning Models for Speech Source Localization Using Layer-wise Relevance Propagation
di: Comanducci, Luca, et al.
Pubblicazione: (2024)
di: Comanducci, Luca, et al.
Pubblicazione: (2024)
Diffusion based Text-to-Music Generation with Global and Local Text based Conditioning
di: Zhang, Jisi, et al.
Pubblicazione: (2025)
di: Zhang, Jisi, et al.
Pubblicazione: (2025)
Binaural Sound Event Localization and Detection Neural Network based on HRTF Localization Cues for Humanoid Robots
di: Lee, Gyeong-Tae
Pubblicazione: (2025)
di: Lee, Gyeong-Tae
Pubblicazione: (2025)
Reference Microphone Selection for Guided Source Separation based on the Normalized L-p Norm
di: Lohmann, Anselm, et al.
Pubblicazione: (2025)
di: Lohmann, Anselm, et al.
Pubblicazione: (2025)
Determined Multichannel Blind Source Separation with Clustered Source Model
di: Wang, Jianyu, et al.
Pubblicazione: (2024)
di: Wang, Jianyu, et al.
Pubblicazione: (2024)
DTT-BSR: GAN-based DTTNet with RoPE Transformer Enhancement for Music Source Restoration
di: Tan, Shihong, et al.
Pubblicazione: (2026)
di: Tan, Shihong, et al.
Pubblicazione: (2026)
ChunkFormer: Masked Chunking Conformer For Long-Form Speech Transcription
di: Le, Khanh, et al.
Pubblicazione: (2025)
di: Le, Khanh, et al.
Pubblicazione: (2025)
Binaural Sound Event Localization and Detection based on HRTF Cues for Humanoid Robots
di: Lee, Gyeong-Tae, et al.
Pubblicazione: (2025)
di: Lee, Gyeong-Tae, et al.
Pubblicazione: (2025)
Efficient and Robust Long-Form Speech Recognition with Hybrid H3-Conformer
di: Honda, Tomoki, et al.
Pubblicazione: (2024)
di: Honda, Tomoki, et al.
Pubblicazione: (2024)
Noise-Robust Contrastive Learning with an MFCC-Conformer For Coronary Artery Disease Detection
di: Marocchi, Milan, et al.
Pubblicazione: (2026)
di: Marocchi, Milan, et al.
Pubblicazione: (2026)
Source Separation by Flow Matching
di: Scheibler, Robin, et al.
Pubblicazione: (2025)
di: Scheibler, Robin, et al.
Pubblicazione: (2025)
Source Verification for Speech Deepfakes
di: Negroni, Viola, et al.
Pubblicazione: (2025)
di: Negroni, Viola, et al.
Pubblicazione: (2025)
Frame-Aligned Fusion of Canary and WavLM for Non-Intrusive Intelligibility Prediction of Hearing-Aid-Processed Speech
di: Nakazawa, Kazushi
Pubblicazione: (2026)
di: Nakazawa, Kazushi
Pubblicazione: (2026)
A Comparative Study on Positional Encoding for Time-frequency Domain Dual-path Transformer-based Source Separation Models
di: Saijo, Kohei, et al.
Pubblicazione: (2025)
di: Saijo, Kohei, et al.
Pubblicazione: (2025)
AuralNet: Hierarchical Attention-based 3D Binaural Localization of Overlapping Speakers
di: Fu, Linya, et al.
Pubblicazione: (2025)
di: Fu, Linya, et al.
Pubblicazione: (2025)
WTFormer: A Wavelet Conformer Network for MIMO Speech Enhancement with Spatial Cues Peservation
di: Han, Lu, et al.
Pubblicazione: (2025)
di: Han, Lu, et al.
Pubblicazione: (2025)
Source Tracing of Audio Deepfake Systems
di: Klein, Nicholas, et al.
Pubblicazione: (2024)
di: Klein, Nicholas, et al.
Pubblicazione: (2024)
Task-Aware Unified Source Separation
di: Saijo, Kohei, et al.
Pubblicazione: (2024)
di: Saijo, Kohei, et al.
Pubblicazione: (2024)
Fast Algorithm for Moving Sound Source
di: Yang, Dong
Pubblicazione: (2025)
di: Yang, Dong
Pubblicazione: (2025)
Single-Microphone-Based Sound Source Localization for Mobile Robots in Reverberant Environments
di: Wang, Jiang, et al.
Pubblicazione: (2025)
di: Wang, Jiang, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Uncertainty Quantification and Risk Control for Multi-Speaker Sound Source Localization
di: Rozenfeld, Vadim, et al.
Pubblicazione: (2026) -
MAPSS: Manifold-based Assessment of Perceptual Source Separation
di: Ivry, Amir, et al.
Pubblicazione: (2025) -
LipVoicer: Generating Speech from Silent Videos Guided by Lip Reading
di: Yemini, Yochai, et al.
Pubblicazione: (2023) -
CNN-based Robust Sound Source Localization with SRP-PHAT for the Extreme Edge
di: Yin, Jun, et al.
Pubblicazione: (2025) -
NEST: Self-supervised Fast Conformer as All-purpose Seasoning to Speech Processing Tasks
di: Huang, He, et al.
Pubblicazione: (2024)