Enregistré dans:
| Auteurs principaux: | Guzik, Mateusz, Kowalczyk, Konrad |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | https://arxiv.org/abs/2501.10305 |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Clustering-based hard negative sampling for supervised contrastive speaker verification
par: Masztalski, Piotr, et autres
Publié: (2025)
par: Masztalski, Piotr, et autres
Publié: (2025)
Deep learning based spatial aliasing reduction in beamforming for audio capture
par: Guzik, Mateusz, et autres
Publié: (2025)
par: Guzik, Mateusz, et autres
Publié: (2025)
HeightCeleb - an enrichment of VoxCeleb dataset with speaker height information
par: Kacprzak, Stanisław, et autres
Publié: (2024)
par: Kacprzak, Stanisław, et autres
Publié: (2024)
Investigation of Whisper ASR Hallucinations Induced by Non-Speech Audio
par: Barański, Mateusz, et autres
Publié: (2025)
par: Barański, Mateusz, et autres
Publié: (2025)
Perceptually-motivated Spatial Audio Codec for Higher-Order Ambisonics Compression
par: Hold, Christoph, et autres
Publié: (2024)
par: Hold, Christoph, et autres
Publié: (2024)
Evaluation of Spherical Wavelet Framework in Comparsion with Ambisonics
par: Ekmen, Ş., et autres
Publié: (2025)
par: Ekmen, Ş., et autres
Publié: (2025)
Introduction to Ambisonics, Part 1: The Part With No Math
par: Ahrens, Jens
Publié: (2025)
par: Ahrens, Jens
Publié: (2025)
Residual Learning for Neural Ambisonics Encoders
par: Deppisch, Thomas, et autres
Publié: (2026)
par: Deppisch, Thomas, et autres
Publié: (2026)
Spatial-Temporal Activity-Informed Diarization and Separation
par: Hsu, Yicheng, et autres
Publié: (2024)
par: Hsu, Yicheng, et autres
Publié: (2024)
Ambisonizer: Neural Upmixing as Spherical Harmonics Generation
par: Zang, Yongyi, et autres
Publié: (2024)
par: Zang, Yongyi, et autres
Publié: (2024)
Ambisonics Networks -- The Effect Of Radial Functions Regularization
par: Shaybet, Bar, et autres
Publié: (2024)
par: Shaybet, Bar, et autres
Publié: (2024)
Ambisonics Encoder for Wearable Array with Improved Binaural Reproduction
par: Gayer, Yhonatan, et autres
Publié: (2025)
par: Gayer, Yhonatan, et autres
Publié: (2025)
Neural Ambisonics encoding for compact irregular microphone arrays
par: Heikkinen, Mikko, et autres
Publié: (2024)
par: Heikkinen, Mikko, et autres
Publié: (2024)
DiffAU: Diffusion-Based Ambisonics Upscaling
par: Milstein, Amit, et autres
Publié: (2025)
par: Milstein, Amit, et autres
Publié: (2025)
Dynamic Real-Time Ambisonics Order Adaptation for Immersive Networked Music Performances
par: Ostan, Paolo, et autres
Publié: (2025)
par: Ostan, Paolo, et autres
Publié: (2025)
Perceptual implications of simplifying geometrical acoustics models for Ambisonics-based binaural reverberation
par: Martin, Vincent, et autres
Publié: (2024)
par: Martin, Vincent, et autres
Publié: (2024)
Ambisonics Encoding For Arbitrary Microphone Arrays Incorporating Residual Channels For Binaural Reproduction
par: Gayer, Yhonatan, et autres
Publié: (2024)
par: Gayer, Yhonatan, et autres
Publié: (2024)
Ambisonics Binaural Rendering via Masked Magnitude Least Squares
par: Berebi, Or, et autres
Publié: (2025)
par: Berebi, Or, et autres
Publié: (2025)
A first-order DirAC-based parametric Ambisonic coder for immersive communications
par: Fuchs, Guillaume, et autres
Publié: (2025)
par: Fuchs, Guillaume, et autres
Publié: (2025)
Neural Ambisonic Encoding For Multi-Speaker Scenarios Using A Circular Microphone Array
par: Qiao, Yue, et autres
Publié: (2024)
par: Qiao, Yue, et autres
Publié: (2024)
Perceptual Compensation of Ambisonics Recordings for Reproduction in Room
par: Fallah, Ali, et autres
Publié: (2025)
par: Fallah, Ali, et autres
Publié: (2025)
AmbiDrop: Array-Agnostic Speech Enhancement Using Ambisonics Encoding and Dropout-Based Learning
par: Tatarjitzky, Michael, et autres
Publié: (2025)
par: Tatarjitzky, Michael, et autres
Publié: (2025)
Beyond Omnidirectional: Neural Ambisonics Encoding for Arbitrary Microphone Directivity Patterns using Cross-Attention
par: Heikkinen, Mikko, et autres
Publié: (2026)
par: Heikkinen, Mikko, et autres
Publié: (2026)
Ambisonics Super-Resolution Using A Waveform-Domain Neural Network
par: Nawfal, Ismael, et autres
Publié: (2025)
par: Nawfal, Ismael, et autres
Publié: (2025)
SHroom: A Python Framework for Ambisonics Room Acoustics Simulation and Binaural Rendering
par: Gayer, Yhonatan
Publié: (2026)
par: Gayer, Yhonatan
Publié: (2026)
Array-Aware Ambisonics and HRTF Encoding for Binaural Reproduction With Wearable Arrays
par: Gayer, Yhonatan, et autres
Publié: (2025)
par: Gayer, Yhonatan, et autres
Publié: (2025)
Velocity Potential Neural Field for Efficient Ambisonics Impulse Response Modeling
par: Masuyama, Yoshiki, et autres
Publié: (2026)
par: Masuyama, Yoshiki, et autres
Publié: (2026)
Do Music Source Separation Models Preserve Spatial Information in Binaural Audio?
par: Namballa, Richa, et autres
Publié: (2025)
par: Namballa, Richa, et autres
Publié: (2025)
Fast Multichannel NMF with Block-Diagonal Spatial Covariance Matrices for Efficient Blind Source Separation Using Distributed Microphone Arrays
par: Nishikori, Hirotaka, et autres
Publié: (2026)
par: Nishikori, Hirotaka, et autres
Publié: (2026)
Source Separation by Flow Matching
par: Scheibler, Robin, et autres
Publié: (2025)
par: Scheibler, Robin, et autres
Publié: (2025)
SCNet: Sparse Compression Network for Music Source Separation
par: Tong, Weinan, et autres
Publié: (2024)
par: Tong, Weinan, et autres
Publié: (2024)
Blind Estimation of Sub-band Acoustic Parameters from Ambisonics Recordings using Spectro-Spatial Covariance Features
par: Meng, Hanyu, et autres
Publié: (2024)
par: Meng, Hanyu, et autres
Publié: (2024)
DnR-nonverbal: Cinematic Audio Source Separation Dataset Containing Non-Verbal Sounds
par: Hasumi, Takuya, et autres
Publié: (2025)
par: Hasumi, Takuya, et autres
Publié: (2025)
Determined Multichannel Blind Source Separation with Clustered Source Model
par: Wang, Jianyu, et autres
Publié: (2024)
par: Wang, Jianyu, et autres
Publié: (2024)
Task-Aware Unified Source Separation
par: Saijo, Kohei, et autres
Publié: (2024)
par: Saijo, Kohei, et autres
Publié: (2024)
Compression of Higher Order Ambisonics with Multichannel RVQGAN
par: Hirvonen, Toni, et autres
Publié: (2024)
par: Hirvonen, Toni, et autres
Publié: (2024)
Brain-Informed Speech Separation for Cochlear Implants
par: Gajecki, Tom, et autres
Publié: (2026)
par: Gajecki, Tom, et autres
Publié: (2026)
Is MixIT Really Unsuitable for Correlated Sources? Exploring MixIT for Unsupervised Pre-training in Music Source Separation
par: Saijo, Kohei, et autres
Publié: (2025)
par: Saijo, Kohei, et autres
Publié: (2025)
Pre-training Music Classification Models via Music Source Separation
par: Garoufis, Christos, et autres
Publié: (2023)
par: Garoufis, Christos, et autres
Publié: (2023)
Input-Adaptive Spectral Feature Compression by Sequence Modeling for Source Separation
par: Saijo, Kohei, et autres
Publié: (2026)
par: Saijo, Kohei, et autres
Publié: (2026)
Documents similaires
-
Clustering-based hard negative sampling for supervised contrastive speaker verification
par: Masztalski, Piotr, et autres
Publié: (2025) -
Deep learning based spatial aliasing reduction in beamforming for audio capture
par: Guzik, Mateusz, et autres
Publié: (2025) -
HeightCeleb - an enrichment of VoxCeleb dataset with speaker height information
par: Kacprzak, Stanisław, et autres
Publié: (2024) -
Investigation of Whisper ASR Hallucinations Induced by Non-Speech Audio
par: Barański, Mateusz, et autres
Publié: (2025) -
Perceptually-motivated Spatial Audio Codec for Higher-Order Ambisonics Compression
par: Hold, Christoph, et autres
Publié: (2024)