Sparse wavefield reconstruction and denoising with boostlets
Fuente:
arXiv
Salvato in:
| Autori principali: | Zea, Elias, Laudato, Marco, Andén, Joakim |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
A boostlet transform for wave-based acoustic signal processing in space-time
di: Zea, Elias, et al.
Pubblicazione: (2024)
di: Zea, Elias, et al.
Pubblicazione: (2024)
RaD-Net 2: A causal two-stage repairing and denoising speech enhancement network with knowledge distillation and complex axial self-attention
di: Liu, Mingshuai, et al.
Pubblicazione: (2024)
di: Liu, Mingshuai, et al.
Pubblicazione: (2024)
Differentiable physics for sound field reconstruction
di: Verburg, Samuel A., et al.
Pubblicazione: (2025)
di: Verburg, Samuel A., et al.
Pubblicazione: (2025)
An incremental algorithm based on multichannel non-negative matrix partial co-factorization for ambient denoising in auscultation
di: Cruz, Juan De La Torre, et al.
Pubblicazione: (2024)
di: Cruz, Juan De La Torre, et al.
Pubblicazione: (2024)
Toward a Sparse and Interpretable Audio Codec
di: Vinyard, John
Pubblicazione: (2025)
di: Vinyard, John
Pubblicazione: (2025)
Subjective quality evaluation of personalized own voice reconstruction systems
di: Ohlenbusch, Mattes, et al.
Pubblicazione: (2025)
di: Ohlenbusch, Mattes, et al.
Pubblicazione: (2025)
Regularized autoregressive modeling and its application to audio signal reconstruction
di: Mokrý, Ondřej, et al.
Pubblicazione: (2024)
di: Mokrý, Ondřej, et al.
Pubblicazione: (2024)
Sparsely Shared LoRA on Whisper for Child Speech Recognition
di: Liu, Wei, et al.
Pubblicazione: (2023)
di: Liu, Wei, et al.
Pubblicazione: (2023)
SNIPER Training: Single-Shot Sparse Training for Text-to-Speech
di: Lam, Perry, et al.
Pubblicazione: (2022)
di: Lam, Perry, et al.
Pubblicazione: (2022)
An experiment on an automated literature survey of data-driven speech enhancement methods
di: Santos, Arthur dos, et al.
Pubblicazione: (2023)
di: Santos, Arthur dos, et al.
Pubblicazione: (2023)
Efficient Sparse Coding with the Adaptive Locally Competitive Algorithm for Speech Classification
di: Bahadi, Soufiyan, et al.
Pubblicazione: (2024)
di: Bahadi, Soufiyan, et al.
Pubblicazione: (2024)
SwitchCodec: A High-Fidelity Nerual Audio Codec With Sparse Quantization
di: Wang, Jin, et al.
Pubblicazione: (2025)
di: Wang, Jin, et al.
Pubblicazione: (2025)
Sparse Direction of Arrival Estimation Method Based on Vector Signal Reconstruction with a Single Vector Sensor
di: Guo, Jiabin
Pubblicazione: (2024)
di: Guo, Jiabin
Pubblicazione: (2024)
Relational graph-driven differential denoising and diffusion attention fusion for multimodal conversation emotion recognition
di: Liu, Ying, et al.
Pubblicazione: (2026)
di: Liu, Ying, et al.
Pubblicazione: (2026)
FUSE: Universal Speech Enhancement using Multi-Stage Fusion of Sparse Compression and Token Generation Models for the URGENT 2025 Challenge
di: Goswami, Nabarun, et al.
Pubblicazione: (2025)
di: Goswami, Nabarun, et al.
Pubblicazione: (2025)
Zero-shot Cross-lingual Voice Transfer for TTS
di: Biadsy, Fadi, et al.
Pubblicazione: (2024)
di: Biadsy, Fadi, et al.
Pubblicazione: (2024)
A data-driven two-microphone method for in-situ sound absorption measurements
di: Emmerich, Leon, et al.
Pubblicazione: (2025)
di: Emmerich, Leon, et al.
Pubblicazione: (2025)
Improving Musical Accompaniment Co-creation via Diffusion Transformers
di: Nistal, Javier, et al.
Pubblicazione: (2024)
di: Nistal, Javier, et al.
Pubblicazione: (2024)
Differentiable Black-box and Gray-box Modeling of Nonlinear Audio Effects
di: Comunità, Marco, et al.
Pubblicazione: (2025)
di: Comunità, Marco, et al.
Pubblicazione: (2025)
Bayesian adaptive learning to latent variables via Variational Bayes and Maximum a Posteriori
di: Hu, Hu, et al.
Pubblicazione: (2024)
di: Hu, Hu, et al.
Pubblicazione: (2024)
A Study of Data Selection Strategies for Pre-training Self-Supervised Speech Models
di: Whetten, Ryan, et al.
Pubblicazione: (2026)
di: Whetten, Ryan, et al.
Pubblicazione: (2026)
MambaFoley: Foley Sound Generation using Selective State-Space Models
di: Colombo, Marco Furio, et al.
Pubblicazione: (2024)
di: Colombo, Marco Furio, et al.
Pubblicazione: (2024)
Extending Multilingual Speech Synthesis to 100+ Languages without Transcribed Data
di: Saeki, Takaaki, et al.
Pubblicazione: (2024)
di: Saeki, Takaaki, et al.
Pubblicazione: (2024)
Perturbed Public Voices (P$^{2}$V): A Dataset for Robust Audio Deepfake Detection
di: Gao, Chongyang, et al.
Pubblicazione: (2025)
di: Gao, Chongyang, et al.
Pubblicazione: (2025)
voc2vec: A Foundation Model for Non-Verbal Vocalization
di: Koudounas, Alkis, et al.
Pubblicazione: (2025)
di: Koudounas, Alkis, et al.
Pubblicazione: (2025)
Speaker Distance Estimation in Enclosures from Single-Channel Audio
di: Neri, Michael, et al.
Pubblicazione: (2024)
di: Neri, Michael, et al.
Pubblicazione: (2024)
Variational Bayesian Adaptive Learning of Deep Latent Variables for Acoustic Knowledge Transfer
di: Hu, Hu, et al.
Pubblicazione: (2025)
di: Hu, Hu, et al.
Pubblicazione: (2025)
An Explicit Consistency-Preserving Loss Function for Phase Reconstruction and Speech Enhancement
di: Ku, Pin-Jui, et al.
Pubblicazione: (2024)
di: Ku, Pin-Jui, et al.
Pubblicazione: (2024)
ITO-Master: Inference-Time Optimization for Audio Effects Modeling of Music Mastering Processors
di: Koo, Junghyun, et al.
Pubblicazione: (2025)
di: Koo, Junghyun, et al.
Pubblicazione: (2025)
ST-ITO: Controlling Audio Effects for Style Transfer with Inference-Time Optimization
di: Steinmetz, Christian J., et al.
Pubblicazione: (2024)
di: Steinmetz, Christian J., et al.
Pubblicazione: (2024)
GRAFX: An Open-Source Library for Audio Processing Graphs in PyTorch
di: Lee, Sungho, et al.
Pubblicazione: (2024)
di: Lee, Sungho, et al.
Pubblicazione: (2024)
Linear stimulus reconstruction works on the KU Leuven audiovisual, gaze-controlled auditory attention decoding dataset
di: Geirnaert, Simon, et al.
Pubblicazione: (2024)
di: Geirnaert, Simon, et al.
Pubblicazione: (2024)
Acousto-optic reconstruction of exterior sound field based on concentric circle sampling with circular harmonic expansion
di: Nguyen, Phuc Duc, et al.
Pubblicazione: (2023)
di: Nguyen, Phuc Duc, et al.
Pubblicazione: (2023)
Fx-Encoder++: Extracting Instrument-Wise Audio Effects Representations from Mixtures
di: Yeh, Yen-Tung, et al.
Pubblicazione: (2025)
di: Yeh, Yen-Tung, et al.
Pubblicazione: (2025)
Exploiting Consistency-Preserving Loss and Perceptual Contrast Stretching to Boost SSL-based Speech Enhancement
di: Khan, Muhammad Salman, et al.
Pubblicazione: (2024)
di: Khan, Muhammad Salman, et al.
Pubblicazione: (2024)
Audio Classification of Low Feature Spectrograms Utilizing Convolutional Neural Networks
di: Elias, Noel
Pubblicazione: (2024)
di: Elias, Noel
Pubblicazione: (2024)
A Novel Score-CAM based Denoiser for Spectrographic Signature Extraction without Ground Truth
di: Elias, Noel
Pubblicazione: (2024)
di: Elias, Noel
Pubblicazione: (2024)
DiffVox: A Differentiable Model for Capturing and Analysing Vocal Effects Distributions
di: Yu, Chin-Yun, et al.
Pubblicazione: (2025)
di: Yu, Chin-Yun, et al.
Pubblicazione: (2025)
Few-Shot and Pseudo-Label Guided Speech Quality Evaluation with Large Language Models
di: Zezario, Ryandhimas E., et al.
Pubblicazione: (2026)
di: Zezario, Ryandhimas E., et al.
Pubblicazione: (2026)
Automatic Music Mixing using a Generative Model of Effect Embeddings
di: Moliner, Eloi, et al.
Pubblicazione: (2025)
di: Moliner, Eloi, et al.
Pubblicazione: (2025)
Documenti analoghi
-
A boostlet transform for wave-based acoustic signal processing in space-time
di: Zea, Elias, et al.
Pubblicazione: (2024) -
RaD-Net 2: A causal two-stage repairing and denoising speech enhancement network with knowledge distillation and complex axial self-attention
di: Liu, Mingshuai, et al.
Pubblicazione: (2024) -
Differentiable physics for sound field reconstruction
di: Verburg, Samuel A., et al.
Pubblicazione: (2025) -
An incremental algorithm based on multichannel non-negative matrix partial co-factorization for ambient denoising in auscultation
di: Cruz, Juan De La Torre, et al.
Pubblicazione: (2024) -
Toward a Sparse and Interpretable Audio Codec
di: Vinyard, John
Pubblicazione: (2025)