Biodenoising: Animal Vocalization Denoising without Access to Clean Data
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Miron, Marius, Keen, Sara, Liu, Jen-Yu, Hoffman, Benjamin, Hagiwara, Masato, Pietquin, Olivier, Effenberger, Felix, Cusimano, Maddie |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Robust detection of overlapping bioacoustic sound events
par: Mahon, Louis, et autres
Publié: (2025)
par: Mahon, Louis, et autres
Publié: (2025)
Synthetic data enables context-aware bioacoustic sound event detection
par: Hoffman, Benjamin, et autres
Publié: (2025)
par: Hoffman, Benjamin, et autres
Publié: (2025)
ISPA: Inter-Species Phonetic Alphabet for Transcribing Animal Sounds
par: Hagiwara, Masato, et autres
Publié: (2024)
par: Hagiwara, Masato, et autres
Publié: (2024)
NatureLM-audio: an Audio-Language Foundation Model for Bioacoustics
par: Robinson, David, et autres
Publié: (2024)
par: Robinson, David, et autres
Publié: (2024)
AVEX: What Matters for Animal Vocalization Encoding
par: Miron, Marius, et autres
Publié: (2025)
par: Miron, Marius, et autres
Publié: (2025)
Mel-RoFormer for Vocal Separation and Vocal Melody Transcription
par: Wang, Ju-Chiang, et autres
Publié: (2024)
par: Wang, Ju-Chiang, et autres
Publié: (2024)
CVSM: Contrastive Vocal Similarity Modeling
par: Garoufis, Christos, et autres
Publié: (2025)
par: Garoufis, Christos, et autres
Publié: (2025)
Modeling and Estimation of Vocal Tract and Glottal Source Parameters Using ARMAX-LF Model
par: Lia, Kai, et autres
Publié: (2024)
par: Lia, Kai, et autres
Publié: (2024)
Melodic and Metrical Elements of Expressiveness in Hindustani Vocal Music
par: Bhake, Yash, et autres
Publié: (2025)
par: Bhake, Yash, et autres
Publié: (2025)
Auditory Representation Effective for Estimating Vocal Tract Information
par: Irino, Toshio, et autres
Publié: (2023)
par: Irino, Toshio, et autres
Publié: (2023)
Improving Unsupervised Clean-to-Rendered Guitar Tone Transformation Using GANs and Integrated Unaligned Clean Data
par: Chen, Yu-Hua, et autres
Publié: (2024)
par: Chen, Yu-Hua, et autres
Publié: (2024)
A Reliable and Efficient Detection Pipeline for Rodent Ultrasonic Vocalizations
par: Anis, Sabah Shahnoor, et autres
Publié: (2025)
par: Anis, Sabah Shahnoor, et autres
Publié: (2025)
Drum-to-Vocal Percussion Sound Conversion and Its Evaluation Methodology
par: Nobukawa, Rinka, et autres
Publié: (2025)
par: Nobukawa, Rinka, et autres
Publié: (2025)
Analysis of Self-Supervised Speech Models on Children's Speech and Infant Vocalizations
par: Li, Jialu, et autres
Publié: (2024)
par: Li, Jialu, et autres
Publié: (2024)
voc2vec: A Foundation Model for Non-Verbal Vocalization
par: Koudounas, Alkis, et autres
Publié: (2025)
par: Koudounas, Alkis, et autres
Publié: (2025)
RMVPE: A Robust Model for Vocal Pitch Estimation in Polyphonic Music
par: Wei, Haojie, et autres
Publié: (2023)
par: Wei, Haojie, et autres
Publié: (2023)
Learning Vocal-Tract Area and Radiation with a Physics-Informed Webster Model
par: Lu, Minhui, et autres
Publié: (2026)
par: Lu, Minhui, et autres
Publié: (2026)
Enhancing Child Vocalization Classification with Phonetically-Tuned Embeddings for Assisting Autism Diagnosis
par: Li, Jialu, et autres
Publié: (2023)
par: Li, Jialu, et autres
Publié: (2023)
DiffVox: A Differentiable Model for Capturing and Analysing Vocal Effects Distributions
par: Yu, Chin-Yun, et autres
Publié: (2025)
par: Yu, Chin-Yun, et autres
Publié: (2025)
Speech Denoising with Auditory Models
par: Saddler, Mark R., et autres
Publié: (2020)
par: Saddler, Mark R., et autres
Publié: (2020)
DJCM: A Deep Joint Cascade Model for Singing Voice Separation and Vocal Pitch Estimation
par: Wei, Haojie, et autres
Publié: (2024)
par: Wei, Haojie, et autres
Publié: (2024)
Hearing Health in Home Healthcare: Leveraging LLMs for Illness Scoring and ALMs for Vocal Biomarker Extraction
par: Chen, Yu-Wen, et autres
Publié: (2025)
par: Chen, Yu-Wen, et autres
Publié: (2025)
Computational Extraction of Intonation and Tuning Systems from Multiple Microtonal Monophonic Vocal Recordings with Diverse Modes
par: Shafiei, Sepideh, et autres
Publié: (2025)
par: Shafiei, Sepideh, et autres
Publié: (2025)
Adaptive Differential Denoising for Respiratory Sounds Classification
par: Dong, Gaoyang, et autres
Publié: (2025)
par: Dong, Gaoyang, et autres
Publié: (2025)
Towards HRTF Personalization using Denoising Diffusion Models
par: Sánchez, Juan Camilo Albarracín, et autres
Publié: (2025)
par: Sánchez, Juan Camilo Albarracín, et autres
Publié: (2025)
Complex Image-Generative Diffusion Transformer for Audio Denoising
par: Li, Junhui, et autres
Publié: (2024)
par: Li, Junhui, et autres
Publié: (2024)
Vision Transformer Segmentation for Visual Bird Sound Denoising
par: Kumar, Sahil, et autres
Publié: (2024)
par: Kumar, Sahil, et autres
Publié: (2024)
VocalAgent: Large Language Models for Vocal Health Diagnostics with Safety-Aware Evaluation
par: Kim, Yubin, et autres
Publié: (2025)
par: Kim, Yubin, et autres
Publié: (2025)
A Multilingual Framework for Dysarthria: Detection, Severity Classification, Speech-to-Text, and Clean Speech Generation
par: Raghu, Ananya, et autres
Publié: (2025)
par: Raghu, Ananya, et autres
Publié: (2025)
Confidence-based Filtering for Speech Dataset Curation with Generative Speech Enhancement Using Discrete Tokens
par: Yamauchi, Kazuki, et autres
Publié: (2026)
par: Yamauchi, Kazuki, et autres
Publié: (2026)
An Attribute Interpolation Method in Speech Synthesis by Model Merging
par: Murata, Masato, et autres
Publié: (2024)
par: Murata, Masato, et autres
Publié: (2024)
Exploring the Capability of Mamba in Speech Applications
par: Miyazaki, Koichi, et autres
Publié: (2024)
par: Miyazaki, Koichi, et autres
Publié: (2024)
Speaker-agnostic Emotion Vector for Cross-speaker Emotion Intensity Control
par: Murata, Masato, et autres
Publié: (2025)
par: Murata, Masato, et autres
Publié: (2025)
Mamba-based Decoder-Only Approach with Bidirectional Speech Modeling for Speech Recognition
par: Masuyama, Yoshiki, et autres
Publié: (2024)
par: Masuyama, Yoshiki, et autres
Publié: (2024)
On Feature Learning for Titi Monkey Activity Detection
par: Ravuri, Aditya, et autres
Publié: (2024)
par: Ravuri, Aditya, et autres
Publié: (2024)
RaD-Net: A Repairing and Denoising Network for Speech Signal Improvement
par: Liu, Mingshuai, et autres
Publié: (2024)
par: Liu, Mingshuai, et autres
Publié: (2024)
A Unified Denoising and Adaptation Framework for Self-Supervised Bengali Dialectal ASR
par: Biswas, Swadhin, et autres
Publié: (2025)
par: Biswas, Swadhin, et autres
Publié: (2025)
Towards the Synthesis of Non-speech Vocalizations
par: Hoq, Enjamamul, et autres
Publié: (2024)
par: Hoq, Enjamamul, et autres
Publié: (2024)
A Novel Score-CAM based Denoiser for Spectrographic Signature Extraction without Ground Truth
par: Elias, Noel
Publié: (2024)
par: Elias, Noel
Publié: (2024)
InsectSet459: an open dataset of insect sounds for bioacoustic machine learning
par: Faiß, Marius, et autres
Publié: (2025)
par: Faiß, Marius, et autres
Publié: (2025)
Documents similaires
-
Robust detection of overlapping bioacoustic sound events
par: Mahon, Louis, et autres
Publié: (2025) -
Synthetic data enables context-aware bioacoustic sound event detection
par: Hoffman, Benjamin, et autres
Publié: (2025) -
ISPA: Inter-Species Phonetic Alphabet for Transcribing Animal Sounds
par: Hagiwara, Masato, et autres
Publié: (2024) -
NatureLM-audio: an Audio-Language Foundation Model for Bioacoustics
par: Robinson, David, et autres
Publié: (2024) -
AVEX: What Matters for Animal Vocalization Encoding
par: Miron, Marius, et autres
Publié: (2025)