Few-Shot Bioacoustic Event Detection with Frame-Level Embedding Learning System
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Zhao, PengYuan, Lu, ChengWei, Zou, Liang |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Adaptive Learning via a Negative Selection Strategy for Few-Shot Bioacoustic Event Detection
par: Chen, Yaxiong, et autres
Publié: (2024)
par: Chen, Yaxiong, et autres
Publié: (2024)
Regularized Contrastive Pre-training for Few-shot Bioacoustic Sound Detection
par: Moummad, Ilyass, et autres
Publié: (2023)
par: Moummad, Ilyass, et autres
Publié: (2023)
Robust Bioacoustic Detection via Richly Labelled Synthetic Soundscape Augmentation
par: Soltero, Kaspar, et autres
Publié: (2025)
par: Soltero, Kaspar, et autres
Publié: (2025)
Zero- and Few-shot Sound Event Localization and Detection
par: Shimada, Kazuki, et autres
Publié: (2023)
par: Shimada, Kazuki, et autres
Publié: (2023)
Towards High-Fidelity and Controllable Bioacoustic Generation via Enhanced Diffusion Learning
par: Song, Tianyu, et autres
Publié: (2025)
par: Song, Tianyu, et autres
Publié: (2025)
Aggregation Strategies for Efficient Annotation of Bioacoustic Sound Events Using Active Learning
par: Lindholm, Richard, et autres
Publié: (2025)
par: Lindholm, Richard, et autres
Publié: (2025)
Learning Domain-Robust Bioacoustic Representations for Mosquito Species Classification with Contrastive Learning and Distribution Alignment
par: Hou, Yuanbo, et autres
Publié: (2025)
par: Hou, Yuanbo, et autres
Publié: (2025)
Hybrid Disagreement-Diversity Active Learning for Bioacoustic Sound Event Detection
par: Zhang, Shiqi, et autres
Publié: (2025)
par: Zhang, Shiqi, et autres
Publié: (2025)
Audiobox TTA-RAG: Improving Zero-Shot and Few-Shot Text-To-Audio with Retrieval-Augmented Generation
par: Yang, Mu, et autres
Publié: (2024)
par: Yang, Mu, et autres
Publié: (2024)
Contrastive Loss Based Frame-wise Feature disentanglement for Polyphonic Sound Event Detection
par: Guan, Yadong, et autres
Publié: (2024)
par: Guan, Yadong, et autres
Publié: (2024)
The Universal Personalizer: Few-Shot Dysarthric Speech Recognition via Meta-Learning
par: Agarwal, Dhruuv, et autres
Publié: (2025)
par: Agarwal, Dhruuv, et autres
Publié: (2025)
Distilling Spectrograms into Tokens: Fast and Lightweight Bioacoustic Classification for BirdCLEF+ 2025
par: Miyaguchi, Anthony, et autres
Publié: (2025)
par: Miyaguchi, Anthony, et autres
Publié: (2025)
Large Language Models and Non-Negative Matrix Factorization for Bioacoustic Signal Decomposition
par: Torabi, Yasaman, et autres
Publié: (2025)
par: Torabi, Yasaman, et autres
Publié: (2025)
BioME: A Resource-Efficient Bioacoustic Foundational Model for IoT Applications
par: Guimarães, Heitor R., et autres
Publié: (2026)
par: Guimarães, Heitor R., et autres
Publié: (2026)
Generalized Audio Deepfake Detection Using Frame-level Latent Information Entropy
par: Zhao, Botao, et autres
Publié: (2025)
par: Zhao, Botao, et autres
Publié: (2025)
Towards Deep Active Learning in Avian Bioacoustics
par: Rauch, Lukas, et autres
Publié: (2024)
par: Rauch, Lukas, et autres
Publié: (2024)
A Few-Shot Learning Approach for Sound Source Distance Estimation Using Relation Networks
par: Sobhdel, Amirreza, et autres
Publié: (2021)
par: Sobhdel, Amirreza, et autres
Publié: (2021)
Self-supervised Learning for Acoustic Few-Shot Classification
par: Liang, Jingyong, et autres
Publié: (2024)
par: Liang, Jingyong, et autres
Publié: (2024)
Vision Language Models Are Few-Shot Audio Spectrogram Classifiers
par: Dixit, Satvik, et autres
Publié: (2024)
par: Dixit, Satvik, et autres
Publié: (2024)
Few-Shot and Pseudo-Label Guided Speech Quality Evaluation with Large Language Models
par: Zezario, Ryandhimas E., et autres
Publié: (2026)
par: Zezario, Ryandhimas E., et autres
Publié: (2026)
The THU-HCSI Multi-Speaker Multi-Lingual Few-Shot Voice Cloning System for LIMMITS'24 Challenge
par: Zhou, Yixuan, et autres
Publié: (2024)
par: Zhou, Yixuan, et autres
Publié: (2024)
Learning How to Listen: A Temporal-Frequential Attention Model for Sound Event Detection
par: Shen, Yu-Han, et autres
Publié: (2018)
par: Shen, Yu-Han, et autres
Publié: (2018)
Speech Enhancement with Overlapped-Frame Information Fusion and Causal Self-Attention
par: Zhang, Yuewei, et autres
Publié: (2025)
par: Zhang, Yuewei, et autres
Publié: (2025)
Word-Level Emotional Expression Control in Zero-Shot Text-to-Speech Synthesis
par: Wang, Tianrui, et autres
Publié: (2025)
par: Wang, Tianrui, et autres
Publié: (2025)
IndexTTS: An Industrial-Level Controllable and Efficient Zero-Shot Text-To-Speech System
par: Deng, Wei, et autres
Publié: (2025)
par: Deng, Wei, et autres
Publié: (2025)
Hierarchical Pooling Structure for Weakly Labeled Sound Event Detection
par: He, Ke-Xin, et autres
Publié: (2019)
par: He, Ke-Xin, et autres
Publié: (2019)
Perch 2.0: The Bittern Lesson for Bioacoustics
par: van Merriënboer, Bart, et autres
Publié: (2025)
par: van Merriënboer, Bart, et autres
Publié: (2025)
Quantization-Based Score Calibration for Few-Shot Keyword Spotting with Dynamic Time Warping in Noisy Environments
par: Wilkinghoff, Kevin, et autres
Publié: (2025)
par: Wilkinghoff, Kevin, et autres
Publié: (2025)
Few-Shot Speech Deepfake Detection Adaptation with Gaussian Processes
par: Glazer, Neta, et autres
Publié: (2025)
par: Glazer, Neta, et autres
Publié: (2025)
FGCL: Fine-grained Contrastive Learning For Mandarin Stuttering Event Detection
par: Jiang, Han, et autres
Publié: (2024)
par: Jiang, Han, et autres
Publié: (2024)
UCIL: An Unsupervised Class Incremental Learning Approach for Sound Event Detection
par: Xiao, Yang, et autres
Publié: (2024)
par: Xiao, Yang, et autres
Publié: (2024)
Unified Audio Event Detection
par: Jiang, Yidi, et autres
Publié: (2024)
par: Jiang, Yidi, et autres
Publié: (2024)
A Few-Shot Approach to Dysarthric Speech Intelligibility Level Classification Using Transformers
par: Chowdary, Paleti Nikhil, et autres
Publié: (2023)
par: Chowdary, Paleti Nikhil, et autres
Publié: (2023)
A Two-Step Learning Framework for Enhancing Sound Event Localization and Detection
par: Yu, Hogeon
Publié: (2025)
par: Yu, Hogeon
Publié: (2025)
Selective-Memory Meta-Learning with Environment Representations for Sound Event Localization and Detection
par: Hu, Jinbo, et autres
Publié: (2023)
par: Hu, Jinbo, et autres
Publié: (2023)
Integrated Multi-Level Knowledge Distillation for Enhanced Speaker Verification
par: Yang, Wenhao, et autres
Publié: (2024)
par: Yang, Wenhao, et autres
Publié: (2024)
Robust Wake Word Spotting With Frame-Level Cross-Modal Attention Based Audio-Visual Conformer
par: Wang, Haoxu, et autres
Publié: (2024)
par: Wang, Haoxu, et autres
Publié: (2024)
Experimental Results of Underwater Sound Speed Profile Inversion by Few-shot Multi-task Learning
par: Huang, Wei, et autres
Publié: (2023)
par: Huang, Wei, et autres
Publié: (2023)
WildDESED: An LLM-Powered Dataset for Wild Domestic Environment Sound Event Detection System
par: Xiao, Yang, et autres
Publié: (2024)
par: Xiao, Yang, et autres
Publié: (2024)
Harmonic Detection from Noisy Speech with Auditory Frame Gain for Intelligibility Enhancement
par: Queiroz, A., et autres
Publié: (2024)
par: Queiroz, A., et autres
Publié: (2024)
Documents similaires
-
Adaptive Learning via a Negative Selection Strategy for Few-Shot Bioacoustic Event Detection
par: Chen, Yaxiong, et autres
Publié: (2024) -
Regularized Contrastive Pre-training for Few-shot Bioacoustic Sound Detection
par: Moummad, Ilyass, et autres
Publié: (2023) -
Robust Bioacoustic Detection via Richly Labelled Synthetic Soundscape Augmentation
par: Soltero, Kaspar, et autres
Publié: (2025) -
Zero- and Few-shot Sound Event Localization and Detection
par: Shimada, Kazuki, et autres
Publié: (2023) -
Towards High-Fidelity and Controllable Bioacoustic Generation via Enhanced Diffusion Learning
par: Song, Tianyu, et autres
Publié: (2025)