On the Transferability of Large-Scale Self-Supervision to Few-Shot Audio Classification
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Heggan, Calum, Budgett, Sam, Hospedales, Timothy, Yaghoobi, Mehrdad |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
MT-SLVR: Multi-Task Self-Supervised Learning for Transformation In(Variant) Representations
par: Heggan, Calum, et autres
Publié: (2023)
par: Heggan, Calum, et autres
Publié: (2023)
Self-Supervised Learning for Few-Shot Bird Sound Classification
par: Moummad, Ilyass, et autres
Publié: (2023)
par: Moummad, Ilyass, et autres
Publié: (2023)
Zero Shot Audio to Audio Emotion Transfer With Speaker Disentanglement
par: Dutta, Soumya, et autres
Publié: (2024)
par: Dutta, Soumya, et autres
Publié: (2024)
Audio Flamingo: A Novel Audio Language Model with Few-Shot Learning and Dialogue Abilities
par: Kong, Zhifeng, et autres
Publié: (2024)
par: Kong, Zhifeng, et autres
Publié: (2024)
LC-Protonets: Multi-Label Few-Shot Learning for World Music Audio Tagging
par: Papaioannou, Charilaos, et autres
Publié: (2024)
par: Papaioannou, Charilaos, et autres
Publié: (2024)
Multi-label Zero-Shot Audio Classification with Temporal Attention
par: Dogan, Duygu, et autres
Publié: (2024)
par: Dogan, Duygu, et autres
Publié: (2024)
Enhancing Audio-Language Models through Self-Supervised Post-Training with Text-Audio Pairs
par: Sinha, Anshuman, et autres
Publié: (2024)
par: Sinha, Anshuman, et autres
Publié: (2024)
Towards Supervised Performance on Speaker Verification with Self-Supervised Learning by Leveraging Large-Scale ASR Models
par: Miara, Victor, et autres
Publié: (2024)
par: Miara, Victor, et autres
Publié: (2024)
Towards Robust Few-shot Class Incremental Learning in Audio Classification using Contrastive Representation
par: Singh, Riyansha, et autres
Publié: (2024)
par: Singh, Riyansha, et autres
Publié: (2024)
Improving Perceptual Audio Aesthetic Assessment via Triplet Loss and Self-Supervised Embeddings
par: Wisnu, Dyah A. M. G., et autres
Publié: (2025)
par: Wisnu, Dyah A. M. G., et autres
Publié: (2025)
Few-Shot Speech Deepfake Detection Adaptation with Gaussian Processes
par: Glazer, Neta, et autres
Publié: (2025)
par: Glazer, Neta, et autres
Publié: (2025)
On Class Separability Pitfalls In Audio-Text Contrastive Zero-Shot Learning
par: Tavares, Tiago, et autres
Publié: (2024)
par: Tavares, Tiago, et autres
Publié: (2024)
Zero-Shot Unsupervised and Text-Based Audio Editing Using DDPM Inversion
par: Manor, Hila, et autres
Publié: (2024)
par: Manor, Hila, et autres
Publié: (2024)
Blind Audio Bandwidth Extension: A Diffusion-Based Zero-Shot Approach
par: Moliner, Eloi, et autres
Publié: (2023)
par: Moliner, Eloi, et autres
Publié: (2023)
SNAC: Multi-Scale Neural Audio Codec
par: Siuzdak, Hubert, et autres
Publié: (2024)
par: Siuzdak, Hubert, et autres
Publié: (2024)
Gaussian Flow Bridges for Audio Domain Transfer with Unpaired Data
par: Moliner, Eloi, et autres
Publié: (2024)
par: Moliner, Eloi, et autres
Publié: (2024)
Audio Processing using Pattern Recognition for Music Genre Classification
par: Chatterjee, Sivangi, et autres
Publié: (2024)
par: Chatterjee, Sivangi, et autres
Publié: (2024)
EnvId: A Metric Learning Approach for Forensic Few-Shot Identification of Unseen Environments
par: Moussa, Denise, et autres
Publié: (2024)
par: Moussa, Denise, et autres
Publié: (2024)
Embedding-Space Diffusion for Zero-Shot Environmental Sound Classification
par: Sims, Ysobel, et autres
Publié: (2024)
par: Sims, Ysobel, et autres
Publié: (2024)
Audio Classification of Low Feature Spectrograms Utilizing Convolutional Neural Networks
par: Elias, Noel
Publié: (2024)
par: Elias, Noel
Publié: (2024)
Multimodal Attention Merging for Improved Speech Recognition and Audio Event Classification
par: Sundar, Anirudh S., et autres
Publié: (2023)
par: Sundar, Anirudh S., et autres
Publié: (2023)
Exploring Meta Information for Audio-based Zero-shot Bird Classification
par: Gebhard, Alexander, et autres
Publié: (2023)
par: Gebhard, Alexander, et autres
Publié: (2023)
An Investigation of Test-time Adaptation for Audio Classification under Background Noise
par: Shao, Weichuang, et autres
Publié: (2025)
par: Shao, Weichuang, et autres
Publié: (2025)
Listenable Maps for Zero-Shot Audio Classifiers
par: Paissan, Francesco, et autres
Publié: (2024)
par: Paissan, Francesco, et autres
Publié: (2024)
Patch-Mix Contrastive Learning with Audio Spectrogram Transformer on Respiratory Sound Classification
par: Bae, Sangmin, et autres
Publié: (2023)
par: Bae, Sangmin, et autres
Publié: (2023)
Toward Fully Self-Supervised Multi-Pitch Estimation
par: Cwitkowitz, Frank, et autres
Publié: (2024)
par: Cwitkowitz, Frank, et autres
Publié: (2024)
Self-Supervised Embeddings for Detecting Individual Symptoms of Depression
par: Dumpala, Sri Harsha, et autres
Publié: (2024)
par: Dumpala, Sri Harsha, et autres
Publié: (2024)
Vision Language Models Are Few-Shot Audio Spectrogram Classifiers
par: Dixit, Satvik, et autres
Publié: (2024)
par: Dixit, Satvik, et autres
Publié: (2024)
SSLAM: Enhancing Self-Supervised Models with Audio Mixtures for Polyphonic Soundscapes
par: Alex, Tony, et autres
Publié: (2025)
par: Alex, Tony, et autres
Publié: (2025)
Self-Learning for Personalized Keyword Spotting on Ultra-Low-Power Audio Sensors
par: Rusci, Manuele, et autres
Publié: (2024)
par: Rusci, Manuele, et autres
Publié: (2024)
Cross-Referencing Self-Training Network for Sound Event Detection in Audio Mixtures
par: Park, Sangwook, et autres
Publié: (2021)
par: Park, Sangwook, et autres
Publié: (2021)
Transfer Learning with Semi-Supervised Dataset Annotation for Birdcall Classification
par: Miyaguchi, Anthony, et autres
Publié: (2023)
par: Miyaguchi, Anthony, et autres
Publié: (2023)
Singer Identity Representation Learning using Self-Supervised Techniques
par: Torres, Bernardo, et autres
Publié: (2024)
par: Torres, Bernardo, et autres
Publié: (2024)
Improving the Adversarial Robustness for Speaker Verification by Self-Supervised Learning
par: Wu, Haibin, et autres
Publié: (2021)
par: Wu, Haibin, et autres
Publié: (2021)
Self-Supervised Learning for Speaker Recognition: A study and review
par: Lepage, Theo, et autres
Publié: (2026)
par: Lepage, Theo, et autres
Publié: (2026)
Bringing the Discussion of Minima Sharpness to the Audio Domain: a Filter-Normalised Evaluation for Acoustic Scene Classification
par: Milling, Manuel, et autres
Publié: (2023)
par: Milling, Manuel, et autres
Publié: (2023)
VI-PANN: Harnessing Transfer Learning and Uncertainty-Aware Variational Inference for Improved Generalization in Audio Pattern Recognition
par: Fischer, John, et autres
Publié: (2024)
par: Fischer, John, et autres
Publié: (2024)
The Effect of Batch Size on Contrastive Self-Supervised Speech Representation Learning
par: Vaessen, Nik, et autres
Publié: (2024)
par: Vaessen, Nik, et autres
Publié: (2024)
Self-Supervised Frameworks for Speaker Verification via Bootstrapped Positive Sampling
par: Lepage, Theo, et autres
Publié: (2025)
par: Lepage, Theo, et autres
Publié: (2025)
Investigating an Overfitting and Degeneration Phenomenon in Self-Supervised Multi-Pitch Estimation
par: Cwitkowitz, Frank, et autres
Publié: (2025)
par: Cwitkowitz, Frank, et autres
Publié: (2025)
Documents similaires
-
MT-SLVR: Multi-Task Self-Supervised Learning for Transformation In(Variant) Representations
par: Heggan, Calum, et autres
Publié: (2023) -
Self-Supervised Learning for Few-Shot Bird Sound Classification
par: Moummad, Ilyass, et autres
Publié: (2023) -
Zero Shot Audio to Audio Emotion Transfer With Speaker Disentanglement
par: Dutta, Soumya, et autres
Publié: (2024) -
Audio Flamingo: A Novel Audio Language Model with Few-Shot Learning and Dialogue Abilities
par: Kong, Zhifeng, et autres
Publié: (2024) -
LC-Protonets: Multi-Label Few-Shot Learning for World Music Audio Tagging
par: Papaioannou, Charilaos, et autres
Publié: (2024)