Unmute the Patch Tokens: Rethinking Probing in Multi-Label Audio Classification
Fuente:
arXiv
Salvato in:
| Autori principali: | Rauch, Lukas, Heinrich, René, Ghaffari, Houtan, Miklautz, Lukas, Moummad, Ilyass, Sick, Bernhard, Scholz, Christoph |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Can Masked Autoencoders Also Listen to Birds?
di: Rauch, Lukas, et al.
Pubblicazione: (2025)
di: Rauch, Lukas, et al.
Pubblicazione: (2025)
AudioProtoPNet: An interpretable deep learning model for bird sound classification
di: Heinrich, René, et al.
Pubblicazione: (2024)
di: Heinrich, René, et al.
Pubblicazione: (2024)
Audio-to-Image Bird Species Retrieval without Audio-Image Pairs via Text Distillation
di: Moummad, Ilyass, et al.
Pubblicazione: (2026)
di: Moummad, Ilyass, et al.
Pubblicazione: (2026)
Adversarial Training Improves Generalization Under Distribution Shifts in Bioacoustics
di: Heinrich, René, et al.
Pubblicazione: (2025)
di: Heinrich, René, et al.
Pubblicazione: (2025)
Self-Supervised Learning for Few-Shot Bird Sound Classification
di: Moummad, Ilyass, et al.
Pubblicazione: (2023)
di: Moummad, Ilyass, et al.
Pubblicazione: (2023)
Uncertainty Calibration of Multi-Label Bird Sound Classifiers
di: Schwinger, Raphael, et al.
Pubblicazione: (2025)
di: Schwinger, Raphael, et al.
Pubblicazione: (2025)
Hashing-Baseline: Rethinking Hashing in the Age of Pretrained Models
di: Moummad, Ilyass, et al.
Pubblicazione: (2025)
di: Moummad, Ilyass, et al.
Pubblicazione: (2025)
Mixture of Mixups for Multi-label Classification of Rare Anuran Sounds
di: Moummad, Ilyass, et al.
Pubblicazione: (2024)
di: Moummad, Ilyass, et al.
Pubblicazione: (2024)
Comparison of self-supervised in-domain and supervised out-domain transfer learning for bird species recognition
di: Ghaffari, Houtan, et al.
Pubblicazione: (2024)
di: Ghaffari, Houtan, et al.
Pubblicazione: (2024)
Data-Efficient Self-Supervised Algorithms for Fine-Grained Birdsong Analysis
di: Ghaffari, Houtan, et al.
Pubblicazione: (2025)
di: Ghaffari, Houtan, et al.
Pubblicazione: (2025)
Regularized Contrastive Pre-training for Few-shot Bioacoustic Sound Detection
di: Moummad, Ilyass, et al.
Pubblicazione: (2023)
di: Moummad, Ilyass, et al.
Pubblicazione: (2023)
Acoustic identification of individual animals with hierarchical contrastive learning
di: Nolasco, Ines, et al.
Pubblicazione: (2024)
di: Nolasco, Ines, et al.
Pubblicazione: (2024)
BirdSet: A Large-Scale Dataset for Audio Classification in Avian Bioacoustics
di: Rauch, Lukas, et al.
Pubblicazione: (2024)
di: Rauch, Lukas, et al.
Pubblicazione: (2024)
Towards Deep Active Learning in Avian Bioacoustics
di: Rauch, Lukas, et al.
Pubblicazione: (2024)
di: Rauch, Lukas, et al.
Pubblicazione: (2024)
MUKA: Multi Kernel Audio Adaptation Of Audio-Language Models
di: Bensaid, Reda, et al.
Pubblicazione: (2026)
di: Bensaid, Reda, et al.
Pubblicazione: (2026)
How to Label Resynthesized Audio: The Dual Role of Neural Audio Codecs in Audio Deepfake Detection
di: Xiao, Yixuan, et al.
Pubblicazione: (2026)
di: Xiao, Yixuan, et al.
Pubblicazione: (2026)
Exploring Meta Information for Audio-based Zero-shot Bird Classification
di: Gebhard, Alexander, et al.
Pubblicazione: (2023)
di: Gebhard, Alexander, et al.
Pubblicazione: (2023)
Patch-Mix Contrastive Learning with Audio Spectrogram Transformer on Respiratory Sound Classification
di: Bae, Sangmin, et al.
Pubblicazione: (2023)
di: Bae, Sangmin, et al.
Pubblicazione: (2023)
Fast Fishing: Approximating BAIT for Efficient and Scalable Deep Active Image Classification
di: Huseljic, Denis, et al.
Pubblicazione: (2024)
di: Huseljic, Denis, et al.
Pubblicazione: (2024)
Exploring Token-Space Manipulation in Latent Audio Tokenizers
di: Paissan, Francesco, et al.
Pubblicazione: (2026)
di: Paissan, Francesco, et al.
Pubblicazione: (2026)
APEX: Audio Prototype EXplanations for Classification Tasks
di: Kawa, Piotr, et al.
Pubblicazione: (2026)
di: Kawa, Piotr, et al.
Pubblicazione: (2026)
DADO -- Low-Cost Query Strategies for Deep Active Design Optimization
di: Decke, Jens, et al.
Pubblicazione: (2023)
di: Decke, Jens, et al.
Pubblicazione: (2023)
Domain-Invariant Representation Learning of Bird Sounds
di: Moummad, Ilyass, et al.
Pubblicazione: (2024)
di: Moummad, Ilyass, et al.
Pubblicazione: (2024)
Improving Audio Classification by Transitioning from Zero- to Few-Shot
di: Taylor, James, et al.
Pubblicazione: (2025)
di: Taylor, James, et al.
Pubblicazione: (2025)
Prototypical Contrastive Learning For Improved Few-Shot Audio Classification
di: Sgouropoulos, Christos, et al.
Pubblicazione: (2025)
di: Sgouropoulos, Christos, et al.
Pubblicazione: (2025)
Cleaning the Pool: Progressive Filtering of Unlabeled Pools in Deep Active Learning
di: Huseljic, Denis, et al.
Pubblicazione: (2025)
di: Huseljic, Denis, et al.
Pubblicazione: (2025)
Adaptive Discovery of Interpretable Audio Attributes with Multimodal LLMs for Low-Resource Classification
di: Yoshimura, Kosuke, et al.
Pubblicazione: (2026)
di: Yoshimura, Kosuke, et al.
Pubblicazione: (2026)
PairAlign: A Framework for Sequence Tokenization via Self-Alignment with Applications to Audio Tokenization
di: Banerjee, Adhiraj, et al.
Pubblicazione: (2026)
di: Banerjee, Adhiraj, et al.
Pubblicazione: (2026)
Multi-label Zero-Shot Audio Classification with Temporal Attention
di: Dogan, Duygu, et al.
Pubblicazione: (2024)
di: Dogan, Duygu, et al.
Pubblicazione: (2024)
Leveraging Prediction Entropy for Automatic Prompt Weighting in Zero-Shot Audio-Language Classification
di: Khoury, Karim El, et al.
Pubblicazione: (2026)
di: Khoury, Karim El, et al.
Pubblicazione: (2026)
CLAP-ART: Automated Audio Captioning with Semantic-rich Audio Representation Tokenizer
di: Takeuchi, Daiki, et al.
Pubblicazione: (2025)
di: Takeuchi, Daiki, et al.
Pubblicazione: (2025)
LC-Protonets: Multi-Label Few-Shot Learning for World Music Audio Tagging
di: Papaioannou, Charilaos, et al.
Pubblicazione: (2024)
di: Papaioannou, Charilaos, et al.
Pubblicazione: (2024)
Sound and Music Biases in Deep Music Transcription Models: A Systematic Analysis
di: Marták, Lukáš Samuel, et al.
Pubblicazione: (2025)
di: Marták, Lukáš Samuel, et al.
Pubblicazione: (2025)
Compact Hypercube Embeddings for Fast Text-based Wildlife Observation Retrieval
di: Moummad, Ilyass, et al.
Pubblicazione: (2026)
di: Moummad, Ilyass, et al.
Pubblicazione: (2026)
crowd-hpo: Realistic Hyperparameter Optimization and Benchmarking for Learning from Crowds with Noisy Labels
di: Herde, Marek, et al.
Pubblicazione: (2025)
di: Herde, Marek, et al.
Pubblicazione: (2025)
WavLink: Compact Audio-Text Embeddings with a Global Whisper Token
di: Kumar, Gokul Karthik, et al.
Pubblicazione: (2026)
di: Kumar, Gokul Karthik, et al.
Pubblicazione: (2026)
ADNAC: Audio Denoiser using Neural Audio Codec
di: Jimon, Daniel, et al.
Pubblicazione: (2025)
di: Jimon, Daniel, et al.
Pubblicazione: (2025)
High-Fidelity Speech Enhancement via Discrete Audio Tokens
di: Lanzendörfer, Luca A., et al.
Pubblicazione: (2025)
di: Lanzendörfer, Luca A., et al.
Pubblicazione: (2025)
Echo: Towards Advanced Audio Comprehension via Audio-Interleaved Reasoning
di: Wu, Daiqing, et al.
Pubblicazione: (2026)
di: Wu, Daiqing, et al.
Pubblicazione: (2026)
Just Label the Repeats for In-The-Wild Audio-to-Score Alignment
di: Bukey, Irmak, et al.
Pubblicazione: (2024)
di: Bukey, Irmak, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Can Masked Autoencoders Also Listen to Birds?
di: Rauch, Lukas, et al.
Pubblicazione: (2025) -
AudioProtoPNet: An interpretable deep learning model for bird sound classification
di: Heinrich, René, et al.
Pubblicazione: (2024) -
Audio-to-Image Bird Species Retrieval without Audio-Image Pairs via Text Distillation
di: Moummad, Ilyass, et al.
Pubblicazione: (2026) -
Adversarial Training Improves Generalization Under Distribution Shifts in Bioacoustics
di: Heinrich, René, et al.
Pubblicazione: (2025) -
Self-Supervised Learning for Few-Shot Bird Sound Classification
di: Moummad, Ilyass, et al.
Pubblicazione: (2023)