Music auto-tagging in the long tail: A few-shot approach
Fuente:
arXiv
Salvato in:
| Autori principali: | Ma, T. Aleksandra, Lerch, Alexander |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Uncertainty Estimation in the Real World: A Study on Music Emotion Recognition
di: Watcharasupat, Karn N., et al.
Pubblicazione: (2025)
di: Watcharasupat, Karn N., et al.
Pubblicazione: (2025)
PeakNetFP: Peak-based Neural Audio Fingerprinting Robust to Extreme Time Stretching
di: Cortès-Sebastià, Guillem, et al.
Pubblicazione: (2025)
di: Cortès-Sebastià, Guillem, et al.
Pubblicazione: (2025)
Separate This, and All of these Things Around It: Music Source Separation via Hyperellipsoidal Queries
di: Watcharasupat, Karn N., et al.
Pubblicazione: (2025)
di: Watcharasupat, Karn N., et al.
Pubblicazione: (2025)
Application of Audio Fingerprinting Techniques for Real-Time Scalable Speech Retrieval and Speech Clusterization
di: Altwlkany, Kemal, et al.
Pubblicazione: (2024)
di: Altwlkany, Kemal, et al.
Pubblicazione: (2024)
A Stem-Agnostic Single-Decoder System for Music Source Separation Beyond Four Stems
di: Watcharasupat, Karn N., et al.
Pubblicazione: (2024)
di: Watcharasupat, Karn N., et al.
Pubblicazione: (2024)
The Concatenator: A Bayesian Approach To Real Time Concatenative Musaicing
di: Tralie, Christopher, et al.
Pubblicazione: (2024)
di: Tralie, Christopher, et al.
Pubblicazione: (2024)
Towards Robust Transcription: Exploring Noise Injection Strategies for Training Data Augmentation
di: Kim, Yonghyun, et al.
Pubblicazione: (2024)
di: Kim, Yonghyun, et al.
Pubblicazione: (2024)
Music Foundation Model as Generic Booster for Music Downstream Tasks
di: Liao, WeiHsiang, et al.
Pubblicazione: (2024)
di: Liao, WeiHsiang, et al.
Pubblicazione: (2024)
Universal Music Representations? Evaluating Foundation Models on World Music Corpora
di: Papaioannou, Charilaos, et al.
Pubblicazione: (2025)
di: Papaioannou, Charilaos, et al.
Pubblicazione: (2025)
Nested Music Transformer: Sequentially Decoding Compound Tokens in Symbolic Music and Audio Generation
di: Yoo, HaeJun, et al.
Pubblicazione: (2024)
di: Yoo, HaeJun, et al.
Pubblicazione: (2024)
A Novel Audio Representation for Music Genre Identification in MIR
di: Kamuni, Navin, et al.
Pubblicazione: (2024)
di: Kamuni, Navin, et al.
Pubblicazione: (2024)
Improving Musical Instrument Classification with Advanced Machine Learning Techniques
di: Chulev, Joanikij
Pubblicazione: (2024)
di: Chulev, Joanikij
Pubblicazione: (2024)
Analyzing and reducing the synthetic-to-real transfer gap in Music Information Retrieval: the task of automatic drum transcription
di: Zehren, Mickaël, et al.
Pubblicazione: (2024)
di: Zehren, Mickaël, et al.
Pubblicazione: (2024)
Learning Normal Patterns in Musical Loops
di: Dadman, Shayan, et al.
Pubblicazione: (2025)
di: Dadman, Shayan, et al.
Pubblicazione: (2025)
A Dataset and Baselines for Measuring and Predicting the Music Piece Memorability
di: Tseng, Li-Yang, et al.
Pubblicazione: (2024)
di: Tseng, Li-Yang, et al.
Pubblicazione: (2024)
MERGE -- A Bimodal Audio-Lyrics Dataset for Static Music Emotion Recognition
di: Louro, Pedro Lima, et al.
Pubblicazione: (2024)
di: Louro, Pedro Lima, et al.
Pubblicazione: (2024)
Music Genre Classification: Ensemble Learning with Subcomponents-level Attention
di: Liu, Yichen, et al.
Pubblicazione: (2024)
di: Liu, Yichen, et al.
Pubblicazione: (2024)
On the Effect of Data-Augmentation on Local Embedding Properties in the Contrastive Learning of Music Audio Representations
di: McCallum, Matthew C., et al.
Pubblicazione: (2024)
di: McCallum, Matthew C., et al.
Pubblicazione: (2024)
Parameter-Efficient Transfer Learning for Music Foundation Models
di: Ding, Yiwei, et al.
Pubblicazione: (2024)
di: Ding, Yiwei, et al.
Pubblicazione: (2024)
Beyond Musical Descriptors: Extracting Preference-Bearing Intent in Music Queries
di: Baranes, Marion, et al.
Pubblicazione: (2026)
di: Baranes, Marion, et al.
Pubblicazione: (2026)
An Audio-centric Multi-task Learning Framework for Streaming Ads Targeting on Spotify
di: Verma, Shivam, et al.
Pubblicazione: (2025)
di: Verma, Shivam, et al.
Pubblicazione: (2025)
SECP: A Speech Enhancement-Based Curation Pipeline For Scalable Acquisition Of Clean Speech
di: Sabra, Adam, et al.
Pubblicazione: (2024)
di: Sabra, Adam, et al.
Pubblicazione: (2024)
Automatic Estimation of Singing Voice Musical Dynamics
di: Narang, Jyoti, et al.
Pubblicazione: (2024)
di: Narang, Jyoti, et al.
Pubblicazione: (2024)
EAViT: External Attention Vision Transformer for Audio Classification
di: Iqbal, Aquib, et al.
Pubblicazione: (2024)
di: Iqbal, Aquib, et al.
Pubblicazione: (2024)
Dissecting Temporal Understanding in Text-to-Audio Retrieval
di: Oncescu, Andreea-Maria, et al.
Pubblicazione: (2024)
di: Oncescu, Andreea-Maria, et al.
Pubblicazione: (2024)
From Real to Cloned Singer Identification
di: Desblancs, Dorian, et al.
Pubblicazione: (2024)
di: Desblancs, Dorian, et al.
Pubblicazione: (2024)
Transfer Learning with Semi-Supervised Dataset Annotation for Birdcall Classification
di: Miyaguchi, Anthony, et al.
Pubblicazione: (2023)
di: Miyaguchi, Anthony, et al.
Pubblicazione: (2023)
Hybrid Losses for Hierarchical Embedding Learning
di: Tian, Haokun, et al.
Pubblicazione: (2025)
di: Tian, Haokun, et al.
Pubblicazione: (2025)
Deconstructing Jazz Piano Style Using Machine Learning
di: Cheston, Huw, et al.
Pubblicazione: (2025)
di: Cheston, Huw, et al.
Pubblicazione: (2025)
Multi-label Cross-lingual automatic music genre classification from lyrics with Sentence BERT
di: Tavares, Tiago Fernandes, et al.
Pubblicazione: (2025)
di: Tavares, Tiago Fernandes, et al.
Pubblicazione: (2025)
Emergent musical properties of a transformer under contrastive self-supervised learning
di: Kong, Yuexuan, et al.
Pubblicazione: (2025)
di: Kong, Yuexuan, et al.
Pubblicazione: (2025)
Speaker Retrieval in the Wild: Challenges, Effectiveness and Robustness
di: Loweimi, Erfan, et al.
Pubblicazione: (2025)
di: Loweimi, Erfan, et al.
Pubblicazione: (2025)
Do Captioning Metrics Reflect Music Semantic Alignment?
di: Lee, Jinwoo, et al.
Pubblicazione: (2024)
di: Lee, Jinwoo, et al.
Pubblicazione: (2024)
Exploring GPT's Ability as a Judge in Music Understanding
di: Fang, Kun, et al.
Pubblicazione: (2025)
di: Fang, Kun, et al.
Pubblicazione: (2025)
TALKPLAY: Multimodal Music Recommendation with Large Language Models
di: Doh, Seungheon, et al.
Pubblicazione: (2025)
di: Doh, Seungheon, et al.
Pubblicazione: (2025)
Similar but Faster: Manipulation of Tempo in Music Audio Embeddings for Tempo Prediction and Search
di: McCallum, Matthew C., et al.
Pubblicazione: (2024)
di: McCallum, Matthew C., et al.
Pubblicazione: (2024)
DeepSRGM -- Sequence Classification and Ranking in Indian Classical Music with Deep Learning
di: Madhusudhan, Sathwik Tejaswi, et al.
Pubblicazione: (2024)
di: Madhusudhan, Sathwik Tejaswi, et al.
Pubblicazione: (2024)
Exploring Diverse Sounds: Identifying Outliers in a Music Corpus
di: Cai, Le, et al.
Pubblicazione: (2024)
di: Cai, Le, et al.
Pubblicazione: (2024)
FusID: Modality-Fused Semantic IDs for Generative Music Recommendation
di: Kim, Haven, et al.
Pubblicazione: (2026)
di: Kim, Haven, et al.
Pubblicazione: (2026)
Evaluating Interval-based Tokenization for Pitch Representation in Symbolic Music Analysis
di: Le, Dinh-Viet-Toan, et al.
Pubblicazione: (2025)
di: Le, Dinh-Viet-Toan, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Uncertainty Estimation in the Real World: A Study on Music Emotion Recognition
di: Watcharasupat, Karn N., et al.
Pubblicazione: (2025) -
PeakNetFP: Peak-based Neural Audio Fingerprinting Robust to Extreme Time Stretching
di: Cortès-Sebastià, Guillem, et al.
Pubblicazione: (2025) -
Separate This, and All of these Things Around It: Music Source Separation via Hyperellipsoidal Queries
di: Watcharasupat, Karn N., et al.
Pubblicazione: (2025) -
Application of Audio Fingerprinting Techniques for Real-Time Scalable Speech Retrieval and Speech Clusterization
di: Altwlkany, Kemal, et al.
Pubblicazione: (2024) -
A Stem-Agnostic Single-Decoder System for Music Source Separation Beyond Four Stems
di: Watcharasupat, Karn N., et al.
Pubblicazione: (2024)