Evaluation of pretrained language models on music understanding
Fuente:
arXiv
Salvato in:
| Autori principali: | Vasilakis, Yannis, Bittner, Rachel, Pauwels, Johan |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
I can listen but cannot read: An evaluation of two-tower multimodal systems for instrument recognition
di: Vasilakis, Yannis, et al.
Pubblicazione: (2024)
di: Vasilakis, Yannis, et al.
Pubblicazione: (2024)
Towards Effective Negation Modeling in Joint Audio-Text Models for Music
di: Vasilakis, Yannis, et al.
Pubblicazione: (2026)
di: Vasilakis, Yannis, et al.
Pubblicazione: (2026)
Contrastive and Transfer Learning for Effective Audio Fingerprinting through a Real-World Evaluation Protocol
di: Nikou, Christos, et al.
Pubblicazione: (2025)
di: Nikou, Christos, et al.
Pubblicazione: (2025)
DeepSRGM -- Sequence Classification and Ranking in Indian Classical Music with Deep Learning
di: Madhusudhan, Sathwik Tejaswi, et al.
Pubblicazione: (2024)
di: Madhusudhan, Sathwik Tejaswi, et al.
Pubblicazione: (2024)
A Stem-Agnostic Single-Decoder System for Music Source Separation Beyond Four Stems
di: Watcharasupat, Karn N., et al.
Pubblicazione: (2024)
di: Watcharasupat, Karn N., et al.
Pubblicazione: (2024)
Towards Robust Transcription: Exploring Noise Injection Strategies for Training Data Augmentation
di: Kim, Yonghyun, et al.
Pubblicazione: (2024)
di: Kim, Yonghyun, et al.
Pubblicazione: (2024)
Segment Length Matters: A Study of Segment Lengths on Audio Fingerprinting Performance
di: Gong, Ziling, et al.
Pubblicazione: (2026)
di: Gong, Ziling, et al.
Pubblicazione: (2026)
Emergent musical properties of a transformer under contrastive self-supervised learning
di: Kong, Yuexuan, et al.
Pubblicazione: (2025)
di: Kong, Yuexuan, et al.
Pubblicazione: (2025)
Multi-label Cross-lingual automatic music genre classification from lyrics with Sentence BERT
di: Tavares, Tiago Fernandes, et al.
Pubblicazione: (2025)
di: Tavares, Tiago Fernandes, et al.
Pubblicazione: (2025)
Universal Music Representations? Evaluating Foundation Models on World Music Corpora
di: Papaioannou, Charilaos, et al.
Pubblicazione: (2025)
di: Papaioannou, Charilaos, et al.
Pubblicazione: (2025)
Latent Diffusion Bridges for Unsupervised Musical Audio Timbre Transfer
di: Mancusi, Michele, et al.
Pubblicazione: (2024)
di: Mancusi, Michele, et al.
Pubblicazione: (2024)
Analyzing Musical Characteristics of National Anthems in Relation to Global Indices
di: Hasan, S M Rakib, et al.
Pubblicazione: (2024)
di: Hasan, S M Rakib, et al.
Pubblicazione: (2024)
Distance Sampling-based Paraphraser Leveraging ChatGPT for Text Data Manipulation
di: Oh, Yoori, et al.
Pubblicazione: (2024)
di: Oh, Yoori, et al.
Pubblicazione: (2024)
SoundSignature: What Type of Music Do You Like?
di: Carone, Brandon James, et al.
Pubblicazione: (2024)
di: Carone, Brandon James, et al.
Pubblicazione: (2024)
Music Era Recognition Using Supervised Contrastive Learning and Artist Information
di: He, Qiqi, et al.
Pubblicazione: (2024)
di: He, Qiqi, et al.
Pubblicazione: (2024)
Towards Explainable and Interpretable Musical Difficulty Estimation: A Parameter-efficient Approach
di: Ramoneda, Pedro, et al.
Pubblicazione: (2024)
di: Ramoneda, Pedro, et al.
Pubblicazione: (2024)
Natural Language Processing Methods for Symbolic Music Generation and Information Retrieval: a Survey
di: Le, Dinh-Viet-Toan, et al.
Pubblicazione: (2024)
di: Le, Dinh-Viet-Toan, et al.
Pubblicazione: (2024)
Music Auto-Tagging with Robust Music Representation Learned via Domain Adversarial Training
di: Joung, Haesun, et al.
Pubblicazione: (2024)
di: Joung, Haesun, et al.
Pubblicazione: (2024)
An approach to hummed-tune and song sequences matching
di: Pham, Loc Bao, et al.
Pubblicazione: (2024)
di: Pham, Loc Bao, et al.
Pubblicazione: (2024)
Pretrained Conformers for Audio Fingerprinting and Retrieval
di: Altwlkany, Kemal, et al.
Pubblicazione: (2025)
di: Altwlkany, Kemal, et al.
Pubblicazione: (2025)
Advancing the Foundation Model for Music Understanding
di: Jiang, Yi, et al.
Pubblicazione: (2025)
di: Jiang, Yi, et al.
Pubblicazione: (2025)
A Cascaded Architecture for Extractive Summarization of Multimedia Content via Audio-to-Text Alignment
di: Hossain, Tanzir, et al.
Pubblicazione: (2025)
di: Hossain, Tanzir, et al.
Pubblicazione: (2025)
High-Resolution Sustain Pedal Depth Estimation from Piano Audio Across Room Acoustics
di: Fang, Kun, et al.
Pubblicazione: (2025)
di: Fang, Kun, et al.
Pubblicazione: (2025)
EMelodyGen: Emotion-Conditioned Melody Generation in ABC Notation with the Musical Feature Template
di: Zhou, Monan, et al.
Pubblicazione: (2023)
di: Zhou, Monan, et al.
Pubblicazione: (2023)
wav2graph: A Framework for Supervised Learning Knowledge Graph from Speech
di: Le-Duc, Khai, et al.
Pubblicazione: (2024)
di: Le-Duc, Khai, et al.
Pubblicazione: (2024)
Towards Training Music Taggers on Synthetic Data
di: Kroher, Nadine, et al.
Pubblicazione: (2024)
di: Kroher, Nadine, et al.
Pubblicazione: (2024)
WikiMuTe: A web-sourced dataset of semantic descriptions for music audio
di: Weck, Benno, et al.
Pubblicazione: (2023)
di: Weck, Benno, et al.
Pubblicazione: (2023)
Analyzing and reducing the synthetic-to-real transfer gap in Music Information Retrieval: the task of automatic drum transcription
di: Zehren, Mickaël, et al.
Pubblicazione: (2024)
di: Zehren, Mickaël, et al.
Pubblicazione: (2024)
Music Foundation Model as Generic Booster for Music Downstream Tasks
di: Liao, WeiHsiang, et al.
Pubblicazione: (2024)
di: Liao, WeiHsiang, et al.
Pubblicazione: (2024)
SECP: A Speech Enhancement-Based Curation Pipeline For Scalable Acquisition Of Clean Speech
di: Sabra, Adam, et al.
Pubblicazione: (2024)
di: Sabra, Adam, et al.
Pubblicazione: (2024)
A Novel Audio Representation for Music Genre Identification in MIR
di: Kamuni, Navin, et al.
Pubblicazione: (2024)
di: Kamuni, Navin, et al.
Pubblicazione: (2024)
EAViT: External Attention Vision Transformer for Audio Classification
di: Iqbal, Aquib, et al.
Pubblicazione: (2024)
di: Iqbal, Aquib, et al.
Pubblicazione: (2024)
Nested Music Transformer: Sequentially Decoding Compound Tokens in Symbolic Music and Audio Generation
di: Yoo, HaeJun, et al.
Pubblicazione: (2024)
di: Yoo, HaeJun, et al.
Pubblicazione: (2024)
Improving Musical Instrument Classification with Advanced Machine Learning Techniques
di: Chulev, Joanikij
Pubblicazione: (2024)
di: Chulev, Joanikij
Pubblicazione: (2024)
Dissecting Temporal Understanding in Text-to-Audio Retrieval
di: Oncescu, Andreea-Maria, et al.
Pubblicazione: (2024)
di: Oncescu, Andreea-Maria, et al.
Pubblicazione: (2024)
From Real to Cloned Singer Identification
di: Desblancs, Dorian, et al.
Pubblicazione: (2024)
di: Desblancs, Dorian, et al.
Pubblicazione: (2024)
Transfer Learning with Semi-Supervised Dataset Annotation for Birdcall Classification
di: Miyaguchi, Anthony, et al.
Pubblicazione: (2023)
di: Miyaguchi, Anthony, et al.
Pubblicazione: (2023)
Hybrid Losses for Hierarchical Embedding Learning
di: Tian, Haokun, et al.
Pubblicazione: (2025)
di: Tian, Haokun, et al.
Pubblicazione: (2025)
Deconstructing Jazz Piano Style Using Machine Learning
di: Cheston, Huw, et al.
Pubblicazione: (2025)
di: Cheston, Huw, et al.
Pubblicazione: (2025)
Uncertainty Estimation in the Real World: A Study on Music Emotion Recognition
di: Watcharasupat, Karn N., et al.
Pubblicazione: (2025)
di: Watcharasupat, Karn N., et al.
Pubblicazione: (2025)
Documenti analoghi
-
I can listen but cannot read: An evaluation of two-tower multimodal systems for instrument recognition
di: Vasilakis, Yannis, et al.
Pubblicazione: (2024) -
Towards Effective Negation Modeling in Joint Audio-Text Models for Music
di: Vasilakis, Yannis, et al.
Pubblicazione: (2026) -
Contrastive and Transfer Learning for Effective Audio Fingerprinting through a Real-World Evaluation Protocol
di: Nikou, Christos, et al.
Pubblicazione: (2025) -
DeepSRGM -- Sequence Classification and Ranking in Indian Classical Music with Deep Learning
di: Madhusudhan, Sathwik Tejaswi, et al.
Pubblicazione: (2024) -
A Stem-Agnostic Single-Decoder System for Music Source Separation Beyond Four Stems
di: Watcharasupat, Karn N., et al.
Pubblicazione: (2024)