CultureMERT: Continual Pre-Training for Cross-Cultural Music Representation Learning
Fuente:
arXiv
Guardado en:
| Autores principales: | Kanatas, Angelos-Nikolaos, Papaioannou, Charilaos, Potamianos, Alexandros |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
LC-Protonets: Multi-Label Few-Shot Learning for World Music Audio Tagging
por: Papaioannou, Charilaos, et al.
Publicado: (2024)
por: Papaioannou, Charilaos, et al.
Publicado: (2024)
Universal Music Representations? Evaluating Foundation Models on World Music Corpora
por: Papaioannou, Charilaos, et al.
Publicado: (2025)
por: Papaioannou, Charilaos, et al.
Publicado: (2025)
MERT: Acoustic Music Understanding Model with Large-Scale Self-supervised Training
por: Li, Yizhi, et al.
Publicado: (2023)
por: Li, Yizhi, et al.
Publicado: (2023)
EditGen: Harnessing Cross-Attention Control for Instruction-Based Auto-Regressive Audio Editing
por: Sioros, Vassilis, et al.
Publicado: (2025)
por: Sioros, Vassilis, et al.
Publicado: (2025)
Embedding-Based Intrusive Evaluation Metrics for Musical Source Separation Using MERT Representations
por: Bereuter, Paul A., et al.
Publicado: (2026)
por: Bereuter, Paul A., et al.
Publicado: (2026)
From Generality to Mastery: Composer-Style Symbolic Music Generation via Large-Scale Pre-training
por: Yao, Mingyang, et al.
Publicado: (2025)
por: Yao, Mingyang, et al.
Publicado: (2025)
Repurposing Image Diffusion Models for Training-Free Music Style Transfer on Mel-spectrograms
por: Wang, Heehwan, et al.
Publicado: (2024)
por: Wang, Heehwan, et al.
Publicado: (2024)
MusicLIME: Explainable Multimodal Music Understanding
por: Sotirou, Theodoros, et al.
Publicado: (2024)
por: Sotirou, Theodoros, et al.
Publicado: (2024)
Automatic Music Sample Identification with Multi-Track Contrastive Learning
por: Riou, Alain, et al.
Publicado: (2025)
por: Riou, Alain, et al.
Publicado: (2025)
Machine Learning Techniques in Automatic Music Transcription: A Systematic Survey
por: Jamshidi, Fatemeh, et al.
Publicado: (2024)
por: Jamshidi, Fatemeh, et al.
Publicado: (2024)
Music Source Restoration
por: Zang, Yongyi, et al.
Publicado: (2025)
por: Zang, Yongyi, et al.
Publicado: (2025)
CloserMusicDB: A Modern Multipurpose Dataset of High Quality Music
por: Piekarzewicz, Aleksandra, et al.
Publicado: (2024)
por: Piekarzewicz, Aleksandra, et al.
Publicado: (2024)
CoDiCodec: Unifying Continuous and Discrete Compressed Representations of Audio
por: Pasini, Marco, et al.
Publicado: (2025)
por: Pasini, Marco, et al.
Publicado: (2025)
WhisQ: Cross-Modal Representation Learning for Text-to-Music MOS Prediction
por: Emon, Jakaria Islam, et al.
Publicado: (2025)
por: Emon, Jakaria Islam, et al.
Publicado: (2025)
Simple and Controllable Music Generation
por: Copet, Jade, et al.
Publicado: (2023)
por: Copet, Jade, et al.
Publicado: (2023)
Progressive Rock Music Classification
por: Nagar, Arpan, et al.
Publicado: (2025)
por: Nagar, Arpan, et al.
Publicado: (2025)
MusicGen-Chord: Advancing Music Generation through Chord Progressions and Interactive Web-UI
por: Jung, Jongmin, et al.
Publicado: (2024)
por: Jung, Jongmin, et al.
Publicado: (2024)
The NES Video-Music Database: A Dataset of Symbolic Video Game Music Paired with Gameplay Videos
por: Cardoso, Igor, et al.
Publicado: (2024)
por: Cardoso, Igor, et al.
Publicado: (2024)
SAGE-Music: Low-Latency Symbolic Music Generation via Attribute-Specialized Key-Value Head Sharing
por: Tan, Jiaye, et al.
Publicado: (2025)
por: Tan, Jiaye, et al.
Publicado: (2025)
A Conditioned UNet for Music Source Separation
por: O'Hanlon, Ken, et al.
Publicado: (2025)
por: O'Hanlon, Ken, et al.
Publicado: (2025)
A Survey of Music Generation in the Context of Interaction
por: Agchar, Ismael, et al.
Publicado: (2024)
por: Agchar, Ismael, et al.
Publicado: (2024)
Exploring and Applying Audio-Based Sentiment Analysis in Music
por: Jhanji, Etash
Publicado: (2024)
por: Jhanji, Etash
Publicado: (2024)
DITTO: Diffusion Inference-Time T-Optimization for Music Generation
por: Novack, Zachary, et al.
Publicado: (2024)
por: Novack, Zachary, et al.
Publicado: (2024)
Presto! Distilling Steps and Layers for Accelerating Music Generation
por: Novack, Zachary, et al.
Publicado: (2024)
por: Novack, Zachary, et al.
Publicado: (2024)
Steering Autoregressive Music Generation with Recursive Feature Machines
por: Zhao, Daniel, et al.
Publicado: (2025)
por: Zhao, Daniel, et al.
Publicado: (2025)
Perception-Inspired Graph Convolution for Music Understanding Tasks
por: Karystinaios, Emmanouil, et al.
Publicado: (2024)
por: Karystinaios, Emmanouil, et al.
Publicado: (2024)
An Independence-promoting Loss for Music Generation with Language Models
por: Lemercier, Jean-Marie, et al.
Publicado: (2024)
por: Lemercier, Jean-Marie, et al.
Publicado: (2024)
Leveraging Pre-Trained Autoencoders for Interpretable Prototype Learning of Music Audio
por: Alonso-Jiménez, Pablo, et al.
Publicado: (2024)
por: Alonso-Jiménez, Pablo, et al.
Publicado: (2024)
Recognizing Ornaments in Vocal Indian Art Music with Active Annotation
por: Kumar, Sumit, et al.
Publicado: (2025)
por: Kumar, Sumit, et al.
Publicado: (2025)
Deep Neural Network for Musical Instrument Recognition using MFCCs
por: Mahanta, Saranga Kingkor, et al.
Publicado: (2021)
por: Mahanta, Saranga Kingkor, et al.
Publicado: (2021)
Evaluating Fake Music Detection Performance Under Audio Augmentations
por: Sroka, Tomasz, et al.
Publicado: (2025)
por: Sroka, Tomasz, et al.
Publicado: (2025)
Efficient Multi-Model Fusion with Adversarial Complementary Representation Learning
por: Kang, Zuheng, et al.
Publicado: (2024)
por: Kang, Zuheng, et al.
Publicado: (2024)
Scaling Self-Supervised Representation Learning for Symbolic Piano Performance
por: Bradshaw, Louis, et al.
Publicado: (2025)
por: Bradshaw, Louis, et al.
Publicado: (2025)
PianoBART: Symbolic Piano Music Generation and Understanding with Large-Scale Pre-Training
por: Liang, Xiao, et al.
Publicado: (2024)
por: Liang, Xiao, et al.
Publicado: (2024)
CMI-Bench: A Comprehensive Benchmark for Evaluating Music Instruction Following
por: Ma, Yinghao, et al.
Publicado: (2025)
por: Ma, Yinghao, et al.
Publicado: (2025)
Music Plagiarism Detection: Problem Formulation and a Segment-based Solution
por: Go, Seonghyeon, et al.
Publicado: (2026)
por: Go, Seonghyeon, et al.
Publicado: (2026)
Hierarchical Generative Modeling of Melodic Vocal Contours in Hindustani Classical Music
por: Shikarpur, Nithya, et al.
Publicado: (2024)
por: Shikarpur, Nithya, et al.
Publicado: (2024)
Self-Supervised Disentangled Representation Learning for Robust Target Speech Extraction
por: Mu, Zhaoxi, et al.
Publicado: (2023)
por: Mu, Zhaoxi, et al.
Publicado: (2023)
Music2Latent2: Audio Compression with Summary Embeddings and Autoregressive Decoding
por: Pasini, Marco, et al.
Publicado: (2025)
por: Pasini, Marco, et al.
Publicado: (2025)
DiffRoll: Diffusion-based Generative Music Transcription with Unsupervised Pretraining Capability
por: Cheuk, Kin Wai, et al.
Publicado: (2022)
por: Cheuk, Kin Wai, et al.
Publicado: (2022)
Ejemplares similares
-
LC-Protonets: Multi-Label Few-Shot Learning for World Music Audio Tagging
por: Papaioannou, Charilaos, et al.
Publicado: (2024) -
Universal Music Representations? Evaluating Foundation Models on World Music Corpora
por: Papaioannou, Charilaos, et al.
Publicado: (2025) -
MERT: Acoustic Music Understanding Model with Large-Scale Self-supervised Training
por: Li, Yizhi, et al.
Publicado: (2023) -
EditGen: Harnessing Cross-Attention Control for Instruction-Based Auto-Regressive Audio Editing
por: Sioros, Vassilis, et al.
Publicado: (2025) -
Embedding-Based Intrusive Evaluation Metrics for Musical Source Separation Using MERT Representations
por: Bereuter, Paul A., et al.
Publicado: (2026)