MERIT: Learning Disentangled Music Representations for Audio Similarity
Fuente:
arXiv
Salvato in:
| Autori principali: | Roy, Abhinaba, Liang, Junyi, Herremans, Dorien |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Aligning Generative Music AI with Human Preferences: Methods and Challenges
di: Herremans, Dorien, et al.
Pubblicazione: (2025)
di: Herremans, Dorien, et al.
Pubblicazione: (2025)
Leveraging LLM Embeddings for Cross Dataset Label Alignment and Zero Shot Music Emotion Prediction
di: Liu, Renhang, et al.
Pubblicazione: (2024)
di: Liu, Renhang, et al.
Pubblicazione: (2024)
MIRFLEX: Music Information Retrieval Feature Library for Extraction
di: Chopra, Anuradha, et al.
Pubblicazione: (2024)
di: Chopra, Anuradha, et al.
Pubblicazione: (2024)
JamendoMaxCaps: A Large Scale Music-caption Dataset with Imputed Metadata
di: Roy, Abhinaba, et al.
Pubblicazione: (2025)
di: Roy, Abhinaba, et al.
Pubblicazione: (2025)
MelodySim: Measuring Melody-aware Music Similarity for Plagiarism Detection
di: Lu, Tongyu, et al.
Pubblicazione: (2025)
di: Lu, Tongyu, et al.
Pubblicazione: (2025)
Text2midi-InferAlign: Improving Symbolic Music Generation with Inference-Time Alignment
di: Roy, Abhinaba, et al.
Pubblicazione: (2025)
di: Roy, Abhinaba, et al.
Pubblicazione: (2025)
SonicVerse: Multi-Task Learning for Music Feature-Informed Captioning
di: Chopra, Anuradha, et al.
Pubblicazione: (2025)
di: Chopra, Anuradha, et al.
Pubblicazione: (2025)
MidiCaps: A large-scale MIDI dataset with text captions
di: Melechovsky, Jan, et al.
Pubblicazione: (2024)
di: Melechovsky, Jan, et al.
Pubblicazione: (2024)
Text2Score: Generating Sheet Music From Textual Prompts
di: Bhandari, Keshav, et al.
Pubblicazione: (2026)
di: Bhandari, Keshav, et al.
Pubblicazione: (2026)
SonicMaster: Towards Controllable All-in-One Music Restoration and Mastering
di: Melechovsky, Jan, et al.
Pubblicazione: (2025)
di: Melechovsky, Jan, et al.
Pubblicazione: (2025)
Text2midi: Generating Symbolic Music from Captions
di: Bhandari, Keshav, et al.
Pubblicazione: (2024)
di: Bhandari, Keshav, et al.
Pubblicazione: (2024)
Towards Unified Music Emotion Recognition across Dimensional and Categorical Models
di: Kang, Jaeyong, et al.
Pubblicazione: (2025)
di: Kang, Jaeyong, et al.
Pubblicazione: (2025)
Are We There Yet? A Brief Survey of Music Emotion Prediction Datasets, Models and Outstanding Challenges
di: Kang, Jaeyong, et al.
Pubblicazione: (2024)
di: Kang, Jaeyong, et al.
Pubblicazione: (2024)
DART: Disentanglement of Accent and Speaker Representation in Multispeaker Text-to-Speech
di: Melechovsky, Jan, et al.
Pubblicazione: (2024)
di: Melechovsky, Jan, et al.
Pubblicazione: (2024)
Video2Music: Suitable Music Generation from Videos using an Affective Multimodal Transformer model
di: Kang, Jaeyong, et al.
Pubblicazione: (2023)
di: Kang, Jaeyong, et al.
Pubblicazione: (2023)
KARMA-MV: A Benchmark for Causal Question Answering on Music Videos
di: Ghosh, Archishman, et al.
Pubblicazione: (2026)
di: Ghosh, Archishman, et al.
Pubblicazione: (2026)
BandCondiNet: Parallel Transformers-based Conditional Popular Music Generation with Multi-View Features
di: Luo, Jing, et al.
Pubblicazione: (2024)
di: Luo, Jing, et al.
Pubblicazione: (2024)
Learning Multidimensional Disentangled Representations of Instrumental Sounds for Musical Similarity Assessment
di: Hashizume, Yuka, et al.
Pubblicazione: (2024)
di: Hashizume, Yuka, et al.
Pubblicazione: (2024)
Self-Supervised Multi-View Learning for Disentangled Music Audio Representations
di: Wilkins, Julia, et al.
Pubblicazione: (2024)
di: Wilkins, Julia, et al.
Pubblicazione: (2024)
Natural Language Processing Methods for Symbolic Music Generation and Information Retrieval: a Survey
di: Le, Dinh-Viet-Toan, et al.
Pubblicazione: (2024)
di: Le, Dinh-Viet-Toan, et al.
Pubblicazione: (2024)
APEX: Large-scale Multi-task Aesthetic-Informed Popularity Prediction for AI-Generated Music
di: Husain, Jaavid Aktar, et al.
Pubblicazione: (2026)
di: Husain, Jaavid Aktar, et al.
Pubblicazione: (2026)
Accented Text-to-Speech Synthesis with a Conditional Variational Autoencoder
di: Melechovsky, Jan, et al.
Pubblicazione: (2022)
di: Melechovsky, Jan, et al.
Pubblicazione: (2022)
Accent Conversion in Text-To-Speech Using Multi-Level VAE and Adversarial Training
di: Melechovsky, Jan, et al.
Pubblicazione: (2024)
di: Melechovsky, Jan, et al.
Pubblicazione: (2024)
A Machine Learning Approach for MIDI to Guitar Tablature Conversion
di: Kaliakatsos-Papakostas, Maximos, et al.
Pubblicazione: (2025)
di: Kaliakatsos-Papakostas, Maximos, et al.
Pubblicazione: (2025)
ImprovNet -- Generating Controllable Musical Improvisations with Iterative Corruption Refinement
di: Bhandari, Keshav, et al.
Pubblicazione: (2025)
di: Bhandari, Keshav, et al.
Pubblicazione: (2025)
Learning Separated Representations for Instrument-based Music Similarity
di: Hashizume, Yuka, et al.
Pubblicazione: (2025)
di: Hashizume, Yuka, et al.
Pubblicazione: (2025)
Prevailing Research Areas for Music AI in the Era of Foundation Models
di: Wei, Megan, et al.
Pubblicazione: (2024)
di: Wei, Megan, et al.
Pubblicazione: (2024)
SNIPER Training: Single-Shot Sparse Training for Text-to-Speech
di: Lam, Perry, et al.
Pubblicazione: (2022)
di: Lam, Perry, et al.
Pubblicazione: (2022)
DeCodec: Rethinking Audio Codecs as Universal Disentangled Representation Learners
di: Luo, Xiaoxue, et al.
Pubblicazione: (2025)
di: Luo, Xiaoxue, et al.
Pubblicazione: (2025)
Learning Music Audio Representations With Limited Data
di: Plachouras, Christos, et al.
Pubblicazione: (2025)
di: Plachouras, Christos, et al.
Pubblicazione: (2025)
Balancing Information Preservation and Disentanglement in Self-Supervised Music Representation Learning
di: Wilkins, Julia, et al.
Pubblicazione: (2025)
di: Wilkins, Julia, et al.
Pubblicazione: (2025)
Learning Disentangled Audio Representations through Controlled Synthesis
di: Brima, Yusuf, et al.
Pubblicazione: (2024)
di: Brima, Yusuf, et al.
Pubblicazione: (2024)
DiffRoll: Diffusion-based Generative Music Transcription with Unsupervised Pretraining Capability
di: Cheuk, Kin Wai, et al.
Pubblicazione: (2022)
di: Cheuk, Kin Wai, et al.
Pubblicazione: (2022)
Evaluating Disentangled Representations for Controllable Music Generation
di: Ibáñez-Martínez, Laura, et al.
Pubblicazione: (2026)
di: Ibáñez-Martínez, Laura, et al.
Pubblicazione: (2026)
A Domain-Knowledge-Inspired Music Embedding Space and a Novel Attention Mechanism for Symbolic Music Modeling
di: Guo, Z., et al.
Pubblicazione: (2022)
di: Guo, Z., et al.
Pubblicazione: (2022)
Assessing the Alignment of Audio Representations with Timbre Similarity Ratings
di: Tian, Haokun, et al.
Pubblicazione: (2025)
di: Tian, Haokun, et al.
Pubblicazione: (2025)
COCOLA: Coherence-Oriented Contrastive Learning of Musical Audio Representations
di: Ciranni, Ruben, et al.
Pubblicazione: (2024)
di: Ciranni, Ruben, et al.
Pubblicazione: (2024)
Music Similarity Representation Learning Focusing on Individual Instruments with Source Separation and Human Preference
di: Imamura, Takehiro, et al.
Pubblicazione: (2025)
di: Imamura, Takehiro, et al.
Pubblicazione: (2025)
MART: Learning Hierarchical Music Audio Representations with Part-Whole Transformer
di: Yao, Dong, et al.
Pubblicazione: (2023)
di: Yao, Dong, et al.
Pubblicazione: (2023)
Towards Assessing Data Replication in Music Generation with Music Similarity Metrics on Raw Audio
di: Batlle-Roca, Roser, et al.
Pubblicazione: (2024)
di: Batlle-Roca, Roser, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Aligning Generative Music AI with Human Preferences: Methods and Challenges
di: Herremans, Dorien, et al.
Pubblicazione: (2025) -
Leveraging LLM Embeddings for Cross Dataset Label Alignment and Zero Shot Music Emotion Prediction
di: Liu, Renhang, et al.
Pubblicazione: (2024) -
MIRFLEX: Music Information Retrieval Feature Library for Extraction
di: Chopra, Anuradha, et al.
Pubblicazione: (2024) -
JamendoMaxCaps: A Large Scale Music-caption Dataset with Imputed Metadata
di: Roy, Abhinaba, et al.
Pubblicazione: (2025) -
MelodySim: Measuring Melody-aware Music Similarity for Plagiarism Detection
di: Lu, Tongyu, et al.
Pubblicazione: (2025)