Language Model Mapping in Multimodal Music Learning: A Grand Challenge Proposal
Fuente:
arXiv
Salvato in:
| Autori principali: | Chin, Daniel, Xia, Gus |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Content-based Controls For Music Large Language Modeling
di: Lin, Liwei, et al.
Pubblicazione: (2023)
di: Lin, Liwei, et al.
Pubblicazione: (2023)
M2M-Gen: A Multimodal Framework for Automated Background Music Generation in Japanese Manga Using Large Language Models
di: Sharma, Megha, et al.
Pubblicazione: (2024)
di: Sharma, Megha, et al.
Pubblicazione: (2024)
TOMI: Transforming and Organizing Music Ideas for Multi-Track Compositions with Full-Song Structure
di: He, Qi, et al.
Pubblicazione: (2025)
di: He, Qi, et al.
Pubblicazione: (2025)
Arrange, Inpaint, and Refine: Steerable Long-term Music Audio Generation and Editing via Content-based Controls
di: Lin, Liwei, et al.
Pubblicazione: (2024)
di: Lin, Liwei, et al.
Pubblicazione: (2024)
The Music Maestro or The Musically Challenged, A Massive Music Evaluation Benchmark for Large Language Models
di: Li, Jiajia, et al.
Pubblicazione: (2024)
di: Li, Jiajia, et al.
Pubblicazione: (2024)
MusicMagus: Zero-Shot Text-to-Music Editing via Diffusion Models
di: Zhang, Yixiao, et al.
Pubblicazione: (2024)
di: Zhang, Yixiao, et al.
Pubblicazione: (2024)
Evaluating Multimodal Large Language Models on Core Music Perception Tasks
di: Carone, Brandon James, et al.
Pubblicazione: (2025)
di: Carone, Brandon James, et al.
Pubblicazione: (2025)
EXPOTION: Facial Expression and Motion Control for Multimodal Music Generation
di: Izzati, Fathinah, et al.
Pubblicazione: (2025)
di: Izzati, Fathinah, et al.
Pubblicazione: (2025)
Whole-Song Hierarchical Generation of Symbolic Music Using Cascaded Diffusion Models
di: Wang, Ziyu, et al.
Pubblicazione: (2024)
di: Wang, Ziyu, et al.
Pubblicazione: (2024)
Structured Multi-Track Accompaniment Arrangement via Style Prior Modelling
di: Zhao, Jingwei, et al.
Pubblicazione: (2023)
di: Zhao, Jingwei, et al.
Pubblicazione: (2023)
Instruct-MusicGen: Unlocking Text-to-Music Editing for Music Language Models via Instruction Tuning
di: Zhang, Yixiao, et al.
Pubblicazione: (2024)
di: Zhang, Yixiao, et al.
Pubblicazione: (2024)
Summary of The Inaugural Music Source Restoration Challenge
di: Zang, Yongyi, et al.
Pubblicazione: (2026)
di: Zang, Yongyi, et al.
Pubblicazione: (2026)
NotaGen: Advancing Musicality in Symbolic Music Generation with Large Language Model Training Paradigms
di: Wang, Yashan, et al.
Pubblicazione: (2025)
di: Wang, Yashan, et al.
Pubblicazione: (2025)
Are We There Yet? A Brief Survey of Music Emotion Prediction Datasets, Models and Outstanding Challenges
di: Kang, Jaeyong, et al.
Pubblicazione: (2024)
di: Kang, Jaeyong, et al.
Pubblicazione: (2024)
MuPT: A Generative Symbolic Music Pretrained Transformer
di: Qu, Xingwei, et al.
Pubblicazione: (2024)
di: Qu, Xingwei, et al.
Pubblicazione: (2024)
Exploring State-Space-Model based Language Model in Music Generation
di: Lee, Wei-Jaw, et al.
Pubblicazione: (2025)
di: Lee, Wei-Jaw, et al.
Pubblicazione: (2025)
Video2Music: Suitable Music Generation from Videos using an Affective Multimodal Transformer model
di: Kang, Jaeyong, et al.
Pubblicazione: (2023)
di: Kang, Jaeyong, et al.
Pubblicazione: (2023)
The Multimodal Information Based Speech Processing (MISP) 2025 Challenge: Audio-Visual Diarization and Recognition
di: Gao, Ming, et al.
Pubblicazione: (2025)
di: Gao, Ming, et al.
Pubblicazione: (2025)
Aligning Generative Music AI with Human Preferences: Methods and Challenges
di: Herremans, Dorien, et al.
Pubblicazione: (2025)
di: Herremans, Dorien, et al.
Pubblicazione: (2025)
LadderSym: A Multimodal Interleaved Transformer for Music Practice Error Detection
di: Chou, Benjamin Shiue-Hal, et al.
Pubblicazione: (2025)
di: Chou, Benjamin Shiue-Hal, et al.
Pubblicazione: (2025)
Tuning Music Education: AI-Powered Personalization in Learning Music
di: Sanganeria, Mayank, et al.
Pubblicazione: (2024)
di: Sanganeria, Mayank, et al.
Pubblicazione: (2024)
Music Source Restoration with Ensemble Separation and Targeted Reconstruction
di: Deng, Xinlong, et al.
Pubblicazione: (2026)
di: Deng, Xinlong, et al.
Pubblicazione: (2026)
Music Consistency Models
di: Fei, Zhengcong, et al.
Pubblicazione: (2024)
di: Fei, Zhengcong, et al.
Pubblicazione: (2024)
Practical and Reproducible Symbolic Music Generation by Large Language Models with Structural Embeddings
di: Rhyu, Seungyeon, et al.
Pubblicazione: (2024)
di: Rhyu, Seungyeon, et al.
Pubblicazione: (2024)
MAJL: A Model-Agnostic Joint Learning Framework for Music Source Separation and Pitch Estimation
di: Wei, Haojie, et al.
Pubblicazione: (2025)
di: Wei, Haojie, et al.
Pubblicazione: (2025)
Joint Learning of Emotions in Music and Generalized Sounds
di: Simonetta, Federico, et al.
Pubblicazione: (2024)
di: Simonetta, Federico, et al.
Pubblicazione: (2024)
Play Me Something Icy: Practical Challenges, Explainability and the Semantic Gap in Generative AI Music
di: Allison, Jesse, et al.
Pubblicazione: (2024)
di: Allison, Jesse, et al.
Pubblicazione: (2024)
Wearable Music2Emotion : Assessing Emotions Induced by AI-Generated Music through Portable EEG-fNIRS Fusion
di: Zhao, Sha, et al.
Pubblicazione: (2025)
di: Zhao, Sha, et al.
Pubblicazione: (2025)
Exploring Musical Roots: Applying Audio Embeddings to Empower Influence Attribution for a Generative Music Model
di: Barnett, Julia, et al.
Pubblicazione: (2024)
di: Barnett, Julia, et al.
Pubblicazione: (2024)
The Interpretation Gap in Text-to-Music Generation Models
di: Zang, Yongyi, et al.
Pubblicazione: (2024)
di: Zang, Yongyi, et al.
Pubblicazione: (2024)
Arabic Music Classification and Generation using Deep Learning
di: Elshaarawy, Mohamed, et al.
Pubblicazione: (2024)
di: Elshaarawy, Mohamed, et al.
Pubblicazione: (2024)
MMVA: Multimodal Matching Based on Valence and Arousal across Images, Music, and Musical Captions
di: Choi, Suhwan, et al.
Pubblicazione: (2025)
di: Choi, Suhwan, et al.
Pubblicazione: (2025)
YNote: A Novel Music Notation for Fine-Tuning LLMs in Music Generation
di: Lu, Shao-Chien, et al.
Pubblicazione: (2025)
di: Lu, Shao-Chien, et al.
Pubblicazione: (2025)
Music Genre Classification: A Comparative Analysis of Classical Machine Learning and Deep Learning Approaches
di: Prajuli, Sachin, et al.
Pubblicazione: (2026)
di: Prajuli, Sachin, et al.
Pubblicazione: (2026)
MMT-BERT: Chord-aware Symbolic Music Generation Based on Multitrack Music Transformer and MusicBERT
di: Zhu, Jinlong, et al.
Pubblicazione: (2024)
di: Zhu, Jinlong, et al.
Pubblicazione: (2024)
Semi-Supervised Self-Learning Enhanced Music Emotion Recognition
di: Sun, Yifu, et al.
Pubblicazione: (2024)
di: Sun, Yifu, et al.
Pubblicazione: (2024)
Are Inherently Interpretable Models More Robust? A Study In Music Emotion Recognition
di: Hoedt, Katharina, et al.
Pubblicazione: (2025)
di: Hoedt, Katharina, et al.
Pubblicazione: (2025)
Real-world Music Plagiarism Detection With Music Segment Transcription System
di: Go, Seonghyeon
Pubblicazione: (2025)
di: Go, Seonghyeon
Pubblicazione: (2025)
MusicFlow: Cascaded Flow Matching for Text Guided Music Generation
di: Prajwal, K R, et al.
Pubblicazione: (2024)
di: Prajwal, K R, et al.
Pubblicazione: (2024)
ShrutiSense: Microtonal Modeling and Correction in Indian Classical Music
di: Ghosh, Rajarshi, et al.
Pubblicazione: (2025)
di: Ghosh, Rajarshi, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Content-based Controls For Music Large Language Modeling
di: Lin, Liwei, et al.
Pubblicazione: (2023) -
M2M-Gen: A Multimodal Framework for Automated Background Music Generation in Japanese Manga Using Large Language Models
di: Sharma, Megha, et al.
Pubblicazione: (2024) -
TOMI: Transforming and Organizing Music Ideas for Multi-Track Compositions with Full-Song Structure
di: He, Qi, et al.
Pubblicazione: (2025) -
Arrange, Inpaint, and Refine: Steerable Long-term Music Audio Generation and Editing via Content-based Controls
di: Lin, Liwei, et al.
Pubblicazione: (2024) -
The Music Maestro or The Musically Challenged, A Massive Music Evaluation Benchmark for Large Language Models
di: Li, Jiajia, et al.
Pubblicazione: (2024)