Generating Symbolic Music from Natural Language Prompts using an LLM-Enhanced Dataset
Fuente:
arXiv
Salvato in:
| Autori principali: | Xu, Weihan, McAuley, Julian, Berg-Kirkpatrick, Taylor, Dubnov, Shlomo, Dong, Hao-Wen |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
PDMX: A Large-Scale Public Domain MusicXML Dataset for Symbolic Music Processing
di: Long, Phillip, et al.
Pubblicazione: (2024)
di: Long, Phillip, et al.
Pubblicazione: (2024)
BACHI: Boundary-Aware Symbolic Chord Recognition Through Masked Iterative Decoding on Pop and Classical Music
di: Yao, Mingyang, et al.
Pubblicazione: (2025)
di: Yao, Mingyang, et al.
Pubblicazione: (2025)
Video-Guided Text-to-Music Generation Using Public Domain Movie Collections
di: Kim, Haven, et al.
Pubblicazione: (2025)
di: Kim, Haven, et al.
Pubblicazione: (2025)
MuseTok: Symbolic Music Tokenization for Generation and Semantic Understanding
di: Huang, Jingyue, et al.
Pubblicazione: (2025)
di: Huang, Jingyue, et al.
Pubblicazione: (2025)
DITTO: Diffusion Inference-Time T-Optimization for Music Generation
di: Novack, Zachary, et al.
Pubblicazione: (2024)
di: Novack, Zachary, et al.
Pubblicazione: (2024)
Steering Autoregressive Music Generation with Recursive Feature Machines
di: Zhao, Daniel, et al.
Pubblicazione: (2025)
di: Zhao, Daniel, et al.
Pubblicazione: (2025)
Large-scale Contrastive Language-Audio Pretraining with Feature Fusion and Keyword-to-Caption Augmentation
di: Wu, Yusong, et al.
Pubblicazione: (2022)
di: Wu, Yusong, et al.
Pubblicazione: (2022)
SelfVC: Voice Conversion With Iterative Refinement using Self Transformations
di: Neekhara, Paarth, et al.
Pubblicazione: (2023)
di: Neekhara, Paarth, et al.
Pubblicazione: (2023)
Simultaneous Music Separation and Generation Using Multi-Track Latent Diffusion Models
di: Karchkhadze, Tornike, et al.
Pubblicazione: (2024)
di: Karchkhadze, Tornike, et al.
Pubblicazione: (2024)
Presto! Distilling Steps and Layers for Accelerating Music Generation
di: Novack, Zachary, et al.
Pubblicazione: (2024)
di: Novack, Zachary, et al.
Pubblicazione: (2024)
Improving Music Source Separation with Diffusion and Consistency Refinement
di: Karchkhadze, Tornike, et al.
Pubblicazione: (2024)
di: Karchkhadze, Tornike, et al.
Pubblicazione: (2024)
FusID: Modality-Fused Semantic IDs for Generative Music Recommendation
di: Kim, Haven, et al.
Pubblicazione: (2026)
di: Kim, Haven, et al.
Pubblicazione: (2026)
Improving Generalization of Speech Separation in Real-World Scenarios: Strategies in Simulation, Optimization, and Evaluation
di: Chen, Ke, et al.
Pubblicazione: (2024)
di: Chen, Ke, et al.
Pubblicazione: (2024)
Interpreting Graphic Notation with MusicLDM: An AI Improvisation of Cornelius Cardew's Treatise
di: Karchkhadze, Tornike, et al.
Pubblicazione: (2024)
di: Karchkhadze, Tornike, et al.
Pubblicazione: (2024)
WildScore: Benchmarking MLLMs in-the-Wild Symbolic Music Reasoning
di: Mundada, Gagan, et al.
Pubblicazione: (2025)
di: Mundada, Gagan, et al.
Pubblicazione: (2025)
Binaural sound source localization using a hybrid time and frequency domain model
di: Geva, Gil, et al.
Pubblicazione: (2024)
di: Geva, Gil, et al.
Pubblicazione: (2024)
PosCUDA: Position based Convolution for Unlearnable Audio Datasets
di: Gokul, Vignesh, et al.
Pubblicazione: (2024)
di: Gokul, Vignesh, et al.
Pubblicazione: (2024)
Multi-Track MusicLDM: Towards Versatile Music Generation with Latent Diffusion Model
di: Karchkhadze, Tornike, et al.
Pubblicazione: (2024)
di: Karchkhadze, Tornike, et al.
Pubblicazione: (2024)
CoLLAP: Contrastive Long-form Language-Audio Pretraining with Musical Temporal Structure Augmentation
di: Wu, Junda, et al.
Pubblicazione: (2024)
di: Wu, Junda, et al.
Pubblicazione: (2024)
Music Enhancement with Deep Filters: A Technical Report for The ICASSP 2024 Cadenza Challenge
di: Shao, Keren, et al.
Pubblicazione: (2024)
di: Shao, Keren, et al.
Pubblicazione: (2024)
CSyMR: Benchmarking Compositional Music Information Retrieval in Symbolic Music Reasoning
di: Wang, Boyang, et al.
Pubblicazione: (2025)
di: Wang, Boyang, et al.
Pubblicazione: (2025)
Futga: Towards Fine-grained Music Understanding through Temporally-enhanced Generative Augmentation
di: Wu, Junda, et al.
Pubblicazione: (2024)
di: Wu, Junda, et al.
Pubblicazione: (2024)
Radif Corpus: A Symbolic Dataset for Non-Metric Iranian Classical Music
di: Kanani, Maziar, et al.
Pubblicazione: (2025)
di: Kanani, Maziar, et al.
Pubblicazione: (2025)
SymPAC: Scalable Symbolic Music Generation With Prompts And Constraints
di: Chen, Haonan, et al.
Pubblicazione: (2024)
di: Chen, Haonan, et al.
Pubblicazione: (2024)
MusicSem: A Semantically Rich Language--Audio Dataset of Natural Music Descriptions
di: Salganik, Rebecca, et al.
Pubblicazione: (2026)
di: Salganik, Rebecca, et al.
Pubblicazione: (2026)
Fast Text-to-Audio Generation with Adversarial Post-Training
di: Novack, Zachary, et al.
Pubblicazione: (2025)
di: Novack, Zachary, et al.
Pubblicazione: (2025)
Steer-by-prior Editing of Symbolic Music Loops
di: Jonason, Nicolas, et al.
Pubblicazione: (2024)
di: Jonason, Nicolas, et al.
Pubblicazione: (2024)
kNN-SVC: Robust Zero-Shot Singing Voice Conversion with Additive Synthesis and Concatenation Smoothness Optimization
di: Shao, Keren, et al.
Pubblicazione: (2025)
di: Shao, Keren, et al.
Pubblicazione: (2025)
Nested Music Transformer: Sequentially Decoding Compound Tokens in Symbolic Music and Audio Generation
di: Yoo, HaeJun, et al.
Pubblicazione: (2024)
di: Yoo, HaeJun, et al.
Pubblicazione: (2024)
SMUG-Explain: A Framework for Symbolic Music Graph Explanations
di: Karystinaios, Emmanouil, et al.
Pubblicazione: (2024)
di: Karystinaios, Emmanouil, et al.
Pubblicazione: (2024)
Pianoroll-Event: A Novel Score Representation for Symbolic Music
di: Qian, Lekai, et al.
Pubblicazione: (2026)
di: Qian, Lekai, et al.
Pubblicazione: (2026)
Evaluating Co-Creativity using Total Information Flow
di: Gokul, Vignesh, et al.
Pubblicazione: (2024)
di: Gokul, Vignesh, et al.
Pubblicazione: (2024)
PerTok: Expressive Encoding and Modeling of Symbolic Musical Ideas and Variations
di: Lenz, Julian, et al.
Pubblicazione: (2024)
di: Lenz, Julian, et al.
Pubblicazione: (2024)
Bob's Confetti: Phonetic Memorization Attacks in Music and Video Generation
di: Roh, Jaechul, et al.
Pubblicazione: (2025)
di: Roh, Jaechul, et al.
Pubblicazione: (2025)
Flexible Control in Symbolic Music Generation via Musical Metadata
di: Han, Sangjun, et al.
Pubblicazione: (2024)
di: Han, Sangjun, et al.
Pubblicazione: (2024)
Optimizing Feature Extraction for Symbolic Music
di: Simonetta, Federico, et al.
Pubblicazione: (2023)
di: Simonetta, Federico, et al.
Pubblicazione: (2023)
MusicEval: A Generative Music Dataset with Expert Ratings for Automatic Text-to-Music Evaluation
di: Liu, Cheng, et al.
Pubblicazione: (2025)
di: Liu, Cheng, et al.
Pubblicazione: (2025)
Joint Audio and Symbolic Conditioning for Temporally Controlled Text-to-Music Generation
di: Tal, Or, et al.
Pubblicazione: (2024)
di: Tal, Or, et al.
Pubblicazione: (2024)
MelodyT5: A Unified Score-to-Score Transformer for Symbolic Music Processing
di: Wu, Shangda, et al.
Pubblicazione: (2024)
di: Wu, Shangda, et al.
Pubblicazione: (2024)
FakeMusicCaps: a Dataset for Detection and Attribution of Synthetic Music Generated via Text-to-Music Models
di: Comanducci, Luca, et al.
Pubblicazione: (2024)
di: Comanducci, Luca, et al.
Pubblicazione: (2024)
Documenti analoghi
-
PDMX: A Large-Scale Public Domain MusicXML Dataset for Symbolic Music Processing
di: Long, Phillip, et al.
Pubblicazione: (2024) -
BACHI: Boundary-Aware Symbolic Chord Recognition Through Masked Iterative Decoding on Pop and Classical Music
di: Yao, Mingyang, et al.
Pubblicazione: (2025) -
Video-Guided Text-to-Music Generation Using Public Domain Movie Collections
di: Kim, Haven, et al.
Pubblicazione: (2025) -
MuseTok: Symbolic Music Tokenization for Generation and Semantic Understanding
di: Huang, Jingyue, et al.
Pubblicazione: (2025) -
DITTO: Diffusion Inference-Time T-Optimization for Music Generation
di: Novack, Zachary, et al.
Pubblicazione: (2024)