ComposerX: Multi-Agent Symbolic Music Composition with LLMs
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Deng, Qixin, Yang, Qikai, Yuan, Ruibin, Huang, Yipeng, Wang, Yi, Liu, Xubo, Tian, Zeyue, Pan, Jiahao, Zhang, Ge, Lin, Hanfeng, Li, Yizhi, Ma, Yinghao, Fu, Jie, Lin, Chenghua, Benetos, Emmanouil, Wang, Wenwu, Xia, Guangyu, Xue, Wei, Guo, Yike |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Can LLMs "Reason" in Music? An Evaluation of LLMs' Capability of Music Understanding and Generation
par: Zhou, Ziya, et autres
Publié: (2024)
par: Zhou, Ziya, et autres
Publié: (2024)
CMI-RewardBench: Evaluating Music Reward Models with Compositional Multimodal Instruction
par: Ma, Yinghao, et autres
Publié: (2026)
par: Ma, Yinghao, et autres
Publié: (2026)
AutoMV: An Automatic Multi-Agent System for Music Video Generation
par: Tang, Xiaoxuan, et autres
Publié: (2025)
par: Tang, Xiaoxuan, et autres
Publié: (2025)
ChatMusician: Understanding and Generating Music Intrinsically with LLM
par: Yuan, Ruibin, et autres
Publié: (2024)
par: Yuan, Ruibin, et autres
Publié: (2024)
MusiLingo: Bridging Music and Text with Pre-trained Language Models for Music Captioning and Query Response
par: Deng, Zihao, et autres
Publié: (2023)
par: Deng, Zihao, et autres
Publié: (2023)
VidMuse: A Simple Video-to-Music Generation Framework with Long-Short-Term Modeling
par: Tian, Zeyue, et autres
Publié: (2024)
par: Tian, Zeyue, et autres
Publié: (2024)
MusicWeaver: Composer-Style Structural Editing and Minute-Scale Coherent Music Generation
par: Wang, Xuanchen, et autres
Publié: (2025)
par: Wang, Xuanchen, et autres
Publié: (2025)
YuE: Scaling Open Foundation Models for Long-Form Music Generation
par: Yuan, Ruibin, et autres
Publié: (2025)
par: Yuan, Ruibin, et autres
Publié: (2025)
MuChoMusic: Evaluating Music Understanding in Multimodal Audio-Language Models
par: Weck, Benno, et autres
Publié: (2024)
par: Weck, Benno, et autres
Publié: (2024)
Audio-FLAN: A Preliminary Release
par: Xue, Liumeng, et autres
Publié: (2025)
par: Xue, Liumeng, et autres
Publié: (2025)
CoComposer: LLM Multi-agent Collaborative Music Composition
par: Xing, Peiwen, et autres
Publié: (2025)
par: Xing, Peiwen, et autres
Publié: (2025)
MeloTrans: A Text to Symbolic Music Generation Model Following Human Composition Habit
par: Wang, Yutian, et autres
Publié: (2024)
par: Wang, Yutian, et autres
Publié: (2024)
MusicAOG: an Energy-Based Model for Learning and Sampling a Hierarchical Representation of Symbolic Music
par: Qian, Yikai, et autres
Publié: (2024)
par: Qian, Yikai, et autres
Publié: (2024)
MMTrail: A Multimodal Trailer Video Dataset with Language and Music Descriptions
par: Chi, Xiaowei, et autres
Publié: (2024)
par: Chi, Xiaowei, et autres
Publié: (2024)
MusFlow: Multimodal Music Generation via Conditional Flow Matching
par: Song, Jiahao, et autres
Publié: (2025)
par: Song, Jiahao, et autres
Publié: (2025)
Towards Generating Diverse Audio Captions via Adversarial Training
par: Mei, Xinhao, et autres
Publié: (2022)
par: Mei, Xinhao, et autres
Publié: (2022)
Flexible Control in Symbolic Music Generation via Musical Metadata
par: Han, Sangjun, et autres
Publié: (2024)
par: Han, Sangjun, et autres
Publié: (2024)
MIDI-LLaMA: An Instruction-Following Multimodal LLM for Symbolic Music Understanding
par: Yang, Meng, et autres
Publié: (2026)
par: Yang, Meng, et autres
Publié: (2026)
Optimizing Feature Extraction for Symbolic Music
par: Simonetta, Federico, et autres
Publié: (2023)
par: Simonetta, Federico, et autres
Publié: (2023)
AudioX: A Unified Framework for Anything-to-Audio Generation
par: Tian, Zeyue, et autres
Publié: (2025)
par: Tian, Zeyue, et autres
Publié: (2025)
Learning Temporal Resolution in Spectrogram for Audio Classification
par: Liu, Haohe, et autres
Publié: (2022)
par: Liu, Haohe, et autres
Publié: (2022)
Retrieval-Augmented Text-to-Audio Generation
par: Yuan, Yi, et autres
Publié: (2023)
par: Yuan, Yi, et autres
Publié: (2023)
Leveraging Pre-trained AudioLDM for Sound Generation: A Benchmark Study
par: Yuan, Yi, et autres
Publié: (2023)
par: Yuan, Yi, et autres
Publié: (2023)
MMAR: A Challenging Benchmark for Deep Reasoning in Speech, Audio, Music, and Their Mix
par: Ma, Ziyang, et autres
Publié: (2025)
par: Ma, Ziyang, et autres
Publié: (2025)
Video Echoed in Music: Semantic, Temporal, and Rhythmic Alignment for Video-to-Music Generation
par: Tong, Xinyi, et autres
Publié: (2025)
par: Tong, Xinyi, et autres
Publié: (2025)
Multimodal Fish Feeding Intensity Assessment in Aquaculture
par: Cui, Meng, et autres
Publié: (2023)
par: Cui, Meng, et autres
Publié: (2023)
Audio-Omni: Extending Multi-modal Understanding to Versatile Audio Generation and Editing
par: Tian, Zeyue, et autres
Publié: (2026)
par: Tian, Zeyue, et autres
Publié: (2026)
MusicSwarm: Biologically Inspired Intelligence for Music Composition
par: Buehler, Markus J.
Publié: (2025)
par: Buehler, Markus J.
Publié: (2025)
SyMuPe: Affective and Controllable Symbolic Music Performance
par: Borovik, Ilya, et autres
Publié: (2025)
par: Borovik, Ilya, et autres
Publié: (2025)
Amadeus: Autoregressive Model with Bidirectional Attribute Modelling for Symbolic Music
par: Su, Hongju, et autres
Publié: (2025)
par: Su, Hongju, et autres
Publié: (2025)
Music Grounding by Short Video
par: Xin, Zijie, et autres
Publié: (2024)
par: Xin, Zijie, et autres
Publié: (2024)
Physics-Aware Novel-View Acoustic Synthesis with Vision-Language Priors and 3D Acoustic Environment Modeling
par: Fan, Congyi, et autres
Publié: (2026)
par: Fan, Congyi, et autres
Publié: (2026)
LyricWhiz: Robust Multilingual Zero-shot Lyrics Transcription by Whispering to ChatGPT
par: Zhuo, Le, et autres
Publié: (2023)
par: Zhuo, Le, et autres
Publié: (2023)
MCA: Modality Composition Awareness for Robust Composed Multimodal Retrieval
par: Wu, Qiyu, et autres
Publié: (2025)
par: Wu, Qiyu, et autres
Publié: (2025)
Interpretable Zero-shot Referring Expression Comprehension with Query-driven Scene Graphs
par: Wu, Yike, et autres
Publié: (2026)
par: Wu, Yike, et autres
Publié: (2026)
Improving BERT for Symbolic Music Understanding Using Token Denoising and Pianoroll Prediction
par: Wang, Jun-You, et autres
Publié: (2025)
par: Wang, Jun-You, et autres
Publié: (2025)
MixFake: Benchmarking and Enhancing Audio Deepfake Detection in Diverse Real-world Mixed Audio
par: Li, Qingcao, et autres
Publié: (2026)
par: Li, Qingcao, et autres
Publié: (2026)
Frechet Music Distance: A Metric For Generative Symbolic Music Evaluation
par: Retkowski, Jan, et autres
Publié: (2024)
par: Retkowski, Jan, et autres
Publié: (2024)
Music Arena: Live Evaluation for Text-to-Music
par: Kim, Yonghyun, et autres
Publié: (2025)
par: Kim, Yonghyun, et autres
Publié: (2025)
Constructing Composite Features for Interpretable Music-Tagging
par: Xue, Chenhao, et autres
Publié: (2026)
par: Xue, Chenhao, et autres
Publié: (2026)
Documents similaires
-
Can LLMs "Reason" in Music? An Evaluation of LLMs' Capability of Music Understanding and Generation
par: Zhou, Ziya, et autres
Publié: (2024) -
CMI-RewardBench: Evaluating Music Reward Models with Compositional Multimodal Instruction
par: Ma, Yinghao, et autres
Publié: (2026) -
AutoMV: An Automatic Multi-Agent System for Music Video Generation
par: Tang, Xiaoxuan, et autres
Publié: (2025) -
ChatMusician: Understanding and Generating Music Intrinsically with LLM
par: Yuan, Ruibin, et autres
Publié: (2024) -
MusiLingo: Bridging Music and Text with Pre-trained Language Models for Music Captioning and Query Response
par: Deng, Zihao, et autres
Publié: (2023)