Seed-Music: A Unified Framework for High Quality and Controlled Music Generation
Fuente:
arXiv
Saved in:
| Main Authors: | Bai, Ye, Chen, Haonan, Chen, Jitong, Chen, Zhuo, Deng, Yi, Dong, Xiaohong, Hantrakul, Lamtharn, Hao, Weituo, Huang, Qingqing, Huang, Zhongyi, Jia, Dongya, La, Feihu, Le, Duc, Li, Bochen, Li, Chumin, Li, Hui, Li, Xingxing, Liu, Shouda, Lu, Wei-Tsung, Lu, Yiqing, Shaw, Andrew, Spijkervet, Janne, Sun, Yakun, Wang, Bo, Wang, Ju-Chiang, Wang, Yuping, Wang, Yuxuan, Xu, Ling, Yang, Yifeng, Yao, Chao, Zhang, Shuo, Zhang, Yang, Zhang, Yilin, Zhao, Hang, Zhao, Ziyi, Zhong, Dejian, Zhou, Shicen, Zou, Pei |
|---|---|
| Format: | Preprint |
| Published: |
2024
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
SymPAC: Scalable Symbolic Music Generation With Prompts And Constraints
by: Chen, Haonan, et al.
Published: (2024)
by: Chen, Haonan, et al.
Published: (2024)
Temporal Adaptation of Pre-trained Foundation Models for Music Structure Analysis
by: Zhang, Yixiao, et al.
Published: (2025)
by: Zhang, Yixiao, et al.
Published: (2025)
Music Era Recognition Using Supervised Contrastive Learning and Artist Information
by: He, Qiqi, et al.
Published: (2024)
by: He, Qiqi, et al.
Published: (2024)
The Music Maestro or The Musically Challenged, A Massive Music Evaluation Benchmark for Large Language Models
by: Li, Jiajia, et al.
Published: (2024)
by: Li, Jiajia, et al.
Published: (2024)
Every Image Listens, Every Image Dances: Music-Driven Image Animation
by: Dong, Zhikang, et al.
Published: (2025)
by: Dong, Zhikang, et al.
Published: (2025)
Seed-TTS: A Family of High-Quality Versatile Speech Generation Models
by: Anastassiou, Philip, et al.
Published: (2024)
by: Anastassiou, Philip, et al.
Published: (2024)
MEDIC: Zero-shot Music Editing with Disentangled Inversion Control
by: Liu, Huadai, et al.
Published: (2024)
by: Liu, Huadai, et al.
Published: (2024)
Adaptive Federated Minimax Optimization with Lower Complexities
by: Huang, Feihu, et al.
Published: (2022)
by: Huang, Feihu, et al.
Published: (2022)
Monotonicity of the deficit in the local log-Brunn-Minkowski inequality
by: Wang, Shouda
Published: (2025)
by: Wang, Shouda
Published: (2025)
Music Style Transfer With Diffusion Model
by: Huang, Hong, et al.
Published: (2024)
by: Huang, Hong, et al.
Published: (2024)
NOTA: Multimodal Music Notation Understanding for Visual Large Language Model
by: Tang, Mingni, et al.
Published: (2025)
by: Tang, Mingni, et al.
Published: (2025)
StemGen: A music generation model that listens
by: Parker, Julian D., et al.
Published: (2023)
by: Parker, Julian D., et al.
Published: (2023)
Text-to-Song: Towards Controllable Music Generation Incorporating Vocals and Accompaniment
by: Hong, Zhiqing, et al.
Published: (2024)
by: Hong, Zhiqing, et al.
Published: (2024)
Comparison of different extraction methods of active ingredients of Chinese medicine and natural products
by: Geyuan Li, et al.
Published: (2024)
by: Geyuan Li, et al.
Published: (2024)
Not that Groove: Zero-Shot Symbolic Music Editing
by: Zhang, Li
Published: (2025)
by: Zhang, Li
Published: (2025)
MoMu-Diffusion: On Learning Long-Term Motion-Music Synchronization and Correspondence
by: You, Fuming, et al.
Published: (2024)
by: You, Fuming, et al.
Published: (2024)
JEN-1: Text-Guided Universal Music Generation with Omnidirectional Diffusion Models
by: Li, Peike, et al.
Published: (2023)
by: Li, Peike, et al.
Published: (2023)
Mel-RoFormer for Vocal Separation and Vocal Melody Transcription
by: Wang, Ju-Chiang, et al.
Published: (2024)
by: Wang, Ju-Chiang, et al.
Published: (2024)
Amphion: An Open-Source Audio, Music and Speech Generation Toolkit
by: Zhang, Xueyao, et al.
Published: (2023)
by: Zhang, Xueyao, et al.
Published: (2023)
GTSinger: A Global Multi-Technique Singing Corpus with Realistic Music Scores for All Singing Tasks
by: Zhang, Yu, et al.
Published: (2024)
by: Zhang, Yu, et al.
Published: (2024)
Music Grounding by Short Video
by: Xin, Zijie, et al.
Published: (2024)
by: Xin, Zijie, et al.
Published: (2024)
SongSong: A Time Phonograph for Chinese SongCi Music from Thousand of Years Away
by: Li, Jiajia, et al.
Published: (2026)
by: Li, Jiajia, et al.
Published: (2026)
MusiXQA: Advancing Visual Music Understanding in Multimodal Large Language Models
by: Chen, Jian, et al.
Published: (2025)
by: Chen, Jian, et al.
Published: (2025)
Hypnotic doses of fazamorexant induced less impairment on balance and cognition than zolpidem in healthy younger and elderly individuals
by: Chen Xia, et al.
Published: (2026)
by: Chen Xia, et al.
Published: (2026)
S-NeRF++: Autonomous Driving Simulation via Neural Reconstruction and Generation
by: Chen, Yurui, et al.
Published: (2024)
by: Chen, Yurui, et al.
Published: (2024)
CLion: Efficient Cautious Lion Optimizer with Enhanced Generalization
by: Huang, Feihu, et al.
Published: (2026)
by: Huang, Feihu, et al.
Published: (2026)
HomeAdam: Adam and AdamW Algorithms Sometimes Go Home to Obtain Better Provable Generalization
by: Huang, Feihu, et al.
Published: (2026)
by: Huang, Feihu, et al.
Published: (2026)
DiTAR: Diffusion Transformer Autoregressive Modeling for Speech Generation
by: Jia, Dongya, et al.
Published: (2025)
by: Jia, Dongya, et al.
Published: (2025)
MOSA: Music Motion with Semantic Annotation Dataset for Cross-Modal Music Processing
by: Huang, Yu-Fen, et al.
Published: (2024)
by: Huang, Yu-Fen, et al.
Published: (2024)
Know When to Explore: Difficulty-Aware Certainty as a Guide for LLM Reinforcement Learning
by: Li, Ang, et al.
Published: (2025)
by: Li, Ang, et al.
Published: (2025)
Dry‐Processed Perovskite Photovoltaics: Materials, Fabrication Techniques, and Devices
by: Lei Huang, et al.
Published: (2025)
by: Lei Huang, et al.
Published: (2025)
WildLong: Synthesizing Realistic Long-Context Instruction Data at Scale
by: Li, Jiaxi, et al.
Published: (2025)
by: Li, Jiaxi, et al.
Published: (2025)
MQAD: A Large-Scale Question Answering Dataset for Training Music Large Language Models
by: Ouyang, Zhihao, et al.
Published: (2025)
by: Ouyang, Zhihao, et al.
Published: (2025)
A Comprehensive Survey on Generative AI for Video-to-Music Generation
by: Ji, Shulei, et al.
Published: (2025)
by: Ji, Shulei, et al.
Published: (2025)
JEN-1 DreamStyler: Customized Musical Concept Learning via Pivotal Parameters Tuning
by: Chen, Boyu, et al.
Published: (2024)
by: Chen, Boyu, et al.
Published: (2024)
JEN-1 Composer: A Unified Framework for High-Fidelity Multi-Track Music Generation
by: Yao, Yao, et al.
Published: (2023)
by: Yao, Yao, et al.
Published: (2023)
Drug Repurposing: In Vitro Evaluation of Simeprevir as a Novel Antiviral Drug Against Severe Fever With Thrombocytopenia Syndrome Virus
by: Qian Chen, et al.
Published: (2025)
by: Qian Chen, et al.
Published: (2025)
Analyzable Chain-of-Musical-Thought Prompting for High-Fidelity Music Generation
by: Lam, Max W. Y., et al.
Published: (2025)
by: Lam, Max W. Y., et al.
Published: (2025)
MusicEval: A Generative Music Dataset with Expert Ratings for Automatic Text-to-Music Evaluation
by: Liu, Cheng, et al.
Published: (2025)
by: Liu, Cheng, et al.
Published: (2025)
Enhanced Adaptive Gradient Algorithms for Nonconvex-PL Minimax Optimization
by: Huang, Feihu, et al.
Published: (2023)
by: Huang, Feihu, et al.
Published: (2023)
Similar Items
-
SymPAC: Scalable Symbolic Music Generation With Prompts And Constraints
by: Chen, Haonan, et al.
Published: (2024) -
Temporal Adaptation of Pre-trained Foundation Models for Music Structure Analysis
by: Zhang, Yixiao, et al.
Published: (2025) -
Music Era Recognition Using Supervised Contrastive Learning and Artist Information
by: He, Qiqi, et al.
Published: (2024) -
The Music Maestro or The Musically Challenged, A Massive Music Evaluation Benchmark for Large Language Models
by: Li, Jiajia, et al.
Published: (2024) -
Every Image Listens, Every Image Dances: Music-Driven Image Animation
by: Dong, Zhikang, et al.
Published: (2025)