SongCreator: Lyrics-based Universal Song Generation
Fuente:
arXiv
Salvato in:
| Autori principali: | Lei, Shun, Zhou, Yixuan, Tang, Boshi, Lam, Max W. Y., Liu, Feng, Liu, Hangyu, Wu, Jingcheng, Kang, Shiyin, Wu, Zhiyong, Meng, Helen |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
An End-to-End Approach for Chord-Conditioned Song Generation
di: Gao, Shuochen, et al.
Pubblicazione: (2024)
di: Gao, Shuochen, et al.
Pubblicazione: (2024)
SongBench: A Fine-Grained Multi-Aspect Benchmark for Song Quality Assessment
di: Wu, Dapeng, et al.
Pubblicazione: (2026)
di: Wu, Dapeng, et al.
Pubblicazione: (2026)
SongPrep: A Preprocessing Framework and End-to-end Model for Full-song Structure Parsing and Lyrics Transcription
di: Tan, Wei, et al.
Pubblicazione: (2025)
di: Tan, Wei, et al.
Pubblicazione: (2025)
SongComposer: A Large Language Model for Lyric and Melody Generation in Song Composition
di: Ding, Shuangrui, et al.
Pubblicazione: (2024)
di: Ding, Shuangrui, et al.
Pubblicazione: (2024)
LeVo: High-Quality Song Generation with Multi-Preference Alignment
di: Lei, Shun, et al.
Pubblicazione: (2025)
di: Lei, Shun, et al.
Pubblicazione: (2025)
SongGLM: Lyric-to-Melody Generation with 2D Alignment Encoding and Multi-Task Pre-Training
di: Yu, Jiaxing, et al.
Pubblicazione: (2024)
di: Yu, Jiaxing, et al.
Pubblicazione: (2024)
Improving Language Model-Based Zero-Shot Text-to-Speech Synthesis with Multi-Scale Acoustic Prompts
di: Lei, Shun, et al.
Pubblicazione: (2023)
di: Lei, Shun, et al.
Pubblicazione: (2023)
Towards Hallucination-Free Music: A Reinforcement Learning Preference Optimization Framework for Reliable Song Generation
di: Zhang, Huaicheng, et al.
Pubblicazione: (2025)
di: Zhang, Huaicheng, et al.
Pubblicazione: (2025)
The ICASSP 2026 Automatic Song Aesthetics Evaluation Challenge
di: Ma, Guobin, et al.
Pubblicazione: (2026)
di: Ma, Guobin, et al.
Pubblicazione: (2026)
DiffRhythm+: Controllable and Flexible Full-Length Song Generation with Preference Optimization
di: Chen, Huakang, et al.
Pubblicazione: (2025)
di: Chen, Huakang, et al.
Pubblicazione: (2025)
SongEditor: Adapting Zero-Shot Song Generation Language Model as a Multi-Task Editor
di: Yang, Chenyu, et al.
Pubblicazione: (2024)
di: Yang, Chenyu, et al.
Pubblicazione: (2024)
IdolSongsJp Corpus: A Multi-Singer Song Corpus in the Style of Japanese Idol Groups
di: Suda, Hitoshi, et al.
Pubblicazione: (2025)
di: Suda, Hitoshi, et al.
Pubblicazione: (2025)
The THU-HCSI Multi-Speaker Multi-Lingual Few-Shot Voice Cloning System for LIMMITS'24 Challenge
di: Zhou, Yixuan, et al.
Pubblicazione: (2024)
di: Zhou, Yixuan, et al.
Pubblicazione: (2024)
Multi-view MidiVAE: Fusing Track- and Bar-view Representations for Long Multi-track Symbolic Music Generation
di: Lin, Zhiwei, et al.
Pubblicazione: (2024)
di: Lin, Zhiwei, et al.
Pubblicazione: (2024)
SongTrans: An unified song transcription and alignment method for lyrics and notes
di: Wu, Siwei, et al.
Pubblicazione: (2024)
di: Wu, Siwei, et al.
Pubblicazione: (2024)
The Florence Price Art Song Dataset and Piano Accompaniment Generator
di: He, Tao-Tao, et al.
Pubblicazione: (2025)
di: He, Tao-Tao, et al.
Pubblicazione: (2025)
Song Aesthetics Evaluation with Multi-Stem Attention and Hierarchical Uncertainty Modeling
di: Lv, Yishan, et al.
Pubblicazione: (2026)
di: Lv, Yishan, et al.
Pubblicazione: (2026)
MIDI-Informed Singing Accompaniment Generation in a Compositional Song Pipeline
di: Tsai, Fang-Duo, et al.
Pubblicazione: (2026)
di: Tsai, Fang-Duo, et al.
Pubblicazione: (2026)
CSL-L2M: Controllable Song-Level Lyric-to-Melody Generation Based on Conditional Transformer with Fine-Grained Lyric and Musical Controls
di: Chai, Li, et al.
Pubblicazione: (2024)
di: Chai, Li, et al.
Pubblicazione: (2024)
Disambiguation of Chinese Polyphones in an End-to-End Framework with Semantic Features Extracted by Pre-trained BERT
di: Dai, Dongyang, et al.
Pubblicazione: (2025)
di: Dai, Dongyang, et al.
Pubblicazione: (2025)
FruitsMusic: A Real-World Corpus of Japanese Idol-Group Songs
di: Suda, Hitoshi, et al.
Pubblicazione: (2024)
di: Suda, Hitoshi, et al.
Pubblicazione: (2024)
Enhancing Expressiveness in Dance Generation via Integrating Frequency and Music Style Information
di: Huang, Qiaochu, et al.
Pubblicazione: (2024)
di: Huang, Qiaochu, et al.
Pubblicazione: (2024)
Automatic Live Music Song Identification Using Multi-level Deep Sequence Similarity Learning
di: Hakala, Aapo, et al.
Pubblicazione: (2025)
di: Hakala, Aapo, et al.
Pubblicazione: (2025)
The Codec Language Model-based Zero-Shot Spontaneous Style TTS System for CoVoC Challenge 2024
di: Zhou, Shuoyi, et al.
Pubblicazione: (2024)
di: Zhou, Shuoyi, et al.
Pubblicazione: (2024)
VoxInstruct: Expressive Human Instruction-to-Speech Generation with Unified Multilingual Codec Language Modelling
di: Zhou, Yixuan, et al.
Pubblicazione: (2024)
di: Zhou, Yixuan, et al.
Pubblicazione: (2024)
Exploiting Audio-Visual Features with Pretrained AV-HuBERT for Multi-Modal Dysarthric Speech Reconstruction
di: Chen, Xueyuan, et al.
Pubblicazione: (2024)
di: Chen, Xueyuan, et al.
Pubblicazione: (2024)
Versatile Framework for Song Generation with Prompt-based Control
di: Zhang, Yu, et al.
Pubblicazione: (2025)
di: Zhang, Yu, et al.
Pubblicazione: (2025)
In This Environment, As That Speaker: A Text-Driven Framework for Multi-Attribute Speech Conversion
di: Jin, Jiawei, et al.
Pubblicazione: (2025)
di: Jin, Jiawei, et al.
Pubblicazione: (2025)
Neural Concatenative Singing Voice Conversion: Rethinking Concatenation-Based Approach for One-Shot Singing Voice Conversion
di: Sha, Binzhu, et al.
Pubblicazione: (2023)
di: Sha, Binzhu, et al.
Pubblicazione: (2023)
UniSep: Universal Target Audio Separation with Language Models at Scale
di: Wang, Yuanyuan, et al.
Pubblicazione: (2025)
di: Wang, Yuanyuan, et al.
Pubblicazione: (2025)
DiffDSR: Dysarthric Speech Reconstruction Using Latent Diffusion Model
di: Chen, Xueyuan, et al.
Pubblicazione: (2025)
di: Chen, Xueyuan, et al.
Pubblicazione: (2025)
UniSRM: A Unified Speech Reward Model for Reasoning-Based Fine-grained Assessment
di: Wang, Yuanyuan, et al.
Pubblicazione: (2026)
di: Wang, Yuanyuan, et al.
Pubblicazione: (2026)
CHORDONOMICON: A Dataset of 666,000 Songs and their Chord Progressions
di: Kantarelis, Spyridon, et al.
Pubblicazione: (2024)
di: Kantarelis, Spyridon, et al.
Pubblicazione: (2024)
DualSpeechLM: Towards Unified Speech Understanding and Generation via Dual Speech Token Modeling with Large Language Models
di: Wang, Yuanyuan, et al.
Pubblicazione: (2025)
di: Wang, Yuanyuan, et al.
Pubblicazione: (2025)
TOMI: Transforming and Organizing Music Ideas for Multi-Track Compositions with Full-Song Structure
di: He, Qi, et al.
Pubblicazione: (2025)
di: He, Qi, et al.
Pubblicazione: (2025)
Enhancing Lyrics Transcription on Music Mixtures with Consistency Loss
di: Huang, Jiawen, et al.
Pubblicazione: (2025)
di: Huang, Jiawen, et al.
Pubblicazione: (2025)
Improving the Adversarial Robustness for Speaker Verification by Self-Supervised Learning
di: Wu, Haibin, et al.
Pubblicazione: (2021)
di: Wu, Haibin, et al.
Pubblicazione: (2021)
MuCodec: Ultra Low-Bitrate Music Codec
di: Xu, Yaoxun, et al.
Pubblicazione: (2024)
di: Xu, Yaoxun, et al.
Pubblicazione: (2024)
Exploiting Music Source Separation for Automatic Lyrics Transcription with Whisper
di: Syed, Jaza, et al.
Pubblicazione: (2025)
di: Syed, Jaza, et al.
Pubblicazione: (2025)
LyricWhiz: Robust Multilingual Zero-shot Lyrics Transcription by Whispering to ChatGPT
di: Zhuo, Le, et al.
Pubblicazione: (2023)
di: Zhuo, Le, et al.
Pubblicazione: (2023)
Documenti analoghi
-
An End-to-End Approach for Chord-Conditioned Song Generation
di: Gao, Shuochen, et al.
Pubblicazione: (2024) -
SongBench: A Fine-Grained Multi-Aspect Benchmark for Song Quality Assessment
di: Wu, Dapeng, et al.
Pubblicazione: (2026) -
SongPrep: A Preprocessing Framework and End-to-end Model for Full-song Structure Parsing and Lyrics Transcription
di: Tan, Wei, et al.
Pubblicazione: (2025) -
SongComposer: A Large Language Model for Lyric and Melody Generation in Song Composition
di: Ding, Shuangrui, et al.
Pubblicazione: (2024) -
LeVo: High-Quality Song Generation with Multi-Preference Alignment
di: Lei, Shun, et al.
Pubblicazione: (2025)