Enregistré dans:
| Auteurs principaux: | Ou, Longshen, Wang, Ye |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | https://arxiv.org/abs/2512.11348 |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Lead Instrument Detection from Multitrack Music
par: Ou, Longshen, et autres
Publié: (2025)
par: Ou, Longshen, et autres
Publié: (2025)
Motifs, Phrases, and Beyond: The Modelling of Structure in Symbolic Music Generation
par: Bhandari, Keshav, et autres
Publié: (2024)
par: Bhandari, Keshav, et autres
Publié: (2024)
Unifying Symbolic Music Arrangement: Track-Aware Reconstruction and Structured Tokenization
par: Ou, Longshen, et autres
Publié: (2024)
par: Ou, Longshen, et autres
Publié: (2024)
Apollo: An Interactive Environment for Generating Symbolic Musical Phrases using Corpus-based Style Imitation
par: Tchemeube, Renaud Bougueng, et autres
Publié: (2025)
par: Tchemeube, Renaud Bougueng, et autres
Publié: (2025)
Joint Learning of Wording and Formatting for Singable Melody-to-Lyric Generation
par: Ou, Longshen, et autres
Publié: (2023)
par: Ou, Longshen, et autres
Publié: (2023)
Analyzing Byte-Pair Encoding on Monophonic and Polyphonic Symbolic Music: A Focus on Musical Phrase Segmentation
par: Le, Dinh-Viet-Toan, et autres
Publié: (2024)
par: Le, Dinh-Viet-Toan, et autres
Publié: (2024)
Multi-Track MusicLDM: Towards Versatile Music Generation with Latent Diffusion Model
par: Karchkhadze, Tornike, et autres
Publié: (2024)
par: Karchkhadze, Tornike, et autres
Publié: (2024)
MMT-BERT: Chord-aware Symbolic Music Generation Based on Multitrack Music Transformer and MusicBERT
par: Zhu, Jinlong, et autres
Publié: (2024)
par: Zhu, Jinlong, et autres
Publié: (2024)
Segment-Factorized Full-Song Generation on Symbolic Piano Music
par: Chen, Ping-Yi, et autres
Publié: (2025)
par: Chen, Ping-Yi, et autres
Publié: (2025)
MGE-LDM: Joint Latent Diffusion for Simultaneous Music Generation and Source Extraction
par: Chae, Yunkee, et autres
Publié: (2025)
par: Chae, Yunkee, et autres
Publié: (2025)
DanceMeld: Unraveling Dance Phrases with Hierarchical Latent Codes for Music-to-Dance Synthesis
par: Gao, Xin, et autres
Publié: (2023)
par: Gao, Xin, et autres
Publié: (2023)
Exploring Tokenization Methods for Multitrack Sheet Music Generation
par: Wang, Yashan, et autres
Publié: (2024)
par: Wang, Yashan, et autres
Publié: (2024)
SCORE-SET: A dataset of GuitarPro files for Music Phrase Generation and Sequence Learning
par: Begari, Vishakh
Publié: (2025)
par: Begari, Vishakh
Publié: (2025)
Whole-Song Hierarchical Generation of Symbolic Music Using Cascaded Diffusion Models
par: Wang, Ziyu, et autres
Publié: (2024)
par: Wang, Ziyu, et autres
Publié: (2024)
PHRASED: Phrase Dictionary Biasing for Speech Translation
par: Wang, Peidong, et autres
Publié: (2025)
par: Wang, Peidong, et autres
Publié: (2025)
CatchPhrase: EXPrompt-Guided Encoder Adaptation for Audio-to-Image Generation
par: Oh, Hyunwoo, et autres
Publié: (2025)
par: Oh, Hyunwoo, et autres
Publié: (2025)
MIDI-GPT: A Controllable Generative Model for Computer-Assisted Multitrack Music Composition
par: Pasquier, Philippe, et autres
Publié: (2025)
par: Pasquier, Philippe, et autres
Publié: (2025)
ProsodyFM: Unsupervised Phrasing and Intonation Control for Intelligible Speech Synthesis
par: He, Xiangheng, et autres
Publié: (2024)
par: He, Xiangheng, et autres
Publié: (2024)
METEOR: Melody-aware Texture-controllable Symbolic Orchestral Music Generation via Transformer VAE
par: Le, Dinh-Viet-Toan, et autres
Publié: (2024)
par: Le, Dinh-Viet-Toan, et autres
Publié: (2024)
The Spheres Dataset: Multitrack Orchestral Recordings for Music Source Separation and Information Retrieval
par: Garcia-Martinez, Jaime, et autres
Publié: (2025)
par: Garcia-Martinez, Jaime, et autres
Publié: (2025)
Diffusion-based Symbolic Music Generation with Structured State Space Models
par: Yuan, Shenghua, et autres
Publié: (2025)
par: Yuan, Shenghua, et autres
Publié: (2025)
SongSong: A Time Phonograph for Chinese SongCi Music from Thousand of Years Away
par: Li, Jiajia, et autres
Publié: (2026)
par: Li, Jiajia, et autres
Publié: (2026)
Efficient Long-Sequence Diffusion Modeling for Symbolic Music Generation
par: Xu, Jinhan, et autres
Publié: (2026)
par: Xu, Jinhan, et autres
Publié: (2026)
TOMI: Transforming and Organizing Music Ideas for Multi-Track Compositions with Full-Song Structure
par: He, Qi, et autres
Publié: (2025)
par: He, Qi, et autres
Publié: (2025)
Contextualized Automatic Speech Recognition with Attention-Based Bias Phrase Boosted Beam Search
par: Sudo, Yui, et autres
Publié: (2024)
par: Sudo, Yui, et autres
Publié: (2024)
Composer Vector: Style-steering Symbolic Music Generation in a Latent Space
par: Jiang, Xunyi, et autres
Publié: (2026)
par: Jiang, Xunyi, et autres
Publié: (2026)
Multi-view MidiVAE: Fusing Track- and Bar-view Representations for Long Multi-track Symbolic Music Generation
par: Lin, Zhiwei, et autres
Publié: (2024)
par: Lin, Zhiwei, et autres
Publié: (2024)
TurboBias: Universal ASR Context-Biasing powered by GPU-accelerated Phrase-Boosting Tree
par: Andrusenko, Andrei, et autres
Publié: (2025)
par: Andrusenko, Andrei, et autres
Publié: (2025)
Multi-Source Music Generation with Latent Diffusion
par: Xu, Zhongweiyang, et autres
Publié: (2024)
par: Xu, Zhongweiyang, et autres
Publié: (2024)
LDM-SVC: Latent Diffusion Model Based Zero-Shot Any-to-Any Singing Voice Conversion with Singer Guidance
par: Chen, Shihao, et autres
Publié: (2024)
par: Chen, Shihao, et autres
Publié: (2024)
Interpreting Graphic Notation with MusicLDM: An AI Improvisation of Cornelius Cardew's Treatise
par: Karchkhadze, Tornike, et autres
Publié: (2024)
par: Karchkhadze, Tornike, et autres
Publié: (2024)
Depth-Structured Music Recurrence: Budgeted Recurrent Attention for Full-Piece Symbolic Music Modeling
par: Yi, Yungang, et autres
Publié: (2026)
par: Yi, Yungang, et autres
Publié: (2026)
Symbolic Music Generation with Non-Differentiable Rule Guided Diffusion
par: Huang, Yujia, et autres
Publié: (2024)
par: Huang, Yujia, et autres
Publié: (2024)
DiffRhythm+: Controllable and Flexible Full-Length Song Generation with Preference Optimization
par: Chen, Huakang, et autres
Publié: (2025)
par: Chen, Huakang, et autres
Publié: (2025)
LZMidi: Compression-Based Symbolic Music Generation
par: Ding, Connor, et autres
Publié: (2025)
par: Ding, Connor, et autres
Publié: (2025)
Mamba-Diffusion Model with Learnable Wavelet for Controllable Symbolic Music Generation
par: Zhang, Jincheng, et autres
Publié: (2025)
par: Zhang, Jincheng, et autres
Publié: (2025)
Versatile Symbolic Music-for-Music Modeling via Function Alignment
par: Jiang, Junyan, et autres
Publié: (2025)
par: Jiang, Junyan, et autres
Publié: (2025)
ViTex: Visual Texture Control for Multi-Track Symbolic Music Generation via Discrete Diffusion Models
par: Yi, Xiaoyu, et autres
Publié: (2026)
par: Yi, Xiaoyu, et autres
Publié: (2026)
Flexible Control in Symbolic Music Generation via Musical Metadata
par: Han, Sangjun, et autres
Publié: (2024)
par: Han, Sangjun, et autres
Publié: (2024)
SongEcho: Towards Cover Song Generation via Instance-Adaptive Element-wise Linear Modulation
par: Li, Sifei, et autres
Publié: (2026)
par: Li, Sifei, et autres
Publié: (2026)
Documents similaires
-
Lead Instrument Detection from Multitrack Music
par: Ou, Longshen, et autres
Publié: (2025) -
Motifs, Phrases, and Beyond: The Modelling of Structure in Symbolic Music Generation
par: Bhandari, Keshav, et autres
Publié: (2024) -
Unifying Symbolic Music Arrangement: Track-Aware Reconstruction and Structured Tokenization
par: Ou, Longshen, et autres
Publié: (2024) -
Apollo: An Interactive Environment for Generating Symbolic Musical Phrases using Corpus-based Style Imitation
par: Tchemeube, Renaud Bougueng, et autres
Publié: (2025) -
Joint Learning of Wording and Formatting for Singable Melody-to-Lyric Generation
par: Ou, Longshen, et autres
Publié: (2023)