Music Style Transfer With Diffusion Model
Fuente:
arXiv
Salvato in:
| Autori principali: | Huang, Hong, Wang, Yuyi, Li, Luyao, Lin, Jun |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Repurposing Image Diffusion Models for Training-Free Music Style Transfer on Mel-spectrograms
di: Wang, Heehwan, et al.
Pubblicazione: (2024)
di: Wang, Heehwan, et al.
Pubblicazione: (2024)
Remix the Timbre: Diffusion-Based Style Transfer Across Polyphonic Stems
di: Chen, Leduo, et al.
Pubblicazione: (2026)
di: Chen, Leduo, et al.
Pubblicazione: (2026)
Composer Vector: Style-steering Symbolic Music Generation in a Latent Space
di: Jiang, Xunyi, et al.
Pubblicazione: (2026)
di: Jiang, Xunyi, et al.
Pubblicazione: (2026)
Speech-to-Speech Translation with Discrete-Unit-Based Style Transfer
di: Wang, Yongqi, et al.
Pubblicazione: (2023)
di: Wang, Yongqi, et al.
Pubblicazione: (2023)
Device-Guided Music Transfer
di: Hung, Manh Pham, et al.
Pubblicazione: (2025)
di: Hung, Manh Pham, et al.
Pubblicazione: (2025)
Efficient Long-Sequence Diffusion Modeling for Symbolic Music Generation
di: Xu, Jinhan, et al.
Pubblicazione: (2026)
di: Xu, Jinhan, et al.
Pubblicazione: (2026)
Composer Style-specific Symbolic Music Generation Using Vector Quantized Discrete Diffusion Models
di: Zhang, Jincheng, et al.
Pubblicazione: (2023)
di: Zhang, Jincheng, et al.
Pubblicazione: (2023)
AutoStyle-TTS: Retrieval-Augmented Generation based Automatic Style Matching Text-to-Speech Synthesis
di: Luo, Dan, et al.
Pubblicazione: (2025)
di: Luo, Dan, et al.
Pubblicazione: (2025)
Generating Separated Singing Vocals Using a Diffusion Model Conditioned on Music Mixtures
di: Plaja-Roglans, Genís, et al.
Pubblicazione: (2025)
di: Plaja-Roglans, Genís, et al.
Pubblicazione: (2025)
Live Music Diffusion Models: Efficient Fine-Tuning and Post-Training of Interactive Diffusion Music Generators
di: Novack, Zachary, et al.
Pubblicazione: (2026)
di: Novack, Zachary, et al.
Pubblicazione: (2026)
SpeakerLM: End-to-End Versatile Speaker Diarization and Recognition with Multimodal Large Language Models
di: Yin, Han, et al.
Pubblicazione: (2025)
di: Yin, Han, et al.
Pubblicazione: (2025)
Musical Score Understanding Benchmark: Evaluating Large Language Models' Comprehension of Complete Musical Scores
di: Dai, Congren, et al.
Pubblicazione: (2025)
di: Dai, Congren, et al.
Pubblicazione: (2025)
ChoreoMuse: Robust Music-to-Dance Video Generation with Style Transfer and Beat-Adherent Motion
di: Wang, Xuanchen, et al.
Pubblicazione: (2025)
di: Wang, Xuanchen, et al.
Pubblicazione: (2025)
TalkingMachines: Real-Time Audio-Driven FaceTime-Style Video via Autoregressive Diffusion Models
di: Low, Chetwin, et al.
Pubblicazione: (2025)
di: Low, Chetwin, et al.
Pubblicazione: (2025)
When Noise Lowers The Loss: Rethinking Likelihood-Based Evaluation in Music Large Language Models
di: Li, Xiaosha, et al.
Pubblicazione: (2026)
di: Li, Xiaosha, et al.
Pubblicazione: (2026)
DuoTok: Source-Aware Dual-Track Tokenization for Multi-Track Music Language Modeling
di: Lin, Rui, et al.
Pubblicazione: (2025)
di: Lin, Rui, et al.
Pubblicazione: (2025)
Quality-aware Masked Diffusion Transformer for Enhanced Music Generation
di: Li, Chang, et al.
Pubblicazione: (2024)
di: Li, Chang, et al.
Pubblicazione: (2024)
Towards Real-Time Human-AI Musical Co-Performance: Accompaniment Generation with Latent Diffusion Models and MAX/MSP
di: Karchkhadze, Tornike, et al.
Pubblicazione: (2026)
di: Karchkhadze, Tornike, et al.
Pubblicazione: (2026)
Back to Ear: Perceptually Driven High Fidelity Music Reconstruction
di: Wang, Kangdi, et al.
Pubblicazione: (2025)
di: Wang, Kangdi, et al.
Pubblicazione: (2025)
Modeling Music as a Time-Frequency Image: A 2D Tokenizer for Music Generation
di: Cheng, Yuqing, et al.
Pubblicazione: (2026)
di: Cheng, Yuqing, et al.
Pubblicazione: (2026)
HNote: Extending YNote with Hexadecimal Encoding for Fine-Tuning LLMs in Music Modeling
di: Chu, Hung-Ying, et al.
Pubblicazione: (2025)
di: Chu, Hung-Ying, et al.
Pubblicazione: (2025)
Music Arena: Live Evaluation for Text-to-Music
di: Kim, Yonghyun, et al.
Pubblicazione: (2025)
di: Kim, Yonghyun, et al.
Pubblicazione: (2025)
ABC-Eval: Benchmarking Large Language Models on Symbolic Music Understanding and Instruction Following
di: Zhao, Jiahao, et al.
Pubblicazione: (2025)
di: Zhao, Jiahao, et al.
Pubblicazione: (2025)
StyleStream: Real-Time Zero-Shot Voice Style Conversion
di: Liu, Yisi, et al.
Pubblicazione: (2026)
di: Liu, Yisi, et al.
Pubblicazione: (2026)
Latent Diffusion Bridges for Unsupervised Musical Audio Timbre Transfer
di: Mancusi, Michele, et al.
Pubblicazione: (2024)
di: Mancusi, Michele, et al.
Pubblicazione: (2024)
Music Consistency Models
di: Fei, Zhengcong, et al.
Pubblicazione: (2024)
di: Fei, Zhengcong, et al.
Pubblicazione: (2024)
The Music Maestro or The Musically Challenged, A Massive Music Evaluation Benchmark for Large Language Models
di: Li, Jiajia, et al.
Pubblicazione: (2024)
di: Li, Jiajia, et al.
Pubblicazione: (2024)
Voiced-Aware Style Extraction and Style Direction Adjustment for Expressive Text-to-Speech
di: Kim, Nam-Gyu
Pubblicazione: (2025)
di: Kim, Nam-Gyu
Pubblicazione: (2025)
Amadeus: Autoregressive Model with Bidirectional Attribute Modelling for Symbolic Music
di: Su, Hongju, et al.
Pubblicazione: (2025)
di: Su, Hongju, et al.
Pubblicazione: (2025)
MusicSynth: An Automated Pipeline for Generating Violin Fingerboard Animations from Sheet Music Using Optical Music Recognition
di: Kaushik, Abhimanyu
Pubblicazione: (2026)
di: Kaushik, Abhimanyu
Pubblicazione: (2026)
Robust Neural Audio Fingerprinting using Music Foundation Models
di: Singh, Shubhr, et al.
Pubblicazione: (2025)
di: Singh, Shubhr, et al.
Pubblicazione: (2025)
Training-Efficient Text-to-Music Generation with State-Space Modeling
di: Lee, Wei-Jaw, et al.
Pubblicazione: (2026)
di: Lee, Wei-Jaw, et al.
Pubblicazione: (2026)
MusicMagus: Zero-Shot Text-to-Music Editing via Diffusion Models
di: Zhang, Yixiao, et al.
Pubblicazione: (2024)
di: Zhang, Yixiao, et al.
Pubblicazione: (2024)
Neural Style Transfer for Audio Spectograms
di: Verma, Prateek, et al.
Pubblicazione: (2018)
di: Verma, Prateek, et al.
Pubblicazione: (2018)
HAIM: Human-AI Music Datasets for AI Music Production Tracking Benchmark
di: Go, Seonghyeon, et al.
Pubblicazione: (2026)
di: Go, Seonghyeon, et al.
Pubblicazione: (2026)
Khala: Scaling Acoustic Token Language Models Toward High-Fidelity Music Generation
di: Liu, Jiafeng, et al.
Pubblicazione: (2026)
di: Liu, Jiafeng, et al.
Pubblicazione: (2026)
NotaGen: Advancing Musicality in Symbolic Music Generation with Large Language Model Training Paradigms
di: Wang, Yashan, et al.
Pubblicazione: (2025)
di: Wang, Yashan, et al.
Pubblicazione: (2025)
MUSE-Explainer: Counterfactual Explanations for Symbolic Music Graph Classification Models
di: Hilaire, Baptiste, et al.
Pubblicazione: (2025)
di: Hilaire, Baptiste, et al.
Pubblicazione: (2025)
Controllable Singing Style Conversion with Boundary-Aware Information Bottleneck
di: Hu, Zhetao, et al.
Pubblicazione: (2026)
di: Hu, Zhetao, et al.
Pubblicazione: (2026)
CompLex: Music Theory Lexicon Constructed by Autonomous Agents for Automatic Music Generation
di: Hu, Zhejing, et al.
Pubblicazione: (2025)
di: Hu, Zhejing, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Repurposing Image Diffusion Models for Training-Free Music Style Transfer on Mel-spectrograms
di: Wang, Heehwan, et al.
Pubblicazione: (2024) -
Remix the Timbre: Diffusion-Based Style Transfer Across Polyphonic Stems
di: Chen, Leduo, et al.
Pubblicazione: (2026) -
Composer Vector: Style-steering Symbolic Music Generation in a Latent Space
di: Jiang, Xunyi, et al.
Pubblicazione: (2026) -
Speech-to-Speech Translation with Discrete-Unit-Based Style Transfer
di: Wang, Yongqi, et al.
Pubblicazione: (2023) -
Device-Guided Music Transfer
di: Hung, Manh Pham, et al.
Pubblicazione: (2025)