The Interpretation Gap in Text-to-Music Generation Models
Fuente:
arXiv
Salvato in:
| Autori principali: | Zang, Yongyi, Zhang, Yixiao |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Improving Controllability and Editability for Pretrained Text-to-Music Generation Models
di: Zhang, Yixiao
Pubblicazione: (2024)
di: Zhang, Yixiao
Pubblicazione: (2024)
Content-based Controls For Music Large Language Modeling
di: Lin, Liwei, et al.
Pubblicazione: (2023)
di: Lin, Liwei, et al.
Pubblicazione: (2023)
Summary of The Inaugural Music Source Restoration Challenge
di: Zang, Yongyi, et al.
Pubblicazione: (2026)
di: Zang, Yongyi, et al.
Pubblicazione: (2026)
Music Source Restoration
di: Zang, Yongyi, et al.
Pubblicazione: (2025)
di: Zang, Yongyi, et al.
Pubblicazione: (2025)
SingFake: Singing Voice Deepfake Detection
di: Zang, Yongyi, et al.
Pubblicazione: (2023)
di: Zang, Yongyi, et al.
Pubblicazione: (2023)
MusicMagus: Zero-Shot Text-to-Music Editing via Diffusion Models
di: Zhang, Yixiao, et al.
Pubblicazione: (2024)
di: Zhang, Yixiao, et al.
Pubblicazione: (2024)
Arrange, Inpaint, and Refine: Steerable Long-term Music Audio Generation and Editing via Content-based Controls
di: Lin, Liwei, et al.
Pubblicazione: (2024)
di: Lin, Liwei, et al.
Pubblicazione: (2024)
MusicFlow: Cascaded Flow Matching for Text Guided Music Generation
di: Prajwal, K R, et al.
Pubblicazione: (2024)
di: Prajwal, K R, et al.
Pubblicazione: (2024)
Piano Transcription by Hierarchical Language Modeling with Pretrained Roll-based Encoders
di: Li, Dichucheng, et al.
Pubblicazione: (2025)
di: Li, Dichucheng, et al.
Pubblicazione: (2025)
AImoclips: A Benchmark for Evaluating Emotion Conveyance in Text-to-Music Generation
di: Go, Gyehun, et al.
Pubblicazione: (2025)
di: Go, Gyehun, et al.
Pubblicazione: (2025)
Play Me Something Icy: Practical Challenges, Explainability and the Semantic Gap in Generative AI Music
di: Allison, Jesse, et al.
Pubblicazione: (2024)
di: Allison, Jesse, et al.
Pubblicazione: (2024)
Perceptual Musical Features for Interpretable Audio Tagging
di: Lyberatos, Vassilis, et al.
Pubblicazione: (2023)
di: Lyberatos, Vassilis, et al.
Pubblicazione: (2023)
Are Inherently Interpretable Models More Robust? A Study In Music Emotion Recognition
di: Hoedt, Katharina, et al.
Pubblicazione: (2025)
di: Hoedt, Katharina, et al.
Pubblicazione: (2025)
Training-Free Multi-Step Audio Source Separation
di: Zang, Yongyi, et al.
Pubblicazione: (2025)
di: Zang, Yongyi, et al.
Pubblicazione: (2025)
MusiConGen: Rhythm and Chord Control for Transformer-Based Text-to-Music Generation
di: Lan, Yun-Han, et al.
Pubblicazione: (2024)
di: Lan, Yun-Han, et al.
Pubblicazione: (2024)
Aligning Text-to-Music Evaluation with Human Preferences
di: Huang, Yichen, et al.
Pubblicazione: (2025)
di: Huang, Yichen, et al.
Pubblicazione: (2025)
Audio Prompt Adapter: Unleashing Music Editing Abilities for Text-to-Music with Lightweight Finetuning
di: Tsai, Fang-Duo, et al.
Pubblicazione: (2024)
di: Tsai, Fang-Duo, et al.
Pubblicazione: (2024)
Mamba-Diffusion Model with Learnable Wavelet for Controllable Symbolic Music Generation
di: Zhang, Jincheng, et al.
Pubblicazione: (2025)
di: Zhang, Jincheng, et al.
Pubblicazione: (2025)
NotaGen: Advancing Musicality in Symbolic Music Generation with Large Language Model Training Paradigms
di: Wang, Yashan, et al.
Pubblicazione: (2025)
di: Wang, Yashan, et al.
Pubblicazione: (2025)
Exploring Musical Roots: Applying Audio Embeddings to Empower Influence Attribution for a Generative Music Model
di: Barnett, Julia, et al.
Pubblicazione: (2024)
di: Barnett, Julia, et al.
Pubblicazione: (2024)
Instruct-MusicGen: Unlocking Text-to-Music Editing for Music Language Models via Instruction Tuning
di: Zhang, Yixiao, et al.
Pubblicazione: (2024)
di: Zhang, Yixiao, et al.
Pubblicazione: (2024)
Exploring State-Space-Model based Language Model in Music Generation
di: Lee, Wei-Jaw, et al.
Pubblicazione: (2025)
di: Lee, Wei-Jaw, et al.
Pubblicazione: (2025)
MMT-BERT: Chord-aware Symbolic Music Generation Based on Multitrack Music Transformer and MusicBERT
di: Zhu, Jinlong, et al.
Pubblicazione: (2024)
di: Zhu, Jinlong, et al.
Pubblicazione: (2024)
Melody-Guided Music Generation
di: Wei, Shaopeng, et al.
Pubblicazione: (2024)
di: Wei, Shaopeng, et al.
Pubblicazione: (2024)
Composer Style-specific Symbolic Music Generation Using Vector Quantized Discrete Diffusion Models
di: Zhang, Jincheng, et al.
Pubblicazione: (2023)
di: Zhang, Jincheng, et al.
Pubblicazione: (2023)
XMusic: Towards a Generalized and Controllable Symbolic Music Generation Framework
di: Tian, Sida, et al.
Pubblicazione: (2025)
di: Tian, Sida, et al.
Pubblicazione: (2025)
Music Consistency Models
di: Fei, Zhengcong, et al.
Pubblicazione: (2024)
di: Fei, Zhengcong, et al.
Pubblicazione: (2024)
The Music Maestro or The Musically Challenged, A Massive Music Evaluation Benchmark for Large Language Models
di: Li, Jiajia, et al.
Pubblicazione: (2024)
di: Li, Jiajia, et al.
Pubblicazione: (2024)
YNote: A Novel Music Notation for Fine-Tuning LLMs in Music Generation
di: Lu, Shao-Chien, et al.
Pubblicazione: (2025)
di: Lu, Shao-Chien, et al.
Pubblicazione: (2025)
Segment Transformer: AI-Generated Music Detection via Music Structural Analysis
di: Kim, Yumin, et al.
Pubblicazione: (2025)
di: Kim, Yumin, et al.
Pubblicazione: (2025)
Domain Adaptation Method and Modality Gap Impact in Audio-Text Models for Prototypical Sound Classification
di: Acevedo, Emiliano, et al.
Pubblicazione: (2025)
di: Acevedo, Emiliano, et al.
Pubblicazione: (2025)
Ambisonizer: Neural Upmixing as Spherical Harmonics Generation
di: Zang, Yongyi, et al.
Pubblicazione: (2024)
di: Zang, Yongyi, et al.
Pubblicazione: (2024)
Zero-Effort Image-to-Music Generation: An Interpretable RAG-based VLM Approach
di: Zhao, Zijian, et al.
Pubblicazione: (2025)
di: Zhao, Zijian, et al.
Pubblicazione: (2025)
Expressive Music Data Processing and Generation
di: Liu, Jingwei
Pubblicazione: (2025)
di: Liu, Jingwei
Pubblicazione: (2025)
YuE: Scaling Open Foundation Models for Long-Form Music Generation
di: Yuan, Ruibin, et al.
Pubblicazione: (2025)
di: Yuan, Ruibin, et al.
Pubblicazione: (2025)
WhisQ: Cross-Modal Representation Learning for Text-to-Music MOS Prediction
di: Emon, Jakaria Islam, et al.
Pubblicazione: (2025)
di: Emon, Jakaria Islam, et al.
Pubblicazione: (2025)
Generating High-quality Symbolic Music Using Fine-grained Discriminators
di: Zhang, Zhedong, et al.
Pubblicazione: (2024)
di: Zhang, Zhedong, et al.
Pubblicazione: (2024)
Practical and Reproducible Symbolic Music Generation by Large Language Models with Structural Embeddings
di: Rhyu, Seungyeon, et al.
Pubblicazione: (2024)
di: Rhyu, Seungyeon, et al.
Pubblicazione: (2024)
Diff-V2M: A Hierarchical Conditional Diffusion Model with Explicit Rhythmic Modeling for Video-to-Music Generation
di: Ji, Shulei, et al.
Pubblicazione: (2025)
di: Ji, Shulei, et al.
Pubblicazione: (2025)
Structure-informed Positional Encoding for Music Generation
di: Agarwal, Manvi, et al.
Pubblicazione: (2024)
di: Agarwal, Manvi, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Improving Controllability and Editability for Pretrained Text-to-Music Generation Models
di: Zhang, Yixiao
Pubblicazione: (2024) -
Content-based Controls For Music Large Language Modeling
di: Lin, Liwei, et al.
Pubblicazione: (2023) -
Summary of The Inaugural Music Source Restoration Challenge
di: Zang, Yongyi, et al.
Pubblicazione: (2026) -
Music Source Restoration
di: Zang, Yongyi, et al.
Pubblicazione: (2025) -
SingFake: Singing Voice Deepfake Detection
di: Zang, Yongyi, et al.
Pubblicazione: (2023)