Exploring Adapter Design Tradeoffs for Low Resource Music Generation
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Mehta, Atharva, Chauhan, Shivam, Choudhury, Monojit |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Missing Melodies: AI Music Generation and its "Nearly" Complete Omission of the Global South
par: Mehta, Atharva, et autres
Publié: (2024)
par: Mehta, Atharva, et autres
Publié: (2024)
Music for All: Representational Bias and Cross-Cultural Adaptability of Music Generation Models
par: Mehta, Atharva, et autres
Publié: (2025)
par: Mehta, Atharva, et autres
Publié: (2025)
Who Gets Heard? Rethinking Fairness in AI for Music Systems
par: Mehta, Atharva, et autres
Publié: (2025)
par: Mehta, Atharva, et autres
Publié: (2025)
ChatMusician: Understanding and Generating Music Intrinsically with LLM
par: Yuan, Ruibin, et autres
Publié: (2024)
par: Yuan, Ruibin, et autres
Publié: (2024)
ComposerX: Multi-Agent Symbolic Music Composition with LLMs
par: Deng, Qixin, et autres
Publié: (2024)
par: Deng, Qixin, et autres
Publié: (2024)
Cross-Modal Learning for Music-to-Music-Video Description Generation
par: Mao, Zhuoyuan, et autres
Publié: (2025)
par: Mao, Zhuoyuan, et autres
Publié: (2025)
Generative AI for Music and Audio
par: Dong, Hao-Wen
Publié: (2024)
par: Dong, Hao-Wen
Publié: (2024)
Exploring Acoustic Similarity in Emotional Speech and Music via Self-Supervised Representations
par: Sun, Yujia, et autres
Publié: (2024)
par: Sun, Yujia, et autres
Publié: (2024)
HARP: A Large-Scale Higher-Order Ambisonic Room Impulse Response Dataset
par: Saini, Shivam, et autres
Publié: (2024)
par: Saini, Shivam, et autres
Publié: (2024)
Segment-Factorized Full-Song Generation on Symbolic Piano Music
par: Chen, Ping-Yi, et autres
Publié: (2025)
par: Chen, Ping-Yi, et autres
Publié: (2025)
Instruct-MusicGen: Unlocking Text-to-Music Editing for Music Language Models via Instruction Tuning
par: Zhang, Yixiao, et autres
Publié: (2024)
par: Zhang, Yixiao, et autres
Publié: (2024)
The Name-Free Gap: Policy-Aware Stylistic Control in Music Generation
par: Nagarajan, Ashwin, et autres
Publié: (2025)
par: Nagarajan, Ashwin, et autres
Publié: (2025)
LatentSpeech: Latent Diffusion for Text-To-Speech Generation
par: Lou, Haowei, et autres
Publié: (2024)
par: Lou, Haowei, et autres
Publié: (2024)
Efficient Fine-Grained Guidance for Diffusion Model Based Symbolic Music Generation
par: Zhu, Tingyu, et autres
Publié: (2024)
par: Zhu, Tingyu, et autres
Publié: (2024)
JEN-1: Text-Guided Universal Music Generation with Omnidirectional Diffusion Models
par: Li, Peike, et autres
Publié: (2023)
par: Li, Peike, et autres
Publié: (2023)
MusiLingo: Bridging Music and Text with Pre-trained Language Models for Music Captioning and Query Response
par: Deng, Zihao, et autres
Publié: (2023)
par: Deng, Zihao, et autres
Publié: (2023)
DeepResonance: Enhancing Multimodal Music Understanding via Music-centric Multi-way Instruction Tuning
par: Mao, Zhuoyuan, et autres
Publié: (2025)
par: Mao, Zhuoyuan, et autres
Publié: (2025)
PDMX: A Large-Scale Public Domain MusicXML Dataset for Symbolic Music Processing
par: Long, Phillip, et autres
Publié: (2024)
par: Long, Phillip, et autres
Publié: (2024)
MuChoMusic: Evaluating Music Understanding in Multimodal Audio-Language Models
par: Weck, Benno, et autres
Publié: (2024)
par: Weck, Benno, et autres
Publié: (2024)
OpenMU: Your Swiss Army Knife for Music Understanding
par: Zhao, Mengjie, et autres
Publié: (2024)
par: Zhao, Mengjie, et autres
Publié: (2024)
LM2D: Lyrics- and Music-Driven Dance Synthesis
par: Yin, Wenjie, et autres
Publié: (2024)
par: Yin, Wenjie, et autres
Publié: (2024)
Automatic Music Transcription using Convolutional Neural Networks and Constant-Q transform
par: Telila, Yohannis, et autres
Publié: (2025)
par: Telila, Yohannis, et autres
Publié: (2025)
CMI-RewardBench: Evaluating Music Reward Models with Compositional Multimodal Instruction
par: Ma, Yinghao, et autres
Publié: (2026)
par: Ma, Yinghao, et autres
Publié: (2026)
Kimi-Audio Technical Report
par: KimiTeam, et autres
Publié: (2025)
par: KimiTeam, et autres
Publié: (2025)
Towards Controllable Speech Synthesis in the Era of Large Language Models: A Systematic Survey
par: Xie, Tianxin, et autres
Publié: (2024)
par: Xie, Tianxin, et autres
Publié: (2024)
Audio-Reasoner: Improving Reasoning Capability in Large Audio Language Models
par: Xie, Zhifei, et autres
Publié: (2025)
par: Xie, Zhifei, et autres
Publié: (2025)
Exploring Classical Piano Performance Generation with Expressive Music Variational AutoEncoder
par: Luo, Jing, et autres
Publié: (2025)
par: Luo, Jing, et autres
Publié: (2025)
Music Enhancement with Deep Filters: A Technical Report for The ICASSP 2024 Cadenza Challenge
par: Shao, Keren, et autres
Publié: (2024)
par: Shao, Keren, et autres
Publié: (2024)
MR-MT3: Memory Retaining Multi-Track Music Transcription to Mitigate Instrument Leakage
par: Tan, Hao Hao, et autres
Publié: (2024)
par: Tan, Hao Hao, et autres
Publié: (2024)
MusRec: Zero-Shot Text-to-Music Editing via Rectified Flow and Diffusion Transformers
par: Boudaghi, Ali, et autres
Publié: (2025)
par: Boudaghi, Ali, et autres
Publié: (2025)
Frechet Music Distance: A Metric For Generative Symbolic Music Evaluation
par: Retkowski, Jan, et autres
Publié: (2024)
par: Retkowski, Jan, et autres
Publié: (2024)
MusER: Musical Element-Based Regularization for Generating Symbolic Music with Emotion
par: Ji, Shulei, et autres
Publié: (2023)
par: Ji, Shulei, et autres
Publié: (2023)
Towards Assessing Data Replication in Music Generation with Music Similarity Metrics on Raw Audio
par: Batlle-Roca, Roser, et autres
Publié: (2024)
par: Batlle-Roca, Roser, et autres
Publié: (2024)
Can LLMs "Reason" in Music? An Evaluation of LLMs' Capability of Music Understanding and Generation
par: Zhou, Ziya, et autres
Publié: (2024)
par: Zhou, Ziya, et autres
Publié: (2024)
LaunchpadGPT: Language Model as Music Visualization Designer on Launchpad
par: Xu, Siting, et autres
Publié: (2023)
par: Xu, Siting, et autres
Publié: (2023)
GVMGen: A General Video-to-Music Generation Model with Hierarchical Attentions
par: Zuo, Heda, et autres
Publié: (2025)
par: Zuo, Heda, et autres
Publié: (2025)
FastSAG: Towards Fast Non-Autoregressive Singing Accompaniment Generation
par: Chen, Jianyi, et autres
Publié: (2024)
par: Chen, Jianyi, et autres
Publié: (2024)
Controllable Video-to-Music Generation with Multiple Time-Varying Conditions
par: Wu, Junxian, et autres
Publié: (2025)
par: Wu, Junxian, et autres
Publié: (2025)
Whispering LLaMA: A Cross-Modal Generative Error Correction Framework for Speech Recognition
par: Radhakrishnan, Srijith, et autres
Publié: (2023)
par: Radhakrishnan, Srijith, et autres
Publié: (2023)
Fast Text-to-Audio Generation with Adversarial Post-Training
par: Novack, Zachary, et autres
Publié: (2025)
par: Novack, Zachary, et autres
Publié: (2025)
Documents similaires
-
Missing Melodies: AI Music Generation and its "Nearly" Complete Omission of the Global South
par: Mehta, Atharva, et autres
Publié: (2024) -
Music for All: Representational Bias and Cross-Cultural Adaptability of Music Generation Models
par: Mehta, Atharva, et autres
Publié: (2025) -
Who Gets Heard? Rethinking Fairness in AI for Music Systems
par: Mehta, Atharva, et autres
Publié: (2025) -
ChatMusician: Understanding and Generating Music Intrinsically with LLM
par: Yuan, Ruibin, et autres
Publié: (2024) -
ComposerX: Multi-Agent Symbolic Music Composition with LLMs
par: Deng, Qixin, et autres
Publié: (2024)