Music for All: Representational Bias and Cross-Cultural Adaptability of Music Generation Models
Fuente:
arXiv
Salvato in:
| Autori principali: | Mehta, Atharva, Chauhan, Shivam, Djanibekov, Amirbek, Kulkarni, Atharva, Xia, Gus, Choudhury, Monojit |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Exploring Adapter Design Tradeoffs for Low Resource Music Generation
di: Mehta, Atharva, et al.
Pubblicazione: (2025)
di: Mehta, Atharva, et al.
Pubblicazione: (2025)
Missing Melodies: AI Music Generation and its "Nearly" Complete Omission of the Global South
di: Mehta, Atharva, et al.
Pubblicazione: (2024)
di: Mehta, Atharva, et al.
Pubblicazione: (2024)
Who Gets Heard? Rethinking Fairness in AI for Music Systems
di: Mehta, Atharva, et al.
Pubblicazione: (2025)
di: Mehta, Atharva, et al.
Pubblicazione: (2025)
MusicAIR: A Multimodal AI Music Generation Framework Powered by an Algorithm-Driven Core
di: Liao, Callie C., et al.
Pubblicazione: (2025)
di: Liao, Callie C., et al.
Pubblicazione: (2025)
Cross-Modal Learning for Music-to-Music-Video Description Generation
di: Mao, Zhuoyuan, et al.
Pubblicazione: (2025)
di: Mao, Zhuoyuan, et al.
Pubblicazione: (2025)
Cross-Cultural Bias in Mel-Scale Representations: Evidence and Alternatives from Speech and Music
di: Chauhan, Shivam, et al.
Pubblicazione: (2026)
di: Chauhan, Shivam, et al.
Pubblicazione: (2026)
MusicMagus: Zero-Shot Text-to-Music Editing via Diffusion Models
di: Zhang, Yixiao, et al.
Pubblicazione: (2024)
di: Zhang, Yixiao, et al.
Pubblicazione: (2024)
EXPOTION: Facial Expression and Motion Control for Multimodal Music Generation
di: Izzati, Fathinah, et al.
Pubblicazione: (2025)
di: Izzati, Fathinah, et al.
Pubblicazione: (2025)
Music Arena: Live Evaluation for Text-to-Music
di: Kim, Yonghyun, et al.
Pubblicazione: (2025)
di: Kim, Yonghyun, et al.
Pubblicazione: (2025)
MusicSwarm: Biologically Inspired Intelligence for Music Composition
di: Buehler, Markus J.
Pubblicazione: (2025)
di: Buehler, Markus J.
Pubblicazione: (2025)
Instruct-MusicGen: Unlocking Text-to-Music Editing for Music Language Models via Instruction Tuning
di: Zhang, Yixiao, et al.
Pubblicazione: (2024)
di: Zhang, Yixiao, et al.
Pubblicazione: (2024)
A Survey on Music Generation from Single-Modal, Cross-Modal, and Multi-Modal Perspectives
di: Li, Shuyu, et al.
Pubblicazione: (2025)
di: Li, Shuyu, et al.
Pubblicazione: (2025)
Let the Model Learn to Feel: Mode-Guided Tonality Injection for Symbolic Music Emotion Recognition
di: Xia, Haiying, et al.
Pubblicazione: (2025)
di: Xia, Haiying, et al.
Pubblicazione: (2025)
Amadeus: Autoregressive Model with Bidirectional Attribute Modelling for Symbolic Music
di: Su, Hongju, et al.
Pubblicazione: (2025)
di: Su, Hongju, et al.
Pubblicazione: (2025)
MusiLingo: Bridging Music and Text with Pre-trained Language Models for Music Captioning and Query Response
di: Deng, Zihao, et al.
Pubblicazione: (2023)
di: Deng, Zihao, et al.
Pubblicazione: (2023)
Exploring Acoustic Similarity in Emotional Speech and Music via Self-Supervised Representations
di: Sun, Yujia, et al.
Pubblicazione: (2024)
di: Sun, Yujia, et al.
Pubblicazione: (2024)
ChatMusician: Understanding and Generating Music Intrinsically with LLM
di: Yuan, Ruibin, et al.
Pubblicazione: (2024)
di: Yuan, Ruibin, et al.
Pubblicazione: (2024)
Live Music Diffusion Models: Efficient Fine-Tuning and Post-Training of Interactive Diffusion Music Generators
di: Novack, Zachary, et al.
Pubblicazione: (2026)
di: Novack, Zachary, et al.
Pubblicazione: (2026)
DeepResonance: Enhancing Multimodal Music Understanding via Music-centric Multi-way Instruction Tuning
di: Mao, Zhuoyuan, et al.
Pubblicazione: (2025)
di: Mao, Zhuoyuan, et al.
Pubblicazione: (2025)
MotionBeat: Motion-Aligned Music Representation via Embodied Contrastive Learning and Bar-Equivariant Contact-Aware Encoding
di: Wang, Xuanchen, et al.
Pubblicazione: (2025)
di: Wang, Xuanchen, et al.
Pubblicazione: (2025)
Frechet Music Distance: A Metric For Generative Symbolic Music Evaluation
di: Retkowski, Jan, et al.
Pubblicazione: (2024)
di: Retkowski, Jan, et al.
Pubblicazione: (2024)
MusER: Musical Element-Based Regularization for Generating Symbolic Music with Emotion
di: Ji, Shulei, et al.
Pubblicazione: (2023)
di: Ji, Shulei, et al.
Pubblicazione: (2023)
YuE: Scaling Open Foundation Models for Long-Form Music Generation
di: Yuan, Ruibin, et al.
Pubblicazione: (2025)
di: Yuan, Ruibin, et al.
Pubblicazione: (2025)
OpenMU: Your Swiss Army Knife for Music Understanding
di: Zhao, Mengjie, et al.
Pubblicazione: (2024)
di: Zhao, Mengjie, et al.
Pubblicazione: (2024)
Towards Assessing Data Replication in Music Generation with Music Similarity Metrics on Raw Audio
di: Batlle-Roca, Roser, et al.
Pubblicazione: (2024)
di: Batlle-Roca, Roser, et al.
Pubblicazione: (2024)
Memo2496: Expert-Annotated Dataset and Dual-View Adaptive Framework for Music Emotion Recognition
di: Li, Qilin, et al.
Pubblicazione: (2025)
di: Li, Qilin, et al.
Pubblicazione: (2025)
GVMGen: A General Video-to-Music Generation Model with Hierarchical Attentions
di: Zuo, Heda, et al.
Pubblicazione: (2025)
di: Zuo, Heda, et al.
Pubblicazione: (2025)
MIDI-LLM: Adapting Large Language Models for Text-to-MIDI Music Generation
di: Wu, Shih-Lun, et al.
Pubblicazione: (2025)
di: Wu, Shih-Lun, et al.
Pubblicazione: (2025)
A Survey of Foundation Models for Music Understanding
di: Li, Wenjun, et al.
Pubblicazione: (2024)
di: Li, Wenjun, et al.
Pubblicazione: (2024)
Structured Multi-Track Accompaniment Arrangement via Style Prior Modelling
di: Zhao, Jingwei, et al.
Pubblicazione: (2023)
di: Zhao, Jingwei, et al.
Pubblicazione: (2023)
MMVA: Multimodal Matching Based on Valence and Arousal across Images, Music, and Musical Captions
di: Choi, Suhwan, et al.
Pubblicazione: (2025)
di: Choi, Suhwan, et al.
Pubblicazione: (2025)
ComposerX: Multi-Agent Symbolic Music Composition with LLMs
di: Deng, Qixin, et al.
Pubblicazione: (2024)
di: Deng, Qixin, et al.
Pubblicazione: (2024)
Analyzable Chain-of-Musical-Thought Prompting for High-Fidelity Music Generation
di: Lam, Max W. Y., et al.
Pubblicazione: (2025)
di: Lam, Max W. Y., et al.
Pubblicazione: (2025)
Controllable Video-to-Music Generation with Multiple Time-Varying Conditions
di: Wu, Junxian, et al.
Pubblicazione: (2025)
di: Wu, Junxian, et al.
Pubblicazione: (2025)
Rubato: Transcribing Piano Music with Timestamps
di: Tamer, Nazif Can, et al.
Pubblicazione: (2026)
di: Tamer, Nazif Can, et al.
Pubblicazione: (2026)
Generative AI for Music and Audio
di: Dong, Hao-Wen
Pubblicazione: (2024)
di: Dong, Hao-Wen
Pubblicazione: (2024)
Zero-Effort Image-to-Music Generation: An Interpretable RAG-based VLM Approach
di: Zhao, Zijian, et al.
Pubblicazione: (2025)
di: Zhao, Zijian, et al.
Pubblicazione: (2025)
Exploring Classical Piano Performance Generation with Expressive Music Variational AutoEncoder
di: Luo, Jing, et al.
Pubblicazione: (2025)
di: Luo, Jing, et al.
Pubblicazione: (2025)
Addressing Emotion Bias in Music Emotion Recognition and Generation with Frechet Audio Distance
di: Li, Yuanchao, et al.
Pubblicazione: (2024)
di: Li, Yuanchao, et al.
Pubblicazione: (2024)
Audio ControlNet for Fine-Grained Audio Generation and Editing
di: Zhu, Haina, et al.
Pubblicazione: (2026)
di: Zhu, Haina, et al.
Pubblicazione: (2026)
Documenti analoghi
-
Exploring Adapter Design Tradeoffs for Low Resource Music Generation
di: Mehta, Atharva, et al.
Pubblicazione: (2025) -
Missing Melodies: AI Music Generation and its "Nearly" Complete Omission of the Global South
di: Mehta, Atharva, et al.
Pubblicazione: (2024) -
Who Gets Heard? Rethinking Fairness in AI for Music Systems
di: Mehta, Atharva, et al.
Pubblicazione: (2025) -
MusicAIR: A Multimodal AI Music Generation Framework Powered by an Algorithm-Driven Core
di: Liao, Callie C., et al.
Pubblicazione: (2025) -
Cross-Modal Learning for Music-to-Music-Video Description Generation
di: Mao, Zhuoyuan, et al.
Pubblicazione: (2025)