Salvato in:
| Autori principali: | Batra, Arnesh, Sharma, Dev, Thukral, Krish, Bhatia, Ruhani, Batra, Naman, Gautam, Aditya |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | https://arxiv.org/abs/2512.00621 |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Missing Melodies: AI Music Generation and its "Nearly" Complete Omission of the Global South
di: Mehta, Atharva, et al.
Pubblicazione: (2024)
di: Mehta, Atharva, et al.
Pubblicazione: (2024)
MelodySim: Measuring Melody-aware Music Similarity for Plagiarism Detection
di: Lu, Tongyu, et al.
Pubblicazione: (2025)
di: Lu, Tongyu, et al.
Pubblicazione: (2025)
Exploring Machine Learning and Language Models for Multimodal Depression Detection
di: Hong, Javier Si Zhao, et al.
Pubblicazione: (2025)
di: Hong, Javier Si Zhao, et al.
Pubblicazione: (2025)
Melody-Guided Music Generation
di: Wei, Shaopeng, et al.
Pubblicazione: (2024)
di: Wei, Shaopeng, et al.
Pubblicazione: (2024)
SongComposer: A Large Language Model for Lyric and Melody Generation in Song Composition
di: Ding, Shuangrui, et al.
Pubblicazione: (2024)
di: Ding, Shuangrui, et al.
Pubblicazione: (2024)
MusicAIR: A Multimodal AI Music Generation Framework Powered by an Algorithm-Driven Core
di: Liao, Callie C., et al.
Pubblicazione: (2025)
di: Liao, Callie C., et al.
Pubblicazione: (2025)
Story2MIDI: Emotionally Aligned Music Generation from Text
di: Shokri, Mohammad, et al.
Pubblicazione: (2025)
di: Shokri, Mohammad, et al.
Pubblicazione: (2025)
EDMFormer: Genre-Specific Self-Supervised Learning for Music Structure Segmentation
di: Sajeer, Sahal, et al.
Pubblicazione: (2026)
di: Sajeer, Sahal, et al.
Pubblicazione: (2026)
Generative Artificial Intelligence, Musical Heritage and the Construction of Peace Narratives: A Case Study in Mali
di: Coulibaly, Nouhoum, et al.
Pubblicazione: (2026)
di: Coulibaly, Nouhoum, et al.
Pubblicazione: (2026)
Cross-Modal Learning for Music-to-Music-Video Description Generation
di: Mao, Zhuoyuan, et al.
Pubblicazione: (2025)
di: Mao, Zhuoyuan, et al.
Pubblicazione: (2025)
Linear Complexity Self-Supervised Learning for Music Understanding with Random Quantizer
di: Vavaroutsos, Petros, et al.
Pubblicazione: (2026)
di: Vavaroutsos, Petros, et al.
Pubblicazione: (2026)
MindMelody: A Closed-Loop EEG-Driven System for Personalized Music Intervention
di: Zhang, Yimeng, et al.
Pubblicazione: (2026)
di: Zhang, Yimeng, et al.
Pubblicazione: (2026)
Music for All: Representational Bias and Cross-Cultural Adaptability of Music Generation Models
di: Mehta, Atharva, et al.
Pubblicazione: (2025)
di: Mehta, Atharva, et al.
Pubblicazione: (2025)
YingMusic-Singer: Zero-shot Singing Voice Synthesis and Editing with Annotation-free Melody Guidance
di: Zheng, Junjie, et al.
Pubblicazione: (2025)
di: Zheng, Junjie, et al.
Pubblicazione: (2025)
StreamSpeech: Simultaneous Speech-to-Speech Translation with Multi-task Learning
di: Zhang, Shaolei, et al.
Pubblicazione: (2024)
di: Zhang, Shaolei, et al.
Pubblicazione: (2024)
Streaming Speaker Change Detection and Gender Classification for Transducer-Based Multi-Talker Speech Translation
di: Wang, Peidong, et al.
Pubblicazione: (2025)
di: Wang, Peidong, et al.
Pubblicazione: (2025)
FLM-Audio: Natural Monologues Improves Native Full-Duplex Chatbots via Dual Training
di: Yao, Yiqun, et al.
Pubblicazione: (2025)
di: Yao, Yiqun, et al.
Pubblicazione: (2025)
Musical ethnocentrism in Large Language Models
di: Kruspe, Anna
Pubblicazione: (2025)
di: Kruspe, Anna
Pubblicazione: (2025)
InspireMusic: Integrating Super Resolution and Large Language Model for High-Fidelity Long-Form Music Generation
di: Zhang, Chong, et al.
Pubblicazione: (2025)
di: Zhang, Chong, et al.
Pubblicazione: (2025)
Augment, Drop & Swap: Improving Diversity in LLM Captions for Efficient Music-Text Representation Learning
di: Manco, Ilaria, et al.
Pubblicazione: (2024)
di: Manco, Ilaria, et al.
Pubblicazione: (2024)
Synthetic Audio Helps for Cognitive State Tasks
di: Soubki, Adil, et al.
Pubblicazione: (2025)
di: Soubki, Adil, et al.
Pubblicazione: (2025)
StreamAtt: Direct Streaming Speech-to-Text Translation with Attention-based Audio History Selection
di: Papi, Sara, et al.
Pubblicazione: (2024)
di: Papi, Sara, et al.
Pubblicazione: (2024)
Audio Contrastive-based Fine-tuning: Decoupling Representation Learning and Classification
di: Wang, Yang, et al.
Pubblicazione: (2023)
di: Wang, Yang, et al.
Pubblicazione: (2023)
Sing it, Narrate it: Quality Musical Lyrics Translation
di: Ye, Zhuorui, et al.
Pubblicazione: (2024)
di: Ye, Zhuorui, et al.
Pubblicazione: (2024)
AI-Generated Song Detection via Lyrics Transcripts
di: Frohmann, Markus, et al.
Pubblicazione: (2025)
di: Frohmann, Markus, et al.
Pubblicazione: (2025)
Efficient Streaming LLM for Speech Recognition
di: Jia, Junteng, et al.
Pubblicazione: (2024)
di: Jia, Junteng, et al.
Pubblicazione: (2024)
Nwāchā Munā: A Devanagari Speech Corpus and Proximal Transfer Benchmark for Nepal Bhasha ASR
di: Sharma, Rishikesh Kumar, et al.
Pubblicazione: (2026)
di: Sharma, Rishikesh Kumar, et al.
Pubblicazione: (2026)
Do Music Generation Models Encode Music Theory?
di: Wei, Megan, et al.
Pubblicazione: (2024)
di: Wei, Megan, et al.
Pubblicazione: (2024)
WavSLM: Single-Stream Speech Language Modeling via WavLM Distillation
di: Della Libera, Luca, et al.
Pubblicazione: (2026)
di: Della Libera, Luca, et al.
Pubblicazione: (2026)
Bob's Confetti: Phonetic Memorization Attacks in Music and Video Generation
di: Roh, Jaechul, et al.
Pubblicazione: (2025)
di: Roh, Jaechul, et al.
Pubblicazione: (2025)
Text2midi: Generating Symbolic Music from Captions
di: Bhandari, Keshav, et al.
Pubblicazione: (2024)
di: Bhandari, Keshav, et al.
Pubblicazione: (2024)
Bona fide Cross Testing Reveals Weak Spot in Audio Deepfake Detection Systems
di: Kwok, Chin Yuen, et al.
Pubblicazione: (2025)
di: Kwok, Chin Yuen, et al.
Pubblicazione: (2025)
Do Compact SSL Backbones Matter for Audio Deepfake Detection? A Controlled Study with RAPTOR
di: Kulkarni, Ajinkya, et al.
Pubblicazione: (2026)
di: Kulkarni, Ajinkya, et al.
Pubblicazione: (2026)
MusiLingo: Bridging Music and Text with Pre-trained Language Models for Music Captioning and Query Response
di: Deng, Zihao, et al.
Pubblicazione: (2023)
di: Deng, Zihao, et al.
Pubblicazione: (2023)
DeepResonance: Enhancing Multimodal Music Understanding via Music-centric Multi-way Instruction Tuning
di: Mao, Zhuoyuan, et al.
Pubblicazione: (2025)
di: Mao, Zhuoyuan, et al.
Pubblicazione: (2025)
WhiSPA: Semantically and Psychologically Aligned Whisper with Self-Supervised Contrastive and Student-Teacher Learning
di: Rao, Rajath, et al.
Pubblicazione: (2025)
di: Rao, Rajath, et al.
Pubblicazione: (2025)
Exploring Self-Supervised Multi-view Contrastive Learning for Speech Emotion Recognition with Limited Annotations
di: Khaertdinov, Bulat, et al.
Pubblicazione: (2024)
di: Khaertdinov, Bulat, et al.
Pubblicazione: (2024)
Controlling Surprisal in Music Generation via Information Content Curve Matching
di: Bjare, Mathias Rose, et al.
Pubblicazione: (2024)
di: Bjare, Mathias Rose, et al.
Pubblicazione: (2024)
Aligning Language Models for Lyric-to-Melody Generation with Rule-Based Musical Constraints
di: Meng, Hao, et al.
Pubblicazione: (2026)
di: Meng, Hao, et al.
Pubblicazione: (2026)
PARCO: Phoneme-Augmented Robust Contextual ASR via Contrastive Entity Disambiguation
di: He, Jiajun, et al.
Pubblicazione: (2025)
di: He, Jiajun, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Missing Melodies: AI Music Generation and its "Nearly" Complete Omission of the Global South
di: Mehta, Atharva, et al.
Pubblicazione: (2024) -
MelodySim: Measuring Melody-aware Music Similarity for Plagiarism Detection
di: Lu, Tongyu, et al.
Pubblicazione: (2025) -
Exploring Machine Learning and Language Models for Multimodal Depression Detection
di: Hong, Javier Si Zhao, et al.
Pubblicazione: (2025) -
Melody-Guided Music Generation
di: Wei, Shaopeng, et al.
Pubblicazione: (2024) -
SongComposer: A Large Language Model for Lyric and Melody Generation in Song Composition
di: Ding, Shuangrui, et al.
Pubblicazione: (2024)