CLaMP 3: Universal Music Information Retrieval Across Unaligned Modalities and Unseen Languages
Fuente:
arXiv
Salvato in:
| Autori principali: | Wu, Shangda, Guo, Zhancheng, Yuan, Ruibin, Jiang, Junyan, Doh, Seungheon, Xia, Gus, Nam, Juhan, Li, Xiaobing, Yu, Feng, Sun, Maosong |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
CLaMP 2: Multimodal Music Information Retrieval Across 101 Languages Using Large Language Models
di: Wu, Shangda, et al.
Pubblicazione: (2024)
di: Wu, Shangda, et al.
Pubblicazione: (2024)
TALKPLAY: Multimodal Music Recommendation with Large Language Models
di: Doh, Seungheon, et al.
Pubblicazione: (2025)
di: Doh, Seungheon, et al.
Pubblicazione: (2025)
TalkPlay-Tools: Conversational Music Recommendation with LLM Tool Calling
di: Doh, Seungheon, et al.
Pubblicazione: (2025)
di: Doh, Seungheon, et al.
Pubblicazione: (2025)
TalkPlayData 2: An Agentic Synthetic Data Pipeline for Multimodal Conversational Music Recommendation
di: Choi, Keunwoo, et al.
Pubblicazione: (2025)
di: Choi, Keunwoo, et al.
Pubblicazione: (2025)
Musical Word Embedding for Music Tagging and Retrieval
di: Doh, SeungHeon, et al.
Pubblicazione: (2024)
di: Doh, SeungHeon, et al.
Pubblicazione: (2024)
MelodyT5: A Unified Score-to-Score Transformer for Symbolic Music Processing
di: Wu, Shangda, et al.
Pubblicazione: (2024)
di: Wu, Shangda, et al.
Pubblicazione: (2024)
Enriching Music Descriptions with a Finetuned-LLM and Metadata for Text-to-Music Retrieval
di: Doh, SeungHeon, et al.
Pubblicazione: (2024)
di: Doh, SeungHeon, et al.
Pubblicazione: (2024)
Predicting User Intents and Musical Attributes from Music Discovery Conversations
di: Kwon, Daeyong, et al.
Pubblicazione: (2024)
di: Kwon, Daeyong, et al.
Pubblicazione: (2024)
Can Large Language Models Predict Audio Effects Parameters from Natural Language?
di: Doh, Seungheon, et al.
Pubblicazione: (2025)
di: Doh, Seungheon, et al.
Pubblicazione: (2025)
Exploring Tokenization Methods for Multitrack Sheet Music Generation
di: Wang, Yashan, et al.
Pubblicazione: (2024)
di: Wang, Yashan, et al.
Pubblicazione: (2024)
Content-based Controls For Music Large Language Modeling
di: Lin, Liwei, et al.
Pubblicazione: (2023)
di: Lin, Liwei, et al.
Pubblicazione: (2023)
Music Discovery Dialogue Generation Using Human Intent Analysis and Large Language Models
di: Doh, SeungHeon, et al.
Pubblicazione: (2024)
di: Doh, SeungHeon, et al.
Pubblicazione: (2024)
Voices of Civilizations: A Multilingual QA Benchmark for Global Music Understanding
di: Wu, Shangda, et al.
Pubblicazione: (2026)
di: Wu, Shangda, et al.
Pubblicazione: (2026)
Arrange, Inpaint, and Refine: Steerable Long-term Music Audio Generation and Editing via Content-based Controls
di: Lin, Liwei, et al.
Pubblicazione: (2024)
di: Lin, Liwei, et al.
Pubblicazione: (2024)
PIAST: A Multimodal Piano Dataset with Audio, Symbolic and Text
di: Bang, Hayeon, et al.
Pubblicazione: (2024)
di: Bang, Hayeon, et al.
Pubblicazione: (2024)
NotaGen: Advancing Musicality in Symbolic Music Generation with Large Language Model Training Paradigms
di: Wang, Yashan, et al.
Pubblicazione: (2025)
di: Wang, Yashan, et al.
Pubblicazione: (2025)
FlashSR: One-step Versatile Audio Super-resolution via Diffusion Distillation
di: Im, Jaekwon, et al.
Pubblicazione: (2025)
di: Im, Jaekwon, et al.
Pubblicazione: (2025)
DIFFRENT: A Diffusion Model for Recording Environment Transfer of Speech
di: Im, Jaekwon, et al.
Pubblicazione: (2024)
di: Im, Jaekwon, et al.
Pubblicazione: (2024)
Language Model Mapping in Multimodal Music Learning: A Grand Challenge Proposal
di: Chin, Daniel, et al.
Pubblicazione: (2025)
di: Chin, Daniel, et al.
Pubblicazione: (2025)
Dialogue in Resonance: An Interactive Music Piece for Piano and Real-Time Automatic Transcription System
di: Bang, Hayeon, et al.
Pubblicazione: (2025)
di: Bang, Hayeon, et al.
Pubblicazione: (2025)
TOMI: Transforming and Organizing Music Ideas for Multi-Track Compositions with Full-Song Structure
di: He, Qi, et al.
Pubblicazione: (2025)
di: He, Qi, et al.
Pubblicazione: (2025)
Exploring GPT's Ability as a Judge in Music Understanding
di: Fang, Kun, et al.
Pubblicazione: (2025)
di: Fang, Kun, et al.
Pubblicazione: (2025)
CLaM-TTS: Improving Neural Codec Language Model for Zero-Shot Text-to-Speech
di: Kim, Jaehyeon, et al.
Pubblicazione: (2024)
di: Kim, Jaehyeon, et al.
Pubblicazione: (2024)
AImoclips: A Benchmark for Evaluating Emotion Conveyance in Text-to-Music Generation
di: Go, Gyehun, et al.
Pubblicazione: (2025)
di: Go, Gyehun, et al.
Pubblicazione: (2025)
M2M-Gen: A Multimodal Framework for Automated Background Music Generation in Japanese Manga Using Large Language Models
di: Sharma, Megha, et al.
Pubblicazione: (2024)
di: Sharma, Megha, et al.
Pubblicazione: (2024)
Automatic Melody Reduction via Shortest Path Finding
di: Wang, Ziyu, et al.
Pubblicazione: (2025)
di: Wang, Ziyu, et al.
Pubblicazione: (2025)
Editing Music with Melody and Text: Using ControlNet for Diffusion Transformer
di: Hou, Siyuan, et al.
Pubblicazione: (2024)
di: Hou, Siyuan, et al.
Pubblicazione: (2024)
Towards Efficient and Real-Time Piano Transcription Using Neural Autoregressive Models
di: Kwon, Taegyun, et al.
Pubblicazione: (2024)
di: Kwon, Taegyun, et al.
Pubblicazione: (2024)
MuPT: A Generative Symbolic Music Pretrained Transformer
di: Qu, Xingwei, et al.
Pubblicazione: (2024)
di: Qu, Xingwei, et al.
Pubblicazione: (2024)
Unifying Symbolic Music Arrangement: Track-Aware Reconstruction and Structured Tokenization
di: Ou, Longshen, et al.
Pubblicazione: (2024)
di: Ou, Longshen, et al.
Pubblicazione: (2024)
Improving Unsupervised Clean-to-Rendered Guitar Tone Transformation Using GANs and Integrated Unaligned Clean Data
di: Chen, Yu-Hua, et al.
Pubblicazione: (2024)
di: Chen, Yu-Hua, et al.
Pubblicazione: (2024)
GD-Retriever: Controllable Generative Text-Music Retrieval with Diffusion Models
di: Guinot, Julien, et al.
Pubblicazione: (2025)
di: Guinot, Julien, et al.
Pubblicazione: (2025)
MusicMamba: A Dual-Feature Modeling Approach for Generating Chinese Traditional Music with Modal Precision
di: Chen, Jiatao, et al.
Pubblicazione: (2024)
di: Chen, Jiatao, et al.
Pubblicazione: (2024)
UNMIXX: Untangling Highly Correlated Singing Voices Mixtures
di: Jung, Jihoo, et al.
Pubblicazione: (2026)
di: Jung, Jihoo, et al.
Pubblicazione: (2026)
pTSE-T: Presentation Target Speaker Extraction using Unaligned Text Cues
di: Jiang, Ziyang, et al.
Pubblicazione: (2024)
di: Jiang, Ziyang, et al.
Pubblicazione: (2024)
CONMOD: Controllable Neural Frame-based Modulation Effects
di: Lee, Gyubin, et al.
Pubblicazione: (2024)
di: Lee, Gyubin, et al.
Pubblicazione: (2024)
A Real-Time Lyrics Alignment System Using Chroma And Phonetic Features For Classical Vocal Performance
di: Park, Jiyun, et al.
Pubblicazione: (2024)
di: Park, Jiyun, et al.
Pubblicazione: (2024)
MusicMagus: Zero-Shot Text-to-Music Editing via Diffusion Models
di: Zhang, Yixiao, et al.
Pubblicazione: (2024)
di: Zhang, Yixiao, et al.
Pubblicazione: (2024)
Whole-Song Hierarchical Generation of Symbolic Music Using Cascaded Diffusion Models
di: Wang, Ziyu, et al.
Pubblicazione: (2024)
di: Wang, Ziyu, et al.
Pubblicazione: (2024)
Who Gets Heard? Rethinking Fairness in AI for Music Systems
di: Mehta, Atharva, et al.
Pubblicazione: (2025)
di: Mehta, Atharva, et al.
Pubblicazione: (2025)
Documenti analoghi
-
CLaMP 2: Multimodal Music Information Retrieval Across 101 Languages Using Large Language Models
di: Wu, Shangda, et al.
Pubblicazione: (2024) -
TALKPLAY: Multimodal Music Recommendation with Large Language Models
di: Doh, Seungheon, et al.
Pubblicazione: (2025) -
TalkPlay-Tools: Conversational Music Recommendation with LLM Tool Calling
di: Doh, Seungheon, et al.
Pubblicazione: (2025) -
TalkPlayData 2: An Agentic Synthetic Data Pipeline for Multimodal Conversational Music Recommendation
di: Choi, Keunwoo, et al.
Pubblicazione: (2025) -
Musical Word Embedding for Music Tagging and Retrieval
di: Doh, SeungHeon, et al.
Pubblicazione: (2024)