Musical Word Embedding for Music Tagging and Retrieval
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Doh, SeungHeon, Lee, Jongpil, Jeong, Dasaem, Nam, Juhan |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Enriching Music Descriptions with a Finetuned-LLM and Metadata for Text-to-Music Retrieval
par: Doh, SeungHeon, et autres
Publié: (2024)
par: Doh, SeungHeon, et autres
Publié: (2024)
Predicting User Intents and Musical Attributes from Music Discovery Conversations
par: Kwon, Daeyong, et autres
Publié: (2024)
par: Kwon, Daeyong, et autres
Publié: (2024)
Music Discovery Dialogue Generation Using Human Intent Analysis and Large Language Models
par: Doh, SeungHeon, et autres
Publié: (2024)
par: Doh, SeungHeon, et autres
Publié: (2024)
TALKPLAY: Multimodal Music Recommendation with Large Language Models
par: Doh, Seungheon, et autres
Publié: (2025)
par: Doh, Seungheon, et autres
Publié: (2025)
TalkPlay-Tools: Conversational Music Recommendation with LLM Tool Calling
par: Doh, Seungheon, et autres
Publié: (2025)
par: Doh, Seungheon, et autres
Publié: (2025)
Towards Efficient and Real-Time Piano Transcription Using Neural Autoregressive Models
par: Kwon, Taegyun, et autres
Publié: (2024)
par: Kwon, Taegyun, et autres
Publié: (2024)
CLaMP 3: Universal Music Information Retrieval Across Unaligned Modalities and Unseen Languages
par: Wu, Shangda, et autres
Publié: (2025)
par: Wu, Shangda, et autres
Publié: (2025)
TalkPlayData 2: An Agentic Synthetic Data Pipeline for Multimodal Conversational Music Recommendation
par: Choi, Keunwoo, et autres
Publié: (2025)
par: Choi, Keunwoo, et autres
Publié: (2025)
Can Audio Reveal Music Performance Difficulty? Insights from the Piano Syllabus Dataset
par: Ramoneda, Pedro, et autres
Publié: (2024)
par: Ramoneda, Pedro, et autres
Publié: (2024)
MusicGen-Chord: Advancing Music Generation through Chord Progressions and Interactive Web-UI
par: Jung, Jongmin, et autres
Publié: (2024)
par: Jung, Jongmin, et autres
Publié: (2024)
Music Tagging with Classifier Group Chains
par: Hasumi, Takuya, et autres
Publié: (2025)
par: Hasumi, Takuya, et autres
Publié: (2025)
Dialogue in Resonance: An Interactive Music Piece for Piano and Real-Time Automatic Transcription System
par: Bang, Hayeon, et autres
Publié: (2025)
par: Bang, Hayeon, et autres
Publié: (2025)
Boundary Regression for Leitmotif Detection in Music Audio
par: Lee, Sihun, et autres
Publié: (2025)
par: Lee, Sihun, et autres
Publié: (2025)
AImoclips: A Benchmark for Evaluating Emotion Conveyance in Text-to-Music Generation
par: Go, Gyehun, et autres
Publié: (2025)
par: Go, Gyehun, et autres
Publié: (2025)
Nested Music Transformer: Sequentially Decoding Compound Tokens in Symbolic Music and Audio Generation
par: Yoo, HaeJun, et autres
Publié: (2024)
par: Yoo, HaeJun, et autres
Publié: (2024)
Six Dragons Fly Again: Reviving 15th-Century Korean Court Music with Transformers and Novel Encoding
par: Han, Danbinaerin, et autres
Publié: (2024)
par: Han, Danbinaerin, et autres
Publié: (2024)
Benchmarking Music Autotagging with MGPHot Expert Annotations vs. Generic Tag Datasets
par: Ramoneda, Pedro, et autres
Publié: (2025)
par: Ramoneda, Pedro, et autres
Publié: (2025)
DIFFRENT: A Diffusion Model for Recording Environment Transfer of Speech
par: Im, Jaekwon, et autres
Publié: (2024)
par: Im, Jaekwon, et autres
Publié: (2024)
FlashSR: One-step Versatile Audio Super-resolution via Diffusion Distillation
par: Im, Jaekwon, et autres
Publié: (2025)
par: Im, Jaekwon, et autres
Publié: (2025)
Expressivity-aware Music Performance Retrieval using Mid-level Perceptual Features and Emotion Word Embeddings
par: Chowdhury, Shreyan, et autres
Publié: (2024)
par: Chowdhury, Shreyan, et autres
Publié: (2024)
On the de-duplication of the Lakh MIDI dataset
par: Choi, Eunjin, et autres
Publié: (2025)
par: Choi, Eunjin, et autres
Publié: (2025)
Perceptual Musical Features for Interpretable Audio Tagging
par: Lyberatos, Vassilis, et autres
Publié: (2023)
par: Lyberatos, Vassilis, et autres
Publié: (2023)
GD-Retriever: Controllable Generative Text-Music Retrieval with Diffusion Models
par: Guinot, Julien, et autres
Publié: (2025)
par: Guinot, Julien, et autres
Publié: (2025)
Zero-Shot Crate Digging: DJ Tool Retrieval Using Speech Activity, Music Structure And CLAP Embeddings
par: Orife, Iroro
Publié: (2024)
par: Orife, Iroro
Publié: (2024)
MusicEval: A Generative Music Dataset with Expert Ratings for Automatic Text-to-Music Evaluation
par: Liu, Cheng, et autres
Publié: (2025)
par: Liu, Cheng, et autres
Publié: (2025)
Semantic-Aware Interpretable Multimodal Music Auto-Tagging
par: Patakis, Andreas, et autres
Publié: (2025)
par: Patakis, Andreas, et autres
Publié: (2025)
Automatic Music Mixing using a Generative Model of Effect Embeddings
par: Moliner, Eloi, et autres
Publié: (2025)
par: Moliner, Eloi, et autres
Publié: (2025)
Music Auto-Tagging with Robust Music Representation Learned via Domain Adversarial Training
par: Joung, Haesun, et autres
Publié: (2024)
par: Joung, Haesun, et autres
Publié: (2024)
Music2Fail: Transfer Music to Failed Recorder Style
par: Leong, Chon In, et autres
Publié: (2024)
par: Leong, Chon In, et autres
Publié: (2024)
FakeMusicCaps: a Dataset for Detection and Attribution of Synthetic Music Generated via Text-to-Music Models
par: Comanducci, Luca, et autres
Publié: (2024)
par: Comanducci, Luca, et autres
Publié: (2024)
Zero-shot Musical Stem Retrieval with Joint-Embedding Predictive Architectures
par: Riou, Alain, et autres
Publié: (2024)
par: Riou, Alain, et autres
Publié: (2024)
Can Large Language Models Predict Audio Effects Parameters from Natural Language?
par: Doh, Seungheon, et autres
Publié: (2025)
par: Doh, Seungheon, et autres
Publié: (2025)
Beyond Genre: Diagnosing Bias in Music Embeddings Using Concept Activation Vectors
par: Gebhardt, Roman B., et autres
Publié: (2025)
par: Gebhardt, Roman B., et autres
Publié: (2025)
Seed-Music: A Unified Framework for High Quality and Controlled Music Generation
par: Bai, Ye, et autres
Publié: (2024)
par: Bai, Ye, et autres
Publié: (2024)
Embedding-Based Intrusive Evaluation Metrics for Musical Source Separation Using MERT Representations
par: Bereuter, Paul A., et autres
Publié: (2026)
par: Bereuter, Paul A., et autres
Publié: (2026)
Flexible Control in Symbolic Music Generation via Musical Metadata
par: Han, Sangjun, et autres
Publié: (2024)
par: Han, Sangjun, et autres
Publié: (2024)
An Experimental Comparison Of Multi-view Self-supervised Methods For Music Tagging
par: Meseguer-Brocal, Gabriel, et autres
Publié: (2024)
par: Meseguer-Brocal, Gabriel, et autres
Publié: (2024)
Towards Computational Analysis of Pansori Singing
par: Park, Sangheon, et autres
Publié: (2024)
par: Park, Sangheon, et autres
Publié: (2024)
ACMID: Automatic Curation of Musical Instrument Dataset for 7-Stem Music Source Separation
par: Yu, Ji, et autres
Publié: (2025)
par: Yu, Ji, et autres
Publié: (2025)
Modeling the Difficulty of Saxophone Music
par: Libřický, Šimon, et autres
Publié: (2025)
par: Libřický, Šimon, et autres
Publié: (2025)
Documents similaires
-
Enriching Music Descriptions with a Finetuned-LLM and Metadata for Text-to-Music Retrieval
par: Doh, SeungHeon, et autres
Publié: (2024) -
Predicting User Intents and Musical Attributes from Music Discovery Conversations
par: Kwon, Daeyong, et autres
Publié: (2024) -
Music Discovery Dialogue Generation Using Human Intent Analysis and Large Language Models
par: Doh, SeungHeon, et autres
Publié: (2024) -
TALKPLAY: Multimodal Music Recommendation with Large Language Models
par: Doh, Seungheon, et autres
Publié: (2025) -
TalkPlay-Tools: Conversational Music Recommendation with LLM Tool Calling
par: Doh, Seungheon, et autres
Publié: (2025)