TalkPlayData 2: An Agentic Synthetic Data Pipeline for Multimodal Conversational Music Recommendation
Fuente:
arXiv
Guardado en:
| Autores principales: | Choi, Keunwoo, Doh, Seungheon, Nam, Juhan |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
TalkPlay-Tools: Conversational Music Recommendation with LLM Tool Calling
por: Doh, Seungheon, et al.
Publicado: (2025)
por: Doh, Seungheon, et al.
Publicado: (2025)
TALKPLAY: Multimodal Music Recommendation with Large Language Models
por: Doh, Seungheon, et al.
Publicado: (2025)
por: Doh, Seungheon, et al.
Publicado: (2025)
Enriching Music Descriptions with a Finetuned-LLM and Metadata for Text-to-Music Retrieval
por: Doh, SeungHeon, et al.
Publicado: (2024)
por: Doh, SeungHeon, et al.
Publicado: (2024)
Music Discovery Dialogue Generation Using Human Intent Analysis and Large Language Models
por: Doh, SeungHeon, et al.
Publicado: (2024)
por: Doh, SeungHeon, et al.
Publicado: (2024)
PIAST: A Multimodal Piano Dataset with Audio, Symbolic and Text
por: Bang, Hayeon, et al.
Publicado: (2024)
por: Bang, Hayeon, et al.
Publicado: (2024)
PianoBind: A Multimodal Joint Embedding Model for Pop-piano Music
por: Bang, Hayeon, et al.
Publicado: (2025)
por: Bang, Hayeon, et al.
Publicado: (2025)
Can Large Language Models Predict Audio Effects Parameters from Natural Language?
por: Doh, Seungheon, et al.
Publicado: (2025)
por: Doh, Seungheon, et al.
Publicado: (2025)
Diff4Steer: Steerable Diffusion Prior for Generative Music Retrieval with Semantic Guidance
por: Bao, Xuchan, et al.
Publicado: (2024)
por: Bao, Xuchan, et al.
Publicado: (2024)
JEPOO: Highly Accurate Joint Estimation of Pitch, Onset and Offset for Music Information Retrieval
por: Wei, Haojie, et al.
Publicado: (2023)
por: Wei, Haojie, et al.
Publicado: (2023)
On the Effect of Data-Augmentation on Local Embedding Properties in the Contrastive Learning of Music Audio Representations
por: McCallum, Matthew C., et al.
Publicado: (2024)
por: McCallum, Matthew C., et al.
Publicado: (2024)
SynthTab: Leveraging Synthesized Data for Guitar Tablature Transcription
por: Zang, Yongyi, et al.
Publicado: (2023)
por: Zang, Yongyi, et al.
Publicado: (2023)
Learning Normal Patterns in Musical Loops
por: Dadman, Shayan, et al.
Publicado: (2025)
por: Dadman, Shayan, et al.
Publicado: (2025)
Streaming Piano Transcription Based on Consistent Onset and Offset Decoding with Sustain Pedal Detection
por: Wei, Weixing, et al.
Publicado: (2025)
por: Wei, Weixing, et al.
Publicado: (2025)
Anchor-aware Deep Metric Learning for Audio-visual Retrieval
por: Zeng, Donghuo, et al.
Publicado: (2024)
por: Zeng, Donghuo, et al.
Publicado: (2024)
A Dataset and Baselines for Measuring and Predicting the Music Piece Memorability
por: Tseng, Li-Yang, et al.
Publicado: (2024)
por: Tseng, Li-Yang, et al.
Publicado: (2024)
Music Genre Classification: Ensemble Learning with Subcomponents-level Attention
por: Liu, Yichen, et al.
Publicado: (2024)
por: Liu, Yichen, et al.
Publicado: (2024)
MERGE -- A Bimodal Audio-Lyrics Dataset for Static Music Emotion Recognition
por: Louro, Pedro Lima, et al.
Publicado: (2024)
por: Louro, Pedro Lima, et al.
Publicado: (2024)
MMVA: Multimodal Matching Based on Valence and Arousal across Images, Music, and Musical Captions
por: Choi, Suhwan, et al.
Publicado: (2025)
por: Choi, Suhwan, et al.
Publicado: (2025)
A Survey on Cross-Modal Interaction Between Music and Multimodal Data
por: Li, Sifei, et al.
Publicado: (2025)
por: Li, Sifei, et al.
Publicado: (2025)
ASK: Adaptive Self-improving Knowledge Framework for Audio Text Retrieval
por: Fu, Siyuan, et al.
Publicado: (2025)
por: Fu, Siyuan, et al.
Publicado: (2025)
Towards Assessing Data Replication in Music Generation with Music Similarity Metrics on Raw Audio
por: Batlle-Roca, Roser, et al.
Publicado: (2024)
por: Batlle-Roca, Roser, et al.
Publicado: (2024)
On the de-duplication of the Lakh MIDI dataset
por: Choi, Eunjin, et al.
Publicado: (2025)
por: Choi, Eunjin, et al.
Publicado: (2025)
A Survey on Multimodal Music Emotion Recognition
por: Liyanarachchi, Rashini, et al.
Publicado: (2025)
por: Liyanarachchi, Rashini, et al.
Publicado: (2025)
FusID: Modality-Fused Semantic IDs for Generative Music Recommendation
por: Kim, Haven, et al.
Publicado: (2026)
por: Kim, Haven, et al.
Publicado: (2026)
SONIQUE: Video Background Music Generation Using Unpaired Audio-Visual Data
por: Zhang, Liqian, et al.
Publicado: (2024)
por: Zhang, Liqian, et al.
Publicado: (2024)
Jamendo-QA: A Large-Scale Music Question Answering Dataset
por: Koh, Junyoung, et al.
Publicado: (2025)
por: Koh, Junyoung, et al.
Publicado: (2025)
Musical Word Embedding for Music Tagging and Retrieval
por: Doh, SeungHeon, et al.
Publicado: (2024)
por: Doh, SeungHeon, et al.
Publicado: (2024)
SteerMusic: Enhanced Musical Consistency for Zero-shot Text-guided and Personalized Music Editing
por: Niu, Xinlei, et al.
Publicado: (2025)
por: Niu, Xinlei, et al.
Publicado: (2025)
MusFlow: Multimodal Music Generation via Conditional Flow Matching
por: Song, Jiahao, et al.
Publicado: (2025)
por: Song, Jiahao, et al.
Publicado: (2025)
MuseAgent-1: Interactive Grounded Multimodal Understanding of Music Scores and Performance Audio
por: Zhao, Qihao, et al.
Publicado: (2026)
por: Zhao, Qihao, et al.
Publicado: (2026)
Frechet Music Distance: A Metric For Generative Symbolic Music Evaluation
por: Retkowski, Jan, et al.
Publicado: (2024)
por: Retkowski, Jan, et al.
Publicado: (2024)
Towards Training Music Taggers on Synthetic Data
por: Kroher, Nadine, et al.
Publicado: (2024)
por: Kroher, Nadine, et al.
Publicado: (2024)
MusicMagus: Zero-Shot Text-to-Music Editing via Diffusion Models
por: Zhang, Yixiao, et al.
Publicado: (2024)
por: Zhang, Yixiao, et al.
Publicado: (2024)
MusER: Musical Element-Based Regularization for Generating Symbolic Music with Emotion
por: Ji, Shulei, et al.
Publicado: (2023)
por: Ji, Shulei, et al.
Publicado: (2023)
Music Auto-Tagging with Robust Music Representation Learned via Domain Adversarial Training
por: Joung, Haesun, et al.
Publicado: (2024)
por: Joung, Haesun, et al.
Publicado: (2024)
Predicting User Intents and Musical Attributes from Music Discovery Conversations
por: Kwon, Daeyong, et al.
Publicado: (2024)
por: Kwon, Daeyong, et al.
Publicado: (2024)
Flexible Control in Symbolic Music Generation via Musical Metadata
por: Han, Sangjun, et al.
Publicado: (2024)
por: Han, Sangjun, et al.
Publicado: (2024)
Advancing the Foundation Model for Music Understanding
por: Jiang, Yi, et al.
Publicado: (2025)
por: Jiang, Yi, et al.
Publicado: (2025)
A Survey of Foundation Models for Music Understanding
por: Li, Wenjun, et al.
Publicado: (2024)
por: Li, Wenjun, et al.
Publicado: (2024)
MusicSem: A Semantically Rich Language--Audio Dataset of Natural Music Descriptions
por: Salganik, Rebecca, et al.
Publicado: (2026)
por: Salganik, Rebecca, et al.
Publicado: (2026)
Ejemplares similares
-
TalkPlay-Tools: Conversational Music Recommendation with LLM Tool Calling
por: Doh, Seungheon, et al.
Publicado: (2025) -
TALKPLAY: Multimodal Music Recommendation with Large Language Models
por: Doh, Seungheon, et al.
Publicado: (2025) -
Enriching Music Descriptions with a Finetuned-LLM and Metadata for Text-to-Music Retrieval
por: Doh, SeungHeon, et al.
Publicado: (2024) -
Music Discovery Dialogue Generation Using Human Intent Analysis and Large Language Models
por: Doh, SeungHeon, et al.
Publicado: (2024) -
PIAST: A Multimodal Piano Dataset with Audio, Symbolic and Text
por: Bang, Hayeon, et al.
Publicado: (2024)