Music Discovery Dialogue Generation Using Human Intent Analysis and Large Language Models
Fuente:
arXiv
Salvato in:
| Autori principali: | Doh, SeungHeon, Choi, Keunwoo, Kwon, Daeyong, Kim, Taesu, Nam, Juhan |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Predicting User Intents and Musical Attributes from Music Discovery Conversations
di: Kwon, Daeyong, et al.
Pubblicazione: (2024)
di: Kwon, Daeyong, et al.
Pubblicazione: (2024)
TALKPLAY: Multimodal Music Recommendation with Large Language Models
di: Doh, Seungheon, et al.
Pubblicazione: (2025)
di: Doh, Seungheon, et al.
Pubblicazione: (2025)
Enriching Music Descriptions with a Finetuned-LLM and Metadata for Text-to-Music Retrieval
di: Doh, SeungHeon, et al.
Pubblicazione: (2024)
di: Doh, SeungHeon, et al.
Pubblicazione: (2024)
TalkPlay-Tools: Conversational Music Recommendation with LLM Tool Calling
di: Doh, Seungheon, et al.
Pubblicazione: (2025)
di: Doh, Seungheon, et al.
Pubblicazione: (2025)
Musical Word Embedding for Music Tagging and Retrieval
di: Doh, SeungHeon, et al.
Pubblicazione: (2024)
di: Doh, SeungHeon, et al.
Pubblicazione: (2024)
TalkPlayData 2: An Agentic Synthetic Data Pipeline for Multimodal Conversational Music Recommendation
di: Choi, Keunwoo, et al.
Pubblicazione: (2025)
di: Choi, Keunwoo, et al.
Pubblicazione: (2025)
ArtistMus: A Globally Diverse, Artist-Centric Benchmark for Retrieval-Augmented Music Question Answering
di: Kwon, Daeyong, et al.
Pubblicazione: (2025)
di: Kwon, Daeyong, et al.
Pubblicazione: (2025)
MUST-RAG: MUSical Text Question Answering with Retrieval Augmented Generation
di: Kwon, Daeyong, et al.
Pubblicazione: (2025)
di: Kwon, Daeyong, et al.
Pubblicazione: (2025)
Dialogue in Resonance: An Interactive Music Piece for Piano and Real-Time Automatic Transcription System
di: Bang, Hayeon, et al.
Pubblicazione: (2025)
di: Bang, Hayeon, et al.
Pubblicazione: (2025)
CLaMP 3: Universal Music Information Retrieval Across Unaligned Modalities and Unseen Languages
di: Wu, Shangda, et al.
Pubblicazione: (2025)
di: Wu, Shangda, et al.
Pubblicazione: (2025)
Can Large Language Models Predict Audio Effects Parameters from Natural Language?
di: Doh, Seungheon, et al.
Pubblicazione: (2025)
di: Doh, Seungheon, et al.
Pubblicazione: (2025)
FusID: Modality-Fused Semantic IDs for Generative Music Recommendation
di: Kim, Haven, et al.
Pubblicazione: (2026)
di: Kim, Haven, et al.
Pubblicazione: (2026)
Evaluating Interval-based Tokenization for Pitch Representation in Symbolic Music Analysis
di: Le, Dinh-Viet-Toan, et al.
Pubblicazione: (2025)
di: Le, Dinh-Viet-Toan, et al.
Pubblicazione: (2025)
Towards Efficient and Real-Time Piano Transcription Using Neural Autoregressive Models
di: Kwon, Taegyun, et al.
Pubblicazione: (2024)
di: Kwon, Taegyun, et al.
Pubblicazione: (2024)
Automatic Estimation of Singing Voice Musical Dynamics
di: Narang, Jyoti, et al.
Pubblicazione: (2024)
di: Narang, Jyoti, et al.
Pubblicazione: (2024)
Beyond Musical Descriptors: Extracting Preference-Bearing Intent in Music Queries
di: Baranes, Marion, et al.
Pubblicazione: (2026)
di: Baranes, Marion, et al.
Pubblicazione: (2026)
A SOUND APPROACH: Using Large Language Models to generate audio descriptions for egocentric text-audio retrieval
di: Oncescu, Andreea-Maria, et al.
Pubblicazione: (2024)
di: Oncescu, Andreea-Maria, et al.
Pubblicazione: (2024)
Exploring GPT's Ability as a Judge in Music Understanding
di: Fang, Kun, et al.
Pubblicazione: (2025)
di: Fang, Kun, et al.
Pubblicazione: (2025)
Do Captioning Metrics Reflect Music Semantic Alignment?
di: Lee, Jinwoo, et al.
Pubblicazione: (2024)
di: Lee, Jinwoo, et al.
Pubblicazione: (2024)
Exploring Diverse Sounds: Identifying Outliers in a Music Corpus
di: Cai, Le, et al.
Pubblicazione: (2024)
di: Cai, Le, et al.
Pubblicazione: (2024)
FlashSR: One-step Versatile Audio Super-resolution via Diffusion Distillation
di: Im, Jaekwon, et al.
Pubblicazione: (2025)
di: Im, Jaekwon, et al.
Pubblicazione: (2025)
DIFFRENT: A Diffusion Model for Recording Environment Transfer of Speech
di: Im, Jaekwon, et al.
Pubblicazione: (2024)
di: Im, Jaekwon, et al.
Pubblicazione: (2024)
Personalized Dynamic Music Emotion Recognition with Dual-Scale Attention-Based Meta-Learning
di: Zhang, Dengming, et al.
Pubblicazione: (2024)
di: Zhang, Dengming, et al.
Pubblicazione: (2024)
Evaluating High-Resolution Piano Sustain Pedal Depth Estimation with Musically Informed Metrics
di: Zhang, Hanwen, et al.
Pubblicazione: (2025)
di: Zhang, Hanwen, et al.
Pubblicazione: (2025)
Bridging the Gap Between Semantic and User Preference Spaces for Multi-modal Music Representation Learning
di: Pan, Xiaofeng, et al.
Pubblicazione: (2025)
di: Pan, Xiaofeng, et al.
Pubblicazione: (2025)
Expressivity-aware Music Performance Retrieval using Mid-level Perceptual Features and Emotion Word Embeddings
di: Chowdhury, Shreyan, et al.
Pubblicazione: (2024)
di: Chowdhury, Shreyan, et al.
Pubblicazione: (2024)
A Real-Time Lyrics Alignment System Using Chroma And Phonetic Features For Classical Vocal Performance
di: Park, Jiyun, et al.
Pubblicazione: (2024)
di: Park, Jiyun, et al.
Pubblicazione: (2024)
Music Foundation Model as Generic Booster for Music Downstream Tasks
di: Liao, WeiHsiang, et al.
Pubblicazione: (2024)
di: Liao, WeiHsiang, et al.
Pubblicazione: (2024)
AImoclips: A Benchmark for Evaluating Emotion Conveyance in Text-to-Music Generation
di: Go, Gyehun, et al.
Pubblicazione: (2025)
di: Go, Gyehun, et al.
Pubblicazione: (2025)
D3RM: A Discrete Denoising Diffusion Refinement Model for Piano Transcription
di: Kim, Hounsu, et al.
Pubblicazione: (2025)
di: Kim, Hounsu, et al.
Pubblicazione: (2025)
KAD: No More FAD! An Effective and Efficient Evaluation Metric for Audio Generation
di: Chung, Yoonjin, et al.
Pubblicazione: (2025)
di: Chung, Yoonjin, et al.
Pubblicazione: (2025)
Music Era Recognition Using Supervised Contrastive Learning and Artist Information
di: He, Qiqi, et al.
Pubblicazione: (2024)
di: He, Qiqi, et al.
Pubblicazione: (2024)
Universal Music Representations? Evaluating Foundation Models on World Music Corpora
di: Papaioannou, Charilaos, et al.
Pubblicazione: (2025)
di: Papaioannou, Charilaos, et al.
Pubblicazione: (2025)
Diff4Steer: Steerable Diffusion Prior for Generative Music Retrieval with Semantic Guidance
di: Bao, Xuchan, et al.
Pubblicazione: (2024)
di: Bao, Xuchan, et al.
Pubblicazione: (2024)
JEPOO: Highly Accurate Joint Estimation of Pitch, Onset and Offset for Music Information Retrieval
di: Wei, Haojie, et al.
Pubblicazione: (2023)
di: Wei, Haojie, et al.
Pubblicazione: (2023)
Natural Language Processing Methods for Symbolic Music Generation and Information Retrieval: a Survey
di: Le, Dinh-Viet-Toan, et al.
Pubblicazione: (2024)
di: Le, Dinh-Viet-Toan, et al.
Pubblicazione: (2024)
Towards Computational Analysis of Pansori Singing
di: Park, Sangheon, et al.
Pubblicazione: (2024)
di: Park, Sangheon, et al.
Pubblicazione: (2024)
Nested Music Transformer: Sequentially Decoding Compound Tokens in Symbolic Music and Audio Generation
di: Yoo, HaeJun, et al.
Pubblicazione: (2024)
di: Yoo, HaeJun, et al.
Pubblicazione: (2024)
Music Auto-Tagging with Robust Music Representation Learned via Domain Adversarial Training
di: Joung, Haesun, et al.
Pubblicazione: (2024)
di: Joung, Haesun, et al.
Pubblicazione: (2024)
Language-based Audio Retrieval with Co-Attention Networks
di: Sun, Haoran, et al.
Pubblicazione: (2024)
di: Sun, Haoran, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Predicting User Intents and Musical Attributes from Music Discovery Conversations
di: Kwon, Daeyong, et al.
Pubblicazione: (2024) -
TALKPLAY: Multimodal Music Recommendation with Large Language Models
di: Doh, Seungheon, et al.
Pubblicazione: (2025) -
Enriching Music Descriptions with a Finetuned-LLM and Metadata for Text-to-Music Retrieval
di: Doh, SeungHeon, et al.
Pubblicazione: (2024) -
TalkPlay-Tools: Conversational Music Recommendation with LLM Tool Calling
di: Doh, Seungheon, et al.
Pubblicazione: (2025) -
Musical Word Embedding for Music Tagging and Retrieval
di: Doh, SeungHeon, et al.
Pubblicazione: (2024)