Salvato in:
| Autori principali: | Go, Gyehun, Han, Satbyul, Choi, Ahyeon, Choi, Eunjin, Nam, Juhan, Park, Jeong Mi |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | https://arxiv.org/abs/2509.00813 |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
On the de-duplication of the Lakh MIDI dataset
di: Choi, Eunjin, et al.
Pubblicazione: (2025)
di: Choi, Eunjin, et al.
Pubblicazione: (2025)
PIAST: A Multimodal Piano Dataset with Audio, Symbolic and Text
di: Bang, Hayeon, et al.
Pubblicazione: (2024)
di: Bang, Hayeon, et al.
Pubblicazione: (2024)
TalkPlayData 2: An Agentic Synthetic Data Pipeline for Multimodal Conversational Music Recommendation
di: Choi, Keunwoo, et al.
Pubblicazione: (2025)
di: Choi, Keunwoo, et al.
Pubblicazione: (2025)
TALKPLAY: Multimodal Music Recommendation with Large Language Models
di: Doh, Seungheon, et al.
Pubblicazione: (2025)
di: Doh, Seungheon, et al.
Pubblicazione: (2025)
Musical Word Embedding for Music Tagging and Retrieval
di: Doh, SeungHeon, et al.
Pubblicazione: (2024)
di: Doh, SeungHeon, et al.
Pubblicazione: (2024)
Dialogue in Resonance: An Interactive Music Piece for Piano and Real-Time Automatic Transcription System
di: Bang, Hayeon, et al.
Pubblicazione: (2025)
di: Bang, Hayeon, et al.
Pubblicazione: (2025)
TalkPlay-Tools: Conversational Music Recommendation with LLM Tool Calling
di: Doh, Seungheon, et al.
Pubblicazione: (2025)
di: Doh, Seungheon, et al.
Pubblicazione: (2025)
Enriching Music Descriptions with a Finetuned-LLM and Metadata for Text-to-Music Retrieval
di: Doh, SeungHeon, et al.
Pubblicazione: (2024)
di: Doh, SeungHeon, et al.
Pubblicazione: (2024)
Expressive Acoustic Guitar Sound Synthesis with an Instrument-Specific Input Representation and Diffusion Outpainting
di: Kim, Hounsu, et al.
Pubblicazione: (2024)
di: Kim, Hounsu, et al.
Pubblicazione: (2024)
Music Discovery Dialogue Generation Using Human Intent Analysis and Large Language Models
di: Doh, SeungHeon, et al.
Pubblicazione: (2024)
di: Doh, SeungHeon, et al.
Pubblicazione: (2024)
KAD: No More FAD! An Effective and Efficient Evaluation Metric for Audio Generation
di: Chung, Yoonjin, et al.
Pubblicazione: (2025)
di: Chung, Yoonjin, et al.
Pubblicazione: (2025)
Segment Transformer: AI-Generated Music Detection via Music Structural Analysis
di: Kim, Yumin, et al.
Pubblicazione: (2025)
di: Kim, Yumin, et al.
Pubblicazione: (2025)
Real-world Music Plagiarism Detection With Music Segment Transcription System
di: Go, Seonghyeon
Pubblicazione: (2025)
di: Go, Seonghyeon
Pubblicazione: (2025)
FlashSR: One-step Versatile Audio Super-resolution via Diffusion Distillation
di: Im, Jaekwon, et al.
Pubblicazione: (2025)
di: Im, Jaekwon, et al.
Pubblicazione: (2025)
DIFFRENT: A Diffusion Model for Recording Environment Transfer of Speech
di: Im, Jaekwon, et al.
Pubblicazione: (2024)
di: Im, Jaekwon, et al.
Pubblicazione: (2024)
CONMOD: Controllable Neural Frame-based Modulation Effects
di: Lee, Gyubin, et al.
Pubblicazione: (2024)
di: Lee, Gyubin, et al.
Pubblicazione: (2024)
Towards Efficient and Real-Time Piano Transcription Using Neural Autoregressive Models
di: Kwon, Taegyun, et al.
Pubblicazione: (2024)
di: Kwon, Taegyun, et al.
Pubblicazione: (2024)
Joint Learning of Emotions in Music and Generalized Sounds
di: Simonetta, Federico, et al.
Pubblicazione: (2024)
di: Simonetta, Federico, et al.
Pubblicazione: (2024)
Aligning Text-to-Music Evaluation with Human Preferences
di: Huang, Yichen, et al.
Pubblicazione: (2025)
di: Huang, Yichen, et al.
Pubblicazione: (2025)
The Music Maestro or The Musically Challenged, A Massive Music Evaluation Benchmark for Large Language Models
di: Li, Jiajia, et al.
Pubblicazione: (2024)
di: Li, Jiajia, et al.
Pubblicazione: (2024)
Wearable Music2Emotion : Assessing Emotions Induced by AI-Generated Music through Portable EEG-fNIRS Fusion
di: Zhao, Sha, et al.
Pubblicazione: (2025)
di: Zhao, Sha, et al.
Pubblicazione: (2025)
Predicting User Intents and Musical Attributes from Music Discovery Conversations
di: Kwon, Daeyong, et al.
Pubblicazione: (2024)
di: Kwon, Daeyong, et al.
Pubblicazione: (2024)
MusicFlow: Cascaded Flow Matching for Text Guided Music Generation
di: Prajwal, K R, et al.
Pubblicazione: (2024)
di: Prajwal, K R, et al.
Pubblicazione: (2024)
D3RM: A Discrete Denoising Diffusion Refinement Model for Piano Transcription
di: Kim, Hounsu, et al.
Pubblicazione: (2025)
di: Kim, Hounsu, et al.
Pubblicazione: (2025)
Self Training and Ensembling Frequency Dependent Networks with Coarse Prediction Pooling and Sound Event Bounding Boxes
di: Nam, Hyeonuk, et al.
Pubblicazione: (2024)
di: Nam, Hyeonuk, et al.
Pubblicazione: (2024)
The Interpretation Gap in Text-to-Music Generation Models
di: Zang, Yongyi, et al.
Pubblicazione: (2024)
di: Zang, Yongyi, et al.
Pubblicazione: (2024)
Six Dragons Fly Again: Reviving 15th-Century Korean Court Music with Transformers and Novel Encoding
di: Han, Danbinaerin, et al.
Pubblicazione: (2024)
di: Han, Danbinaerin, et al.
Pubblicazione: (2024)
MMVA: Multimodal Matching Based on Valence and Arousal across Images, Music, and Musical Captions
di: Choi, Suhwan, et al.
Pubblicazione: (2025)
di: Choi, Suhwan, et al.
Pubblicazione: (2025)
MusiConGen: Rhythm and Chord Control for Transformer-Based Text-to-Music Generation
di: Lan, Yun-Han, et al.
Pubblicazione: (2024)
di: Lan, Yun-Han, et al.
Pubblicazione: (2024)
MusicEval: A Generative Music Dataset with Expert Ratings for Automatic Text-to-Music Evaluation
di: Liu, Cheng, et al.
Pubblicazione: (2025)
di: Liu, Cheng, et al.
Pubblicazione: (2025)
MuSpike: A Benchmark and Evaluation Framework for Symbolic Music Generation with Spiking Neural Networks
di: Liang, Qian, et al.
Pubblicazione: (2025)
di: Liang, Qian, et al.
Pubblicazione: (2025)
MusER: Musical Element-Based Regularization for Generating Symbolic Music with Emotion
di: Ji, Shulei, et al.
Pubblicazione: (2023)
di: Ji, Shulei, et al.
Pubblicazione: (2023)
AudioGenX: Explainability on Text-to-Audio Generative Models
di: Kang, Hyunju, et al.
Pubblicazione: (2025)
di: Kang, Hyunju, et al.
Pubblicazione: (2025)
BERT-APC: A Reference-free Framework for Automatic Pitch Correction via Musical Context Inference
di: Kim, Sungjae, et al.
Pubblicazione: (2025)
di: Kim, Sungjae, et al.
Pubblicazione: (2025)
T-FOLEY: A Controllable Waveform-Domain Diffusion Model for Temporal-Event-Guided Foley Sound Synthesis
di: Chung, Yoonjin, et al.
Pubblicazione: (2024)
di: Chung, Yoonjin, et al.
Pubblicazione: (2024)
Emotion-driven Piano Music Generation via Two-stage Disentanglement and Functional Representation
di: Huang, Jingyue, et al.
Pubblicazione: (2024)
di: Huang, Jingyue, et al.
Pubblicazione: (2024)
Enhancing Speech Emotion Recognition through Segmental Average Pooling of Self-Supervised Learning Features
di: Hyeon, Jonghwan, et al.
Pubblicazione: (2024)
di: Hyeon, Jonghwan, et al.
Pubblicazione: (2024)
A Real-Time Lyrics Alignment System Using Chroma And Phonetic Features For Classical Vocal Performance
di: Park, Jiyun, et al.
Pubblicazione: (2024)
di: Park, Jiyun, et al.
Pubblicazione: (2024)
CLaMP 3: Universal Music Information Retrieval Across Unaligned Modalities and Unseen Languages
di: Wu, Shangda, et al.
Pubblicazione: (2025)
di: Wu, Shangda, et al.
Pubblicazione: (2025)
Semi-Supervised Self-Learning Enhanced Music Emotion Recognition
di: Sun, Yifu, et al.
Pubblicazione: (2024)
di: Sun, Yifu, et al.
Pubblicazione: (2024)
Documenti analoghi
-
On the de-duplication of the Lakh MIDI dataset
di: Choi, Eunjin, et al.
Pubblicazione: (2025) -
PIAST: A Multimodal Piano Dataset with Audio, Symbolic and Text
di: Bang, Hayeon, et al.
Pubblicazione: (2024) -
TalkPlayData 2: An Agentic Synthetic Data Pipeline for Multimodal Conversational Music Recommendation
di: Choi, Keunwoo, et al.
Pubblicazione: (2025) -
TALKPLAY: Multimodal Music Recommendation with Large Language Models
di: Doh, Seungheon, et al.
Pubblicazione: (2025) -
Musical Word Embedding for Music Tagging and Retrieval
di: Doh, SeungHeon, et al.
Pubblicazione: (2024)