HumMusQA: A Human-written Music Understanding QA Benchmark Dataset
Fuente:
arXiv
Salvato in:
| Autori principali: | Weck, Benno, Puentes, Pablo, Poltronieri, Andrea, Prabhu, Satyajeet, Bogdanov, Dmitry |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
MuChoMusic: Evaluating Music Understanding in Multimodal Audio-Language Models
di: Weck, Benno, et al.
Pubblicazione: (2024)
di: Weck, Benno, et al.
Pubblicazione: (2024)
The language of sound search: Examining User Queries in Audio Search Engines
di: Weck, Benno, et al.
Pubblicazione: (2024)
di: Weck, Benno, et al.
Pubblicazione: (2024)
Revisiting Meter Tracking in Carnatic Music using Deep Learning Approaches
di: Prabhu, Satyajeet
Pubblicazione: (2025)
di: Prabhu, Satyajeet
Pubblicazione: (2025)
WikiMuTe: A web-sourced dataset of semantic descriptions for music audio
di: Weck, Benno, et al.
Pubblicazione: (2023)
di: Weck, Benno, et al.
Pubblicazione: (2023)
OMAR-RQ: Open Music Audio Representation Model Trained with Multi-Feature Masked Token Prediction
di: Alonso-Jiménez, Pablo, et al.
Pubblicazione: (2025)
di: Alonso-Jiménez, Pablo, et al.
Pubblicazione: (2025)
Voices of Civilizations: A Multilingual QA Benchmark for Global Music Understanding
di: Wu, Shangda, et al.
Pubblicazione: (2026)
di: Wu, Shangda, et al.
Pubblicazione: (2026)
The ICASSP 2026 HumDial Challenge: Benchmarking Human-like Spoken Dialogue Systems in the LLM Era
di: Zhao, Zhixian, et al.
Pubblicazione: (2026)
di: Zhao, Zhixian, et al.
Pubblicazione: (2026)
The Role of Large Language Models in Musicology: Are We Ready to Trust the Machines?
di: Ramoneda, Pedro, et al.
Pubblicazione: (2024)
di: Ramoneda, Pedro, et al.
Pubblicazione: (2024)
Analyzing Error Propagation in Korean Spoken QA with ASR-LLM Cascades
di: Jung, Donghyuk, et al.
Pubblicazione: (2026)
di: Jung, Donghyuk, et al.
Pubblicazione: (2026)
Are you really listening? Boosting Perceptual Awareness in Music-QA Benchmarks
di: Zang, Yongyi, et al.
Pubblicazione: (2025)
di: Zang, Yongyi, et al.
Pubblicazione: (2025)
Persian MusicGen: A Large-Scale Dataset and Culturally-Aware Generative Model for Persian Music
di: Sameti, Mohammad Hossein, et al.
Pubblicazione: (2026)
di: Sameti, Mohammad Hossein, et al.
Pubblicazione: (2026)
Benchmarking Music Autotagging with MGPHot Expert Annotations vs. Generic Tag Datasets
di: Ramoneda, Pedro, et al.
Pubblicazione: (2025)
di: Ramoneda, Pedro, et al.
Pubblicazione: (2025)
BASS: Benchmarking Audio LMs for Musical Structure and Semantic Reasoning
di: Jang, Min, et al.
Pubblicazione: (2026)
di: Jang, Min, et al.
Pubblicazione: (2026)
Jamendo-QA: A Large-Scale Music Question Answering Dataset
di: Koh, Junyoung, et al.
Pubblicazione: (2025)
di: Koh, Junyoung, et al.
Pubblicazione: (2025)
ASR Benchmarking: Need for a More Representative Conversational Dataset
di: Maheshwari, Gaurav, et al.
Pubblicazione: (2024)
di: Maheshwari, Gaurav, et al.
Pubblicazione: (2024)
SD-Eval: A Benchmark Dataset for Spoken Dialogue Understanding Beyond Words
di: Ao, Junyi, et al.
Pubblicazione: (2024)
di: Ao, Junyi, et al.
Pubblicazione: (2024)
Jamendo-MT-QA: A Benchmark for Multi-Track Comparative Music Question Answering
di: Koh, Junyoung, et al.
Pubblicazione: (2026)
di: Koh, Junyoung, et al.
Pubblicazione: (2026)
Discogs-VI: A Musical Version Identification Dataset Based on Public Editorial Metadata
di: Araz, R. Oguz, et al.
Pubblicazione: (2024)
di: Araz, R. Oguz, et al.
Pubblicazione: (2024)
Words at Play: Benchmarking Audio Pun Understanding in Large Audio-Language Models
di: Su, Yuchen, et al.
Pubblicazione: (2026)
di: Su, Yuchen, et al.
Pubblicazione: (2026)
MobQA: A Benchmark Dataset for Semantic Understanding of Human Mobility Data through Question Answering
di: Asano, Hikaru, et al.
Pubblicazione: (2025)
di: Asano, Hikaru, et al.
Pubblicazione: (2025)
Do Music Preferences Reflect Cultural Values? A Cross-National Analysis Using Music Embedding and World Values Survey
di: Kim, Yongjae, et al.
Pubblicazione: (2025)
di: Kim, Yongjae, et al.
Pubblicazione: (2025)
RJUA-QA: A Comprehensive QA Dataset for Urology
di: Lyu, Shiwei, et al.
Pubblicazione: (2023)
di: Lyu, Shiwei, et al.
Pubblicazione: (2023)
Can LLMs "Reason" in Music? An Evaluation of LLMs' Capability of Music Understanding and Generation
di: Zhou, Ziya, et al.
Pubblicazione: (2024)
di: Zhou, Ziya, et al.
Pubblicazione: (2024)
WildScore: Benchmarking MLLMs in-the-Wild Symbolic Music Reasoning
di: Mundada, Gagan, et al.
Pubblicazione: (2025)
di: Mundada, Gagan, et al.
Pubblicazione: (2025)
Persian Musical Instruments Classification Using Polyphonic Data Augmentation
di: Esfangereh, Diba Hadi, et al.
Pubblicazione: (2025)
di: Esfangereh, Diba Hadi, et al.
Pubblicazione: (2025)
SongSong: A Time Phonograph for Chinese SongCi Music from Thousand of Years Away
di: Li, Jiajia, et al.
Pubblicazione: (2026)
di: Li, Jiajia, et al.
Pubblicazione: (2026)
Rubato: Transcribing Piano Music with Timestamps
di: Tamer, Nazif Can, et al.
Pubblicazione: (2026)
di: Tamer, Nazif Can, et al.
Pubblicazione: (2026)
MMAR: A Challenging Benchmark for Deep Reasoning in Speech, Audio, Music, and Their Mix
di: Ma, Ziyang, et al.
Pubblicazione: (2025)
di: Ma, Ziyang, et al.
Pubblicazione: (2025)
UniMoE-Audio: Unified Speech and Music Generation with Dynamic-Capacity MoE
di: Liu, Zhenyu, et al.
Pubblicazione: (2025)
di: Liu, Zhenyu, et al.
Pubblicazione: (2025)
CrossMuSim: A Cross-Modal Framework for Music Similarity Retrieval with LLM-Powered Text Description Sourcing and Mining
di: Tsoi, Tristan, et al.
Pubblicazione: (2025)
di: Tsoi, Tristan, et al.
Pubblicazione: (2025)
Linear Complexity Self-Supervised Learning for Music Understanding with Random Quantizer
di: Vavaroutsos, Petros, et al.
Pubblicazione: (2026)
di: Vavaroutsos, Petros, et al.
Pubblicazione: (2026)
BRACE: A Benchmark for Robust Audio Caption Quality Evaluation
di: Guo, Tianyu, et al.
Pubblicazione: (2025)
di: Guo, Tianyu, et al.
Pubblicazione: (2025)
BioGraphletQA: Knowledge-Anchored Generation of Complex QA Datasets
di: Jonker, Richard A. A., et al.
Pubblicazione: (2026)
di: Jonker, Richard A. A., et al.
Pubblicazione: (2026)
Advancing Singlish Understanding: Bridging the Gap with Datasets and Multimodal Models
di: Wang, Bin, et al.
Pubblicazione: (2025)
di: Wang, Bin, et al.
Pubblicazione: (2025)
Knowing What to Stress: A Discourse-Conditioned Text-to-Speech Benchmark
di: Turetzky, Arnon, et al.
Pubblicazione: (2026)
di: Turetzky, Arnon, et al.
Pubblicazione: (2026)
PARSA-Bench: A Comprehensive Persian Audio-Language Model Benchmark
di: Kalahroodi, Mohammad Javad Ranjbar, et al.
Pubblicazione: (2026)
di: Kalahroodi, Mohammad Javad Ranjbar, et al.
Pubblicazione: (2026)
Massive Sound Embedding Benchmark (MSEB)
di: Heigold, Georg, et al.
Pubblicazione: (2026)
di: Heigold, Georg, et al.
Pubblicazione: (2026)
MMSU: A Massive Multi-task Spoken Language Understanding and Reasoning Benchmark
di: Wang, Dingdong, et al.
Pubblicazione: (2025)
di: Wang, Dingdong, et al.
Pubblicazione: (2025)
From Scarcity to Scale: A Release-Level Analysis of the Pashto Common Voice Dataset
di: Jahani, Jandad, et al.
Pubblicazione: (2026)
di: Jahani, Jandad, et al.
Pubblicazione: (2026)
DIFFA-2: A Practical Diffusion Large Language Model for General Audio Understanding
di: Zhou, Jiaming, et al.
Pubblicazione: (2026)
di: Zhou, Jiaming, et al.
Pubblicazione: (2026)
Documenti analoghi
-
MuChoMusic: Evaluating Music Understanding in Multimodal Audio-Language Models
di: Weck, Benno, et al.
Pubblicazione: (2024) -
The language of sound search: Examining User Queries in Audio Search Engines
di: Weck, Benno, et al.
Pubblicazione: (2024) -
Revisiting Meter Tracking in Carnatic Music using Deep Learning Approaches
di: Prabhu, Satyajeet
Pubblicazione: (2025) -
WikiMuTe: A web-sourced dataset of semantic descriptions for music audio
di: Weck, Benno, et al.
Pubblicazione: (2023) -
OMAR-RQ: Open Music Audio Representation Model Trained with Multi-Feature Masked Token Prediction
di: Alonso-Jiménez, Pablo, et al.
Pubblicazione: (2025)