KNVQA: A Benchmark for evaluation knowledge-based VQA
Fuente:
arXiv
Salvato in:
| Autori principali: | Cheng, Sirui, Zhang, Siyu, Wu, Jiayi, Lan, Muchen |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2023
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
ReXSonoVQA: A Video QA Benchmark for Procedure-Centric Ultrasound Understanding
di: Wang, Xucheng, et al.
Pubblicazione: (2026)
di: Wang, Xucheng, et al.
Pubblicazione: (2026)
ChromouVQA: Benchmarking Vision-Language Models under Chromatic Camouflaged Images
di: Zhang, Yunfei, et al.
Pubblicazione: (2025)
di: Zhang, Yunfei, et al.
Pubblicazione: (2025)
TableVQA-Bench: A Visual Question Answering Benchmark on Multiple Table Domains
di: Kim, Yoonsik, et al.
Pubblicazione: (2024)
di: Kim, Yoonsik, et al.
Pubblicazione: (2024)
GEMeX: A Large-Scale, Groundable, and Explainable Medical VQA Benchmark for Chest X-ray Diagnosis
di: Liu, Bo, et al.
Pubblicazione: (2024)
di: Liu, Bo, et al.
Pubblicazione: (2024)
MechVQA: Benchmarking and Enhancing Multimodal LLMs on Comprehensive Mechanical Drawing Understanding
di: Kou, Qian, et al.
Pubblicazione: (2026)
di: Kou, Qian, et al.
Pubblicazione: (2026)
M$^3$-VQA: A Benchmark for Multimodal, Multi-Entity, Multi-Hop Visual Question Answering
di: Ma, Jiatong, et al.
Pubblicazione: (2026)
di: Ma, Jiatong, et al.
Pubblicazione: (2026)
MISS: A Generative Pretraining and Finetuning Approach for Med-VQA
di: Chen, Jiawei, et al.
Pubblicazione: (2024)
di: Chen, Jiawei, et al.
Pubblicazione: (2024)
VQA$^2$: Visual Question Answering for Video Quality Assessment
di: Jia, Ziheng, et al.
Pubblicazione: (2024)
di: Jia, Ziheng, et al.
Pubblicazione: (2024)
MangaVQA and MangaLMM: A Benchmark and Specialized Model for Multimodal Manga Understanding
di: Baek, Jeonghun, et al.
Pubblicazione: (2025)
di: Baek, Jeonghun, et al.
Pubblicazione: (2025)
Mind the Uncertainty in Human Disagreement: Evaluating Discrepancies between Model Predictions and Human Responses in VQA
di: Lan, Jian, et al.
Pubblicazione: (2024)
di: Lan, Jian, et al.
Pubblicazione: (2024)
Improving VQA Reliability: A Dual-Assessment Approach with Self-Reflection and Cross-Model Verification
di: Wu, Xixian, et al.
Pubblicazione: (2025)
di: Wu, Xixian, et al.
Pubblicazione: (2025)
AutoViVQA: A Large-Scale Automatically Constructed Dataset for Vietnamese Visual Question Answering
di: Tuong, Nguyen Anh, et al.
Pubblicazione: (2026)
di: Tuong, Nguyen Anh, et al.
Pubblicazione: (2026)
Gather and Trace: Rethinking Video TextVQA from an Instance-oriented Perspective
di: Zhang, Yan, et al.
Pubblicazione: (2025)
di: Zhang, Yan, et al.
Pubblicazione: (2025)
Knowledge Generation for Zero-shot Knowledge-based VQA
di: Cao, Rui, et al.
Pubblicazione: (2024)
di: Cao, Rui, et al.
Pubblicazione: (2024)
R^3-VQA: "Read the Room" by Video Social Reasoning
di: Niu, Lixing, et al.
Pubblicazione: (2025)
di: Niu, Lixing, et al.
Pubblicazione: (2025)
WorldScore: A Unified Evaluation Benchmark for World Generation
di: Duan, Haoyi, et al.
Pubblicazione: (2025)
di: Duan, Haoyi, et al.
Pubblicazione: (2025)
VQA-Levels: A Hierarchical Approach for Classifying Questions in VQA
di: Madaka, Madhuri Latha, et al.
Pubblicazione: (2025)
di: Madaka, Madhuri Latha, et al.
Pubblicazione: (2025)
VQArt-Bench: A semantically rich VQA Benchmark for Art and Cultural Heritage
di: Alfarano, A., et al.
Pubblicazione: (2025)
di: Alfarano, A., et al.
Pubblicazione: (2025)
Advancing Surgical VQA with Scene Graph Knowledge
di: Yuan, Kun, et al.
Pubblicazione: (2023)
di: Yuan, Kun, et al.
Pubblicazione: (2023)
DeepTumorVQA: A Hierarchical 3D CT Benchmark for Stage-Wise Evaluation of Medical VLMs and Tool-Augmented Agents
di: Chen, Yixiong, et al.
Pubblicazione: (2026)
di: Chen, Yixiong, et al.
Pubblicazione: (2026)
Is ChatGPT-5 Ready for Mammogram VQA?
di: Li, Qiang, et al.
Pubblicazione: (2025)
di: Li, Qiang, et al.
Pubblicazione: (2025)
Automatic Evaluation for Text-to-image Generation: Task-decomposed Framework, Distilled Training, and Meta-evaluation Benchmark
di: Tu, Rong-Cheng, et al.
Pubblicazione: (2024)
di: Tu, Rong-Cheng, et al.
Pubblicazione: (2024)
Look-Closer-Then-Diagnose: Confidence-Aware Ultrasound VQA via Active Zooming
di: Zhou, Yue, et al.
Pubblicazione: (2026)
di: Zhou, Yue, et al.
Pubblicazione: (2026)
MaS-VQA: A Mask-and-Select Framework for Knowledge-Based Visual Question Answering
di: Mao, Xianwei, et al.
Pubblicazione: (2026)
di: Mao, Xianwei, et al.
Pubblicazione: (2026)
An Evaluation of GPT-4V and Gemini in Online VQA
di: Liu, Mengchen, et al.
Pubblicazione: (2023)
di: Liu, Mengchen, et al.
Pubblicazione: (2023)
PathNavigate: A Training-Free Pathology Agent with Surprise-Guided Scan and Shared Slide Memory for Whole-Slide Image VQA
di: Yang, Chunze, et al.
Pubblicazione: (2026)
di: Yang, Chunze, et al.
Pubblicazione: (2026)
LMM-VQA: Advancing Video Quality Assessment with Large Multimodal Models
di: Ge, Qihang, et al.
Pubblicazione: (2024)
di: Ge, Qihang, et al.
Pubblicazione: (2024)
Kvasir-VQA: A Text-Image Pair GI Tract Dataset
di: Gautam, Sushant, et al.
Pubblicazione: (2024)
di: Gautam, Sushant, et al.
Pubblicazione: (2024)
When Text Hijacks Vision: Benchmarking and Mitigating Text Overlay-Induced Hallucination in Vision Language Models
di: Yakun, Cui, et al.
Pubblicazione: (2026)
di: Yakun, Cui, et al.
Pubblicazione: (2026)
Improving vision-language alignment with graph spiking hybrid Networks
di: Zhang, Siyu, et al.
Pubblicazione: (2025)
di: Zhang, Siyu, et al.
Pubblicazione: (2025)
KOFFVQA: An Objectively Evaluated Free-form VQA Benchmark for Large Vision-Language Models in the Korean Language
di: Kim, Yoonshik, et al.
Pubblicazione: (2025)
di: Kim, Yoonshik, et al.
Pubblicazione: (2025)
I2EBench: A Comprehensive Benchmark for Instruction-based Image Editing
di: Ma, Yiwei, et al.
Pubblicazione: (2024)
di: Ma, Yiwei, et al.
Pubblicazione: (2024)
Towards Clinically Interpretable Ophthalmic VQA via Spatially-Grounded Lesion Evidence
di: Wang, Xingyue, et al.
Pubblicazione: (2026)
di: Wang, Xingyue, et al.
Pubblicazione: (2026)
Free Lunch Alignment of Text-to-Image Diffusion Models without Preference Image Pairs
di: Xian, Jia Jun Cheng, et al.
Pubblicazione: (2025)
di: Xian, Jia Jun Cheng, et al.
Pubblicazione: (2025)
Semantic and Visual Evidence for Efficient Long-Video Reasoning: A Solution for the HD-EPIC VQA Challenge
di: Xu, Yinsong, et al.
Pubblicazione: (2026)
di: Xu, Yinsong, et al.
Pubblicazione: (2026)
CoralVQA: A Large-Scale Visual Question Answering Dataset for Coral Reef Image Understanding
di: Han, Hongyong, et al.
Pubblicazione: (2025)
di: Han, Hongyong, et al.
Pubblicazione: (2025)
ARIAL: An Agentic Framework for Document VQA with Precise Answer Localization
di: Mohammadshirazi, Ahmad, et al.
Pubblicazione: (2025)
di: Mohammadshirazi, Ahmad, et al.
Pubblicazione: (2025)
Box-QAymo: Box-Referring VQA Dataset for Autonomous Driving
di: Etchegaray, Djamahl, et al.
Pubblicazione: (2025)
di: Etchegaray, Djamahl, et al.
Pubblicazione: (2025)
Better Supervised Fine-tuning for VQA: Integer-Only Loss
di: Qian, Baihong, et al.
Pubblicazione: (2025)
di: Qian, Baihong, et al.
Pubblicazione: (2025)
SCRA-VQA: Summarized Caption-Rerank for Augmented Large Language Models in Visual Question Answering
di: Zhang, Yan, et al.
Pubblicazione: (2025)
di: Zhang, Yan, et al.
Pubblicazione: (2025)
Documenti analoghi
-
ReXSonoVQA: A Video QA Benchmark for Procedure-Centric Ultrasound Understanding
di: Wang, Xucheng, et al.
Pubblicazione: (2026) -
ChromouVQA: Benchmarking Vision-Language Models under Chromatic Camouflaged Images
di: Zhang, Yunfei, et al.
Pubblicazione: (2025) -
TableVQA-Bench: A Visual Question Answering Benchmark on Multiple Table Domains
di: Kim, Yoonsik, et al.
Pubblicazione: (2024) -
GEMeX: A Large-Scale, Groundable, and Explainable Medical VQA Benchmark for Chest X-ray Diagnosis
di: Liu, Bo, et al.
Pubblicazione: (2024) -
MechVQA: Benchmarking and Enhancing Multimodal LLMs on Comprehensive Mechanical Drawing Understanding
di: Kou, Qian, et al.
Pubblicazione: (2026)