BOK-VQA: Bilingual outside Knowledge-Based Visual Question Answering via Graph Representation Pretraining
Fuente:
arXiv
Guardado en:
| Autores principales: | Kim, Minjun, Song, Seungwoo, Lee, Youhan, Jang, Haneol, Lim, Kyungtae |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
X-LLaVA: Optimizing Bilingual Large Vision-Language Alignment
por: Shin, Dongjae, et al.
Publicado: (2024)
por: Shin, Dongjae, et al.
Publicado: (2024)
MAGIC-VQA: Multimodal And Grounded Inference with Commonsense Knowledge for Visual Question Answering
por: Yang, Shuo, et al.
Publicado: (2025)
por: Yang, Shuo, et al.
Publicado: (2025)
VLR-Bench: Multilingual Benchmark Dataset for Vision-Language Retrieval Augmented Generation
por: Lim, Hyeonseok, et al.
Publicado: (2024)
por: Lim, Hyeonseok, et al.
Publicado: (2024)
CommVQA: Situating Visual Question Answering in Communicative Contexts
por: Naik, Nandita Shankar, et al.
Publicado: (2024)
por: Naik, Nandita Shankar, et al.
Publicado: (2024)
AdaDocVQA: Adaptive Framework for Long Document Visual Question Answering in Low-Resource Settings
por: Li, Haoxuan, et al.
Publicado: (2025)
por: Li, Haoxuan, et al.
Publicado: (2025)
KORMo: Korean Open Reasoning Model for Everyone
por: Kim, Minjun, et al.
Publicado: (2025)
por: Kim, Minjun, et al.
Publicado: (2025)
Knowledge-Based Counterfactual Queries for Visual Question Answering
por: Stoikou, Theodoti, et al.
Publicado: (2023)
por: Stoikou, Theodoti, et al.
Publicado: (2023)
ScholarBench: A Bilingual Benchmark for Abstraction, Comprehension, and Reasoning Evaluation in Academic Contexts
por: Noh, Dongwon, et al.
Publicado: (2025)
por: Noh, Dongwon, et al.
Publicado: (2025)
FlowVQA: Mapping Multimodal Logic in Visual Question Answering with Flowcharts
por: Singh, Shubhankar, et al.
Publicado: (2024)
por: Singh, Shubhankar, et al.
Publicado: (2024)
A Knowledge-Injected Curriculum Pretraining Framework for Question Answering
por: Lin, Xin, et al.
Publicado: (2024)
por: Lin, Xin, et al.
Publicado: (2024)
Question-guided Knowledge Graph Re-scoring and Injection for Knowledge Graph Question Answering
por: Zhang, Yu, et al.
Publicado: (2024)
por: Zhang, Yu, et al.
Publicado: (2024)
PipeNet: Question Answering with Semantic Pruning over Knowledge Graphs
por: Su, Ying, et al.
Publicado: (2024)
por: Su, Ying, et al.
Publicado: (2024)
CRIT: Graph-Based Automatic Data Synthesis to Enhance Cross-Modal Multi-Hop Reasoning
por: Sung, Junyoung, et al.
Publicado: (2026)
por: Sung, Junyoung, et al.
Publicado: (2026)
Inference Scaled GraphRAG: Improving Multi Hop Question Answering on Knowledge Graphs
por: Thompson, Travis, et al.
Publicado: (2025)
por: Thompson, Travis, et al.
Publicado: (2025)
VQA-MHUG: A Gaze Dataset to Study Multimodal Neural Attention in Visual Question Answering
por: Sood, Ekta, et al.
Publicado: (2021)
por: Sood, Ekta, et al.
Publicado: (2021)
Semantic Parsing with Candidate Expressions for Knowledge Base Question Answering
por: Nam, Daehwan, et al.
Publicado: (2024)
por: Nam, Daehwan, et al.
Publicado: (2024)
Adversarial Attacks on VQA-NLE: Exposing and Alleviating Inconsistencies in Visual Question Answering Explanations
por: Yeh, Yahsin, et al.
Publicado: (2025)
por: Yeh, Yahsin, et al.
Publicado: (2025)
UCSF-PDGM-VQA: Visual Question Answering dataset for brain tumor MRI interpretation
por: Ghosh, Shiv, et al.
Publicado: (2026)
por: Ghosh, Shiv, et al.
Publicado: (2026)
Pretraining Vision-Language Model for Difference Visual Question Answering in Longitudinal Chest X-rays
por: Cho, Yeongjae, et al.
Publicado: (2024)
por: Cho, Yeongjae, et al.
Publicado: (2024)
GraphWalker: Agentic Knowledge Graph Question Answering via Synthetic Trajectory Curriculum
por: Xu, Shuwen, et al.
Publicado: (2026)
por: Xu, Shuwen, et al.
Publicado: (2026)
Semantic Parsing for Question Answering over Knowledge Graphs
por: Wei, Sijia, et al.
Publicado: (2023)
por: Wei, Sijia, et al.
Publicado: (2023)
Overcoming Language Priors for Visual Question Answering Based on Knowledge Distillation
por: Peng, Daowan, et al.
Publicado: (2025)
por: Peng, Daowan, et al.
Publicado: (2025)
Computed Tomography Visual Question Answering with Cross-modal Feature Graphing
por: Tian, Yuanhe, et al.
Publicado: (2025)
por: Tian, Yuanhe, et al.
Publicado: (2025)
Interpretable Question Answering with Knowledge Graphs
por: Aneja, Kartikeya, et al.
Publicado: (2025)
por: Aneja, Kartikeya, et al.
Publicado: (2025)
Knowledge Editing with Dynamic Knowledge Graphs for Multi-Hop Question Answering
por: Lu, Yifan, et al.
Publicado: (2024)
por: Lu, Yifan, et al.
Publicado: (2024)
Translation Deserves Better: Analyzing Translation Artifacts in Cross-lingual Visual Question Answering
por: Park, ChaeHun, et al.
Publicado: (2024)
por: Park, ChaeHun, et al.
Publicado: (2024)
RespondeoQA: a Benchmark for Bilingual Latin-English Question Answering
por: Hudspeth, Marisa, et al.
Publicado: (2026)
por: Hudspeth, Marisa, et al.
Publicado: (2026)
Combining LLMs and Knowledge Graphs to Reduce Hallucinations in Question Answering
por: Pusch, Larissa, et al.
Publicado: (2024)
por: Pusch, Larissa, et al.
Publicado: (2024)
Self-Improvement Programming for Temporal Knowledge Graph Question Answering
por: Chen, Zhuo, et al.
Publicado: (2024)
por: Chen, Zhuo, et al.
Publicado: (2024)
MST5 -- Multilingual Question Answering over Knowledge Graphs
por: Srivastava, Nikit, et al.
Publicado: (2024)
por: Srivastava, Nikit, et al.
Publicado: (2024)
LLM-based Discriminative Reasoning for Knowledge Graph Question Answering
por: Xu, Mufan, et al.
Publicado: (2024)
por: Xu, Mufan, et al.
Publicado: (2024)
Find The Gap: Knowledge Base Reasoning For Visual Question Answering
por: Barezi, Elham J., et al.
Publicado: (2024)
por: Barezi, Elham J., et al.
Publicado: (2024)
Multimodal Reranking for Knowledge-Intensive Visual Question Answering
por: Wen, Haoyang, et al.
Publicado: (2024)
por: Wen, Haoyang, et al.
Publicado: (2024)
Multimodal Commonsense Knowledge Distillation for Visual Question Answering
por: Yang, Shuo, et al.
Publicado: (2024)
por: Yang, Shuo, et al.
Publicado: (2024)
LLM-Based Multi-Hop Question Answering with Knowledge Graph Integration in Evolving Environments
por: Chen, Ruirui, et al.
Publicado: (2024)
por: Chen, Ruirui, et al.
Publicado: (2024)
Efficient Multi-Hop Question Answering over Knowledge Graphs via LLM Planning and Embedding-Guided Search
por: Shrestha, Manil, et al.
Publicado: (2025)
por: Shrestha, Manil, et al.
Publicado: (2025)
LinkQ: An LLM-Assisted Visual Interface for Knowledge Graph Question-Answering
por: Li, Harry, et al.
Publicado: (2024)
por: Li, Harry, et al.
Publicado: (2024)
BYOKG-RAG: Multi-Strategy Graph Retrieval for Knowledge Graph Question Answering
por: Mavromatis, Costas, et al.
Publicado: (2025)
por: Mavromatis, Costas, et al.
Publicado: (2025)
Conversational Question Answering with Reformulations over Knowledge Graph
por: Liu, Lihui, et al.
Publicado: (2023)
por: Liu, Lihui, et al.
Publicado: (2023)
RadImageNet-VQA: A Large-Scale CT and MRI Dataset for Radiologic Visual Question Answering
por: Butsanets, Léo, et al.
Publicado: (2025)
por: Butsanets, Léo, et al.
Publicado: (2025)
Ejemplares similares
-
X-LLaVA: Optimizing Bilingual Large Vision-Language Alignment
por: Shin, Dongjae, et al.
Publicado: (2024) -
MAGIC-VQA: Multimodal And Grounded Inference with Commonsense Knowledge for Visual Question Answering
por: Yang, Shuo, et al.
Publicado: (2025) -
VLR-Bench: Multilingual Benchmark Dataset for Vision-Language Retrieval Augmented Generation
por: Lim, Hyeonseok, et al.
Publicado: (2024) -
CommVQA: Situating Visual Question Answering in Communicative Contexts
por: Naik, Nandita Shankar, et al.
Publicado: (2024) -
AdaDocVQA: Adaptive Framework for Long Document Visual Question Answering in Low-Resource Settings
por: Li, Haoxuan, et al.
Publicado: (2025)