DARE: Diverse Visual Question Answering with Robustness Evaluation
Fuente:
arXiv
Guardado en:
| Autores principales: | Sterz, Hannah, Pfeiffer, Jonas, Vulić, Ivan |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
M2QA: Multi-domain Multilingual Question Answering
por: Engländer, Leon, et al.
Publicado: (2024)
por: Engländer, Leon, et al.
Publicado: (2024)
ReCoVeR the Target Language: Language Steering without Sacrificing Task Performance
por: Sterz, Hannah, et al.
Publicado: (2025)
por: Sterz, Hannah, et al.
Publicado: (2025)
Scaling Sparse Fine-Tuning to Large Language Models
por: Ansell, Alan, et al.
Publicado: (2024)
por: Ansell, Alan, et al.
Publicado: (2024)
SQATIN: Supervised Instruction Tuning Meets Question Answering for Improved Dialogue NLU
por: Razumovskaia, Evgeniia, et al.
Publicado: (2023)
por: Razumovskaia, Evgeniia, et al.
Publicado: (2023)
FUN with Fisher: Improving Generalization of Adapter-Based Cross-lingual Transfer with Scheduled Unfreezing
por: Liu, Chen Cecilia, et al.
Publicado: (2023)
por: Liu, Chen Cecilia, et al.
Publicado: (2023)
LoRA-Squeeze: Simple and Effective Post-Tuning and In-Tuning Compression of LoRA Modules
por: Vulić, Ivan, et al.
Publicado: (2026)
por: Vulić, Ivan, et al.
Publicado: (2026)
Exploring Diverse Methods in Visual Question Answering
por: Li, Panfeng, et al.
Publicado: (2024)
por: Li, Panfeng, et al.
Publicado: (2024)
Evaluating Robustness of LLMs in Question Answering on Multilingual Noisy OCR Data
por: Piryani, Bhawna, et al.
Publicado: (2025)
por: Piryani, Bhawna, et al.
Publicado: (2025)
Selectively Answering Visual Questions
por: Eisenschlos, Julian Martin, et al.
Publicado: (2024)
por: Eisenschlos, Julian Martin, et al.
Publicado: (2024)
DARE-bench: Evaluating Modeling and Instruction Fidelity of LLMs in Data Science
por: Shu, Fan, et al.
Publicado: (2026)
por: Shu, Fan, et al.
Publicado: (2026)
EVJVQA Challenge: Multilingual Visual Question Answering
por: Nguyen, Ngan Luu-Thuy, et al.
Publicado: (2023)
por: Nguyen, Ngan Luu-Thuy, et al.
Publicado: (2023)
Polyglot Teachers: Evaluating Language Models for Multilingual Synthetic Data Generation
por: Miranda, Lester James V., et al.
Publicado: (2026)
por: Miranda, Lester James V., et al.
Publicado: (2026)
Knowing or Guessing? Robust Medical Visual Question Answering via Joint Consistency and Contrastive Learning
por: Jiang, Songtao, et al.
Publicado: (2025)
por: Jiang, Songtao, et al.
Publicado: (2025)
DARE: Diffusion Large Language Models Alignment and Reinforcement Executor
por: Yang, Jingyi, et al.
Publicado: (2026)
por: Yang, Jingyi, et al.
Publicado: (2026)
A Comprehensive Evaluation of GPT-4V on Knowledge-Intensive Visual Question Answering
por: Li, Yunxin, et al.
Publicado: (2023)
por: Li, Yunxin, et al.
Publicado: (2023)
FREB-TQA: A Fine-Grained Robustness Evaluation Benchmark for Table Question Answering
por: Zhou, Wei, et al.
Publicado: (2024)
por: Zhou, Wei, et al.
Publicado: (2024)
LIVE: Learnable In-Context Vector for Visual Question Answering
por: Peng, Yingzhe, et al.
Publicado: (2024)
por: Peng, Yingzhe, et al.
Publicado: (2024)
Efficient Multimodal Planning Agent for Visual Question-Answering
por: Chen, Zhuo, et al.
Publicado: (2026)
por: Chen, Zhuo, et al.
Publicado: (2026)
Knowledge-Based Counterfactual Queries for Visual Question Answering
por: Stoikou, Theodoti, et al.
Publicado: (2023)
por: Stoikou, Theodoti, et al.
Publicado: (2023)
The Illusion of Competence: Evaluating the Effect of Explanations on Users' Mental Models of Visual Question Answering Systems
por: Sieker, Judith, et al.
Publicado: (2024)
por: Sieker, Judith, et al.
Publicado: (2024)
Who's Asking? Evaluating LLM Robustness to Inquiry Personas in Factual Question Answering
por: Akpinar, Nil-Jana, et al.
Publicado: (2025)
por: Akpinar, Nil-Jana, et al.
Publicado: (2025)
Retrofitting Large Language Models with Dynamic Tokenization
por: Feher, Darius, et al.
Publicado: (2024)
por: Feher, Darius, et al.
Publicado: (2024)
Analyzing and Adapting Large Language Models for Few-Shot Multilingual NLU: Are We There Yet?
por: Razumovskaia, Evgeniia, et al.
Publicado: (2024)
por: Razumovskaia, Evgeniia, et al.
Publicado: (2024)
Quantifying Language Disparities in Multilingual Large Language Models
por: Hu, Songbo, et al.
Publicado: (2025)
por: Hu, Songbo, et al.
Publicado: (2025)
ESQA: Event Sequences Question Answering
por: Abdullaeva, Irina, et al.
Publicado: (2024)
por: Abdullaeva, Irina, et al.
Publicado: (2024)
Knowledge-Aware Diverse Reranking for Cross-Source Question Answering
por: Zhou, Tong
Publicado: (2025)
por: Zhou, Tong
Publicado: (2025)
DebateQA: Evaluating Question Answering on Debatable Knowledge
por: Xu, Rongwu, et al.
Publicado: (2024)
por: Xu, Rongwu, et al.
Publicado: (2024)
Trustworthy Medical Question Answering: An Evaluation-Centric Survey
por: Wang, Yinuo, et al.
Publicado: (2025)
por: Wang, Yinuo, et al.
Publicado: (2025)
Argument-Based Comparative Question Answering Evaluation Benchmark
por: Nikishina, Irina, et al.
Publicado: (2025)
por: Nikishina, Irina, et al.
Publicado: (2025)
Specialising and Analysing Instruction-Tuned and Byte-Level Language Models for Organic Reaction Prediction
por: Pang, Jiayun, et al.
Publicado: (2024)
por: Pang, Jiayun, et al.
Publicado: (2024)
ChartQAPro: A More Diverse and Challenging Benchmark for Chart Question Answering
por: Masry, Ahmed, et al.
Publicado: (2025)
por: Masry, Ahmed, et al.
Publicado: (2025)
Robust Bias Evaluation with FilBBQ: A Filipino Bias Benchmark for Question-Answering Language Models
por: Gamboa, Lance Calvin Lim, et al.
Publicado: (2026)
por: Gamboa, Lance Calvin Lim, et al.
Publicado: (2026)
DIALIGHT: Lightweight Multilingual Development and Evaluation of Task-Oriented Dialogue Systems with Large Language Models
por: Hu, Songbo, et al.
Publicado: (2024)
por: Hu, Songbo, et al.
Publicado: (2024)
Hallucination Benchmark in Medical Visual Question Answering
por: Wu, Jinge, et al.
Publicado: (2024)
por: Wu, Jinge, et al.
Publicado: (2024)
Multimodal Reranking for Knowledge-Intensive Visual Question Answering
por: Wen, Haoyang, et al.
Publicado: (2024)
por: Wen, Haoyang, et al.
Publicado: (2024)
Multimodal Commonsense Knowledge Distillation for Visual Question Answering
por: Yang, Shuo, et al.
Publicado: (2024)
por: Yang, Shuo, et al.
Publicado: (2024)
OWLViz: An Open-World Benchmark for Visual Question Answering
por: Nguyen, Thuy, et al.
Publicado: (2025)
por: Nguyen, Thuy, et al.
Publicado: (2025)
LLM Robustness Against Misinformation in Biomedical Question Answering
por: Bondarenko, Alexander, et al.
Publicado: (2024)
por: Bondarenko, Alexander, et al.
Publicado: (2024)
Intrinsic Subgraph Generation for Interpretable Graph based Visual Question Answering
por: Tilli, Pascal, et al.
Publicado: (2024)
por: Tilli, Pascal, et al.
Publicado: (2024)
Discrete Subgraph Sampling for Interpretable Graph based Visual Question Answering
por: Tilli, Pascal, et al.
Publicado: (2024)
por: Tilli, Pascal, et al.
Publicado: (2024)
Ejemplares similares
-
M2QA: Multi-domain Multilingual Question Answering
por: Engländer, Leon, et al.
Publicado: (2024) -
ReCoVeR the Target Language: Language Steering without Sacrificing Task Performance
por: Sterz, Hannah, et al.
Publicado: (2025) -
Scaling Sparse Fine-Tuning to Large Language Models
por: Ansell, Alan, et al.
Publicado: (2024) -
SQATIN: Supervised Instruction Tuning Meets Question Answering for Improved Dialogue NLU
por: Razumovskaia, Evgeniia, et al.
Publicado: (2023) -
FUN with Fisher: Improving Generalization of Adapter-Based Cross-lingual Transfer with Scheduled Unfreezing
por: Liu, Chen Cecilia, et al.
Publicado: (2023)