FAMMA: A Benchmark for Financial Domain Multilingual Multimodal Question Answering
Fuente:
arXiv
Guardado en:
| Autores principales: | Xue, Siqiao, Li, Xiaojing, Zhou, Fan, Dai, Qingyang, Chu, Zhixuan, Mei, Hongyuan |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
RJUA-MedDQA: A Multimodal Benchmark for Medical Document Question Answering and Clinical Reasoning
por: Jin, Congyun, et al.
Publicado: (2024)
por: Jin, Congyun, et al.
Publicado: (2024)
SceMQA: A Scientific College Entrance Level Multimodal Question Answering Benchmark
por: Liang, Zhenwen, et al.
Publicado: (2024)
por: Liang, Zhenwen, et al.
Publicado: (2024)
DaPT: A Dual-Path Framework for Multilingual Multi-hop Question Answering
por: Wang, Yilin, et al.
Publicado: (2026)
por: Wang, Yilin, et al.
Publicado: (2026)
FinTextQA: A Dataset for Long-form Financial Question Answering
por: Chen, Jian, et al.
Publicado: (2024)
por: Chen, Jian, et al.
Publicado: (2024)
MTBench: A Multimodal Time Series Benchmark for Temporal Reasoning and Question Answering
por: Chen, Jialin, et al.
Publicado: (2025)
por: Chen, Jialin, et al.
Publicado: (2025)
Evaluating Monolingual and Multilingual Large Language Models for Greek Question Answering: The DemosQA Benchmark
por: Mastrokostas, Charalampos, et al.
Publicado: (2026)
por: Mastrokostas, Charalampos, et al.
Publicado: (2026)
Multi-TW: Benchmarking Multimodal Models on Traditional Chinese Question Answering in Taiwan
por: Yao, Jui-Ming, et al.
Publicado: (2025)
por: Yao, Jui-Ming, et al.
Publicado: (2025)
Improved LLM Agents for Financial Document Question Answering
por: Tan, Nelvin, et al.
Publicado: (2025)
por: Tan, Nelvin, et al.
Publicado: (2025)
FinCARDS: Card-Based Analyst Reranking for Financial Document Question Answering
por: Zhou, Yixi, et al.
Publicado: (2026)
por: Zhou, Yixi, et al.
Publicado: (2026)
Multilingual Medical Reasoning for Question Answering with Large Language Models
por: Ferrazzi, Pietro, et al.
Publicado: (2025)
por: Ferrazzi, Pietro, et al.
Publicado: (2025)
InsQABench: Benchmarking Chinese Insurance Domain Question Answering with Large Language Models
por: Ding, Jing, et al.
Publicado: (2025)
por: Ding, Jing, et al.
Publicado: (2025)
CVQA: Culturally-diverse Multilingual Visual Question Answering Benchmark
por: Romero, David, et al.
Publicado: (2024)
por: Romero, David, et al.
Publicado: (2024)
FinAgentBench: A Benchmark Dataset for Agentic Retrieval in Financial Question Answering
por: Choi, Chanyeol, et al.
Publicado: (2025)
por: Choi, Chanyeol, et al.
Publicado: (2025)
Open Domain Question Answering with Conflicting Contexts
por: Liu, Siyi, et al.
Publicado: (2024)
por: Liu, Siyi, et al.
Publicado: (2024)
Hierarchical Retrieval with Evidence Curation for Open-Domain Financial Question Answering on Standardized Documents
por: Choe, Jaeyoung, et al.
Publicado: (2025)
por: Choe, Jaeyoung, et al.
Publicado: (2025)
Chart-HQA: A Benchmark for Hypothetical Question Answering in Charts
por: Chen, Xiangnan, et al.
Publicado: (2025)
por: Chen, Xiangnan, et al.
Publicado: (2025)
Discrepancy Detection at the Data Level: Toward Consistent Multilingual Question Answering
por: Calvo-Bartolomé, Lorena, et al.
Publicado: (2025)
por: Calvo-Bartolomé, Lorena, et al.
Publicado: (2025)
Multilingual State Space Models for Structured Question Answering in Indic Languages
por: Vats, Arpita, et al.
Publicado: (2025)
por: Vats, Arpita, et al.
Publicado: (2025)
A Benchmark for Long-Form Medical Question Answering
por: Hosseini, Pedram, et al.
Publicado: (2024)
por: Hosseini, Pedram, et al.
Publicado: (2024)
QPaug: Question and Passage Augmentation for Open-Domain Question Answering of LLMs
por: Kim, Minsang, et al.
Publicado: (2024)
por: Kim, Minsang, et al.
Publicado: (2024)
Unmasking Deceptive Visuals: Benchmarking Multimodal Large Language Models on Misleading Chart Question Answering
por: Chen, Zixin, et al.
Publicado: (2025)
por: Chen, Zixin, et al.
Publicado: (2025)
Knowledgeable Preference Alignment for LLMs in Domain-specific Question Answering
por: Zhang, Yichi, et al.
Publicado: (2023)
por: Zhang, Yichi, et al.
Publicado: (2023)
POLYCHARTQA: Benchmarking Large Vision-Language Models with Multilingual Chart Question Answering
por: Xu, Yichen, et al.
Publicado: (2025)
por: Xu, Yichen, et al.
Publicado: (2025)
Leveraging Synthetic Data for Question Answering with Multilingual LLMs in the Agricultural Domain
por: Kaur, Rishemjit, et al.
Publicado: (2025)
por: Kaur, Rishemjit, et al.
Publicado: (2025)
Enhancing Financial Question Answering with a Multi-Agent Reflection Framework
por: Fatemi, Sorouralsadat, et al.
Publicado: (2024)
por: Fatemi, Sorouralsadat, et al.
Publicado: (2024)
WorldCuisines: A Massive-Scale Benchmark for Multilingual and Multicultural Visual Question Answering on Global Cuisines
por: Winata, Genta Indra, et al.
Publicado: (2024)
por: Winata, Genta Indra, et al.
Publicado: (2024)
Multimodal Multihop Source Retrieval for Web Question Answering
por: Yarrabelly, Navya, et al.
Publicado: (2025)
por: Yarrabelly, Navya, et al.
Publicado: (2025)
Multimodal Reranking for Knowledge-Intensive Visual Question Answering
por: Wen, Haoyang, et al.
Publicado: (2024)
por: Wen, Haoyang, et al.
Publicado: (2024)
Multimodal Commonsense Knowledge Distillation for Visual Question Answering
por: Yang, Shuo, et al.
Publicado: (2024)
por: Yang, Shuo, et al.
Publicado: (2024)
KoBBQ: Korean Bias Benchmark for Question Answering
por: Jin, Jiho, et al.
Publicado: (2023)
por: Jin, Jiho, et al.
Publicado: (2023)
Social Bias in Popular Question-Answering Benchmarks
por: Kraft, Angelie, et al.
Publicado: (2025)
por: Kraft, Angelie, et al.
Publicado: (2025)
WikiMixQA: A Multimodal Benchmark for Question Answering over Tables and Charts
por: Foroutan, Negar, et al.
Publicado: (2025)
por: Foroutan, Negar, et al.
Publicado: (2025)
A Dataset of Open-Domain Question Answering with Multiple-Span Answers
por: Luo, Zhiyi, et al.
Publicado: (2024)
por: Luo, Zhiyi, et al.
Publicado: (2024)
Long-Context Long-Form Question Answering for Legal Domain
por: Kulkarni, Anagha, et al.
Publicado: (2026)
por: Kulkarni, Anagha, et al.
Publicado: (2026)
Denoising Table-Text Retrieval for Open-Domain Question Answering
por: Kang, Deokhyung, et al.
Publicado: (2024)
por: Kang, Deokhyung, et al.
Publicado: (2024)
SensorQA: A Question Answering Benchmark for Daily-Life Monitoring
por: Reichman, Benjamin, et al.
Publicado: (2025)
por: Reichman, Benjamin, et al.
Publicado: (2025)
RETQA: A Large-Scale Open-Domain Tabular Question Answering Dataset for Real Estate Sector
por: Wang, Zhensheng, et al.
Publicado: (2024)
por: Wang, Zhensheng, et al.
Publicado: (2024)
Assessing Modality Bias in Video Question Answering Benchmarks with Multimodal Large Language Models
por: Park, Jean, et al.
Publicado: (2024)
por: Park, Jean, et al.
Publicado: (2024)
MedEthicsQA: A Comprehensive Question Answering Benchmark for Medical Ethics Evaluation of LLMs
por: Wei, Jianhui, et al.
Publicado: (2025)
por: Wei, Jianhui, et al.
Publicado: (2025)
O$^2$-Searcher: A Searching-based Agent Model for Open-Domain Open-Ended Question Answering
por: Mei, Jianbiao, et al.
Publicado: (2025)
por: Mei, Jianbiao, et al.
Publicado: (2025)
Ejemplares similares
-
RJUA-MedDQA: A Multimodal Benchmark for Medical Document Question Answering and Clinical Reasoning
por: Jin, Congyun, et al.
Publicado: (2024) -
SceMQA: A Scientific College Entrance Level Multimodal Question Answering Benchmark
por: Liang, Zhenwen, et al.
Publicado: (2024) -
DaPT: A Dual-Path Framework for Multilingual Multi-hop Question Answering
por: Wang, Yilin, et al.
Publicado: (2026) -
FinTextQA: A Dataset for Long-form Financial Question Answering
por: Chen, Jian, et al.
Publicado: (2024) -
MTBench: A Multimodal Time Series Benchmark for Temporal Reasoning and Question Answering
por: Chen, Jialin, et al.
Publicado: (2025)