FinMR: A Knowledge-Intensive Multimodal Benchmark for Advanced Financial Reasoning
Fuente:
arXiv
Salvato in:
| Autori principali: | Deng, Shuangyan, Peng, Haizhou, Xu, Jiachen, Mao, Rui, Giurcăneanu, Ciprian Doru, Liu, Jiamou |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Understanding Financial Reasoning in AI: A Multimodal Benchmark and Error Learning Approach
di: Deng, Shuangyan, et al.
Pubblicazione: (2025)
di: Deng, Shuangyan, et al.
Pubblicazione: (2025)
FinS-Pilot: A Benchmark for Online Financial RAG System
di: Wang, Feng, et al.
Pubblicazione: (2025)
di: Wang, Feng, et al.
Pubblicazione: (2025)
Forget Less, Generalize More: Unifying Temporal and Structural Adaptation for Dynamic Graphs
di: Chang, Qian, et al.
Pubblicazione: (2026)
di: Chang, Qian, et al.
Pubblicazione: (2026)
Benchmarking Safety Risks of Knowledge-Intensive Reasoning under Malicious Knowledge Editing
di: Mao, Qinghua, et al.
Pubblicazione: (2026)
di: Mao, Qinghua, et al.
Pubblicazione: (2026)
FinReflectKG -- MultiHop: Financial QA Benchmark for Reasoning with Knowledge Graph Evidence
di: Arun, Abhinav, et al.
Pubblicazione: (2025)
di: Arun, Abhinav, et al.
Pubblicazione: (2025)
FinChain: A Symbolic Benchmark for Verifiable Chain-of-Thought Financial Reasoning
di: Xie, Zhuohan, et al.
Pubblicazione: (2025)
di: Xie, Zhuohan, et al.
Pubblicazione: (2025)
FinForge: Semi-Synthetic Financial Benchmark Generation
di: Matlin, Glenn, et al.
Pubblicazione: (2026)
di: Matlin, Glenn, et al.
Pubblicazione: (2026)
FinVault: Benchmarking Financial Agent Safety in Execution-Grounded Environments
di: Yang, Zhi, et al.
Pubblicazione: (2026)
di: Yang, Zhi, et al.
Pubblicazione: (2026)
REAL: Resolving Knowledge Conflicts in Knowledge-Intensive Visual Question Answering via Reasoning-Pivot Alignment
di: Ye, Kai, et al.
Pubblicazione: (2026)
di: Ye, Kai, et al.
Pubblicazione: (2026)
FinCARE: Financial Causal Analysis with Reasoning and Evidence
di: Michel, Alejandro, et al.
Pubblicazione: (2025)
di: Michel, Alejandro, et al.
Pubblicazione: (2025)
FinTagging: Benchmarking LLMs for Extracting and Structuring Financial Information
di: Wang, Yan, et al.
Pubblicazione: (2025)
di: Wang, Yan, et al.
Pubblicazione: (2025)
FinSTaR: Towards Financial Reasoning with Time Series Reasoning Models
di: Lee, Seunghan, et al.
Pubblicazione: (2026)
di: Lee, Seunghan, et al.
Pubblicazione: (2026)
Emotion and Intent Joint Understanding in Multimodal Conversation: A Benchmarking Dataset
di: Liu, Rui, et al.
Pubblicazione: (2024)
di: Liu, Rui, et al.
Pubblicazione: (2024)
FinBen: A Holistic Financial Benchmark for Large Language Models
di: Xie, Qianqian, et al.
Pubblicazione: (2024)
di: Xie, Qianqian, et al.
Pubblicazione: (2024)
Progressive Multimodal Search and Reasoning for Knowledge-Intensive Visual Question Answering
di: Choi, Changin, et al.
Pubblicazione: (2025)
di: Choi, Changin, et al.
Pubblicazione: (2025)
FinRule-Bench: A Benchmark for Joint Reasoning over Financial Tables and Principles
di: Malarkkan, Arun Vignesh, et al.
Pubblicazione: (2026)
di: Malarkkan, Arun Vignesh, et al.
Pubblicazione: (2026)
FinDABench: Benchmarking Financial Data Analysis Ability of Large Language Models
di: Liu, Shu, et al.
Pubblicazione: (2024)
di: Liu, Shu, et al.
Pubblicazione: (2024)
Process Reward Agents for Steering Knowledge-Intensive Reasoning
di: Sohn, Jiwoong, et al.
Pubblicazione: (2026)
di: Sohn, Jiwoong, et al.
Pubblicazione: (2026)
FinKario: Event-Enhanced Automated Construction of Financial Knowledge Graph
di: Li, Xiang, et al.
Pubblicazione: (2025)
di: Li, Xiang, et al.
Pubblicazione: (2025)
SVFSearch: A Multimodal Knowledge-Intensive Benchmark for Short-Video Frame Search in the Gaming Vertical Domain
di: Mao, Lingtao, et al.
Pubblicazione: (2026)
di: Mao, Lingtao, et al.
Pubblicazione: (2026)
DocFinQA: A Long-Context Financial Reasoning Dataset
di: Reddy, Varshini, et al.
Pubblicazione: (2024)
di: Reddy, Varshini, et al.
Pubblicazione: (2024)
FinLLMs: A Framework for Financial Reasoning Dataset Generation with Large Language Models
di: Yuan, Ziqiang, et al.
Pubblicazione: (2024)
di: Yuan, Ziqiang, et al.
Pubblicazione: (2024)
Conv-FinRe: A Conversational and Longitudinal Benchmark for Utility-Grounded Financial Recommendation
di: Wang, Yan, et al.
Pubblicazione: (2026)
di: Wang, Yan, et al.
Pubblicazione: (2026)
Towards Unified Neurosymbolic Reasoning on Knowledge Graphs
di: Lin, Qika, et al.
Pubblicazione: (2025)
di: Lin, Qika, et al.
Pubblicazione: (2025)
FinVerBench: Benchmark Validity and Calibration in Large Language Model Financial Statement Verification
di: Panda, Silu
Pubblicazione: (2026)
di: Panda, Silu
Pubblicazione: (2026)
ORIGAMISPACE: Benchmarking Multimodal LLMs in Multi-Step Spatial Reasoning with Mathematical Constraints
di: Xu, Rui, et al.
Pubblicazione: (2025)
di: Xu, Rui, et al.
Pubblicazione: (2025)
FinZero: Launching Multi-modal Financial Time Series Forecast with Large Reasoning Model
di: Wang, Yanlong, et al.
Pubblicazione: (2025)
di: Wang, Yanlong, et al.
Pubblicazione: (2025)
FinRetrieval: A Benchmark for Financial Data Retrieval by AI Agents
di: Kim, Eric Y., et al.
Pubblicazione: (2026)
di: Kim, Eric Y., et al.
Pubblicazione: (2026)
Multimodal Reranking for Knowledge-Intensive Visual Question Answering
di: Wen, Haoyang, et al.
Pubblicazione: (2024)
di: Wen, Haoyang, et al.
Pubblicazione: (2024)
ChatLogic: Integrating Logic Programming with Large Language Models for Multi-Step Reasoning
di: Wang, Zhongsheng, et al.
Pubblicazione: (2024)
di: Wang, Zhongsheng, et al.
Pubblicazione: (2024)
Fin-Fact: A Benchmark Dataset for Multimodal Financial Fact Checking and Explanation Generation
di: Rangapur, Aman, et al.
Pubblicazione: (2023)
di: Rangapur, Aman, et al.
Pubblicazione: (2023)
Bridging the Arithmetic Gap: The Cognitive Complexity Benchmark and Financial-PoT for Robust Financial Reasoning
di: Zhao, Boxiang, et al.
Pubblicazione: (2026)
di: Zhao, Boxiang, et al.
Pubblicazione: (2026)
RefTool: Reference-Guided Tool Creation for Knowledge-Intensive Reasoning
di: Liu, Xiao, et al.
Pubblicazione: (2025)
di: Liu, Xiao, et al.
Pubblicazione: (2025)
FinReflectKG -- EvalBench: Benchmarking Financial KG with Multi-Dimensional Evaluation
di: Dimino, Fabrizio, et al.
Pubblicazione: (2025)
di: Dimino, Fabrizio, et al.
Pubblicazione: (2025)
FinSheet-Bench: From Simple Lookups to Complex Reasoning, Where LLMs Break on Financial Spreadsheets
di: Ravnik, Jan, et al.
Pubblicazione: (2026)
di: Ravnik, Jan, et al.
Pubblicazione: (2026)
FinTradeBench: A Financial Reasoning Benchmark for LLMs
di: Agrawal, Yogesh, et al.
Pubblicazione: (2026)
di: Agrawal, Yogesh, et al.
Pubblicazione: (2026)
Benchmarking Multimodal Knowledge Conflict for Large Multimodal Models
di: Jia, Yifan, et al.
Pubblicazione: (2025)
di: Jia, Yifan, et al.
Pubblicazione: (2025)
FinSearchComp: Towards a Realistic, Expert-Level Evaluation of Financial Search and Reasoning
di: Hu, Liang, et al.
Pubblicazione: (2025)
di: Hu, Liang, et al.
Pubblicazione: (2025)
FinAudio: A Benchmark for Audio Large Language Models in Financial Applications
di: Cao, Yupeng, et al.
Pubblicazione: (2025)
di: Cao, Yupeng, et al.
Pubblicazione: (2025)
FinHEAR: Human Expertise and Adaptive Risk-Aware Temporal Reasoning for Financial Decision-Making
di: Chen, Jiaxiang, et al.
Pubblicazione: (2025)
di: Chen, Jiaxiang, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Understanding Financial Reasoning in AI: A Multimodal Benchmark and Error Learning Approach
di: Deng, Shuangyan, et al.
Pubblicazione: (2025) -
FinS-Pilot: A Benchmark for Online Financial RAG System
di: Wang, Feng, et al.
Pubblicazione: (2025) -
Forget Less, Generalize More: Unifying Temporal and Structural Adaptation for Dynamic Graphs
di: Chang, Qian, et al.
Pubblicazione: (2026) -
Benchmarking Safety Risks of Knowledge-Intensive Reasoning under Malicious Knowledge Editing
di: Mao, Qinghua, et al.
Pubblicazione: (2026) -
FinReflectKG -- MultiHop: Financial QA Benchmark for Reasoning with Knowledge Graph Evidence
di: Arun, Abhinav, et al.
Pubblicazione: (2025)