FinRAGBench-V: A Benchmark for Multimodal RAG with Visual Citation in the Financial Domain
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Zhao, Suifeng, Jin, Zhuoran, Li, Sujian, Gao, Jun |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
FinS-Pilot: A Benchmark for Online Financial RAG System
par: Wang, Feng, et autres
Publié: (2025)
par: Wang, Feng, et autres
Publié: (2025)
RAGBench: Explainable Benchmark for Retrieval-Augmented Generation Systems
par: Friel, Robert, et autres
Publié: (2024)
par: Friel, Robert, et autres
Publié: (2024)
FinGAIA: A Chinese Benchmark for AI Agents in Real-World Financial Domain
par: Zeng, Lingfeng, et autres
Publié: (2025)
par: Zeng, Lingfeng, et autres
Publié: (2025)
MultiFinBen: Benchmarking Large Language Models for Multilingual and Multimodal Financial Application
par: Peng, Xueqing, et autres
Publié: (2025)
par: Peng, Xueqing, et autres
Publié: (2025)
LongFin: A Multimodal Document Understanding Model for Long Financial Domain Documents
par: Masry, Ahmed, et autres
Publié: (2024)
par: Masry, Ahmed, et autres
Publié: (2024)
ER-RAG: Enhance RAG with ER-Based Unified Modeling of Heterogeneous Data Sources
par: Xia, Yikuan, et autres
Publié: (2025)
par: Xia, Yikuan, et autres
Publié: (2025)
LIT-RAGBench: Benchmarking Generator Capabilities of Large Language Models in Retrieval-Augmented Generation
par: Itai, Koki, et autres
Publié: (2026)
par: Itai, Koki, et autres
Publié: (2026)
FinReflectKG -- HalluBench: GraphRAG Hallucination Benchmark for Financial Question Answering Systems
par: Kumar, Mahesh, et autres
Publié: (2026)
par: Kumar, Mahesh, et autres
Publié: (2026)
MMR-V: What's Left Unsaid? A Benchmark for Multimodal Deep Reasoning in Videos
par: Zhu, Kejian, et autres
Publié: (2025)
par: Zhu, Kejian, et autres
Publié: (2025)
OmniEval: An Omnidirectional and Automatic RAG Evaluation Benchmark in Financial Domain
par: Wang, Shuting, et autres
Publié: (2024)
par: Wang, Shuting, et autres
Publié: (2024)
FinEval: A Chinese Financial Domain Knowledge Evaluation Benchmark for Large Language Models
par: Guo, Xin, et autres
Publié: (2023)
par: Guo, Xin, et autres
Publié: (2023)
AlphaFin: Benchmarking Financial Analysis with Retrieval-Augmented Stock-Chain Framework
par: Li, Xiang, et autres
Publié: (2024)
par: Li, Xiang, et autres
Publié: (2024)
CanLegalRAGBench: Evaluating Retrieval-Augmented Generation on Canadian Case Law
par: Zhao, Ethan, et autres
Publié: (2026)
par: Zhao, Ethan, et autres
Publié: (2026)
RAG-RewardBench: Benchmarking Reward Models in Retrieval Augmented Generation for Preference Alignment
par: Jin, Zhuoran, et autres
Publié: (2024)
par: Jin, Zhuoran, et autres
Publié: (2024)
FinReasoning: A Hierarchical Benchmark for Reliable Financial Research Reporting
par: Zhu, Yiyun, et autres
Publié: (2026)
par: Zhu, Yiyun, et autres
Publié: (2026)
FAMMA: A Benchmark for Financial Domain Multilingual Multimodal Question Answering
par: Xue, Siqiao, et autres
Publié: (2024)
par: Xue, Siqiao, et autres
Publié: (2024)
FinTrust: A Comprehensive Benchmark of Trustworthiness Evaluation in Finance Domain
par: Hu, Tiansheng, et autres
Publié: (2025)
par: Hu, Tiansheng, et autres
Publié: (2025)
AraFinNews: Arabic Financial Summarisation with Domain-Adapted LLMs
par: El-Haj, Mo, et autres
Publié: (2025)
par: El-Haj, Mo, et autres
Publié: (2025)
SMARTFinRAG: Interactive Modularized Financial RAG Benchmark
par: Zha, Yiwei
Publié: (2025)
par: Zha, Yiwei
Publié: (2025)
FinMME: Benchmark Dataset for Financial Multi-Modal Reasoning Evaluation
par: Luo, Junyu, et autres
Publié: (2025)
par: Luo, Junyu, et autres
Publié: (2025)
Fin-PRM: A Domain-Specialized Process Reward Model for Financial Reasoning in Large Language Models
par: Zhu, Jie, et autres
Publié: (2025)
par: Zhu, Jie, et autres
Publié: (2025)
FinBen: A Holistic Financial Benchmark for Large Language Models
par: Xie, Qianqian, et autres
Publié: (2024)
par: Xie, Qianqian, et autres
Publié: (2024)
Agent-RewardBench: Towards a Unified Benchmark for Reward Modeling across Perception, Planning, and Safety in Real-World Multimodal Agents
par: Men, Tianyi, et autres
Publié: (2025)
par: Men, Tianyi, et autres
Publié: (2025)
FinTruthQA: A Benchmark for AI-Driven Financial Disclosure Quality Assessment in Investor -- Firm Interactions
par: Zhou, Peilin, et autres
Publié: (2024)
par: Zhou, Peilin, et autres
Publié: (2024)
FinDABench: Benchmarking Financial Data Analysis Ability of Large Language Models
par: Liu, Shu, et autres
Publié: (2024)
par: Liu, Shu, et autres
Publié: (2024)
FinTagging: Benchmarking LLMs for Extracting and Structuring Financial Information
par: Wang, Yan, et autres
Publié: (2025)
par: Wang, Yan, et autres
Publié: (2025)
MCiteBench: A Multimodal Benchmark for Generating Text with Citations
par: Hu, Caiyu, et autres
Publié: (2025)
par: Hu, Caiyu, et autres
Publié: (2025)
FinEval-KR: A Financial Domain Evaluation Framework for Large Language Models' Knowledge and Reasoning
par: Dou, Shaoyu, et autres
Publié: (2025)
par: Dou, Shaoyu, et autres
Publié: (2025)
FinRetrieval: A Benchmark for Financial Data Retrieval by AI Agents
par: Kim, Eric Y., et autres
Publié: (2026)
par: Kim, Eric Y., et autres
Publié: (2026)
Open-FinLLMs: Open Multimodal Large Language Models for Financial Applications
par: Huang, Jimin, et autres
Publié: (2024)
par: Huang, Jimin, et autres
Publié: (2024)
CitaLaw: Enhancing LLM with Citations in Legal Domain
par: Zhang, Kepu, et autres
Publié: (2024)
par: Zhang, Kepu, et autres
Publié: (2024)
FinAuditing: A Financial Taxonomy-Structured Multi-Document Benchmark for Evaluating LLMs
par: Wang, Yan, et autres
Publié: (2025)
par: Wang, Yan, et autres
Publié: (2025)
Reinforcement Learning for Chain of Thought Compression with One-Domain-to-All Generalization
par: Li, Hanyu, et autres
Publié: (2025)
par: Li, Hanyu, et autres
Publié: (2025)
FinVet: A Collaborative Framework of RAG and External Fact-Checking Agents for Financial Misinformation Detection
par: Araya, Daniel Berhane, et autres
Publié: (2025)
par: Araya, Daniel Berhane, et autres
Publié: (2025)
FinChain: A Symbolic Benchmark for Verifiable Chain-of-Thought Financial Reasoning
par: Xie, Zhuohan, et autres
Publié: (2025)
par: Xie, Zhuohan, et autres
Publié: (2025)
Shapley Value-based Contrastive Alignment for Multimodal Information Extraction
par: Luo, Wen, et autres
Publié: (2024)
par: Luo, Wen, et autres
Publié: (2024)
Agentar-Fin-R1: Enhancing Financial Intelligence through Domain Expertise, Training Efficiency, and Advanced Reasoning
par: Zheng, Yanjun, et autres
Publié: (2025)
par: Zheng, Yanjun, et autres
Publié: (2025)
FinTral: A Family of GPT-4 Level Multimodal Financial Large Language Models
par: Bhatia, Gagan, et autres
Publié: (2024)
par: Bhatia, Gagan, et autres
Publié: (2024)
MMKE-Bench: A Multimodal Editing Benchmark for Diverse Visual Knowledge
par: Du, Yuntao, et autres
Publié: (2025)
par: Du, Yuntao, et autres
Publié: (2025)
UniFinEval: Towards Unified Evaluation of Financial Multimodal Models across Text, Images and Videos
par: Yang, Zhi, et autres
Publié: (2026)
par: Yang, Zhi, et autres
Publié: (2026)
Documents similaires
-
FinS-Pilot: A Benchmark for Online Financial RAG System
par: Wang, Feng, et autres
Publié: (2025) -
RAGBench: Explainable Benchmark for Retrieval-Augmented Generation Systems
par: Friel, Robert, et autres
Publié: (2024) -
FinGAIA: A Chinese Benchmark for AI Agents in Real-World Financial Domain
par: Zeng, Lingfeng, et autres
Publié: (2025) -
MultiFinBen: Benchmarking Large Language Models for Multilingual and Multimodal Financial Application
par: Peng, Xueqing, et autres
Publié: (2025) -
LongFin: A Multimodal Document Understanding Model for Long Financial Domain Documents
par: Masry, Ahmed, et autres
Publié: (2024)