FinEval: A Chinese Financial Domain Knowledge Evaluation Benchmark for Large Language Models
Fuente:
arXiv
Saved in:
| Main Authors: | Guo, Xin, Xia, Haotian, Liu, Zhaowei, Cao, Hanyang, Yang, Zhi, Liu, Zhiqiang, Wang, Sizhe, Niu, Jinyi, Wang, Chuqi, Wang, Yanhui, Liang, Xiaolong, Huang, Xiaoming, Zhu, Bing, Wei, Zhongyu, Chen, Yun, Shen, Weining, Zhang, Liwen |
|---|---|
| Format: | Preprint |
| Published: |
2023
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
VisFinEval: A Scenario-Driven Chinese Multimodal Benchmark for Holistic Financial Understanding
by: Liu, Zhaowei, et al.
Published: (2025)
by: Liu, Zhaowei, et al.
Published: (2025)
FinEval-KR: A Financial Domain Evaluation Framework for Large Language Models' Knowledge and Reasoning
by: Dou, Shaoyu, et al.
Published: (2025)
by: Dou, Shaoyu, et al.
Published: (2025)
FinGAIA: A Chinese Benchmark for AI Agents in Real-World Financial Domain
by: Zeng, Lingfeng, et al.
Published: (2025)
by: Zeng, Lingfeng, et al.
Published: (2025)
Fin-R1: A Large Language Model for Financial Reasoning through Reinforcement Learning
by: Liu, Zhaowei, et al.
Published: (2025)
by: Liu, Zhaowei, et al.
Published: (2025)
UniFinEval: Towards Unified Evaluation of Financial Multimodal Models across Text, Images and Videos
by: Yang, Zhi, et al.
Published: (2026)
by: Yang, Zhi, et al.
Published: (2026)
FinVault: Benchmarking Financial Agent Safety in Execution-Grounded Environments
by: Yang, Zhi, et al.
Published: (2026)
by: Yang, Zhi, et al.
Published: (2026)
StreamProfileBench: A Benchmark for Fine-Grained User Profile Inference in Real-World Streaming Scenarios
by: Wang, Sizhe, et al.
Published: (2026)
by: Wang, Sizhe, et al.
Published: (2026)
FinTeam: A Multi-Agent Collaborative Intelligence System for Comprehensive Financial Scenarios
by: Wu, Yingqian, et al.
Published: (2025)
by: Wu, Yingqian, et al.
Published: (2025)
AgriEval: A Comprehensive Chinese Agricultural Benchmark for Large Language Models
by: Yan, Lian, et al.
Published: (2025)
by: Yan, Lian, et al.
Published: (2025)
LightAgent: Production-level Open-source Agentic AI Framework
by: Cai, Weige, et al.
Published: (2025)
by: Cai, Weige, et al.
Published: (2025)
Exploring Task-Solving Paradigm for Generalized Cross-Domain Face Anti-Spoofing via Reinforcement Fine-Tuning
by: Jiang, Fangling, et al.
Published: (2025)
by: Jiang, Fangling, et al.
Published: (2025)
MTFinEval:A Multi-domain Chinese Financial Benchmark with Eurypalynous questions
by: Liu, Xinyu, et al.
Published: (2024)
by: Liu, Xinyu, et al.
Published: (2024)
FinSafetyBench: Evaluating LLM Safety in Real-World Financial Scenarios
by: Hou, Yutao, et al.
Published: (2026)
by: Hou, Yutao, et al.
Published: (2026)
zkFinGPT: Zero-Knowledge Proofs for Financial Generative Pre-trained Transformers
by: Liu, Xiao-Yang, et al.
Published: (2026)
by: Liu, Xiao-Yang, et al.
Published: (2026)
OmniEval: An Omnidirectional and Automatic RAG Evaluation Benchmark in Financial Domain
by: Wang, Shuting, et al.
Published: (2024)
by: Wang, Shuting, et al.
Published: (2024)
Agentar-Fin-R1: Enhancing Financial Intelligence through Domain Expertise, Training Efficiency, and Advanced Reasoning
by: Zheng, Yanjun, et al.
Published: (2025)
by: Zheng, Yanjun, et al.
Published: (2025)
FinGPT: Open-Source Financial Large Language Models
by: Yang, Hongyang, et al.
Published: (2023)
by: Yang, Hongyang, et al.
Published: (2023)
FinReflectKG -- EvalBench: Benchmarking Financial KG with Multi-Dimensional Evaluation
by: Dimino, Fabrizio, et al.
Published: (2025)
by: Dimino, Fabrizio, et al.
Published: (2025)
Fin3R: Fine-tuning Feed-forward 3D Reconstruction Models via Monocular Knowledge Distillation
by: Ren, Weining, et al.
Published: (2025)
by: Ren, Weining, et al.
Published: (2025)
Advanced Microsphere and Hydrogel Platforms for Precision Interventional Therapy of Hepatocellular Carcinoma
by: Yanhui Wang, et al.
Published: (2025)
by: Yanhui Wang, et al.
Published: (2025)
BizFinBench.v2: A Unified Dual-Mode Bilingual Benchmark for Expert-Level Financial Capability Alignment
by: Guo, Xin, et al.
Published: (2026)
by: Guo, Xin, et al.
Published: (2026)
PoGDiff: Product-of-Gaussians Diffusion Models for Imbalanced Text-to-Image Generation
by: Wang, Ziyan, et al.
Published: (2025)
by: Wang, Ziyan, et al.
Published: (2025)
Unveiling the Heterogeneity of Sensation Seeking and Collectivism Development in Chinese Adolescents
by: Chuqi Chen, et al.
Published: (2024)
by: Chuqi Chen, et al.
Published: (2024)
Finance for Whom? Exploring the Conditional Impacts of Financial Inclusion on Economic, Social, and Environmental Sustainability in the Global South
by: Ping Wang, et al.
Published: (2026)
by: Ping Wang, et al.
Published: (2026)
FinAuditing: A Financial Taxonomy-Structured Multi-Document Benchmark for Evaluating LLMs
by: Wang, Yan, et al.
Published: (2025)
by: Wang, Yan, et al.
Published: (2025)
FinTagging: Benchmarking LLMs for Extracting and Structuring Financial Information
by: Wang, Yan, et al.
Published: (2025)
by: Wang, Yan, et al.
Published: (2025)
FinDebate: Multi-Agent Collaborative Intelligence for Financial Analysis
by: Cai, Tianshi, et al.
Published: (2025)
by: Cai, Tianshi, et al.
Published: (2025)
TCM-Eval: An Expert-Level Dynamic and Extensible Benchmark for Traditional Chinese Medicine
by: Cheng, Zihao, et al.
Published: (2025)
by: Cheng, Zihao, et al.
Published: (2025)
Prob-cGAN: A Probabilistic Conditional Generative Adversarial Network for LSD1 Inhibitor Activity Prediction
by: Wang, Hanyang
Published: (2024)
by: Wang, Hanyang
Published: (2024)
Open FinLLM Leaderboard: Towards Financial AI Readiness
by: Lin, Shengyuan Colin, et al.
Published: (2025)
by: Lin, Shengyuan Colin, et al.
Published: (2025)
The spectral radii and extremal graphs of two types of minimal graphs
by: Lian, Liwen, et al.
Published: (2025)
by: Lian, Liwen, et al.
Published: (2025)
Dynamic changes of vaginal microbiota in healthy Chinese women from pre‐pregnancy to the postpartum period
by: Dan Li, et al.
Published: (2025)
by: Dan Li, et al.
Published: (2025)
AraFinNews: Arabic Financial Summarisation with Domain-Adapted LLMs
by: El-Haj, Mo, et al.
Published: (2025)
by: El-Haj, Mo, et al.
Published: (2025)
FinDeepResearch: Evaluating Deep Research Agents in Rigorous Financial Analysis
by: Zhu, Fengbin, et al.
Published: (2025)
by: Zhu, Fengbin, et al.
Published: (2025)
FinChart-Bench: Benchmarking Financial Chart Comprehension in Vision-Language Models
by: Shu, Dong, et al.
Published: (2025)
by: Shu, Dong, et al.
Published: (2025)
How Class Influences the Ethnic Identity of Chinese Immigrants in the UK: Citizenship, Work, and Solidarity
by: Zhaowei Yin
Published: (2026)
by: Zhaowei Yin
Published: (2026)
FinCPRG: A Bidirectional Generation Pipeline for Hierarchical Queries and Rich Relevance in Financial Chinese Passage Retrieval
by: Xu, Xuan, et al.
Published: (2025)
by: Xu, Xuan, et al.
Published: (2025)
Deep FinResearch Bench: Evaluating AI's Ability to Conduct Professional Financial Investment Research
by: Haque, Mirazul, et al.
Published: (2026)
by: Haque, Mirazul, et al.
Published: (2026)
FinS-Pilot: A Benchmark for Online Financial RAG System
by: Wang, Feng, et al.
Published: (2025)
by: Wang, Feng, et al.
Published: (2025)
FinLoRA: Benchmarking LoRA Methods for Fine-Tuning LLMs on Financial Datasets
by: Wang, Dannong, et al.
Published: (2025)
by: Wang, Dannong, et al.
Published: (2025)
Similar Items
-
VisFinEval: A Scenario-Driven Chinese Multimodal Benchmark for Holistic Financial Understanding
by: Liu, Zhaowei, et al.
Published: (2025) -
FinEval-KR: A Financial Domain Evaluation Framework for Large Language Models' Knowledge and Reasoning
by: Dou, Shaoyu, et al.
Published: (2025) -
FinGAIA: A Chinese Benchmark for AI Agents in Real-World Financial Domain
by: Zeng, Lingfeng, et al.
Published: (2025) -
Fin-R1: A Large Language Model for Financial Reasoning through Reinforcement Learning
by: Liu, Zhaowei, et al.
Published: (2025) -
UniFinEval: Towards Unified Evaluation of Financial Multimodal Models across Text, Images and Videos
by: Yang, Zhi, et al.
Published: (2026)