FinMME: Benchmark Dataset for Financial Multi-Modal Reasoning Evaluation
Fuente:
arXiv
Guardado en:
| Autores principales: | Luo, Junyu, Kou, Zhizhuo, Yang, Liming, Luo, Xiao, Huang, Jinsheng, Xiao, Zhiping, Peng, Jingshu, Liu, Chengzhong, Ji, Jiaming, Liu, Xuanzhe, Han, Sirui, Zhang, Ming, Guo, Yike |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Automate Strategy Finding with LLM in Quant Investment
por: Kou, Zhizhuo, et al.
Publicado: (2024)
por: Kou, Zhizhuo, et al.
Publicado: (2024)
Attention Bootstrapping for Multi-Modal Test-Time Adaptation
por: Zhao, Yusheng, et al.
Publicado: (2025)
por: Zhao, Yusheng, et al.
Publicado: (2025)
Sparse Causal Discovery with Generative Intervention for Unsupervised Graph Domain Adaptation
por: Luo, Junyu, et al.
Publicado: (2025)
por: Luo, Junyu, et al.
Publicado: (2025)
MMFCTUB: Multi-Modal Financial Credit Table Understanding Benchmark
por: Yakun, Cui, et al.
Publicado: (2026)
por: Yakun, Cui, et al.
Publicado: (2026)
BAMAS: Structuring Budget-Aware Multi-Agent Systems
por: Yang, Liming, et al.
Publicado: (2025)
por: Yang, Liming, et al.
Publicado: (2025)
Semi-supervised Fine-tuning for Large Language Models
por: Luo, Junyu, et al.
Publicado: (2024)
por: Luo, Junyu, et al.
Publicado: (2024)
RobustFT: Robust Supervised Fine-tuning for Large Language Models under Noisy Response
por: Luo, Junyu, et al.
Publicado: (2024)
por: Luo, Junyu, et al.
Publicado: (2024)
FinLoRA: Benchmarking LoRA Methods for Fine-Tuning LLMs on Financial Datasets
por: Wang, Dannong, et al.
Publicado: (2025)
por: Wang, Dannong, et al.
Publicado: (2025)
RW-TTT: Batched Serving for Request-Owned Test-Time Training State
por: Yang, Jian, et al.
Publicado: (2026)
por: Yang, Jian, et al.
Publicado: (2026)
MME-CC: A Challenging Multi-Modal Evaluation Benchmark of Cognitive Capacity
por: Zhang, Kaiyuan, et al.
Publicado: (2025)
por: Zhang, Kaiyuan, et al.
Publicado: (2025)
MME-Finance: A Multimodal Finance Benchmark for Expert-level Understanding and Reasoning
por: Gan, Ziliang, et al.
Publicado: (2024)
por: Gan, Ziliang, et al.
Publicado: (2024)
Rank and Align: Towards Effective Source-free Graph Domain Adaptation
por: Luo, Junyu, et al.
Publicado: (2024)
por: Luo, Junyu, et al.
Publicado: (2024)
Benchmarking Multi-National Value Alignment for Large Language Models
por: Shi, Weijie, et al.
Publicado: (2025)
por: Shi, Weijie, et al.
Publicado: (2025)
FinRL Contests: Benchmarking Data-driven Financial Reinforcement Learning Agents
por: Wang, Keyi, et al.
Publicado: (2025)
por: Wang, Keyi, et al.
Publicado: (2025)
MME-Reasoning: A Comprehensive Benchmark for Logical Reasoning in MLLMs
por: Yuan, Jiakang, et al.
Publicado: (2025)
por: Yuan, Jiakang, et al.
Publicado: (2025)
FinAnchor: Aligned Multi-Model Representations for Financial Prediction
por: He, Zirui, et al.
Publicado: (2026)
por: He, Zirui, et al.
Publicado: (2026)
GALA: Graph Diffusion-based Alignment with Jigsaw for Source-free Domain Adaptation
por: Luo, Junyu, et al.
Publicado: (2024)
por: Luo, Junyu, et al.
Publicado: (2024)
Multifaceted Evaluation of Audio-Visual Capability for MLLMs: Effectiveness, Efficiency, Generalizability and Robustness
por: Zhao, Yusheng, et al.
Publicado: (2025)
por: Zhao, Yusheng, et al.
Publicado: (2025)
Cross-Domain Diffusion with Progressive Alignment for Efficient Adaptive Retrieval
por: Luo, Junyu, et al.
Publicado: (2025)
por: Luo, Junyu, et al.
Publicado: (2025)
FinBen: A Holistic Financial Benchmark for Large Language Models
por: Xie, Qianqian, et al.
Publicado: (2024)
por: Xie, Qianqian, et al.
Publicado: (2024)
MEME: Modeling the Evolutionary Modes of Financial Markets
por: Guo, Taian, et al.
Publicado: (2026)
por: Guo, Taian, et al.
Publicado: (2026)
FinTagging: Benchmarking LLMs for Extracting and Structuring Financial Information
por: Wang, Yan, et al.
Publicado: (2025)
por: Wang, Yan, et al.
Publicado: (2025)
Reimagining Legal Fact Verification with GenAI: Toward Effective Human-AI Collaboration
por: Han, Sirui, et al.
Publicado: (2026)
por: Han, Sirui, et al.
Publicado: (2026)
FinMR: A Knowledge-Intensive Multimodal Benchmark for Advanced Financial Reasoning
por: Deng, Shuangyan, et al.
Publicado: (2025)
por: Deng, Shuangyan, et al.
Publicado: (2025)
FinTradeBench: A Financial Reasoning Benchmark for LLMs
por: Agrawal, Yogesh, et al.
Publicado: (2026)
por: Agrawal, Yogesh, et al.
Publicado: (2026)
FinMultiTime: A Four-Modal Bilingual Dataset for Financial Time-Series Analysis
por: Xu, Wenyan, et al.
Publicado: (2025)
por: Xu, Wenyan, et al.
Publicado: (2025)
MARCO: Meta-Reflection with Cross-Referencing for Code Reasoning
por: Zhao, Yusheng, et al.
Publicado: (2025)
por: Zhao, Yusheng, et al.
Publicado: (2025)
InsightEval: An Expert-Curated Benchmark for Assessing Insight Discovery in LLM-Driven Data Agents
por: Zhu, Zhenghao, et al.
Publicado: (2025)
por: Zhu, Zhenghao, et al.
Publicado: (2025)
FinGPT: Open-Source Financial Large Language Models
por: Yang, Hongyang, et al.
Publicado: (2023)
por: Yang, Hongyang, et al.
Publicado: (2023)
PGODE: Towards High-quality System Dynamics Modeling
por: Luo, Xiao, et al.
Publicado: (2023)
por: Luo, Xiao, et al.
Publicado: (2023)
DocFinQA: A Long-Context Financial Reasoning Dataset
por: Reddy, Varshini, et al.
Publicado: (2024)
por: Reddy, Varshini, et al.
Publicado: (2024)
FinReasoning: A Hierarchical Benchmark for Reliable Financial Research Reporting
por: Zhu, Yiyun, et al.
Publicado: (2026)
por: Zhu, Yiyun, et al.
Publicado: (2026)
Human-MME: A Holistic Evaluation Benchmark for Human-Centric Multimodal Large Language Models
por: Liu, Yuansen, et al.
Publicado: (2025)
por: Liu, Yuansen, et al.
Publicado: (2025)
A Survey of Data-Efficient Graph Learning
por: Ju, Wei, et al.
Publicado: (2024)
por: Ju, Wei, et al.
Publicado: (2024)
BizFinBench: A Business-Driven Real-World Financial Benchmark for Evaluating LLMs
por: Lu, Guilong, et al.
Publicado: (2025)
por: Lu, Guilong, et al.
Publicado: (2025)
Video-MME: The First-Ever Comprehensive Evaluation Benchmark of Multi-modal LLMs in Video Analysis
por: Fu, Chaoyou, et al.
Publicado: (2024)
por: Fu, Chaoyou, et al.
Publicado: (2024)
FinChain: A Symbolic Benchmark for Verifiable Chain-of-Thought Financial Reasoning
por: Xie, Zhuohan, et al.
Publicado: (2025)
por: Xie, Zhuohan, et al.
Publicado: (2025)
SCoRE: Benchmarking Long-Chain Reasoning in Commonsense Scenarios
por: Zhan, Weidong, et al.
Publicado: (2025)
por: Zhan, Weidong, et al.
Publicado: (2025)
FinAudio: A Benchmark for Audio Large Language Models in Financial Applications
por: Cao, Yupeng, et al.
Publicado: (2025)
por: Cao, Yupeng, et al.
Publicado: (2025)
Benchmarking Automated Clinical Language Simplification: Dataset, Algorithm, and Evaluation
por: Luo, Junyu, et al.
Publicado: (2020)
por: Luo, Junyu, et al.
Publicado: (2020)
Ejemplares similares
-
Automate Strategy Finding with LLM in Quant Investment
por: Kou, Zhizhuo, et al.
Publicado: (2024) -
Attention Bootstrapping for Multi-Modal Test-Time Adaptation
por: Zhao, Yusheng, et al.
Publicado: (2025) -
Sparse Causal Discovery with Generative Intervention for Unsupervised Graph Domain Adaptation
por: Luo, Junyu, et al.
Publicado: (2025) -
MMFCTUB: Multi-Modal Financial Credit Table Understanding Benchmark
por: Yakun, Cui, et al.
Publicado: (2026) -
BAMAS: Structuring Budget-Aware Multi-Agent Systems
por: Yang, Liming, et al.
Publicado: (2025)