DianJin-R1: Evaluating and Enhancing Financial Reasoning in Large Language Models
Fuente:
arXiv
Salvato in:
| Autori principali: | Zhu, Jie, Chen, Qian, Dou, Huaixia, Li, Junhui, Guo, Lifan, Chen, Feng, Zhang, Chi |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
DianJin-OCR-R1: Enhancing OCR Capabilities via a Reasoning-and-Tool Interleaved Vision-Language Model
di: Chen, Qian, et al.
Pubblicazione: (2025)
di: Chen, Qian, et al.
Pubblicazione: (2025)
Benchmarking Large Language Models on CFLUE -- A Chinese Financial Language Understanding Evaluation Dataset
di: Zhu, Jie, et al.
Pubblicazione: (2024)
di: Zhu, Jie, et al.
Pubblicazione: (2024)
ESC-Skills: Discovering and Self-Evolving Skills for Emotional Support Conversations
di: Zhu, Jie, et al.
Pubblicazione: (2026)
di: Zhu, Jie, et al.
Pubblicazione: (2026)
Benchmarking Large Vision-Language Models on CFMME: A Comprehensive Chinese Financial Multimodal Evaluation Dataset
di: Chen, Qian, et al.
Pubblicazione: (2026)
di: Chen, Qian, et al.
Pubblicazione: (2026)
Evaluating, Synthesizing, and Enhancing for Customer Support Conversation
di: Zhu, Jie, et al.
Pubblicazione: (2025)
di: Zhu, Jie, et al.
Pubblicazione: (2025)
M$^3$FinMeeting: A Multilingual, Multi-Sector, and Multi-Task Financial Meeting Understanding Evaluation Dataset
di: Zhu, Jie, et al.
Pubblicazione: (2025)
di: Zhu, Jie, et al.
Pubblicazione: (2025)
Speech Translation Refinement using Large Language Models
di: Dou, Huaixia, et al.
Pubblicazione: (2025)
di: Dou, Huaixia, et al.
Pubblicazione: (2025)
FinGuard: Detecting Financial Regulatory Non-Compliance in LLM Interactions
di: Dou, Huaixia, et al.
Pubblicazione: (2026)
di: Dou, Huaixia, et al.
Pubblicazione: (2026)
FinMCP-Bench: Benchmarking LLM Agents for Real-World Financial Tool Use under the Model Context Protocol
di: Zhu, Jie, et al.
Pubblicazione: (2026)
di: Zhu, Jie, et al.
Pubblicazione: (2026)
Fin-PRM: A Domain-Specialized Process Reward Model for Financial Reasoning in Large Language Models
di: Zhu, Jie, et al.
Pubblicazione: (2025)
di: Zhu, Jie, et al.
Pubblicazione: (2025)
Modeling Multiple Support Strategies within a Single Turn for Emotional Support Conversations
di: Zhu, Jie, et al.
Pubblicazione: (2026)
di: Zhu, Jie, et al.
Pubblicazione: (2026)
CARE: Cognitive-reasoning Augmented Reinforcement for Emotional Support Conversation
di: Zhu, Jie, et al.
Pubblicazione: (2025)
di: Zhu, Jie, et al.
Pubblicazione: (2025)
LingLanMiDian: Systematic Evaluation of LLMs on TCM Knowledge and Clinical Reasoning
di: Hua, Rui, et al.
Pubblicazione: (2026)
di: Hua, Rui, et al.
Pubblicazione: (2026)
Reasoning or Overthinking: Evaluating Large Language Models on Financial Sentiment Analysis
di: Vamvourellis, Dimitris, et al.
Pubblicazione: (2025)
di: Vamvourellis, Dimitris, et al.
Pubblicazione: (2025)
FinLLMs: A Framework for Financial Reasoning Dataset Generation with Large Language Models
di: Yuan, Ziqiang, et al.
Pubblicazione: (2024)
di: Yuan, Ziqiang, et al.
Pubblicazione: (2024)
Code-driven Number Sequence Calculation: Enhancing the inductive Reasoning Abilities of Large Language Models
di: Chen, Kedi, et al.
Pubblicazione: (2025)
di: Chen, Kedi, et al.
Pubblicazione: (2025)
JT-DA: Enhancing Data Analysis with Tool-Integrated Table Reasoning Large Language Models
di: Chi, Ce, et al.
Pubblicazione: (2025)
di: Chi, Ce, et al.
Pubblicazione: (2025)
Premise Order Matters in Reasoning with Large Language Models
di: Chen, Xinyun, et al.
Pubblicazione: (2024)
di: Chen, Xinyun, et al.
Pubblicazione: (2024)
Evaluating Large Language Models for Financial Reasoning: A CFA-Based Benchmark Study
di: Yao, Xuan, et al.
Pubblicazione: (2025)
di: Yao, Xuan, et al.
Pubblicazione: (2025)
Cumulative Reasoning with Large Language Models
di: Zhang, Yifan, et al.
Pubblicazione: (2023)
di: Zhang, Yifan, et al.
Pubblicazione: (2023)
FLAME: Financial Large-Language Model Assessment and Metrics Evaluation
di: Guo, Jiayu, et al.
Pubblicazione: (2025)
di: Guo, Jiayu, et al.
Pubblicazione: (2025)
Reasoning Relay: Evaluating Stability and Interchangeability of Large Language Models in Mathematical Reasoning
di: Lu, Leo, et al.
Pubblicazione: (2025)
di: Lu, Leo, et al.
Pubblicazione: (2025)
CP-Env: Evaluating Large Language Models on Clinical Pathways in a Controllable Hospital Environment
di: Zhu, Yakun, et al.
Pubblicazione: (2025)
di: Zhu, Yakun, et al.
Pubblicazione: (2025)
TReB: A Comprehensive Benchmark for Evaluating Table Reasoning Capabilities of Large Language Models
di: Li, Ce, et al.
Pubblicazione: (2025)
di: Li, Ce, et al.
Pubblicazione: (2025)
Meta-R1: Empowering Large Reasoning Models with Metacognition
di: Dong, Haonan, et al.
Pubblicazione: (2025)
di: Dong, Haonan, et al.
Pubblicazione: (2025)
Search-o1: Agentic Search-Enhanced Large Reasoning Models
di: Li, Xiaoxi, et al.
Pubblicazione: (2025)
di: Li, Xiaoxi, et al.
Pubblicazione: (2025)
Innate Reasoning is Not Enough: In-Context Learning Enhances Reasoning Large Language Models with Less Overthinking
di: Ge, Yuyao, et al.
Pubblicazione: (2025)
di: Ge, Yuyao, et al.
Pubblicazione: (2025)
Enhancing Serendipity Recommendation System by Constructing Dynamic User Knowledge Graphs with Large Language Models
di: Yong, Qian, et al.
Pubblicazione: (2025)
di: Yong, Qian, et al.
Pubblicazione: (2025)
Advanced Financial Reasoning at Scale: A Comprehensive Evaluation of Large Language Models on CFA Level III
di: Shetty, Pranam, et al.
Pubblicazione: (2025)
di: Shetty, Pranam, et al.
Pubblicazione: (2025)
Survey on Knowledge Distillation for Large Language Models: Methods, Evaluation, and Application
di: Yang, Chuanpeng, et al.
Pubblicazione: (2024)
di: Yang, Chuanpeng, et al.
Pubblicazione: (2024)
Are Large Language Models Capable of Deep Relational Reasoning? Insights from DeepSeek-R1 and Benchmark Comparisons
di: So, Chi Chiu, et al.
Pubblicazione: (2025)
di: So, Chi Chiu, et al.
Pubblicazione: (2025)
Who Reasons in the Large Language Models?
di: Shao, Jie, et al.
Pubblicazione: (2025)
di: Shao, Jie, et al.
Pubblicazione: (2025)
Evaluating and Enhancing Large Language Models for Conversational Reasoning on Knowledge Graphs
di: Huang, Yuxuan
Pubblicazione: (2023)
di: Huang, Yuxuan
Pubblicazione: (2023)
Enhance Reasoning for Large Language Models in the Game Werewolf
di: Wu, Shuang, et al.
Pubblicazione: (2024)
di: Wu, Shuang, et al.
Pubblicazione: (2024)
StrucText-Eval: Evaluating Large Language Model's Reasoning Ability in Structure-Rich Text
di: Gu, Zhouhong, et al.
Pubblicazione: (2024)
di: Gu, Zhouhong, et al.
Pubblicazione: (2024)
DyVal: Dynamic Evaluation of Large Language Models for Reasoning Tasks
di: Zhu, Kaijie, et al.
Pubblicazione: (2023)
di: Zhu, Kaijie, et al.
Pubblicazione: (2023)
FEVO: Financial Knowledge Expansion and Reasoning Evolution for Large Language Models
di: Pang, Bo, et al.
Pubblicazione: (2025)
di: Pang, Bo, et al.
Pubblicazione: (2025)
KnowledgeBerg: Evaluating Systematic Knowledge Coverage and Compositional Reasoning in Large Language Models
di: Zhang, Xiao, et al.
Pubblicazione: (2026)
di: Zhang, Xiao, et al.
Pubblicazione: (2026)
LAST: Leveraging Tools as Hints to Enhance Spatial Reasoning for Multimodal Large Language Models
di: Tian, Shi-Yu, et al.
Pubblicazione: (2026)
di: Tian, Shi-Yu, et al.
Pubblicazione: (2026)
A Survey of Inductive Reasoning for Large Language Models
di: Chen, Kedi, et al.
Pubblicazione: (2025)
di: Chen, Kedi, et al.
Pubblicazione: (2025)
Documenti analoghi
-
DianJin-OCR-R1: Enhancing OCR Capabilities via a Reasoning-and-Tool Interleaved Vision-Language Model
di: Chen, Qian, et al.
Pubblicazione: (2025) -
Benchmarking Large Language Models on CFLUE -- A Chinese Financial Language Understanding Evaluation Dataset
di: Zhu, Jie, et al.
Pubblicazione: (2024) -
ESC-Skills: Discovering and Self-Evolving Skills for Emotional Support Conversations
di: Zhu, Jie, et al.
Pubblicazione: (2026) -
Benchmarking Large Vision-Language Models on CFMME: A Comprehensive Chinese Financial Multimodal Evaluation Dataset
di: Chen, Qian, et al.
Pubblicazione: (2026) -
Evaluating, Synthesizing, and Enhancing for Customer Support Conversation
di: Zhu, Jie, et al.
Pubblicazione: (2025)