Assessing Consistency and Reproducibility in the Outputs of Large Language Models: Evidence Across Diverse Finance and Accounting Tasks
Fuente:
arXiv
Saved in:
| Main Authors: | Wang, Julian Junyan, Wang, Victor Xiaoqi |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Leveraging Large Language Models to Democratize Access to Costly Datasets for Academic Research
by: Wang, Julian Junyan, et al.
Published: (2024)
by: Wang, Julian Junyan, et al.
Published: (2024)
A Scoping Review of ChatGPT Research in Accounting and Finance
by: Dong, Mengming Michael, et al.
Published: (2024)
by: Dong, Mengming Michael, et al.
Published: (2024)
NumLLM: Numeric-Sensitive Large Language Model for Chinese Finance
by: Su, Huan-Yi, et al.
Published: (2024)
by: Su, Huan-Yi, et al.
Published: (2024)
Large Language Models in Finance: A Survey
by: Li, Yinheng, et al.
Published: (2023)
by: Li, Yinheng, et al.
Published: (2023)
Finance Language Model Evaluation (FLaME)
by: Matlin, Glenn, et al.
Published: (2025)
by: Matlin, Glenn, et al.
Published: (2025)
EUR-USD Exchange Rate Forecasting Based on Information Fusion with Large Language Models and Deep Learning Methods
by: Ding, Hongcheng, et al.
Published: (2024)
by: Ding, Hongcheng, et al.
Published: (2024)
Empirical Asset Pricing with Large Language Model Agents
by: Cheng, Junyan, et al.
Published: (2024)
by: Cheng, Junyan, et al.
Published: (2024)
Look-Ahead-Bench: a Standardized Benchmark of Look-ahead Bias in Point-in-Time LLMs for Finance
by: Benhenda, Mostapha
Published: (2026)
by: Benhenda, Mostapha
Published: (2026)
Modeling News Interactions and Influence for Financial Market Prediction
by: Wang, Mengyu, et al.
Published: (2024)
by: Wang, Mengyu, et al.
Published: (2024)
The Agentic Regulator: Risks for AI in Finance and a Proposed Agent-based Framework for Governance
by: Kurshan, Eren, et al.
Published: (2025)
by: Kurshan, Eren, et al.
Published: (2025)
Financial Statement Analysis with Large Language Models
by: Kim, Alex, et al.
Published: (2024)
by: Kim, Alex, et al.
Published: (2024)
Mixing It Up: The Cocktail Effect of Multi-Task Fine-Tuning on LLM Performance -- A Case Study in Finance
by: Brief, Meni, et al.
Published: (2024)
by: Brief, Meni, et al.
Published: (2024)
Personalized Chain-of-Thought Summarization of Financial News for Investor Decision Support
by: Zhang, Tianyi, et al.
Published: (2025)
by: Zhang, Tianyi, et al.
Published: (2025)
Standard Benchmarks Fail -- Auditing LLM Agents in Finance Must Prioritize Risk
by: Chen, Zichen, et al.
Published: (2025)
by: Chen, Zichen, et al.
Published: (2025)
FinBen: A Holistic Financial Benchmark for Large Language Models
by: Xie, Qianqian, et al.
Published: (2024)
by: Xie, Qianqian, et al.
Published: (2024)
A Survey of Large Language Models for Financial Applications: Progress, Prospects and Challenges
by: Nie, Yuqi, et al.
Published: (2024)
by: Nie, Yuqi, et al.
Published: (2024)
Enterprise Benchmarks for Large Language Model Evaluation
by: Zhang, Bing, et al.
Published: (2024)
by: Zhang, Bing, et al.
Published: (2024)
Opportunities for Large Language Models and Discourse in Engineering Design
by: Göpfert, Jan, et al.
Published: (2023)
by: Göpfert, Jan, et al.
Published: (2023)
Evaluating Large Language Models (LLMs) in Financial NLP: A Comparative Study on Financial Report Analysis
by: Mohsin, Md Talha
Published: (2025)
by: Mohsin, Md Talha
Published: (2025)
Non-Atomic Arbitrage in Decentralized Finance
by: Heimbach, Lioba, et al.
Published: (2024)
by: Heimbach, Lioba, et al.
Published: (2024)
FLAME: Financial Large-Language Model Assessment and Metrics Evaluation
by: Guo, Jiayu, et al.
Published: (2025)
by: Guo, Jiayu, et al.
Published: (2025)
Chat Bankman-Fried: an Exploration of LLM Alignment in Finance
by: Biancotti, Claudia, et al.
Published: (2024)
by: Biancotti, Claudia, et al.
Published: (2024)
MetaBench: A Multi-task Benchmark for Assessing LLMs in Metabolomics
by: Lu, Yuxing, et al.
Published: (2025)
by: Lu, Yuxing, et al.
Published: (2025)
IdeaBench: Benchmarking Large Language Models for Research Idea Generation
by: Guo, Sikun, et al.
Published: (2024)
by: Guo, Sikun, et al.
Published: (2024)
FinBERT2: A Specialized Bidirectional Encoder for Bridging the Gap in Finance-Specific Deployment of Large Language Models
by: Xu, Xuan, et al.
Published: (2025)
by: Xu, Xuan, et al.
Published: (2025)
Computational Lesions in Multilingual Language Models Separate Shared and Language-specific Brain Alignment
by: Cui, Yang, et al.
Published: (2026)
by: Cui, Yang, et al.
Published: (2026)
A Survey of Large Language Models in Finance (FinLLMs)
by: Lee, Jean, et al.
Published: (2024)
by: Lee, Jean, et al.
Published: (2024)
Quokka: An Open-source Large Language Model ChatBot for Material Science
by: Yang, Xianjun, et al.
Published: (2024)
by: Yang, Xianjun, et al.
Published: (2024)
TCM-FTP: Fine-Tuning Large Language Models for Herbal Prescription Prediction
by: Zhou, Xingzhi, et al.
Published: (2024)
by: Zhou, Xingzhi, et al.
Published: (2024)
Distributional Semantics Tracing: A Framework for Explaining Hallucinations in Large Language Models
by: Bhatia, Gagan, et al.
Published: (2025)
by: Bhatia, Gagan, et al.
Published: (2025)
Assessing and Enhancing Large Language Models in Rare Disease Question-answering
by: Wang, Guanchu, et al.
Published: (2024)
by: Wang, Guanchu, et al.
Published: (2024)
LlaSMol: Advancing Large Language Models for Chemistry with a Large-Scale, Comprehensive, High-Quality Instruction Tuning Dataset
by: Yu, Botao, et al.
Published: (2024)
by: Yu, Botao, et al.
Published: (2024)
FiMI: A Domain-Specific Language Model for Indian Finance Ecosystem
by: Kathar, Aboli, et al.
Published: (2026)
by: Kathar, Aboli, et al.
Published: (2026)
RAMIE: Retrieval-Augmented Multi-task Information Extraction with Large Language Models on Dietary Supplements
by: Zhan, Zaifu, et al.
Published: (2024)
by: Zhan, Zaifu, et al.
Published: (2024)
Interactive DualChecker for Mitigating Hallucinations in Distilling Large Language Models
by: Wang, Meiyun, et al.
Published: (2024)
by: Wang, Meiyun, et al.
Published: (2024)
Reverse Physician-AI Relationship: Full-process Clinical Diagnosis Driven by a Large Language Model
by: Xu, Shicheng, et al.
Published: (2025)
by: Xu, Shicheng, et al.
Published: (2025)
A Financial Brain Scan of the LLM
by: Chen, Hui, et al.
Published: (2025)
by: Chen, Hui, et al.
Published: (2025)
Reasoning Models Ace the CFA Exams
by: Patel, Jaisal, et al.
Published: (2025)
by: Patel, Jaisal, et al.
Published: (2025)
Diabetica: Adapting Large Language Model to Enhance Multiple Medical Tasks in Diabetes Care and Management
by: Wei, Lai, et al.
Published: (2024)
by: Wei, Lai, et al.
Published: (2024)
Words That Unite The World: A Unified Framework for Deciphering Central Bank Communications Globally
by: Shah, Agam, et al.
Published: (2025)
by: Shah, Agam, et al.
Published: (2025)
Similar Items
-
Leveraging Large Language Models to Democratize Access to Costly Datasets for Academic Research
by: Wang, Julian Junyan, et al.
Published: (2024) -
A Scoping Review of ChatGPT Research in Accounting and Finance
by: Dong, Mengming Michael, et al.
Published: (2024) -
NumLLM: Numeric-Sensitive Large Language Model for Chinese Finance
by: Su, Huan-Yi, et al.
Published: (2024) -
Large Language Models in Finance: A Survey
by: Li, Yinheng, et al.
Published: (2023) -
Finance Language Model Evaluation (FLaME)
by: Matlin, Glenn, et al.
Published: (2025)