Beyond the Reported Cutoff: Where Large Language Models Fall Short on Financial Knowledge
Fuente:
arXiv
Saved in:
| Main Authors: | Shah, Agam, Ye, Liqin, Jaskowski, Sebastian, Xu, Wei, Chava, Sudheer |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
BERTScoreVisualizer: A Web Tool for Understanding Simplified Text Evaluation with BERTScore
by: Jaskowski, Sebastian, et al.
Published: (2024)
by: Jaskowski, Sebastian, et al.
Published: (2024)
Calibrating Pre-trained Language Classifiers on LLM-generated Noisy Labels via Iterative Refinement
by: Ye, Liqin, et al.
Published: (2025)
by: Ye, Liqin, et al.
Published: (2025)
Language Modeling for the Future of Finance: A Survey into Metrics, Tasks, and Data Opportunities
by: Tatarinov, Nikita, et al.
Published: (2025)
by: Tatarinov, Nikita, et al.
Published: (2025)
FiNER-ORD: Financial Named Entity Recognition Open Research Dataset
by: Shah, Agam, et al.
Published: (2023)
by: Shah, Agam, et al.
Published: (2023)
Numerical Claim Detection in Finance: A New Financial Dataset, Weak-Supervision Model, and Market Analysis
by: Shah, Agam, et al.
Published: (2024)
by: Shah, Agam, et al.
Published: (2024)
How Inclusively do LMs Perceive Social and Moral Norms?
by: Galarnyk, Michael, et al.
Published: (2025)
by: Galarnyk, Michael, et al.
Published: (2025)
CoCoHD: Congress Committee Hearing Dataset
by: Hiray, Arnav, et al.
Published: (2024)
by: Hiray, Arnav, et al.
Published: (2024)
Precise Attribute Intensity Control in Large Language Models via Targeted Representation Editing
by: Zhang, Rongzhi, et al.
Published: (2025)
by: Zhang, Rongzhi, et al.
Published: (2025)
FinCap: Topic-Aligned Captions for Short-Form Financial YouTube Videos
by: Sukhani, Siddhant, et al.
Published: (2025)
by: Sukhani, Siddhant, et al.
Published: (2025)
ConfReady: A RAG based Assistant and Dataset for Conference Checklist Responses
by: Galarnyk, Michael, et al.
Published: (2024)
by: Galarnyk, Michael, et al.
Published: (2024)
VideoConviction: A Multimodal Benchmark for Human Conviction and Stock Market Recommendations
by: Galarnyk, Michael, et al.
Published: (2025)
by: Galarnyk, Michael, et al.
Published: (2025)
Financial Instruction Following Evaluation (FIFE)
by: Matlin, Glenn, et al.
Published: (2025)
by: Matlin, Glenn, et al.
Published: (2025)
Finance Language Model Evaluation (FLaME)
by: Matlin, Glenn, et al.
Published: (2025)
by: Matlin, Glenn, et al.
Published: (2025)
Words That Unite The World: A Unified Framework for Deciphering Central Bank Communications Globally
by: Shah, Agam, et al.
Published: (2025)
by: Shah, Agam, et al.
Published: (2025)
Dated Data: Tracing Knowledge Cutoffs in Large Language Models
by: Cheng, Jeffrey, et al.
Published: (2024)
by: Cheng, Jeffrey, et al.
Published: (2024)
KG-MuLQA: A Framework for KG-based Multi-Level QA Extraction and Long-Context LLM Evaluation
by: Tatarinov, Nikita, et al.
Published: (2025)
by: Tatarinov, Nikita, et al.
Published: (2025)
Financial Knowledge Large Language Model
by: Yang, Cehao, et al.
Published: (2024)
by: Yang, Cehao, et al.
Published: (2024)
SubjECTive-QA: Measuring Subjectivity in Earnings Call Transcripts' QA Through Six-Dimensional Feature Analysis
by: Pardawala, Huzaifa, et al.
Published: (2024)
by: Pardawala, Huzaifa, et al.
Published: (2024)
Arctic-Extract Technical Report
by: Chiliński, Mateusz, et al.
Published: (2025)
by: Chiliński, Mateusz, et al.
Published: (2025)
Tokenization Falling Short: On Subword Robustness in Large Language Models
by: Chai, Yekun, et al.
Published: (2024)
by: Chai, Yekun, et al.
Published: (2024)
Large Language Models Fall Short: Understanding Complex Relationships in Detective Narratives
by: Zhao, Runcong, et al.
Published: (2024)
by: Zhao, Runcong, et al.
Published: (2024)
IPO-Mine: A Toolkit and Dataset for Section-Structured Analysis of Long, Multimodal IPO Documents
by: Galarnyk, Michael, et al.
Published: (2026)
by: Galarnyk, Michael, et al.
Published: (2026)
Shifting Cryptocurrency Influence: A High-Resolution Network Analysis of Market Leaders
by: Hiray, Arnav, et al.
Published: (2023)
by: Hiray, Arnav, et al.
Published: (2023)
Knowledge-Augmented Large Language Model Agents for Explainable Financial Decision-Making
by: Zhang, Qingyuan, et al.
Published: (2025)
by: Zhang, Qingyuan, et al.
Published: (2025)
FinEval: A Chinese Financial Domain Knowledge Evaluation Benchmark for Large Language Models
by: Guo, Xin, et al.
Published: (2023)
by: Guo, Xin, et al.
Published: (2023)
Large Language Models as Financial Data Annotators: A Study on Effectiveness and Efficiency
by: Aguda, Toyin, et al.
Published: (2024)
by: Aguda, Toyin, et al.
Published: (2024)
FinEval-KR: A Financial Domain Evaluation Framework for Large Language Models' Knowledge and Reasoning
by: Dou, Shaoyu, et al.
Published: (2025)
by: Dou, Shaoyu, et al.
Published: (2025)
WeaverBird: Empowering Financial Decision-Making with Large Language Model, Knowledge Base, and Search Engine
by: Xue, Siqiao, et al.
Published: (2023)
by: Xue, Siqiao, et al.
Published: (2023)
Evaluating Large Language Models on Financial Report Summarization: An Empirical Study
by: Yang, Xinqi, et al.
Published: (2024)
by: Yang, Xinqi, et al.
Published: (2024)
Structure-aware Domain Knowledge Injection for Large Language Models
by: Liu, Kai, et al.
Published: (2024)
by: Liu, Kai, et al.
Published: (2024)
Knowledge Fusion of Large Language Models
by: Wan, Fanqi, et al.
Published: (2024)
by: Wan, Fanqi, et al.
Published: (2024)
Pre-trained Large Language Models for Financial Sentiment Analysis
by: Luo, Wei, et al.
Published: (2024)
by: Luo, Wei, et al.
Published: (2024)
Long-Tail Knowledge in Large Language Models: Taxonomy, Mechanisms, Interventions and Implications
by: Badhe, Sanket, et al.
Published: (2026)
by: Badhe, Sanket, et al.
Published: (2026)
Knowledge Graph Enhanced Large Language Model Editing
by: Zhang, Mengqi, et al.
Published: (2024)
by: Zhang, Mengqi, et al.
Published: (2024)
Are Large Language Models Good In-context Learners for Financial Sentiment Analysis?
by: Wei, Xinyu, et al.
Published: (2025)
by: Wei, Xinyu, et al.
Published: (2025)
Functional Abstraction of Knowledge Recall in Large Language Models
by: Wang, Zijian, et al.
Published: (2025)
by: Wang, Zijian, et al.
Published: (2025)
Simulating Financial Market via Large Language Model based Agents
by: Gao, Shen, et al.
Published: (2024)
by: Gao, Shen, et al.
Published: (2024)
Disentangling Knowledge Representations for Large Language Model Editing
by: Zhang, Mengqi, et al.
Published: (2025)
by: Zhang, Mengqi, et al.
Published: (2025)
Why Did Apple Fall: Evaluating Curiosity in Large Language Models
by: Wang, Haoyu, et al.
Published: (2025)
by: Wang, Haoyu, et al.
Published: (2025)
Why Does the Effective Context Length of LLMs Fall Short?
by: An, Chenxin, et al.
Published: (2024)
by: An, Chenxin, et al.
Published: (2024)
Similar Items
-
BERTScoreVisualizer: A Web Tool for Understanding Simplified Text Evaluation with BERTScore
by: Jaskowski, Sebastian, et al.
Published: (2024) -
Calibrating Pre-trained Language Classifiers on LLM-generated Noisy Labels via Iterative Refinement
by: Ye, Liqin, et al.
Published: (2025) -
Language Modeling for the Future of Finance: A Survey into Metrics, Tasks, and Data Opportunities
by: Tatarinov, Nikita, et al.
Published: (2025) -
FiNER-ORD: Financial Named Entity Recognition Open Research Dataset
by: Shah, Agam, et al.
Published: (2023) -
Numerical Claim Detection in Finance: A New Financial Dataset, Weak-Supervision Model, and Market Analysis
by: Shah, Agam, et al.
Published: (2024)