FinBen: A Holistic Financial Benchmark for Large Language Models
Fuente:
arXiv
Salvato in:
| Autori principali: | Xie, Qianqian, Han, Weiguang, Chen, Zhengyu, Xiang, Ruoyu, Zhang, Xiao, He, Yueru, Xiao, Mengxi, Li, Dong, Dai, Yongfu, Feng, Duanyu, Xu, Yijing, Kang, Haoqiang, Kuang, Ziyan, Yuan, Chenhan, Yang, Kailai, Luo, Zheheng, Zhang, Tianlin, Liu, Zhiwei, Xiong, Guojun, Deng, Zhiyang, Jiang, Yuechen, Yao, Zhiyuan, Li, Haohang, Yu, Yangyang, Hu, Gang, Huang, Jiajia, Liu, Xiao-Yang, Lopez-Lira, Alejandro, Wang, Benyou, Lai, Yanzhao, Wang, Hao, Peng, Min, Ananiadou, Sophia, Huang, Jimin |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
MentaLLaMA: Interpretable Mental Health Analysis on Social Media with Large Language Models
di: Yang, Kailai, et al.
Pubblicazione: (2023)
di: Yang, Kailai, et al.
Pubblicazione: (2023)
HealMe: Harnessing Cognitive Reframing in Large Language Models for Psychotherapy
di: Xiao, Mengxi, et al.
Pubblicazione: (2024)
di: Xiao, Mengxi, et al.
Pubblicazione: (2024)
HARMONIC: Harnessing LLMs for Tabular Data Synthesis and Privacy Protection
di: Wang, Yuxin, et al.
Pubblicazione: (2024)
di: Wang, Yuxin, et al.
Pubblicazione: (2024)
Dólares or Dollars? Unraveling the Bilingual Prowess of Financial LLMs Between Spanish and English
di: Zhang, Xiao, et al.
Pubblicazione: (2024)
di: Zhang, Xiao, et al.
Pubblicazione: (2024)
MetaAligner: Towards Generalizable Multi-Objective Alignment of Language Models
di: Yang, Kailai, et al.
Pubblicazione: (2024)
di: Yang, Kailai, et al.
Pubblicazione: (2024)
Are Large Language Models True Healthcare Jacks-of-All-Trades? Benchmarking Across Health Professions Beyond Physician Exams
di: Luo, Zheheng, et al.
Pubblicazione: (2024)
di: Luo, Zheheng, et al.
Pubblicazione: (2024)
Retrieval-augmented Large Language Models for Financial Time Series Forecasting
di: Xiao, Mengxi, et al.
Pubblicazione: (2025)
di: Xiao, Mengxi, et al.
Pubblicazione: (2025)
Empowering Many, Biasing a Few: Generalist Credit Scoring through Large Language Models
di: Feng, Duanyu, et al.
Pubblicazione: (2023)
di: Feng, Duanyu, et al.
Pubblicazione: (2023)
Towards Interpretable Mental Health Analysis with Large Language Models
di: Yang, Kailai, et al.
Pubblicazione: (2023)
di: Yang, Kailai, et al.
Pubblicazione: (2023)
Open-FinLLMs: Open Multimodal Large Language Models for Financial Applications
di: Huang, Jimin, et al.
Pubblicazione: (2024)
di: Huang, Jimin, et al.
Pubblicazione: (2024)
MentraSuite: Post-Training Large Language Models for Mental Health Reasoning and Assessment
di: Xiao, Mengxi, et al.
Pubblicazione: (2025)
di: Xiao, Mengxi, et al.
Pubblicazione: (2025)
LAiW: A Chinese Legal Large Language Models Benchmark
di: Dai, Yongfu, et al.
Pubblicazione: (2023)
di: Dai, Yongfu, et al.
Pubblicazione: (2023)
Moira: Language-driven Hierarchical Reinforcement Learning for Pair Trading
di: Giannouris, Polydoros, et al.
Pubblicazione: (2026)
di: Giannouris, Polydoros, et al.
Pubblicazione: (2026)
EmoLLMs: A Series of Emotional Large Language Models and Annotation Tools for Comprehensive Affective Analysis
di: Liu, Zhiwei, et al.
Pubblicazione: (2024)
di: Liu, Zhiwei, et al.
Pubblicazione: (2024)
FLAG-Trader: Fusion LLM-Agent with Gradient-based Reinforcement Learning for Financial Trading
di: Xiong, Guojun, et al.
Pubblicazione: (2025)
di: Xiong, Guojun, et al.
Pubblicazione: (2025)
Factual consistency evaluation of summarization in the Era of large language models
di: Luo, Zheheng, et al.
Pubblicazione: (2024)
di: Luo, Zheheng, et al.
Pubblicazione: (2024)
The Lay Person's Guide to Biomedicine: Orchestrating Large Language Models
di: Luo, Zheheng, et al.
Pubblicazione: (2024)
di: Luo, Zheheng, et al.
Pubblicazione: (2024)
MMAFFBen: A Multilingual and Multimodal Affective Analysis Benchmark for Evaluating LLMs and VLMs
di: Liu, Zhiwei, et al.
Pubblicazione: (2025)
di: Liu, Zhiwei, et al.
Pubblicazione: (2025)
Selective Preference Optimization via Token-Level Reward Function Estimation
di: Yang, Kailai, et al.
Pubblicazione: (2024)
di: Yang, Kailai, et al.
Pubblicazione: (2024)
FMDLlama: Financial Misinformation Detection based on Large Language Models
di: Liu, Zhiwei, et al.
Pubblicazione: (2024)
di: Liu, Zhiwei, et al.
Pubblicazione: (2024)
Generalized Mazur Patterns and Immersed Heegaard Floer Homology
di: Patwardhan, Jay, et al.
Pubblicazione: (2024)
di: Patwardhan, Jay, et al.
Pubblicazione: (2024)
No Language is an Island: Unifying Chinese and English in Financial Large Language Models, Instruction Data, and Benchmarks
di: Hu, Gang, et al.
Pubblicazione: (2024)
di: Hu, Gang, et al.
Pubblicazione: (2024)
MFMDQwen: Multilingual Financial Misinformation Detection Based on Large Language Model
di: Liu, Zhiwei, et al.
Pubblicazione: (2026)
di: Liu, Zhiwei, et al.
Pubblicazione: (2026)
INVESTORBENCH: A Benchmark for Financial Decision-Making Tasks with LLM-based Agent
di: Li, Haohang, et al.
Pubblicazione: (2024)
di: Li, Haohang, et al.
Pubblicazione: (2024)
All That Glisters Is Not Gold: A Benchmark for Reference-Free Counterfactual Financial Misinformation Detection
di: Jiang, Yuechen, et al.
Pubblicazione: (2026)
di: Jiang, Yuechen, et al.
Pubblicazione: (2026)
Emotion Detection for Misinformation: A Review
di: Liu, Zhiwei, et al.
Pubblicazione: (2023)
di: Liu, Zhiwei, et al.
Pubblicazione: (2023)
FinAudio: A Benchmark for Audio Large Language Models in Financial Applications
di: Cao, Yupeng, et al.
Pubblicazione: (2025)
di: Cao, Yupeng, et al.
Pubblicazione: (2025)
Concordia: Self-Improving Synthetic Tables for Federated LLMs
di: Huang, Jimin, et al.
Pubblicazione: (2026)
di: Huang, Jimin, et al.
Pubblicazione: (2026)
MultiFinBen: Benchmarking Large Language Models for Multilingual and Multimodal Financial Application
di: Peng, Xueqing, et al.
Pubblicazione: (2025)
di: Peng, Xueqing, et al.
Pubblicazione: (2025)
FinCriticalED: A Visual Benchmark for Financial Fact-Level OCR
di: He, Yueru, et al.
Pubblicazione: (2025)
di: He, Yueru, et al.
Pubblicazione: (2025)
Limits of Residual-Based Detection for Physically Consistent False Data Injection
di: Xiao, Chenhan, et al.
Pubblicazione: (2026)
di: Xiao, Chenhan, et al.
Pubblicazione: (2026)
Field imaging framework for morphological characterization of aggregates with computer vision: Algorithms and applications
di: Huang, Haohang
Pubblicazione: (2026)
di: Huang, Haohang
Pubblicazione: (2026)
Natural Language Processing for Cardiology: A Narrative Review
di: Yang, Kailai, et al.
Pubblicazione: (2025)
di: Yang, Kailai, et al.
Pubblicazione: (2025)
DITING: A Multi-Agent Evaluation Framework for Benchmarking Web Novel Translation
di: Zhang, Enze, et al.
Pubblicazione: (2025)
di: Zhang, Enze, et al.
Pubblicazione: (2025)
Associations of aged neutrophils with disease activity in primary Sjögren's syndrome
di: Lei Han, et al.
Pubblicazione: (2025)
di: Lei Han, et al.
Pubblicazione: (2025)
Rumor Detection by Multi-task Suffix Learning based on Time-series Dual Sentiments
di: Liu, Zhiwei, et al.
Pubblicazione: (2025)
di: Liu, Zhiwei, et al.
Pubblicazione: (2025)
When Agents Trade: Live Multi-Market Trading Benchmark for LLM Agents
di: Qian, Lingfei, et al.
Pubblicazione: (2025)
di: Qian, Lingfei, et al.
Pubblicazione: (2025)
Determinants of Financial Development
di: Huang, Yongfu
Pubblicazione: (2011)
di: Huang, Yongfu
Pubblicazione: (2011)
UCFE: A User-Centric Financial Expertise Benchmark for Large Language Models
di: Yang, Yuzhe, et al.
Pubblicazione: (2024)
di: Yang, Yuzhe, et al.
Pubblicazione: (2024)
OrdRankBen: A Novel Ranking Benchmark for Ordinal Relevance in NLP
di: Wang, Yan, et al.
Pubblicazione: (2025)
di: Wang, Yan, et al.
Pubblicazione: (2025)
Documenti analoghi
-
MentaLLaMA: Interpretable Mental Health Analysis on Social Media with Large Language Models
di: Yang, Kailai, et al.
Pubblicazione: (2023) -
HealMe: Harnessing Cognitive Reframing in Large Language Models for Psychotherapy
di: Xiao, Mengxi, et al.
Pubblicazione: (2024) -
HARMONIC: Harnessing LLMs for Tabular Data Synthesis and Privacy Protection
di: Wang, Yuxin, et al.
Pubblicazione: (2024) -
Dólares or Dollars? Unraveling the Bilingual Prowess of Financial LLMs Between Spanish and English
di: Zhang, Xiao, et al.
Pubblicazione: (2024) -
MetaAligner: Towards Generalizable Multi-Objective Alignment of Language Models
di: Yang, Kailai, et al.
Pubblicazione: (2024)