Plutus: Benchmarking Large Language Models in Low-Resource Greek Finance
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Peng, Xueqing, Papadopoulos, Triantafillos, Soufleri, Efstathia, Giannouris, Polydoros, Xiang, Ruoyu, Wang, Yan, Qian, Lingfei, Huang, Jimin, Xie, Qianqian, Ananiadou, Sophia |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
NOMAD: A Multi-Agent LLM System for UML Class Diagram Generation from Natural Language Requirements
par: Giannouris, Polydoros, et autres
Publié: (2025)
par: Giannouris, Polydoros, et autres
Publié: (2025)
Moira: Language-driven Hierarchical Reinforcement Learning for Pair Trading
par: Giannouris, Polydoros, et autres
Publié: (2026)
par: Giannouris, Polydoros, et autres
Publié: (2026)
Ebisu: Benchmarking Large Language Models in Japanese Finance
par: Peng, Xueqing, et autres
Publié: (2026)
par: Peng, Xueqing, et autres
Publié: (2026)
MMAFFBen: A Multilingual and Multimodal Affective Analysis Benchmark for Evaluating LLMs and VLMs
par: Liu, Zhiwei, et autres
Publié: (2025)
par: Liu, Zhiwei, et autres
Publié: (2025)
Semantic Label Drift in Cross-Cultural Translation
par: Kabir, Mohsinul, et autres
Publié: (2025)
par: Kabir, Mohsinul, et autres
Publié: (2025)
Same Claim, Different Judgment: Benchmarking Scenario-Induced Bias in Multilingual Financial Misinformation Detection
par: Liu, Zhiwei, et autres
Publié: (2026)
par: Liu, Zhiwei, et autres
Publié: (2026)
OrdRankBen: A Novel Ranking Benchmark for Ordinal Relevance in NLP
par: Wang, Yan, et autres
Publié: (2025)
par: Wang, Yan, et autres
Publié: (2025)
Fino1: On the Transferability of Reasoning-Enhanced LLMs and Reinforcement Learning to Finance
par: Qian, Lingfei, et autres
Publié: (2025)
par: Qian, Lingfei, et autres
Publié: (2025)
MultiFinBen: Benchmarking Large Language Models for Multilingual and Multimodal Financial Application
par: Peng, Xueqing, et autres
Publié: (2025)
par: Peng, Xueqing, et autres
Publié: (2025)
Advancing Compressed Video Action Recognition through Progressive Knowledge Distillation
par: Soufleri, Efstathia, et autres
Publié: (2024)
par: Soufleri, Efstathia, et autres
Publié: (2024)
Curvature Clues: Decoding Deep Learning Privacy with Input Loss Curvature
par: Ravikumar, Deepak, et autres
Publié: (2024)
par: Ravikumar, Deepak, et autres
Publié: (2024)
The Lay Person's Guide to Biomedicine: Orchestrating Large Language Models
par: Luo, Zheheng, et autres
Publié: (2024)
par: Luo, Zheheng, et autres
Publié: (2024)
FinCriticalED: A Visual Benchmark for Financial Fact-Level OCR
par: He, Yueru, et autres
Publié: (2025)
par: He, Yueru, et autres
Publié: (2025)
Are Large Language Models True Healthcare Jacks-of-All-Trades? Benchmarking Across Health Professions Beyond Physician Exams
par: Luo, Zheheng, et autres
Publié: (2024)
par: Luo, Zheheng, et autres
Publié: (2024)
FMDLlama: Financial Misinformation Detection based on Large Language Models
par: Liu, Zhiwei, et autres
Publié: (2024)
par: Liu, Zhiwei, et autres
Publié: (2024)
MentaLLaMA: Interpretable Mental Health Analysis on Social Media with Large Language Models
par: Yang, Kailai, et autres
Publié: (2023)
par: Yang, Kailai, et autres
Publié: (2023)
Can LLM Agents Be CFOs? Benchmarking Long-Horizon Resource Allocation in an Uncertain Enterprise Environment
par: Han, Yi, et autres
Publié: (2026)
par: Han, Yi, et autres
Publié: (2026)
Unveiling Privacy, Memorization, and Input Curvature Links
par: Ravikumar, Deepak, et autres
Publié: (2024)
par: Ravikumar, Deepak, et autres
Publié: (2024)
Finding the Muses: Identifying Coresets through Loss Trajectories
par: Nagaraj, Manish, et autres
Publié: (2025)
par: Nagaraj, Manish, et autres
Publié: (2025)
No Language is an Island: Unifying Chinese and English in Financial Large Language Models, Instruction Data, and Benchmarks
par: Hu, Gang, et autres
Publié: (2024)
par: Hu, Gang, et autres
Publié: (2024)
Factual consistency evaluation of summarization in the Era of large language models
par: Luo, Zheheng, et autres
Publié: (2024)
par: Luo, Zheheng, et autres
Publié: (2024)
MetaAligner: Towards Generalizable Multi-Objective Alignment of Language Models
par: Yang, Kailai, et autres
Publié: (2024)
par: Yang, Kailai, et autres
Publié: (2024)
Selective Preference Optimization via Token-Level Reward Function Estimation
par: Yang, Kailai, et autres
Publié: (2024)
par: Yang, Kailai, et autres
Publié: (2024)
Towards Scalable Modeling of Compressed Videos for Efficient Action Recognition
par: Biswas, Shristi Das, et autres
Publié: (2025)
par: Biswas, Shristi Das, et autres
Publié: (2025)
LongDocFACTScore: Evaluating the Factuality of Long Document Abstractive Summarisation
par: Bishop, Jennifer A, et autres
Publié: (2023)
par: Bishop, Jennifer A, et autres
Publié: (2023)
Retrieval-augmented Large Language Models for Financial Time Series Forecasting
par: Xiao, Mengxi, et autres
Publié: (2025)
par: Xiao, Mengxi, et autres
Publié: (2025)
EmoLLMs: A Series of Emotional Large Language Models and Annotation Tools for Comprehensive Affective Analysis
par: Liu, Zhiwei, et autres
Publié: (2024)
par: Liu, Zhiwei, et autres
Publié: (2024)
Dólares or Dollars? Unraveling the Bilingual Prowess of Financial LLMs Between Spanish and English
par: Zhang, Xiao, et autres
Publié: (2024)
par: Zhang, Xiao, et autres
Publié: (2024)
When Agents Trade: Live Multi-Market Trading Benchmark for LLM Agents
par: Qian, Lingfei, et autres
Publié: (2025)
par: Qian, Lingfei, et autres
Publié: (2025)
Towards Interpretable Mental Health Analysis with Large Language Models
par: Yang, Kailai, et autres
Publié: (2023)
par: Yang, Kailai, et autres
Publié: (2023)
Neuron-Level Knowledge Attribution in Large Language Models
par: Yu, Zeping, et autres
Publié: (2023)
par: Yu, Zeping, et autres
Publié: (2023)
Interpreting Arithmetic Mechanism in Large Language Models through Comparative Neuron Analysis
par: Yu, Zeping, et autres
Publié: (2024)
par: Yu, Zeping, et autres
Publié: (2024)
HARMONIC: Harnessing LLMs for Tabular Data Synthesis and Privacy Protection
par: Wang, Yuxin, et autres
Publié: (2024)
par: Wang, Yuxin, et autres
Publié: (2024)
How do Large Language Models Learn In-Context? Query and Key Matrices of In-Context Heads are Two Towers for Metric Learning
par: Yu, Zeping, et autres
Publié: (2024)
par: Yu, Zeping, et autres
Publié: (2024)
Appear2Meaning: A Cross-Cultural Benchmark for Structured Cultural Metadata Inference from Images
par: Jiang, Yuechen, et autres
Publié: (2026)
par: Jiang, Yuechen, et autres
Publié: (2026)
FinAudio: A Benchmark for Audio Large Language Models in Financial Applications
par: Cao, Yupeng, et autres
Publié: (2025)
par: Cao, Yupeng, et autres
Publié: (2025)
INVESTORBENCH: A Benchmark for Financial Decision-Making Tasks with LLM-based Agent
par: Li, Haohang, et autres
Publié: (2024)
par: Li, Haohang, et autres
Publié: (2024)
FLAG-Trader: Fusion LLM-Agent with Gradient-based Reinforcement Learning for Financial Trading
par: Xiong, Guojun, et autres
Publié: (2025)
par: Xiong, Guojun, et autres
Publié: (2025)
RAAR: Retrieval Augmented Agentic Reasoning for Cross-Domain Misinformation Detection
par: Liu, Zhiwei, et autres
Publié: (2026)
par: Liu, Zhiwei, et autres
Publié: (2026)
Back Attention: Understanding and Enhancing Multi-Hop Reasoning in Large Language Models
par: Yu, Zeping, et autres
Publié: (2025)
par: Yu, Zeping, et autres
Publié: (2025)
Documents similaires
-
NOMAD: A Multi-Agent LLM System for UML Class Diagram Generation from Natural Language Requirements
par: Giannouris, Polydoros, et autres
Publié: (2025) -
Moira: Language-driven Hierarchical Reinforcement Learning for Pair Trading
par: Giannouris, Polydoros, et autres
Publié: (2026) -
Ebisu: Benchmarking Large Language Models in Japanese Finance
par: Peng, Xueqing, et autres
Publié: (2026) -
MMAFFBen: A Multilingual and Multimodal Affective Analysis Benchmark for Evaluating LLMs and VLMs
par: Liu, Zhiwei, et autres
Publié: (2025) -
Semantic Label Drift in Cross-Cultural Translation
par: Kabir, Mohsinul, et autres
Publié: (2025)