When Tables Go Crazy: Evaluating Multimodal Models on French Financial Documents
Fuente:
arXiv
Salvato in:
| Autori principali: | Mouilleron, Virginie, Lasnier, Théo, Mosolova, Anna, Seddah, Djamé |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Cloaked Classifiers: Pseudonymization Strategies on Sensitive Classification Tasks
di: Riabi, Arij, et al.
Pubblicazione: (2024)
di: Riabi, Arij, et al.
Pubblicazione: (2024)
Triggers Hijack Language Circuits: A Mechanistic Analysis of Backdoor Behaviors in Large Language Models
di: Lasnier, Théo, et al.
Pubblicazione: (2026)
di: Lasnier, Théo, et al.
Pubblicazione: (2026)
Beyond Dataset Creation: Critical View of Annotation Variation and Bias Probing of a Dataset for Online Radical Content Detection
di: Riabi, Arij, et al.
Pubblicazione: (2024)
di: Riabi, Arij, et al.
Pubblicazione: (2024)
Language-Switching Triggers Take a Latent Detour Through Language Models
di: Kulumba, Francis, et al.
Pubblicazione: (2026)
di: Kulumba, Francis, et al.
Pubblicazione: (2026)
Disentangling meaning from language in LLM-based machine translation
di: Lasnier, Théo, et al.
Pubblicazione: (2026)
di: Lasnier, Théo, et al.
Pubblicazione: (2026)
Multilingual, Multimodal Pipeline for Creating Authentic and Structured Fact-Checked Claim Dataset
di: Hüsünbeyi, Z. Melce, et al.
Pubblicazione: (2026)
di: Hüsünbeyi, Z. Melce, et al.
Pubblicazione: (2026)
From Text to Source: Results in Detecting Large Language Model-Generated Content
di: Antoun, Wissam, et al.
Pubblicazione: (2023)
di: Antoun, Wissam, et al.
Pubblicazione: (2023)
ModernBERT or DeBERTaV3? Examining Architecture and Data Influence on Transformer Encoder Models Performance
di: Antoun, Wissam, et al.
Pubblicazione: (2025)
di: Antoun, Wissam, et al.
Pubblicazione: (2025)
Can Character-based Language Models Improve Downstream Task Performance in Low-Resource and Noisy Language Scenarios?
di: Riabi, Arij, et al.
Pubblicazione: (2021)
di: Riabi, Arij, et al.
Pubblicazione: (2021)
Enriching the NArabizi Treebank: A Multifaceted Approach to Supporting an Under-Resourced Language
di: Riabi, Arij, et al.
Pubblicazione: (2023)
di: Riabi, Arij, et al.
Pubblicazione: (2023)
Common Ground, Diverse Roots: The Difficulty of Classifying Common Examples in Spanish Varieties
di: Lopetegui, Javier A., et al.
Pubblicazione: (2024)
di: Lopetegui, Javier A., et al.
Pubblicazione: (2024)
CamemBERT 2.0: A Smarter French Language Model Aged to Perfection
di: Antoun, Wissam, et al.
Pubblicazione: (2024)
di: Antoun, Wissam, et al.
Pubblicazione: (2024)
Gaperon: A Peppered English-French Generative Language Model Suite
di: Godey, Nathan, et al.
Pubblicazione: (2025)
di: Godey, Nathan, et al.
Pubblicazione: (2025)
Rethinking the Multilingual Reasoning Gap with Layer Swap
di: Lasbordes, Maxence, et al.
Pubblicazione: (2026)
di: Lasbordes, Maxence, et al.
Pubblicazione: (2026)
In the LLM era, Word Sense Induction remains unsolved
di: Mosolova, Anna, et al.
Pubblicazione: (2026)
di: Mosolova, Anna, et al.
Pubblicazione: (2026)
Injecting Wiktionary to improve token-level contextual representations using contrastive learning
di: Mosolova, Anna, et al.
Pubblicazione: (2024)
di: Mosolova, Anna, et al.
Pubblicazione: (2024)
Leveraging Wikidata for Geographically Informed Sociocultural Bias Dataset Creation: Application to Latin America
di: Karmim, Yannis, et al.
Pubblicazione: (2026)
di: Karmim, Yannis, et al.
Pubblicazione: (2026)
LongFin: A Multimodal Document Understanding Model for Long Financial Domain Documents
di: Masry, Ahmed, et al.
Pubblicazione: (2024)
di: Masry, Ahmed, et al.
Pubblicazione: (2024)
Calm-Whisper: Reduce Whisper Hallucination On Non-Speech By Calming Crazy Heads Down
di: Wang, Yingzhi, et al.
Pubblicazione: (2025)
di: Wang, Yingzhi, et al.
Pubblicazione: (2025)
Evaluating LLMs' Mathematical Reasoning in Financial Document Question Answering
di: Srivastava, Pragya, et al.
Pubblicazione: (2024)
di: Srivastava, Pragya, et al.
Pubblicazione: (2024)
Document-Level Numerical Reasoning across Single and Multiple Tables in Financial Reports
di: Wang, Yi-Cheng, et al.
Pubblicazione: (2026)
di: Wang, Yi-Cheng, et al.
Pubblicazione: (2026)
FrenchToxicityPrompts: a Large Benchmark for Evaluating and Mitigating Toxicity in French Texts
di: Brun, Caroline, et al.
Pubblicazione: (2024)
di: Brun, Caroline, et al.
Pubblicazione: (2024)
DesignQA: A Multimodal Benchmark for Evaluating Large Language Models' Understanding of Engineering Documentation
di: Doris, Anna C., et al.
Pubblicazione: (2024)
di: Doris, Anna C., et al.
Pubblicazione: (2024)
Summarization of Multimodal Presentations with Vision-Language Models: Study of the Effect of Modalities and Structure
di: Gigant, Théo, et al.
Pubblicazione: (2025)
di: Gigant, Théo, et al.
Pubblicazione: (2025)
Financial Named Entity Recognition: How Far Can LLM Go?
di: Lu, Yi-Te, et al.
Pubblicazione: (2025)
di: Lu, Yi-Te, et al.
Pubblicazione: (2025)
Knowing When Not to Answer: Evaluating Abstention in Multimodal Reasoning Systems
di: Madhusudhan, Nishanth, et al.
Pubblicazione: (2026)
di: Madhusudhan, Nishanth, et al.
Pubblicazione: (2026)
When Tom Eats Kimchi: Evaluating Cultural Bias of Multimodal Large Language Models in Cultural Mixture Contexts
di: Kim, Jun Seong, et al.
Pubblicazione: (2025)
di: Kim, Jun Seong, et al.
Pubblicazione: (2025)
CFBenchmark-MM: Chinese Financial Assistant Benchmark for Multimodal Large Language Model
di: Li, Jiangtong, et al.
Pubblicazione: (2025)
di: Li, Jiangtong, et al.
Pubblicazione: (2025)
GoCoMA: Hyperbolic Multimodal Representation Fusion for Large Language Model-Generated Code Attribution
di: Choudhury, Nitin, et al.
Pubblicazione: (2026)
di: Choudhury, Nitin, et al.
Pubblicazione: (2026)
When Actions Go Off-Task: Detecting and Correcting Misaligned Actions in Computer-Use Agents
di: Ning, Yuting, et al.
Pubblicazione: (2026)
di: Ning, Yuting, et al.
Pubblicazione: (2026)
When Large Multimodal Models Confront Evolving Knowledge: Challenges and Explorations
di: Jiang, Kailin, et al.
Pubblicazione: (2025)
di: Jiang, Kailin, et al.
Pubblicazione: (2025)
MTEB-French: Resources for French Sentence Embedding Evaluation and Analysis
di: Ciancone, Mathieu, et al.
Pubblicazione: (2024)
di: Ciancone, Mathieu, et al.
Pubblicazione: (2024)
Spatial ModernBERT: Spatial-Aware Transformer for Table and Key-Value Extraction in Financial Documents at Scale
di: Javis AI Team, et al.
Pubblicazione: (2025)
di: Javis AI Team, et al.
Pubblicazione: (2025)
Improving Social Determinants of Health Documentation in French EHRs Using Large Language Models
di: Bazoge, Adrien, et al.
Pubblicazione: (2025)
di: Bazoge, Adrien, et al.
Pubblicazione: (2025)
Adaptation of Biomedical and Clinical Pretrained Models to French Long Documents: A Comparative Study
di: Bazoge, Adrien, et al.
Pubblicazione: (2024)
di: Bazoge, Adrien, et al.
Pubblicazione: (2024)
COLE: a Comprehensive Benchmark for French Language Understanding Evaluation
di: Beauchemin, David, et al.
Pubblicazione: (2025)
di: Beauchemin, David, et al.
Pubblicazione: (2025)
MultiFinBen: Benchmarking Large Language Models for Multilingual and Multimodal Financial Application
di: Peng, Xueqing, et al.
Pubblicazione: (2025)
di: Peng, Xueqing, et al.
Pubblicazione: (2025)
MCERF: Advancing Multimodal LLM Evaluation of Engineering Documentation with Enhanced Retrieval
di: Khanghah, Kiarash Naghavi, et al.
Pubblicazione: (2026)
di: Khanghah, Kiarash Naghavi, et al.
Pubblicazione: (2026)
FinLLM-B: When Large Language Models Meet Financial Breakout Trading
di: Zhang, Kang, et al.
Pubblicazione: (2024)
di: Zhang, Kang, et al.
Pubblicazione: (2024)
ViTaB-A: Evaluating Multimodal Large Language Models on Visual Table Attribution
di: Alqurnawi, Yahia, et al.
Pubblicazione: (2026)
di: Alqurnawi, Yahia, et al.
Pubblicazione: (2026)
Documenti analoghi
-
Cloaked Classifiers: Pseudonymization Strategies on Sensitive Classification Tasks
di: Riabi, Arij, et al.
Pubblicazione: (2024) -
Triggers Hijack Language Circuits: A Mechanistic Analysis of Backdoor Behaviors in Large Language Models
di: Lasnier, Théo, et al.
Pubblicazione: (2026) -
Beyond Dataset Creation: Critical View of Annotation Variation and Bias Probing of a Dataset for Online Radical Content Detection
di: Riabi, Arij, et al.
Pubblicazione: (2024) -
Language-Switching Triggers Take a Latent Detour Through Language Models
di: Kulumba, Francis, et al.
Pubblicazione: (2026) -
Disentangling meaning from language in LLM-based machine translation
di: Lasnier, Théo, et al.
Pubblicazione: (2026)