Format Matters: The Robustness of Multimodal LLMs in Reviewing Evidence from Tables and Charts
Fuente:
arXiv
Salvato in:
| Autori principali: | Ho, Xanh, Wu, Yun-Ang, Kumar, Sunisth, Boudin, Florian, Takasu, Atsuhiro, Aizawa, Akiko |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Table-Text Alignment: Explaining Claim Verification Against Tables in Scientific Papers
di: Ho, Xanh, et al.
Pubblicazione: (2025)
di: Ho, Xanh, et al.
Pubblicazione: (2025)
Encoded but Not Routed: Explaining the Table-Chart Gap in Scientific Claim Verification
di: Kumar, Sunisth, et al.
Pubblicazione: (2026)
di: Kumar, Sunisth, et al.
Pubblicazione: (2026)
SciClaimEval: Cross-modal Claim Verification in Scientific Papers
di: Ho, Xanh, et al.
Pubblicazione: (2026)
di: Ho, Xanh, et al.
Pubblicazione: (2026)
Reassessing Extractive QA Datasets at Scale: LLM-as-a-Judge and In-Depth Analyses
di: Ho, Xanh, et al.
Pubblicazione: (2025)
di: Ho, Xanh, et al.
Pubblicazione: (2025)
MoreHopQA: More Than Multi-hop Reasoning
di: Schnitzler, Julian, et al.
Pubblicazione: (2024)
di: Schnitzler, Julian, et al.
Pubblicazione: (2024)
Unsupervised Domain Adaptation for Keyphrase Generation using Citation Contexts
di: Boudin, Florian, et al.
Pubblicazione: (2024)
di: Boudin, Florian, et al.
Pubblicazione: (2024)
An Analysis of Datasets, Metrics and Models in Keyphrase Generation
di: Boudin, Florian, et al.
Pubblicazione: (2025)
di: Boudin, Florian, et al.
Pubblicazione: (2025)
Preface to the Special Issue of the TAL Journal on Scholarly Document Processing
di: Boudin, Florian, et al.
Pubblicazione: (2025)
di: Boudin, Florian, et al.
Pubblicazione: (2025)
Automatically Suggesting Diverse Example Sentences for L2 Japanese Learners Using Pre-Trained Language Models
di: Benedetti, Enrico, et al.
Pubblicazione: (2025)
di: Benedetti, Enrico, et al.
Pubblicazione: (2025)
A Survey of Pre-trained Language Models for Processing Scientific Text
di: Ho, Xanh, et al.
Pubblicazione: (2024)
di: Ho, Xanh, et al.
Pubblicazione: (2024)
Self-Compositional Data Augmentation for Scientific Keyphrase Generation
di: Houbre, Mael, et al.
Pubblicazione: (2024)
di: Houbre, Mael, et al.
Pubblicazione: (2024)
ParaRev: Building a dataset for Scientific Paragraph Revision annotated with revision instruction
di: Jourdan, Léane, et al.
Pubblicazione: (2025)
di: Jourdan, Léane, et al.
Pubblicazione: (2025)
Repurposing Annotation Guidelines to Instruct LLM Annotators: A Case Study
di: Kim, Kon Woo, et al.
Pubblicazione: (2025)
di: Kim, Kon Woo, et al.
Pubblicazione: (2025)
Revisiting Bi-Encoder Neural Search: An Encoding--Searching Separation Perspective
di: Tran, Hung-Nghiep, et al.
Pubblicazione: (2024)
di: Tran, Hung-Nghiep, et al.
Pubblicazione: (2024)
Exploring Scholarly Data by Semantic Query on Knowledge Graph Embedding Space
di: Tran, Hung Nghiep, et al.
Pubblicazione: (2019)
di: Tran, Hung Nghiep, et al.
Pubblicazione: (2019)
FC-CONAN: An Exhaustively Paired Dataset for Robust Evaluation of Retrieval Systems
di: Junqueras, Juan, et al.
Pubblicazione: (2026)
di: Junqueras, Juan, et al.
Pubblicazione: (2026)
Harnessing PDF Data for Improving Japanese Large Multimodal Models
di: Baek, Jeonghun, et al.
Pubblicazione: (2025)
di: Baek, Jeonghun, et al.
Pubblicazione: (2025)
Syllable-level lyrics generation from melody exploiting character-level language model
di: Zhang, Zhe, et al.
Pubblicazione: (2023)
di: Zhang, Zhe, et al.
Pubblicazione: (2023)
Are Emotions Arranged in a Circle? Geometric Analysis of Emotion Representations via Hyperspherical Contrastive Learning
di: Yamauchi, Yusuke, et al.
Pubblicazione: (2026)
di: Yamauchi, Yusuke, et al.
Pubblicazione: (2026)
Evaluating the Homogeneity of Keyphrase Prediction Models
di: Houbre, Maël, et al.
Pubblicazione: (2026)
di: Houbre, Maël, et al.
Pubblicazione: (2026)
CharXiv: Charting Gaps in Realistic Chart Understanding in Multimodal LLMs
di: Wang, Zirui, et al.
Pubblicazione: (2024)
di: Wang, Zirui, et al.
Pubblicazione: (2024)
JMedBench: A Benchmark for Evaluating Japanese Biomedical Large Language Models
di: Jiang, Junfeng, et al.
Pubblicazione: (2024)
di: Jiang, Junfeng, et al.
Pubblicazione: (2024)
Chart-to-Experience: Benchmarking Multimodal LLMs for Predicting Experiential Impact of Charts
di: Kim, Seon Gyeom, et al.
Pubblicazione: (2025)
di: Kim, Seon Gyeom, et al.
Pubblicazione: (2025)
CASIMIR: A Corpus of Scientific Articles enhanced with Multiple Author-Integrated Revisions
di: Jourdan, Leane, et al.
Pubblicazione: (2024)
di: Jourdan, Leane, et al.
Pubblicazione: (2024)
Text revision in Scientific Writing Assistance: An Overview
di: Jourdan, Léane, et al.
Pubblicazione: (2023)
di: Jourdan, Léane, et al.
Pubblicazione: (2023)
Identifying Reliable Evaluation Metrics for Scientific Text Revision
di: Jourdan, Léane, et al.
Pubblicazione: (2025)
di: Jourdan, Léane, et al.
Pubblicazione: (2025)
Tracing Multilingual Knowledge Acquisition Dynamics in Domain Adaptation: A Case Study of English-Japanese Biomedical Adaptation
di: Zhao, Xin, et al.
Pubblicazione: (2025)
di: Zhao, Xin, et al.
Pubblicazione: (2025)
Refining and Reusing Annotation Guidelines for LLM Annotation
di: Kim, Kon Woo, et al.
Pubblicazione: (2026)
di: Kim, Kon Woo, et al.
Pubblicazione: (2026)
ChartNet: A Million-Scale, High-Quality Multimodal Dataset for Robust Chart Understanding
di: Kondic, Jovana, et al.
Pubblicazione: (2026)
di: Kondic, Jovana, et al.
Pubblicazione: (2026)
PrionNER: A Named Entity Recognition Dataset for Prion Disease Biomedical Literature
di: Dao, An, et al.
Pubblicazione: (2026)
di: Dao, An, et al.
Pubblicazione: (2026)
EarlySciRev: A Dataset of Early-Stage Scientific Revisions Extracted from LaTeX Writing Traces
di: Jourdan, Léane, et al.
Pubblicazione: (2026)
di: Jourdan, Léane, et al.
Pubblicazione: (2026)
Memorization, Emergence, and Explaining Reversal Failures: A Controlled Study of Relational Semantics in LLMs
di: Zhu, Yihua, et al.
Pubblicazione: (2026)
di: Zhu, Yihua, et al.
Pubblicazione: (2026)
Beyond Chains: Bridging Large Language Models and Knowledge Bases in Complex Question Answering
di: Zhu, Yihua, et al.
Pubblicazione: (2025)
di: Zhu, Yihua, et al.
Pubblicazione: (2025)
Med-CoDE: Medical Critique based Disagreement Evaluation Framework
di: Gupta, Mohit, et al.
Pubblicazione: (2025)
di: Gupta, Mohit, et al.
Pubblicazione: (2025)
ChartMind: A Comprehensive Benchmark for Complex Real-world Multimodal Chart Question Answering
di: Wei, Jingxuan, et al.
Pubblicazione: (2025)
di: Wei, Jingxuan, et al.
Pubblicazione: (2025)
Through the LLM Looking Glass: A Socratic Probing of Donkeys, Elephants, and Markets
di: Kennedy, Molly, et al.
Pubblicazione: (2025)
di: Kennedy, Molly, et al.
Pubblicazione: (2025)
ChartAttack: Testing the Vulnerability of LLMs to Malicious Prompting in Chart Generation
di: Ortiz-Barajas, Jesus-German, et al.
Pubblicazione: (2026)
di: Ortiz-Barajas, Jesus-German, et al.
Pubblicazione: (2026)
MSG-Chart: Multimodal Scene Graph for ChartQA
di: Dai, Yue, et al.
Pubblicazione: (2024)
di: Dai, Yue, et al.
Pubblicazione: (2024)
ChartFI: Benchmarking Faithfulness and Insightfulness of Chart Descriptions from Multimodal Large Language Models
di: Wang, Fen, et al.
Pubblicazione: (2026)
di: Wang, Fen, et al.
Pubblicazione: (2026)
ChartEditor: A Reinforcement Learning Framework for Robust Chart Editing
di: Chen, Liangyu, et al.
Pubblicazione: (2025)
di: Chen, Liangyu, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Table-Text Alignment: Explaining Claim Verification Against Tables in Scientific Papers
di: Ho, Xanh, et al.
Pubblicazione: (2025) -
Encoded but Not Routed: Explaining the Table-Chart Gap in Scientific Claim Verification
di: Kumar, Sunisth, et al.
Pubblicazione: (2026) -
SciClaimEval: Cross-modal Claim Verification in Scientific Papers
di: Ho, Xanh, et al.
Pubblicazione: (2026) -
Reassessing Extractive QA Datasets at Scale: LLM-as-a-Judge and In-Depth Analyses
di: Ho, Xanh, et al.
Pubblicazione: (2025) -
MoreHopQA: More Than Multi-hop Reasoning
di: Schnitzler, Julian, et al.
Pubblicazione: (2024)