Benchmarking Multimodal LLMs on Recognition and Understanding over Chemical Tables
Fuente:
arXiv
Guardado en:
| Autores principales: | Zhou, Yitong, Cheng, Mingyue, Mao, Qingyang, Luo, Yucong, Liu, Qi, Li, Yupeng, Zhang, Xiaohan, Liu, Deguang, Li, Xin, Chen, Enhong |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Enhancing Table Recognition with Vision LLMs: A Benchmark and Neighbor-Guided Toolchain Reasoner
por: Zhou, Yitong, et al.
Publicado: (2024)
por: Zhou, Yitong, et al.
Publicado: (2024)
TableTime: Reformulating Time Series Classification as Training-Free Table Understanding with Large Language Models
por: Wang, Jiahao, et al.
Publicado: (2024)
por: Wang, Jiahao, et al.
Publicado: (2024)
BLADE: A Behavior-Level Data Augmentation Framework with Dual Fusion Modeling for Multi-Behavior Sequential Recommendation
por: Li, Yupeng, et al.
Publicado: (2025)
por: Li, Yupeng, et al.
Publicado: (2025)
Agent-R1: A Unified and Modular Framework for Agentic Reinforcement Learning
por: Cheng, Mingyue, et al.
Publicado: (2025)
por: Cheng, Mingyue, et al.
Publicado: (2025)
TableMind++: An Uncertainty-Aware Programmatic Agent for Tool-Augmented Table Reasoning
por: Cheng, Mingyue, et al.
Publicado: (2026)
por: Cheng, Mingyue, et al.
Publicado: (2026)
Time Series Forecasting as Reasoning: A Slow-Thinking Approach with Reinforced LLMs
por: Zhou, Yitong, et al.
Publicado: (2025)
por: Zhou, Yitong, et al.
Publicado: (2025)
Hierarchical Multimodal LLMs with Semantic Space Alignment for Enhanced Time Series Classification
por: Tao, Xiaoyu, et al.
Publicado: (2024)
por: Tao, Xiaoyu, et al.
Publicado: (2024)
Revisiting the Solution of Meta KDD Cup 2024: CRAG
por: Ouyang, Jie, et al.
Publicado: (2024)
por: Ouyang, Jie, et al.
Publicado: (2024)
Multi-Source Knowledge Pruning for Retrieval-Augmented Generation: A Benchmark and Empirical Study
por: Yu, Shuo, et al.
Publicado: (2024)
por: Yu, Shuo, et al.
Publicado: (2024)
Understanding the Role of LLMs in Multimodal Evaluation Benchmarks
por: Jiang, Botian, et al.
Publicado: (2024)
por: Jiang, Botian, et al.
Publicado: (2024)
GeoDecider: A Coarse-to-Fine Agentic Workflow for Explainable Lithology Classification
por: Wang, Jiahao, et al.
Publicado: (2026)
por: Wang, Jiahao, et al.
Publicado: (2026)
HoH: A Dynamic Benchmark for Evaluating the Impact of Outdated Information on Retrieval-Augmented Generation
por: Ouyang, Jie, et al.
Publicado: (2025)
por: Ouyang, Jie, et al.
Publicado: (2025)
GeoMind: An Agentic Workflow for Lithology Classification with Reasoned Tool Invocation
por: Zhou, Yitong, et al.
Publicado: (2026)
por: Zhou, Yitong, et al.
Publicado: (2026)
A Survey on Knowledge-Oriented Retrieval-Augmented Generation
por: Cheng, Mingyue, et al.
Publicado: (2025)
por: Cheng, Mingyue, et al.
Publicado: (2025)
Learning Recommender Systems with Soft Target: A Decoupled Perspective
por: Zhang, Hao, et al.
Publicado: (2024)
por: Zhang, Hao, et al.
Publicado: (2024)
A Benchmark Dataset and a Framework for Urdu Multimodal Named Entity Recognition
por: Ahmad, Hussain, et al.
Publicado: (2025)
por: Ahmad, Hussain, et al.
Publicado: (2025)
StepPO: Step-Aligned Policy Optimization for Agentic Reinforcement Learning
por: Wang, Daoyu, et al.
Publicado: (2026)
por: Wang, Daoyu, et al.
Publicado: (2026)
Multimodal Forecasting of Sparse Intraoperative Hypotension Events Powered by Language Model
por: Zhang, Jintao, et al.
Publicado: (2025)
por: Zhang, Jintao, et al.
Publicado: (2025)
DV-FSR: A Dual-View Target Attack Framework for Federated Sequential Recommendation
por: Qin, Qitao, et al.
Publicado: (2024)
por: Qin, Qitao, et al.
Publicado: (2024)
Are LLMs Stable Formal Logic Translators in Logical Reasoning Across Linguistically Diversified Texts?
por: Li, Qingchuan, et al.
Publicado: (2025)
por: Li, Qingchuan, et al.
Publicado: (2025)
Advancing Time Series Classification with Multimodal Language Modeling
por: Cheng, Mingyue, et al.
Publicado: (2024)
por: Cheng, Mingyue, et al.
Publicado: (2024)
Unlocking the Potential of Large Language Models for Explainable Recommendations
por: Luo, Yucong, et al.
Publicado: (2023)
por: Luo, Yucong, et al.
Publicado: (2023)
Towards Personalized Evaluation of Large Language Models with An Anonymous Crowd-Sourcing Platform
por: Cheng, Mingyue, et al.
Publicado: (2024)
por: Cheng, Mingyue, et al.
Publicado: (2024)
Leveraging LLMs for Hypothetical Deduction in Logical Inference: A Neuro-Symbolic Approach
por: Li, Qingchuan, et al.
Publicado: (2024)
por: Li, Qingchuan, et al.
Publicado: (2024)
Chem4DLLM: 4D Multimodal LLMs for Chemical Dynamics Understanding
por: Li, Xinyu, et al.
Publicado: (2026)
por: Li, Xinyu, et al.
Publicado: (2026)
PoTable: Towards Systematic Thinking via Plan-then-Execute Stage Reasoning on Tables
por: Mao, Qingyang, et al.
Publicado: (2024)
por: Mao, Qingyang, et al.
Publicado: (2024)
MSE-Adapter: A Lightweight Plugin Endowing LLMs with the Capability to Perform Multimodal Sentiment Analysis and Emotion Recognition
por: Yang, Yang, et al.
Publicado: (2025)
por: Yang, Yang, et al.
Publicado: (2025)
TextMatch: Enhancing Image-Text Consistency Through Multimodal Optimization
por: Luo, Yucong, et al.
Publicado: (2024)
por: Luo, Yucong, et al.
Publicado: (2024)
CMATH: Cross-Modality Augmented Transformer with Hierarchical Variational Distillation for Multimodal Emotion Recognition in Conversation
por: Zhu, Xiaofei, et al.
Publicado: (2024)
por: Zhu, Xiaofei, et al.
Publicado: (2024)
DisenTS: Disentangled Channel Evolving Pattern Modeling for Multivariate Time Series Forecasting
por: Liu, Zhiding, et al.
Publicado: (2024)
por: Liu, Zhiding, et al.
Publicado: (2024)
FAMMA: A Benchmark for Financial Domain Multilingual Multimodal Question Answering
por: Xue, Siqiao, et al.
Publicado: (2024)
por: Xue, Siqiao, et al.
Publicado: (2024)
Does Table Source Matter? Benchmarking and Improving Multimodal Scientific Table Understanding and Reasoning
por: Yang, Bohao, et al.
Publicado: (2025)
por: Yang, Bohao, et al.
Publicado: (2025)
ChemEval: A Comprehensive Multi-Level Chemical Evaluation for Large Language Models
por: Huang, Yuqing, et al.
Publicado: (2024)
por: Huang, Yuqing, et al.
Publicado: (2024)
Hanfu-Bench: A Multimodal Benchmark on Cross-Temporal Cultural Understanding and Transcreation
por: Zhou, Li, et al.
Publicado: (2025)
por: Zhou, Li, et al.
Publicado: (2025)
MMESGBench: Pioneering Multimodal Understanding and Complex Reasoning Benchmark for ESG Tasks
por: Zhang, Lei, et al.
Publicado: (2025)
por: Zhang, Lei, et al.
Publicado: (2025)
When LLMs Meet Cunning Texts: A Fallacy Understanding Benchmark for Large Language Models
por: Li, Yinghui, et al.
Publicado: (2024)
por: Li, Yinghui, et al.
Publicado: (2024)
Open CaptchaWorld: A Comprehensive Web-based Platform for Testing and Benchmarking Multimodal LLM Agents
por: Luo, Yaxin, et al.
Publicado: (2025)
por: Luo, Yaxin, et al.
Publicado: (2025)
More Edits, More Stable: Understanding the Lifelong Normalization in Sequential Model Editing
por: Ma, Xin, et al.
Publicado: (2026)
por: Ma, Xin, et al.
Publicado: (2026)
DependEval: Benchmarking LLMs for Repository Dependency Understanding
por: Du, Junjia, et al.
Publicado: (2025)
por: Du, Junjia, et al.
Publicado: (2025)
DentalBench: Benchmarking and Advancing LLMs Capability for Bilingual Dentistry Understanding
por: Zhu, Hengchuan, et al.
Publicado: (2025)
por: Zhu, Hengchuan, et al.
Publicado: (2025)
Ejemplares similares
-
Enhancing Table Recognition with Vision LLMs: A Benchmark and Neighbor-Guided Toolchain Reasoner
por: Zhou, Yitong, et al.
Publicado: (2024) -
TableTime: Reformulating Time Series Classification as Training-Free Table Understanding with Large Language Models
por: Wang, Jiahao, et al.
Publicado: (2024) -
BLADE: A Behavior-Level Data Augmentation Framework with Dual Fusion Modeling for Multi-Behavior Sequential Recommendation
por: Li, Yupeng, et al.
Publicado: (2025) -
Agent-R1: A Unified and Modular Framework for Agentic Reinforcement Learning
por: Cheng, Mingyue, et al.
Publicado: (2025) -
TableMind++: An Uncertainty-Aware Programmatic Agent for Tool-Augmented Table Reasoning
por: Cheng, Mingyue, et al.
Publicado: (2026)