Multi-domain Multi-modal Document Classification Benchmark with a Multi-level Taxonomy
Fuente:
arXiv
Salvato in:
| Autori principali: | Ma, Denghao, Liu, Qing, Chen, Zulong, Xu, Chuanfei, Xu, Jia, Yang, Zhibo, Shao, Wei, Li, Zhao |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
DMDTEval: An Evaluation and Analysis of LLMs on Disambiguation in Multi-domain Translation
di: Man, Zhibo, et al.
Pubblicazione: (2025)
di: Man, Zhibo, et al.
Pubblicazione: (2025)
CC-OCR V2: Benchmarking Large Multimodal Models for Literacy in Real-world Document Processing
di: Xu, Zhipeng, et al.
Pubblicazione: (2026)
di: Xu, Zhipeng, et al.
Pubblicazione: (2026)
FinAuditing: A Financial Taxonomy-Structured Multi-Document Benchmark for Evaluating LLMs
di: Wang, Yan, et al.
Pubblicazione: (2025)
di: Wang, Yan, et al.
Pubblicazione: (2025)
UNIKIE-BENCH: Benchmarking Large Multimodal Models for Key Information Extraction in Visual Documents
di: Ji, Yifan, et al.
Pubblicazione: (2026)
di: Ji, Yifan, et al.
Pubblicazione: (2026)
M$^3$CoT: A Novel Benchmark for Multi-Domain Multi-step Multi-modal Chain-of-Thought
di: Chen, Qiguang, et al.
Pubblicazione: (2024)
di: Chen, Qiguang, et al.
Pubblicazione: (2024)
UnifiedMLLM: Enabling Unified Representation for Multi-modal Multi-tasks With Large Language Model
di: Li, Zhaowei, et al.
Pubblicazione: (2024)
di: Li, Zhaowei, et al.
Pubblicazione: (2024)
Revisiting Classification Taxonomy for Grammatical Errors
di: Zou, Deqing, et al.
Pubblicazione: (2025)
di: Zou, Deqing, et al.
Pubblicazione: (2025)
Multi-modal Stance Detection: New Datasets and Model
di: Liang, Bin, et al.
Pubblicazione: (2024)
di: Liang, Bin, et al.
Pubblicazione: (2024)
VisScience: An Extensive Benchmark for Evaluating K12 Educational Multi-modal Scientific Reasoning
di: Jiang, Zhihuan, et al.
Pubblicazione: (2024)
di: Jiang, Zhihuan, et al.
Pubblicazione: (2024)
Emphasis Rendering for Conversational Text-to-Speech with Multi-modal Multi-scale Context Modeling
di: Liu, Rui, et al.
Pubblicazione: (2024)
di: Liu, Rui, et al.
Pubblicazione: (2024)
CaseGen: A Benchmark for Multi-Stage Legal Case Documents Generation
di: Li, Haitao, et al.
Pubblicazione: (2025)
di: Li, Haitao, et al.
Pubblicazione: (2025)
CMMU: A Benchmark for Chinese Multi-modal Multi-type Question Understanding and Reasoning
di: He, Zheqi, et al.
Pubblicazione: (2024)
di: He, Zheqi, et al.
Pubblicazione: (2024)
SciMMIR: Benchmarking Scientific Multi-modal Information Retrieval
di: Wu, Siwei, et al.
Pubblicazione: (2024)
di: Wu, Siwei, et al.
Pubblicazione: (2024)
DanmakuTPPBench: A Multi-modal Benchmark for Temporal Point Process Modeling and Understanding
di: Jiang, Yue, et al.
Pubblicazione: (2025)
di: Jiang, Yue, et al.
Pubblicazione: (2025)
Benchmarking Large Language Models for Conversational Question Answering in Multi-instructional Documents
di: Wu, Shiwei, et al.
Pubblicazione: (2024)
di: Wu, Shiwei, et al.
Pubblicazione: (2024)
GlobeSumm: A Challenging Benchmark Towards Unifying Multi-lingual, Cross-lingual and Multi-document News Summarization
di: Ye, Yangfan, et al.
Pubblicazione: (2024)
di: Ye, Yangfan, et al.
Pubblicazione: (2024)
CMMaTH: A Chinese Multi-modal Math Skill Evaluation Benchmark for Foundation Models
di: Li, Zhong-Zhi, et al.
Pubblicazione: (2024)
di: Li, Zhong-Zhi, et al.
Pubblicazione: (2024)
Large Multi-modal Models Can Interpret Features in Large Multi-modal Models
di: Zhang, Kaichen, et al.
Pubblicazione: (2024)
di: Zhang, Kaichen, et al.
Pubblicazione: (2024)
MultiADE: A Multi-domain Benchmark for Adverse Drug Event Extraction
di: Dai, Xiang, et al.
Pubblicazione: (2024)
di: Dai, Xiang, et al.
Pubblicazione: (2024)
Unleashing the Potentials of Likelihood Composition for Multi-modal Language Models
di: Zhao, Shitian, et al.
Pubblicazione: (2024)
di: Zhao, Shitian, et al.
Pubblicazione: (2024)
A Survey on Multi-modal Machine Translation: Tasks, Methods and Challenges
di: Shen, Huangjun, et al.
Pubblicazione: (2024)
di: Shen, Huangjun, et al.
Pubblicazione: (2024)
Task Selection and Assignment for Multi-modal Multi-task Dialogue Act Classification with Non-stationary Multi-armed Bandits
di: He, Xiangheng, et al.
Pubblicazione: (2023)
di: He, Xiangheng, et al.
Pubblicazione: (2023)
VisRAG: Vision-based Retrieval-augmented Generation on Multi-modality Documents
di: Yu, Shi, et al.
Pubblicazione: (2024)
di: Yu, Shi, et al.
Pubblicazione: (2024)
Friends-MMC: A Dataset for Multi-modal Multi-party Conversation Understanding
di: Wang, Yueqian, et al.
Pubblicazione: (2024)
di: Wang, Yueqian, et al.
Pubblicazione: (2024)
Video-MME: The First-Ever Comprehensive Evaluation Benchmark of Multi-modal LLMs in Video Analysis
di: Fu, Chaoyou, et al.
Pubblicazione: (2024)
di: Fu, Chaoyou, et al.
Pubblicazione: (2024)
Face-Human-Bench: A Comprehensive Benchmark of Face and Human Understanding for Multi-modal Assistants
di: Qin, Lixiong, et al.
Pubblicazione: (2025)
di: Qin, Lixiong, et al.
Pubblicazione: (2025)
Multi-modal Retrieval Augmented Multi-modal Generation: Datasets, Evaluation Metrics and Strong Baselines
di: Ma, Zi-Ao, et al.
Pubblicazione: (2024)
di: Ma, Zi-Ao, et al.
Pubblicazione: (2024)
Instruct-Imagen: Image Generation with Multi-modal Instruction
di: Hu, Hexiang, et al.
Pubblicazione: (2024)
di: Hu, Hexiang, et al.
Pubblicazione: (2024)
Improving LLM-based Document-level Machine Translation with Multi-Knowledge Fusion
di: Liu, Bin, et al.
Pubblicazione: (2025)
di: Liu, Bin, et al.
Pubblicazione: (2025)
M3SciQA: A Multi-Modal Multi-Document Scientific QA Benchmark for Evaluating Foundation Models
di: Li, Chuhan, et al.
Pubblicazione: (2024)
di: Li, Chuhan, et al.
Pubblicazione: (2024)
FaiMA: Feature-aware In-context Learning for Multi-domain Aspect-based Sentiment Analysis
di: Yang, Songhua, et al.
Pubblicazione: (2024)
di: Yang, Songhua, et al.
Pubblicazione: (2024)
Multi-IF: Benchmarking LLMs on Multi-Turn and Multilingual Instructions Following
di: He, Yun, et al.
Pubblicazione: (2024)
di: He, Yun, et al.
Pubblicazione: (2024)
Multi-modal Data Spectrum: Multi-modal Datasets are Multi-dimensional
di: Madaan, Divyam, et al.
Pubblicazione: (2025)
di: Madaan, Divyam, et al.
Pubblicazione: (2025)
SciEvent: Benchmarking Multi-domain Scientific Event Extraction
di: Dong, Bofu, et al.
Pubblicazione: (2025)
di: Dong, Bofu, et al.
Pubblicazione: (2025)
Visual Language Tracking with Multi-modal Interaction: A Robust Benchmark
di: Li, Xuchen, et al.
Pubblicazione: (2024)
di: Li, Xuchen, et al.
Pubblicazione: (2024)
MMMOS: Multi-domain Multi-axis Audio Quality Assessment
di: Lin, Yi-Cheng, et al.
Pubblicazione: (2025)
di: Lin, Yi-Cheng, et al.
Pubblicazione: (2025)
Soft-Prompting with Graph-of-Thought for Multi-modal Representation Learning
di: Yang, Juncheng, et al.
Pubblicazione: (2024)
di: Yang, Juncheng, et al.
Pubblicazione: (2024)
MM-StanceDet: Retrieval-Augmented Multi-modal Multi-agent Stance Detection
di: Lu, Weihai, et al.
Pubblicazione: (2026)
di: Lu, Weihai, et al.
Pubblicazione: (2026)
MMSearch: Benchmarking the Potential of Large Models as Multi-modal Search Engines
di: Jiang, Dongzhi, et al.
Pubblicazione: (2024)
di: Jiang, Dongzhi, et al.
Pubblicazione: (2024)
Research Experiment on Multi-Model Comparison for Chinese Text Classification Tasks
di: Li, JiaCheng
Pubblicazione: (2024)
di: Li, JiaCheng
Pubblicazione: (2024)
Documenti analoghi
-
DMDTEval: An Evaluation and Analysis of LLMs on Disambiguation in Multi-domain Translation
di: Man, Zhibo, et al.
Pubblicazione: (2025) -
CC-OCR V2: Benchmarking Large Multimodal Models for Literacy in Real-world Document Processing
di: Xu, Zhipeng, et al.
Pubblicazione: (2026) -
FinAuditing: A Financial Taxonomy-Structured Multi-Document Benchmark for Evaluating LLMs
di: Wang, Yan, et al.
Pubblicazione: (2025) -
UNIKIE-BENCH: Benchmarking Large Multimodal Models for Key Information Extraction in Visual Documents
di: Ji, Yifan, et al.
Pubblicazione: (2026) -
M$^3$CoT: A Novel Benchmark for Multi-Domain Multi-step Multi-modal Chain-of-Thought
di: Chen, Qiguang, et al.
Pubblicazione: (2024)