ParseBench: A Document Parsing Benchmark for AI Agents
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Zhang, Boyang, Acosta, Sebastián G., Carlson, Preston, Bron, Sacha, Doulcet, Pierre-Loïc, Ospina, Daniel B., Suo, Simon |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2026
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
OmniDocBench: Benchmarking Diverse PDF Document Parsing with Comprehensive Annotations
von: Ouyang, Linke, et al.
Veröffentlicht: (2024)
von: Ouyang, Linke, et al.
Veröffentlicht: (2024)
Dr. DocBench: A Comprehensive Benchmark for Expert-Level and Difficult Document Parsing
von: Yang, Minglai, et al.
Veröffentlicht: (2026)
von: Yang, Minglai, et al.
Veröffentlicht: (2026)
Real5-OmniDocBench: A Full-Scale Physical Reconstruction Benchmark for Robust Document Parsing in the Wild
von: Zhou, Changda, et al.
Veröffentlicht: (2026)
von: Zhou, Changda, et al.
Veröffentlicht: (2026)
Multimodal OCR: Parse Anything from Documents
von: Zheng, Handong, et al.
Veröffentlicht: (2026)
von: Zheng, Handong, et al.
Veröffentlicht: (2026)
MDPBench: A Benchmark for Multilingual Document Parsing in Real-World Scenarios
von: Li, Zhang, et al.
Veröffentlicht: (2026)
von: Li, Zhang, et al.
Veröffentlicht: (2026)
DocPTBench: Benchmarking End-to-End Photographed Document Parsing and Translation
von: Du, Yongkun, et al.
Veröffentlicht: (2025)
von: Du, Yongkun, et al.
Veröffentlicht: (2025)
KPM-Bench: A Kinematic Parsing Motion Benchmark for Fine-grained Motion-centric Video Understanding
von: Lin, Boda, et al.
Veröffentlicht: (2026)
von: Lin, Boda, et al.
Veröffentlicht: (2026)
ParseCaps: An Interpretable Parsing Capsule Network for Medical Image Diagnosis
von: Geng, Xinyu, et al.
Veröffentlicht: (2024)
von: Geng, Xinyu, et al.
Veröffentlicht: (2024)
ScreenParse: Moving Beyond Sparse Grounding with Complete Screen Parsing Supervision
von: Gurbuz, A. Said, et al.
Veröffentlicht: (2026)
von: Gurbuz, A. Said, et al.
Veröffentlicht: (2026)
How Far Is Document Parsing from Solved? PureDocBench: A Source-TraceableBenchmark across Clean, Degraded, and Real-World Settings
von: Li, Zhiheng, et al.
Veröffentlicht: (2026)
von: Li, Zhiheng, et al.
Veröffentlicht: (2026)
Dolphin: Document Image Parsing via Heterogeneous Anchor Prompting
von: Feng, Hao, et al.
Veröffentlicht: (2025)
von: Feng, Hao, et al.
Veröffentlicht: (2025)
Efficient Document Parsing via Parallel Token Prediction
von: Li, Lei, et al.
Veröffentlicht: (2026)
von: Li, Lei, et al.
Veröffentlicht: (2026)
Logics-Parsing Technical Report
von: Chen, Xiangyang, et al.
Veröffentlicht: (2025)
von: Chen, Xiangyang, et al.
Veröffentlicht: (2025)
DOCR-Inspector: Fine-Grained and Automated Evaluation of Document Parsing with VLM
von: Zhang, Qintong, et al.
Veröffentlicht: (2025)
von: Zhang, Qintong, et al.
Veröffentlicht: (2025)
SciFlow-Bench: Evaluating Structure-Aware Scientific Diagram Generation via Inverse Parsing
von: Zhang, Tong, et al.
Veröffentlicht: (2026)
von: Zhang, Tong, et al.
Veröffentlicht: (2026)
Intelligent Parsing: An Automated Parsing Framework for Extracting Design Semantics from E-commerce Creatives
von: Li, Guandong, et al.
Veröffentlicht: (2023)
von: Li, Guandong, et al.
Veröffentlicht: (2023)
MonkeyOCR: Document Parsing with a Structure-Recognition-Relation Triplet Paradigm
von: Li, Zhang, et al.
Veröffentlicht: (2025)
von: Li, Zhang, et al.
Veröffentlicht: (2025)
Parser-Oriented Structural Refinement for a Stable Layout Interface in Document Parsing
von: Liu, Fuyuan, et al.
Veröffentlicht: (2026)
von: Liu, Fuyuan, et al.
Veröffentlicht: (2026)
Dolphin-v2: Universal Document Parsing via Scalable Anchor Prompting
von: Feng, Hao, et al.
Veröffentlicht: (2026)
von: Feng, Hao, et al.
Veröffentlicht: (2026)
Towards Real-World Document Parsing via Realistic Scene Synthesis and Document-Aware Training
von: Li, Gengluo, et al.
Veröffentlicht: (2026)
von: Li, Gengluo, et al.
Veröffentlicht: (2026)
Hierarchical Document Parsing via Large Margin Feature Matching and Heuristics
von: Kiet, Duong Anh
Veröffentlicht: (2025)
von: Kiet, Duong Anh
Veröffentlicht: (2025)
PSGait: Gait Recognition using Parsing Skeleton
von: Xu, Hangrui, et al.
Veröffentlicht: (2025)
von: Xu, Hangrui, et al.
Veröffentlicht: (2025)
SCHNet: SAM Marries CLIP for Human Parsing
von: Liu, Kunliang, et al.
Veröffentlicht: (2025)
von: Liu, Kunliang, et al.
Veröffentlicht: (2025)
Beyond Masks: The Case for Medical Image Parsing
von: Gupta, Siddharth, et al.
Veröffentlicht: (2026)
von: Gupta, Siddharth, et al.
Veröffentlicht: (2026)
Explore Human Parsing Modality for Action Recognition
von: Liu, Jinfu, et al.
Veröffentlicht: (2024)
von: Liu, Jinfu, et al.
Veröffentlicht: (2024)
Learning AND-OR Templates for Professional Photograph Parsing and Guidance
von: Jin, Xin, et al.
Veröffentlicht: (2024)
von: Jin, Xin, et al.
Veröffentlicht: (2024)
PhysLab: A Benchmark Dataset for Multi-Granularity Visual Parsing of Physics Experiments
von: Zou, Minghao, et al.
Veröffentlicht: (2025)
von: Zou, Minghao, et al.
Veröffentlicht: (2025)
MeDocVL: A Visual Language Model for Medical Document Understanding and Parsing
von: Wang, Wenjie, et al.
Veröffentlicht: (2026)
von: Wang, Wenjie, et al.
Veröffentlicht: (2026)
dots.ocr: Multilingual Document Layout Parsing in a Single Vision-Language Model
von: Li, Yumeng, et al.
Veröffentlicht: (2025)
von: Li, Yumeng, et al.
Veröffentlicht: (2025)
MPDocBench-Parse: Benchmarking Practical Multi-page Document Parsing
von: Zhou, Bangbang, et al.
Veröffentlicht: (2026)
von: Zhou, Bangbang, et al.
Veröffentlicht: (2026)
μgat: Improving Single-Page Document Parsing by Providing Multi-Page Context
von: Quattrini, Fabio, et al.
Veröffentlicht: (2024)
von: Quattrini, Fabio, et al.
Veröffentlicht: (2024)
Boosting Document Parsing Efficiency and Performance with Coarse-to-Fine Visual Processing
von: Cui, Cheng, et al.
Veröffentlicht: (2026)
von: Cui, Cheng, et al.
Veröffentlicht: (2026)
Synthetically Trained Icon Proposals for Parsing and Summarizing Infographics
von: Madan, Spandan, et al.
Veröffentlicht: (2018)
von: Madan, Spandan, et al.
Veröffentlicht: (2018)
Parsing Objects at a Finer Granularity: A Survey
von: Zhao, Yifan, et al.
Veröffentlicht: (2022)
von: Zhao, Yifan, et al.
Veröffentlicht: (2022)
EasyPortrait -- Face Parsing and Portrait Segmentation Dataset
von: Kvanchiani, Karina, et al.
Veröffentlicht: (2023)
von: Kvanchiani, Karina, et al.
Veröffentlicht: (2023)
Unsupervised Collaborative Domain Adaptation for Driving Scene Parsing
von: Fan, Jiahe, et al.
Veröffentlicht: (2026)
von: Fan, Jiahe, et al.
Veröffentlicht: (2026)
Dictionary-based Framework for Interpretable and Consistent Object Parsing
von: Zhang, Tiezheng, et al.
Veröffentlicht: (2025)
von: Zhang, Tiezheng, et al.
Veröffentlicht: (2025)
Graph-Boosted Attentive Network for Semantic Body Parsing
von: Wang, Tinghuai, et al.
Veröffentlicht: (2024)
von: Wang, Tinghuai, et al.
Veröffentlicht: (2024)
DocParseNet: Advanced Semantic Segmentation and OCR Embeddings for Efficient Scanned Document Annotation
von: Mohammadshirazi, Ahmad, et al.
Veröffentlicht: (2024)
von: Mohammadshirazi, Ahmad, et al.
Veröffentlicht: (2024)
IndicDLP: A Foundational Dataset for Multi-Lingual and Multi-Domain Document Layout Parsing
von: Nath, Oikantik, et al.
Veröffentlicht: (2025)
von: Nath, Oikantik, et al.
Veröffentlicht: (2025)
Ähnliche Einträge
-
OmniDocBench: Benchmarking Diverse PDF Document Parsing with Comprehensive Annotations
von: Ouyang, Linke, et al.
Veröffentlicht: (2024) -
Dr. DocBench: A Comprehensive Benchmark for Expert-Level and Difficult Document Parsing
von: Yang, Minglai, et al.
Veröffentlicht: (2026) -
Real5-OmniDocBench: A Full-Scale Physical Reconstruction Benchmark for Robust Document Parsing in the Wild
von: Zhou, Changda, et al.
Veröffentlicht: (2026) -
Multimodal OCR: Parse Anything from Documents
von: Zheng, Handong, et al.
Veröffentlicht: (2026) -
MDPBench: A Benchmark for Multilingual Document Parsing in Real-World Scenarios
von: Li, Zhang, et al.
Veröffentlicht: (2026)