OCRGenBench: A Comprehensive Benchmark for Evaluating OCR Generative Capabilities
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Zhang, Peirong, Xu, Haowei, Zhang, Jiaxin, Zheng, Xuhan, Xu, Guitao, Zhang, Yuyi, Liu, Junle, Yang, Zhenhua, Zhou, Wei, Jin, Lianwen |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
PosterVerse: A Full-Workflow Framework for Commercial-Grade Poster Generation with HTML-Based Scalable Typography
par: Liu, Junle, et autres
Publié: (2026)
par: Liu, Junle, et autres
Publié: (2026)
MegaHan97K: A Large-Scale Dataset for Mega-Category Chinese Character Recognition with over 97K Categories
par: Zhang, Yuyi, et autres
Publié: (2025)
par: Zhang, Yuyi, et autres
Publié: (2025)
Reviving Cultural Heritage: A Novel Approach for Comprehensive Historical Document Restoration
par: Zhang, Yuyi, et autres
Publié: (2025)
par: Zhang, Yuyi, et autres
Publié: (2025)
Online Writer Retrieval with Chinese Handwritten Phrases: A Synergistic Temporal-Frequency Representation Learning Approach
par: Zhang, Peirong, et autres
Publié: (2024)
par: Zhang, Peirong, et autres
Publié: (2024)
Smaller But Better: Unifying Layout Generation with Smaller Large Language Models
par: Zhang, Peirong, et autres
Publié: (2025)
par: Zhang, Peirong, et autres
Publié: (2025)
HierCode: A Lightweight Hierarchical Codebook for Zero-shot Chinese Text Recognition
par: Zhang, Yuyi, et autres
Publié: (2024)
par: Zhang, Yuyi, et autres
Publié: (2024)
DocRes: A Generalist Model Toward Unifying Document Image Restoration Tasks
par: Zhang, Jiaxin, et autres
Publié: (2024)
par: Zhang, Jiaxin, et autres
Publié: (2024)
Capturing More: Learning Multi-Domain Representations for Robust Online Handwriting Verification
par: Zhang, Peirong, et autres
Publié: (2025)
par: Zhang, Peirong, et autres
Publié: (2025)
UPOCR: Towards Unified Pixel-Level OCR Interface
par: Peng, Dezhi, et autres
Publié: (2023)
par: Peng, Dezhi, et autres
Publié: (2023)
MCCD: A Multi-Attribute Chinese Calligraphy Character Dataset Annotated with Script Styles, Dynasties, and Calligraphers
par: Zhao, Yixin, et autres
Publié: (2025)
par: Zhao, Yixin, et autres
Publié: (2025)
Predicting the Original Appearance of Damaged Historical Documents
par: Yang, Zhenhua, et autres
Publié: (2024)
par: Yang, Zhenhua, et autres
Publié: (2024)
C$^{3}$Bench: A Comprehensive Classical Chinese Understanding Benchmark for Large Language Models
par: Cao, Jiahuan, et autres
Publié: (2024)
par: Cao, Jiahuan, et autres
Publié: (2024)
PRL-Bench: A Comprehensive Benchmark Evaluating LLMs' Capabilities in Frontier Physics Research
par: Miao, Tingjia, et autres
Publié: (2026)
par: Miao, Tingjia, et autres
Publié: (2026)
LEGO: Self-Supervised Representation Learning for Scene Text Images
par: Ren, Yujin, et autres
Publié: (2024)
par: Ren, Yujin, et autres
Publié: (2024)
Privacy-Preserving Biometric Verification with Handwritten Random Digit String
par: Zhang, Peirong, et autres
Publié: (2025)
par: Zhang, Peirong, et autres
Publié: (2025)
MME-VideoOCR: Evaluating OCR-Based Capabilities of Multimodal LLMs in Video Scenarios
par: Shi, Yang, et autres
Publié: (2025)
par: Shi, Yang, et autres
Publié: (2025)
WebCoderBench: Benchmarking Web Application Generation with Comprehensive and Interpretable Evaluation Metrics
par: Liu, Chenxu, et autres
Publié: (2026)
par: Liu, Chenxu, et autres
Publié: (2026)
MemBench: Towards More Comprehensive Evaluation on the Memory of LLM-based Agents
par: Tan, Haoran, et autres
Publié: (2025)
par: Tan, Haoran, et autres
Publié: (2025)
CC-OCR: A Comprehensive and Challenging OCR Benchmark for Evaluating Large Multimodal Models in Literacy
par: Yang, Zhibo, et autres
Publié: (2024)
par: Yang, Zhibo, et autres
Publié: (2024)
AIR-Bench: Benchmarking Large Audio-Language Models via Generative Comprehension
par: Yang, Qian, et autres
Publié: (2024)
par: Yang, Qian, et autres
Publié: (2024)
TCC-Bench: Benchmarking the Traditional Chinese Culture Understanding Capabilities of MLLMs
par: Xu, Pengju, et autres
Publié: (2025)
par: Xu, Pengju, et autres
Publié: (2025)
TongGu: Mastering Classical Chinese Understanding with Knowledge-Grounded Large Language Models
par: Cao, Jiahuan, et autres
Publié: (2024)
par: Cao, Jiahuan, et autres
Publié: (2024)
AudioCodecBench: A Comprehensive Benchmark for Audio Codec Evaluation
par: Wang, Lu, et autres
Publié: (2025)
par: Wang, Lu, et autres
Publié: (2025)
DocKylin: A Large Multimodal Model for Visual Document Understanding with Efficient Visual Slimming
par: Zhang, Jiaxin, et autres
Publié: (2024)
par: Zhang, Jiaxin, et autres
Publié: (2024)
AirQualityBench: A Realistic Evaluation Benchmark for Global Air Quality Forecasting
par: Xu, Xing, et autres
Publié: (2026)
par: Xu, Xing, et autres
Publié: (2026)
UrbanPlanBench: A Comprehensive Urban Planning Benchmark for Evaluating Large Language Models
par: Zheng, Yu, et autres
Publié: (2025)
par: Zheng, Yu, et autres
Publié: (2025)
PodBench: A Comprehensive Benchmark for Instruction-Aware Audio-Oriented Podcast Script Generation
par: Xu, Chenning, et autres
Publié: (2026)
par: Xu, Chenning, et autres
Publié: (2026)
CausalBench: A Comprehensive Benchmark for Causal Learning Capability of LLMs
par: Zhou, Yu, et autres
Publié: (2024)
par: Zhou, Yu, et autres
Publié: (2024)
When Good OCR Is Not Enough: Benchmarking OCR Robustness for Retrieval-Augmented Generation
par: Sun, Lin, et autres
Publié: (2026)
par: Sun, Lin, et autres
Publié: (2026)
VideoRewardBench: Comprehensive Evaluation of Multimodal Reward Models for Video Understanding
par: Zhang, Zhihong, et autres
Publié: (2025)
par: Zhang, Zhihong, et autres
Publié: (2025)
KITAB-Bench: A Comprehensive Multi-Domain Benchmark for Arabic OCR and Document Understanding
par: Heakl, Ahmed, et autres
Publié: (2025)
par: Heakl, Ahmed, et autres
Publié: (2025)
WritingBench: A Comprehensive Benchmark for Generative Writing
par: Wu, Yuning, et autres
Publié: (2025)
par: Wu, Yuning, et autres
Publié: (2025)
OCR-Agent: Agentic OCR with Capability and Memory Reflection
par: Wen, Shimin, et autres
Publié: (2026)
par: Wen, Shimin, et autres
Publié: (2026)
HelloBench: Evaluating Long Text Generation Capabilities of Large Language Models
par: Que, Haoran, et autres
Publié: (2024)
par: Que, Haoran, et autres
Publié: (2024)
Online Signature Verification based on the Lagrange formulation with 2D and 3D robotic models
par: Diaz, Moises, et autres
Publié: (2025)
par: Diaz, Moises, et autres
Publié: (2025)
OCRBench: On the Hidden Mystery of OCR in Large Multimodal Models
par: Liu, Yuliang, et autres
Publié: (2023)
par: Liu, Yuliang, et autres
Publié: (2023)
KernelBenchX: A Comprehensive Benchmark for Evaluating LLM-Generated GPU Kernels
par: Wang, Han, et autres
Publié: (2026)
par: Wang, Han, et autres
Publié: (2026)
OCR Hinders RAG: Evaluating the Cascading Impact of OCR on Retrieval-Augmented Generation
par: Zhang, Junyuan, et autres
Publié: (2024)
par: Zhang, Junyuan, et autres
Publié: (2024)
MMT-Bench: A Comprehensive Multimodal Benchmark for Evaluating Large Vision-Language Models Towards Multitask AGI
par: Ying, Kaining, et autres
Publié: (2024)
par: Ying, Kaining, et autres
Publié: (2024)
AI Idea Bench 2025: AI Research Idea Generation Benchmark
par: Qiu, Yansheng, et autres
Publié: (2025)
par: Qiu, Yansheng, et autres
Publié: (2025)
Documents similaires
-
PosterVerse: A Full-Workflow Framework for Commercial-Grade Poster Generation with HTML-Based Scalable Typography
par: Liu, Junle, et autres
Publié: (2026) -
MegaHan97K: A Large-Scale Dataset for Mega-Category Chinese Character Recognition with over 97K Categories
par: Zhang, Yuyi, et autres
Publié: (2025) -
Reviving Cultural Heritage: A Novel Approach for Comprehensive Historical Document Restoration
par: Zhang, Yuyi, et autres
Publié: (2025) -
Online Writer Retrieval with Chinese Handwritten Phrases: A Synergistic Temporal-Frequency Representation Learning Approach
par: Zhang, Peirong, et autres
Publié: (2024) -
Smaller But Better: Unifying Layout Generation with Smaller Large Language Models
par: Zhang, Peirong, et autres
Publié: (2025)