KhmerST: A Low-Resource Khmer Scene Text Detection and Recognition Benchmark
Fuente:
arXiv
Guardado en:
| Autores principales: | Nom, Vannkinh, Bakkali, Souhail, Luqman, Muhammad Muzzamil, Coustaty, Mickaël, Ogier, Jean-Marc |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Evaluating the Impact of Khmer Font Types on Text Recognition
por: Nom, Vannkinh, et al.
Publicado: (2025)
por: Nom, Vannkinh, et al.
Publicado: (2025)
Towards Universal Khmer Text Recognition
por: Kong, Marry, et al.
Publicado: (2026)
por: Kong, Marry, et al.
Publicado: (2026)
Towards Khmer Scene Document Layout Detection
por: Kong, Marry, et al.
Publicado: (2026)
por: Kong, Marry, et al.
Publicado: (2026)
Confidence-Aware Document OCR Error Detection
por: Hemmer, Arthur, et al.
Publicado: (2024)
por: Hemmer, Arthur, et al.
Publicado: (2024)
IDTrust: Deep Identity Document Quality Detection with Bandpass Filtering
por: Al-Ghadi, Musab, et al.
Publicado: (2024)
por: Al-Ghadi, Musab, et al.
Publicado: (2024)
GlobalDoc: A Cross-Modal Vision-Language Framework for Real-World Document Image Retrieval and Classification
por: Bakkali, Souhail, et al.
Publicado: (2023)
por: Bakkali, Souhail, et al.
Publicado: (2023)
RAPTOR: Refined Approach for Product Table Object Recognition
por: Thomas, Eliott, et al.
Publicado: (2025)
por: Thomas, Eliott, et al.
Publicado: (2025)
Hybrid Retrieval-Augmented Generation for Robust Multilingual Document Question Answering
por: Mudet, Anthony, et al.
Publicado: (2025)
por: Mudet, Anthony, et al.
Publicado: (2025)
KH-FUNSD: A Hierarchical and Fine-Grained Layout Analysis Dataset for Low-Resource Khmer Business Document
por: Thuon, Nimol, et al.
Publicado: (2025)
por: Thuon, Nimol, et al.
Publicado: (2025)
DocSum: Domain-Adaptive Pre-training for Document Abstractive Summarization
por: Chau, Phan Phuong Mai, et al.
Publicado: (2024)
por: Chau, Phan Phuong Mai, et al.
Publicado: (2024)
Dataset and Benchmark for Urdu Natural Scenes Text Detection, Recognition and Visual Question Answering
por: Maryam, Hiba, et al.
Publicado: (2024)
por: Maryam, Hiba, et al.
Publicado: (2024)
Reading in the Dark: Low-light Scene Text Recognition
por: Fu, Xuanshuo, et al.
Publicado: (2026)
por: Fu, Xuanshuo, et al.
Publicado: (2026)
Handwritten Text Recognition for Low Resource Languages
por: Dey, Sayantan, et al.
Publicado: (2025)
por: Dey, Sayantan, et al.
Publicado: (2025)
CLIP-SLA: Parameter-Efficient CLIP Adaptation for Continuous Sign Language Recognition
por: Alyami, Sarah, et al.
Publicado: (2025)
por: Alyami, Sarah, et al.
Publicado: (2025)
The First Swahili Language Scene Text Detection and Recognition Dataset
por: Douamba, Fadila Wendigoundi, et al.
Publicado: (2024)
por: Douamba, Fadila Wendigoundi, et al.
Publicado: (2024)
Isharah: A Large-Scale Multi-Scene Dataset for Continuous Sign Language Recognition
por: Alyami, Sarah, et al.
Publicado: (2025)
por: Alyami, Sarah, et al.
Publicado: (2025)
Multimodal Adaptive Inference for Document Image Classification with Anytime Early Exiting
por: Hamed, Omar, et al.
Publicado: (2024)
por: Hamed, Omar, et al.
Publicado: (2024)
ClapperText: A Benchmark for Text Recognition in Low-Resource Archival Documents
por: Lin, Tingyu, et al.
Publicado: (2025)
por: Lin, Tingyu, et al.
Publicado: (2025)
USTM: Unified Spatial and Temporal Modeling for Continuous Sign Language Recognition
por: Hasanaath, Ahmed Abul, et al.
Publicado: (2025)
por: Hasanaath, Ahmed Abul, et al.
Publicado: (2025)
STELLAR: Scene Text Editor for Low-Resource Languages and Real-World Data
por: Seo, Yongdeuk, et al.
Publicado: (2025)
por: Seo, Yongdeuk, et al.
Publicado: (2025)
Recognition-Synergistic Scene Text Editing
por: Fang, Zhengyao, et al.
Publicado: (2025)
por: Fang, Zhengyao, et al.
Publicado: (2025)
Instruction-Guided Scene Text Recognition
por: Du, Yongkun, et al.
Publicado: (2024)
por: Du, Yongkun, et al.
Publicado: (2024)
A Comparative Study of Continuous Sign Language Recognition Techniques
por: Alyami, Sarah, et al.
Publicado: (2024)
por: Alyami, Sarah, et al.
Publicado: (2024)
Decoder Pre-Training with only Text for Scene Text Recognition
por: Zhao, Shuai, et al.
Publicado: (2024)
por: Zhao, Shuai, et al.
Publicado: (2024)
TEACH: Text Encoding as Curriculum Hints for Scene Text Recognition
por: Yang, Xiahan, et al.
Publicado: (2025)
por: Yang, Xiahan, et al.
Publicado: (2025)
TextSculptor: Training and Benchmarking Scene Text Editing
por: Lin, Yiheng, et al.
Publicado: (2026)
por: Lin, Yiheng, et al.
Publicado: (2026)
Dynamic-Dark SLAM: RGB-Thermal Cooperative Robot Vision Strategy for Multi-Person Tracking in Both Well-Lit and Low-Light Scenes
por: Sakai, Tatsuro, et al.
Publicado: (2025)
por: Sakai, Tatsuro, et al.
Publicado: (2025)
TextSSR: Diffusion-based Data Synthesis for Scene Text Recognition
por: Ye, Xingsong, et al.
Publicado: (2024)
por: Ye, Xingsong, et al.
Publicado: (2024)
Aggregated Text Transformer for Scene Text Detection
por: Zhou, Zhao, et al.
Publicado: (2022)
por: Zhou, Zhao, et al.
Publicado: (2022)
Efficient and Accurate Scene Text Recognition with Cascaded-Transformers
por: Ozkan, Savas, et al.
Publicado: (2025)
por: Ozkan, Savas, et al.
Publicado: (2025)
LRANet: Towards Accurate and Efficient Scene Text Detection with Low-Rank Approximation Network
por: Su, Yuchen, et al.
Publicado: (2023)
por: Su, Yuchen, et al.
Publicado: (2023)
Optimal Transport for Handwritten Text Recognition in a Low-Resource Regime
por: Wraight, Petros Georgoulas, et al.
Publicado: (2025)
por: Wraight, Petros Georgoulas, et al.
Publicado: (2025)
Masked and Permuted Implicit Context Learning for Scene Text Recognition
por: Yang, Xiaomeng, et al.
Publicado: (2023)
por: Yang, Xiaomeng, et al.
Publicado: (2023)
The Devil is in Fine-tuning and Long-tailed Problems:A New Benchmark for Scene Text Detection
por: Cao, Tianjiao, et al.
Publicado: (2025)
por: Cao, Tianjiao, et al.
Publicado: (2025)
To Supervise or Not to Supervise: Understanding and Addressing the Key Challenges of Point Cloud Transfer Learning
por: Hadgi, Souhail, et al.
Publicado: (2024)
por: Hadgi, Souhail, et al.
Publicado: (2024)
TextVidBench: A Benchmark for Long Video Scene Text Understanding
por: Zhong, Yangyang, et al.
Publicado: (2025)
por: Zhong, Yangyang, et al.
Publicado: (2025)
EventSTR: A Benchmark Dataset and Baselines for Event Stream based Scene Text Recognition
por: Wang, Xiao, et al.
Publicado: (2025)
por: Wang, Xiao, et al.
Publicado: (2025)
Scene Text Detection and Recognition "in light of" Challenging Environmental Conditions using Aria Glasses Egocentric Vision Cameras
por: De Mathia, Joseph, et al.
Publicado: (2025)
por: De Mathia, Joseph, et al.
Publicado: (2025)
CMFN: Cross-Modal Fusion Network for Irregular Scene Text Recognition
por: Zheng, Jinzhi, et al.
Publicado: (2024)
por: Zheng, Jinzhi, et al.
Publicado: (2024)
MDiff4STR: Mask Diffusion Model for Scene Text Recognition
por: Du, Yongkun, et al.
Publicado: (2025)
por: Du, Yongkun, et al.
Publicado: (2025)
Ejemplares similares
-
Evaluating the Impact of Khmer Font Types on Text Recognition
por: Nom, Vannkinh, et al.
Publicado: (2025) -
Towards Universal Khmer Text Recognition
por: Kong, Marry, et al.
Publicado: (2026) -
Towards Khmer Scene Document Layout Detection
por: Kong, Marry, et al.
Publicado: (2026) -
Confidence-Aware Document OCR Error Detection
por: Hemmer, Arthur, et al.
Publicado: (2024) -
IDTrust: Deep Identity Document Quality Detection with Bandpass Filtering
por: Al-Ghadi, Musab, et al.
Publicado: (2024)