Adapting TrOCR for Printed Tigrinya Text Recognition: Word-Aware Loss Weighting for Cross-Script Transfer Learning
Fuente:
arXiv
Saved in:
| Main Authors: | Medhanie, Yonatan Haile, Ni, Yuanhua |
|---|---|
| Format: | Preprint |
| Published: |
2026
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Error Patterns in Historical OCR: A Comparative Analysis of TrOCR and a Vision-Language Model
by: Vesalainen, Ari, et al.
Published: (2026)
by: Vesalainen, Ari, et al.
Published: (2026)
Spanish TrOCR: Leveraging Transfer Learning for Language Adaptation
by: Lauar, Filipe, et al.
Published: (2024)
by: Lauar, Filipe, et al.
Published: (2024)
ExPLoRA: Parameter-Efficient Extended Pre-Training to Adapt Vision Transformers under Domain Shifts
by: Khanna, Samar, et al.
Published: (2024)
by: Khanna, Samar, et al.
Published: (2024)
GlotOCR Bench: OCR Models Still Struggle Beyond a Handful of Unicode Scripts
by: Kargaran, Amir Hossein, et al.
Published: (2026)
by: Kargaran, Amir Hossein, et al.
Published: (2026)
KazakhOCR: A Synthetic Benchmark for Evaluating Multimodal Models in Low-Resource Kazakh Script OCR
by: Gagnier, Henry, et al.
Published: (2026)
by: Gagnier, Henry, et al.
Published: (2026)
PLATTER: A Page-Level Handwritten Text Recognition System for Indic Scripts
by: Kasuba, Badri Vishal, et al.
Published: (2025)
by: Kasuba, Badri Vishal, et al.
Published: (2025)
Advances and Limitations in Open Source Arabic-Script OCR: A Case Study
by: Kiessling, Benjamin, et al.
Published: (2024)
by: Kiessling, Benjamin, et al.
Published: (2024)
SARD: A Large-Scale Synthetic Arabic OCR Dataset for Book-Style Text Recognition
by: Nacar, Omer, et al.
Published: (2025)
by: Nacar, Omer, et al.
Published: (2025)
TC-OCR: TableCraft OCR for Efficient Detection & Recognition of Table Structure & Content
by: Anand, Avinash, et al.
Published: (2024)
by: Anand, Avinash, et al.
Published: (2024)
Combining OCR Models for Reading Early Modern Printed Books
by: Seuret, Mathias, et al.
Published: (2023)
by: Seuret, Mathias, et al.
Published: (2023)
SPRINT: Script-agnostic Structure Recognition in Tables
by: Kudale, Dhruv, et al.
Published: (2025)
by: Kudale, Dhruv, et al.
Published: (2025)
Reference-Based Post-OCR Processing with LLM for Precise Diacritic Text in Historical Document Recognition
by: Do, Thao, et al.
Published: (2024)
by: Do, Thao, et al.
Published: (2024)
SAViL-Det: Semantic-Aware Vision-Language Model for Multi-Script Text Detection
by: Zighem, Mohammed-En-Nadhir, et al.
Published: (2025)
by: Zighem, Mohammed-En-Nadhir, et al.
Published: (2025)
GaitAdapt: Continual Learning for Evolving Gait Recognition
by: Wang, Jingjie, et al.
Published: (2025)
by: Wang, Jingjie, et al.
Published: (2025)
Cross-Language Learning within Arabic Script for Low-Resource HTR
by: Al-azzawi, Sana, et al.
Published: (2026)
by: Al-azzawi, Sana, et al.
Published: (2026)
Ancient Script Image Recognition and Processing: A Review
by: Diao, Xiaolei, et al.
Published: (2025)
by: Diao, Xiaolei, et al.
Published: (2025)
Semi-Supervised Transfer Boosting (SS-TrBoosting)
by: Deng, Lingfei, et al.
Published: (2024)
by: Deng, Lingfei, et al.
Published: (2024)
Learning from Mistakes: Loss-Aware Memory Enhanced Continual Learning for LiDAR Place Recognition
by: Wang, Xufei, et al.
Published: (2025)
by: Wang, Xufei, et al.
Published: (2025)
Percept, Chat, and then Adapt: Multimodal Knowledge Transfer of Foundation Models for Open-World Video Recognition
by: Chen, Boyu, et al.
Published: (2024)
by: Chen, Boyu, et al.
Published: (2024)
Class Distance Weighted Cross Entropy Loss for Classification of Disease Severity
by: Polat, Gorkem, et al.
Published: (2024)
by: Polat, Gorkem, et al.
Published: (2024)
Improving OCR for Historical Texts of Multiple Languages
by: Westerdijk, Hylke, et al.
Published: (2025)
by: Westerdijk, Hylke, et al.
Published: (2025)
GPA-VGGT:Adapting VGGT to Large Scale Localization by Self-Supervised Learning with Geometry and Physics Aware Loss
by: Xu, Yangfan, et al.
Published: (2026)
by: Xu, Yangfan, et al.
Published: (2026)
TextSR: Diffusion Super-Resolution with Multilingual OCR Guidance
by: Ye, Keren, et al.
Published: (2025)
by: Ye, Keren, et al.
Published: (2025)
Deciphering the Underserved: Benchmarking LLM OCR for Low-Resource Scripts
by: Sohail, Muhammad Abdullah, et al.
Published: (2024)
by: Sohail, Muhammad Abdullah, et al.
Published: (2024)
Transfer Learning for Cross-dataset Isolated Sign Language Recognition in Under-Resourced Datasets
by: Kindiroglu, Ahmet Alp, et al.
Published: (2024)
by: Kindiroglu, Ahmet Alp, et al.
Published: (2024)
Temporal Consistency Constrained Transferable Adversarial Attacks with Background Mixup for Action Recognition
by: Li, Ping, et al.
Published: (2025)
by: Li, Ping, et al.
Published: (2025)
From Static to Dynamic: Adapting Landmark-Aware Image Models for Facial Expression Recognition in Videos
by: Chen, Yin, et al.
Published: (2023)
by: Chen, Yin, et al.
Published: (2023)
TextFlux: An OCR-Free DiT Model for High-Fidelity Multilingual Scene Text Synthesis
by: Xie, Yu, et al.
Published: (2025)
by: Xie, Yu, et al.
Published: (2025)
QARI-OCR: High-Fidelity Arabic Text Recognition through Multimodal Large Language Model Adaptation
by: Wasfy, Ahmed, et al.
Published: (2025)
by: Wasfy, Ahmed, et al.
Published: (2025)
Learning to Adapt SAM for Segmenting Cross-domain Point Clouds
by: Peng, Xidong, et al.
Published: (2023)
by: Peng, Xidong, et al.
Published: (2023)
MonkeyOCR: Document Parsing with a Structure-Recognition-Relation Triplet Paradigm
by: Li, Zhang, et al.
Published: (2025)
by: Li, Zhang, et al.
Published: (2025)
CAST: Channel-Aware Spatial Transfer Learning with Pseudo-Image Radar for Sign Language Recognition
by: Shujon, Md. Shakhoyat Rahman, et al.
Published: (2026)
by: Shujon, Md. Shakhoyat Rahman, et al.
Published: (2026)
Learning Continuous 3D Words for Text-to-Image Generation
by: Cheng, Ta-Ying, et al.
Published: (2024)
by: Cheng, Ta-Ying, et al.
Published: (2024)
A Robust Deep Learning Framework for Bangla License Plate Recognition Using YOLO and Vision-Language OCR
by: Hasin, Nayeb, et al.
Published: (2026)
by: Hasin, Nayeb, et al.
Published: (2026)
Language-Agnostic Visual Embeddings for Cross-Script Handwriting Retrieval
by: Chen, Fangke, et al.
Published: (2026)
by: Chen, Fangke, et al.
Published: (2026)
Text-guided Feature Disentanglement for Cross-modal Gait Recognition
by: Lu, Zhiyang, et al.
Published: (2026)
by: Lu, Zhiyang, et al.
Published: (2026)
Open-Vocabulary Scene Text Recognition via Pseudo-Image Labeling and Margin Loss
by: Ren, Xuhua, et al.
Published: (2024)
by: Ren, Xuhua, et al.
Published: (2024)
OCR-Agent: Agentic OCR with Capability and Memory Reflection
by: Wen, Shimin, et al.
Published: (2026)
by: Wen, Shimin, et al.
Published: (2026)
OmniOCR: Generalist OCR for Ethnic Minority Languages
by: Liu, Bonan, et al.
Published: (2026)
by: Liu, Bonan, et al.
Published: (2026)
WordCon: Word-level Typography Control in Scene Text Rendering
by: Shi, Wenda, et al.
Published: (2025)
by: Shi, Wenda, et al.
Published: (2025)
Similar Items
-
Error Patterns in Historical OCR: A Comparative Analysis of TrOCR and a Vision-Language Model
by: Vesalainen, Ari, et al.
Published: (2026) -
Spanish TrOCR: Leveraging Transfer Learning for Language Adaptation
by: Lauar, Filipe, et al.
Published: (2024) -
ExPLoRA: Parameter-Efficient Extended Pre-Training to Adapt Vision Transformers under Domain Shifts
by: Khanna, Samar, et al.
Published: (2024) -
GlotOCR Bench: OCR Models Still Struggle Beyond a Handful of Unicode Scripts
by: Kargaran, Amir Hossein, et al.
Published: (2026) -
KazakhOCR: A Synthetic Benchmark for Evaluating Multimodal Models in Low-Resource Kazakh Script OCR
by: Gagnier, Henry, et al.
Published: (2026)