Guardado en:
| Autores principales: | Bourne, Jonathan, Simbeye, Mwiza, Nockels, Joseph |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | https://arxiv.org/abs/2604.06160 |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
The COTe score: A decomposable framework for evaluating Document Layout Analysis models
por: Bourne, Jonathan, et al.
Publicado: (2026)
por: Bourne, Jonathan, et al.
Publicado: (2026)
TextPixs: Glyph-Conditioned Diffusion with Character-Aware Attention and OCR-Guided Supervision
por: Gillani, Syeda Anshrah, et al.
Publicado: (2025)
por: Gillani, Syeda Anshrah, et al.
Publicado: (2025)
Decomposed evaluations of geographic disparities in text-to-image models
por: Sureddy, Abhishek, et al.
Publicado: (2024)
por: Sureddy, Abhishek, et al.
Publicado: (2024)
Uncertainty-Aware Decomposed Hybrid Networks
por: Ditzel, Sina, et al.
Publicado: (2025)
por: Ditzel, Sina, et al.
Publicado: (2025)
Evaluation of Ensemble Learning Techniques for handwritten OCR Improvement
por: Preiß, Martin
Publicado: (2025)
por: Preiß, Martin
Publicado: (2025)
SimpleOCR: Rendering Visualized Questions to Teach MLLMs to Read
por: Peng, Yibo, et al.
Publicado: (2026)
por: Peng, Yibo, et al.
Publicado: (2026)
PubMed-OCR: PMC Open Access OCR Annotations
por: Heidenreich, Hunter, et al.
Publicado: (2026)
por: Heidenreich, Hunter, et al.
Publicado: (2026)
Decompose-and-Compose: A Compositional Approach to Mitigating Spurious Correlation
por: Noohdani, Fahimeh Hosseini, et al.
Publicado: (2024)
por: Noohdani, Fahimeh Hosseini, et al.
Publicado: (2024)
DeSplat: Decomposed Gaussian Splatting for Distractor-Free Rendering
por: Wang, Yihao, et al.
Publicado: (2024)
por: Wang, Yihao, et al.
Publicado: (2024)
Video Decomposition Prior: A Methodology to Decompose Videos into Layers
por: Shrivastava, Gaurav, et al.
Publicado: (2024)
por: Shrivastava, Gaurav, et al.
Publicado: (2024)
Benchmarking OCR Pipelines with Adaptive Enhancement for Multi-Domain Retail Bill Digitization
por: Gaikwad, Vijaysinh
Publicado: (2026)
por: Gaikwad, Vijaysinh
Publicado: (2026)
The OCR Quest for Generalization: Learning to recognize low-resource alphabets with model editing
por: Rodríguez, Adrià Molina, et al.
Publicado: (2025)
por: Rodríguez, Adrià Molina, et al.
Publicado: (2025)
IsoCLIP: Decomposing CLIP Projectors for Efficient Intra-modal Alignment
por: Magistri, Simone, et al.
Publicado: (2026)
por: Magistri, Simone, et al.
Publicado: (2026)
Improving Chinese Character Representation with Formation Tree
por: Hong, Yang, et al.
Publicado: (2024)
por: Hong, Yang, et al.
Publicado: (2024)
Learning Decomposable and Debiased Representations via Attribute-Centric Information Bottlenecks
por: Hong, Jinyung, et al.
Publicado: (2024)
por: Hong, Jinyung, et al.
Publicado: (2024)
Contrastive Learning for Character Detection in Ancient Greek Papyri
por: Nakka, Vedasri, et al.
Publicado: (2024)
por: Nakka, Vedasri, et al.
Publicado: (2024)
SliderSpace: Decomposing the Visual Capabilities of Diffusion Models
por: Gandikota, Rohit, et al.
Publicado: (2025)
por: Gandikota, Rohit, et al.
Publicado: (2025)
A Sobel-Gradient MLP Baseline for Handwritten Character Recognition
por: Nouri, Azam
Publicado: (2025)
por: Nouri, Azam
Publicado: (2025)
Deep Learning-Driven Approach for Handwritten Chinese Character Classification
por: Kriuk, Boris, et al.
Publicado: (2024)
por: Kriuk, Boris, et al.
Publicado: (2024)
ToonOut: Fine-tuned Background-Removal for Anime Characters
por: Muratori, Matteo, et al.
Publicado: (2025)
por: Muratori, Matteo, et al.
Publicado: (2025)
Towards Accessible Learning: Deep Learning-Based Potential Dysgraphia Detection and OCR for Potentially Dysgraphic Handwriting
por: D, Vydeki, et al.
Publicado: (2024)
por: D, Vydeki, et al.
Publicado: (2024)
A Benchmark of State-Space Models vs. Transformers and BiLSTM-based Models for Historical Newspaper OCR
por: Agbeti-messan, Merveilles, et al.
Publicado: (2026)
por: Agbeti-messan, Merveilles, et al.
Publicado: (2026)
Contrastive Masked Autoencoders for Character-Level Open-Set Writer Identification
por: Jiang, Xiaowei, et al.
Publicado: (2025)
por: Jiang, Xiaowei, et al.
Publicado: (2025)
Lookahead Anchoring: Preserving Character Identity in Audio-Driven Human Animation
por: Seo, Junyoung, et al.
Publicado: (2025)
por: Seo, Junyoung, et al.
Publicado: (2025)
Multi-Cell Decoder and Mutual Learning for Table Structure and Character Recognition
por: Kawakatsu, Takaya
Publicado: (2024)
por: Kawakatsu, Takaya
Publicado: (2024)
From Label Error Detection to Correction: A Modular Framework and Benchmark for Object Detection Datasets
por: Penquitt, Sarina, et al.
Publicado: (2025)
por: Penquitt, Sarina, et al.
Publicado: (2025)
DoRAN: Stabilizing Weight-Decomposed Low-Rank Adaptation via Noise Injection and Auxiliary Networks
por: Diep, Nghiem T., et al.
Publicado: (2025)
por: Diep, Nghiem T., et al.
Publicado: (2025)
Masked Vector Quantization
por: Nguyen, David D., et al.
Publicado: (2023)
por: Nguyen, David D., et al.
Publicado: (2023)
Improving OCR Quality in 19th Century Historical Documents Using a Combined Machine Learning Based Approach
por: Fleischhacker, David, et al.
Publicado: (2024)
por: Fleischhacker, David, et al.
Publicado: (2024)
Rotation-free Online Handwritten Character Recognition Using Linear Recurrent Units
por: Ling, Zhe, et al.
Publicado: (2026)
por: Ling, Zhe, et al.
Publicado: (2026)
Identity-Preserving Pose-Guided Character Animation via Facial Landmarks Transformation
por: Mu, Lianrui, et al.
Publicado: (2024)
por: Mu, Lianrui, et al.
Publicado: (2024)
GANime: Generating Anime and Manga Character Drawings from Sketches with Deep Learning
por: Vu, Tai, et al.
Publicado: (2025)
por: Vu, Tai, et al.
Publicado: (2025)
MatriVasha: A Multipurpose Comprehensive Database for Bangla Handwritten Compound Characters
por: Ferdous, Jannatul, et al.
Publicado: (2020)
por: Ferdous, Jannatul, et al.
Publicado: (2020)
LatentMan: Generating Consistent Animated Characters using Image Diffusion Models
por: Eldesokey, Abdelrahman, et al.
Publicado: (2023)
por: Eldesokey, Abdelrahman, et al.
Publicado: (2023)
Improving OCR using internal document redundancy
por: Belzarena, Diego, et al.
Publicado: (2025)
por: Belzarena, Diego, et al.
Publicado: (2025)
BMI Prediction from Handwritten English Characters Using a Convolutional Neural Network
por: Diba, N. T., et al.
Publicado: (2024)
por: Diba, N. T., et al.
Publicado: (2024)
BanglaNet: Bangla Handwritten Character Recognition using Ensembling of Convolutional Neural Network
por: Saha, Chandrika, et al.
Publicado: (2024)
por: Saha, Chandrika, et al.
Publicado: (2024)
ORACLE: Leveraging Mutual Information for Consistent Character Generation with LoRAs in Diffusion Models
por: Akdemir, Kiymet, et al.
Publicado: (2024)
por: Akdemir, Kiymet, et al.
Publicado: (2024)
An Intrinsic Vector Heat Network
por: Gao, Alexander, et al.
Publicado: (2024)
por: Gao, Alexander, et al.
Publicado: (2024)
Low-Resource Heuristics for Bahnaric Optical Character Recognition Improvement
por: Tran, Phat, et al.
Publicado: (2026)
por: Tran, Phat, et al.
Publicado: (2026)
Ejemplares similares
-
The COTe score: A decomposable framework for evaluating Document Layout Analysis models
por: Bourne, Jonathan, et al.
Publicado: (2026) -
TextPixs: Glyph-Conditioned Diffusion with Character-Aware Attention and OCR-Guided Supervision
por: Gillani, Syeda Anshrah, et al.
Publicado: (2025) -
Decomposed evaluations of geographic disparities in text-to-image models
por: Sureddy, Abhishek, et al.
Publicado: (2024) -
Uncertainty-Aware Decomposed Hybrid Networks
por: Ditzel, Sina, et al.
Publicado: (2025) -
Evaluation of Ensemble Learning Techniques for handwritten OCR Improvement
por: Preiß, Martin
Publicado: (2025)