Enhancing OCR for Sino-Vietnamese Language Processing via Fine-tuned PaddleOCRv5
Fuente:
arXiv
Salvato in:
| Autori principali: | Nguyen, Minh Hoang, Thiet, Su Nguyen |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Co-NAML-LSTUR: A Combined Model with Attentive Multi-View Learning and Long- and Short-term User Representations for News Recommendation
di: Nguyen, Minh Hoang, et al.
Pubblicazione: (2025)
di: Nguyen, Minh Hoang, et al.
Pubblicazione: (2025)
From Surface to Semantics: Semantic Structure Parsing for Table-Centric Document Analysis
di: Li, Xuan, et al.
Pubblicazione: (2025)
di: Li, Xuan, et al.
Pubblicazione: (2025)
Multilingual Multi-Label Emotion Classification at Scale with Synthetic Data
di: Borisov, Vadim
Pubblicazione: (2026)
di: Borisov, Vadim
Pubblicazione: (2026)
Transparent but Powerful: Explainability, Accuracy, and Generalizability in ADHD Detection from Social Media Data
di: Wiechmann, D., et al.
Pubblicazione: (2024)
di: Wiechmann, D., et al.
Pubblicazione: (2024)
LLM-supported document separation for printed reviews from zbMATH Open
di: Pluzhnikov, Ivan, et al.
Pubblicazione: (2026)
di: Pluzhnikov, Ivan, et al.
Pubblicazione: (2026)
Logits-Constrained Framework with RoBERTa for Ancient Chinese NER
di: Hua, Wenjie, et al.
Pubblicazione: (2025)
di: Hua, Wenjie, et al.
Pubblicazione: (2025)
VietMed-MCQ: A Consistency-Filtered Data Synthesis Framework for Vietnamese Traditional Medicine Evaluation
di: Kiet, Huynh Trung, et al.
Pubblicazione: (2026)
di: Kiet, Huynh Trung, et al.
Pubblicazione: (2026)
Beyond Subtokens: A Rich Character Embedding for Low-resource and Morphologically Complex Languages
di: Schneider, Felix, et al.
Pubblicazione: (2026)
di: Schneider, Felix, et al.
Pubblicazione: (2026)
LegalGuardian: A Privacy-Preserving Framework for Secure Integration of Large Language Models in Legal Practice
di: Demir, M. Mikail, et al.
Pubblicazione: (2025)
di: Demir, M. Mikail, et al.
Pubblicazione: (2025)
PaperAudit-Bench: Benchmarking Error Detection in Research Papers for Critical Automated Peer Review
di: Tu, Songjun, et al.
Pubblicazione: (2026)
di: Tu, Songjun, et al.
Pubblicazione: (2026)
NERCat: Fine-Tuning for Enhanced Named Entity Recognition in Catalan
di: Ferreres, Guillem Cadevall, et al.
Pubblicazione: (2025)
di: Ferreres, Guillem Cadevall, et al.
Pubblicazione: (2025)
Fine-tuning of Large Language Models for Constituency Parsing Using a Sequence to Sequence Approach
di: Delgado, Francisco Jose Cortes, et al.
Pubblicazione: (2025)
di: Delgado, Francisco Jose Cortes, et al.
Pubblicazione: (2025)
ECLAIR: Enhanced Clarification for Interactive Responses in an Enterprise AI Assistant
di: Murzaku, John, et al.
Pubblicazione: (2025)
di: Murzaku, John, et al.
Pubblicazione: (2025)
Prompt Engineering and the Effectiveness of Large Language Models in Enhancing Human Productivity
di: Anam, Rizal Khoirul
Pubblicazione: (2025)
di: Anam, Rizal Khoirul
Pubblicazione: (2025)
Multi-Agent Synergy-Driven Iterative Visual Narrative Synthesis
di: Xi, Wang, et al.
Pubblicazione: (2025)
di: Xi, Wang, et al.
Pubblicazione: (2025)
Improving French Synthetic Speech Quality via SSML Prosody Control
di: Ouali, Nassima Ould, et al.
Pubblicazione: (2025)
di: Ouali, Nassima Ould, et al.
Pubblicazione: (2025)
Mechanistic Analysis of Catastrophic Forgetting in Large Language Models During Continual Fine-tuning
di: Imanov, Olaf Yunus Laitinen
Pubblicazione: (2026)
di: Imanov, Olaf Yunus Laitinen
Pubblicazione: (2026)
MELoRA: Mini-Ensemble Low-Rank Adapters for Parameter-Efficient Fine-Tuning
di: Ren, Pengjie, et al.
Pubblicazione: (2024)
di: Ren, Pengjie, et al.
Pubblicazione: (2024)
Approaches to Semantic Textual Similarity in Slovak Language: From Algorithms to Transformers
di: Radosky, Lukas, et al.
Pubblicazione: (2026)
di: Radosky, Lukas, et al.
Pubblicazione: (2026)
Evaluating Pixel Language Models on Non-Standardized Languages
di: Muñoz-Ortiz, Alberto, et al.
Pubblicazione: (2024)
di: Muñoz-Ortiz, Alberto, et al.
Pubblicazione: (2024)
Vis-CoT: A Human-in-the-Loop Framework for Interactive Visualization and Intervention in LLM Chain-of-Thought Reasoning
di: Pather, Kaviraj, et al.
Pubblicazione: (2025)
di: Pather, Kaviraj, et al.
Pubblicazione: (2025)
Aligning LLMs for Multilingual Consistency in Enterprise Applications
di: Agarwal, Amit, et al.
Pubblicazione: (2025)
di: Agarwal, Amit, et al.
Pubblicazione: (2025)
Math Natural Language Inference: this should be easy!
di: de Paiva, Valeria, et al.
Pubblicazione: (2025)
di: de Paiva, Valeria, et al.
Pubblicazione: (2025)
The Superalignment of Superhuman Intelligence with Large Language Models
di: Huang, Minlie, et al.
Pubblicazione: (2024)
di: Huang, Minlie, et al.
Pubblicazione: (2024)
A Survey on Natural Language Counterfactual Generation
di: Wang, Yongjie, et al.
Pubblicazione: (2024)
di: Wang, Yongjie, et al.
Pubblicazione: (2024)
D-SMART: Enhancing LLM Dialogue Consistency via Dynamic Structured Memory And Reasoning Tree
di: Lei, Xiang, et al.
Pubblicazione: (2025)
di: Lei, Xiang, et al.
Pubblicazione: (2025)
An Unforgeable Publicly Verifiable Watermark for Large Language Models
di: Liu, Aiwei, et al.
Pubblicazione: (2023)
di: Liu, Aiwei, et al.
Pubblicazione: (2023)
Exploring State Tracking Capabilities of Large Language Models
di: Rezaee, Kiamehr, et al.
Pubblicazione: (2025)
di: Rezaee, Kiamehr, et al.
Pubblicazione: (2025)
A Survey of Text Watermarking in the Era of Large Language Models
di: Liu, Aiwei, et al.
Pubblicazione: (2023)
di: Liu, Aiwei, et al.
Pubblicazione: (2023)
Distilling Large Language Models for Efficient Clinical Information Extraction
di: Vedula, Karthik S., et al.
Pubblicazione: (2024)
di: Vedula, Karthik S., et al.
Pubblicazione: (2024)
Adaptive Steering and Remasking for Safe Generation in Diffusion Language Models
di: Lee, Yejin, et al.
Pubblicazione: (2026)
di: Lee, Yejin, et al.
Pubblicazione: (2026)
Towards Effective and Efficient Continual Pre-training of Large Language Models
di: Chen, Jie, et al.
Pubblicazione: (2024)
di: Chen, Jie, et al.
Pubblicazione: (2024)
Accurate Retraining-free Pruning for Pretrained Encoder-based Language Models
di: Park, Seungcheol, et al.
Pubblicazione: (2023)
di: Park, Seungcheol, et al.
Pubblicazione: (2023)
Unifying Uniform and Binary-coding Quantization for Accurate Compression of Large Language Models
di: Park, Seungcheol, et al.
Pubblicazione: (2025)
di: Park, Seungcheol, et al.
Pubblicazione: (2025)
Accurate Sublayer Pruning for Large Language Models by Exploiting Latency and Tunability Information
di: Park, Seungcheol, et al.
Pubblicazione: (2025)
di: Park, Seungcheol, et al.
Pubblicazione: (2025)
Setting Standards in Turkish NLP: TR-MMLU for Large Language Model Evaluation
di: Bayram, M. Ali, et al.
Pubblicazione: (2024)
di: Bayram, M. Ali, et al.
Pubblicazione: (2024)
d-TreeRPO: Towards More Reliable Policy Optimization for Diffusion Language Models
di: Pan, Leyi, et al.
Pubblicazione: (2025)
di: Pan, Leyi, et al.
Pubblicazione: (2025)
Direct Large Language Model Alignment Through Self-Rewarding Contrastive Prompt Distillation
di: Liu, Aiwei, et al.
Pubblicazione: (2024)
di: Liu, Aiwei, et al.
Pubblicazione: (2024)
Culturally-Nuanced Story Generation for Reasoning in Low-Resource Languages: The Case of Javanese and Sundanese
di: Pranida, Salsabila Zahirah, et al.
Pubblicazione: (2025)
di: Pranida, Salsabila Zahirah, et al.
Pubblicazione: (2025)
Large Language Models(LLMs) on Tabular Data: Prediction, Generation, and Understanding -- A Survey
di: Fang, Xi, et al.
Pubblicazione: (2024)
di: Fang, Xi, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Co-NAML-LSTUR: A Combined Model with Attentive Multi-View Learning and Long- and Short-term User Representations for News Recommendation
di: Nguyen, Minh Hoang, et al.
Pubblicazione: (2025) -
From Surface to Semantics: Semantic Structure Parsing for Table-Centric Document Analysis
di: Li, Xuan, et al.
Pubblicazione: (2025) -
Multilingual Multi-Label Emotion Classification at Scale with Synthetic Data
di: Borisov, Vadim
Pubblicazione: (2026) -
Transparent but Powerful: Explainability, Accuracy, and Generalizability in ADHD Detection from Social Media Data
di: Wiechmann, D., et al.
Pubblicazione: (2024) -
LLM-supported document separation for printed reviews from zbMATH Open
di: Pluzhnikov, Ivan, et al.
Pubblicazione: (2026)