Towards Khmer Scene Document Layout Detection
Fuente:
arXiv
Guardado en:
| Autores principales: | Kong, Marry, Buoy, Rina, Chenda, Sovisal, Taing, Nguonly, Iwamura, Masakazu, Kise, Koichi |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Towards Universal Khmer Text Recognition
por: Kong, Marry, et al.
Publicado: (2026)
por: Kong, Marry, et al.
Publicado: (2026)
Towards Explainable Khmer Polarity Classification
por: Kong, Marry, et al.
Publicado: (2025)
por: Kong, Marry, et al.
Publicado: (2025)
Khmer Spellchecking: A Holistic Approach
por: Kong, Marry, et al.
Publicado: (2025)
por: Kong, Marry, et al.
Publicado: (2025)
CBEN -- A Multimodal Machine Learning Dataset for Cloud Robust Remote Sensing Image Understanding
por: Stricker, Marco, et al.
Publicado: (2026)
por: Stricker, Marco, et al.
Publicado: (2026)
KhmerST: A Low-Resource Khmer Scene Text Detection and Recognition Benchmark
por: Nom, Vannkinh, et al.
Publicado: (2024)
por: Nom, Vannkinh, et al.
Publicado: (2024)
Towards Non-Latin Text and Layout Personalization for Enhanced Readability
por: Buoy, Rina, et al.
Publicado: (2026)
por: Buoy, Rina, et al.
Publicado: (2026)
KH-FUNSD: A Hierarchical and Fine-Grained Layout Analysis Dataset for Low-Resource Khmer Business Document
por: Thuon, Nimol, et al.
Publicado: (2025)
por: Thuon, Nimol, et al.
Publicado: (2025)
Toward Scene Graph and Layout Guided Complex 3D Scene Generation
por: Huang, Yu-Hsiang, et al.
Publicado: (2024)
por: Huang, Yu-Hsiang, et al.
Publicado: (2024)
Evaluating the Impact of Khmer Font Types on Text Recognition
por: Nom, Vannkinh, et al.
Publicado: (2025)
por: Nom, Vannkinh, et al.
Publicado: (2025)
From Pen Strokes to Sleep States: Detecting Low-Recovery Days Using Sigma-Lognormal Handwriting Features
por: Tanaka, Chisa, et al.
Publicado: (2026)
por: Tanaka, Chisa, et al.
Publicado: (2026)
CasLayout: Cascaded 3D Layout Diffusion for Indoor Scene Synthesis with Implicit Relation Modeling
por: Wu, Yingrui, et al.
Publicado: (2026)
por: Wu, Yingrui, et al.
Publicado: (2026)
ReLayout: Towards Real-World Document Understanding via Layout-enhanced Pre-training
por: Jiang, Zhouqiang, et al.
Publicado: (2024)
por: Jiang, Zhouqiang, et al.
Publicado: (2024)
OmniDocLayout: Towards Diverse Document Layout Generation via Coarse-to-Fine LLM Learning
por: Kang, Hengrui, et al.
Publicado: (2025)
por: Kang, Hengrui, et al.
Publicado: (2025)
SceneCraft: Layout-Guided 3D Scene Generation
por: Yang, Xiuyu, et al.
Publicado: (2024)
por: Yang, Xiuyu, et al.
Publicado: (2024)
UnSupDLA: Towards Unsupervised Document Layout Analysis
por: Sheikh, Talha Uddin, et al.
Publicado: (2024)
por: Sheikh, Talha Uddin, et al.
Publicado: (2024)
Perceive-then-Plan: Layout-as-Policy for Monocular 3D Scene Layout Estimation
por: Zhou, Junwei, et al.
Publicado: (2026)
por: Zhou, Junwei, et al.
Publicado: (2026)
Layout2Scene: 3D Semantic Layout Guided Scene Generation via Geometry and Appearance Diffusion Priors
por: Chen, Minglin, et al.
Publicado: (2025)
por: Chen, Minglin, et al.
Publicado: (2025)
Word-level Sign Language Recognition with Multi-stream Neural Networks Focusing on Local Regions and Skeletal Information
por: Maruyama, Mizuki, et al.
Publicado: (2021)
por: Maruyama, Mizuki, et al.
Publicado: (2021)
Embodied Scene Understanding for Vision Language Models via MetaVQA
por: Wang, Weizhen, et al.
Publicado: (2025)
por: Wang, Weizhen, et al.
Publicado: (2025)
SLayR: Scene Layout Generation with Rectified Flow
por: Braunstein, Cameron, et al.
Publicado: (2024)
por: Braunstein, Cameron, et al.
Publicado: (2024)
LED Benchmark: Diagnosing Structural Layout Errors for Document Layout Analysis
por: Heo, Inbum, et al.
Publicado: (2025)
por: Heo, Inbum, et al.
Publicado: (2025)
Function2Scene: 3D Indoor Scene Layout from Functional Specifications
por: Wang, Ruiqi, et al.
Publicado: (2026)
por: Wang, Ruiqi, et al.
Publicado: (2026)
SemLayoutDiff: Semantic Layout Generation with Diffusion Model for Indoor Scene Synthesis
por: Sun, Xiaohao, et al.
Publicado: (2025)
por: Sun, Xiaohao, et al.
Publicado: (2025)
ET-SAM: Efficient Point Prompt Prediction in SAM for Unified Scene Text Detection and Layout Analysis
por: Zhang, Xike, et al.
Publicado: (2026)
por: Zhang, Xike, et al.
Publicado: (2026)
Layout Agnostic Scene Text Image Synthesis with Diffusion Models
por: Zhangli, Qilong, et al.
Publicado: (2024)
por: Zhangli, Qilong, et al.
Publicado: (2024)
SPATIALGEN: Layout-guided 3D Indoor Scene Generation
por: Fang, Chuan, et al.
Publicado: (2025)
por: Fang, Chuan, et al.
Publicado: (2025)
SDesc3D: Towards Layout-Aware 3D Indoor Scene Generation from Short Descriptions
por: Feng, Jie, et al.
Publicado: (2026)
por: Feng, Jie, et al.
Publicado: (2026)
LED: A Benchmark for Evaluating Layout Error Detection in Document Analysis
por: Heo, Inbum, et al.
Publicado: (2026)
por: Heo, Inbum, et al.
Publicado: (2026)
LayoutDETR: Detection Transformer Is a Good Multimodal Layout Designer
por: Yu, Ning, et al.
Publicado: (2022)
por: Yu, Ning, et al.
Publicado: (2022)
A Hybrid Approach for Document Layout Analysis in Document images
por: Shehzadi, Tahira, et al.
Publicado: (2024)
por: Shehzadi, Tahira, et al.
Publicado: (2024)
SceneLCM: End-to-End Layout-Guided Interactive Indoor Scene Generation with Latent Consistency Model
por: Lin, Yangkai, et al.
Publicado: (2025)
por: Lin, Yangkai, et al.
Publicado: (2025)
SFDLA: Source-Free Document Layout Analysis
por: Tewes, Sebastian, et al.
Publicado: (2025)
por: Tewes, Sebastian, et al.
Publicado: (2025)
Diachronic Document Dataset for Semantic Layout Analysis
por: Clérice, Thibault, et al.
Publicado: (2024)
por: Clérice, Thibault, et al.
Publicado: (2024)
LayoutLLM: Layout Instruction Tuning with Large Language Models for Document Understanding
por: Luo, Chuwei, et al.
Publicado: (2024)
por: Luo, Chuwei, et al.
Publicado: (2024)
InternScenes: A Large-scale Simulatable Indoor Scene Dataset with Realistic Layouts
por: Zhong, Weipeng, et al.
Publicado: (2025)
por: Zhong, Weipeng, et al.
Publicado: (2025)
Lay-Your-Scene: Natural Scene Layout Generation with Diffusion Transformers
por: Srivastava, Divyansh, et al.
Publicado: (2025)
por: Srivastava, Divyansh, et al.
Publicado: (2025)
GALA3D: Towards Text-to-3D Complex Scene Generation via Layout-guided Generative Gaussian Splatting
por: Zhou, Xiaoyu, et al.
Publicado: (2024)
por: Zhou, Xiaoyu, et al.
Publicado: (2024)
Cross-Domain Document Layout Analysis Using Document Style Guide
por: Wu, Xingjiao, et al.
Publicado: (2022)
por: Wu, Xingjiao, et al.
Publicado: (2022)
Imaginarium: Vision-guided High-Quality 3D Scene Layout Generation
por: Zhu, Xiaoming, et al.
Publicado: (2025)
por: Zhu, Xiaoming, et al.
Publicado: (2025)
Human-in-the-Loop Local Corrections of 3D Scene Layouts via Infilling
por: Xie, Christopher, et al.
Publicado: (2025)
por: Xie, Christopher, et al.
Publicado: (2025)
Ejemplares similares
-
Towards Universal Khmer Text Recognition
por: Kong, Marry, et al.
Publicado: (2026) -
Towards Explainable Khmer Polarity Classification
por: Kong, Marry, et al.
Publicado: (2025) -
Khmer Spellchecking: A Holistic Approach
por: Kong, Marry, et al.
Publicado: (2025) -
CBEN -- A Multimodal Machine Learning Dataset for Cloud Robust Remote Sensing Image Understanding
por: Stricker, Marco, et al.
Publicado: (2026) -
KhmerST: A Low-Resource Khmer Scene Text Detection and Recognition Benchmark
por: Nom, Vannkinh, et al.
Publicado: (2024)