Bengali Document Layout Analysis -- A YOLOV8 Based Ensembling Approach
Fuente:
arXiv
Saved in:
| Main Authors: | Ahmed, Nazmus Sakib, Noor, Saad Sakib, Sikder, Ashraful Islam Shanto, Paul, Abhijit |
|---|---|
| Format: | Preprint |
| Published: |
2023
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Automatic Vehicle Detection using DETR: A Transformer-Based Approach for Navigating Treacherous Roads
by: Fahad, Istiaq Ahmed, et al.
Published: (2025)
by: Fahad, Istiaq Ahmed, et al.
Published: (2025)
Transformation of Biological Networks into Images via Semantic Cartography for Visual Interpretation and Scalable Deep Analysis
by: Mostafa, Sakib, et al.
Published: (2025)
by: Mostafa, Sakib, et al.
Published: (2025)
PlantVillageVQA: A Visual Question Answering Dataset for Benchmarking Vision-Language Models in Plant Science
by: Sakib, Syed Nazmus, et al.
Published: (2025)
by: Sakib, Syed Nazmus, et al.
Published: (2025)
PhyDrawGen: Physically Grounded Diagram Generation from Natural Language
by: Haque, Nafiul, et al.
Published: (2026)
by: Haque, Nafiul, et al.
Published: (2026)
Maritime Small Object Detection from UAVs using Deep Learning with Altitude-Aware Dynamic Tiling
by: Ahmed, Sakib, et al.
Published: (2025)
by: Ahmed, Sakib, et al.
Published: (2025)
Protecting and Preserving Protest Dynamics for Responsible Analysis
by: Archbold, Cohen, et al.
Published: (2026)
by: Archbold, Cohen, et al.
Published: (2026)
Scene Graph-Guided Generative AI Framework for Synthesizing and Evaluating Industrial Hazard Scenarios
by: Acharjee, Sanjay, et al.
Published: (2025)
by: Acharjee, Sanjay, et al.
Published: (2025)
Single-Channel Tissue Segmentation via Cross-Modal Distillation from Foundation Models
by: Mohammad, Sakib, et al.
Published: (2026)
by: Mohammad, Sakib, et al.
Published: (2026)
CSRAP: Enhanced Canvas Attention Scheduling for Real-Time Mission Critical Perception
by: Sakib, Md Iftekharul Islam, et al.
Published: (2025)
by: Sakib, Md Iftekharul Islam, et al.
Published: (2025)
Biomolecular Analysis of Soil Samples and Rock Imagery for Tracing Evidence of Life Using a Mobile Robot
by: Siddique, Shah Md Ahasan, et al.
Published: (2024)
by: Siddique, Shah Md Ahasan, et al.
Published: (2024)
Enhancement of Bengali OCR by Specialized Models and Advanced Techniques for Diverse Document Types
by: Rabby, AKM Shahariar Azad, et al.
Published: (2024)
by: Rabby, AKM Shahariar Azad, et al.
Published: (2024)
SugarcaneShuffleNet: A Very Fast, Lightweight Convolutional Neural Network for Diagnosis of 15 Sugarcane Leaf Diseases
by: Arman, Shifat E., et al.
Published: (2025)
by: Arman, Shifat E., et al.
Published: (2025)
Reliable Deep Learning for Small-Scale Classifications: Experiments on Real-World Image Datasets from Bangladesh
by: Suny, Alfe, et al.
Published: (2026)
by: Suny, Alfe, et al.
Published: (2026)
A Scoping Review of Deep Learning for Urban Visual Pollution and Proposal of a Real-Time Monitoring Framework with a Visual Pollution Index
by: Rahman, Mohammad Masudur, et al.
Published: (2026)
by: Rahman, Mohammad Masudur, et al.
Published: (2026)
A Diver Attention Estimation Framework for Effective Underwater Human-Robot Interaction
by: Enan, Sadman Sakib, et al.
Published: (2022)
by: Enan, Sadman Sakib, et al.
Published: (2022)
A Hybrid Approach for Document Layout Analysis in Document images
by: Shehzadi, Tahira, et al.
Published: (2024)
by: Shehzadi, Tahira, et al.
Published: (2024)
Can Large Language Models Challenge CNNs in Medical Image Analysis?
by: Ahmed, Shibbir, et al.
Published: (2025)
by: Ahmed, Shibbir, et al.
Published: (2025)
HAND: Hierarchical Attention Network for Multi-Scale Handwritten Document Recognition and Layout Analysis
by: Hamdan, Mohammed, et al.
Published: (2024)
by: Hamdan, Mohammed, et al.
Published: (2024)
A Real-Time DETR Approach to Bangladesh Road Object Detection for Autonomous Vehicles
by: Shahan, Irfan Nafiz, et al.
Published: (2024)
by: Shahan, Irfan Nafiz, et al.
Published: (2024)
A Modified VGG19-Based Framework for Accurate and Interpretable Real-Time Bone Fracture Detection
by: Haque, Md. Ehsanul, et al.
Published: (2025)
by: Haque, Md. Ehsanul, et al.
Published: (2025)
CloudBreaker: Breaking the Cloud Covers of Sentinel-2 Images using Multi-Stage Trained Conditional Flow Matching on Sentinel-1
by: Ahmed, Saleh Sakib, et al.
Published: (2025)
by: Ahmed, Saleh Sakib, et al.
Published: (2025)
STAR: A Foundation Model-driven Framework for Robust Task Planning and Failure Recovery in Robotic Systems
by: Sakib, Md Sadman, et al.
Published: (2025)
by: Sakib, Md Sadman, et al.
Published: (2025)
OptiGait-LGBM: An Efficient Approach of Gait-based Person Re-identification in Non-Overlapping Regions
by: Chowdhury, Md. Sakib Hassan, et al.
Published: (2025)
by: Chowdhury, Md. Sakib Hassan, et al.
Published: (2025)
Benchmarking Graph Neural Networks for Document Layout Analysis in Public Affairs
by: Lopez-Duran, Miguel, et al.
Published: (2025)
by: Lopez-Duran, Miguel, et al.
Published: (2025)
Dissecting Model Failures in Abdominal Aortic Aneurysm Segmentation through Explainability-Driven Analysis
by: Sakib, Abu Noman Md, et al.
Published: (2026)
by: Sakib, Abu Noman Md, et al.
Published: (2026)
LAPDoc: Layout-Aware Prompting for Documents
by: Lamott, Marcel, et al.
Published: (2024)
by: Lamott, Marcel, et al.
Published: (2024)
Decentralized LoRA augmented transformer with multi-scale feature learning for secured eye diagnosis
by: Borno, Md. Naimur Asif, et al.
Published: (2025)
by: Borno, Md. Naimur Asif, et al.
Published: (2025)
LED Benchmark: Diagnosing Structural Layout Errors for Document Layout Analysis
by: Heo, Inbum, et al.
Published: (2025)
by: Heo, Inbum, et al.
Published: (2025)
HAT: History-Augmented Anchor Transformer for Online Temporal Action Localization
by: Reza, Sakib, et al.
Published: (2024)
by: Reza, Sakib, et al.
Published: (2024)
From Image to Language: A Critical Analysis of Visual Question Answering (VQA) Approaches, Challenges, and Opportunities
by: Ishmam, Md Farhan, et al.
Published: (2023)
by: Ishmam, Md Farhan, et al.
Published: (2023)
EDocNet: Efficient Datasheet Layout Analysis Based on Focus and Global Knowledge Distillation
by: Chen, Hong Cai, et al.
Published: (2025)
by: Chen, Hong Cai, et al.
Published: (2025)
Explainable Multimodal Sentiment Analysis on Bengali Memes
by: Elahi, Kazi Toufique, et al.
Published: (2023)
by: Elahi, Kazi Toufique, et al.
Published: (2023)
BD Currency Detection: A CNN Based Approach with Mobile App Integration
by: Jaman, Syed Jubayer, et al.
Published: (2025)
by: Jaman, Syed Jubayer, et al.
Published: (2025)
Trustworthy Medical Imaging with Large Language Models: A Study of Hallucinations Across Modalities
by: Das, Anindya Bijoy, et al.
Published: (2025)
by: Das, Anindya Bijoy, et al.
Published: (2025)
SFDLA: Source-Free Document Layout Analysis
by: Tewes, Sebastian, et al.
Published: (2025)
by: Tewes, Sebastian, et al.
Published: (2025)
Diachronic Document Dataset for Semantic Layout Analysis
by: Clérice, Thibault, et al.
Published: (2024)
by: Clérice, Thibault, et al.
Published: (2024)
FusionEnsemble-Net: An Attention-Based Ensemble of Spatiotemporal Networks for Multimodal Sign Language Recognition
by: Islam, Md. Milon, et al.
Published: (2025)
by: Islam, Md. Milon, et al.
Published: (2025)
Cross-Domain Document Layout Analysis Using Document Style Guide
by: Wu, Xingjiao, et al.
Published: (2022)
by: Wu, Xingjiao, et al.
Published: (2022)
DLAFormer: An End-to-End Transformer For Document Layout Analysis
by: Wang, Jiawei, et al.
Published: (2024)
by: Wang, Jiawei, et al.
Published: (2024)
HybriDLA: Hybrid Generation for Document Layout Analysis
by: Chen, Yufan, et al.
Published: (2025)
by: Chen, Yufan, et al.
Published: (2025)
Similar Items
-
Automatic Vehicle Detection using DETR: A Transformer-Based Approach for Navigating Treacherous Roads
by: Fahad, Istiaq Ahmed, et al.
Published: (2025) -
Transformation of Biological Networks into Images via Semantic Cartography for Visual Interpretation and Scalable Deep Analysis
by: Mostafa, Sakib, et al.
Published: (2025) -
PlantVillageVQA: A Visual Question Answering Dataset for Benchmarking Vision-Language Models in Plant Science
by: Sakib, Syed Nazmus, et al.
Published: (2025) -
PhyDrawGen: Physically Grounded Diagram Generation from Natural Language
by: Haque, Nafiul, et al.
Published: (2026) -
Maritime Small Object Detection from UAVs using Deep Learning with Altitude-Aware Dynamic Tiling
by: Ahmed, Sakib, et al.
Published: (2025)