Maximizing Generalization: The Effect of Different Augmentation Techniques on Lightweight Vision Transformer for Bengali Character Classification
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Chowdhury, Rafi Hassan, Haque, Naimul, Fatiha, Kaniz |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
BornoViT: A Novel Efficient Vision Transformer for Bengali Handwritten Basic Characters Classification
par: Chowdhury, Rafi Hassan, et autres
Publié: (2026)
par: Chowdhury, Rafi Hassan, et autres
Publié: (2026)
MangoLeafViT: Leveraging Lightweight Vision Transformer with Runtime Augmentation for Efficient Mango Leaf Disease Classification
par: Chowdhury, Rafi Hassan, et autres
Publié: (2025)
par: Chowdhury, Rafi Hassan, et autres
Publié: (2025)
Stress Classification from ECG Signals Using Vision Transformer
par: Ahmad, Zeeshan, et autres
Publié: (2026)
par: Ahmad, Zeeshan, et autres
Publié: (2026)
FaceGemma: Enhancing Image Captioning with Facial Attributes for Portrait Images
par: Haque, Naimul, et autres
Publié: (2023)
par: Haque, Naimul, et autres
Publié: (2023)
Vision Transformer for Classification of Breast Ultrasound Images
par: Gheflati, Behnaz, et autres
Publié: (2021)
par: Gheflati, Behnaz, et autres
Publié: (2021)
Taylor-Series Expanded Kolmogorov-Arnold Network for Medical Imaging Classification
par: Fatema, Kaniz, et autres
Publié: (2025)
par: Fatema, Kaniz, et autres
Publié: (2025)
Lightweight Vision Transformer with Window and Spatial Attention for Food Image Classification
par: Gao, Xinle, et autres
Publié: (2025)
par: Gao, Xinle, et autres
Publié: (2025)
Bangla-Bayanno: A 52K-Pair Bengali Visual Question Answering Dataset with LLM-Assisted Translation Refinement
par: Hasan, Mohammed Rakibul, et autres
Publié: (2025)
par: Hasan, Mohammed Rakibul, et autres
Publié: (2025)
Temporal Feature Weaving for Neonatal Echocardiographic Viewpoint Video Classification
par: French, Satchel, et autres
Publié: (2025)
par: French, Satchel, et autres
Publié: (2025)
Classification of Non-native Handwritten Characters Using Convolutional Neural Network
par: Mamun, F. A., et autres
Publié: (2024)
par: Mamun, F. A., et autres
Publié: (2024)
Masked Generative Story Transformer with Character Guidance and Caption Augmentation
par: Papadimitriou, Christos, et autres
Publié: (2024)
par: Papadimitriou, Christos, et autres
Publié: (2024)
Lightweight Vision Transformer with Bidirectional Interaction
par: Fan, Qihang, et autres
Publié: (2023)
par: Fan, Qihang, et autres
Publié: (2023)
Enhancing Image Classification with Augmentation: Data Augmentation Techniques for Improved Image Classification
par: Kumar, Saorj, et autres
Publié: (2025)
par: Kumar, Saorj, et autres
Publié: (2025)
DynaSeg: A Deep Dynamic Fusion Method for Unsupervised Image Segmentation Incorporating Feature Similarity and Spatial Continuity
par: Guermazi, Boujemaa, et autres
Publié: (2024)
par: Guermazi, Boujemaa, et autres
Publié: (2024)
SSFT: A Lightweight Spectral-Spatial Fusion Transformer for Generic Hyperspectral Classification
par: Musiat, Alexander, et autres
Publié: (2026)
par: Musiat, Alexander, et autres
Publié: (2026)
Lightweight RGB-T Tracking with Mobile Vision Transformers
par: Falaki, Mahdi, et autres
Publié: (2025)
par: Falaki, Mahdi, et autres
Publié: (2025)
FantasyPortrait: Enhancing Multi-Character Portrait Animation with Expression-Augmented Diffusion Transformers
par: Wang, Qiang, et autres
Publié: (2025)
par: Wang, Qiang, et autres
Publié: (2025)
Image Recognition with Online Lightweight Vision Transformer: A Survey
par: Zhang, Zherui, et autres
Publié: (2025)
par: Zhang, Zherui, et autres
Publié: (2025)
Evaluating Data Augmentation Techniques for Coffee Leaf Disease Classification
par: Gheorghiu, Adrian, et autres
Publié: (2024)
par: Gheorghiu, Adrian, et autres
Publié: (2024)
AdaptoVision: A Multi-Resolution Image Recognition Model for Robust and Scalable Classification
par: Sabrin, Md. Sanaullah Chowdhury Lameya
Publié: (2025)
par: Sabrin, Md. Sanaullah Chowdhury Lameya
Publié: (2025)
VLDrive: Vision-Augmented Lightweight MLLMs for Efficient Language-grounded Autonomous Driving
par: Zhang, Ruifei, et autres
Publié: (2025)
par: Zhang, Ruifei, et autres
Publié: (2025)
DynaGuide: A Generalizable Dynamic Guidance Framework for Unsupervised Semantic Segmentation
par: Guermazi, Boujemaa, et autres
Publié: (2026)
par: Guermazi, Boujemaa, et autres
Publié: (2026)
Vision Mamba for Classification of Breast Ultrasound Images
par: Nasiri-Sarvi, Ali, et autres
Publié: (2024)
par: Nasiri-Sarvi, Ali, et autres
Publié: (2024)
IoT Botnet Detection: Application of Vision Transformer to Classification of Network Flow Traffic
par: Wasswa, Hassan, et autres
Publié: (2025)
par: Wasswa, Hassan, et autres
Publié: (2025)
LMFLOSS: A Hybrid Loss For Imbalanced Medical Image Classification
par: Sadi, Abu Adnan, et autres
Publié: (2022)
par: Sadi, Abu Adnan, et autres
Publié: (2022)
How Lightweight Can A Vision Transformer Be
par: Tan, Jen Hong
Publié: (2024)
par: Tan, Jen Hong
Publié: (2024)
InstantCharacter: Personalize Any Characters with a Scalable Diffusion Transformer Framework
par: Tao, Jiale, et autres
Publié: (2025)
par: Tao, Jiale, et autres
Publié: (2025)
EffLoc: Lightweight Vision Transformer for Efficient 6-DOF Camera Relocalization
par: Xiao, Zhendong, et autres
Publié: (2024)
par: Xiao, Zhendong, et autres
Publié: (2024)
Shuffle Vision Transformer: Lightweight, Fast and Efficient Recognition of Driver Facial Expression
par: Saadi, Ibtissam, et autres
Publié: (2024)
par: Saadi, Ibtissam, et autres
Publié: (2024)
Image Clustering using an Augmented Generative Adversarial Network and Information Maximization
par: Ntelemis, Foivos, et autres
Publié: (2020)
par: Ntelemis, Foivos, et autres
Publié: (2020)
Hierarchical Re-Classification: Combining Animal Classification Models with Vision Transformers
par: Markoff, Hugo, et autres
Publié: (2025)
par: Markoff, Hugo, et autres
Publié: (2025)
BdSL-SPOTER: A Transformer-Based Framework for Bengali Sign Language Recognition with Cultural Adaptation
par: Azad, Sayad Ibna, et autres
Publié: (2025)
par: Azad, Sayad Ibna, et autres
Publié: (2025)
Static and Dynamic Synthesis of Bengali and Devanagari Signatures
par: Ferrer, Miguel A., et autres
Publié: (2024)
par: Ferrer, Miguel A., et autres
Publié: (2024)
Embedded ConvNet Ensembles: A Lightweight Approach to Recognize Arabic Handwritten Characters
par: Khayati, Mohsine El, et autres
Publié: (2026)
par: Khayati, Mohsine El, et autres
Publié: (2026)
Interpretable Vision Transformers in Image Classification via SVDA
par: Arampatzakis, Vasileios, et autres
Publié: (2026)
par: Arampatzakis, Vasileios, et autres
Publié: (2026)
CNNs, Transformers, Hybrid, and Vision Language Models for Skin Cancer Detection
par: Dey, Durjoy, et autres
Publié: (2026)
par: Dey, Durjoy, et autres
Publié: (2026)
GRIHA: Synthesizing 2-Dimensional Building Layouts from Images Captured using a Smart Phone
par: Goyal, Shreya, et autres
Publié: (2021)
par: Goyal, Shreya, et autres
Publié: (2021)
ViTALS: Vision Transformer for Action Localization in Surgical Nephrectomy
par: Chandra, Soumyadeep, et autres
Publié: (2024)
par: Chandra, Soumyadeep, et autres
Publié: (2024)
GNN-ViTCap: GNN-Enhanced Multiple Instance Learning with Vision Transformers for Whole Slide Image Classification and Captioning
par: Raju, S M Taslim Uddin, et autres
Publié: (2025)
par: Raju, S M Taslim Uddin, et autres
Publié: (2025)
SKDU at De-Factify 4.0: Vision Transformer with Data Augmentation for AI-Generated Image Detection
par: Malviya, Shrikant, et autres
Publié: (2025)
par: Malviya, Shrikant, et autres
Publié: (2025)
Documents similaires
-
BornoViT: A Novel Efficient Vision Transformer for Bengali Handwritten Basic Characters Classification
par: Chowdhury, Rafi Hassan, et autres
Publié: (2026) -
MangoLeafViT: Leveraging Lightweight Vision Transformer with Runtime Augmentation for Efficient Mango Leaf Disease Classification
par: Chowdhury, Rafi Hassan, et autres
Publié: (2025) -
Stress Classification from ECG Signals Using Vision Transformer
par: Ahmad, Zeeshan, et autres
Publié: (2026) -
FaceGemma: Enhancing Image Captioning with Facial Attributes for Portrait Images
par: Haque, Naimul, et autres
Publié: (2023) -
Vision Transformer for Classification of Breast Ultrasound Images
par: Gheflati, Behnaz, et autres
Publié: (2021)