A Saccade-inspired Approach to Image Classification using Vision Transformer Attention Maps
Fuente:
arXiv
Salvato in:
| Autori principali: | Dallain, Matthis, Rodriguez, Laurent, Perrinet, Laurent Udo, Miramond, Benoît |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Spiking Vision Transformer with Saccadic Attention
di: Wang, Shuai, et al.
Pubblicazione: (2025)
di: Wang, Shuai, et al.
Pubblicazione: (2025)
Foveated Retinotopy Improves Classification and Localization in Convolutional Neural Networks
di: Jérémie, Jean-Nicolas, et al.
Pubblicazione: (2024)
di: Jérémie, Jean-Nicolas, et al.
Pubblicazione: (2024)
Saccadic Vision for Fine-Grained Visual Classification
di: Schmidt, Johann, et al.
Pubblicazione: (2025)
di: Schmidt, Johann, et al.
Pubblicazione: (2025)
Spiking monocular event based 6D pose estimation for space application
di: Courtois, Jonathan, et al.
Pubblicazione: (2025)
di: Courtois, Jonathan, et al.
Pubblicazione: (2025)
Emergence of Fixational and Saccadic Movements in a Multi-Level Recurrent Attention Model for Vision
di: Pan, Pengcheng, et al.
Pubblicazione: (2025)
di: Pan, Pengcheng, et al.
Pubblicazione: (2025)
Lightweight Vision Transformer with Window and Spatial Attention for Food Image Classification
di: Gao, Xinle, et al.
Pubblicazione: (2025)
di: Gao, Xinle, et al.
Pubblicazione: (2025)
On Reducing Activity with Distillation and Regularization for Energy Efficient Spiking Neural Networks
di: Louis, Thomas, et al.
Pubblicazione: (2024)
di: Louis, Thomas, et al.
Pubblicazione: (2024)
Enhanced Neuromorphic Semantic Segmentation Latency through Stream Event
di: Hareb, D., et al.
Pubblicazione: (2025)
di: Hareb, D., et al.
Pubblicazione: (2025)
Reading Is Believing: Revisiting Language Bottleneck Models for Image Classification
di: Udo, Honori, et al.
Pubblicazione: (2024)
di: Udo, Honori, et al.
Pubblicazione: (2024)
SaccadeDet: A Novel Dual-Stage Architecture for Rapid and Accurate Detection in Gigapixel Images
di: Li, Wenxi, et al.
Pubblicazione: (2024)
di: Li, Wenxi, et al.
Pubblicazione: (2024)
Vision Transformer for Classification of Breast Ultrasound Images
di: Gheflati, Behnaz, et al.
Pubblicazione: (2021)
di: Gheflati, Behnaz, et al.
Pubblicazione: (2021)
IRIS: Intent Resolution via Inference-time Saccades for Open-Ended VQA in Large Vision-Language Models
di: Madinei, Parsa, et al.
Pubblicazione: (2026)
di: Madinei, Parsa, et al.
Pubblicazione: (2026)
Triplet-Watershed for Hyperspectral Image Classification
di: Challa, Aditya, et al.
Pubblicazione: (2021)
di: Challa, Aditya, et al.
Pubblicazione: (2021)
Improved EATFormer: A Vision Transformer for Medical Image Classification
di: Shisu, Yulong, et al.
Pubblicazione: (2024)
di: Shisu, Yulong, et al.
Pubblicazione: (2024)
Interpretable Vision Transformers in Image Classification via SVDA
di: Arampatzakis, Vasileios, et al.
Pubblicazione: (2026)
di: Arampatzakis, Vasileios, et al.
Pubblicazione: (2026)
Graph Attention Transformer Network for Multi-Label Image Classification
di: Yuan, Jin, et al.
Pubblicazione: (2022)
di: Yuan, Jin, et al.
Pubblicazione: (2022)
SaFiRe: Saccade-Fixation Reiteration with Mamba for Referring Image Segmentation
di: Mao, Zhenjie, et al.
Pubblicazione: (2025)
di: Mao, Zhenjie, et al.
Pubblicazione: (2025)
Embedded event based object detection with spiking neural network
di: Courtois, Jonathan, et al.
Pubblicazione: (2024)
di: Courtois, Jonathan, et al.
Pubblicazione: (2024)
Medical Image Classification with KAN-Integrated Transformers and Dilated Neighborhood Attention
di: Manzari, Omid Nejati, et al.
Pubblicazione: (2025)
di: Manzari, Omid Nejati, et al.
Pubblicazione: (2025)
Interpretable Image Classification with Adaptive Prototype-based Vision Transformers
di: Ma, Chiyu, et al.
Pubblicazione: (2024)
di: Ma, Chiyu, et al.
Pubblicazione: (2024)
Hierarchical Vision Transformer with Prototypes for Interpretable Medical Image Classification
di: Gallée, Luisa, et al.
Pubblicazione: (2025)
di: Gallée, Luisa, et al.
Pubblicazione: (2025)
Sensitive Image Classification by Vision Transformers
di: He, Hanxian, et al.
Pubblicazione: (2024)
di: He, Hanxian, et al.
Pubblicazione: (2024)
Representative Attention For Vision Transformers
di: Li, Yuntong, et al.
Pubblicazione: (2026)
di: Li, Yuntong, et al.
Pubblicazione: (2026)
Vision Transformers with Hierarchical Attention
di: Liu, Yun, et al.
Pubblicazione: (2021)
di: Liu, Yun, et al.
Pubblicazione: (2021)
A Synergistic CNN-Transformer Network with Pooling Attention Fusion for Hyperspectral Image Classification
di: Chen, Peng, et al.
Pubblicazione: (2026)
di: Chen, Peng, et al.
Pubblicazione: (2026)
A Novel Vision Transformer with Residual in Self-attention for Biomedical Image Classification
di: Sharma, Arun K., et al.
Pubblicazione: (2023)
di: Sharma, Arun K., et al.
Pubblicazione: (2023)
Federated Vision Transformer with Adaptive Focal Loss for Medical Image Classification
di: Zhao, Xinyuan, et al.
Pubblicazione: (2026)
di: Zhao, Xinyuan, et al.
Pubblicazione: (2026)
Fusion of Foundation and Vision Transformer Model Features for Dermatoscopic Image Classification
di: Mahbod, Amirreza, et al.
Pubblicazione: (2025)
di: Mahbod, Amirreza, et al.
Pubblicazione: (2025)
Class-Discriminative Attention Maps for Vision Transformers
di: Brocki, Lennart, et al.
Pubblicazione: (2023)
di: Brocki, Lennart, et al.
Pubblicazione: (2023)
ROI-Aware Multiscale Cross-Attention Vision Transformer for Pest Image Identification
di: Kim, Ga-Eun, et al.
Pubblicazione: (2023)
di: Kim, Ga-Eun, et al.
Pubblicazione: (2023)
EVA: Bridging Performance and Human Alignment in Hard-Attention Vision Models for Image Classification
di: Pan, Pengcheng, et al.
Pubblicazione: (2026)
di: Pan, Pengcheng, et al.
Pubblicazione: (2026)
HAViT: Historical Attention Vision Transformer
di: Banik, Swarnendu, et al.
Pubblicazione: (2026)
di: Banik, Swarnendu, et al.
Pubblicazione: (2026)
Structured Initialization for Attention in Vision Transformers
di: Zheng, Jianqiao, et al.
Pubblicazione: (2024)
di: Zheng, Jianqiao, et al.
Pubblicazione: (2024)
Vision Transformers are Circulant Attention Learners
di: Han, Dongchen, et al.
Pubblicazione: (2025)
di: Han, Dongchen, et al.
Pubblicazione: (2025)
Multi-manifold Attention for Vision Transformers
di: Konstantinidis, Dimitrios, et al.
Pubblicazione: (2022)
di: Konstantinidis, Dimitrios, et al.
Pubblicazione: (2022)
Skin Cancer Detection utilizing Deep Learning: Classification of Skin Lesion Images using a Vision Transformer
di: Flosdorf, Carolin, et al.
Pubblicazione: (2024)
di: Flosdorf, Carolin, et al.
Pubblicazione: (2024)
Segmentation-guided Attention for Visual Question Answering from Remote Sensing Images
di: Tosato, Lucrezia, et al.
Pubblicazione: (2024)
di: Tosato, Lucrezia, et al.
Pubblicazione: (2024)
TCSAFormer: Efficient Vision Transformer with Token Compression and Sparse Attention for Medical Image Segmentation
di: Xia, Zunhui, et al.
Pubblicazione: (2025)
di: Xia, Zunhui, et al.
Pubblicazione: (2025)
Multi-Modal Vision Transformers for Crop Mapping from Satellite Image Time Series
di: Follath, Theresa, et al.
Pubblicazione: (2024)
di: Follath, Theresa, et al.
Pubblicazione: (2024)
Polyline Path Masked Attention for Vision Transformer
di: Zhao, Zhongchen, et al.
Pubblicazione: (2025)
di: Zhao, Zhongchen, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Spiking Vision Transformer with Saccadic Attention
di: Wang, Shuai, et al.
Pubblicazione: (2025) -
Foveated Retinotopy Improves Classification and Localization in Convolutional Neural Networks
di: Jérémie, Jean-Nicolas, et al.
Pubblicazione: (2024) -
Saccadic Vision for Fine-Grained Visual Classification
di: Schmidt, Johann, et al.
Pubblicazione: (2025) -
Spiking monocular event based 6D pose estimation for space application
di: Courtois, Jonathan, et al.
Pubblicazione: (2025) -
Emergence of Fixational and Saccadic Movements in a Multi-Level Recurrent Attention Model for Vision
di: Pan, Pengcheng, et al.
Pubblicazione: (2025)