Do Transformers Understand Ancient Roman Coin Motifs Better than CNNs?
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Reid, David, Arandjelovic, Ognjen |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
A White-Box False Positive Adversarial Attack Method on Contrastive Loss Based Offline Handwritten Signature Verification Models
par: Guo, Zhongliang, et autres
Publié: (2023)
par: Guo, Zhongliang, et autres
Publié: (2023)
This Looks Better than That: Better Interpretable Models with ProtoPNeXt
par: Willard, Frank, et autres
Publié: (2024)
par: Willard, Frank, et autres
Publié: (2024)
TraNCE: Transformative Non-linear Concept Explainer for CNNs
par: Akpudo, Ugochukwu Ejike, et autres
Publié: (2025)
par: Akpudo, Ugochukwu Ejike, et autres
Publié: (2025)
Pruning By Explaining Revisited: Optimizing Attribution Methods to Prune CNNs and Transformers
par: Hatefi, Sayed Mohammad Vakilzadeh, et autres
Publié: (2024)
par: Hatefi, Sayed Mohammad Vakilzadeh, et autres
Publié: (2024)
A Gray-box Attack against Latent Diffusion Model-based Image Editing by Posterior Collapse
par: Guo, Zhongliang, et autres
Publié: (2024)
par: Guo, Zhongliang, et autres
Publié: (2024)
RNNs, CNNs and Transformers in Human Action Recognition: A Survey and a Hybrid Model
par: Alomar, Khaled, et autres
Publié: (2024)
par: Alomar, Khaled, et autres
Publié: (2024)
VORTEX: Challenging CNNs at Texture Recognition by using Vision Transformers with Orderless and Randomized Token Encodings
par: Scabini, Leonardo, et autres
Publié: (2025)
par: Scabini, Leonardo, et autres
Publié: (2025)
Efficient Hyperparameter Importance Assessment for CNNs
par: Wang, Ruinan, et autres
Publié: (2024)
par: Wang, Ruinan, et autres
Publié: (2024)
Steering the LoCoMotif: Using Domain Knowledge in Time Series Motif Discovery
par: Yurtman, Aras, et autres
Publié: (2025)
par: Yurtman, Aras, et autres
Publié: (2025)
Detecção da Psoríase Utilizando Visão Computacional: Uma Abordagem Comparativa Entre CNNs e Vision Transformers
par: Lucena, Natanael, et autres
Publié: (2025)
par: Lucena, Natanael, et autres
Publié: (2025)
CNNs Avoid Curse of Dimensionality by Learning on Patches
par: Madala, Vamshi C., et autres
Publié: (2022)
par: Madala, Vamshi C., et autres
Publié: (2022)
Explaning with trees: interpreting CNNs using hierarchies
par: Rodrigues, Caroline Mazini, et autres
Publié: (2024)
par: Rodrigues, Caroline Mazini, et autres
Publié: (2024)
From Ground to Air: Noise Robustness in Vision Transformers and CNNs for Event-Based Vehicle Classification with Potential UAV Applications
par: Almesafri, Nouf, et autres
Publié: (2025)
par: Almesafri, Nouf, et autres
Publié: (2025)
Better Understanding Differences in Attribution Methods via Systematic Evaluations
par: Rao, Sukrut, et autres
Publié: (2023)
par: Rao, Sukrut, et autres
Publié: (2023)
Explaining Model Overfitting in CNNs via GMM Clustering
par: Dou, Hui, et autres
Publié: (2024)
par: Dou, Hui, et autres
Publié: (2024)
Evaluating the Stability of Semantic Concept Representations in CNNs for Robust Explainability
par: Mikriukov, Georgii, et autres
Publié: (2023)
par: Mikriukov, Georgii, et autres
Publié: (2023)
Do Language Models Understand Time?
par: Ding, Xi, et autres
Publié: (2024)
par: Ding, Xi, et autres
Publié: (2024)
Reliable Evaluation of Attribution Maps in CNNs: A Perturbation-Based Approach
par: Nieradzik, Lars, et autres
Publié: (2024)
par: Nieradzik, Lars, et autres
Publié: (2024)
Stacked Ensemble of Fine-Tuned CNNs for Knee Osteoarthritis Severity Grading
par: Gupta, Adarsh, et autres
Publié: (2025)
par: Gupta, Adarsh, et autres
Publié: (2025)
Understanding Multi-View Transformers
par: Stary, Michal, et autres
Publié: (2025)
par: Stary, Michal, et autres
Publié: (2025)
LibraGrad: Balancing Gradient Flow for Universally Better Vision Transformer Attributions
par: Mehri, Faridoun, et autres
Publié: (2024)
par: Mehri, Faridoun, et autres
Publié: (2024)
Data or Language Supervision: What Makes CLIP Better than DINO?
par: Liu, Yiming, et autres
Publié: (2025)
par: Liu, Yiming, et autres
Publié: (2025)
ScribFormer: Transformer Makes CNN Work Better for Scribble-based Medical Image Segmentation
par: Li, Zihan, et autres
Publié: (2024)
par: Li, Zihan, et autres
Publié: (2024)
ImageNet-trained CNNs are not biased towards texture: Revisiting feature reliance through controlled suppression
par: Burgert, Tom, et autres
Publié: (2025)
par: Burgert, Tom, et autres
Publié: (2025)
Frugal Federated Learning for Violence Detection: A Comparison of LoRA-Tuned VLMs and Personalized CNNs
par: Thuau, Sébastien, et autres
Publié: (2025)
par: Thuau, Sébastien, et autres
Publié: (2025)
A Comparative Study of Custom CNNs, Pre-trained Models, and Transfer Learning Across Multiple Visual Datasets
par: Akhand, Annoor Sharara
Publié: (2026)
par: Akhand, Annoor Sharara
Publié: (2026)
ImageDDI: Image-enhanced Molecular Motif Sequence Representation for Drug-Drug Interaction Prediction
par: He, Yuqin, et autres
Publié: (2025)
par: He, Yuqin, et autres
Publié: (2025)
Do Understanding and Generation Fight? A Diagnostic Study of DPO for Unified Multimodal Models
par: Rao, Abinav, et autres
Publié: (2026)
par: Rao, Abinav, et autres
Publié: (2026)
Drawing the Line: Deep Segmentation for Extracting Art from Ancient Etruscan Mirrors
par: Sterzinger, Rafael, et autres
Publié: (2024)
par: Sterzinger, Rafael, et autres
Publié: (2024)
Federated Learning for Video Violence Detection: Complementary Roles of Lightweight CNNs and Vision-Language Models for Energy-Efficient Use
par: Thuau, Sébastien, et autres
Publié: (2025)
par: Thuau, Sébastien, et autres
Publié: (2025)
Role of Locality and Weight Sharing in Image-Based Tasks: A Sample Complexity Separation between CNNs, LCNs, and FCNs
par: Lahoti, Aakash, et autres
Publié: (2024)
par: Lahoti, Aakash, et autres
Publié: (2024)
An accuracy-aware extension to LRP-based pruning for CNNs to prevent cascading accuracy degradation in data-scarce transfer learning
par: Yasui, Daisuke, et autres
Publié: (2025)
par: Yasui, Daisuke, et autres
Publié: (2025)
Efficient CNNs via Passive Filter Pruning
par: Singh, Arshdeep, et autres
Publié: (2023)
par: Singh, Arshdeep, et autres
Publié: (2023)
Generalization of CNNs on Relational Reasoning with Bar Charts
par: Cui, Zhenxing, et autres
Publié: (2025)
par: Cui, Zhenxing, et autres
Publié: (2025)
ULTra: Unveiling Latent Token Interpretability in Transformer-Based Understanding and Segmentation
par: Hosseini, Hesam, et autres
Publié: (2024)
par: Hosseini, Hesam, et autres
Publié: (2024)
Better Safe than Sorry: Pre-training CLIP against Targeted Data Poisoning and Backdoor Attacks
par: Yang, Wenhan, et autres
Publié: (2023)
par: Yang, Wenhan, et autres
Publié: (2023)
How Do I Do That? Synthesizing 3D Hand Motion and Contacts for Everyday Interactions
par: Prakash, Aditya, et autres
Publié: (2025)
par: Prakash, Aditya, et autres
Publié: (2025)
Learning the RoPEs: Better 2D and 3D Position Encodings with STRING
par: Schenck, Connor, et autres
Publié: (2025)
par: Schenck, Connor, et autres
Publié: (2025)
PlantDiseaseNet-RT50: A Fine-tuned ResNet50 Architecture for High-Accuracy Plant Disease Detection Beyond Standard CNNs
par: Sagnika, Santwana, et autres
Publié: (2025)
par: Sagnika, Santwana, et autres
Publié: (2025)
Provably Better Explanations with Optimized Aggregation of Feature Attributions
par: Decker, Thomas, et autres
Publié: (2024)
par: Decker, Thomas, et autres
Publié: (2024)
Documents similaires
-
A White-Box False Positive Adversarial Attack Method on Contrastive Loss Based Offline Handwritten Signature Verification Models
par: Guo, Zhongliang, et autres
Publié: (2023) -
This Looks Better than That: Better Interpretable Models with ProtoPNeXt
par: Willard, Frank, et autres
Publié: (2024) -
TraNCE: Transformative Non-linear Concept Explainer for CNNs
par: Akpudo, Ugochukwu Ejike, et autres
Publié: (2025) -
Pruning By Explaining Revisited: Optimizing Attribution Methods to Prune CNNs and Transformers
par: Hatefi, Sayed Mohammad Vakilzadeh, et autres
Publié: (2024) -
A Gray-box Attack against Latent Diffusion Model-based Image Editing by Posterior Collapse
par: Guo, Zhongliang, et autres
Publié: (2024)