A Comparative Study of Vision Transformers and CNNs for Few-Shot Rigid Transformation and Fundamental Matrix Estimation
Fuente:
arXiv
Guardado en:
| Autores principales: | Kaya, Alon, Bilik, Igal, Stainvas, Inna |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
RGBX-DiffusionDet: A Framework for Multi-Modal RGB-X Object Detection Using DiffusionDet
por: Orfaig, Eliraz, et al.
Publicado: (2025)
por: Orfaig, Eliraz, et al.
Publicado: (2025)
Enhanced Automotive Object Detection via RGB-D Fusion in a DiffusionDet Framework
por: Orfaig, Eliraz, et al.
Publicado: (2024)
por: Orfaig, Eliraz, et al.
Publicado: (2024)
Vision Transformers for Kidney Stone Image Classification: A Comparative Study with CNNs
por: Reyes-Amezcua, Ivan, et al.
Publicado: (2025)
por: Reyes-Amezcua, Ivan, et al.
Publicado: (2025)
SuperResolution Radar Gesture Recognitio
por: Blumenfeld, Netanel, et al.
Publicado: (2024)
por: Blumenfeld, Netanel, et al.
Publicado: (2024)
Pre-trained Vision and Language Transformers Are Few-Shot Incremental Learners
por: Park, Keon-Hee, et al.
Publicado: (2024)
por: Park, Keon-Hee, et al.
Publicado: (2024)
B-cos Alignment for Inherently Interpretable CNNs and Vision Transformers
por: Böhle, Moritz, et al.
Publicado: (2023)
por: Böhle, Moritz, et al.
Publicado: (2023)
Adaptive Additive Parameter Updates of Vision Transformers for Few-Shot Continual Learning
por: Stein, Kyle, et al.
Publicado: (2025)
por: Stein, Kyle, et al.
Publicado: (2025)
Intra-task Mutual Attention based Vision Transformer for Few-Shot Learning
por: Jiang, Weihao, et al.
Publicado: (2024)
por: Jiang, Weihao, et al.
Publicado: (2024)
Comparing the Decision-Making Mechanisms by Transformers and CNNs via Explanation Methods
por: Jiang, Mingqi, et al.
Publicado: (2022)
por: Jiang, Mingqi, et al.
Publicado: (2022)
CNNs, Transformers, Hybrid, and Vision Language Models for Skin Cancer Detection
por: Dey, Durjoy, et al.
Publicado: (2026)
por: Dey, Durjoy, et al.
Publicado: (2026)
Color as the Impetus: Transforming Few-Shot Learner
por: Qi, Chaofei, et al.
Publicado: (2025)
por: Qi, Chaofei, et al.
Publicado: (2025)
Vision Transformer Off-the-Shelf: A Surprising Baseline for Few-Shot Class-Agnostic Counting
por: Wang, Zhicheng, et al.
Publicado: (2023)
por: Wang, Zhicheng, et al.
Publicado: (2023)
Few-Shot Object Detection with Sparse Context Transformers
por: Mei, Jie, et al.
Publicado: (2024)
por: Mei, Jie, et al.
Publicado: (2024)
Vision Transformers for Zero-Shot Clustering of Animal Images: A Comparative Benchmarking Study
por: Markoff, Hugo, et al.
Publicado: (2026)
por: Markoff, Hugo, et al.
Publicado: (2026)
Dense Vision Transformer Compression with Few Samples
por: Zhang, Hanxiao, et al.
Publicado: (2024)
por: Zhang, Hanxiao, et al.
Publicado: (2024)
Temporal Object-Aware Vision Transformer for Few-Shot Video Object Detection
por: Kumar, Yogesh, et al.
Publicado: (2025)
por: Kumar, Yogesh, et al.
Publicado: (2025)
Calibrating Higher-Order Statistics for Few-Shot Class-Incremental Learning with Pre-trained Vision Transformers
por: Goswami, Dipam, et al.
Publicado: (2024)
por: Goswami, Dipam, et al.
Publicado: (2024)
Transforming Precision: A Comparative Analysis of Vision Transformers, CNNs, and Traditional ML for Knee Osteoarthritis Severity Diagnosis
por: Apon, Tasnim Sakib, et al.
Publicado: (2024)
por: Apon, Tasnim Sakib, et al.
Publicado: (2024)
tSF: Transformer-based Semantic Filter for Few-Shot Learning
por: Lai, Jinxiang, et al.
Publicado: (2022)
por: Lai, Jinxiang, et al.
Publicado: (2022)
Exploring Synergistic Ensemble Learning: Uniting CNNs, MLP-Mixers, and Vision Transformers to Enhance Image Classification
por: Bashar, Mk, et al.
Publicado: (2025)
por: Bashar, Mk, et al.
Publicado: (2025)
Automated Image Captioning with CNNs and Transformers
por: Cahyono, Joshua Adrian, et al.
Publicado: (2024)
por: Cahyono, Joshua Adrian, et al.
Publicado: (2024)
Towards Optimal Trade-offs in Knowledge Distillation for CNNs and Vision Transformers at the Edge
por: Violos, John, et al.
Publicado: (2024)
por: Violos, John, et al.
Publicado: (2024)
UniRiT: Towards Few-Shot Non-Rigid Point Cloud Registration
por: Li, Geng, et al.
Publicado: (2024)
por: Li, Geng, et al.
Publicado: (2024)
EfficientFSL: Enhancing Few-Shot Classification via Query-Only Tuning in Vision Transformers
por: Liao, Wenwen, et al.
Publicado: (2026)
por: Liao, Wenwen, et al.
Publicado: (2026)
Cross-Domain Few-Shot Semantic Segmentation via Doubly Matching Transformation
por: Chen, Jiayi, et al.
Publicado: (2024)
por: Chen, Jiayi, et al.
Publicado: (2024)
Few-Shot Personalized Age Estimation
por: Paplhám, Jakub, et al.
Publicado: (2026)
por: Paplhám, Jakub, et al.
Publicado: (2026)
Weight Copy and Low-Rank Adaptation for Few-Shot Distillation of Vision Transformers
por: Grigore, Diana-Nicoleta, et al.
Publicado: (2024)
por: Grigore, Diana-Nicoleta, et al.
Publicado: (2024)
Benchmarking Vision Transformers and CNNs for Thermal Photovoltaic Fault Detection with Explainable AI Validation
por: Aksoy, Serra
Publicado: (2025)
por: Aksoy, Serra
Publicado: (2025)
Deep Network Pruning: A Comparative Study on CNNs in Face Recognition
por: Alonso-Fernandez, Fernando, et al.
Publicado: (2024)
por: Alonso-Fernandez, Fernando, et al.
Publicado: (2024)
Transformer Based Self-Context Aware Prediction for Few-Shot Anomaly Detection in Videos
por: Pillai, Gargi V., et al.
Publicado: (2025)
por: Pillai, Gargi V., et al.
Publicado: (2025)
Efficient Masked Attention Transformer for Few-Shot Classification and Segmentation
por: Carrión-Ojeda, Dustin, et al.
Publicado: (2025)
por: Carrión-Ojeda, Dustin, et al.
Publicado: (2025)
KNN Transformer with Pyramid Prompts for Few-Shot Learning
por: Li, Wenhao, et al.
Publicado: (2024)
por: Li, Wenhao, et al.
Publicado: (2024)
UIFormer: A Unified Transformer-based Framework for Incremental Few-Shot Object Detection and Instance Segmentation
por: Zhang, Chengyuan, et al.
Publicado: (2024)
por: Zhang, Chengyuan, et al.
Publicado: (2024)
Bridging the Gap: Fusing CNNs and Transformers to Decode the Elegance of Handwritten Arabic Script
por: Boufenar, Chaouki, et al.
Publicado: (2025)
por: Boufenar, Chaouki, et al.
Publicado: (2025)
Combining Transformers and CNNs for Efficient Object Detection in High-Resolution Satellite Imagery
por: Drapier, Nicolas, et al.
Publicado: (2025)
por: Drapier, Nicolas, et al.
Publicado: (2025)
Where to Bind Matters: Hebbian Fast Weights in Vision Transformers for Few-Shot Character Recognition
por: Money, Gavin, et al.
Publicado: (2026)
por: Money, Gavin, et al.
Publicado: (2026)
Continual HyperTransformer: A Meta-Learner for Continual Few-Shot Learning
por: Vladymyrov, Max, et al.
Publicado: (2023)
por: Vladymyrov, Max, et al.
Publicado: (2023)
Few-Shot Deployment of Pretrained MRI Transformers in Brain Imaging Tasks
por: Li, Mengyu, et al.
Publicado: (2025)
por: Li, Mengyu, et al.
Publicado: (2025)
Improving Depth Gradient Continuity in Transformers: A Comparative Study on Monocular Depth Estimation with CNN
por: Yao, Jiawei, et al.
Publicado: (2023)
por: Yao, Jiawei, et al.
Publicado: (2023)
TinyViT-Batten: Few-Shot Vision Transformer with Explainable Attention for Early Batten-Disease Detection on Pediatric MRI
por: Uppalapati, Khartik, et al.
Publicado: (2025)
por: Uppalapati, Khartik, et al.
Publicado: (2025)
Ejemplares similares
-
RGBX-DiffusionDet: A Framework for Multi-Modal RGB-X Object Detection Using DiffusionDet
por: Orfaig, Eliraz, et al.
Publicado: (2025) -
Enhanced Automotive Object Detection via RGB-D Fusion in a DiffusionDet Framework
por: Orfaig, Eliraz, et al.
Publicado: (2024) -
Vision Transformers for Kidney Stone Image Classification: A Comparative Study with CNNs
por: Reyes-Amezcua, Ivan, et al.
Publicado: (2025) -
SuperResolution Radar Gesture Recognitio
por: Blumenfeld, Netanel, et al.
Publicado: (2024) -
Pre-trained Vision and Language Transformers Are Few-Shot Incremental Learners
por: Park, Keon-Hee, et al.
Publicado: (2024)