FViT: A Focal Vision Transformer with Gabor Filter
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Shi, Yulong, Sun, Mingwei, Wang, Yongshuai, Chen, Zengqiang |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
EViT: An Eagle Vision Transformer with Bi-Fovea Self-Attention
par: Shi, Yulong, et autres
Publié: (2023)
par: Shi, Yulong, et autres
Publié: (2023)
Improved EATFormer: A Vision Transformer for Medical Image Classification
par: Shisu, Yulong, et autres
Publié: (2024)
par: Shisu, Yulong, et autres
Publié: (2024)
Revolutionizing Traffic Sign Recognition: Unveiling the Potential of Vision Transformers
par: Mingwin, Susano, et autres
Publié: (2024)
par: Mingwin, Susano, et autres
Publié: (2024)
AdaptSplat: Adapting Vision Foundation Models for Feed-Forward 3D Gaussian Splatting
par: Xing, Mingwei, et autres
Publié: (2026)
par: Xing, Mingwei, et autres
Publié: (2026)
Federated Vision Transformer with Adaptive Focal Loss for Medical Image Classification
par: Zhao, Xinyuan, et autres
Publié: (2026)
par: Zhao, Xinyuan, et autres
Publié: (2026)
GFT: Gradient Focal Transformer
par: Kriuk, Boris, et autres
Publié: (2025)
par: Kriuk, Boris, et autres
Publié: (2025)
big.LITTLE Vision Transformer for Efficient Visual Recognition
par: Guo, He, et autres
Publié: (2024)
par: Guo, He, et autres
Publié: (2024)
Surface Defect Detection with Gabor Filter Using Reconstruction-Based Blurring U-Net-ViT
par: Si, Jongwook, et autres
Publié: (2025)
par: Si, Jongwook, et autres
Publié: (2025)
Effects of Gabor Filters on Classification Performance of CNNs Trained on a Limited Number of Conditions
par: Morita, Akito, et autres
Publié: (2026)
par: Morita, Akito, et autres
Publié: (2026)
There is More to Attention: Statistical Filtering Enhances Explanations in Vision Transformers
par: Ayyar, Meghna P, et autres
Publié: (2025)
par: Ayyar, Meghna P, et autres
Publié: (2025)
DoReMi: Bridging 3D Domains via Topology-Aware Domain-Representation Mixture of Experts
par: Xing, Mingwei, et autres
Publié: (2025)
par: Xing, Mingwei, et autres
Publié: (2025)
FocalOrder: Focal Preference Optimization for Reading Order Detection
par: Liu, Fuyuan, et autres
Publié: (2026)
par: Liu, Fuyuan, et autres
Publié: (2026)
Tell2Adapt: A Unified Framework for Source Free Unsupervised Domain Adaptation via Vision Foundation Model
par: Shi, Yulong, et autres
Publié: (2026)
par: Shi, Yulong, et autres
Publié: (2026)
Neural Gabor Splatting: Enhanced Gaussian Splatting with Neural Gabor for High-frequency Surface Reconstruction
par: Watanabe, Haato, et autres
Publié: (2026)
par: Watanabe, Haato, et autres
Publié: (2026)
Speed-up of Vision Transformer Models by Attention-aware Token Filtering
par: Naruko, Takahiro, et autres
Publié: (2025)
par: Naruko, Takahiro, et autres
Publié: (2025)
DaBiT: Depth and Blur informed Transformer for Video Focal Deblurring
par: Morris, Crispian, et autres
Publié: (2024)
par: Morris, Crispian, et autres
Publié: (2024)
Beyond the Vision Encoder: Identifying and Mitigating Spatial Bias in Large Vision-Language Models
par: Zhu, Yingjie, et autres
Publié: (2025)
par: Zhu, Yingjie, et autres
Publié: (2025)
Revisiting Reweighted Risk for Calibration: AURC, Focal, and Inverse Focal Loss
par: Zhou, Han, et autres
Publié: (2025)
par: Zhou, Han, et autres
Publié: (2025)
Non-parametric regularization for class imbalance federated medical image classification
par: Wicaksana, Jeffry, et autres
Publié: (2024)
par: Wicaksana, Jeffry, et autres
Publié: (2024)
FedA3I: Annotation Quality-Aware Aggregation for Federated Medical Image Segmentation against Heterogeneous Annotation Noise
par: Wu, Nannan, et autres
Publié: (2023)
par: Wu, Nannan, et autres
Publié: (2023)
FocalPose++: Focal Length and Object Pose Estimation via Render and Compare
par: Cífka, Martin, et autres
Publié: (2023)
par: Cífka, Martin, et autres
Publié: (2023)
EmbryoDiff: A Conditional Diffusion Framework with Multi-Focal Feature Fusion for Fine-Grained Embryo Developmental Stage Recognition
par: Sun, Yong, et autres
Publié: (2025)
par: Sun, Yong, et autres
Publié: (2025)
Revisiting 360 Depth Estimation with PanoGabor: A New Fusion Perspective
par: Shen, Zhijie, et autres
Publié: (2024)
par: Shen, Zhijie, et autres
Publié: (2024)
Compress image to patches for Vision Transformer
par: Zhao, Xinfeng, et autres
Publié: (2025)
par: Zhao, Xinfeng, et autres
Publié: (2025)
FloorplanVLM: A Vision-Language Model for Floorplan Vectorization
par: Liu, Yuanqing, et autres
Publié: (2026)
par: Liu, Yuanqing, et autres
Publié: (2026)
Variable Aperture Bokeh Rendering via Customized Focal Plane Guidance
par: Chen, Kang, et autres
Publié: (2024)
par: Chen, Kang, et autres
Publié: (2024)
AdaGaR: Adaptive Gabor Representation for Dynamic Scene Reconstruction
par: Chan, Jiewen, et autres
Publié: (2026)
par: Chan, Jiewen, et autres
Publié: (2026)
Vision Transformers Need More Than Registers
par: Shi, Cheng, et autres
Publié: (2026)
par: Shi, Cheng, et autres
Publié: (2026)
V2X-RECT: An Efficient V2X Trajectory Prediction Framework via Redundant Interaction Filtering and Tracking Error Correction
par: Kong, Xiangyan, et autres
Publié: (2025)
par: Kong, Xiangyan, et autres
Publié: (2025)
PASSION: Towards Effective Incomplete Multi-Modal Medical Image Segmentation with Imbalanced Missing Rates
par: Shi, Junjie, et autres
Publié: (2024)
par: Shi, Junjie, et autres
Publié: (2024)
A New Clustering-based View Planning Method for Building Inspection with Drone
par: Zheng, Yongshuai, et autres
Publié: (2024)
par: Zheng, Yongshuai, et autres
Publié: (2024)
Gabor is Enough: Interpretable Deep Denoising with a Gabor Synthesis Dictionary Prior
par: Janjušević, Nikola, et autres
Publié: (2022)
par: Janjušević, Nikola, et autres
Publié: (2022)
Query-Efficient Hard-Label Black-Box Attack against Vision Transformers
par: Zhou, Chao, et autres
Publié: (2024)
par: Zhou, Chao, et autres
Publié: (2024)
Artifacts and Attention Sinks: Structured Approximations for Efficient Vision Transformers
par: Lu, Andrew, et autres
Publié: (2025)
par: Lu, Andrew, et autres
Publié: (2025)
A Vision-Language Model for Focal Liver Lesion Classification
par: Jian, Song, et autres
Publié: (2025)
par: Jian, Song, et autres
Publié: (2025)
FocalClick-XL: Towards Unified and High-quality Interactive Segmentation
par: Chen, Xi, et autres
Publié: (2025)
par: Chen, Xi, et autres
Publié: (2025)
Vision Transformers with Hierarchical Attention
par: Liu, Yun, et autres
Publié: (2021)
par: Liu, Yun, et autres
Publié: (2021)
Transforming Vision Transformer: Towards Efficient Multi-Task Asynchronous Learning
par: Zhong, Hanwen, et autres
Publié: (2025)
par: Zhong, Hanwen, et autres
Publié: (2025)
FoPru: Focal Pruning for Efficient Large Vision-Language Models
par: Jiang, Lei, et autres
Publié: (2024)
par: Jiang, Lei, et autres
Publié: (2024)
FUN: A Focal U-Net Combining Reconstruction and Object Detection for Snapshot Spectral Imaging
par: Gao, Dahua, et autres
Publié: (2026)
par: Gao, Dahua, et autres
Publié: (2026)
Documents similaires
-
EViT: An Eagle Vision Transformer with Bi-Fovea Self-Attention
par: Shi, Yulong, et autres
Publié: (2023) -
Improved EATFormer: A Vision Transformer for Medical Image Classification
par: Shisu, Yulong, et autres
Publié: (2024) -
Revolutionizing Traffic Sign Recognition: Unveiling the Potential of Vision Transformers
par: Mingwin, Susano, et autres
Publié: (2024) -
AdaptSplat: Adapting Vision Foundation Models for Feed-Forward 3D Gaussian Splatting
par: Xing, Mingwei, et autres
Publié: (2026) -
Federated Vision Transformer with Adaptive Focal Loss for Medical Image Classification
par: Zhao, Xinyuan, et autres
Publié: (2026)