AnchorFormer: Differentiable Anchor Attention for Efficient Vision Transformer
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Shan, Jiquan, Wang, Junxiao, Zhao, Lifeng, Cai, Liang, Zhang, Hongyuan, Liritzis, Ioannis |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Positional Encodings Anchor Spatial Structure in Vision Transformers: A Geometric Perspective on Robustness
par: Mannes, Mahmoud
Publié: (2026)
par: Mannes, Mahmoud
Publié: (2026)
Attention Transfer Is Not Universally Effective for Vision Transformers
par: Qin, Huaiyuan, et autres
Publié: (2026)
par: Qin, Huaiyuan, et autres
Publié: (2026)
Anchor-based Multi-view Subspace Clustering with Hierarchical Feature Descent
par: Ou, Qiyuan, et autres
Publié: (2023)
par: Ou, Qiyuan, et autres
Publié: (2023)
AEGIS: Anchor-Enforced Gradient Isolation for Knowledge-Preserving Vision-Language-Action Fine-Tuning
par: Singh, Guransh
Publié: (2026)
par: Singh, Guransh
Publié: (2026)
ParFormer: A Vision Transformer with Parallel Mixer and Sparse Channel Attention Patch Embedding
par: Setyawan, Novendra, et autres
Publié: (2024)
par: Setyawan, Novendra, et autres
Publié: (2024)
AnchorRoute: Human Motion Synthesis with Interval-Routed Sparse Contro
par: Fang, Pengcheng, et autres
Publié: (2026)
par: Fang, Pengcheng, et autres
Publié: (2026)
One-step Multi-view Clustering With Adaptive Low-rank Anchor-graph Learning
par: Xue, Zhiyuan, et autres
Publié: (2025)
par: Xue, Zhiyuan, et autres
Publié: (2025)
Anchors Aweigh! Sail for Optimal Unified Multi-Modal Representations
par: Jeong, Minoh, et autres
Publié: (2024)
par: Jeong, Minoh, et autres
Publié: (2024)
Language-Driven Anchors for Zero-Shot Adversarial Robustness
par: Li, Xiao, et autres
Publié: (2023)
par: Li, Xiao, et autres
Publié: (2023)
TagFog: Textual Anchor Guidance and Fake Outlier Generation for Visual Out-of-Distribution Detection
par: Chen, Jiankang, et autres
Publié: (2024)
par: Chen, Jiankang, et autres
Publié: (2024)
AGMA: Adaptive Gaussian Mixture Anchors for Prior-Guided Multimodal Human Trajectory Forecasting
par: Li, Chao, et autres
Publié: (2026)
par: Li, Chao, et autres
Publié: (2026)
A Language Anchor-Guided Method for Robust Noisy Domain Generalization
par: Dai, Zilin, et autres
Publié: (2025)
par: Dai, Zilin, et autres
Publié: (2025)
AuG-KD: Anchor-Based Mixup Generation for Out-of-Domain Knowledge Distillation
par: Tang, Zihao, et autres
Publié: (2024)
par: Tang, Zihao, et autres
Publié: (2024)
LargeMvC-Net: Anchor-based Deep Unfolding Network for Large-scale Multi-view Clustering
par: Du, Shide, et autres
Publié: (2025)
par: Du, Shide, et autres
Publié: (2025)
SpecFormer: Guarding Vision Transformer Robustness via Maximum Singular Value Penalization
par: Hu, Xixu, et autres
Publié: (2024)
par: Hu, Xixu, et autres
Publié: (2024)
LightMedSeg: Lightweight 3D Medical Image Segmentation with Learned Spatial Anchors
par: Tyagi, Kavyansh, et autres
Publié: (2026)
par: Tyagi, Kavyansh, et autres
Publié: (2026)
Spectral Enhancement and Pseudo-Anchor Guidance for Infrared-Visible Person Re-Identification
par: Ge, Yiyuan, et autres
Publié: (2024)
par: Ge, Yiyuan, et autres
Publié: (2024)
PerFormer: A Permutation Based Vision Transformer for Remaining Useful Life Prediction
par: Fan, Zhengyang, et autres
Publié: (2025)
par: Fan, Zhengyang, et autres
Publié: (2025)
GeoFormer: A Vision and Sequence Transformer-based Approach for Greenhouse Gas Monitoring
par: Khirwar, Madhav, et autres
Publié: (2024)
par: Khirwar, Madhav, et autres
Publié: (2024)
SpikeVideoFormer: An Efficient Spike-Driven Video Transformer with Hamming Attention and $\mathcal{O}(T)$ Complexity
par: Zou, Shihao, et autres
Publié: (2025)
par: Zou, Shihao, et autres
Publié: (2025)
Elastic Attention Cores for Scalable Vision Transformers
par: Song, Alan Z., et autres
Publié: (2026)
par: Song, Alan Z., et autres
Publié: (2026)
RTA-Former: Reverse Transformer Attention for Polyp Segmentation
par: Li, Zhikai, et autres
Publié: (2024)
par: Li, Zhikai, et autres
Publié: (2024)
Learning Unlabeled Clients Divergence for Federated Semi-Supervised Learning via Anchor Model Aggregation
par: Elbatel, Marawan, et autres
Publié: (2024)
par: Elbatel, Marawan, et autres
Publié: (2024)
Handling Spatial-Temporal Data Heterogeneity for Federated Continual Learning via Tail Anchor
par: Yu, Hao, et autres
Publié: (2024)
par: Yu, Hao, et autres
Publié: (2024)
IoUCert: Robustness Verification for Anchor-based Object Detectors
par: Brückner, Benedikt, et autres
Publié: (2026)
par: Brückner, Benedikt, et autres
Publié: (2026)
AttAnchor: Guiding Cross-Modal Token Alignment in VLMs with Attention Anchors
par: Zhang, Junyang, et autres
Publié: (2025)
par: Zhang, Junyang, et autres
Publié: (2025)
PDiscoFormer: Relaxing Part Discovery Constraints with Vision Transformers
par: Aniraj, Ananthu, et autres
Publié: (2024)
par: Aniraj, Ananthu, et autres
Publié: (2024)
SimO Loss: Anchor-Free Contrastive Loss for Fine-Grained Supervised Contrastive Learning
par: Bouhsine, Taha, et autres
Publié: (2024)
par: Bouhsine, Taha, et autres
Publié: (2024)
ReasonDrive: Efficient Visual Question Answering for Autonomous Vehicles with Reasoning-Enhanced Small Vision-Language Models
par: Chahe, Amirhosein, et autres
Publié: (2025)
par: Chahe, Amirhosein, et autres
Publié: (2025)
Synthesizer Based Efficient Self-Attention for Vision Tasks
par: Zhu, Guangyang, et autres
Publié: (2022)
par: Zhu, Guangyang, et autres
Publié: (2022)
DASViT: Differentiable Architecture Search for Vision Transformer
par: Wu, Pengjin, et autres
Publié: (2025)
par: Wu, Pengjin, et autres
Publié: (2025)
GRPO-TTA: Test-Time Visual Tuning for Vision-Language Models via GRPO-Driven Reinforcement Learning
par: Li, Yujun, et autres
Publié: (2026)
par: Li, Yujun, et autres
Publié: (2026)
MetaFormer Baselines for Vision
par: Yu, Weihao, et autres
Publié: (2022)
par: Yu, Weihao, et autres
Publié: (2022)
Multi-Modal Landslide Detection from Sentinel-1 SAR and Sentinel-2 Optical Imagery Using Multi-Encoder Vision Transformers and Ensemble Learning
par: Nasios, Ioannis
Publié: (2026)
par: Nasios, Ioannis
Publié: (2026)
GUI-AIMA: Aligning Intrinsic Multimodal Attention with a Context Anchor for GUI Grounding
par: Zhou, Shijie, et autres
Publié: (2025)
par: Zhou, Shijie, et autres
Publié: (2025)
AnchorDS: Anchoring Dynamic Sources for Semantically Consistent Text-to-3D Generation
par: Zhu, Jiayin, et autres
Publié: (2025)
par: Zhu, Jiayin, et autres
Publié: (2025)
Synthetic Lung X-ray Generation through Cross-Attention and Affinity Transformation
par: Pi, Ruochen, et autres
Publié: (2025)
par: Pi, Ruochen, et autres
Publié: (2025)
MABViT -- Modified Attention Block Enhances Vision Transformers
par: Ramesh, Mahesh, et autres
Publié: (2023)
par: Ramesh, Mahesh, et autres
Publié: (2023)
TA-Prompting: Enhancing Video Large Language Models for Dense Video Captioning via Temporal Anchors
par: Cheng, Wei-Yuan, et autres
Publié: (2026)
par: Cheng, Wei-Yuan, et autres
Publié: (2026)
LetheViT: Selective Machine Unlearning for Vision Transformers via Attention-Guided Contrastive Learning
par: Tong, Yujia, et autres
Publié: (2025)
par: Tong, Yujia, et autres
Publié: (2025)
Documents similaires
-
Positional Encodings Anchor Spatial Structure in Vision Transformers: A Geometric Perspective on Robustness
par: Mannes, Mahmoud
Publié: (2026) -
Attention Transfer Is Not Universally Effective for Vision Transformers
par: Qin, Huaiyuan, et autres
Publié: (2026) -
Anchor-based Multi-view Subspace Clustering with Hierarchical Feature Descent
par: Ou, Qiyuan, et autres
Publié: (2023) -
AEGIS: Anchor-Enforced Gradient Isolation for Knowledge-Preserving Vision-Language-Action Fine-Tuning
par: Singh, Guransh
Publié: (2026) -
ParFormer: A Vision Transformer with Parallel Mixer and Sparse Channel Attention Patch Embedding
par: Setyawan, Novendra, et autres
Publié: (2024)