QUEST: A robust attention formulation using query-modulated spherical attention
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Govindarajan, Hariprasath, Sidén, Per, Roll, Jacob, Lindsten, Fredrik |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
DINO as a von Mises-Fisher mixture model
par: Govindarajan, Hariprasath, et autres
Publié: (2024)
par: Govindarajan, Hariprasath, et autres
Publié: (2024)
On Partial Prototype Collapse in the DINO Family of Self-Supervised Methods
par: Govindarajan, Hariprasath, et autres
Publié: (2024)
par: Govindarajan, Hariprasath, et autres
Publié: (2024)
GCAM: Gaussian and causal-attention model of food fine-grained recognition
par: Zhuang, Guohang, et autres
Publié: (2024)
par: Zhuang, Guohang, et autres
Publié: (2024)
CDAN: Convolutional dense attention-guided network for low-light image enhancement
par: Shakibania, Hossein, et autres
Publié: (2023)
par: Shakibania, Hossein, et autres
Publié: (2023)
Moving object detection from multi-depth images with an attention-enhanced CNN
par: Shibukawa, Masato, et autres
Publié: (2025)
par: Shibukawa, Masato, et autres
Publié: (2025)
Vision Transformer attention alignment with human visual perception in aesthetic object evaluation
par: Carrasco, Miguel, et autres
Publié: (2025)
par: Carrasco, Miguel, et autres
Publié: (2025)
Translution: Unifying Self-attention and Convolution for Adaptive and Relative Modeling
par: Fan, Hehe, et autres
Publié: (2025)
par: Fan, Hehe, et autres
Publié: (2025)
Understanding attention-based encoder-decoder networks: a case study with chess scoresheet recognition
par: Hayashi, Sergio Y., et autres
Publié: (2024)
par: Hayashi, Sergio Y., et autres
Publié: (2024)
Multi-scale Quaternion CNN and BiGRU with Cross Self-attention Feature Fusion for Fault Diagnosis of Bearing
par: Liu, Huanbai, et autres
Publié: (2024)
par: Liu, Huanbai, et autres
Publié: (2024)
Is attention all you need in medical image analysis? A review
par: Papanastasiou, Giorgos, et autres
Publié: (2023)
par: Papanastasiou, Giorgos, et autres
Publié: (2023)
Bringing together invertible UNets with invertible attention modules for memory-efficient diffusion models
par: Jain, Karan, et autres
Publié: (2025)
par: Jain, Karan, et autres
Publié: (2025)
Multimodal synthesis of MRI and tabular data with diffusion in a joint latent space via cross-attention
par: Mensing, Daniel, et autres
Publié: (2026)
par: Mensing, Daniel, et autres
Publié: (2026)
Multi-modal user interface control detection using cross-attention
par: Moradi, Milad, et autres
Publié: (2026)
par: Moradi, Milad, et autres
Publié: (2026)
CleverDistiller: Simple and Spatially Consistent Cross-modal Distillation
par: Govindarajan, Hariprasath, et autres
Publié: (2025)
par: Govindarajan, Hariprasath, et autres
Publié: (2025)
S3PT: Scene Semantics and Structure Guided Clustering to Boost Self-Supervised Pre-Training for Autonomous Driving
par: Wozniak, Maciej K., et autres
Publié: (2024)
par: Wozniak, Maciej K., et autres
Publié: (2024)
Open-set object detection: towards unified problem formulation and benchmarking
par: Ammar, Hejer, et autres
Publié: (2024)
par: Ammar, Hejer, et autres
Publié: (2024)
MuM: Multi-View Masked Image Modeling for 3D Vision
par: Nordström, David, et autres
Publié: (2025)
par: Nordström, David, et autres
Publié: (2025)
Random Token Fusion for Multi-View Medical Diagnosis
par: Guo, Jingyu, et autres
Publié: (2024)
par: Guo, Jingyu, et autres
Publié: (2024)
RefTr: Recurrent Refinement of Confluent Trajectories for 3D Vascular Tree Centerlines
par: Naeem, Roman, et autres
Publié: (2025)
par: Naeem, Roman, et autres
Publié: (2025)
Octic Vision Transformers: Quicker ViTs Through Equivariance
par: Nordström, David, et autres
Publié: (2025)
par: Nordström, David, et autres
Publié: (2025)
Adversarial robustness of VAEs through the lens of local geometry
par: Khan, Asif, et autres
Publié: (2022)
par: Khan, Asif, et autres
Publié: (2022)
Understanding vision transformer robustness through the lens of out-of-distribution detection
par: Kuang, Joey, et autres
Publié: (2026)
par: Kuang, Joey, et autres
Publié: (2026)
Group-robust Sample Reweighting for Subpopulation Shifts via Influence Functions
par: Qiao, Rui, et autres
Publié: (2025)
par: Qiao, Rui, et autres
Publié: (2025)
Multi-Object Tracking Consistently Improves Wildlife Inference
par: Muthivhi, Mufhumudzi, et autres
Publié: (2026)
par: Muthivhi, Mufhumudzi, et autres
Publié: (2026)
ARTA: Adaptive Mixed-Resolution Token Allocation for Efficient Dense Feature Extraction
par: Hagerman, David, et autres
Publié: (2026)
par: Hagerman, David, et autres
Publié: (2026)
3D-Consistent Multi-View Editing by Correspondence Guidance
par: Bengtson, Josef, et autres
Publié: (2025)
par: Bengtson, Josef, et autres
Publié: (2025)
Efficient generative adversarial networks using linear additive-attention Transformers
par: Morales-Juarez, Emilio, et autres
Publié: (2024)
par: Morales-Juarez, Emilio, et autres
Publié: (2024)
GCA-ResUNet:Image segmentation in medical images using grouped coordinate attention
par: Ding, Jun, et autres
Publié: (2025)
par: Ding, Jun, et autres
Publié: (2025)
A noisy elephant in the room: Is your out-of-distribution detector robust to label noise?
par: Humblot-Renaux, Galadrielle, et autres
Publié: (2024)
par: Humblot-Renaux, Galadrielle, et autres
Publié: (2024)
Self-supervised video pretraining yields robust and more human-aligned visual representations
par: Parthasarathy, Nikhil, et autres
Publié: (2022)
par: Parthasarathy, Nikhil, et autres
Publié: (2022)
SELECTOR: Heterogeneous graph network with convolutional masked autoencoder for multimodal robust prediction of cancer survival
par: Pan, Liangrui, et autres
Publié: (2024)
par: Pan, Liangrui, et autres
Publié: (2024)
Enhancing compact convolutional transformers with super attention
par: Leandre, Simpenzwe Honore, et autres
Publié: (2025)
par: Leandre, Simpenzwe Honore, et autres
Publié: (2025)
CTARR: A fast and robust method for identifying anatomical regions on CT images via atlas registration
par: Buddenkotte, Thomas, et autres
Publié: (2024)
par: Buddenkotte, Thomas, et autres
Publié: (2024)
Understanding Ice Crystal Habit Diversity with Self-Supervised Learning
par: Ko, Joseph, et autres
Publié: (2025)
par: Ko, Joseph, et autres
Publié: (2025)
GAC-Net_Geometric and attention-based Network for Depth Completion
par: Zhu, Kuang, et autres
Publié: (2025)
par: Zhu, Kuang, et autres
Publié: (2025)
Relation Learning and Aggregate-attention for Multi-person Motion Prediction
par: Qu, Kehua, et autres
Publié: (2024)
par: Qu, Kehua, et autres
Publié: (2024)
Revisiting Likelihood-Based Out-of-Distribution Detection by Modeling Representations
par: Ding, Yifan, et autres
Publié: (2025)
par: Ding, Yifan, et autres
Publié: (2025)
A Conformal Prediction Score that is Robust to Label Noise
par: Penso, Coby, et autres
Publié: (2024)
par: Penso, Coby, et autres
Publié: (2024)
Improving deep learning with prior knowledge and cognitive models: A survey on enhancing explainability, adversarial robustness and zero-shot learning
par: Mumuni, Fuseinin, et autres
Publié: (2024)
par: Mumuni, Fuseinin, et autres
Publié: (2024)
Pruning Self-attentions into Convolutional Layers in Single Path
par: He, Haoyu, et autres
Publié: (2021)
par: He, Haoyu, et autres
Publié: (2021)
Documents similaires
-
DINO as a von Mises-Fisher mixture model
par: Govindarajan, Hariprasath, et autres
Publié: (2024) -
On Partial Prototype Collapse in the DINO Family of Self-Supervised Methods
par: Govindarajan, Hariprasath, et autres
Publié: (2024) -
GCAM: Gaussian and causal-attention model of food fine-grained recognition
par: Zhuang, Guohang, et autres
Publié: (2024) -
CDAN: Convolutional dense attention-guided network for low-light image enhancement
par: Shakibania, Hossein, et autres
Publié: (2023) -
Moving object detection from multi-depth images with an attention-enhanced CNN
par: Shibukawa, Masato, et autres
Publié: (2025)