Geometric Attention: A Regime-Explicit Operator Semantics for Transformer Attention
Fuente:
arXiv
Enregistré dans:
| Auteur principal: | Freytes, Luis Rosario |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Attention Schema-based Attention Control (ASAC): A Cognitive-Inspired Approach for Attention Management in Transformers
par: Saxena, Krati, et autres
Publié: (2025)
par: Saxena, Krati, et autres
Publié: (2025)
The Bayesian Geometry of Transformer Attention
par: Agarwal, Naman, et autres
Publié: (2025)
par: Agarwal, Naman, et autres
Publié: (2025)
XicorAttention: Time Series Transformer Using Attention with Nonlinear Correlation
par: Kimura, Daichi, et autres
Publié: (2025)
par: Kimura, Daichi, et autres
Publié: (2025)
Geometric Analysis of Token Selection in Multi-Head Attention
par: Mudarisov, Timur, et autres
Publié: (2026)
par: Mudarisov, Timur, et autres
Publié: (2026)
HashAttention: Semantic Sparsity for Faster Inference
par: Desai, Aditya, et autres
Publié: (2024)
par: Desai, Aditya, et autres
Publié: (2024)
vAttention: Verified Sparse Attention
par: Desai, Aditya, et autres
Publié: (2025)
par: Desai, Aditya, et autres
Publié: (2025)
Transolver is a Linear Transformer: Revisiting Physics-Attention through the Lens of Linear Attention
par: Hu, Wenjie, et autres
Publié: (2025)
par: Hu, Wenjie, et autres
Publié: (2025)
Geometric Point Attention Transformer for 3D Shape Reassembly
par: Li, Jiahan, et autres
Publié: (2024)
par: Li, Jiahan, et autres
Publié: (2024)
Exact Attention Sensitivity and the Geometry of Transformer Stability
par: Emadi, Seyed Morteza
Publié: (2026)
par: Emadi, Seyed Morteza
Publié: (2026)
Unveiling and Controlling Anomalous Attention Distribution in Transformers
par: Yan, Ruiqing, et autres
Publié: (2024)
par: Yan, Ruiqing, et autres
Publié: (2024)
Graph Convolutions Enrich the Self-Attention in Transformers!
par: Choi, Jeongwhan, et autres
Publié: (2023)
par: Choi, Jeongwhan, et autres
Publié: (2023)
Higher-Order Transformers With Kronecker-Structured Attention
par: Omranpour, Soroush, et autres
Publié: (2024)
par: Omranpour, Soroush, et autres
Publié: (2024)
Expanding Expressivity in Transformer Models with MöbiusAttention
par: Halacheva, Anna-Maria, et autres
Publié: (2024)
par: Halacheva, Anna-Maria, et autres
Publié: (2024)
Beyond Similarity: Temporal Operator Attention for Time Series Analysis
par: Twitty, Jevon, et autres
Publié: (2026)
par: Twitty, Jevon, et autres
Publié: (2026)
GIAT: A Geologically-Informed Attention Transformer for Lithology Identification
par: Li, Jie, et autres
Publié: (2026)
par: Li, Jie, et autres
Publié: (2026)
Attention as Binding: A Vector-Symbolic Perspective on Transformer Reasoning
par: Dhayalkar, Sahil Rajesh
Publié: (2025)
par: Dhayalkar, Sahil Rajesh
Publié: (2025)
NoiseFormer -- Noise Diffused Symmetric Attention Transformer
par: Kumar, Phani, et autres
Publié: (2026)
par: Kumar, Phani, et autres
Publié: (2026)
Dispatch-Aware Ragged Attention for Pruned Vision Transformers
par: Abdellatif, Seifeldin, et autres
Publié: (2026)
par: Abdellatif, Seifeldin, et autres
Publié: (2026)
ZeroS: Zero-Sum Linear Attention for Efficient Transformers
par: Lu, Jiecheng, et autres
Publié: (2026)
par: Lu, Jiecheng, et autres
Publié: (2026)
The Phasor Transformer: Resolving Attention Bottlenecks on the Unit Circle
par: Sigdel, Dibakar
Publié: (2026)
par: Sigdel, Dibakar
Publié: (2026)
Echo State Transformer: Attention Over Finite Memories
par: Bendi-Ouis, Yannis, et autres
Publié: (2025)
par: Bendi-Ouis, Yannis, et autres
Publié: (2025)
Strassen Attention, Split VC Dimension and Compositionality in Transformers
par: Kozachinskiy, Alexander, et autres
Publié: (2025)
par: Kozachinskiy, Alexander, et autres
Publié: (2025)
HATSolver: Learning Groebner Bases with Hierarchical Attention Transformers
par: Malhou, Mohamed, et autres
Publié: (2025)
par: Malhou, Mohamed, et autres
Publié: (2025)
Selective Attention Improves Transformer
par: Leviathan, Yaniv, et autres
Publié: (2024)
par: Leviathan, Yaniv, et autres
Publié: (2024)
Attention Sinks and Outliers in Attention Residuals
par: Luo, Haozheng, et autres
Publié: (2026)
par: Luo, Haozheng, et autres
Publié: (2026)
AttentionSmithy: A Modular Framework for Rapid Transformer Development and Customization
par: Cranney, Caleb, et autres
Publié: (2025)
par: Cranney, Caleb, et autres
Publié: (2025)
Scaling Graph Transformers: A Comparative Study of Sparse and Dense Attention
par: Dimitrov, Leon
Publié: (2025)
par: Dimitrov, Leon
Publié: (2025)
Explicit Multi-head Attention for Inter-head Interaction in Large Language Models
par: Peng, Runyu, et autres
Publié: (2026)
par: Peng, Runyu, et autres
Publié: (2026)
Solar-GECO: Perovskite Solar Cell Property Prediction with Geometric-Aware Co-Attention
par: Li, Lucas, et autres
Publié: (2025)
par: Li, Lucas, et autres
Publié: (2025)
CATO: Charted Attention for Neural PDE Operators
par: Cheng, Chun-Wun, et autres
Publié: (2026)
par: Cheng, Chun-Wun, et autres
Publié: (2026)
LOOKAT: Lookup-Optimized Key-Attention for Memory-Efficient Transformers
par: Karmore, Aryan
Publié: (2026)
par: Karmore, Aryan
Publié: (2026)
TQL: Scaling Q-Functions with Transformers by Preventing Attention Collapse
par: Dong, Perry, et autres
Publié: (2026)
par: Dong, Perry, et autres
Publié: (2026)
QFlash: Bridging Quantization and Memory Efficiency in Vision Transformer Attention
par: Oh, Sehyeon, et autres
Publié: (2026)
par: Oh, Sehyeon, et autres
Publié: (2026)
Nexusformer: Nonlinear Attention Expansion for Stable and Inheritable Transformer Scaling
par: Zhao, Weijie, et autres
Publié: (2026)
par: Zhao, Weijie, et autres
Publié: (2026)
Neighbourhood Transformer: Switchable Attention for Monophily-Aware Graph Learning
par: Luo, Yi, et autres
Publié: (2026)
par: Luo, Yi, et autres
Publié: (2026)
InfoMamba: An Attention-Free Hybrid Mamba-Transformer Model
par: Wang, Youjin, et autres
Publié: (2026)
par: Wang, Youjin, et autres
Publié: (2026)
Clustering by Attention: Leveraging Prior Fitted Transformers for Data Partitioning
par: Shokry, Ahmed, et autres
Publié: (2025)
par: Shokry, Ahmed, et autres
Publié: (2025)
Hybrid Focal and Full-Range Attention Based Graph Transformers
par: Zhu, Minhong, et autres
Publié: (2023)
par: Zhu, Minhong, et autres
Publié: (2023)
Towards Mechanistic Interpretability of Graph Transformers via Attention Graphs
par: El, Batu, et autres
Publié: (2025)
par: El, Batu, et autres
Publié: (2025)
VFA: Relieving Vector Operations in Flash Attention with Global Maximum Pre-computation
par: Sun, Yupeng, et autres
Publié: (2026)
par: Sun, Yupeng, et autres
Publié: (2026)
Documents similaires
-
Attention Schema-based Attention Control (ASAC): A Cognitive-Inspired Approach for Attention Management in Transformers
par: Saxena, Krati, et autres
Publié: (2025) -
The Bayesian Geometry of Transformer Attention
par: Agarwal, Naman, et autres
Publié: (2025) -
XicorAttention: Time Series Transformer Using Attention with Nonlinear Correlation
par: Kimura, Daichi, et autres
Publié: (2025) -
Geometric Analysis of Token Selection in Multi-Head Attention
par: Mudarisov, Timur, et autres
Publié: (2026) -
HashAttention: Semantic Sparsity for Faster Inference
par: Desai, Aditya, et autres
Publié: (2024)