Robust Filter Attention: Self-Attention as Precision-Weighted State Estimation
Fuente:
arXiv
Enregistré dans:
| Auteur principal: | Racioppo, Peter |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
RT-Transformer: The Transformer Block as a Spherical State Estimator
par: Racioppo, Peter
Publié: (2026)
par: Racioppo, Peter
Publié: (2026)
Attention-Based Neural-Augmented Kalman Filter for Legged Robot State Estimation
par: Lee, Seokju, et autres
Publié: (2026)
par: Lee, Seokju, et autres
Publié: (2026)
Attention-Aided MMSE for OFDM Channel Estimation: Learning Linear Filters with Attention
par: Ha, TaeJun, et autres
Publié: (2025)
par: Ha, TaeJun, et autres
Publié: (2025)
The Routing and Filtering Structure of Attention
par: Jamil, Shafayeth, et autres
Publié: (2026)
par: Jamil, Shafayeth, et autres
Publié: (2026)
Pay Attention to Small Weights
par: Zhou, Chao, et autres
Publié: (2025)
par: Zhou, Chao, et autres
Publié: (2025)
The Anxiety of Influence: Bloom Filters in Transformer Attention Heads
par: Balogh, Peter
Publié: (2026)
par: Balogh, Peter
Publié: (2026)
DistrAttention: An Efficient and Flexible Self-Attention Mechanism on Modern GPUs
par: Jin, Haolin, et autres
Publié: (2025)
par: Jin, Haolin, et autres
Publié: (2025)
Spatial-Temporal Attention Model for Traffic State Estimation with Sparse Internet of Vehicles
par: Xue, Jianzhe, et autres
Publié: (2024)
par: Xue, Jianzhe, et autres
Publié: (2024)
Modeling Choice via Self-Attention
par: Ko, Joohwan, et autres
Publié: (2023)
par: Ko, Joohwan, et autres
Publié: (2023)
Quaternion Self-Attention with Shared Scores
par: Yamauchi, Shogo, et autres
Publié: (2026)
par: Yamauchi, Shogo, et autres
Publié: (2026)
One Filters All: A Generalist Filter for State Estimation
par: Liu, Shiqi, et autres
Publié: (2025)
par: Liu, Shiqi, et autres
Publié: (2025)
Weighted Graph Structure Learning with Attention Denoising for Node Classification
par: Wang, Tingting, et autres
Publié: (2025)
par: Wang, Tingting, et autres
Publié: (2025)
More Expressive Attention with Negative Weights
par: Lv, Ang, et autres
Publié: (2024)
par: Lv, Ang, et autres
Publié: (2024)
Sigmoid Self-Attention has Lower Sample Complexity than Softmax Self-Attention: A Mixture-of-Experts Perspective
par: Yan, Fanqi, et autres
Publié: (2025)
par: Yan, Fanqi, et autres
Publié: (2025)
Attention as Robust Representation for Time Series Forecasting
par: Niu, PeiSong, et autres
Publié: (2024)
par: Niu, PeiSong, et autres
Publié: (2024)
Why Low-Precision Transformer Training Fails: An Analysis on Flash Attention
par: Qiu, Haiquan, et autres
Publié: (2025)
par: Qiu, Haiquan, et autres
Publié: (2025)
Are Self-Attentions Effective for Time Series Forecasting?
par: Kim, Dongbin, et autres
Publié: (2024)
par: Kim, Dongbin, et autres
Publié: (2024)
Graph Convolutions Enrich the Self-Attention in Transformers!
par: Choi, Jeongwhan, et autres
Publié: (2023)
par: Choi, Jeongwhan, et autres
Publié: (2023)
AFD-STA: Adaptive Filtering Denoising with Spatiotemporal Attention for Chaotic System Prediction
par: Gong, Chunlin, et autres
Publié: (2025)
par: Gong, Chunlin, et autres
Publié: (2025)
State Rank Dynamics in Linear Attention LLMs
par: Sun, Ao, et autres
Publié: (2026)
par: Sun, Ao, et autres
Publié: (2026)
FROST: Filtering Reasoning Outliers with Attention for Efficient Reasoning
par: Luo, Haozheng, et autres
Publié: (2026)
par: Luo, Haozheng, et autres
Publié: (2026)
Rank-Aware Spectral Bounds on Attention Logits for Stable Low-Precision Training
par: Emadi, Seyed Morteza
Publié: (2026)
par: Emadi, Seyed Morteza
Publié: (2026)
Diagonal-Tiled Mixed-Precision Attention for Efficient Low-Bit MXFP Inference
par: Ding, Yifu, et autres
Publié: (2026)
par: Ding, Yifu, et autres
Publié: (2026)
Key and Value Weights Are Probably All You Need: On the Necessity of the Query, Key, Value weight Triplet in Self-Attention Transformers
par: Karbevski, Marko, et autres
Publié: (2025)
par: Karbevski, Marko, et autres
Publié: (2025)
AC-SINDy: Compositional Sparse Identification of Nonlinear Dynamics
par: Racioppo, Peter
Publié: (2026)
par: Racioppo, Peter
Publié: (2026)
Attention-Driven Hierarchical Reinforcement Learning with Particle Filtering for Source Localization in Dynamic Fields
par: Shi, Yiwei, et autres
Publié: (2025)
par: Shi, Yiwei, et autres
Publié: (2025)
Data-Free Pruning of Self-Attention Layers in LLMs
par: Saikumar, Dhananjay, et autres
Publié: (2025)
par: Saikumar, Dhananjay, et autres
Publié: (2025)
vAttention: Verified Sparse Attention
par: Desai, Aditya, et autres
Publié: (2025)
par: Desai, Aditya, et autres
Publié: (2025)
Attention Sinks and Outliers in Attention Residuals
par: Luo, Haozheng, et autres
Publié: (2026)
par: Luo, Haozheng, et autres
Publié: (2026)
Echo State Transformer: Attention Over Finite Memories
par: Bendi-Ouis, Yannis, et autres
Publié: (2025)
par: Bendi-Ouis, Yannis, et autres
Publié: (2025)
Rhamba: Region-Aware Hybrid Attention-Mamba Framework for Self-Supervised Learning in Resting-State fMRI
par: Doodipala, Ruthwik Reddy, et autres
Publié: (2026)
par: Doodipala, Ruthwik Reddy, et autres
Publié: (2026)
Self-Attention Mechanism in Multimodal Context for Banking Transaction Flow
par: Delestre, Cyrile, et autres
Publié: (2024)
par: Delestre, Cyrile, et autres
Publié: (2024)
CSAI: Conditional Self-Attention Imputation for Healthcare Time-series
par: Qian, Linglong, et autres
Publié: (2023)
par: Qian, Linglong, et autres
Publié: (2023)
Parkinson's Disease Detection from Resting State EEG using Multi-Head Graph Structure Learning with Gradient Weighted Graph Attention Explanations
par: Neves, Christopher, et autres
Publié: (2024)
par: Neves, Christopher, et autres
Publié: (2024)
Towards Robust Knowledge Tracing Models via k-Sparse Attention
par: Huang, Shuyan, et autres
Publié: (2024)
par: Huang, Shuyan, et autres
Publié: (2024)
Attention Schema-based Attention Control (ASAC): A Cognitive-Inspired Approach for Attention Management in Transformers
par: Saxena, Krati, et autres
Publié: (2025)
par: Saxena, Krati, et autres
Publié: (2025)
Improving Underwater Acoustic Classification Through Learnable Gabor Filter Convolution and Attention Mechanisms
par: Domingos, Lucas Cesar Ferreira, et autres
Publié: (2025)
par: Domingos, Lucas Cesar Ferreira, et autres
Publié: (2025)
Attention on the Sphere
par: Bonev, Boris, et autres
Publié: (2025)
par: Bonev, Boris, et autres
Publié: (2025)
Learning Advanced Self-Attention for Linear Transformers in the Singular Value Domain
par: Wi, Hyowon, et autres
Publié: (2025)
par: Wi, Hyowon, et autres
Publié: (2025)
From MLP to NeoMLP: Leveraging Self-Attention for Neural Fields
par: Kofinas, Miltiadis, et autres
Publié: (2024)
par: Kofinas, Miltiadis, et autres
Publié: (2024)
Documents similaires
-
RT-Transformer: The Transformer Block as a Spherical State Estimator
par: Racioppo, Peter
Publié: (2026) -
Attention-Based Neural-Augmented Kalman Filter for Legged Robot State Estimation
par: Lee, Seokju, et autres
Publié: (2026) -
Attention-Aided MMSE for OFDM Channel Estimation: Learning Linear Filters with Attention
par: Ha, TaeJun, et autres
Publié: (2025) -
The Routing and Filtering Structure of Attention
par: Jamil, Shafayeth, et autres
Publié: (2026) -
Pay Attention to Small Weights
par: Zhou, Chao, et autres
Publié: (2025)