RT-Transformer: The Transformer Block as a Spherical State Estimator
Fuente:
arXiv
Guardado en:
| Autor principal: | Racioppo, Peter |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Robust Filter Attention: Self-Attention as Precision-Weighted State Estimation
por: Racioppo, Peter
Publicado: (2025)
por: Racioppo, Peter
Publicado: (2025)
Equivariant Spherical Transformer for Efficient Molecular Modeling
por: An, Junyi, et al.
Publicado: (2025)
por: An, Junyi, et al.
Publicado: (2025)
AC-SINDy: Compositional Sparse Identification of Nonlinear Dynamics
por: Racioppo, Peter
Publicado: (2026)
por: Racioppo, Peter
Publicado: (2026)
SparseSwin: Swin Transformer with Sparse Transformer Block
por: Pinasthika, Krisna, et al.
Publicado: (2023)
por: Pinasthika, Krisna, et al.
Publicado: (2023)
OrthoFormer: Instrumental Variable Estimation in Transformer Hidden States via Neural Control Functions
por: Luo, Charles
Publicado: (2026)
por: Luo, Charles
Publicado: (2026)
BlockCert: Certified Blockwise Extraction of Transformer Mechanisms
por: Andric, Sandro
Publicado: (2025)
por: Andric, Sandro
Publicado: (2025)
Transformer Block Coupling and its Correlation with Generalization in LLMs
por: Aubry, Murdock, et al.
Publicado: (2024)
por: Aubry, Murdock, et al.
Publicado: (2024)
Block-Recurrent Dynamics in Vision Transformers
por: Jacobs, Mozes, et al.
Publicado: (2025)
por: Jacobs, Mozes, et al.
Publicado: (2025)
Block Transformer: Global-to-Local Language Modeling for Fast Inference
por: Ho, Namgyu, et al.
Publicado: (2024)
por: Ho, Namgyu, et al.
Publicado: (2024)
The Belief State Transformer
por: Hu, Edward S., et al.
Publicado: (2024)
por: Hu, Edward S., et al.
Publicado: (2024)
Consciousness-ECG Transformer for Conscious State Estimation System with Real-Time Monitoring
por: Kweon, Young-Seok, et al.
Publicado: (2025)
por: Kweon, Young-Seok, et al.
Publicado: (2025)
Relational Preference Encoding in Looped Transformer Internal States
por: Kirin, Jan
Publicado: (2026)
por: Kirin, Jan
Publicado: (2026)
MeSH: Memory-as-State-Highways for Recursive Transformers
por: Yu, Chengting, et al.
Publicado: (2025)
por: Yu, Chengting, et al.
Publicado: (2025)
On the Role of Hidden States of Modern Hopfield Network in Transformer
por: Masumura, Tsubasa, et al.
Publicado: (2025)
por: Masumura, Tsubasa, et al.
Publicado: (2025)
Echo State Transformer: Attention Over Finite Memories
por: Bendi-Ouis, Yannis, et al.
Publicado: (2025)
por: Bendi-Ouis, Yannis, et al.
Publicado: (2025)
Circuits, Features, and Heuristics in Molecular Transformers
por: Varadi, Kristof, et al.
Publicado: (2025)
por: Varadi, Kristof, et al.
Publicado: (2025)
Conformal Transformations for Symmetric Power Transformers
por: Kumar, Saurabh, et al.
Publicado: (2025)
por: Kumar, Saurabh, et al.
Publicado: (2025)
Spatial Transformers for Radio Map Estimation
por: Viet, Pham Q., et al.
Publicado: (2024)
por: Viet, Pham Q., et al.
Publicado: (2024)
Transformer-Based Spatial-Temporal Counterfactual Outcomes Estimation
por: Li, He, et al.
Publicado: (2025)
por: Li, He, et al.
Publicado: (2025)
ReplaceMe: Network Simplification via Depth Pruning and Transformer Block Linearization
por: Shopkhoev, Dmitriy, et al.
Publicado: (2025)
por: Shopkhoev, Dmitriy, et al.
Publicado: (2025)
Predicting Estimated Times of Restoration for Electrical Outages Using Longitudinal Tabular Transformers
por: Teja, Bogireddy Sai Prasanna, et al.
Publicado: (2025)
por: Teja, Bogireddy Sai Prasanna, et al.
Publicado: (2025)
ACTIVA: Amortized Causal Effect Estimation via Transformer-based Variational Autoencoder
por: Sauter, Andreas, et al.
Publicado: (2025)
por: Sauter, Andreas, et al.
Publicado: (2025)
Scale-Consistent State-Space Dynamics via Fractal of Stationary Transformations
por: Yu, Geunhyeok, et al.
Publicado: (2026)
por: Yu, Geunhyeok, et al.
Publicado: (2026)
Priming: Hybrid State Space Models From Pre-trained Transformers
por: Chattopadhyay, Aditya, et al.
Publicado: (2026)
por: Chattopadhyay, Aditya, et al.
Publicado: (2026)
Value-State Gated Attention for Mitigating Extreme-Token Phenomena in Transformers
por: Bu, Rui, et al.
Publicado: (2025)
por: Bu, Rui, et al.
Publicado: (2025)
SEA: State-Exchange Attention for High-Fidelity Physics Based Transformers
por: Esmati, Parsa, et al.
Publicado: (2024)
por: Esmati, Parsa, et al.
Publicado: (2024)
Predicting Human Brain States with Transformer
por: Sun, Yifei, et al.
Publicado: (2024)
por: Sun, Yifei, et al.
Publicado: (2024)
TOAST: Transformer Optimization using Adaptive and Simple Transformations
por: Cannistraci, Irene, et al.
Publicado: (2024)
por: Cannistraci, Irene, et al.
Publicado: (2024)
An Introduction to Transformers
por: Turner, Richard E.
Publicado: (2023)
por: Turner, Richard E.
Publicado: (2023)
Traj-Transformer: Diffusion Models with Transformer for GPS Trajectory Generation
por: Zhang, Zhiyang, et al.
Publicado: (2025)
por: Zhang, Zhiyang, et al.
Publicado: (2025)
Are Transformers More Robust? Towards Exact Robustness Verification for Transformers
por: Liao, Brian Hsuan-Cheng, et al.
Publicado: (2022)
por: Liao, Brian Hsuan-Cheng, et al.
Publicado: (2022)
Evidential Transformation Network: Turning Pretrained Models into Evidential Models for Post-hoc Uncertainty Estimation
por: Chun, Yongchan, et al.
Publicado: (2026)
por: Chun, Yongchan, et al.
Publicado: (2026)
RESCHED: Rethinking Flexible Job Shop Scheduling from a Transformer-based Architecture with Simplified States
por: Xiao, Xiangjie, et al.
Publicado: (2026)
por: Xiao, Xiangjie, et al.
Publicado: (2026)
EnergyPatchTST: Multi-scale Time Series Transformers with Uncertainty Estimation for Energy Forecasting
por: Li, Wei, et al.
Publicado: (2025)
por: Li, Wei, et al.
Publicado: (2025)
EnTransformer: A Deep Generative Transformer for Multivariate Probabilistic Forecasting
por: Pathak, Rajdeep, et al.
Publicado: (2026)
por: Pathak, Rajdeep, et al.
Publicado: (2026)
Self-Clustering Graph Transformer Approach to Model Resting-State Functional Brain Activity
por: Thapaliya, Bishal, et al.
Publicado: (2025)
por: Thapaliya, Bishal, et al.
Publicado: (2025)
SGAT4PASS: Spherical Geometry-Aware Transformer for PAnoramic Semantic Segmentation
por: Li, Xuewei, et al.
Publicado: (2023)
por: Li, Xuewei, et al.
Publicado: (2023)
Neural Collapse is Globally Optimal in Deep Regularized ResNets and Transformers
por: Súkeník, Peter, et al.
Publicado: (2025)
por: Súkeník, Peter, et al.
Publicado: (2025)
FOAM: Blocked State Folding for Memory-Efficient LLM Training
por: Wen, Ziqing, et al.
Publicado: (2025)
por: Wen, Ziqing, et al.
Publicado: (2025)
Transformer Is Inherently a Causal Learner
por: Wang, Xinyue, et al.
Publicado: (2026)
por: Wang, Xinyue, et al.
Publicado: (2026)
Ejemplares similares
-
Robust Filter Attention: Self-Attention as Precision-Weighted State Estimation
por: Racioppo, Peter
Publicado: (2025) -
Equivariant Spherical Transformer for Efficient Molecular Modeling
por: An, Junyi, et al.
Publicado: (2025) -
AC-SINDy: Compositional Sparse Identification of Nonlinear Dynamics
por: Racioppo, Peter
Publicado: (2026) -
SparseSwin: Swin Transformer with Sparse Transformer Block
por: Pinasthika, Krisna, et al.
Publicado: (2023) -
OrthoFormer: Instrumental Variable Estimation in Transformer Hidden States via Neural Control Functions
por: Luo, Charles
Publicado: (2026)