Salvato in:
| Autore principale: | Khasia, Vladimer |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | https://arxiv.org/abs/2602.07070 |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Spectral-Window Hybrid (SWH)
di: Khasia, Vladimer
Pubblicazione: (2026)
di: Khasia, Vladimer
Pubblicazione: (2026)
Dynamic Subspace Composition: Efficient Adaptation via Contractive Basis Expansion
di: Khasia, Vladimer
Pubblicazione: (2025)
di: Khasia, Vladimer
Pubblicazione: (2025)
HAS-VQ: Hessian-Adaptive Sparse Vector Quantization for High-Fidelity LLM Compression
di: Khasia, Vladimer
Pubblicazione: (2026)
di: Khasia, Vladimer
Pubblicazione: (2026)
BASIS: Balanced Activation Sketching with Invariant Scalars for "Ghost Backpropagation"
di: Khasia, Vladimer
Pubblicazione: (2026)
di: Khasia, Vladimer
Pubblicazione: (2026)
HoloByte: Continuous Hyperspherical Distillation for Tokenizer-Free Modeling
di: Khasia, Vladimer
Pubblicazione: (2026)
di: Khasia, Vladimer
Pubblicazione: (2026)
Beyond Attention: True Adaptive World Models via Spherical Kernel Operator
di: Khasia, Vladimer
Pubblicazione: (2026)
di: Khasia, Vladimer
Pubblicazione: (2026)
The Adaptive Vekua Cascade: A Differentiable Spectral-Analytic Solver for Physics-Informed Representation
di: Khasia, Vladimer
Pubblicazione: (2025)
di: Khasia, Vladimer
Pubblicazione: (2025)
DeepVekua: Geometric-Spectral Representation Learning for Physics-Informed Fields
di: Khasia, Vladimer
Pubblicazione: (2025)
di: Khasia, Vladimer
Pubblicazione: (2025)
The Vekua Layer: Exact Physical Priors for Implicit Neural Representations via Generalized Analytic Functions
di: Khasia, Vladimer
Pubblicazione: (2025)
di: Khasia, Vladimer
Pubblicazione: (2025)
Primal: A Unified Deterministic Framework for Quasi-Orthogonal Hashing and Manifold Learning
di: Khasia, Vladimer
Pubblicazione: (2025)
di: Khasia, Vladimer
Pubblicazione: (2025)
On-the-Fly Adaptive Distillation of Transformer to Dual-State Linear Attention
di: Ro, Yeonju, et al.
Pubblicazione: (2025)
di: Ro, Yeonju, et al.
Pubblicazione: (2025)
Blending Complementary Memory Systems in Hybrid Quadratic-Linear Transformers
di: Irie, Kazuki, et al.
Pubblicazione: (2025)
di: Irie, Kazuki, et al.
Pubblicazione: (2025)
Dual Path Attribution: Efficient Attribution for SwiGLU-Transformers through Layer-Wise Target Propagation
di: Jantsch, Lasse Marten, et al.
Pubblicazione: (2026)
di: Jantsch, Lasse Marten, et al.
Pubblicazione: (2026)
Cross-Architecture Transfer Learning for Linear-Cost Inference Transformers
di: Choi, Sehyun
Pubblicazione: (2024)
di: Choi, Sehyun
Pubblicazione: (2024)
EGMOF: Efficient Generation of Metal-Organic Frameworks Using a Hybrid Diffusion-Transformer Architecture
di: Han, Seunghee, et al.
Pubblicazione: (2025)
di: Han, Seunghee, et al.
Pubblicazione: (2025)
ZeroS: Zero-Sum Linear Attention for Efficient Transformers
di: Lu, Jiecheng, et al.
Pubblicazione: (2026)
di: Lu, Jiecheng, et al.
Pubblicazione: (2026)
Gated Linear Attention Transformers with Hardware-Efficient Training
di: Yang, Songlin, et al.
Pubblicazione: (2023)
di: Yang, Songlin, et al.
Pubblicazione: (2023)
The Dual-Stream Transformer: Channelized Architecture for Interpretable Language Modeling
di: Kerce, J. Clayton, et al.
Pubblicazione: (2026)
di: Kerce, J. Clayton, et al.
Pubblicazione: (2026)
AnchorGT: Efficient and Flexible Attention Architecture for Scalable Graph Transformers
di: Zhu, Wenhao, et al.
Pubblicazione: (2024)
di: Zhu, Wenhao, et al.
Pubblicazione: (2024)
Rethinking Transformer Connectivity: TLinFormer, A Path to Exact, Full Context-Aware Linear Attention
di: Tang, Zhongpan
Pubblicazione: (2025)
di: Tang, Zhongpan
Pubblicazione: (2025)
On Limitations of the Transformer Architecture
di: Peng, Binghui, et al.
Pubblicazione: (2024)
di: Peng, Binghui, et al.
Pubblicazione: (2024)
Ister: Linear Transformer for Efficient Multivariate Time Series Forecasting
di: Cao, Fanpu, et al.
Pubblicazione: (2024)
di: Cao, Fanpu, et al.
Pubblicazione: (2024)
In Transformer We Trust? A Perspective on Transformer Architecture Failure Modes
di: Mondal, Trishit, et al.
Pubblicazione: (2026)
di: Mondal, Trishit, et al.
Pubblicazione: (2026)
EDiT: Efficient Diffusion Transformers with Linear Compressed Attention
di: Becker, Philipp, et al.
Pubblicazione: (2025)
di: Becker, Philipp, et al.
Pubblicazione: (2025)
PPTNet: A Hybrid Periodic Pattern-Transformer Architecture for Traffic Flow Prediction and Congestion Identification
di: Kou, Hongrui, et al.
Pubblicazione: (2025)
di: Kou, Hongrui, et al.
Pubblicazione: (2025)
Learning a Fourier Transform for Linear Relative Positional Encodings in Transformers
di: Choromanski, Krzysztof Marcin, et al.
Pubblicazione: (2023)
di: Choromanski, Krzysztof Marcin, et al.
Pubblicazione: (2023)
Dual Filter: A Transformer-like Inference Architecture for Hidden Markov Models
di: Chang, Heng-Sheng, et al.
Pubblicazione: (2025)
di: Chang, Heng-Sheng, et al.
Pubblicazione: (2025)
Reducing the Transformer Architecture to a Minimum
di: Bermeitinger, Bernhard, et al.
Pubblicazione: (2024)
di: Bermeitinger, Bernhard, et al.
Pubblicazione: (2024)
Efficiently Transforming Neural Networks into Decision Trees: A Path to Ground Truth Explanations with RENTT
di: Monke, Helena, et al.
Pubblicazione: (2025)
di: Monke, Helena, et al.
Pubblicazione: (2025)
Hybrid Dynamic Pruning: A Pathway to Efficient Transformer Inference
di: Jaradat, Ghadeer, et al.
Pubblicazione: (2024)
di: Jaradat, Ghadeer, et al.
Pubblicazione: (2024)
Cottention: Linear Transformers With Cosine Attention
di: Mongaras, Gabriel, et al.
Pubblicazione: (2024)
di: Mongaras, Gabriel, et al.
Pubblicazione: (2024)
Linear Transformers are Versatile In-Context Learners
di: Vladymyrov, Max, et al.
Pubblicazione: (2024)
di: Vladymyrov, Max, et al.
Pubblicazione: (2024)
Generalized Linear Mode Connectivity for Transformers
di: Theus, Alexander, et al.
Pubblicazione: (2025)
di: Theus, Alexander, et al.
Pubblicazione: (2025)
Architecture Determines Observability of Transformers
di: Carmichael, Thomas
Pubblicazione: (2026)
di: Carmichael, Thomas
Pubblicazione: (2026)
EEG Emotion Classification Using an Enhanced Transformer-CNN-BiLSTM Architecture with Dual Attention Mechanisms
di: Karim, S M Rakib UI, et al.
Pubblicazione: (2026)
di: Karim, S M Rakib UI, et al.
Pubblicazione: (2026)
Spectral Journey: How Transformers Predict the Shortest Path
di: Cohen, Andrew, et al.
Pubblicazione: (2025)
di: Cohen, Andrew, et al.
Pubblicazione: (2025)
PDE-Transformer: Efficient and Versatile Transformers for Physics Simulations
di: Holzschuh, Benjamin, et al.
Pubblicazione: (2025)
di: Holzschuh, Benjamin, et al.
Pubblicazione: (2025)
Separations in the Representational Capabilities of Transformers and Recurrent Architectures
di: Bhattamishra, Satwik, et al.
Pubblicazione: (2024)
di: Bhattamishra, Satwik, et al.
Pubblicazione: (2024)
Approximation Rate of the Transformer Architecture for Sequence Modeling
di: Jiang, Haotian, et al.
Pubblicazione: (2023)
di: Jiang, Haotian, et al.
Pubblicazione: (2023)
Simple Path Structural Encoding for Graph Transformers
di: Airale, Louis, et al.
Pubblicazione: (2025)
di: Airale, Louis, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Spectral-Window Hybrid (SWH)
di: Khasia, Vladimer
Pubblicazione: (2026) -
Dynamic Subspace Composition: Efficient Adaptation via Contractive Basis Expansion
di: Khasia, Vladimer
Pubblicazione: (2025) -
HAS-VQ: Hessian-Adaptive Sparse Vector Quantization for High-Fidelity LLM Compression
di: Khasia, Vladimer
Pubblicazione: (2026) -
BASIS: Balanced Activation Sketching with Invariant Scalars for "Ghost Backpropagation"
di: Khasia, Vladimer
Pubblicazione: (2026) -
HoloByte: Continuous Hyperspherical Distillation for Tokenizer-Free Modeling
di: Khasia, Vladimer
Pubblicazione: (2026)