Linear Transformers as VAR Models: Aligning Autoregressive Attention Mechanisms with Autoregressive Forecasting
Fuente:
arXiv
Salvato in:
| Autori principali: | Lu, Jiecheng, Yang, Shihao |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
WAVE: Weighted Autoregressive Varying Gate for Time Series Forecasting
di: Lu, Jiecheng, et al.
Pubblicazione: (2024)
di: Lu, Jiecheng, et al.
Pubblicazione: (2024)
CAPS: Unifying Attention, Recurrence, and Alignment in Transformer-based Time Series Forecasting
di: Pati, Viresh, et al.
Pubblicazione: (2026)
di: Pati, Viresh, et al.
Pubblicazione: (2026)
ZeroS: Zero-Sum Linear Attention for Efficient Transformers
di: Lu, Jiecheng, et al.
Pubblicazione: (2026)
di: Lu, Jiecheng, et al.
Pubblicazione: (2026)
HyperMLP: An Integrated Perspective for Sequence Modeling
di: Lu, Jiecheng, et al.
Pubblicazione: (2026)
di: Lu, Jiecheng, et al.
Pubblicazione: (2026)
StretchTime: Adaptive Time Series Forecasting via Symplectic Attention
di: Kim, Yubin, et al.
Pubblicazione: (2026)
di: Kim, Yubin, et al.
Pubblicazione: (2026)
CATS: Enhancing Multivariate Time Series Forecasting by Constructing Auxiliary Time Series as Exogenous Variables
di: Lu, Jiecheng, et al.
Pubblicazione: (2024)
di: Lu, Jiecheng, et al.
Pubblicazione: (2024)
Free Energy Mixer
di: Lu, Jiecheng, et al.
Pubblicazione: (2026)
di: Lu, Jiecheng, et al.
Pubblicazione: (2026)
In-context Time Series Predictor
di: Lu, Jiecheng, et al.
Pubblicazione: (2024)
di: Lu, Jiecheng, et al.
Pubblicazione: (2024)
Beyond Similarity: Temporal Operator Attention for Time Series Analysis
di: Twitty, Jevon, et al.
Pubblicazione: (2026)
di: Twitty, Jevon, et al.
Pubblicazione: (2026)
AROpt: An Optimization Method for Autoregressive Time Series Forecasting
di: Li, Zheng, et al.
Pubblicazione: (2026)
di: Li, Zheng, et al.
Pubblicazione: (2026)
When Linear Attention Meets Autoregressive Decoding: Towards More Effective and Efficient Linearized Large Language Models
di: You, Haoran, et al.
Pubblicazione: (2024)
di: You, Haoran, et al.
Pubblicazione: (2024)
DEER: Draft with Diffusion, Verify with Autoregressive Models
di: Cheng, Zicong, et al.
Pubblicazione: (2025)
di: Cheng, Zicong, et al.
Pubblicazione: (2025)
KAIROS: Unified Training for Universal Non-Autoregressive Time Series Forecasting
di: Ding, Kuiye, et al.
Pubblicazione: (2025)
di: Ding, Kuiye, et al.
Pubblicazione: (2025)
Beyond Autoregressive RTG: Conditioning via Injection Outside Sequential Modeling in Decision Transformer
di: Wang, Yongyi, et al.
Pubblicazione: (2026)
di: Wang, Yongyi, et al.
Pubblicazione: (2026)
Incoherence in Goal-Conditioned Autoregressive Models
di: Karwowski, Jacek, et al.
Pubblicazione: (2025)
di: Karwowski, Jacek, et al.
Pubblicazione: (2025)
Numerical Pruning for Efficient Autoregressive Models
di: Shen, Xuan, et al.
Pubblicazione: (2024)
di: Shen, Xuan, et al.
Pubblicazione: (2024)
Discriminator Guidance for Autoregressive Diffusion Models
di: Kelvinius, Filip Ekström, et al.
Pubblicazione: (2023)
di: Kelvinius, Filip Ekström, et al.
Pubblicazione: (2023)
MARché: Fast Masked Autoregressive Image Generation with Cache-Aware Attention
di: Jiang, Chaoyi, et al.
Pubblicazione: (2025)
di: Jiang, Chaoyi, et al.
Pubblicazione: (2025)
Don't Retrain, Align: Adapting Autoregressive LMs to Diffusion LMs via Representation Alignment
di: Peng, Fred Zhangzhi, et al.
Pubblicazione: (2026)
di: Peng, Fred Zhangzhi, et al.
Pubblicazione: (2026)
Decentralized Autoregressive Generation
di: Maschan, Stepan, et al.
Pubblicazione: (2026)
di: Maschan, Stepan, et al.
Pubblicazione: (2026)
Learning to Solve Combinatorial Optimization under Positive Linear Constraints via Non-Autoregressive Neural Networks
di: Wang, Runzhong, et al.
Pubblicazione: (2024)
di: Wang, Runzhong, et al.
Pubblicazione: (2024)
Attention Drift: What Autoregressive Speculative Decoding Models Learn
di: Eldenk, Doğaç, et al.
Pubblicazione: (2026)
di: Eldenk, Doğaç, et al.
Pubblicazione: (2026)
HART: Efficient Visual Generation with Hybrid Autoregressive Transformer
di: Tang, Haotian, et al.
Pubblicazione: (2024)
di: Tang, Haotian, et al.
Pubblicazione: (2024)
AutoHFormer: Efficient Hierarchical Autoregressive Transformer for Time Series Prediction
di: Zhang, Qianru, et al.
Pubblicazione: (2025)
di: Zhang, Qianru, et al.
Pubblicazione: (2025)
Distilling Autoregressive Models to Obtain High-Performance Non-Autoregressive Solvers for Vehicle Routing Problems with Faster Inference Speed
di: Xiao, Yubin, et al.
Pubblicazione: (2023)
di: Xiao, Yubin, et al.
Pubblicazione: (2023)
Continuous Autoregressive Language Models
di: Shao, Chenze, et al.
Pubblicazione: (2025)
di: Shao, Chenze, et al.
Pubblicazione: (2025)
Block Diffusion: Interpolating Between Autoregressive and Diffusion Language Models
di: Arriola, Marianne, et al.
Pubblicazione: (2025)
di: Arriola, Marianne, et al.
Pubblicazione: (2025)
Advancing Sequential Numerical Prediction in Autoregressive Models
di: Fei, Xiang, et al.
Pubblicazione: (2025)
di: Fei, Xiang, et al.
Pubblicazione: (2025)
Compression Barriers for Autoregressive Transformers
di: Haris, Themistoklis, et al.
Pubblicazione: (2025)
di: Haris, Themistoklis, et al.
Pubblicazione: (2025)
Projected Autoregression: Autoregressive Language Generation in Continuous State Space
di: Naparstek, Oshri
Pubblicazione: (2026)
di: Naparstek, Oshri
Pubblicazione: (2026)
σ-GPTs: A New Approach to Autoregressive Models
di: Pannatier, Arnaud, et al.
Pubblicazione: (2024)
di: Pannatier, Arnaud, et al.
Pubblicazione: (2024)
M-STAR: Multi-Scale Spatiotemporal Autoregression for Human Mobility Modeling
di: Luo, Yuxiao, et al.
Pubblicazione: (2025)
di: Luo, Yuxiao, et al.
Pubblicazione: (2025)
Learning-Order Autoregressive Models with Application to Molecular Graph Generation
di: Wang, Zhe, et al.
Pubblicazione: (2025)
di: Wang, Zhe, et al.
Pubblicazione: (2025)
Evo: Autoregressive-Diffusion Large Language Models with Evolving Balance
di: Wu, Junde, et al.
Pubblicazione: (2026)
di: Wu, Junde, et al.
Pubblicazione: (2026)
Latent-DARM: Bridging Discrete Diffusion And Autoregressive Models For Reasoning
di: Berrayana, Lina, et al.
Pubblicazione: (2026)
di: Berrayana, Lina, et al.
Pubblicazione: (2026)
Step-Wise Refusal Dynamics in Autoregressive and Diffusion Language Models
di: Rahimi, Eliron, et al.
Pubblicazione: (2026)
di: Rahimi, Eliron, et al.
Pubblicazione: (2026)
SequenceMatch: Imitation Learning for Autoregressive Sequence Modelling with Backtracking
di: Cundy, Chris, et al.
Pubblicazione: (2023)
di: Cundy, Chris, et al.
Pubblicazione: (2023)
NEAT: Neighborhood-Guided, Efficient, Autoregressive Set Transformer for 3D Molecular Generation
di: Rose, Daniel, et al.
Pubblicazione: (2025)
di: Rose, Daniel, et al.
Pubblicazione: (2025)
Accelerating Inference of Discrete Autoregressive Normalizing Flows by Selective Jacobi Decoding
di: Zhang, Jiaru, et al.
Pubblicazione: (2025)
di: Zhang, Jiaru, et al.
Pubblicazione: (2025)
Autoregression-Free Neural Operators for Time-Dependent PDEs
di: Zhang, Jiaquan, et al.
Pubblicazione: (2026)
di: Zhang, Jiaquan, et al.
Pubblicazione: (2026)
Documenti analoghi
-
WAVE: Weighted Autoregressive Varying Gate for Time Series Forecasting
di: Lu, Jiecheng, et al.
Pubblicazione: (2024) -
CAPS: Unifying Attention, Recurrence, and Alignment in Transformer-based Time Series Forecasting
di: Pati, Viresh, et al.
Pubblicazione: (2026) -
ZeroS: Zero-Sum Linear Attention for Efficient Transformers
di: Lu, Jiecheng, et al.
Pubblicazione: (2026) -
HyperMLP: An Integrated Perspective for Sequence Modeling
di: Lu, Jiecheng, et al.
Pubblicazione: (2026) -
StretchTime: Adaptive Time Series Forecasting via Symplectic Attention
di: Kim, Yubin, et al.
Pubblicazione: (2026)