Mamba or Transformer for Time Series Forecasting? Mixture of Universals (MoU) Is All You Need
Fuente:
arXiv
Salvato in:
| Autori principali: | Peng, Sijia, Xiong, Yun, Zhu, Yangyong, Shen, Zhiqiang |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Attention Smoothing Is All You Need For Unlearning
di: Zade, Saleh Zare, et al.
Pubblicazione: (2026)
di: Zade, Saleh Zare, et al.
Pubblicazione: (2026)
Unified Training of Universal Time Series Forecasting Transformers
di: Woo, Gerald, et al.
Pubblicazione: (2024)
di: Woo, Gerald, et al.
Pubblicazione: (2024)
Attention Is All You Need for KV Cache in Diffusion LLMs
di: Nguyen-Tri, Quan, et al.
Pubblicazione: (2025)
di: Nguyen-Tri, Quan, et al.
Pubblicazione: (2025)
Wavelet Mixture of Experts for Time Series Forecasting
di: Zhou, Zheng, et al.
Pubblicazione: (2025)
di: Zhou, Zheng, et al.
Pubblicazione: (2025)
Seg-MoE: Multi-Resolution Segment-wise Mixture-of-Experts for Time Series Forecasting Transformers
di: Ortigossa, Evandro S., et al.
Pubblicazione: (2026)
di: Ortigossa, Evandro S., et al.
Pubblicazione: (2026)
ShapeCond: Fast Shapelet-Guided Dataset Condensation for Time Series Classification
di: Peng, Sijia, et al.
Pubblicazione: (2026)
di: Peng, Sijia, et al.
Pubblicazione: (2026)
MoFE-Time: Mixture of Frequency Domain Experts for Time-Series Forecasting Models
di: Liu, Yiwen, et al.
Pubblicazione: (2025)
di: Liu, Yiwen, et al.
Pubblicazione: (2025)
ms-Mamba: Multi-scale Mamba for Time-Series Forecasting
di: Karadag, Yusuf Meric, et al.
Pubblicazione: (2025)
di: Karadag, Yusuf Meric, et al.
Pubblicazione: (2025)
MoHETS: Long-term Time Series Forecasting with Mixture-of-Heterogeneous-Experts
di: Ortigossa, Evandro S., et al.
Pubblicazione: (2026)
di: Ortigossa, Evandro S., et al.
Pubblicazione: (2026)
MoGU: Mixture-of-Gaussians with Uncertainty-based Gating for Time Series Forecasting
di: Aviv, Gilad, et al.
Pubblicazione: (2025)
di: Aviv, Gilad, et al.
Pubblicazione: (2025)
DB2-TransF: All You Need Is Learnable Daubechies Wavelets for Time Series Forecasting
di: Gupta, Moulik, et al.
Pubblicazione: (2025)
di: Gupta, Moulik, et al.
Pubblicazione: (2025)
SST: Multi-Scale Hybrid Mamba-Transformer Experts for Time Series Forecasting
di: Xu, Xiongxiao, et al.
Pubblicazione: (2024)
di: Xu, Xiongxiao, et al.
Pubblicazione: (2024)
LeMoLE: LLM-Enhanced Mixture of Linear Experts for Time Series Forecasting
di: Zhang, Lingzheng, et al.
Pubblicazione: (2024)
di: Zhang, Lingzheng, et al.
Pubblicazione: (2024)
HTMformer: Hybrid Time and Multivariate Transformer for Time Series Forecasting
di: Wang, Tan, et al.
Pubblicazione: (2025)
di: Wang, Tan, et al.
Pubblicazione: (2025)
DMamba: Decomposition-enhanced Mamba for Time Series Forecasting
di: Chen, Ruxuan, et al.
Pubblicazione: (2026)
di: Chen, Ruxuan, et al.
Pubblicazione: (2026)
Sequential Order-Robust Mamba for Time Series Forecasting
di: Lee, Seunghan, et al.
Pubblicazione: (2024)
di: Lee, Seunghan, et al.
Pubblicazione: (2024)
A Mamba Foundation Model for Time Series Forecasting
di: Ma, Haoyu, et al.
Pubblicazione: (2024)
di: Ma, Haoyu, et al.
Pubblicazione: (2024)
MoDEx: Mixture of Depth-specific Experts for Multivariate Long-term Time Series Forecasting
di: Yoon, Hyekyung, et al.
Pubblicazione: (2026)
di: Yoon, Hyekyung, et al.
Pubblicazione: (2026)
STM3: Mixture of Multiscale Mamba for Long-Term Spatio-Temporal Time-Series Prediction
di: Chen, Haolong, et al.
Pubblicazione: (2025)
di: Chen, Haolong, et al.
Pubblicazione: (2025)
Attention is All You Need Until You Need Retention
di: Yaslioglu, M. Murat
Pubblicazione: (2025)
di: Yaslioglu, M. Murat
Pubblicazione: (2025)
WaveMoE: A Wavelet-Enhanced Mixture-of-Experts Foundation Model for Time Series Forecasting
di: Wu, Shunyu, et al.
Pubblicazione: (2026)
di: Wu, Shunyu, et al.
Pubblicazione: (2026)
Context is All You Need
di: Delanois, Jean Erik, et al.
Pubblicazione: (2026)
di: Delanois, Jean Erik, et al.
Pubblicazione: (2026)
Integration of Mamba and Transformer -- MAT for Long-Short Range Time Series Forecasting with Application to Weather Dynamics
di: Zhang, Wenqing, et al.
Pubblicazione: (2024)
di: Zhang, Wenqing, et al.
Pubblicazione: (2024)
MambaTS: Improved Selective State Space Models for Long-term Time Series Forecasting
di: Cai, Xiuding, et al.
Pubblicazione: (2024)
di: Cai, Xiuding, et al.
Pubblicazione: (2024)
Time-o1: Time-Series Forecasting Needs Transformed Label Alignment
di: Wang, Hao, et al.
Pubblicazione: (2025)
di: Wang, Hao, et al.
Pubblicazione: (2025)
ASGMamba: Adaptive Spectral Gating Mamba for Multivariate Time Series Forecasting
di: Li, Qianyang, et al.
Pubblicazione: (2026)
di: Li, Qianyang, et al.
Pubblicazione: (2026)
Small Graph Is All You Need: DeepStateGNN for Scalable Traffic Forecasting
di: Wölker, Yannick, et al.
Pubblicazione: (2025)
di: Wölker, Yannick, et al.
Pubblicazione: (2025)
Rethinking Time Encoding via Learnable Transformation Functions
di: Chen, Xi, et al.
Pubblicazione: (2025)
di: Chen, Xi, et al.
Pubblicazione: (2025)
HDT: Hierarchical Discrete Transformer for Multivariate Time Series Forecasting
di: Feng, Shibo, et al.
Pubblicazione: (2025)
di: Feng, Shibo, et al.
Pubblicazione: (2025)
Exploitation Is All You Need... for Exploration
di: Rentschler, Micah, et al.
Pubblicazione: (2025)
di: Rentschler, Micah, et al.
Pubblicazione: (2025)
AME-TS: Anchored Mixture-of-Experts for Time Series Forecasting
di: Wang, Rui, et al.
Pubblicazione: (2026)
di: Wang, Rui, et al.
Pubblicazione: (2026)
Mixture-of-Linear-Experts for Long-term Time Series Forecasting
di: Ni, Ronghao, et al.
Pubblicazione: (2023)
di: Ni, Ronghao, et al.
Pubblicazione: (2023)
The Residual Stream Is All You Need: On the Redundancy of the KV Cache in Transformer Inference
di: Qasim, Kaleem Ullah, et al.
Pubblicazione: (2026)
di: Qasim, Kaleem Ullah, et al.
Pubblicazione: (2026)
Hierarchical Information-Guided Spatio-Temporal Mamba for Stock Time Series Forecasting
di: Yan, Wenbo, et al.
Pubblicazione: (2025)
di: Yan, Wenbo, et al.
Pubblicazione: (2025)
Efficient Deep Learning Board: Training Feedback Is Not All You Need
di: Gong, Lina, et al.
Pubblicazione: (2024)
di: Gong, Lina, et al.
Pubblicazione: (2024)
Time-MoE: Billion-Scale Time Series Foundation Models with Mixture of Experts
di: Shi, Xiaoming, et al.
Pubblicazione: (2024)
di: Shi, Xiaoming, et al.
Pubblicazione: (2024)
All You Need Is Synthetic Task Augmentation
di: Godin, Guillaume
Pubblicazione: (2025)
di: Godin, Guillaume
Pubblicazione: (2025)
Element-wise Attention Is All You Need
di: Feng, Guoxin
Pubblicazione: (2025)
di: Feng, Guoxin
Pubblicazione: (2025)
VARMA-Enhanced Transformer for Time Series Forecasting
di: Song, Jiajun, et al.
Pubblicazione: (2025)
di: Song, Jiajun, et al.
Pubblicazione: (2025)
ISMRNN: An Implicitly Segmented RNN Method with Mamba for Long-Term Time Series Forecasting
di: Zhao, GaoXiang, et al.
Pubblicazione: (2024)
di: Zhao, GaoXiang, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Attention Smoothing Is All You Need For Unlearning
di: Zade, Saleh Zare, et al.
Pubblicazione: (2026) -
Unified Training of Universal Time Series Forecasting Transformers
di: Woo, Gerald, et al.
Pubblicazione: (2024) -
Attention Is All You Need for KV Cache in Diffusion LLMs
di: Nguyen-Tri, Quan, et al.
Pubblicazione: (2025) -
Wavelet Mixture of Experts for Time Series Forecasting
di: Zhou, Zheng, et al.
Pubblicazione: (2025) -
Seg-MoE: Multi-Resolution Segment-wise Mixture-of-Experts for Time Series Forecasting Transformers
di: Ortigossa, Evandro S., et al.
Pubblicazione: (2026)