The Effect of Depth on the Expressivity of Deep Linear State-Space Models
Fuente:
arXiv
Guardado en:
| Autores principales: | Bao, Zeyu, Yu, Penghao, Jiang, Haotian, Li, Qianxiao |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
InfoFlow: A Framework for Multi-Layer Transformer Analysis
por: Yu, Penghao, et al.
Publicado: (2026)
por: Yu, Penghao, et al.
Publicado: (2026)
The Effect of Attention Head Count on Transformer Approximation
por: Yu, Penghao, et al.
Publicado: (2025)
por: Yu, Penghao, et al.
Publicado: (2025)
Numerical Investigation of Sequence Modeling Theory using Controllable Memory Functions
por: Jiang, Haotian, et al.
Publicado: (2025)
por: Jiang, Haotian, et al.
Publicado: (2025)
Approximation Rate of the Transformer Architecture for Sequence Modeling
por: Jiang, Haotian, et al.
Publicado: (2023)
por: Jiang, Haotian, et al.
Publicado: (2023)
Allocation of Parameters in Transformers
por: Yu, Ruoxi, et al.
Publicado: (2025)
por: Yu, Ruoxi, et al.
Publicado: (2025)
From Generalization Analysis to Optimization Designs for State Space Models
por: Liu, Fusheng, et al.
Publicado: (2024)
por: Liu, Fusheng, et al.
Publicado: (2024)
Autocorrelation Matters: Understanding the Role of Initialization Schemes for State Space Models
por: Liu, Fusheng, et al.
Publicado: (2024)
por: Liu, Fusheng, et al.
Publicado: (2024)
RAM-Net: Expressive Linear Attention with Selectively Addressable Memory
por: Xiao, Kaicheng, et al.
Publicado: (2026)
por: Xiao, Kaicheng, et al.
Publicado: (2026)
StableSSM: Alleviating the Curse of Memory in State-space Models through Stable Reparameterization
por: Wang, Shida, et al.
Publicado: (2023)
por: Wang, Shida, et al.
Publicado: (2023)
The Role of Depth, Width, and Tree Size in Expressiveness of Deep Forest
por: Lyu, Shen-Huan, et al.
Publicado: (2024)
por: Lyu, Shen-Huan, et al.
Publicado: (2024)
Learning task-specific predictive models for scientific computing
por: Yin, Jianyuan, et al.
Publicado: (2025)
por: Yin, Jianyuan, et al.
Publicado: (2025)
On the Role of Depth in the Expressivity of RNNs
por: Lizaire, Maude, et al.
Publicado: (2026)
por: Lizaire, Maude, et al.
Publicado: (2026)
Deep learning and the rate of approximation by flows
por: Cheng, Jingpu, et al.
Publicado: (2026)
por: Cheng, Jingpu, et al.
Publicado: (2026)
Accelerating Legacy Numerical Solvers by Non-intrusive Gradient-based Meta-solving
por: Arisaka, Sohei, et al.
Publicado: (2024)
por: Arisaka, Sohei, et al.
Publicado: (2024)
Unifying back-propagation and forward-forward algorithms through model predictive control
por: Ren, Lianhai, et al.
Publicado: (2024)
por: Ren, Lianhai, et al.
Publicado: (2024)
DynGMA: a robust approach for learning stochastic differential equations from data
por: Zhu, Aiqing, et al.
Publicado: (2024)
por: Zhu, Aiqing, et al.
Publicado: (2024)
Learning Macroscopic Dynamics from Partial Microscopic Observations
por: Chen, Mengyi, et al.
Publicado: (2024)
por: Chen, Mengyi, et al.
Publicado: (2024)
On the Expressiveness of State Space Models via Temporal Logics
por: Alsmann, Eric, et al.
Publicado: (2026)
por: Alsmann, Eric, et al.
Publicado: (2026)
Continuity-Preserving Convolutional Autoencoders for Learning Continuous Latent Dynamical Models from Images
por: Zhu, Aiqing, et al.
Publicado: (2025)
por: Zhu, Aiqing, et al.
Publicado: (2025)
Taipan: Efficient and Expressive State Space Language Models with Selective Attention
por: Van Nguyen, Chien, et al.
Publicado: (2024)
por: Van Nguyen, Chien, et al.
Publicado: (2024)
On the Expressiveness and Length Generalization of Selective State-Space Models on Regular Languages
por: Terzić, Aleksandar, et al.
Publicado: (2024)
por: Terzić, Aleksandar, et al.
Publicado: (2024)
On Hypothesis Transfer Learning of Functional Linear Models
por: Lin, Haotian, et al.
Publicado: (2022)
por: Lin, Haotian, et al.
Publicado: (2022)
Kimi Linear: An Expressive, Efficient Attention Architecture
por: Kimi Team, et al.
Publicado: (2025)
por: Kimi Team, et al.
Publicado: (2025)
Structured Linear CDEs: Maximally Expressive and Parallel-in-Time Sequence Models
por: Walker, Benjamin, et al.
Publicado: (2025)
por: Walker, Benjamin, et al.
Publicado: (2025)
On the Expressive Power of GNNs to Solve Linear SDPs
por: Qian, Chendi, et al.
Publicado: (2026)
por: Qian, Chendi, et al.
Publicado: (2026)
Learning Permutation-invariant Macroscopic Dynamics
por: Han, Zhichao, et al.
Publicado: (2026)
por: Han, Zhichao, et al.
Publicado: (2026)
MambaVoiceCloning: Efficient and Expressive Text-to-Speech via State-Space Modeling and Diffusion Control
por: Kumar, Sahil, et al.
Publicado: (2026)
por: Kumar, Sahil, et al.
Publicado: (2026)
The Expressive Capacity of State Space Models: A Formal Language Perspective
por: Sarrof, Yash, et al.
Publicado: (2024)
por: Sarrof, Yash, et al.
Publicado: (2024)
Machine Unlearning under Retain-Forget Entanglement
por: Cheng, Jingpu, et al.
Publicado: (2026)
por: Cheng, Jingpu, et al.
Publicado: (2026)
Inverse Approximation Theory for Nonlinear Recurrent Neural Networks
por: Wang, Shida, et al.
Publicado: (2023)
por: Wang, Shida, et al.
Publicado: (2023)
Unfolding Target Detection with State Space Model
por: Yu, Luca Jiang-Tao, et al.
Publicado: (2024)
por: Yu, Luca Jiang-Tao, et al.
Publicado: (2024)
SeRpEnt: Selective Resampling for Expressive State Space Models
por: Rando, Stefano, et al.
Publicado: (2025)
por: Rando, Stefano, et al.
Publicado: (2025)
Are Expressive Models Truly Necessary for Offline RL?
por: Wang, Guan, et al.
Publicado: (2024)
por: Wang, Guan, et al.
Publicado: (2024)
Sparsity is Combinatorial Depth: Quantifying MoE Expressivity via Tropical Geometry
por: Su, Ye, et al.
Publicado: (2026)
por: Su, Ye, et al.
Publicado: (2026)
Latent Matters: Learning Deep State-Space Models
por: Klushyn, Alexej, et al.
Publicado: (2026)
por: Klushyn, Alexej, et al.
Publicado: (2026)
Pause Tokens Strictly Increase the Expressivity of Constant-Depth Transformers
por: London, Charles, et al.
Publicado: (2025)
por: London, Charles, et al.
Publicado: (2025)
On the Expressiveness of Rational ReLU Neural Networks With Bounded Depth
por: Averkov, Gennadiy, et al.
Publicado: (2025)
por: Averkov, Gennadiy, et al.
Publicado: (2025)
A Little Depth Goes a Long Way: The Expressive Power of Log-Depth Transformers
por: Merrill, William, et al.
Publicado: (2025)
por: Merrill, William, et al.
Publicado: (2025)
On the Expressive Power of Permutation-Equivariant Weight-Space Networks
por: Dayan, Adir, et al.
Publicado: (2026)
por: Dayan, Adir, et al.
Publicado: (2026)
Exploring Adversarial Robustness of Deep State Space Models
por: Qi, Biqing, et al.
Publicado: (2024)
por: Qi, Biqing, et al.
Publicado: (2024)
Ejemplares similares
-
InfoFlow: A Framework for Multi-Layer Transformer Analysis
por: Yu, Penghao, et al.
Publicado: (2026) -
The Effect of Attention Head Count on Transformer Approximation
por: Yu, Penghao, et al.
Publicado: (2025) -
Numerical Investigation of Sequence Modeling Theory using Controllable Memory Functions
por: Jiang, Haotian, et al.
Publicado: (2025) -
Approximation Rate of the Transformer Architecture for Sequence Modeling
por: Jiang, Haotian, et al.
Publicado: (2023) -
Allocation of Parameters in Transformers
por: Yu, Ruoxi, et al.
Publicado: (2025)