Longhorn: State Space Models are Amortized Online Learners
Fuente:
arXiv
Salvato in:
| Autori principali: | Liu, Bo, Wang, Rui, Wu, Lemeng, Feng, Yihao, Stone, Peter, Liu, Qiang |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Fine-Grained Gradient Restriction: A Simple Approach for Mitigating Catastrophic Forgetting
di: Liu, Bo, et al.
Pubblicazione: (2024)
di: Liu, Bo, et al.
Pubblicazione: (2024)
Amortized Control of Continuous State Space Feynman-Kac Model for Irregular Time Series
di: Park, Byoungwoo, et al.
Pubblicazione: (2024)
di: Park, Byoungwoo, et al.
Pubblicazione: (2024)
Simple Recipe Works: Vision-Language-Action Models are Natural Continual Learners with Reinforcement Learning
di: Hu, Jiaheng, et al.
Pubblicazione: (2026)
di: Hu, Jiaheng, et al.
Pubblicazione: (2026)
Conflict-Averse Gradient Descent for Multi-task Learning
di: Liu, Bo, et al.
Pubblicazione: (2021)
di: Liu, Bo, et al.
Pubblicazione: (2021)
Online Adaptation of Language Models with a Memory of Amortized Contexts
di: Tack, Jihoon, et al.
Pubblicazione: (2024)
di: Tack, Jihoon, et al.
Pubblicazione: (2024)
Mamba State-Space Models Are Lyapunov-Stable Learners
di: Halloran, John T., et al.
Pubblicazione: (2024)
di: Halloran, John T., et al.
Pubblicazione: (2024)
Learning Memory Mechanisms for Decision Making through Demonstrations
di: Yue, William, et al.
Pubblicazione: (2024)
di: Yue, William, et al.
Pubblicazione: (2024)
Language Rectified Flow: Advancing Diffusion Language Generation with Probabilistic Flows
di: Zhang, Shujian, et al.
Pubblicazione: (2024)
di: Zhang, Shujian, et al.
Pubblicazione: (2024)
Amortized Bayesian Multilevel Models
di: Habermann, Daniel, et al.
Pubblicazione: (2024)
di: Habermann, Daniel, et al.
Pubblicazione: (2024)
Amortized Bayesian Mixture Models
di: Kucharský, Šimon, et al.
Pubblicazione: (2025)
di: Kucharský, Šimon, et al.
Pubblicazione: (2025)
Communication Efficient Distributed Training with Distributed Lion
di: Liu, Bo, et al.
Pubblicazione: (2024)
di: Liu, Bo, et al.
Pubblicazione: (2024)
Amortized Multi-Objective Optimization Across Tasks with Generative Solution Modeling
di: Wei, Tingyang, et al.
Pubblicazione: (2025)
di: Wei, Tingyang, et al.
Pubblicazione: (2025)
Reliable and Efficient Amortized Model-based Evaluation
di: Truong, Sang, et al.
Pubblicazione: (2025)
di: Truong, Sang, et al.
Pubblicazione: (2025)
Amortized Bayesian Workflow
di: Li, Chengkun, et al.
Pubblicazione: (2024)
di: Li, Chengkun, et al.
Pubblicazione: (2024)
t-DGR: A Trajectory-Based Deep Generative Replay Method for Continual Learning in Decision Making
di: Yue, William, et al.
Pubblicazione: (2024)
di: Yue, William, et al.
Pubblicazione: (2024)
Testing and Improving the Robustness of Amortized Bayesian Inference for Cognitive Models
di: Wu, Yufei, et al.
Pubblicazione: (2024)
di: Wu, Yufei, et al.
Pubblicazione: (2024)
Memory-Efficient LLM Training with Online Subspace Descent
di: Liang, Kaizhao, et al.
Pubblicazione: (2024)
di: Liang, Kaizhao, et al.
Pubblicazione: (2024)
Amortized Probabilistic Detection of Communities in Graphs
di: Wang, Yueqi, et al.
Pubblicazione: (2020)
di: Wang, Yueqi, et al.
Pubblicazione: (2020)
MAP: Low-compute Model Merging with Amortized Pareto Fronts via Quadratic Approximation
di: Li, Lu, et al.
Pubblicazione: (2024)
di: Li, Lu, et al.
Pubblicazione: (2024)
Amortized Conditional Independence Testing
di: Duong, Bao, et al.
Pubblicazione: (2025)
di: Duong, Bao, et al.
Pubblicazione: (2025)
Learning Mamba as a Continual Learner: Meta-learning Selective State Space Models for Efficient Continual Learning
di: Zhao, Chongyang, et al.
Pubblicazione: (2024)
di: Zhao, Chongyang, et al.
Pubblicazione: (2024)
Graph Positional Autoencoders as Self-supervised Learners
di: Liu, Yang, et al.
Pubblicazione: (2025)
di: Liu, Yang, et al.
Pubblicazione: (2025)
Improving the Accuracy of Amortized Model Comparison with Self-Consistency
di: Kucharský, Šimon, et al.
Pubblicazione: (2025)
di: Kucharský, Šimon, et al.
Pubblicazione: (2025)
Improving the Accuracy of Amortized Model Comparison with Self-Consistency
di: Kucharský, Šimon, et al.
Pubblicazione: (2025)
di: Kucharský, Šimon, et al.
Pubblicazione: (2025)
Neural Methods for Amortized Inference
di: Zammit-Mangion, Andrew, et al.
Pubblicazione: (2024)
di: Zammit-Mangion, Andrew, et al.
Pubblicazione: (2024)
Amortized Active Learning for Nonparametric Functions
di: Li, Cen-You, et al.
Pubblicazione: (2024)
di: Li, Cen-You, et al.
Pubblicazione: (2024)
Amortized Variational Inference: When and Why?
di: Margossian, Charles C., et al.
Pubblicazione: (2023)
di: Margossian, Charles C., et al.
Pubblicazione: (2023)
Local Inverse Geometry Can Be Amortized
di: Kachhadiya, Aaditya L.
Pubblicazione: (2026)
di: Kachhadiya, Aaditya L.
Pubblicazione: (2026)
Amortized Active Generation of Pareto Sets
di: Steinberg, Daniel M., et al.
Pubblicazione: (2025)
di: Steinberg, Daniel M., et al.
Pubblicazione: (2025)
From Generalization Analysis to Optimization Designs for State Space Models
di: Liu, Fusheng, et al.
Pubblicazione: (2024)
di: Liu, Fusheng, et al.
Pubblicazione: (2024)
A State-Space Perspective on Modelling and Inference for Online Skill Rating
di: Duffield, Samuel, et al.
Pubblicazione: (2023)
di: Duffield, Samuel, et al.
Pubblicazione: (2023)
Diffusion Language Models are Super Data Learners
di: Ni, Jinjie, et al.
Pubblicazione: (2025)
di: Ni, Jinjie, et al.
Pubblicazione: (2025)
Amortized Inference of Causal Models via Conditional Fixed-Point Iterations
di: Mahajan, Divyat, et al.
Pubblicazione: (2024)
di: Mahajan, Divyat, et al.
Pubblicazione: (2024)
Amortized Predictability-aware Training Framework for Time Series Forecasting and Classification
di: Zhang, Xu, et al.
Pubblicazione: (2026)
di: Zhang, Xu, et al.
Pubblicazione: (2026)
Autocorrelation Matters: Understanding the Role of Initialization Schemes for State Space Models
di: Liu, Fusheng, et al.
Pubblicazione: (2024)
di: Liu, Fusheng, et al.
Pubblicazione: (2024)
Latent Geometry Beyond Search: Amortizing Planning in World Models
di: Nguyen, Hoang, et al.
Pubblicazione: (2026)
di: Nguyen, Hoang, et al.
Pubblicazione: (2026)
Deep Reinforcement Learning in Parameterized Action Space
di: Hausknecht, Matthew, et al.
Pubblicazione: (2015)
di: Hausknecht, Matthew, et al.
Pubblicazione: (2015)
Soft MPCritic: Amortized Model Predictive Value Iteration
di: Banker, Thomas, et al.
Pubblicazione: (2026)
di: Banker, Thomas, et al.
Pubblicazione: (2026)
Pushing the Boundaries of State Space Models for Image and Video Generation
di: Hong, Yicong, et al.
Pubblicazione: (2025)
di: Hong, Yicong, et al.
Pubblicazione: (2025)
Iterative Amortized Hierarchical VAE
di: Penninga, Simon W., et al.
Pubblicazione: (2026)
di: Penninga, Simon W., et al.
Pubblicazione: (2026)
Documenti analoghi
-
Fine-Grained Gradient Restriction: A Simple Approach for Mitigating Catastrophic Forgetting
di: Liu, Bo, et al.
Pubblicazione: (2024) -
Amortized Control of Continuous State Space Feynman-Kac Model for Irregular Time Series
di: Park, Byoungwoo, et al.
Pubblicazione: (2024) -
Simple Recipe Works: Vision-Language-Action Models are Natural Continual Learners with Reinforcement Learning
di: Hu, Jiaheng, et al.
Pubblicazione: (2026) -
Conflict-Averse Gradient Descent for Multi-task Learning
di: Liu, Bo, et al.
Pubblicazione: (2021) -
Online Adaptation of Language Models with a Memory of Amortized Contexts
di: Tack, Jihoon, et al.
Pubblicazione: (2024)