Decision MetaMamba: Enhancing Selective SSM in Offline RL with Heterogeneous Sequence Mixing
Fuente:
arXiv
Salvato in:
| Autori principali: | Kim, Wall, Song, Chaeyoung, Kim, Hanul |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Decision MetaMamba: Enhancing Selective SSM in Offline RL with Heterogeneous Sequence Mixing
di: Kim, Wall, et al.
Pubblicazione: (2026)
di: Kim, Wall, et al.
Pubblicazione: (2026)
MultiModalPFN: Extending Prior-Data Fitted Networks for Multimodal Tabular Learning
di: Kim, Wall, et al.
Pubblicazione: (2026)
di: Kim, Wall, et al.
Pubblicazione: (2026)
DEAS: DEtached value learning with Action Sequence for Scalable Offline RL
di: Kim, Changyeon, et al.
Pubblicazione: (2025)
di: Kim, Changyeon, et al.
Pubblicazione: (2025)
Diffusion-Based Offline RL for Improved Decision-Making in Augmented ARC Task
di: Kim, Yunho, et al.
Pubblicazione: (2024)
di: Kim, Yunho, et al.
Pubblicazione: (2024)
Selective Uncertainty Propagation in Offline RL
di: Krishnamurthy, Sanath Kumar, et al.
Pubblicazione: (2023)
di: Krishnamurthy, Sanath Kumar, et al.
Pubblicazione: (2023)
Decision Mamba: Reinforcement Learning via Sequence Modeling with Selective State Spaces
di: Ota, Toshihiro
Pubblicazione: (2024)
di: Ota, Toshihiro
Pubblicazione: (2024)
Decoupled Prioritized Resampling for Offline RL
di: Yue, Yang, et al.
Pubblicazione: (2023)
di: Yue, Yang, et al.
Pubblicazione: (2023)
Toward Explainable Offline RL: Analyzing Representations in Intrinsically Motivated Decision Transformers
di: Guiducci, Leonardo, et al.
Pubblicazione: (2025)
di: Guiducci, Leonardo, et al.
Pubblicazione: (2025)
Budgeting Counterfactual for Offline RL
di: Liu, Yao, et al.
Pubblicazione: (2023)
di: Liu, Yao, et al.
Pubblicazione: (2023)
MambaLRP: Explaining Selective State Space Sequence Models
di: Jafari, Farnoush Rezaei, et al.
Pubblicazione: (2024)
di: Jafari, Farnoush Rezaei, et al.
Pubblicazione: (2024)
Mamba: Linear-Time Sequence Modeling with Selective State Spaces
di: Gu, Albert, et al.
Pubblicazione: (2023)
di: Gu, Albert, et al.
Pubblicazione: (2023)
Augmenting Offline RL with Unlabeled Data
di: Wang, Zhao, et al.
Pubblicazione: (2024)
di: Wang, Zhao, et al.
Pubblicazione: (2024)
An Empirical Study on the Effectiveness of Incorporating Offline RL As Online RL Subroutines
di: Su, Jianhai, et al.
Pubblicazione: (2025)
di: Su, Jianhai, et al.
Pubblicazione: (2025)
Policy Agnostic RL: Offline RL and Online RL Fine-Tuning of Any Class and Backbone
di: Mark, Max Sobol, et al.
Pubblicazione: (2024)
di: Mark, Max Sobol, et al.
Pubblicazione: (2024)
Decision Mamba Architectures
di: Correia, André, et al.
Pubblicazione: (2024)
di: Correia, André, et al.
Pubblicazione: (2024)
Are Expressive Models Truly Necessary for Offline RL?
di: Wang, Guan, et al.
Pubblicazione: (2024)
di: Wang, Guan, et al.
Pubblicazione: (2024)
OGBench: Benchmarking Offline Goal-Conditioned RL
di: Park, Seohong, et al.
Pubblicazione: (2024)
di: Park, Seohong, et al.
Pubblicazione: (2024)
A Tractable Inference Perspective of Offline RL
di: Liu, Xuejie, et al.
Pubblicazione: (2023)
di: Liu, Xuejie, et al.
Pubblicazione: (2023)
Design Considerations in Offline Preference-based RL
di: Agarwal, Alekh, et al.
Pubblicazione: (2025)
di: Agarwal, Alekh, et al.
Pubblicazione: (2025)
GAS: Enhancing Reward-Cost Balance of Generative Model-assisted Offline Safe RL
di: Liu, Zifan, et al.
Pubblicazione: (2026)
di: Liu, Zifan, et al.
Pubblicazione: (2026)
MambaSL: Exploring Single-Layer Mamba for Time Series Classification
di: Jung, Yoo-Min, et al.
Pubblicazione: (2026)
di: Jung, Yoo-Min, et al.
Pubblicazione: (2026)
Graph-Mamba: Towards Long-Range Graph Sequence Modeling with Selective State Spaces
di: Wang, Chloe, et al.
Pubblicazione: (2024)
di: Wang, Chloe, et al.
Pubblicazione: (2024)
Offline Multi-task Transfer RL with Representational Penalization
di: Bose, Avinandan, et al.
Pubblicazione: (2024)
di: Bose, Avinandan, et al.
Pubblicazione: (2024)
Is Value Learning Really the Main Bottleneck in Offline RL?
di: Park, Seohong, et al.
Pubblicazione: (2024)
di: Park, Seohong, et al.
Pubblicazione: (2024)
The Role of Deep Learning Regularizations on Actors in Offline RL
di: Tarasov, Denis, et al.
Pubblicazione: (2024)
di: Tarasov, Denis, et al.
Pubblicazione: (2024)
Yes, Q-learning Helps Offline In-Context RL
di: Tarasov, Denis, et al.
Pubblicazione: (2025)
di: Tarasov, Denis, et al.
Pubblicazione: (2025)
Scalable Offline Model-Based RL with Action Chunks
di: Park, Kwanyoung, et al.
Pubblicazione: (2025)
di: Park, Kwanyoung, et al.
Pubblicazione: (2025)
Compositional Conservatism: A Transductive Approach in Offline Reinforcement Learning
di: Song, Yeda, et al.
Pubblicazione: (2024)
di: Song, Yeda, et al.
Pubblicazione: (2024)
SpoT-Mamba: Learning Long-Range Dependency on Spatio-Temporal Graphs with Selective State Spaces
di: Choi, Jinhyeok, et al.
Pubblicazione: (2024)
di: Choi, Jinhyeok, et al.
Pubblicazione: (2024)
A KL Lens on Quantization: Fast, Forward-Only Sensitivity for Mixed-Precision SSM-Transformer Models
di: Kong, Jason, et al.
Pubblicazione: (2026)
di: Kong, Jason, et al.
Pubblicazione: (2026)
On The Statistical Complexity of Offline Decision-Making
di: Nguyen-Tang, Thanh, et al.
Pubblicazione: (2025)
di: Nguyen-Tang, Thanh, et al.
Pubblicazione: (2025)
Integrating Domain Knowledge for handling Limited Data in Offline RL
di: Gangopadhyay, Briti, et al.
Pubblicazione: (2024)
di: Gangopadhyay, Briti, et al.
Pubblicazione: (2024)
Offline RLAIF: Piloting VLM Feedback for RL via SFO
di: Beck, Jacob
Pubblicazione: (2025)
di: Beck, Jacob
Pubblicazione: (2025)
Dual Alignment Maximin Optimization for Offline Model-based RL
di: Zhou, Chi, et al.
Pubblicazione: (2025)
di: Zhou, Chi, et al.
Pubblicazione: (2025)
Explaining RL Decisions with Trajectories
di: Deshmukh, Shripad Vilasrao, et al.
Pubblicazione: (2023)
di: Deshmukh, Shripad Vilasrao, et al.
Pubblicazione: (2023)
Bridging Domain Gaps with Target-Aligned Generation for Offline Reinforcement Learning
di: Kim, Minung, et al.
Pubblicazione: (2026)
di: Kim, Minung, et al.
Pubblicazione: (2026)
Language-Conditioned Offline RL for Multi-Robot Navigation
di: Morad, Steven, et al.
Pubblicazione: (2024)
di: Morad, Steven, et al.
Pubblicazione: (2024)
Repetitive Contrastive Learning Enhances Mamba's Selectivity in Time Series Prediction
di: Yan, Wenbo, et al.
Pubblicazione: (2025)
di: Yan, Wenbo, et al.
Pubblicazione: (2025)
RL$^3$: Boosting Meta Reinforcement Learning via RL inside RL$^2$
di: Bhatia, Abhinav, et al.
Pubblicazione: (2023)
di: Bhatia, Abhinav, et al.
Pubblicazione: (2023)
Action-Free Offline-to-Online RL via Discretised State Policies
di: Neggatu, Natinael Solomon, et al.
Pubblicazione: (2026)
di: Neggatu, Natinael Solomon, et al.
Pubblicazione: (2026)
Documenti analoghi
-
Decision MetaMamba: Enhancing Selective SSM in Offline RL with Heterogeneous Sequence Mixing
di: Kim, Wall, et al.
Pubblicazione: (2026) -
MultiModalPFN: Extending Prior-Data Fitted Networks for Multimodal Tabular Learning
di: Kim, Wall, et al.
Pubblicazione: (2026) -
DEAS: DEtached value learning with Action Sequence for Scalable Offline RL
di: Kim, Changyeon, et al.
Pubblicazione: (2025) -
Diffusion-Based Offline RL for Improved Decision-Making in Augmented ARC Task
di: Kim, Yunho, et al.
Pubblicazione: (2024) -
Selective Uncertainty Propagation in Offline RL
di: Krishnamurthy, Sanath Kumar, et al.
Pubblicazione: (2023)