STAIRS-Former: Spatio-Temporal Attention with Interleaved Recursive Structure Transformer for Offline Multi-task Multi-agent Reinforcement Learning
Fuente:
arXiv
Saved in:
| Main Authors: | Jeon, Jiwon, Cho, Myungsik, Sung, Youngchul |
|---|---|
| Format: | Preprint |
| Published: |
2026
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Flow Matching with Injected Noise for Offline-to-Online Reinforcement Learning
by: Shin, Yongjae, et al.
Published: (2026)
by: Shin, Yongjae, et al.
Published: (2026)
Flow Actor-Critic for Offline Reinforcement Learning
by: Chae, Jongseong, et al.
Published: (2026)
by: Chae, Jongseong, et al.
Published: (2026)
Multi-Objective Reinforcement Learning with Max-Min Criterion: A Game-Theoretic Approach
by: Byeon, Woohyeon, et al.
Published: (2025)
by: Byeon, Woohyeon, et al.
Published: (2025)
Penalizing Infeasible Actions and Reward Scaling in Reinforcement Learning with Offline Data
by: Kim, Jeonghye, et al.
Published: (2025)
by: Kim, Jeonghye, et al.
Published: (2025)
GAMMA-Net: Adaptive Long-Horizon Traffic Spatio-Temporal Forecasting Model based on Interleaved Graph Attention and Multi-Axis Mamba
by: He, Dongyi, et al.
Published: (2026)
by: He, Dongyi, et al.
Published: (2026)
The Max-Min Formulation of Multi-Objective Reinforcement Learning: From Theory to a Model-Free Algorithm
by: Park, Giseung, et al.
Published: (2024)
by: Park, Giseung, et al.
Published: (2024)
A Recipe for Stable Offline Multi-agent Reinforcement Learning
by: Lee, Dongsu, et al.
Published: (2026)
by: Lee, Dongsu, et al.
Published: (2026)
Get Rid of Isolation: A Continuous Multi-task Spatio-Temporal Learning Framework
by: Yi, Zhongchao, et al.
Published: (2024)
by: Yi, Zhongchao, et al.
Published: (2024)
Diffusion Models for Offline Multi-agent Reinforcement Learning with Safety Constraints
by: Huang, Jianuo
Published: (2024)
by: Huang, Jianuo
Published: (2024)
Goal-Conditioned Decision Transformer for Multi-Goal Offline Reinforcement Learning
by: Gajewski, Paweł, et al.
Published: (2024)
by: Gajewski, Paweł, et al.
Published: (2024)
MarineFormer: A Spatio-Temporal Attention Model for USV Navigation in Dynamic Marine Environments
by: Kazemi, Ehsan, et al.
Published: (2024)
by: Kazemi, Ehsan, et al.
Published: (2024)
Adaptive Action Chunking via Multi-Chunk Q Value Estimation
by: Shin, Yongjae, et al.
Published: (2026)
by: Shin, Yongjae, et al.
Published: (2026)
MADiff: Offline Multi-agent Learning with Diffusion Models
by: Zhu, Zhengbang, et al.
Published: (2023)
by: Zhu, Zhengbang, et al.
Published: (2023)
Guiding Multi-agent Multi-task Reinforcement Learning by a Hierarchical Framework with Logical Reward Shaping
by: Liu, Chanjuan, et al.
Published: (2024)
by: Liu, Chanjuan, et al.
Published: (2024)
Task-Aware Harmony Multi-Task Decision Transformer for Offline Reinforcement Learning
by: Fan, Ziqing, et al.
Published: (2024)
by: Fan, Ziqing, et al.
Published: (2024)
Soft Conflict-Resolution Decision Transformer for Offline Multi-Task Reinforcement Learning
by: Wang, Shudong, et al.
Published: (2025)
by: Wang, Shudong, et al.
Published: (2025)
Rethinking Spatio-Temporal Transformer for Traffic Prediction:Multi-level Multi-view Augmented Learning Framework
by: Lin, Jiaqi, et al.
Published: (2024)
by: Lin, Jiaqi, et al.
Published: (2024)
Offline Multi-task Transfer RL with Representational Penalization
by: Bose, Avinandan, et al.
Published: (2024)
by: Bose, Avinandan, et al.
Published: (2024)
STAS: Spatial-Temporal Return Decomposition for Multi-agent Reinforcement Learning
by: Chen, Sirui, et al.
Published: (2023)
by: Chen, Sirui, et al.
Published: (2023)
Temporal Logic Specification-Conditioned Decision Transformer for Offline Safe Reinforcement Learning
by: Guo, Zijian, et al.
Published: (2024)
by: Guo, Zijian, et al.
Published: (2024)
Sim-MSTNet: sim2real based Multi-task SpatioTemporal Network Traffic Forecasting
by: Ma, Hui, et al.
Published: (2026)
by: Ma, Hui, et al.
Published: (2026)
Offline-to-Online Multi-Agent Reinforcement Learning with Offline Value Function Memory and Sequential Exploration
by: Zhong, Hai, et al.
Published: (2024)
by: Zhong, Hai, et al.
Published: (2024)
Towards Multi-agent Reinforcement Learning based Traffic Signal Control through Spatio-temporal Hypergraphs
by: Wang, Kang, et al.
Published: (2024)
by: Wang, Kang, et al.
Published: (2024)
Variational Offline Multi-agent Skill Discovery
by: Chen, Jiayu, et al.
Published: (2024)
by: Chen, Jiayu, et al.
Published: (2024)
SQL-Trail: Multi-Turn Reinforcement Learning with Interleaved Feedback for Text-to-SQL
by: Hua, Harper, et al.
Published: (2026)
by: Hua, Harper, et al.
Published: (2026)
Policy-regularized Offline Multi-objective Reinforcement Learning
by: Lin, Qian, et al.
Published: (2024)
by: Lin, Qian, et al.
Published: (2024)
Multi-action Tangled Program Graphs for Multi-task Reinforcement Learning with Continuous Control
by: Vacher, Quentin, et al.
Published: (2026)
by: Vacher, Quentin, et al.
Published: (2026)
STARN-GAT: A Multi-Modal Spatio-Temporal Graph Attention Network for Accident Severity Prediction
by: Nobin, Pritom Ray, et al.
Published: (2025)
by: Nobin, Pritom Ray, et al.
Published: (2025)
TFWaveFormer: Temporal-Frequency Collaborative Multi-level Wavelet Transformer for Dynamic Link Prediction
by: Feng, Hantong, et al.
Published: (2026)
by: Feng, Hantong, et al.
Published: (2026)
Sparsity-based Safety Conservatism for Constrained Offline Reinforcement Learning
by: Cho, Minjae, et al.
Published: (2024)
by: Cho, Minjae, et al.
Published: (2024)
Align While Search: Belief-Guided Exploratory Inference for World-Grounded Embodied Agents
by: Bae, Seohui, et al.
Published: (2025)
by: Bae, Seohui, et al.
Published: (2025)
An Offline Adaptation Framework for Constrained Multi-Objective Reinforcement Learning
by: Lin, Qian, et al.
Published: (2024)
by: Lin, Qian, et al.
Published: (2024)
Offline Reinforcement Learning for LLM Multi-Step Reasoning
by: Wang, Huaijie, et al.
Published: (2024)
by: Wang, Huaijie, et al.
Published: (2024)
DenseMTL: Cross-task Attention Mechanism for Dense Multi-task Learning
by: Lopes, Ivan, et al.
Published: (2022)
by: Lopes, Ivan, et al.
Published: (2022)
Heterogeneous Multi-Agent Reinforcement Learning with Attention for Cooperative and Scalable Feature Transformation
by: Zhe, Tao, et al.
Published: (2025)
by: Zhe, Tao, et al.
Published: (2025)
Model-Based Reinforcement Learning with Multi-Task Offline Pretraining
by: Pan, Minting, et al.
Published: (2023)
by: Pan, Minting, et al.
Published: (2023)
Reward Dimension Reduction for Scalable Multi-Objective Reinforcement Learning
by: Park, Giseung, et al.
Published: (2025)
by: Park, Giseung, et al.
Published: (2025)
Multi-modal Spatio-Temporal Transformer for High-resolution Land Subsidence Prediction
by: Yao, Wendong, et al.
Published: (2025)
by: Yao, Wendong, et al.
Published: (2025)
Goal-Oriented Skill Abstraction for Offline Multi-Task Reinforcement Learning
by: He, Jinmin, et al.
Published: (2025)
by: He, Jinmin, et al.
Published: (2025)
FairDICE: Fairness-Driven Offline Multi-Objective Reinforcement Learning
by: Kim, Woosung, et al.
Published: (2025)
by: Kim, Woosung, et al.
Published: (2025)
Similar Items
-
Flow Matching with Injected Noise for Offline-to-Online Reinforcement Learning
by: Shin, Yongjae, et al.
Published: (2026) -
Flow Actor-Critic for Offline Reinforcement Learning
by: Chae, Jongseong, et al.
Published: (2026) -
Multi-Objective Reinforcement Learning with Max-Min Criterion: A Game-Theoretic Approach
by: Byeon, Woohyeon, et al.
Published: (2025) -
Penalizing Infeasible Actions and Reward Scaling in Reinforcement Learning with Offline Data
by: Kim, Jeonghye, et al.
Published: (2025) -
GAMMA-Net: Adaptive Long-Horizon Traffic Spatio-Temporal Forecasting Model based on Interleaved Graph Attention and Multi-Axis Mamba
by: He, Dongyi, et al.
Published: (2026)