Saved in:
| Main Authors: | Lin, Rui, Zhang, Yiwen, Peng, Zhicheng, Lyu, Minghao |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | https://arxiv.org/abs/2510.05285 |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
GPG: Generalized Policy Gradient Theorem for Transformer-based Policies
by: Mao, Hangyu, et al.
Published: (2025)
by: Mao, Hangyu, et al.
Published: (2025)
Online Finetuning Decision Transformers with Pure RL Gradients
by: Luo, Junkai, et al.
Published: (2026)
by: Luo, Junkai, et al.
Published: (2026)
Reinforcement Learning Gradients as Vitamin for Online Finetuning Decision Transformers
by: Yan, Kai, et al.
Published: (2024)
by: Yan, Kai, et al.
Published: (2024)
Generalized Policy Gradient with History-Aware Decision Transformer for Reliable Routing over Graph Signals
by: Wei, Xing, et al.
Published: (2025)
by: Wei, Xing, et al.
Published: (2025)
Generative Sequential Notification Optimization via Multi-Objective Decision Transformers
by: Ocejo, Borja, et al.
Published: (2025)
by: Ocejo, Borja, et al.
Published: (2025)
Attention Sinks Induce Gradient Sinks: Massive Activations as Gradient Regulators in Transformers
by: Chen, Yihong, et al.
Published: (2026)
by: Chen, Yihong, et al.
Published: (2026)
VAM: Verbalized Action Masking for Controllable Exploration in RL Post-Training -- A Chess Case Study
by: Zhang, Zhicheng, et al.
Published: (2026)
by: Zhang, Zhicheng, et al.
Published: (2026)
Adjusting Pretrained Backbones for Performativity
by: Demirel, Berker, et al.
Published: (2024)
by: Demirel, Berker, et al.
Published: (2024)
ACT: Empowering Decision Transformer with Dynamic Programming via Advantage Conditioning
by: Gao, Chen-Xiao, et al.
Published: (2023)
by: Gao, Chen-Xiao, et al.
Published: (2023)
Enhancing Output Diversity Improves Conjugate Gradient-based Adversarial Attacks
by: Yamamura, Keiichiro, et al.
Published: (2024)
by: Yamamura, Keiichiro, et al.
Published: (2024)
Vanilla Gradient Descent for Oblique Decision Trees
by: Panda, Subrat Prasad, et al.
Published: (2024)
by: Panda, Subrat Prasad, et al.
Published: (2024)
Policy Gradient for Robust Markov Decision Processes
by: Wang, Qiuhao, et al.
Published: (2024)
by: Wang, Qiuhao, et al.
Published: (2024)
Data Fusion-Enhanced Decision Transformer for Stable Cross-Domain Generalization
by: Wang, Guojian, et al.
Published: (2025)
by: Wang, Guojian, et al.
Published: (2025)
Ada-Diffuser: Latent-Aware Adaptive Diffusion for Decision-Making
by: Feng, Fan, et al.
Published: (2026)
by: Feng, Fan, et al.
Published: (2026)
MESA: Cooperative Meta-Exploration in Multi-Agent Learning through Exploiting State-Action Space Structure
by: Zhang, Zhicheng, et al.
Published: (2024)
by: Zhang, Zhicheng, et al.
Published: (2024)
UTBoost: Gradient Boosted Decision Trees for Uplift Modeling
by: Gao, Junjie, et al.
Published: (2023)
by: Gao, Junjie, et al.
Published: (2023)
Recurrent Action Transformer with Memory
by: Cherepanov, Egor, et al.
Published: (2023)
by: Cherepanov, Egor, et al.
Published: (2023)
Enhancing Transformer-based models for Long Sequence Time Series Forecasting via Structured Matrix
by: Zhang, Zhicheng, et al.
Published: (2024)
by: Zhang, Zhicheng, et al.
Published: (2024)
Adversarially Robust Decision Transformer
by: Tang, Xiaohang, et al.
Published: (2024)
by: Tang, Xiaohang, et al.
Published: (2024)
Gradients as an Action: Towards Communication-Efficient Federated Recommender Systems via Adaptive Action Sharing
by: Lu, Zhufeng, et al.
Published: (2025)
by: Lu, Zhufeng, et al.
Published: (2025)
Beyond the Known: Decision Making with Counterfactual Reasoning Decision Transformer
by: Nguyen, Minh Hoang, et al.
Published: (2025)
by: Nguyen, Minh Hoang, et al.
Published: (2025)
Policy Gradient Algorithms with Monte Carlo Tree Learning for Non-Markov Decision Processes
by: Morimura, Tetsuro, et al.
Published: (2022)
by: Morimura, Tetsuro, et al.
Published: (2022)
Physics-Informed Teleconnection-Aware Transformer for Global Subseasonal-to-Seasonal Forecasting
by: Lyu, Tengfei, et al.
Published: (2025)
by: Lyu, Tengfei, et al.
Published: (2025)
FlowPG: Action-constrained Policy Gradient with Normalizing Flows
by: Brahmanage, Janaka Chathuranga, et al.
Published: (2024)
by: Brahmanage, Janaka Chathuranga, et al.
Published: (2024)
Differential Adjusted Parity for Learning Fair Representations
by: Sahyouni, Bucher, et al.
Published: (2025)
by: Sahyouni, Bucher, et al.
Published: (2025)
Backpropagation-Free Metropolis-Adjusted Langevin Algorithm
by: Cobb, Adam D., et al.
Published: (2025)
by: Cobb, Adam D., et al.
Published: (2025)
Adjusting Regression Models for Conditional Uncertainty Calibration
by: Gao, Ruijiang, et al.
Published: (2024)
by: Gao, Ruijiang, et al.
Published: (2024)
Decision Transformer vs. Decision Mamba: Analysing the Complexity of Sequential Decision Making in Atari Games
by: Yan, Ke
Published: (2024)
by: Yan, Ke
Published: (2024)
Polynomial Expansion Rank Adaptation: Enhancing Low-Rank Fine-Tuning with High-Order Interactions
by: Zhang, Wenhao, et al.
Published: (2026)
by: Zhang, Wenhao, et al.
Published: (2026)
Score Function Gradient Estimation to Widen the Applicability of Decision-Focused Learning
by: Silvestri, Mattia, et al.
Published: (2023)
by: Silvestri, Mattia, et al.
Published: (2023)
GradTree: Learning Axis-Aligned Decision Trees with Gradient Descent
by: Marton, Sascha, et al.
Published: (2023)
by: Marton, Sascha, et al.
Published: (2023)
Transforming Multimodal Models into Action Models for Radiotherapy
by: Ferrante, Matteo, et al.
Published: (2025)
by: Ferrante, Matteo, et al.
Published: (2025)
Online Gradient Boosting Decision Tree: In-Place Updates for Efficient Adding/Deleting Data
by: Lin, Huawei, et al.
Published: (2025)
by: Lin, Huawei, et al.
Published: (2025)
When should we prefer Decision Transformers for Offline Reinforcement Learning?
by: Bhargava, Prajjwal, et al.
Published: (2023)
by: Bhargava, Prajjwal, et al.
Published: (2023)
Causal Learner: A Toolbox for Causal Structure and Markov Blanket Learning
by: Ling, Zhaolong, et al.
Published: (2021)
by: Ling, Zhaolong, et al.
Published: (2021)
A Learnable Wavelet Transformer for Long-Short Equity Trading and Risk-Adjusted Return Optimization
by: Li, Shuozhe, et al.
Published: (2026)
by: Li, Shuozhe, et al.
Published: (2026)
ALGAN: Time Series Anomaly Detection with Adjusted-LSTM GAN
by: Bashar, Md Abul, et al.
Published: (2023)
by: Bashar, Md Abul, et al.
Published: (2023)
NeuralGrok: Accelerate Grokking by Neural Gradient Transformation
by: Zhou, Xinyu, et al.
Published: (2025)
by: Zhou, Xinyu, et al.
Published: (2025)
Solving Continual Offline Reinforcement Learning with Decision Transformer
by: Huang, Kaixin, et al.
Published: (2024)
by: Huang, Kaixin, et al.
Published: (2024)
Uncertainty-Aware Decision Transformer for Stochastic Driving Environments
by: Li, Zenan, et al.
Published: (2023)
by: Li, Zenan, et al.
Published: (2023)
Similar Items
-
GPG: Generalized Policy Gradient Theorem for Transformer-based Policies
by: Mao, Hangyu, et al.
Published: (2025) -
Online Finetuning Decision Transformers with Pure RL Gradients
by: Luo, Junkai, et al.
Published: (2026) -
Reinforcement Learning Gradients as Vitamin for Online Finetuning Decision Transformers
by: Yan, Kai, et al.
Published: (2024) -
Generalized Policy Gradient with History-Aware Decision Transformer for Reliable Routing over Graph Signals
by: Wei, Xing, et al.
Published: (2025) -
Generative Sequential Notification Optimization via Multi-Objective Decision Transformers
by: Ocejo, Borja, et al.
Published: (2025)