Adjusting the Output of Decision Transformer with Action Gradient
Fuente:
arXiv
Salvato in:
| Autori principali: | Lin, Rui, Zhang, Yiwen, Peng, Zhicheng, Lyu, Minghao |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Online Finetuning Decision Transformers with Pure RL Gradients
di: Luo, Junkai, et al.
Pubblicazione: (2026)
di: Luo, Junkai, et al.
Pubblicazione: (2026)
GPG: Generalized Policy Gradient Theorem for Transformer-based Policies
di: Mao, Hangyu, et al.
Pubblicazione: (2025)
di: Mao, Hangyu, et al.
Pubblicazione: (2025)
Reinforcement Learning Gradients as Vitamin for Online Finetuning Decision Transformers
di: Yan, Kai, et al.
Pubblicazione: (2024)
di: Yan, Kai, et al.
Pubblicazione: (2024)
Generalized Policy Gradient with History-Aware Decision Transformer for Reliable Routing over Graph Signals
di: Wei, Xing, et al.
Pubblicazione: (2025)
di: Wei, Xing, et al.
Pubblicazione: (2025)
Attention Sinks Induce Gradient Sinks: Massive Activations as Gradient Regulators in Transformers
di: Chen, Yihong, et al.
Pubblicazione: (2026)
di: Chen, Yihong, et al.
Pubblicazione: (2026)
Generative Sequential Notification Optimization via Multi-Objective Decision Transformers
di: Ocejo, Borja, et al.
Pubblicazione: (2025)
di: Ocejo, Borja, et al.
Pubblicazione: (2025)
Adjusting Pretrained Backbones for Performativity
di: Demirel, Berker, et al.
Pubblicazione: (2024)
di: Demirel, Berker, et al.
Pubblicazione: (2024)
ACT: Empowering Decision Transformer with Dynamic Programming via Advantage Conditioning
di: Gao, Chen-Xiao, et al.
Pubblicazione: (2023)
di: Gao, Chen-Xiao, et al.
Pubblicazione: (2023)
Enhancing Output Diversity Improves Conjugate Gradient-based Adversarial Attacks
di: Yamamura, Keiichiro, et al.
Pubblicazione: (2024)
di: Yamamura, Keiichiro, et al.
Pubblicazione: (2024)
VAM: Verbalized Action Masking for Controllable Exploration in RL Post-Training -- A Chess Case Study
di: Zhang, Zhicheng, et al.
Pubblicazione: (2026)
di: Zhang, Zhicheng, et al.
Pubblicazione: (2026)
Vanilla Gradient Descent for Oblique Decision Trees
di: Panda, Subrat Prasad, et al.
Pubblicazione: (2024)
di: Panda, Subrat Prasad, et al.
Pubblicazione: (2024)
Policy Gradient for Robust Markov Decision Processes
di: Wang, Qiuhao, et al.
Pubblicazione: (2024)
di: Wang, Qiuhao, et al.
Pubblicazione: (2024)
Data Fusion-Enhanced Decision Transformer for Stable Cross-Domain Generalization
di: Wang, Guojian, et al.
Pubblicazione: (2025)
di: Wang, Guojian, et al.
Pubblicazione: (2025)
UTBoost: Gradient Boosted Decision Trees for Uplift Modeling
di: Gao, Junjie, et al.
Pubblicazione: (2023)
di: Gao, Junjie, et al.
Pubblicazione: (2023)
Recurrent Action Transformer with Memory
di: Cherepanov, Egor, et al.
Pubblicazione: (2023)
di: Cherepanov, Egor, et al.
Pubblicazione: (2023)
Adversarially Robust Decision Transformer
di: Tang, Xiaohang, et al.
Pubblicazione: (2024)
di: Tang, Xiaohang, et al.
Pubblicazione: (2024)
Gradients as an Action: Towards Communication-Efficient Federated Recommender Systems via Adaptive Action Sharing
di: Lu, Zhufeng, et al.
Pubblicazione: (2025)
di: Lu, Zhufeng, et al.
Pubblicazione: (2025)
Beyond the Known: Decision Making with Counterfactual Reasoning Decision Transformer
di: Nguyen, Minh Hoang, et al.
Pubblicazione: (2025)
di: Nguyen, Minh Hoang, et al.
Pubblicazione: (2025)
Policy Gradient Algorithms with Monte Carlo Tree Learning for Non-Markov Decision Processes
di: Morimura, Tetsuro, et al.
Pubblicazione: (2022)
di: Morimura, Tetsuro, et al.
Pubblicazione: (2022)
FlowPG: Action-constrained Policy Gradient with Normalizing Flows
di: Brahmanage, Janaka Chathuranga, et al.
Pubblicazione: (2024)
di: Brahmanage, Janaka Chathuranga, et al.
Pubblicazione: (2024)
Ada-Diffuser: Latent-Aware Adaptive Diffusion for Decision-Making
di: Feng, Fan, et al.
Pubblicazione: (2026)
di: Feng, Fan, et al.
Pubblicazione: (2026)
Decision Transformer vs. Decision Mamba: Analysing the Complexity of Sequential Decision Making in Atari Games
di: Yan, Ke
Pubblicazione: (2024)
di: Yan, Ke
Pubblicazione: (2024)
Enhancing Transformer-based models for Long Sequence Time Series Forecasting via Structured Matrix
di: Zhang, Zhicheng, et al.
Pubblicazione: (2024)
di: Zhang, Zhicheng, et al.
Pubblicazione: (2024)
Physics-Informed Teleconnection-Aware Transformer for Global Subseasonal-to-Seasonal Forecasting
di: Lyu, Tengfei, et al.
Pubblicazione: (2025)
di: Lyu, Tengfei, et al.
Pubblicazione: (2025)
Differential Adjusted Parity for Learning Fair Representations
di: Sahyouni, Bucher, et al.
Pubblicazione: (2025)
di: Sahyouni, Bucher, et al.
Pubblicazione: (2025)
Backpropagation-Free Metropolis-Adjusted Langevin Algorithm
di: Cobb, Adam D., et al.
Pubblicazione: (2025)
di: Cobb, Adam D., et al.
Pubblicazione: (2025)
Adjusting Regression Models for Conditional Uncertainty Calibration
di: Gao, Ruijiang, et al.
Pubblicazione: (2024)
di: Gao, Ruijiang, et al.
Pubblicazione: (2024)
Score Function Gradient Estimation to Widen the Applicability of Decision-Focused Learning
di: Silvestri, Mattia, et al.
Pubblicazione: (2023)
di: Silvestri, Mattia, et al.
Pubblicazione: (2023)
GradTree: Learning Axis-Aligned Decision Trees with Gradient Descent
di: Marton, Sascha, et al.
Pubblicazione: (2023)
di: Marton, Sascha, et al.
Pubblicazione: (2023)
MESA: Cooperative Meta-Exploration in Multi-Agent Learning through Exploiting State-Action Space Structure
di: Zhang, Zhicheng, et al.
Pubblicazione: (2024)
di: Zhang, Zhicheng, et al.
Pubblicazione: (2024)
Transforming Multimodal Models into Action Models for Radiotherapy
di: Ferrante, Matteo, et al.
Pubblicazione: (2025)
di: Ferrante, Matteo, et al.
Pubblicazione: (2025)
When should we prefer Decision Transformers for Offline Reinforcement Learning?
di: Bhargava, Prajjwal, et al.
Pubblicazione: (2023)
di: Bhargava, Prajjwal, et al.
Pubblicazione: (2023)
Polynomial Expansion Rank Adaptation: Enhancing Low-Rank Fine-Tuning with High-Order Interactions
di: Zhang, Wenhao, et al.
Pubblicazione: (2026)
di: Zhang, Wenhao, et al.
Pubblicazione: (2026)
NeuralGrok: Accelerate Grokking by Neural Gradient Transformation
di: Zhou, Xinyu, et al.
Pubblicazione: (2025)
di: Zhou, Xinyu, et al.
Pubblicazione: (2025)
ALGAN: Time Series Anomaly Detection with Adjusted-LSTM GAN
di: Bashar, Md Abul, et al.
Pubblicazione: (2023)
di: Bashar, Md Abul, et al.
Pubblicazione: (2023)
Solving Continual Offline Reinforcement Learning with Decision Transformer
di: Huang, Kaixin, et al.
Pubblicazione: (2024)
di: Huang, Kaixin, et al.
Pubblicazione: (2024)
Uncertainty-Aware Decision Transformer for Stochastic Driving Environments
di: Li, Zenan, et al.
Pubblicazione: (2023)
di: Li, Zenan, et al.
Pubblicazione: (2023)
Off-OAB: Off-Policy Policy Gradient Method with Optimal Action-Dependent Baseline
di: Meng, Wenjia, et al.
Pubblicazione: (2024)
di: Meng, Wenjia, et al.
Pubblicazione: (2024)
Online Gradient Boosting Decision Tree: In-Place Updates for Efficient Adding/Deleting Data
di: Lin, Huawei, et al.
Pubblicazione: (2025)
di: Lin, Huawei, et al.
Pubblicazione: (2025)
Soft Conflict-Resolution Decision Transformer for Offline Multi-Task Reinforcement Learning
di: Wang, Shudong, et al.
Pubblicazione: (2025)
di: Wang, Shudong, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Online Finetuning Decision Transformers with Pure RL Gradients
di: Luo, Junkai, et al.
Pubblicazione: (2026) -
GPG: Generalized Policy Gradient Theorem for Transformer-based Policies
di: Mao, Hangyu, et al.
Pubblicazione: (2025) -
Reinforcement Learning Gradients as Vitamin for Online Finetuning Decision Transformers
di: Yan, Kai, et al.
Pubblicazione: (2024) -
Generalized Policy Gradient with History-Aware Decision Transformer for Reliable Routing over Graph Signals
di: Wei, Xing, et al.
Pubblicazione: (2025) -
Attention Sinks Induce Gradient Sinks: Massive Activations as Gradient Regulators in Transformers
di: Chen, Yihong, et al.
Pubblicazione: (2026)