Decoupling Return-to-Go for Efficient Decision Transformer
Fuente:
arXiv
Saved in:
| Main Authors: | Wang, Yongyi, Liu, Hanyu, Li, Lingfeng, Chen, Bozhou, Li, Ang, Zheng, Qirui, Yang, Xionghui, Li, Wenxin |
|---|---|
| Format: | Preprint |
| Published: |
2026
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Beyond Autoregressive RTG: Conditioning via Injection Outside Sequential Modeling in Decision Transformer
by: Wang, Yongyi, et al.
Published: (2026)
by: Wang, Yongyi, et al.
Published: (2026)
Synthetic POMDPs to Challenge Memory-Augmented RL: Memory Demand Structure Modeling
by: Wang, Yongyi, et al.
Published: (2025)
by: Wang, Yongyi, et al.
Published: (2025)
BotzoneBench: Scalable LLM Evaluation via Graded AI Anchors
by: Li, Lingfeng, et al.
Published: (2026)
by: Li, Lingfeng, et al.
Published: (2026)
Constructing Non-Markovian Decision Process via History Aggregator
by: Wang, Yongyi, et al.
Published: (2025)
by: Wang, Yongyi, et al.
Published: (2025)
Style-Preserving Policy Optimization for Game Agents
by: Li, Lingfeng, et al.
Published: (2025)
by: Li, Lingfeng, et al.
Published: (2025)
Mxplainer: Explain and Learn Insights by Imitating Mahjong Agents
by: Li, Lingfeng, et al.
Published: (2025)
by: Li, Lingfeng, et al.
Published: (2025)
ShuttleEnv: An Interactive Data-Driven RL Environment for Badminton Strategy Modeling
by: Li, Ang, et al.
Published: (2026)
by: Li, Ang, et al.
Published: (2026)
Adapting Rules of Official International Mahjong for Online Players
by: Wang, Chucai, et al.
Published: (2026)
by: Wang, Chucai, et al.
Published: (2026)
Return Augmented Decision Transformer for Off-Dynamics Reinforcement Learning
by: Wang, Ruhan, et al.
Published: (2024)
by: Wang, Ruhan, et al.
Published: (2024)
Pareto-guided Pipeline for Distilling Featherweight AI Agents in Mobile MOBA Games
by: Yang, Xionghui, et al.
Published: (2026)
by: Yang, Xionghui, et al.
Published: (2026)
From Multimodal Perception to Strategic Reasoning: A Survey on AI-Generated Game Commentary
by: Zheng, Qirui, et al.
Published: (2025)
by: Zheng, Qirui, et al.
Published: (2025)
Return-to-Go Is More Than a Number: Q-Guided Alignment for Return-Conditioned Supervised Learning
by: Yang, Yuxiao, et al.
Published: (2026)
by: Yang, Yuxiao, et al.
Published: (2026)
Target Return Optimizer for Multi-Game Decision Transformer
by: Tatematsu, Kensuke, et al.
Published: (2025)
by: Tatematsu, Kensuke, et al.
Published: (2025)
DRPO: Efficient Reasoning via Decoupled Reward Policy Optimization
by: Li, Gang, et al.
Published: (2025)
by: Li, Gang, et al.
Published: (2025)
SPADE-Bench: Evaluating Spontaneous Strategic Deception in Agents via Plan-Action Divergence
by: Bu, Yuyan, et al.
Published: (2026)
by: Bu, Yuyan, et al.
Published: (2026)
CAMPA: Efficient and Aligned Multimodal Graph Learning via Decoupled Propagation and Aggregation
by: Su, Daohan, et al.
Published: (2026)
by: Su, Daohan, et al.
Published: (2026)
Euler-inspired Decoupling Neural Operator for Efficient Pansharpening
by: Zhu, Anqi, et al.
Published: (2026)
by: Zhu, Anqi, et al.
Published: (2026)
Estimating Probabilities of Causation with Machine Learning Models
by: Wang, Shuai, et al.
Published: (2025)
by: Wang, Shuai, et al.
Published: (2025)
Think, Speak, Decide: Language-Augmented Multi-Agent Reinforcement Learning for Economic Decision-Making
by: Ma, Heyang, et al.
Published: (2025)
by: Ma, Heyang, et al.
Published: (2025)
Decoupled Alignment for Robust Plug-and-Play Adaptation
by: Luo, Haozheng, et al.
Published: (2024)
by: Luo, Haozheng, et al.
Published: (2024)
A Mathematical Explanation of Transformers
by: Tai, Xue-Cheng, et al.
Published: (2025)
by: Tai, Xue-Cheng, et al.
Published: (2025)
RaanA: A Fast, Flexible, and Data-Efficient Post-Training Quantization Algorithm
by: Yang, Yongyi, et al.
Published: (2025)
by: Yang, Yongyi, et al.
Published: (2025)
InterMT: Multi-Turn Interleaved Preference Alignment with Human Feedback
by: Chen, Boyuan, et al.
Published: (2025)
by: Chen, Boyuan, et al.
Published: (2025)
Credit-Budgeted ICPC-Style Coding: When Agents Must Pay for Every Decision
by: Zhou, Lingfeng, et al.
Published: (2026)
by: Zhou, Lingfeng, et al.
Published: (2026)
An Information-Theoretic Criterion for Efficient Data Synthesis
by: Li, Hanyu, et al.
Published: (2026)
by: Li, Hanyu, et al.
Published: (2026)
Deep Ideation: Designing LLM Agents to Generate Novel Research Ideas on Scientific Concept Network
by: Zhao, Keyu, et al.
Published: (2025)
by: Zhao, Keyu, et al.
Published: (2025)
Revisiting FastMap: New Applications
by: Li, Ang
Published: (2025)
by: Li, Ang
Published: (2025)
Understanding the Training and Generalization of Pretrained Transformer for Sequential Decision Making
by: Wang, Hanzhao, et al.
Published: (2024)
by: Wang, Hanzhao, et al.
Published: (2024)
COLI: A Hierarchical Efficient Compressor for Large Images
by: Wang, Haoran, et al.
Published: (2025)
by: Wang, Haoran, et al.
Published: (2025)
A Learnable Wavelet Transformer for Long-Short Equity Trading and Risk-Adjusted Return Optimization
by: Li, Shuozhe, et al.
Published: (2026)
by: Li, Shuozhe, et al.
Published: (2026)
Causal-Driven Feature Evaluation for Cross-Domain Image Classification
by: Cheng, Chen, et al.
Published: (2026)
by: Cheng, Chen, et al.
Published: (2026)
On the "Causality" Step in Policy Gradient Derivations: A Pedagogical Reconciliation of Full Return and Reward-to-Go
by: Siboni, Nima H.
Published: (2026)
by: Siboni, Nima H.
Published: (2026)
Modality-Decoupled Online Recursive Editing
by: Li, Siyuan, et al.
Published: (2026)
by: Li, Siyuan, et al.
Published: (2026)
SimVG: A Simple Framework for Visual Grounding with Decoupled Multi-modal Fusion
by: Dai, Ming, et al.
Published: (2024)
by: Dai, Ming, et al.
Published: (2024)
Tandem: Riding Together with Large and Small Language Models for Efficient Reasoning
by: Fu, Zichuan, et al.
Published: (2026)
by: Fu, Zichuan, et al.
Published: (2026)
Denoised Recommendation Model with Collaborative Signal Decoupling
by: Li, Zefeng, et al.
Published: (2025)
by: Li, Zefeng, et al.
Published: (2025)
AI's Euclid's Elements Moment: From Language Models to Computable Thought
by: Fang, Xinmin, et al.
Published: (2025)
by: Fang, Xinmin, et al.
Published: (2025)
Closer to Language than Steam: AI as the Cognitive Engine of a New Productivity Revolution
by: Fang, Xinmin, et al.
Published: (2025)
by: Fang, Xinmin, et al.
Published: (2025)
How Large Language Models Need Symbolism
by: Deng, Xiaotie, et al.
Published: (2025)
by: Deng, Xiaotie, et al.
Published: (2025)
GoNoGo: An Efficient LLM-based Multi-Agent System for Streamlining Automotive Software Release Decision-Making
by: Khoee, Arsham Gholamzadeh, et al.
Published: (2024)
by: Khoee, Arsham Gholamzadeh, et al.
Published: (2024)
Similar Items
-
Beyond Autoregressive RTG: Conditioning via Injection Outside Sequential Modeling in Decision Transformer
by: Wang, Yongyi, et al.
Published: (2026) -
Synthetic POMDPs to Challenge Memory-Augmented RL: Memory Demand Structure Modeling
by: Wang, Yongyi, et al.
Published: (2025) -
BotzoneBench: Scalable LLM Evaluation via Graded AI Anchors
by: Li, Lingfeng, et al.
Published: (2026) -
Constructing Non-Markovian Decision Process via History Aggregator
by: Wang, Yongyi, et al.
Published: (2025) -
Style-Preserving Policy Optimization for Game Agents
by: Li, Lingfeng, et al.
Published: (2025)