A2PO: Towards Effective Offline Reinforcement Learning from an Advantage-aware Perspective
Fuente:
arXiv
Salvato in:
| Autori principali: | Qing, Yunpeng, liu, Shunyu, Cong, Jingyuan, Chen, Kaixuan, Zhou, Yihe, Song, Mingli |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
A Survey on Explainable Reinforcement Learning: Concepts, Algorithms, Challenges
di: Qing, Yunpeng, et al.
Pubblicazione: (2022)
di: Qing, Yunpeng, et al.
Pubblicazione: (2022)
Is Centralized Training with Decentralized Execution Framework Centralized Enough for MARL?
di: Zhou, Yihe, et al.
Pubblicazione: (2023)
di: Zhou, Yihe, et al.
Pubblicazione: (2023)
Temporal Prototype-Aware Learning for Active Voltage Control on Power Distribution Networks
di: Xu, Feiyang, et al.
Pubblicazione: (2024)
di: Xu, Feiyang, et al.
Pubblicazione: (2024)
Interaction Pattern Disentangling for Multi-Agent Reinforcement Learning
di: Liu, Shunyu, et al.
Pubblicazione: (2022)
di: Liu, Shunyu, et al.
Pubblicazione: (2022)
Unveiling Global Interactive Patterns across Graphs: Towards Interpretable Graph Neural Networks
di: Wang, Yuwen, et al.
Pubblicazione: (2024)
di: Wang, Yuwen, et al.
Pubblicazione: (2024)
Ask-AC: An Initiative Advisor-in-the-Loop Actor-Critic Framework
di: Liu, Shunyu, et al.
Pubblicazione: (2022)
di: Liu, Shunyu, et al.
Pubblicazione: (2022)
Transmission Interface Power Flow Adjustment: A Deep Reinforcement Learning Approach based on Multi-task Attribution Map
di: Liu, Shunyu, et al.
Pubblicazione: (2024)
di: Liu, Shunyu, et al.
Pubblicazione: (2024)
Towards Efficient LLM-aware Heterogeneous Graph Learning
di: Li, Wenda, et al.
Pubblicazione: (2025)
di: Li, Wenda, et al.
Pubblicazione: (2025)
Spatiotemporal-Augmented Graph Neural Networks for Human Mobility Simulation
di: Wang, Yu, et al.
Pubblicazione: (2023)
di: Wang, Yu, et al.
Pubblicazione: (2023)
Bi-level Mean Field: Dynamic Grouping for Large-Scale MARL
di: Zheng, Yuxuan, et al.
Pubblicazione: (2025)
di: Zheng, Yuxuan, et al.
Pubblicazione: (2025)
Breaking the Exploration Bottleneck: Rubric-Scaffolded Reinforcement Learning for General LLM Reasoning
di: Zhou, Yang, et al.
Pubblicazione: (2025)
di: Zhou, Yang, et al.
Pubblicazione: (2025)
Adaptive Advantage-Guided Policy Regularization for Offline Reinforcement Learning
di: Liu, Tenglong, et al.
Pubblicazione: (2024)
di: Liu, Tenglong, et al.
Pubblicazione: (2024)
SeRL: Self-Play Reinforcement Learning for Large Language Models with Limited Data
di: Fang, Wenkai, et al.
Pubblicazione: (2025)
di: Fang, Wenkai, et al.
Pubblicazione: (2025)
Powerformer: A Section-adaptive Transformer for Power Flow Adjustment
di: Chen, Kaixuan, et al.
Pubblicazione: (2024)
di: Chen, Kaixuan, et al.
Pubblicazione: (2024)
COLA: Cross-city Mobility Transformer for Human Trajectory Simulation
di: Wang, Yu, et al.
Pubblicazione: (2024)
di: Wang, Yu, et al.
Pubblicazione: (2024)
BAFFLE: Hiding Backdoors in Offline Reinforcement Learning Datasets
di: Gong, Chen, et al.
Pubblicazione: (2022)
di: Gong, Chen, et al.
Pubblicazione: (2022)
Replay Failures as Successes: Sample-Efficient Reinforcement Learning for Instruction Following
di: Zhang, Kongcheng, et al.
Pubblicazione: (2025)
di: Zhang, Kongcheng, et al.
Pubblicazione: (2025)
Offline Trajectory Optimization for Offline Reinforcement Learning
di: Zhao, Ziqi, et al.
Pubblicazione: (2024)
di: Zhao, Ziqi, et al.
Pubblicazione: (2024)
The Edge-of-Reach Problem in Offline Model-Based Reinforcement Learning
di: Sims, Anya, et al.
Pubblicazione: (2024)
di: Sims, Anya, et al.
Pubblicazione: (2024)
Option-aware Temporally Abstracted Value for Offline Goal-Conditioned Reinforcement Learning
di: Ahn, Hongjoon, et al.
Pubblicazione: (2025)
di: Ahn, Hongjoon, et al.
Pubblicazione: (2025)
Physics-informed Diffusion Generation for Geomagnetic Map Interpolation
di: Li, Wenda, et al.
Pubblicazione: (2026)
di: Li, Wenda, et al.
Pubblicazione: (2026)
Provable Zero-Shot Generalization in Offline Reinforcement Learning
di: Wang, Zhiyong, et al.
Pubblicazione: (2025)
di: Wang, Zhiyong, et al.
Pubblicazione: (2025)
Adaptive Replay Buffer for Offline-to-Online Reinforcement Learning
di: Song, Chihyeon, et al.
Pubblicazione: (2025)
di: Song, Chihyeon, et al.
Pubblicazione: (2025)
Temporal Distance-aware Transition Augmentation for Offline Model-based Reinforcement Learning
di: Lee, Dongsu, et al.
Pubblicazione: (2025)
di: Lee, Dongsu, et al.
Pubblicazione: (2025)
Safety-aware Causal Representation for Trustworthy Offline Reinforcement Learning in Autonomous Driving
di: Lin, Haohong, et al.
Pubblicazione: (2023)
di: Lin, Haohong, et al.
Pubblicazione: (2023)
Towards a Sharp Analysis of Offline Policy Learning for $f$-Divergence-Regularized Contextual Bandits
di: Zhao, Qingyue, et al.
Pubblicazione: (2025)
di: Zhao, Qingyue, et al.
Pubblicazione: (2025)
Diffusion Policies creating a Trust Region for Offline Reinforcement Learning
di: Chen, Tianyu, et al.
Pubblicazione: (2024)
di: Chen, Tianyu, et al.
Pubblicazione: (2024)
In-Context Compositional Q-Learning for Offline Reinforcement Learning
di: Xu, Qiushui, et al.
Pubblicazione: (2025)
di: Xu, Qiushui, et al.
Pubblicazione: (2025)
GraphScout: Empowering Large Language Models with Intrinsic Exploration Ability for Agentic Graph Reasoning
di: Ying, Yuchen, et al.
Pubblicazione: (2026)
di: Ying, Yuchen, et al.
Pubblicazione: (2026)
Imagination-Limited Q-Learning for Offline Reinforcement Learning
di: Liu, Wenhui, et al.
Pubblicazione: (2025)
di: Liu, Wenhui, et al.
Pubblicazione: (2025)
Mildly Conservative Regularized Evaluation for Offline Reinforcement Learning
di: Chen, Haohui, et al.
Pubblicazione: (2025)
di: Chen, Haohui, et al.
Pubblicazione: (2025)
Towards Robust Offline Reinforcement Learning under Diverse Data Corruption
di: Yang, Rui, et al.
Pubblicazione: (2023)
di: Yang, Rui, et al.
Pubblicazione: (2023)
Generalizing Beyond Suboptimality: Offline Reinforcement Learning Learns Effective Scheduling through Random Data
di: van Remmerden, Jesse, et al.
Pubblicazione: (2025)
di: van Remmerden, Jesse, et al.
Pubblicazione: (2025)
Offline Reinforcement Learning with Generative Trajectory Policies
di: Feng, Xinsong, et al.
Pubblicazione: (2025)
di: Feng, Xinsong, et al.
Pubblicazione: (2025)
Compositional Conservatism: A Transductive Approach in Offline Reinforcement Learning
di: Song, Yeda, et al.
Pubblicazione: (2024)
di: Song, Yeda, et al.
Pubblicazione: (2024)
Reinforced Model Merging
di: Han, Jiaqi, et al.
Pubblicazione: (2025)
di: Han, Jiaqi, et al.
Pubblicazione: (2025)
Preference Elicitation for Offline Reinforcement Learning
di: Pace, Alizée, et al.
Pubblicazione: (2024)
di: Pace, Alizée, et al.
Pubblicazione: (2024)
Offline Reinforcement Learning with Imbalanced Datasets
di: Jiang, Li, et al.
Pubblicazione: (2023)
di: Jiang, Li, et al.
Pubblicazione: (2023)
Simple Ingredients for Offline Reinforcement Learning
di: Cetin, Edoardo, et al.
Pubblicazione: (2024)
di: Cetin, Edoardo, et al.
Pubblicazione: (2024)
State-Constrained Offline Reinforcement Learning
di: Hepburn, Charles A., et al.
Pubblicazione: (2024)
di: Hepburn, Charles A., et al.
Pubblicazione: (2024)
Documenti analoghi
-
A Survey on Explainable Reinforcement Learning: Concepts, Algorithms, Challenges
di: Qing, Yunpeng, et al.
Pubblicazione: (2022) -
Is Centralized Training with Decentralized Execution Framework Centralized Enough for MARL?
di: Zhou, Yihe, et al.
Pubblicazione: (2023) -
Temporal Prototype-Aware Learning for Active Voltage Control on Power Distribution Networks
di: Xu, Feiyang, et al.
Pubblicazione: (2024) -
Interaction Pattern Disentangling for Multi-Agent Reinforcement Learning
di: Liu, Shunyu, et al.
Pubblicazione: (2022) -
Unveiling Global Interactive Patterns across Graphs: Towards Interpretable Graph Neural Networks
di: Wang, Yuwen, et al.
Pubblicazione: (2024)