Improving the Effectiveness of Potential-Based Reward Shaping in Reinforcement Learning
Fuente:
arXiv
Salvato in:
| Autori principali: | Müller, Henrik, Kudenko, Daniel |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
On the Sample Efficiency of Abstractions and Potential-Based Reward Shaping in Reinforcement Learning
di: Canonaco, Giuseppe, et al.
Pubblicazione: (2024)
di: Canonaco, Giuseppe, et al.
Pubblicazione: (2024)
Subgoal-based Reward Shaping to Improve Efficiency in Reinforcement Learning
di: Okudo, Takato, et al.
Pubblicazione: (2021)
di: Okudo, Takato, et al.
Pubblicazione: (2021)
Occupancy Reward Shaping: Improving Credit Assignment for Offline Goal-Conditioned Reinforcement Learning
di: Venugopal, Aravind, et al.
Pubblicazione: (2026)
di: Venugopal, Aravind, et al.
Pubblicazione: (2026)
Effective Reward Specification in Deep Reinforcement Learning
di: Roy, Julien
Pubblicazione: (2024)
di: Roy, Julien
Pubblicazione: (2024)
From Absolute to Relative: Rethinking Reward Shaping in Group-Based Reinforcement Learning
di: Niu, Wenzhe, et al.
Pubblicazione: (2026)
di: Niu, Wenzhe, et al.
Pubblicazione: (2026)
Potential-Based Reward Shaping For Intrinsic Motivation
di: Forbes, Grant C., et al.
Pubblicazione: (2024)
di: Forbes, Grant C., et al.
Pubblicazione: (2024)
Generalization in Deep Reinforcement Learning for Robotic Navigation by Reward Shaping
di: Miranda, Victor R. F., et al.
Pubblicazione: (2022)
di: Miranda, Victor R. F., et al.
Pubblicazione: (2022)
Highly Efficient Self-Adaptive Reward Shaping for Reinforcement Learning
di: Ma, Haozhe, et al.
Pubblicazione: (2024)
di: Ma, Haozhe, et al.
Pubblicazione: (2024)
Guaranteeing Control Requirements via Reward Shaping in Reinforcement Learning
di: De Lellis, Francesco, et al.
Pubblicazione: (2023)
di: De Lellis, Francesco, et al.
Pubblicazione: (2023)
Text2Reward: Reward Shaping with Language Models for Reinforcement Learning
di: Xie, Tianbao, et al.
Pubblicazione: (2023)
di: Xie, Tianbao, et al.
Pubblicazione: (2023)
Focal Reward: Balanced Reinforcement Learning under Rubric-Based Rewards
di: Huang, Yu, et al.
Pubblicazione: (2026)
di: Huang, Yu, et al.
Pubblicazione: (2026)
Shaping Sparse Rewards in Reinforcement Learning: A Semi-supervised Approach
di: Li, Wenyun, et al.
Pubblicazione: (2025)
di: Li, Wenyun, et al.
Pubblicazione: (2025)
Comprehensive Overview of Reward Engineering and Shaping in Advancing Reinforcement Learning Applications
di: Ibrahim, Sinan, et al.
Pubblicazione: (2024)
di: Ibrahim, Sinan, et al.
Pubblicazione: (2024)
Binary Reward Labeling: Bridging Offline Preference and Reward-Based Reinforcement Learning
di: Xu, Yinglun, et al.
Pubblicazione: (2024)
di: Xu, Yinglun, et al.
Pubblicazione: (2024)
Reinforcement Learning with Verifiable Rewards: GRPO's Effective Loss, Dynamics, and Success Amplification
di: Mroueh, Youssef
Pubblicazione: (2025)
di: Mroueh, Youssef
Pubblicazione: (2025)
Reinforcement Learning with Symbolic Reward Machines
di: Krug, Thomas, et al.
Pubblicazione: (2026)
di: Krug, Thomas, et al.
Pubblicazione: (2026)
Reinforcement Learning with Stochastic Reward Machines
di: Corazza, Jan, et al.
Pubblicazione: (2025)
di: Corazza, Jan, et al.
Pubblicazione: (2025)
SLOPE: Optimistic Potential Landscape Shaping for Model-based Reinforcement Learning
di: Li, Yao-Hui, et al.
Pubblicazione: (2026)
di: Li, Yao-Hui, et al.
Pubblicazione: (2026)
Attention-Based Reward Shaping for Sparse and Delayed Rewards
di: Holmes, Ian, et al.
Pubblicazione: (2025)
di: Holmes, Ian, et al.
Pubblicazione: (2025)
Extracting Heuristics from Large Language Models for Reward Shaping in Reinforcement Learning
di: Bhambri, Siddhant, et al.
Pubblicazione: (2024)
di: Bhambri, Siddhant, et al.
Pubblicazione: (2024)
Enhancing Inverse Reinforcement Learning through Encoding Dynamic Information in Reward Shaping
di: Zhan, Simon Sinong, et al.
Pubblicazione: (2024)
di: Zhan, Simon Sinong, et al.
Pubblicazione: (2024)
Fine-tuning Pocket-Aware Diffusion Models via Denoising Policy Optimization
di: Xue, Yuan, et al.
Pubblicazione: (2026)
di: Xue, Yuan, et al.
Pubblicazione: (2026)
Reward-Conditioned Reinforcement Learning
di: Nauman, Michal, et al.
Pubblicazione: (2026)
di: Nauman, Michal, et al.
Pubblicazione: (2026)
Learning Fair And Effective Points-Based Rewards Programs
di: Hssaine, Chamsi, et al.
Pubblicazione: (2025)
di: Hssaine, Chamsi, et al.
Pubblicazione: (2025)
MVR: Multi-view Video Reward Shaping for Reinforcement Learning
di: Luo, Lirui, et al.
Pubblicazione: (2026)
di: Luo, Lirui, et al.
Pubblicazione: (2026)
Potential-Based Intrinsic Motivation: Preserving Optimality With Complex, Non-Markovian Shaping Rewards
di: Forbes, Grant C., et al.
Pubblicazione: (2024)
di: Forbes, Grant C., et al.
Pubblicazione: (2024)
PAGAR: Taming Reward Misalignment in Inverse Reinforcement Learning-Based Imitation Learning with Protagonist Antagonist Guided Adversarial Reward
di: Zhou, Weichao, et al.
Pubblicazione: (2023)
di: Zhou, Weichao, et al.
Pubblicazione: (2023)
Reward Design for Reinforcement Learning Agents
di: Devidze, Rati
Pubblicazione: (2025)
di: Devidze, Rati
Pubblicazione: (2025)
Reinforcement Learning from Bagged Reward
di: Tang, Yuting, et al.
Pubblicazione: (2024)
di: Tang, Yuting, et al.
Pubblicazione: (2024)
The Value of Reward Lookahead in Reinforcement Learning
di: Merlis, Nadav, et al.
Pubblicazione: (2024)
di: Merlis, Nadav, et al.
Pubblicazione: (2024)
Informativeness of Reward Functions in Reinforcement Learning
di: Devidze, Rati, et al.
Pubblicazione: (2024)
di: Devidze, Rati, et al.
Pubblicazione: (2024)
To the Max: Reinventing Reward in Reinforcement Learning
di: Veviurko, Grigorii, et al.
Pubblicazione: (2024)
di: Veviurko, Grigorii, et al.
Pubblicazione: (2024)
medR: Reward Engineering for Clinical Offline Reinforcement Learning via Tri-Drive Potential Functions
di: Xu, Qianyi, et al.
Pubblicazione: (2026)
di: Xu, Qianyi, et al.
Pubblicazione: (2026)
The Distributional Reward Critic Framework for Reinforcement Learning Under Perturbed Rewards
di: Chen, Xi, et al.
Pubblicazione: (2024)
di: Chen, Xi, et al.
Pubblicazione: (2024)
CLIP-RLDrive: Human-Aligned Autonomous Driving via CLIP-Based Reward Shaping in Reinforcement Learning
di: Doroudian, Erfan, et al.
Pubblicazione: (2024)
di: Doroudian, Erfan, et al.
Pubblicazione: (2024)
Noisy Data is Destructive to Reinforcement Learning with Verifiable Rewards
di: Zhu, Yuxuan, et al.
Pubblicazione: (2026)
di: Zhu, Yuxuan, et al.
Pubblicazione: (2026)
Near-Optimal Sample Complexity in Reward-Free Kernel-Based Reinforcement Learning
di: Kayal, Aya, et al.
Pubblicazione: (2025)
di: Kayal, Aya, et al.
Pubblicazione: (2025)
Reward Modeling for Reinforcement Learning-Based LLM Reasoning: Design, Challenges, and Evaluation
di: Pan, Pei-Chi, et al.
Pubblicazione: (2026)
di: Pan, Pei-Chi, et al.
Pubblicazione: (2026)
Learning Explainable Dense Reward Shapes via Bayesian Optimization
di: Koo, Ryan, et al.
Pubblicazione: (2025)
di: Koo, Ryan, et al.
Pubblicazione: (2025)
Parent-Guided Semantic Reward Model (PGSRM): Embedding-Based Reward Functions for Reinforcement Learning of Transformer Language Models
di: Plashchinsky, Alexandr
Pubblicazione: (2025)
di: Plashchinsky, Alexandr
Pubblicazione: (2025)
Documenti analoghi
-
On the Sample Efficiency of Abstractions and Potential-Based Reward Shaping in Reinforcement Learning
di: Canonaco, Giuseppe, et al.
Pubblicazione: (2024) -
Subgoal-based Reward Shaping to Improve Efficiency in Reinforcement Learning
di: Okudo, Takato, et al.
Pubblicazione: (2021) -
Occupancy Reward Shaping: Improving Credit Assignment for Offline Goal-Conditioned Reinforcement Learning
di: Venugopal, Aravind, et al.
Pubblicazione: (2026) -
Effective Reward Specification in Deep Reinforcement Learning
di: Roy, Julien
Pubblicazione: (2024) -
From Absolute to Relative: Rethinking Reward Shaping in Group-Based Reinforcement Learning
di: Niu, Wenzhe, et al.
Pubblicazione: (2026)