Gespeichert in:
| Hauptverfasser: | Müller, Henrik, Kudenko, Daniel |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2025
|
| Schlagworte: | |
| Online-Zugang: | https://arxiv.org/abs/2502.01307 |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
On the Sample Efficiency of Abstractions and Potential-Based Reward Shaping in Reinforcement Learning
von: Canonaco, Giuseppe, et al.
Veröffentlicht: (2024)
von: Canonaco, Giuseppe, et al.
Veröffentlicht: (2024)
Subgoal-based Reward Shaping to Improve Efficiency in Reinforcement Learning
von: Okudo, Takato, et al.
Veröffentlicht: (2021)
von: Okudo, Takato, et al.
Veröffentlicht: (2021)
Potential-Based Reward Shaping For Intrinsic Motivation
von: Forbes, Grant C., et al.
Veröffentlicht: (2024)
von: Forbes, Grant C., et al.
Veröffentlicht: (2024)
Occupancy Reward Shaping: Improving Credit Assignment for Offline Goal-Conditioned Reinforcement Learning
von: Venugopal, Aravind, et al.
Veröffentlicht: (2026)
von: Venugopal, Aravind, et al.
Veröffentlicht: (2026)
Effective Reward Specification in Deep Reinforcement Learning
von: Roy, Julien
Veröffentlicht: (2024)
von: Roy, Julien
Veröffentlicht: (2024)
From Absolute to Relative: Rethinking Reward Shaping in Group-Based Reinforcement Learning
von: Niu, Wenzhe, et al.
Veröffentlicht: (2026)
von: Niu, Wenzhe, et al.
Veröffentlicht: (2026)
Generalization in Deep Reinforcement Learning for Robotic Navigation by Reward Shaping
von: Miranda, Victor R. F., et al.
Veröffentlicht: (2022)
von: Miranda, Victor R. F., et al.
Veröffentlicht: (2022)
Text2Reward: Reward Shaping with Language Models for Reinforcement Learning
von: Xie, Tianbao, et al.
Veröffentlicht: (2023)
von: Xie, Tianbao, et al.
Veröffentlicht: (2023)
Highly Efficient Self-Adaptive Reward Shaping for Reinforcement Learning
von: Ma, Haozhe, et al.
Veröffentlicht: (2024)
von: Ma, Haozhe, et al.
Veröffentlicht: (2024)
Guaranteeing Control Requirements via Reward Shaping in Reinforcement Learning
von: De Lellis, Francesco, et al.
Veröffentlicht: (2023)
von: De Lellis, Francesco, et al.
Veröffentlicht: (2023)
Fine-tuning Pocket-Aware Diffusion Models via Denoising Policy Optimization
von: Xue, Yuan, et al.
Veröffentlicht: (2026)
von: Xue, Yuan, et al.
Veröffentlicht: (2026)
Focal Reward: Balanced Reinforcement Learning under Rubric-Based Rewards
von: Huang, Yu, et al.
Veröffentlicht: (2026)
von: Huang, Yu, et al.
Veröffentlicht: (2026)
Reinforcement Learning with Symbolic Reward Machines
von: Krug, Thomas, et al.
Veröffentlicht: (2026)
von: Krug, Thomas, et al.
Veröffentlicht: (2026)
Shaping Sparse Rewards in Reinforcement Learning: A Semi-supervised Approach
von: Li, Wenyun, et al.
Veröffentlicht: (2025)
von: Li, Wenyun, et al.
Veröffentlicht: (2025)
Comprehensive Overview of Reward Engineering and Shaping in Advancing Reinforcement Learning Applications
von: Ibrahim, Sinan, et al.
Veröffentlicht: (2024)
von: Ibrahim, Sinan, et al.
Veröffentlicht: (2024)
Reinforcement Learning with Stochastic Reward Machines
von: Corazza, Jan, et al.
Veröffentlicht: (2025)
von: Corazza, Jan, et al.
Veröffentlicht: (2025)
Reinforcement Learning with Verifiable Rewards: GRPO's Effective Loss, Dynamics, and Success Amplification
von: Mroueh, Youssef
Veröffentlicht: (2025)
von: Mroueh, Youssef
Veröffentlicht: (2025)
Binary Reward Labeling: Bridging Offline Preference and Reward-Based Reinforcement Learning
von: Xu, Yinglun, et al.
Veröffentlicht: (2024)
von: Xu, Yinglun, et al.
Veröffentlicht: (2024)
Attention-Based Reward Shaping for Sparse and Delayed Rewards
von: Holmes, Ian, et al.
Veröffentlicht: (2025)
von: Holmes, Ian, et al.
Veröffentlicht: (2025)
CubeletWorld: A New Abstraction for Scalable 3D Modeling
von: Samad, Azlaan Mustafa, et al.
Veröffentlicht: (2025)
von: Samad, Azlaan Mustafa, et al.
Veröffentlicht: (2025)
Extracting Heuristics from Large Language Models for Reward Shaping in Reinforcement Learning
von: Bhambri, Siddhant, et al.
Veröffentlicht: (2024)
von: Bhambri, Siddhant, et al.
Veröffentlicht: (2024)
Enhancing Inverse Reinforcement Learning through Encoding Dynamic Information in Reward Shaping
von: Zhan, Simon Sinong, et al.
Veröffentlicht: (2024)
von: Zhan, Simon Sinong, et al.
Veröffentlicht: (2024)
MVR: Multi-view Video Reward Shaping for Reinforcement Learning
von: Luo, Lirui, et al.
Veröffentlicht: (2026)
von: Luo, Lirui, et al.
Veröffentlicht: (2026)
SLOPE: Optimistic Potential Landscape Shaping for Model-based Reinforcement Learning
von: Li, Yao-Hui, et al.
Veröffentlicht: (2026)
von: Li, Yao-Hui, et al.
Veröffentlicht: (2026)
Learning Fair And Effective Points-Based Rewards Programs
von: Hssaine, Chamsi, et al.
Veröffentlicht: (2025)
von: Hssaine, Chamsi, et al.
Veröffentlicht: (2025)
Potential-Based Intrinsic Motivation: Preserving Optimality With Complex, Non-Markovian Shaping Rewards
von: Forbes, Grant C., et al.
Veröffentlicht: (2024)
von: Forbes, Grant C., et al.
Veröffentlicht: (2024)
Reward-Conditioned Reinforcement Learning
von: Nauman, Michal, et al.
Veröffentlicht: (2026)
von: Nauman, Michal, et al.
Veröffentlicht: (2026)
CLIP-RLDrive: Human-Aligned Autonomous Driving via CLIP-Based Reward Shaping in Reinforcement Learning
von: Doroudian, Erfan, et al.
Veröffentlicht: (2024)
von: Doroudian, Erfan, et al.
Veröffentlicht: (2024)
Noisy Data is Destructive to Reinforcement Learning with Verifiable Rewards
von: Zhu, Yuxuan, et al.
Veröffentlicht: (2026)
von: Zhu, Yuxuan, et al.
Veröffentlicht: (2026)
Reward Design for Reinforcement Learning Agents
von: Devidze, Rati
Veröffentlicht: (2025)
von: Devidze, Rati
Veröffentlicht: (2025)
Reinforcement Learning from Bagged Reward
von: Tang, Yuting, et al.
Veröffentlicht: (2024)
von: Tang, Yuting, et al.
Veröffentlicht: (2024)
The Value of Reward Lookahead in Reinforcement Learning
von: Merlis, Nadav, et al.
Veröffentlicht: (2024)
von: Merlis, Nadav, et al.
Veröffentlicht: (2024)
Informativeness of Reward Functions in Reinforcement Learning
von: Devidze, Rati, et al.
Veröffentlicht: (2024)
von: Devidze, Rati, et al.
Veröffentlicht: (2024)
To the Max: Reinventing Reward in Reinforcement Learning
von: Veviurko, Grigorii, et al.
Veröffentlicht: (2024)
von: Veviurko, Grigorii, et al.
Veröffentlicht: (2024)
PAGAR: Taming Reward Misalignment in Inverse Reinforcement Learning-Based Imitation Learning with Protagonist Antagonist Guided Adversarial Reward
von: Zhou, Weichao, et al.
Veröffentlicht: (2023)
von: Zhou, Weichao, et al.
Veröffentlicht: (2023)
The Distributional Reward Critic Framework for Reinforcement Learning Under Perturbed Rewards
von: Chen, Xi, et al.
Veröffentlicht: (2024)
von: Chen, Xi, et al.
Veröffentlicht: (2024)
medR: Reward Engineering for Clinical Offline Reinforcement Learning via Tri-Drive Potential Functions
von: Xu, Qianyi, et al.
Veröffentlicht: (2026)
von: Xu, Qianyi, et al.
Veröffentlicht: (2026)
Bootstrapped Reward Shaping
von: Adamczyk, Jacob, et al.
Veröffentlicht: (2025)
von: Adamczyk, Jacob, et al.
Veröffentlicht: (2025)
DreamSmooth: Improving Model-based Reinforcement Learning via Reward Smoothing
von: Lee, Vint, et al.
Veröffentlicht: (2023)
von: Lee, Vint, et al.
Veröffentlicht: (2023)
Provable Reward-Agnostic Preference-Based Reinforcement Learning
von: Zhan, Wenhao, et al.
Veröffentlicht: (2023)
von: Zhan, Wenhao, et al.
Veröffentlicht: (2023)
Ähnliche Einträge
-
On the Sample Efficiency of Abstractions and Potential-Based Reward Shaping in Reinforcement Learning
von: Canonaco, Giuseppe, et al.
Veröffentlicht: (2024) -
Subgoal-based Reward Shaping to Improve Efficiency in Reinforcement Learning
von: Okudo, Takato, et al.
Veröffentlicht: (2021) -
Potential-Based Reward Shaping For Intrinsic Motivation
von: Forbes, Grant C., et al.
Veröffentlicht: (2024) -
Occupancy Reward Shaping: Improving Credit Assignment for Offline Goal-Conditioned Reinforcement Learning
von: Venugopal, Aravind, et al.
Veröffentlicht: (2026) -
Effective Reward Specification in Deep Reinforcement Learning
von: Roy, Julien
Veröffentlicht: (2024)