Effective Reward Specification in Deep Reinforcement Learning
Fuente:
arXiv
Enregistré dans:
| Auteur principal: | Roy, Julien |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Improving the Effectiveness of Potential-Based Reward Shaping in Reinforcement Learning
par: Müller, Henrik, et autres
Publié: (2025)
par: Müller, Henrik, et autres
Publié: (2025)
Deep Reinforcement Learning with Hybrid Intrinsic Reward Model
par: Yuan, Mingqi, et autres
Publié: (2025)
par: Yuan, Mingqi, et autres
Publié: (2025)
Analyzing and Bridging the Gap between Maximizing Total Reward and Discounted Reward in Deep Reinforcement Learning
par: Yin, Shuyu, et autres
Publié: (2024)
par: Yin, Shuyu, et autres
Publié: (2024)
Reinforcement Learning with Verifiable Rewards: GRPO's Effective Loss, Dynamics, and Success Amplification
par: Mroueh, Youssef
Publié: (2025)
par: Mroueh, Youssef
Publié: (2025)
Reward Models in Deep Reinforcement Learning: A Survey
par: Yu, Rui, et autres
Publié: (2025)
par: Yu, Rui, et autres
Publié: (2025)
Generalization in Deep Reinforcement Learning for Robotic Navigation by Reward Shaping
par: Miranda, Victor R. F., et autres
Publié: (2022)
par: Miranda, Victor R. F., et autres
Publié: (2022)
Reward-Conditioned Reinforcement Learning
par: Nauman, Michal, et autres
Publié: (2026)
par: Nauman, Michal, et autres
Publié: (2026)
Reinforcement Learning from Bagged Reward
par: Tang, Yuting, et autres
Publié: (2024)
par: Tang, Yuting, et autres
Publié: (2024)
The Value of Reward Lookahead in Reinforcement Learning
par: Merlis, Nadav, et autres
Publié: (2024)
par: Merlis, Nadav, et autres
Publié: (2024)
Informativeness of Reward Functions in Reinforcement Learning
par: Devidze, Rati, et autres
Publié: (2024)
par: Devidze, Rati, et autres
Publié: (2024)
To the Max: Reinventing Reward in Reinforcement Learning
par: Veviurko, Grigorii, et autres
Publié: (2024)
par: Veviurko, Grigorii, et autres
Publié: (2024)
Reward Design for Reinforcement Learning Agents
par: Devidze, Rati
Publié: (2025)
par: Devidze, Rati
Publié: (2025)
Tiered Reward: Designing Rewards for Specification and Fast Learning of Desired Behavior
par: Zhou, Zhiyuan, et autres
Publié: (2022)
par: Zhou, Zhiyuan, et autres
Publié: (2022)
The Distributional Reward Critic Framework for Reinforcement Learning Under Perturbed Rewards
par: Chen, Xi, et autres
Publié: (2024)
par: Chen, Xi, et autres
Publié: (2024)
Focal Reward: Balanced Reinforcement Learning under Rubric-Based Rewards
par: Huang, Yu, et autres
Publié: (2026)
par: Huang, Yu, et autres
Publié: (2026)
Verification-Guided Shielding for Deep Reinforcement Learning
par: Corsi, Davide, et autres
Publié: (2024)
par: Corsi, Davide, et autres
Publié: (2024)
Inductive Generalization in Reinforcement Learning from Specifications
par: Subramanian, Vignesh, et autres
Publié: (2024)
par: Subramanian, Vignesh, et autres
Publié: (2024)
Satisficing Exploration for Deep Reinforcement Learning
par: Arumugam, Dilip, et autres
Publié: (2024)
par: Arumugam, Dilip, et autres
Publié: (2024)
Adaptive Swarm Mesh Refinement using Deep Reinforcement Learning with Local Rewards
par: Freymuth, Niklas, et autres
Publié: (2024)
par: Freymuth, Niklas, et autres
Publié: (2024)
Code as Reward: Empowering Reinforcement Learning with VLMs
par: Venuto, David, et autres
Publié: (2024)
par: Venuto, David, et autres
Publié: (2024)
Binary Reward Labeling: Bridging Offline Preference and Reward-Based Reinforcement Learning
par: Xu, Yinglun, et autres
Publié: (2024)
par: Xu, Yinglun, et autres
Publié: (2024)
Risk-Averse Total-Reward Reinforcement Learning
par: Su, Xihong, et autres
Publié: (2025)
par: Su, Xihong, et autres
Publié: (2025)
Reward-Preserving Attacks For Robust Reinforcement Learning
par: Schott, Lucas, et autres
Publié: (2026)
par: Schott, Lucas, et autres
Publié: (2026)
Reward-Aware Proto-Representations in Reinforcement Learning
par: Tse, Hon Tik, et autres
Publié: (2025)
par: Tse, Hon Tik, et autres
Publié: (2025)
RDA: Reward Design Agent for Reinforcement Learning
par: Lee, Hojoon, et autres
Publié: (2026)
par: Lee, Hojoon, et autres
Publié: (2026)
Binary Rewards and Reinforcement Learning: Fundamental Challenges
par: Dymetman, Marc
Publié: (2026)
par: Dymetman, Marc
Publié: (2026)
Reward-Zero: Language Embedding Driven Implicit Reward Mechanisms for Reinforcement Learning
par: Zhang, Heng, et autres
Publié: (2026)
par: Zhang, Heng, et autres
Publié: (2026)
Long N-step Surrogate Stage Reward to Reduce Variances of Deep Reinforcement Learning in Complex Problems
par: Zhong, Junmin, et autres
Publié: (2022)
par: Zhong, Junmin, et autres
Publié: (2022)
Beyond Simple Sum of Delayed Rewards: Non-Markovian Reward Modeling for Reinforcement Learning
par: Tang, Yuting, et autres
Publié: (2024)
par: Tang, Yuting, et autres
Publié: (2024)
Contextual Pre-planning on Reward Machine Abstractions for Enhanced Transfer in Deep Reinforcement Learning
par: Azran, Guy, et autres
Publié: (2023)
par: Azran, Guy, et autres
Publié: (2023)
Token Hidden Reward: Steering Exploration-Exploitation in Group Relative Deep Reinforcement Learning
par: Deng, Wenlong, et autres
Publié: (2025)
par: Deng, Wenlong, et autres
Publié: (2025)
Offline Reinforcement Learning with Imputed Rewards
par: Romeo, Carlo, et autres
Publié: (2024)
par: Romeo, Carlo, et autres
Publié: (2024)
Reinforcement Learning with Exogenous States and Rewards
par: Trimponias, George, et autres
Publié: (2023)
par: Trimponias, George, et autres
Publié: (2023)
Reinforcement Learning with Symbolic Reward Machines
par: Krug, Thomas, et autres
Publié: (2026)
par: Krug, Thomas, et autres
Publié: (2026)
Reinforcement Learning with Stochastic Reward Machines
par: Corazza, Jan, et autres
Publié: (2025)
par: Corazza, Jan, et autres
Publié: (2025)
SPARK: Stepwise Process-Aware Rewards for Reference-Free Reinforcement Learning
par: Rahman, Salman, et autres
Publié: (2025)
par: Rahman, Salman, et autres
Publié: (2025)
On Feasible Rewards in Multi-Agent Inverse Reinforcement Learning
par: Freihaut, Till, et autres
Publié: (2024)
par: Freihaut, Till, et autres
Publié: (2024)
Bayesian Inverse Reinforcement Learning for Non-Markovian Rewards
par: Topper, Noah, et autres
Publié: (2024)
par: Topper, Noah, et autres
Publié: (2024)
Asymmetric Prompt Weighting for Reinforcement Learning with Verifiable Rewards
par: Heckel, Reinhard, et autres
Publié: (2026)
par: Heckel, Reinhard, et autres
Publié: (2026)
Curriculum Reinforcement Learning for Complex Reward Functions
par: Freitag, Kilian, et autres
Publié: (2024)
par: Freitag, Kilian, et autres
Publié: (2024)
Documents similaires
-
Improving the Effectiveness of Potential-Based Reward Shaping in Reinforcement Learning
par: Müller, Henrik, et autres
Publié: (2025) -
Deep Reinforcement Learning with Hybrid Intrinsic Reward Model
par: Yuan, Mingqi, et autres
Publié: (2025) -
Analyzing and Bridging the Gap between Maximizing Total Reward and Discounted Reward in Deep Reinforcement Learning
par: Yin, Shuyu, et autres
Publié: (2024) -
Reinforcement Learning with Verifiable Rewards: GRPO's Effective Loss, Dynamics, and Success Amplification
par: Mroueh, Youssef
Publié: (2025) -
Reward Models in Deep Reinforcement Learning: A Survey
par: Yu, Rui, et autres
Publié: (2025)