Tiered Reward: Designing Rewards for Specification and Fast Learning of Desired Behavior
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Zhou, Zhiyuan, Raman, Shreyas Sundara, Sowerby, Henry, Littman, Michael L. |
|---|---|
| Format: | Preprint |
| Publié: |
2022
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Which Rewards Matter? Reward Selection for Reinforcement Learning under Limited Feedback
par: Chaudhari, Shreyas, et autres
Publié: (2025)
par: Chaudhari, Shreyas, et autres
Publié: (2025)
Rectifying Shortcut Behaviors in Preference-based Reward Learning
par: Ye, Wenqian, et autres
Publié: (2025)
par: Ye, Wenqian, et autres
Publié: (2025)
Global Rewards in Restless Multi-Armed Bandits
par: Raman, Naveen, et autres
Publié: (2024)
par: Raman, Naveen, et autres
Publié: (2024)
Abstract Reward Processes: Leveraging State Abstraction for Consistent Off-Policy Evaluation
par: Chaudhari, Shreyas, et autres
Publié: (2024)
par: Chaudhari, Shreyas, et autres
Publié: (2024)
Value of Information and Reward Specification in Active Inference and POMDPs
par: Wei, Ran
Publié: (2024)
par: Wei, Ran
Publié: (2024)
Knowledge Retention for Continual Model-Based Reinforcement Learning
par: Sun, Yixiang, et autres
Publié: (2025)
par: Sun, Yixiang, et autres
Publié: (2025)
Towards Improving Reward Design in RL: A Reward Alignment Metric for RL Practitioners
par: Muslimani, Calarina, et autres
Publié: (2025)
par: Muslimani, Calarina, et autres
Publié: (2025)
SemiReward: A General Reward Model for Semi-supervised Learning
par: Li, Siyuan, et autres
Publié: (2023)
par: Li, Siyuan, et autres
Publié: (2023)
Text2Reward: Reward Shaping with Language Models for Reinforcement Learning
par: Xie, Tianbao, et autres
Publié: (2023)
par: Xie, Tianbao, et autres
Publié: (2023)
ORSO: Accelerating Reward Design via Online Reward Selection and Policy Optimization
par: Zhang, Chen Bo Calvin, et autres
Publié: (2024)
par: Zhang, Chen Bo Calvin, et autres
Publié: (2024)
Generalizing Behavior via Inverse Reinforcement Learning with Closed-Form Reward Centroids
par: Lazzati, Filippo, et autres
Publié: (2025)
par: Lazzati, Filippo, et autres
Publié: (2025)
Inverse Reinforcement Learning with Switching Rewards and History Dependency for Characterizing Animal Behaviors
par: Ke, Jingyang, et autres
Publié: (2025)
par: Ke, Jingyang, et autres
Publié: (2025)
Adapting the Behavior of Reinforcement Learning Agents to Changing Action Spaces and Reward Functions
par: de la Rosa, Raul, et autres
Publié: (2026)
par: de la Rosa, Raul, et autres
Publié: (2026)
Temporal Representations for Exploration: Learning Complex Exploratory Behavior without Extrinsic Rewards
par: Mohamed, Faisal, et autres
Publié: (2026)
par: Mohamed, Faisal, et autres
Publié: (2026)
What Fundamental Structure in Reward Functions Enables Efficient Sparse-Reward Learning?
par: Shihab, Ibne Farabi, et autres
Publié: (2025)
par: Shihab, Ibne Farabi, et autres
Publié: (2025)
Constraints as Rewards: Reinforcement Learning for Robots without Reward Functions
par: Ishihara, Yu, et autres
Publié: (2025)
par: Ishihara, Yu, et autres
Publié: (2025)
Expressive Temporal Specifications for Reward Monitoring
par: Adalat, Omar, et autres
Publié: (2025)
par: Adalat, Omar, et autres
Publié: (2025)
Reward Design for Justifiable Sequential Decision-Making
par: Sukovic, Aleksa, et autres
Publié: (2024)
par: Sukovic, Aleksa, et autres
Publié: (2024)
Trust Region Reward Optimization and Proximal Inverse Reward Optimization Algorithm
par: Chen, Yang, et autres
Publié: (2025)
par: Chen, Yang, et autres
Publié: (2025)
Attention-Based Reward Shaping for Sparse and Delayed Rewards
par: Holmes, Ian, et autres
Publié: (2025)
par: Holmes, Ian, et autres
Publié: (2025)
Reward Hacking Mitigation using Verifiable Composite Rewards
par: Tarek, Mirza Farhan Bin, et autres
Publié: (2025)
par: Tarek, Mirza Farhan Bin, et autres
Publié: (2025)
Repairing Reward Functions with Feedback to Mitigate Reward Hacking
par: Hatgis-Kessell, Stephane, et autres
Publié: (2025)
par: Hatgis-Kessell, Stephane, et autres
Publié: (2025)
Intrinsic Reward Policy Optimization for Sparse-Reward Environments
par: Cho, Minjae, et autres
Publié: (2026)
par: Cho, Minjae, et autres
Publié: (2026)
Reinforcement Learning with Exogenous States and Rewards
par: Trimponias, George, et autres
Publié: (2023)
par: Trimponias, George, et autres
Publié: (2023)
Reinforcement Learning with Symbolic Reward Machines
par: Krug, Thomas, et autres
Publié: (2026)
par: Krug, Thomas, et autres
Publié: (2026)
Reward Learning From Preference With Ties
par: Liu, Jinsong, et autres
Publié: (2024)
par: Liu, Jinsong, et autres
Publié: (2024)
Reinforcement Learning with Stochastic Reward Machines
par: Corazza, Jan, et autres
Publié: (2025)
par: Corazza, Jan, et autres
Publié: (2025)
Offline Reinforcement Learning with Imputed Rewards
par: Romeo, Carlo, et autres
Publié: (2024)
par: Romeo, Carlo, et autres
Publié: (2024)
Reward Centering
par: Naik, Abhishek, et autres
Publié: (2024)
par: Naik, Abhishek, et autres
Publié: (2024)
The Reward Model Selection Crisis in Personalized Alignment
par: Rezk, Fady, et autres
Publié: (2025)
par: Rezk, Fady, et autres
Publié: (2025)
Adversarial Reward Auditing for Active Detection and Mitigation of Reward Hacking
par: Beigi, Mohammad, et autres
Publié: (2026)
par: Beigi, Mohammad, et autres
Publié: (2026)
Gradient Regularization Prevents Reward Hacking in Reinforcement Learning from Human Feedback and Verifiable Rewards
par: Ackermann, Johannes, et autres
Publié: (2026)
par: Ackermann, Johannes, et autres
Publié: (2026)
BCR-DRL: Behavior- and Context-aware Reward for Deep Reinforcement Learning in Human-AI Coordination
par: Hao, Xin, et autres
Publié: (2024)
par: Hao, Xin, et autres
Publié: (2024)
Mitigating Reward Over-Optimization in RLHF via Behavior-Supported Regularization
par: Dai, Juntao, et autres
Publié: (2025)
par: Dai, Juntao, et autres
Publié: (2025)
RewardAnything: Generalizable Principle-Following Reward Models
par: Yu, Zhuohao, et autres
Publié: (2025)
par: Yu, Zhuohao, et autres
Publié: (2025)
Beyond Reward Hacking: Causal Rewards for Large Language Model Alignment
par: Wang, Chaoqi, et autres
Publié: (2025)
par: Wang, Chaoqi, et autres
Publié: (2025)
Reward Learning from Best-of-$N$ Preference Data: Targets, Tradeoffs, and Design Principles
par: Pukdee, Rattana, et autres
Publié: (2026)
par: Pukdee, Rattana, et autres
Publié: (2026)
Design Conditions for Intra-Group Learning of Sequence-Level Rewards: Token Gradient Cancellation
par: Ding, Fei, et autres
Publié: (2026)
par: Ding, Fei, et autres
Publié: (2026)
GRPO is Secretly a Process Reward Model
par: Sullivan, Michael, et autres
Publié: (2025)
par: Sullivan, Michael, et autres
Publié: (2025)
Hierarchical Reward Design from Language: Enhancing Alignment of Agent Behavior with Human Specifications
par: Qian, Zhiqin, et autres
Publié: (2026)
par: Qian, Zhiqin, et autres
Publié: (2026)
Documents similaires
-
Which Rewards Matter? Reward Selection for Reinforcement Learning under Limited Feedback
par: Chaudhari, Shreyas, et autres
Publié: (2025) -
Rectifying Shortcut Behaviors in Preference-based Reward Learning
par: Ye, Wenqian, et autres
Publié: (2025) -
Global Rewards in Restless Multi-Armed Bandits
par: Raman, Naveen, et autres
Publié: (2024) -
Abstract Reward Processes: Leveraging State Abstraction for Consistent Off-Policy Evaluation
par: Chaudhari, Shreyas, et autres
Publié: (2024) -
Value of Information and Reward Specification in Active Inference and POMDPs
par: Wei, Ran
Publié: (2024)