Reward Design for Reinforcement Learning Agents
Fuente:
arXiv
Guardado en:
| Autor principal: | Devidze, Rati |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Informativeness of Reward Functions in Reinforcement Learning
por: Devidze, Rati, et al.
Publicado: (2024)
por: Devidze, Rati, et al.
Publicado: (2024)
RDA: Reward Design Agent for Reinforcement Learning
por: Lee, Hojoon, et al.
Publicado: (2026)
por: Lee, Hojoon, et al.
Publicado: (2026)
On Feasible Rewards in Multi-Agent Inverse Reinforcement Learning
por: Freihaut, Till, et al.
Publicado: (2024)
por: Freihaut, Till, et al.
Publicado: (2024)
Multi-Agent Reinforcement Learning with Submodular Reward
por: Chen, Wenjing, et al.
Publicado: (2026)
por: Chen, Wenjing, et al.
Publicado: (2026)
Reinforcing Multi-Turn Reasoning in LLM Agents via Turn-Level Reward Design
por: Wei, Quan, et al.
Publicado: (2025)
por: Wei, Quan, et al.
Publicado: (2025)
ROAD: Responsibility-Oriented Reward Design for Reinforcement Learning in Autonomous Driving
por: Chen, Yongming, et al.
Publicado: (2025)
por: Chen, Yongming, et al.
Publicado: (2025)
Preference-Guided Learning for Sparse-Reward Multi-Agent Reinforcement Learning
por: Bui, The Viet, et al.
Publicado: (2025)
por: Bui, The Viet, et al.
Publicado: (2025)
Reward-Conditioned Reinforcement Learning
por: Nauman, Michal, et al.
Publicado: (2026)
por: Nauman, Michal, et al.
Publicado: (2026)
Reward Modeling for Reinforcement Learning-Based LLM Reasoning: Design, Challenges, and Evaluation
por: Pan, Pei-Chi, et al.
Publicado: (2026)
por: Pan, Pei-Chi, et al.
Publicado: (2026)
Reinforcement Learning from Bagged Reward
por: Tang, Yuting, et al.
Publicado: (2024)
por: Tang, Yuting, et al.
Publicado: (2024)
The Value of Reward Lookahead in Reinforcement Learning
por: Merlis, Nadav, et al.
Publicado: (2024)
por: Merlis, Nadav, et al.
Publicado: (2024)
To the Max: Reinventing Reward in Reinforcement Learning
por: Veviurko, Grigorii, et al.
Publicado: (2024)
por: Veviurko, Grigorii, et al.
Publicado: (2024)
Redistributing Rewards Across Time and Agents for Multi-Agent Reinforcement Learning
por: Kapoor, Aditya, et al.
Publicado: (2025)
por: Kapoor, Aditya, et al.
Publicado: (2025)
Large Language Model Guided Incentive Aware Reward Design for Cooperative Multi-Agent Reinforcement Learning
por: Urgun, Dogan, et al.
Publicado: (2026)
por: Urgun, Dogan, et al.
Publicado: (2026)
Focal Reward: Balanced Reinforcement Learning under Rubric-Based Rewards
por: Huang, Yu, et al.
Publicado: (2026)
por: Huang, Yu, et al.
Publicado: (2026)
The Distributional Reward Critic Framework for Reinforcement Learning Under Perturbed Rewards
por: Chen, Xi, et al.
Publicado: (2024)
por: Chen, Xi, et al.
Publicado: (2024)
Reward-Independent Messaging for Decentralized Multi-Agent Reinforcement Learning
por: Yoshida, Naoto, et al.
Publicado: (2025)
por: Yoshida, Naoto, et al.
Publicado: (2025)
Multi-Agent Reinforcement Learning with a Hierarchy of Reward Machines
por: Zheng, Xuejing, et al.
Publicado: (2024)
por: Zheng, Xuejing, et al.
Publicado: (2024)
Explicit Credit Assignment through Local Rewards and Dependence Graphs in Multi-Agent Reinforcement Learning
por: Le, Bang Giang, et al.
Publicado: (2026)
por: Le, Bang Giang, et al.
Publicado: (2026)
Centralized Reward Agent for Knowledge Sharing and Transfer in Multi-Task Reinforcement Learning
por: Ma, Haozhe, et al.
Publicado: (2024)
por: Ma, Haozhe, et al.
Publicado: (2024)
Adapting the Behavior of Reinforcement Learning Agents to Changing Action Spaces and Reward Functions
por: de la Rosa, Raul, et al.
Publicado: (2026)
por: de la Rosa, Raul, et al.
Publicado: (2026)
Risk-Averse Total-Reward Reinforcement Learning
por: Su, Xihong, et al.
Publicado: (2025)
por: Su, Xihong, et al.
Publicado: (2025)
Reward-Aware Proto-Representations in Reinforcement Learning
por: Tse, Hon Tik, et al.
Publicado: (2025)
por: Tse, Hon Tik, et al.
Publicado: (2025)
Code as Reward: Empowering Reinforcement Learning with VLMs
por: Venuto, David, et al.
Publicado: (2024)
por: Venuto, David, et al.
Publicado: (2024)
Effective Reward Specification in Deep Reinforcement Learning
por: Roy, Julien
Publicado: (2024)
por: Roy, Julien
Publicado: (2024)
Reward-Preserving Attacks For Robust Reinforcement Learning
por: Schott, Lucas, et al.
Publicado: (2026)
por: Schott, Lucas, et al.
Publicado: (2026)
Binary Rewards and Reinforcement Learning: Fundamental Challenges
por: Dymetman, Marc
Publicado: (2026)
por: Dymetman, Marc
Publicado: (2026)
Reward-Zero: Language Embedding Driven Implicit Reward Mechanisms for Reinforcement Learning
por: Zhang, Heng, et al.
Publicado: (2026)
por: Zhang, Heng, et al.
Publicado: (2026)
Binary Reward Labeling: Bridging Offline Preference and Reward-Based Reinforcement Learning
por: Xu, Yinglun, et al.
Publicado: (2024)
por: Xu, Yinglun, et al.
Publicado: (2024)
RLVMR: Reinforcement Learning with Verifiable Meta-Reasoning Rewards for Robust Long-Horizon Agents
por: Zhang, Zijing, et al.
Publicado: (2025)
por: Zhang, Zijing, et al.
Publicado: (2025)
Beyond Simple Sum of Delayed Rewards: Non-Markovian Reward Modeling for Reinforcement Learning
por: Tang, Yuting, et al.
Publicado: (2024)
por: Tang, Yuting, et al.
Publicado: (2024)
A Large Language Model-Driven Reward Design Framework via Dynamic Feedback for Reinforcement Learning
por: Sun, Shengjie, et al.
Publicado: (2024)
por: Sun, Shengjie, et al.
Publicado: (2024)
Reinforcement Learning with Stochastic Reward Machines
por: Corazza, Jan, et al.
Publicado: (2025)
por: Corazza, Jan, et al.
Publicado: (2025)
Reinforcement Learning with Exogenous States and Rewards
por: Trimponias, George, et al.
Publicado: (2023)
por: Trimponias, George, et al.
Publicado: (2023)
Reinforcement Learning with Symbolic Reward Machines
por: Krug, Thomas, et al.
Publicado: (2026)
por: Krug, Thomas, et al.
Publicado: (2026)
Offline Reinforcement Learning with Imputed Rewards
por: Romeo, Carlo, et al.
Publicado: (2024)
por: Romeo, Carlo, et al.
Publicado: (2024)
Deep Reinforcement Learning with Hybrid Intrinsic Reward Model
por: Yuan, Mingqi, et al.
Publicado: (2025)
por: Yuan, Mingqi, et al.
Publicado: (2025)
Bayesian Inverse Reinforcement Learning for Non-Markovian Rewards
por: Topper, Noah, et al.
Publicado: (2024)
por: Topper, Noah, et al.
Publicado: (2024)
Asymmetric Prompt Weighting for Reinforcement Learning with Verifiable Rewards
por: Heckel, Reinhard, et al.
Publicado: (2026)
por: Heckel, Reinhard, et al.
Publicado: (2026)
Curriculum Reinforcement Learning for Complex Reward Functions
por: Freitag, Kilian, et al.
Publicado: (2024)
por: Freitag, Kilian, et al.
Publicado: (2024)
Ejemplares similares
-
Informativeness of Reward Functions in Reinforcement Learning
por: Devidze, Rati, et al.
Publicado: (2024) -
RDA: Reward Design Agent for Reinforcement Learning
por: Lee, Hojoon, et al.
Publicado: (2026) -
On Feasible Rewards in Multi-Agent Inverse Reinforcement Learning
por: Freihaut, Till, et al.
Publicado: (2024) -
Multi-Agent Reinforcement Learning with Submodular Reward
por: Chen, Wenjing, et al.
Publicado: (2026) -
Reinforcing Multi-Turn Reasoning in LLM Agents via Turn-Level Reward Design
por: Wei, Quan, et al.
Publicado: (2025)