The Distributional Reward Critic Framework for Reinforcement Learning Under Perturbed Rewards
Fuente:
arXiv
Guardado en:
| Autores principales: | Chen, Xi, Zhu, Zhihui, Perrault, Andrew |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Normality-Guided Distributional Reinforcement Learning for Continuous Control
por: Byun, Ju-Seung, et al.
Publicado: (2022)
por: Byun, Ju-Seung, et al.
Publicado: (2022)
Sharper Perturbed-Kullback-Leibler Exponential Tail Bounds for Beta and Dirichlet Distributions
por: Perrault, Pierre
Publicado: (2025)
por: Perrault, Pierre
Publicado: (2025)
Binary Reward Labeling: Bridging Offline Preference and Reward-Based Reinforcement Learning
por: Xu, Yinglun, et al.
Publicado: (2024)
por: Xu, Yinglun, et al.
Publicado: (2024)
Offline Reinforcement Learning with Imputed Rewards
por: Romeo, Carlo, et al.
Publicado: (2024)
por: Romeo, Carlo, et al.
Publicado: (2024)
Sample Complexity of Distributionally Robust Average-Reward Reinforcement Learning
por: Chen, Zijun, et al.
Publicado: (2025)
por: Chen, Zijun, et al.
Publicado: (2025)
Diffusion Reinforcement Learning via Centered Reward Distillation
por: Zhu, Yuanzhi, et al.
Publicado: (2026)
por: Zhu, Yuanzhi, et al.
Publicado: (2026)
Reward-Conditioned Reinforcement Learning
por: Nauman, Michal, et al.
Publicado: (2026)
por: Nauman, Michal, et al.
Publicado: (2026)
Optimizing Resource-Constrained Non-Pharmaceutical Interventions for Multi-Cluster Outbreak Control Using Hierarchical Reinforcement Learning
por: Peng, Xueqiao, et al.
Publicado: (2026)
por: Peng, Xueqiao, et al.
Publicado: (2026)
ROAD: Responsibility-Oriented Reward Design for Reinforcement Learning in Autonomous Driving
por: Chen, Yongming, et al.
Publicado: (2025)
por: Chen, Yongming, et al.
Publicado: (2025)
Focal Reward: Balanced Reinforcement Learning under Rubric-Based Rewards
por: Huang, Yu, et al.
Publicado: (2026)
por: Huang, Yu, et al.
Publicado: (2026)
Exploration by Random Reward Perturbation
por: Ma, Haozhe, et al.
Publicado: (2025)
por: Ma, Haozhe, et al.
Publicado: (2025)
medR: Reward Engineering for Clinical Offline Reinforcement Learning via Tri-Drive Potential Functions
por: Xu, Qianyi, et al.
Publicado: (2026)
por: Xu, Qianyi, et al.
Publicado: (2026)
Symmetric Reinforcement Learning Loss for Robust Learning on Diverse Tasks and Model Scales
por: Byun, Ju-Seung, et al.
Publicado: (2024)
por: Byun, Ju-Seung, et al.
Publicado: (2024)
Reward-Zero: Language Embedding Driven Implicit Reward Mechanisms for Reinforcement Learning
por: Zhang, Heng, et al.
Publicado: (2026)
por: Zhang, Heng, et al.
Publicado: (2026)
Reinforcement Learning from Bagged Reward
por: Tang, Yuting, et al.
Publicado: (2024)
por: Tang, Yuting, et al.
Publicado: (2024)
The Value of Reward Lookahead in Reinforcement Learning
por: Merlis, Nadav, et al.
Publicado: (2024)
por: Merlis, Nadav, et al.
Publicado: (2024)
Informativeness of Reward Functions in Reinforcement Learning
por: Devidze, Rati, et al.
Publicado: (2024)
por: Devidze, Rati, et al.
Publicado: (2024)
To the Max: Reinventing Reward in Reinforcement Learning
por: Veviurko, Grigorii, et al.
Publicado: (2024)
por: Veviurko, Grigorii, et al.
Publicado: (2024)
Reward Design for Reinforcement Learning Agents
por: Devidze, Rati
Publicado: (2025)
por: Devidze, Rati
Publicado: (2025)
Constraints as Rewards: Reinforcement Learning for Robots without Reward Functions
por: Ishihara, Yu, et al.
Publicado: (2025)
por: Ishihara, Yu, et al.
Publicado: (2025)
Towards a Reward-Free Reinforcement Learning Framework for Vehicle Control
por: Yang, Jielong, et al.
Publicado: (2025)
por: Yang, Jielong, et al.
Publicado: (2025)
Beyond Simple Sum of Delayed Rewards: Non-Markovian Reward Modeling for Reinforcement Learning
por: Tang, Yuting, et al.
Publicado: (2024)
por: Tang, Yuting, et al.
Publicado: (2024)
Noisy Data is Destructive to Reinforcement Learning with Verifiable Rewards
por: Zhu, Yuxuan, et al.
Publicado: (2026)
por: Zhu, Yuxuan, et al.
Publicado: (2026)
Reward Under Attack: Analyzing the Robustness and Hackability of Process Reward Models
por: Tiwari, Rishabh, et al.
Publicado: (2026)
por: Tiwari, Rishabh, et al.
Publicado: (2026)
Multi-Objective and Mixed-Reward Reinforcement Learning via Reward-Decorrelated Policy Optimization
por: Bai, Yang, et al.
Publicado: (2026)
por: Bai, Yang, et al.
Publicado: (2026)
Efficient $Q$-Learning and Actor-Critic Methods for Robust Average Reward Reinforcement Learning
por: Xu, Yang, et al.
Publicado: (2025)
por: Xu, Yang, et al.
Publicado: (2025)
Code as Reward: Empowering Reinforcement Learning with VLMs
por: Venuto, David, et al.
Publicado: (2024)
por: Venuto, David, et al.
Publicado: (2024)
Effective Reward Specification in Deep Reinforcement Learning
por: Roy, Julien
Publicado: (2024)
por: Roy, Julien
Publicado: (2024)
Risk-Averse Total-Reward Reinforcement Learning
por: Su, Xihong, et al.
Publicado: (2025)
por: Su, Xihong, et al.
Publicado: (2025)
Reward-Preserving Attacks For Robust Reinforcement Learning
por: Schott, Lucas, et al.
Publicado: (2026)
por: Schott, Lucas, et al.
Publicado: (2026)
Reward-Aware Proto-Representations in Reinforcement Learning
por: Tse, Hon Tik, et al.
Publicado: (2025)
por: Tse, Hon Tik, et al.
Publicado: (2025)
RDA: Reward Design Agent for Reinforcement Learning
por: Lee, Hojoon, et al.
Publicado: (2026)
por: Lee, Hojoon, et al.
Publicado: (2026)
Binary Rewards and Reinforcement Learning: Fundamental Challenges
por: Dymetman, Marc
Publicado: (2026)
por: Dymetman, Marc
Publicado: (2026)
Text2Reward: Reward Shaping with Language Models for Reinforcement Learning
por: Xie, Tianbao, et al.
Publicado: (2023)
por: Xie, Tianbao, et al.
Publicado: (2023)
Loss- and Reward-Weighting for Efficient Distributed Reinforcement Learning
por: Holen, Martin, et al.
Publicado: (2023)
por: Holen, Martin, et al.
Publicado: (2023)
Analyzing and Bridging the Gap between Maximizing Total Reward and Discounted Reward in Deep Reinforcement Learning
por: Yin, Shuyu, et al.
Publicado: (2024)
por: Yin, Shuyu, et al.
Publicado: (2024)
Dynamic Reward Adjustment in Multi-Reward Reinforcement Learning for Counselor Reflection Generation
por: Min, Do June, et al.
Publicado: (2024)
por: Min, Do June, et al.
Publicado: (2024)
Which Rewards Matter? Reward Selection for Reinforcement Learning under Limited Feedback
por: Chaudhari, Shreyas, et al.
Publicado: (2025)
por: Chaudhari, Shreyas, et al.
Publicado: (2025)
Reinforcement Learning From Imperfect Corrective Actions And Proxy Rewards
por: Jiang, Zhaohui, et al.
Publicado: (2024)
por: Jiang, Zhaohui, et al.
Publicado: (2024)
Reinforcement Learning with Exogenous States and Rewards
por: Trimponias, George, et al.
Publicado: (2023)
por: Trimponias, George, et al.
Publicado: (2023)
Ejemplares similares
-
Normality-Guided Distributional Reinforcement Learning for Continuous Control
por: Byun, Ju-Seung, et al.
Publicado: (2022) -
Sharper Perturbed-Kullback-Leibler Exponential Tail Bounds for Beta and Dirichlet Distributions
por: Perrault, Pierre
Publicado: (2025) -
Binary Reward Labeling: Bridging Offline Preference and Reward-Based Reinforcement Learning
por: Xu, Yinglun, et al.
Publicado: (2024) -
Offline Reinforcement Learning with Imputed Rewards
por: Romeo, Carlo, et al.
Publicado: (2024) -
Sample Complexity of Distributionally Robust Average-Reward Reinforcement Learning
por: Chen, Zijun, et al.
Publicado: (2025)