Reward-Zero: Language Embedding Driven Implicit Reward Mechanisms for Reinforcement Learning
Fuente:
arXiv
Salvato in:
| Autori principali: | Zhang, Heng, Alchaer, Haddy, Ajoudani, Arash, She, Yu |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Bresa: Bio-inspired Reflexive Safe Reinforcement Learning for Contact-Rich Robotic Tasks
di: Zhang, Heng, et al.
Pubblicazione: (2025)
di: Zhang, Heng, et al.
Pubblicazione: (2025)
Process Reinforcement through Implicit Rewards
di: Cui, Ganqu, et al.
Pubblicazione: (2025)
di: Cui, Ganqu, et al.
Pubblicazione: (2025)
Parent-Guided Semantic Reward Model (PGSRM): Embedding-Based Reward Functions for Reinforcement Learning of Transformer Language Models
di: Plashchinsky, Alexandr
Pubblicazione: (2025)
di: Plashchinsky, Alexandr
Pubblicazione: (2025)
Vision-Language Models are Zero-Shot Reward Models for Reinforcement Learning
di: Rocamonde, Juan, et al.
Pubblicazione: (2023)
di: Rocamonde, Juan, et al.
Pubblicazione: (2023)
Goal-Driven Reward by Video Diffusion Models for Reinforcement Learning
di: Wang, Qi, et al.
Pubblicazione: (2025)
di: Wang, Qi, et al.
Pubblicazione: (2025)
Focal Reward: Balanced Reinforcement Learning under Rubric-Based Rewards
di: Huang, Yu, et al.
Pubblicazione: (2026)
di: Huang, Yu, et al.
Pubblicazione: (2026)
Text2Reward: Reward Shaping with Language Models for Reinforcement Learning
di: Xie, Tianbao, et al.
Pubblicazione: (2023)
di: Xie, Tianbao, et al.
Pubblicazione: (2023)
Zero Shot Coordination for Sparse Reward Tasks with Diverse Reward Shapings
di: Powell, Keenan, et al.
Pubblicazione: (2026)
di: Powell, Keenan, et al.
Pubblicazione: (2026)
Constraints as Rewards: Reinforcement Learning for Robots without Reward Functions
di: Ishihara, Yu, et al.
Pubblicazione: (2025)
di: Ishihara, Yu, et al.
Pubblicazione: (2025)
Bootstrapping Language Models with DPO Implicit Rewards
di: Chen, Changyu, et al.
Pubblicazione: (2024)
di: Chen, Changyu, et al.
Pubblicazione: (2024)
Reward-Conditioned Reinforcement Learning
di: Nauman, Michal, et al.
Pubblicazione: (2026)
di: Nauman, Michal, et al.
Pubblicazione: (2026)
Implicit Updates for Average-Reward Temporal Difference Learning
di: Kim, Hwanwoo, et al.
Pubblicazione: (2025)
di: Kim, Hwanwoo, et al.
Pubblicazione: (2025)
A Large Language Model-Driven Reward Design Framework via Dynamic Feedback for Reinforcement Learning
di: Sun, Shengjie, et al.
Pubblicazione: (2024)
di: Sun, Shengjie, et al.
Pubblicazione: (2024)
The Distributional Reward Critic Framework for Reinforcement Learning Under Perturbed Rewards
di: Chen, Xi, et al.
Pubblicazione: (2024)
di: Chen, Xi, et al.
Pubblicazione: (2024)
Reward-RAG: Enhancing RAG with Reward Driven Supervision
di: Nguyen, Thang, et al.
Pubblicazione: (2024)
di: Nguyen, Thang, et al.
Pubblicazione: (2024)
Adaptive Rollout Allocation for Online Reinforcement Learning with Verifiable Rewards
di: Nguyen, Hieu Trung, et al.
Pubblicazione: (2026)
di: Nguyen, Hieu Trung, et al.
Pubblicazione: (2026)
Diffusion Classifier-Driven Reward for Offline Preference-based Reinforcement Learning
di: Pang, Teng, et al.
Pubblicazione: (2025)
di: Pang, Teng, et al.
Pubblicazione: (2025)
Unsupervised Zero-Shot Reinforcement Learning via Functional Reward Encodings
di: Frans, Kevin, et al.
Pubblicazione: (2024)
di: Frans, Kevin, et al.
Pubblicazione: (2024)
Binary Reward Labeling: Bridging Offline Preference and Reward-Based Reinforcement Learning
di: Xu, Yinglun, et al.
Pubblicazione: (2024)
di: Xu, Yinglun, et al.
Pubblicazione: (2024)
The Implicit Curriculum: Learning Dynamics in RL with Verifiable Rewards
di: Huang, Yu, et al.
Pubblicazione: (2026)
di: Huang, Yu, et al.
Pubblicazione: (2026)
Reinforcement Learning from Bagged Reward
di: Tang, Yuting, et al.
Pubblicazione: (2024)
di: Tang, Yuting, et al.
Pubblicazione: (2024)
The Value of Reward Lookahead in Reinforcement Learning
di: Merlis, Nadav, et al.
Pubblicazione: (2024)
di: Merlis, Nadav, et al.
Pubblicazione: (2024)
Informativeness of Reward Functions in Reinforcement Learning
di: Devidze, Rati, et al.
Pubblicazione: (2024)
di: Devidze, Rati, et al.
Pubblicazione: (2024)
Reward Design for Reinforcement Learning Agents
di: Devidze, Rati
Pubblicazione: (2025)
di: Devidze, Rati
Pubblicazione: (2025)
To the Max: Reinventing Reward in Reinforcement Learning
di: Veviurko, Grigorii, et al.
Pubblicazione: (2024)
di: Veviurko, Grigorii, et al.
Pubblicazione: (2024)
Which Rewards Matter? Reward Selection for Reinforcement Learning under Limited Feedback
di: Chaudhari, Shreyas, et al.
Pubblicazione: (2025)
di: Chaudhari, Shreyas, et al.
Pubblicazione: (2025)
LLM-Driven Intrinsic Motivation for Sparse Reward Reinforcement Learning
di: Quadros, André, et al.
Pubblicazione: (2025)
di: Quadros, André, et al.
Pubblicazione: (2025)
Reinforcement Learning for Infinite-Horizon Average-Reward Linear MDPs via Approximation by Discounted-Reward MDPs
di: Hong, Kihyuk, et al.
Pubblicazione: (2024)
di: Hong, Kihyuk, et al.
Pubblicazione: (2024)
Beyond Simple Sum of Delayed Rewards: Non-Markovian Reward Modeling for Reinforcement Learning
di: Tang, Yuting, et al.
Pubblicazione: (2024)
di: Tang, Yuting, et al.
Pubblicazione: (2024)
Efficient Reinforcement Learning in Probabilistic Reward Machines
di: Lin, Xiaofeng, et al.
Pubblicazione: (2024)
di: Lin, Xiaofeng, et al.
Pubblicazione: (2024)
SSR-Zero: Simple Self-Rewarding Reinforcement Learning for Machine Translation
di: Yang, Wenjie, et al.
Pubblicazione: (2025)
di: Yang, Wenjie, et al.
Pubblicazione: (2025)
Reward Models in Deep Reinforcement Learning: A Survey
di: Yu, Rui, et al.
Pubblicazione: (2025)
di: Yu, Rui, et al.
Pubblicazione: (2025)
From Reward-Free Representations to Preferences: Rethinking Offline Preference-Based Reinforcement Learning
di: Yang, Jun-Jie, et al.
Pubblicazione: (2026)
di: Yang, Jun-Jie, et al.
Pubblicazione: (2026)
Reward-Preserving Attacks For Robust Reinforcement Learning
di: Schott, Lucas, et al.
Pubblicazione: (2026)
di: Schott, Lucas, et al.
Pubblicazione: (2026)
RDA: Reward Design Agent for Reinforcement Learning
di: Lee, Hojoon, et al.
Pubblicazione: (2026)
di: Lee, Hojoon, et al.
Pubblicazione: (2026)
Binary Rewards and Reinforcement Learning: Fundamental Challenges
di: Dymetman, Marc
Pubblicazione: (2026)
di: Dymetman, Marc
Pubblicazione: (2026)
Code as Reward: Empowering Reinforcement Learning with VLMs
di: Venuto, David, et al.
Pubblicazione: (2024)
di: Venuto, David, et al.
Pubblicazione: (2024)
Effective Reward Specification in Deep Reinforcement Learning
di: Roy, Julien
Pubblicazione: (2024)
di: Roy, Julien
Pubblicazione: (2024)
Risk-Averse Total-Reward Reinforcement Learning
di: Su, Xihong, et al.
Pubblicazione: (2025)
di: Su, Xihong, et al.
Pubblicazione: (2025)
Reward-Aware Proto-Representations in Reinforcement Learning
di: Tse, Hon Tik, et al.
Pubblicazione: (2025)
di: Tse, Hon Tik, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Bresa: Bio-inspired Reflexive Safe Reinforcement Learning for Contact-Rich Robotic Tasks
di: Zhang, Heng, et al.
Pubblicazione: (2025) -
Process Reinforcement through Implicit Rewards
di: Cui, Ganqu, et al.
Pubblicazione: (2025) -
Parent-Guided Semantic Reward Model (PGSRM): Embedding-Based Reward Functions for Reinforcement Learning of Transformer Language Models
di: Plashchinsky, Alexandr
Pubblicazione: (2025) -
Vision-Language Models are Zero-Shot Reward Models for Reinforcement Learning
di: Rocamonde, Juan, et al.
Pubblicazione: (2023) -
Goal-Driven Reward by Video Diffusion Models for Reinforcement Learning
di: Wang, Qi, et al.
Pubblicazione: (2025)