RDA: Reward Design Agent for Reinforcement Learning
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Lee, Hojoon, Subramanian, Ajay, Abbatematteo, Ben, Veerabadran, Vijay, Matias, Pedro, Ridgeway, Karl, Kamra, Nitin |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2026
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Benchmarking Egocentric Multimodal Goal Inference for Assistive Wearable Agents
von: Veerabadran, Vijay, et al.
Veröffentlicht: (2025)
von: Veerabadran, Vijay, et al.
Veröffentlicht: (2025)
A Champion-level Vision-based Reinforcement Learning Agent for Competitive Racing in Gran Turismo 7
von: Lee, Hojoon, et al.
Veröffentlicht: (2025)
von: Lee, Hojoon, et al.
Veröffentlicht: (2025)
Reward Design for Reinforcement Learning Agents
von: Devidze, Rati
Veröffentlicht: (2025)
von: Devidze, Rati
Veröffentlicht: (2025)
Hyperspherical Normalization for Scalable Deep Reinforcement Learning
von: Lee, Hojoon, et al.
Veröffentlicht: (2025)
von: Lee, Hojoon, et al.
Veröffentlicht: (2025)
Deep Reinforcement Learning for Robotics: A Survey of Real-World Successes
von: Tang, Chen, et al.
Veröffentlicht: (2024)
von: Tang, Chen, et al.
Veröffentlicht: (2024)
Synthetic Captions for Open-Vocabulary Zero-Shot Segmentation
von: Lebailly, Tim, et al.
Veröffentlicht: (2025)
von: Lebailly, Tim, et al.
Veröffentlicht: (2025)
Investigating Pre-Training Objectives for Generalization in Vision-Based Reinforcement Learning
von: Kim, Donghu, et al.
Veröffentlicht: (2024)
von: Kim, Donghu, et al.
Veröffentlicht: (2024)
Learning to Look: Seeking Information for Decision Making via Policy Factorization
von: Dass, Shivin, et al.
Veröffentlicht: (2024)
von: Dass, Shivin, et al.
Veröffentlicht: (2024)
Bayesian Learning of Optimal Policies in Markov Decision Processes with Countably Infinite State-Space
von: Adler, Saghar, et al.
Veröffentlicht: (2023)
von: Adler, Saghar, et al.
Veröffentlicht: (2023)
SimBa: Simplicity Bias for Scaling Up Parameters in Deep Reinforcement Learning
von: Lee, Hojoon, et al.
Veröffentlicht: (2024)
von: Lee, Hojoon, et al.
Veröffentlicht: (2024)
On Feasible Rewards in Multi-Agent Inverse Reinforcement Learning
von: Freihaut, Till, et al.
Veröffentlicht: (2024)
von: Freihaut, Till, et al.
Veröffentlicht: (2024)
Quotient-Categorical Representations for Bellman-Compatible Average-Reward Distributional Reinforcement Learning
von: Kaya, Ege C., et al.
Veröffentlicht: (2026)
von: Kaya, Ege C., et al.
Veröffentlicht: (2026)
Multi-Agent Reinforcement Learning with Submodular Reward
von: Chen, Wenjing, et al.
Veröffentlicht: (2026)
von: Chen, Wenjing, et al.
Veröffentlicht: (2026)
AgenticCache: Cache-Driven Asynchronous Planning for Embodied AI Agents
von: Kim, Hojoon, et al.
Veröffentlicht: (2026)
von: Kim, Hojoon, et al.
Veröffentlicht: (2026)
DigiData: Training and Evaluating General-Purpose Mobile Control Agents
von: Sun, Yuxuan, et al.
Veröffentlicht: (2025)
von: Sun, Yuxuan, et al.
Veröffentlicht: (2025)
Reinforcing Multi-Turn Reasoning in LLM Agents via Turn-Level Reward Design
von: Wei, Quan, et al.
Veröffentlicht: (2025)
von: Wei, Quan, et al.
Veröffentlicht: (2025)
On-Robot Reinforcement Learning with Goal-Contrastive Rewards
von: Biza, Ondrej, et al.
Veröffentlicht: (2024)
von: Biza, Ondrej, et al.
Veröffentlicht: (2024)
Representation Stability in a Minimal Continual Learning Agent
von: Subramanian, Vishnu
Veröffentlicht: (2026)
von: Subramanian, Vishnu
Veröffentlicht: (2026)
EgoToM: Benchmarking Theory of Mind Reasoning from Egocentric Videos
von: Li, Yuxuan, et al.
Veröffentlicht: (2025)
von: Li, Yuxuan, et al.
Veröffentlicht: (2025)
ROAD: Responsibility-Oriented Reward Design for Reinforcement Learning in Autonomous Driving
von: Chen, Yongming, et al.
Veröffentlicht: (2025)
von: Chen, Yongming, et al.
Veröffentlicht: (2025)
Learning to Admit Optimally in an $M/M/k/k+N$ Queueing System with Unknown Service Rate
von: Adler, Saghar, et al.
Veröffentlicht: (2022)
von: Adler, Saghar, et al.
Veröffentlicht: (2022)
Generalized Intention Modeling in Multi-Agent Reinforcement Learning
von: Odrowaz-Sypniewski, Mateusz, et al.
Veröffentlicht: (2026)
von: Odrowaz-Sypniewski, Mateusz, et al.
Veröffentlicht: (2026)
Preference-Guided Learning for Sparse-Reward Multi-Agent Reinforcement Learning
von: Bui, The Viet, et al.
Veröffentlicht: (2025)
von: Bui, The Viet, et al.
Veröffentlicht: (2025)
Reward-Conditioned Reinforcement Learning
von: Nauman, Michal, et al.
Veröffentlicht: (2026)
von: Nauman, Michal, et al.
Veröffentlicht: (2026)
Reward Modeling for Reinforcement Learning-Based LLM Reasoning: Design, Challenges, and Evaluation
von: Pan, Pei-Chi, et al.
Veröffentlicht: (2026)
von: Pan, Pei-Chi, et al.
Veröffentlicht: (2026)
Reinforcement Learning for Infinite-Horizon Average-Reward Linear MDPs via Approximation by Discounted-Reward MDPs
von: Hong, Kihyuk, et al.
Veröffentlicht: (2024)
von: Hong, Kihyuk, et al.
Veröffentlicht: (2024)
DecDEC: A Systems Approach to Advancing Low-Bit LLM Quantization
von: Park, Yeonhong, et al.
Veröffentlicht: (2024)
von: Park, Yeonhong, et al.
Veröffentlicht: (2024)
Do's and Don'ts: Learning Desirable Skills with Instruction Videos
von: Kim, Hyunseung, et al.
Veröffentlicht: (2024)
von: Kim, Hyunseung, et al.
Veröffentlicht: (2024)
Can Large Language Models Develop Strategic Reasoning? Post-training Insights from Learning Chess
von: Hwang, Dongyoon, et al.
Veröffentlicht: (2025)
von: Hwang, Dongyoon, et al.
Veröffentlicht: (2025)
Reinforcement Learning from Bagged Reward
von: Tang, Yuting, et al.
Veröffentlicht: (2024)
von: Tang, Yuting, et al.
Veröffentlicht: (2024)
The Value of Reward Lookahead in Reinforcement Learning
von: Merlis, Nadav, et al.
Veröffentlicht: (2024)
von: Merlis, Nadav, et al.
Veröffentlicht: (2024)
Informativeness of Reward Functions in Reinforcement Learning
von: Devidze, Rati, et al.
Veröffentlicht: (2024)
von: Devidze, Rati, et al.
Veröffentlicht: (2024)
To the Max: Reinventing Reward in Reinforcement Learning
von: Veviurko, Grigorii, et al.
Veröffentlicht: (2024)
von: Veviurko, Grigorii, et al.
Veröffentlicht: (2024)
Redistributing Rewards Across Time and Agents for Multi-Agent Reinforcement Learning
von: Kapoor, Aditya, et al.
Veröffentlicht: (2025)
von: Kapoor, Aditya, et al.
Veröffentlicht: (2025)
Large Language Model Guided Incentive Aware Reward Design for Cooperative Multi-Agent Reinforcement Learning
von: Urgun, Dogan, et al.
Veröffentlicht: (2026)
von: Urgun, Dogan, et al.
Veröffentlicht: (2026)
Focal Reward: Balanced Reinforcement Learning under Rubric-Based Rewards
von: Huang, Yu, et al.
Veröffentlicht: (2026)
von: Huang, Yu, et al.
Veröffentlicht: (2026)
The Distributional Reward Critic Framework for Reinforcement Learning Under Perturbed Rewards
von: Chen, Xi, et al.
Veröffentlicht: (2024)
von: Chen, Xi, et al.
Veröffentlicht: (2024)
The Trajectory Alignment Coefficient in Two Acts: From Reward Tuning to Reward Learning
von: Muslimani, Calarina, et al.
Veröffentlicht: (2026)
von: Muslimani, Calarina, et al.
Veröffentlicht: (2026)
Reward-Independent Messaging for Decentralized Multi-Agent Reinforcement Learning
von: Yoshida, Naoto, et al.
Veröffentlicht: (2025)
von: Yoshida, Naoto, et al.
Veröffentlicht: (2025)
Multi-Agent Reinforcement Learning with a Hierarchy of Reward Machines
von: Zheng, Xuejing, et al.
Veröffentlicht: (2024)
von: Zheng, Xuejing, et al.
Veröffentlicht: (2024)
Ähnliche Einträge
-
Benchmarking Egocentric Multimodal Goal Inference for Assistive Wearable Agents
von: Veerabadran, Vijay, et al.
Veröffentlicht: (2025) -
A Champion-level Vision-based Reinforcement Learning Agent for Competitive Racing in Gran Turismo 7
von: Lee, Hojoon, et al.
Veröffentlicht: (2025) -
Reward Design for Reinforcement Learning Agents
von: Devidze, Rati
Veröffentlicht: (2025) -
Hyperspherical Normalization for Scalable Deep Reinforcement Learning
von: Lee, Hojoon, et al.
Veröffentlicht: (2025) -
Deep Reinforcement Learning for Robotics: A Survey of Real-World Successes
von: Tang, Chen, et al.
Veröffentlicht: (2024)