Self-correcting Reward Shaping via Language Models for Reinforcement Learning Agents in Games
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Afonso, António, Leite, Iolanda, Sestini, Alessandro, Fuchs, Florian, Tollmar, Konrad, Gisslén, Linus |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
TROFI: Trajectory-Ranked Offline Inverse Reinforcement Learning
par: Sestini, Alessandro, et autres
Publié: (2025)
par: Sestini, Alessandro, et autres
Publié: (2025)
Using Deep Convolutional Neural Networks to Detect Rendered Glitches in Video Games
par: Ling, Carlos Garcia, et autres
Publié: (2024)
par: Ling, Carlos Garcia, et autres
Publié: (2024)
Improving Generalization in Game Agents with Data Augmentation in Imitation Learning
par: Yadgaroff, Derek, et autres
Publié: (2023)
par: Yadgaroff, Derek, et autres
Publié: (2023)
Human-Like Goalkeeping in a Realistic Football Simulation: a Sample-Efficient Reinforcement Learning Approach
par: Sestini, Alessandro, et autres
Publié: (2025)
par: Sestini, Alessandro, et autres
Publié: (2025)
Real-Time Diffusion Policies for Games: Enhancing Consistency Policies with Q-Ensembles
par: Zhang, Ruoqi, et autres
Publié: (2025)
par: Zhang, Ruoqi, et autres
Publié: (2025)
Reinforcement Learning for High-Level Strategic Control in Tower Defense Games
par: Bergdahl, Joakim, et autres
Publié: (2024)
par: Bergdahl, Joakim, et autres
Publié: (2024)
Leveraging Large Language Models for Efficient Failure Analysis in Game Development
par: Marini, Leonardo, et autres
Publié: (2024)
par: Marini, Leonardo, et autres
Publié: (2024)
Towards Better Sample Efficiency in Multi-Agent Reinforcement Learning via Exploration
par: Baghi, Amir, et autres
Publié: (2025)
par: Baghi, Amir, et autres
Publié: (2025)
A Benchmark Environment for Offline Reinforcement Learning in Racing Games
par: Macaluso, Girolamo, et autres
Publié: (2024)
par: Macaluso, Girolamo, et autres
Publié: (2024)
ARMS: Automatic Reward Shaping for Sparse-Reward Multi-Agent Reinforcement Learning
par: Abboud, Elie, et autres
Publié: (2026)
par: Abboud, Elie, et autres
Publié: (2026)
Text2Reward: Reward Shaping with Language Models for Reinforcement Learning
par: Xie, Tianbao, et autres
Publié: (2023)
par: Xie, Tianbao, et autres
Publié: (2023)
Highly Efficient Self-Adaptive Reward Shaping for Reinforcement Learning
par: Ma, Haozhe, et autres
Publié: (2024)
par: Ma, Haozhe, et autres
Publié: (2024)
Extracting Heuristics from Large Language Models for Reward Shaping in Reinforcement Learning
par: Bhambri, Siddhant, et autres
Publié: (2024)
par: Bhambri, Siddhant, et autres
Publié: (2024)
Think in Games: Learning to Reason in Games via Reinforcement Learning with Large Language Models
par: Liao, Yi, et autres
Publié: (2025)
par: Liao, Yi, et autres
Publié: (2025)
Principal-Agent Reward Shaping in MDPs
par: Ben-Porat, Omer, et autres
Publié: (2023)
par: Ben-Porat, Omer, et autres
Publié: (2023)
Self-Consistency of the Internal Reward Models Improves Self-Rewarding Language Models
par: Zhou, Xin, et autres
Publié: (2025)
par: Zhou, Xin, et autres
Publié: (2025)
SPEQ: Offline Stabilization Phases for Efficient Q-Learning in High Update-To-Data Ratio Reinforcement Learning
par: Romeo, Carlo, et autres
Publié: (2025)
par: Romeo, Carlo, et autres
Publié: (2025)
Reward Generation via Large Vision-Language Model in Offline Reinforcement Learning
par: Lee, Younghwan, et autres
Publié: (2025)
par: Lee, Younghwan, et autres
Publié: (2025)
Subgoal-based Reward Shaping to Improve Efficiency in Reinforcement Learning
par: Okudo, Takato, et autres
Publié: (2021)
par: Okudo, Takato, et autres
Publié: (2021)
RLSR: Reinforcement Learning from Self Reward
par: Simonds, Toby, et autres
Publié: (2025)
par: Simonds, Toby, et autres
Publié: (2025)
Learning Reward for Robot Skills Using Large Language Models via Self-Alignment
par: Zeng, Yuwei, et autres
Publié: (2024)
par: Zeng, Yuwei, et autres
Publié: (2024)
Cooperative Reward Shaping for Multi-Agent Pathfinding
par: Song, Zhenyu, et autres
Publié: (2024)
par: Song, Zhenyu, et autres
Publié: (2024)
Self-Rewarding Language Models
par: Yuan, Weizhe, et autres
Publié: (2024)
par: Yuan, Weizhe, et autres
Publié: (2024)
Model-Based Reinforcement Learning in Discrete-Action Non-Markovian Reward Decision Processes
par: Trapasso, Alessandro, et autres
Publié: (2025)
par: Trapasso, Alessandro, et autres
Publié: (2025)
On the Sample Efficiency of Abstractions and Potential-Based Reward Shaping in Reinforcement Learning
par: Canonaco, Giuseppe, et autres
Publié: (2024)
par: Canonaco, Giuseppe, et autres
Publié: (2024)
Shaping Sparse Rewards in Reinforcement Learning: A Semi-supervised Approach
par: Li, Wenyun, et autres
Publié: (2025)
par: Li, Wenyun, et autres
Publié: (2025)
Vision-Language Models are Zero-Shot Reward Models for Reinforcement Learning
par: Rocamonde, Juan, et autres
Publié: (2023)
par: Rocamonde, Juan, et autres
Publié: (2023)
Multi-Agent Collaborative Reward Design for Enhancing Reasoning in Reinforcement Learning
par: Yang, Pei, et autres
Publié: (2025)
par: Yang, Pei, et autres
Publié: (2025)
Language Agents with Reinforcement Learning for Strategic Play in the Werewolf Game
par: Xu, Zelai, et autres
Publié: (2023)
par: Xu, Zelai, et autres
Publié: (2023)
Improving Conditional Level Generation using Automated Validation in Match-3 Games
par: Aylagas, Monica Villanueva, et autres
Publié: (2024)
par: Aylagas, Monica Villanueva, et autres
Publié: (2024)
AI for Handball: predicting and explaining the 2024 Olympic Games tournament with Deep Learning and Large Language Models
par: Felice, Florian
Publié: (2024)
par: Felice, Florian
Publié: (2024)
TextGames: Learning to Self-Play Text-Based Puzzle Games via Language Model Reasoning
par: Hudi, Frederikus, et autres
Publié: (2025)
par: Hudi, Frederikus, et autres
Publié: (2025)
PyTAG: Tabletop Games for Multi-Agent Reinforcement Learning
par: Balla, Martin, et autres
Publié: (2024)
par: Balla, Martin, et autres
Publié: (2024)
Enhancing Inverse Reinforcement Learning through Encoding Dynamic Information in Reward Shaping
par: Zhan, Simon Sinong, et autres
Publié: (2024)
par: Zhan, Simon Sinong, et autres
Publié: (2024)
ROLeR: Effective Reward Shaping in Offline Reinforcement Learning for Recommender Systems
par: Zhang, Yi, et autres
Publié: (2024)
par: Zhang, Yi, et autres
Publié: (2024)
Generative Floor Plan Design with LLMs via Reinforcement Learning with Verifiable Rewards
par: Lara, Luis, et autres
Publié: (2026)
par: Lara, Luis, et autres
Publié: (2026)
Multi-Turn Reinforcement Learning for Tool-Calling Agents with Iterative Reward Calibration
par: Modecrua, Wachiravit, et autres
Publié: (2026)
par: Modecrua, Wachiravit, et autres
Publié: (2026)
Reward Shaping for Inference-Time Alignment: A Stackelberg Game Perspective
par: Wang, Haichuan, et autres
Publié: (2026)
par: Wang, Haichuan, et autres
Publié: (2026)
Large Language Model Guided Incentive Aware Reward Design for Cooperative Multi-Agent Reinforcement Learning
par: Urgun, Dogan, et autres
Publié: (2026)
par: Urgun, Dogan, et autres
Publié: (2026)
MIR: Efficient Exploration in Episodic Multi-Agent Reinforcement Learning via Mutual Intrinsic Reward
par: Chen, Kesheng, et autres
Publié: (2025)
par: Chen, Kesheng, et autres
Publié: (2025)
Documents similaires
-
TROFI: Trajectory-Ranked Offline Inverse Reinforcement Learning
par: Sestini, Alessandro, et autres
Publié: (2025) -
Using Deep Convolutional Neural Networks to Detect Rendered Glitches in Video Games
par: Ling, Carlos Garcia, et autres
Publié: (2024) -
Improving Generalization in Game Agents with Data Augmentation in Imitation Learning
par: Yadgaroff, Derek, et autres
Publié: (2023) -
Human-Like Goalkeeping in a Realistic Football Simulation: a Sample-Efficient Reinforcement Learning Approach
par: Sestini, Alessandro, et autres
Publié: (2025) -
Real-Time Diffusion Policies for Games: Enhancing Consistency Policies with Q-Ensembles
par: Zhang, Ruoqi, et autres
Publié: (2025)