Self-correcting Reward Shaping via Language Models for Reinforcement Learning Agents in Games
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Afonso, António, Leite, Iolanda, Sestini, Alessandro, Fuchs, Florian, Tollmar, Konrad, Gisslén, Linus |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2025
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
TROFI: Trajectory-Ranked Offline Inverse Reinforcement Learning
von: Sestini, Alessandro, et al.
Veröffentlicht: (2025)
von: Sestini, Alessandro, et al.
Veröffentlicht: (2025)
Using Deep Convolutional Neural Networks to Detect Rendered Glitches in Video Games
von: Ling, Carlos Garcia, et al.
Veröffentlicht: (2024)
von: Ling, Carlos Garcia, et al.
Veröffentlicht: (2024)
Improving Generalization in Game Agents with Data Augmentation in Imitation Learning
von: Yadgaroff, Derek, et al.
Veröffentlicht: (2023)
von: Yadgaroff, Derek, et al.
Veröffentlicht: (2023)
Human-Like Goalkeeping in a Realistic Football Simulation: a Sample-Efficient Reinforcement Learning Approach
von: Sestini, Alessandro, et al.
Veröffentlicht: (2025)
von: Sestini, Alessandro, et al.
Veröffentlicht: (2025)
Real-Time Diffusion Policies for Games: Enhancing Consistency Policies with Q-Ensembles
von: Zhang, Ruoqi, et al.
Veröffentlicht: (2025)
von: Zhang, Ruoqi, et al.
Veröffentlicht: (2025)
Reinforcement Learning for High-Level Strategic Control in Tower Defense Games
von: Bergdahl, Joakim, et al.
Veröffentlicht: (2024)
von: Bergdahl, Joakim, et al.
Veröffentlicht: (2024)
Leveraging Large Language Models for Efficient Failure Analysis in Game Development
von: Marini, Leonardo, et al.
Veröffentlicht: (2024)
von: Marini, Leonardo, et al.
Veröffentlicht: (2024)
Towards Better Sample Efficiency in Multi-Agent Reinforcement Learning via Exploration
von: Baghi, Amir, et al.
Veröffentlicht: (2025)
von: Baghi, Amir, et al.
Veröffentlicht: (2025)
A Benchmark Environment for Offline Reinforcement Learning in Racing Games
von: Macaluso, Girolamo, et al.
Veröffentlicht: (2024)
von: Macaluso, Girolamo, et al.
Veröffentlicht: (2024)
ARMS: Automatic Reward Shaping for Sparse-Reward Multi-Agent Reinforcement Learning
von: Abboud, Elie, et al.
Veröffentlicht: (2026)
von: Abboud, Elie, et al.
Veröffentlicht: (2026)
Text2Reward: Reward Shaping with Language Models for Reinforcement Learning
von: Xie, Tianbao, et al.
Veröffentlicht: (2023)
von: Xie, Tianbao, et al.
Veröffentlicht: (2023)
Highly Efficient Self-Adaptive Reward Shaping for Reinforcement Learning
von: Ma, Haozhe, et al.
Veröffentlicht: (2024)
von: Ma, Haozhe, et al.
Veröffentlicht: (2024)
Extracting Heuristics from Large Language Models for Reward Shaping in Reinforcement Learning
von: Bhambri, Siddhant, et al.
Veröffentlicht: (2024)
von: Bhambri, Siddhant, et al.
Veröffentlicht: (2024)
Think in Games: Learning to Reason in Games via Reinforcement Learning with Large Language Models
von: Liao, Yi, et al.
Veröffentlicht: (2025)
von: Liao, Yi, et al.
Veröffentlicht: (2025)
Principal-Agent Reward Shaping in MDPs
von: Ben-Porat, Omer, et al.
Veröffentlicht: (2023)
von: Ben-Porat, Omer, et al.
Veröffentlicht: (2023)
Self-Consistency of the Internal Reward Models Improves Self-Rewarding Language Models
von: Zhou, Xin, et al.
Veröffentlicht: (2025)
von: Zhou, Xin, et al.
Veröffentlicht: (2025)
SPEQ: Offline Stabilization Phases for Efficient Q-Learning in High Update-To-Data Ratio Reinforcement Learning
von: Romeo, Carlo, et al.
Veröffentlicht: (2025)
von: Romeo, Carlo, et al.
Veröffentlicht: (2025)
Reward Generation via Large Vision-Language Model in Offline Reinforcement Learning
von: Lee, Younghwan, et al.
Veröffentlicht: (2025)
von: Lee, Younghwan, et al.
Veröffentlicht: (2025)
Subgoal-based Reward Shaping to Improve Efficiency in Reinforcement Learning
von: Okudo, Takato, et al.
Veröffentlicht: (2021)
von: Okudo, Takato, et al.
Veröffentlicht: (2021)
RLSR: Reinforcement Learning from Self Reward
von: Simonds, Toby, et al.
Veröffentlicht: (2025)
von: Simonds, Toby, et al.
Veröffentlicht: (2025)
Learning Reward for Robot Skills Using Large Language Models via Self-Alignment
von: Zeng, Yuwei, et al.
Veröffentlicht: (2024)
von: Zeng, Yuwei, et al.
Veröffentlicht: (2024)
Cooperative Reward Shaping for Multi-Agent Pathfinding
von: Song, Zhenyu, et al.
Veröffentlicht: (2024)
von: Song, Zhenyu, et al.
Veröffentlicht: (2024)
Self-Rewarding Language Models
von: Yuan, Weizhe, et al.
Veröffentlicht: (2024)
von: Yuan, Weizhe, et al.
Veröffentlicht: (2024)
Model-Based Reinforcement Learning in Discrete-Action Non-Markovian Reward Decision Processes
von: Trapasso, Alessandro, et al.
Veröffentlicht: (2025)
von: Trapasso, Alessandro, et al.
Veröffentlicht: (2025)
On the Sample Efficiency of Abstractions and Potential-Based Reward Shaping in Reinforcement Learning
von: Canonaco, Giuseppe, et al.
Veröffentlicht: (2024)
von: Canonaco, Giuseppe, et al.
Veröffentlicht: (2024)
Shaping Sparse Rewards in Reinforcement Learning: A Semi-supervised Approach
von: Li, Wenyun, et al.
Veröffentlicht: (2025)
von: Li, Wenyun, et al.
Veröffentlicht: (2025)
Vision-Language Models are Zero-Shot Reward Models for Reinforcement Learning
von: Rocamonde, Juan, et al.
Veröffentlicht: (2023)
von: Rocamonde, Juan, et al.
Veröffentlicht: (2023)
Multi-Agent Collaborative Reward Design for Enhancing Reasoning in Reinforcement Learning
von: Yang, Pei, et al.
Veröffentlicht: (2025)
von: Yang, Pei, et al.
Veröffentlicht: (2025)
Language Agents with Reinforcement Learning for Strategic Play in the Werewolf Game
von: Xu, Zelai, et al.
Veröffentlicht: (2023)
von: Xu, Zelai, et al.
Veröffentlicht: (2023)
Improving Conditional Level Generation using Automated Validation in Match-3 Games
von: Aylagas, Monica Villanueva, et al.
Veröffentlicht: (2024)
von: Aylagas, Monica Villanueva, et al.
Veröffentlicht: (2024)
AI for Handball: predicting and explaining the 2024 Olympic Games tournament with Deep Learning and Large Language Models
von: Felice, Florian
Veröffentlicht: (2024)
von: Felice, Florian
Veröffentlicht: (2024)
TextGames: Learning to Self-Play Text-Based Puzzle Games via Language Model Reasoning
von: Hudi, Frederikus, et al.
Veröffentlicht: (2025)
von: Hudi, Frederikus, et al.
Veröffentlicht: (2025)
PyTAG: Tabletop Games for Multi-Agent Reinforcement Learning
von: Balla, Martin, et al.
Veröffentlicht: (2024)
von: Balla, Martin, et al.
Veröffentlicht: (2024)
Enhancing Inverse Reinforcement Learning through Encoding Dynamic Information in Reward Shaping
von: Zhan, Simon Sinong, et al.
Veröffentlicht: (2024)
von: Zhan, Simon Sinong, et al.
Veröffentlicht: (2024)
ROLeR: Effective Reward Shaping in Offline Reinforcement Learning for Recommender Systems
von: Zhang, Yi, et al.
Veröffentlicht: (2024)
von: Zhang, Yi, et al.
Veröffentlicht: (2024)
Generative Floor Plan Design with LLMs via Reinforcement Learning with Verifiable Rewards
von: Lara, Luis, et al.
Veröffentlicht: (2026)
von: Lara, Luis, et al.
Veröffentlicht: (2026)
Multi-Turn Reinforcement Learning for Tool-Calling Agents with Iterative Reward Calibration
von: Modecrua, Wachiravit, et al.
Veröffentlicht: (2026)
von: Modecrua, Wachiravit, et al.
Veröffentlicht: (2026)
Reward Shaping for Inference-Time Alignment: A Stackelberg Game Perspective
von: Wang, Haichuan, et al.
Veröffentlicht: (2026)
von: Wang, Haichuan, et al.
Veröffentlicht: (2026)
Large Language Model Guided Incentive Aware Reward Design for Cooperative Multi-Agent Reinforcement Learning
von: Urgun, Dogan, et al.
Veröffentlicht: (2026)
von: Urgun, Dogan, et al.
Veröffentlicht: (2026)
MIR: Efficient Exploration in Episodic Multi-Agent Reinforcement Learning via Mutual Intrinsic Reward
von: Chen, Kesheng, et al.
Veröffentlicht: (2025)
von: Chen, Kesheng, et al.
Veröffentlicht: (2025)
Ähnliche Einträge
-
TROFI: Trajectory-Ranked Offline Inverse Reinforcement Learning
von: Sestini, Alessandro, et al.
Veröffentlicht: (2025) -
Using Deep Convolutional Neural Networks to Detect Rendered Glitches in Video Games
von: Ling, Carlos Garcia, et al.
Veröffentlicht: (2024) -
Improving Generalization in Game Agents with Data Augmentation in Imitation Learning
von: Yadgaroff, Derek, et al.
Veröffentlicht: (2023) -
Human-Like Goalkeeping in a Realistic Football Simulation: a Sample-Efficient Reinforcement Learning Approach
von: Sestini, Alessandro, et al.
Veröffentlicht: (2025) -
Real-Time Diffusion Policies for Games: Enhancing Consistency Policies with Q-Ensembles
von: Zhang, Ruoqi, et al.
Veröffentlicht: (2025)