Navigating Noisy Feedback: Enhancing Reinforcement Learning with Error-Prone Language Models

Fuente: arXiv
Saved in:
Bibliographic Details
Main Authors: Lin, Muhan, Shi, Shuyang, Guo, Yue, Chalaki, Behdad, Tadiparthi, Vaishnav, Pari, Ehsan Moradi, Stepputtis, Simon, Campbell, Joseph, Sycara, Katia
Format: Preprint
Published: 2024
Subjects:
Online Access:
Tags: Add Tag
No Tags, Be the first to tag this record!