VARP: Reinforcement Learning from Vision-Language Model Feedback with Agent Regularized Preferences

Fuente: arXiv
Gespeichert in:
Bibliographische Detailangaben
Hauptverfasser: Singh, Anukriti, Bhaskar, Amisha, Yu, Peihong, Chakraborty, Souradip, Dasyam, Ruthwik, Bedi, Amrit, Tokekar, Pratap
Format: Preprint
Veröffentlicht: 2025
Schlagworte:
Online-Zugang:
Tags: Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!