Text2Grad: Reinforcement Learning from Natural Language Feedback

Fuente: arXiv
Saved in:
Bibliographic Details
Main Authors: Wang, Hanyang, Wang, Lu, Zhang, Chaoyun, Mao, Tianjun, Qin, Si, Lin, Qingwei, Rajmohan, Saravan, Zhang, Dongmei
Format: Preprint
Published: 2025
Subjects:
Online Access:
Tags: Add Tag
No Tags, Be the first to tag this record!