TruthRL: Incentivizing Truthful LLMs via Reinforcement Learning

Fuente: arXiv
Saved in:
Bibliographic Details
Main Authors: Wei, Zhepei, Yang, Xiao, Sun, Kai, Wang, Jiaqi, Shao, Rulin, Chen, Sean, Kachuee, Mohammad, Gollapudi, Teja, Liao, Tony, Scheffer, Nicolas, Wanga, Rakesh, Kumar, Anuj, Meng, Yu, Yih, Wen-tau, Dong, Xin Luna
Format: Preprint
Published: 2025
Subjects:
Online Access:
Tags: Add Tag
No Tags, Be the first to tag this record!

Similar Items