ReMax: A Simple, Effective, and Efficient Reinforcement Learning Method for Aligning Large Language Models

Fuente: arXiv
Salvato in:
Dettagli Bibliografici
Autori principali: Li, Ziniu, Xu, Tian, Zhang, Yushun, Lin, Zhihang, Yu, Yang, Sun, Ruoyu, Luo, Zhi-Quan
Natura: Preprint
Pubblicazione: 2023
Soggetti:
Accesso online:
Tags: Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!