ThinkTwice: Jointly Optimizing Large Language Models for Reasoning and Self-Refinement

Fuente: arXiv
Guardado en:
Detalles Bibliográficos
Autores principales: Jiao, Difan, Wen, Qianfeng, Yang, Blair, Tang, Zhenwei, Anderson, Ashton
Formato: Preprint
Publicado: 2026
Materias:
Acceso en línea:
Etiquetas: Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!