Harnessing Uncertainty: Entropy-Modulated Policy Gradients for Long-Horizon LLM Agents

Fuente: arXiv
Guardado en:
Detalles Bibliográficos
Autores principales: Wang, Jiawei, Liu, Jiacai, Fu, Yuqian, Li, Yingru, Wang, Xintao, Lin, Yuan, Yue, Yu, Zhang, Lin, Wang, Yang, Wang, Ke
Formato: Preprint
Publicado: 2025
Materias:
Acceso en línea:
Etiquetas: Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!