Graph-GRPO: Stabilizing Multi-Agent Topology Learning via Group Relative Policy Optimization

Fuente: arXiv
Guardado en:
Detalles Bibliográficos
Autores principales: Cang, Yueyang, Zhang, Xiaoteng, Zhao, Erlu, Ji, Zehua, Liu, Yuhang, He, Yuchen, Ning, Zhiyuan, Yijun, Chen, Que, Wenge, Shi, Li
Formato: Preprint
Publicado: 2026
Materias:
Acceso en línea:
Etiquetas: Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!