SRPO: Self-Referential Policy Optimization for Vision-Language-Action Models

Fuente: arXiv
Enregistré dans:
Détails bibliographiques
Auteurs principaux: Fei, Senyu, Wang, Siyin, Ji, Li, Li, Ao, Zhang, Shiduo, Liu, Liming, Hou, Jinlong, Gong, Jingjing, Zhao, Xianzhong, Qiu, Xipeng
Format: Preprint
Publié: 2025
Sujets:
Accès en ligne:
Tags: Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!