Active-O3: Empowering Multimodal Large Language Models with Active Perception via GRPO

Fuente: arXiv
Enregistré dans:
Détails bibliographiques
Auteurs principaux: Zhu, Muzhi, Zhong, Hao, Zhao, Canyu, Du, Zongze, Huang, Zheng, Liu, Mingyu, Chen, Hao, Zou, Cheng, Chen, Jingdong, Yang, Ming, Shen, Chunhua
Format: Preprint
Publié: 2025
Sujets:
Accès en ligne:
Tags: Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!