Active-O3: Empowering Multimodal Large Language Models with Active Perception via GRPO

Fuente: arXiv
Salvato in:
Dettagli Bibliografici
Autori principali: Zhu, Muzhi, Zhong, Hao, Zhao, Canyu, Du, Zongze, Huang, Zheng, Liu, Mingyu, Chen, Hao, Zou, Cheng, Chen, Jingdong, Yang, Ming, Shen, Chunhua
Natura: Preprint
Pubblicazione: 2025
Soggetti:
Accesso online:
Tags: Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!