RGBX-R1: Visual Modality Chain-of-Thought Guided Reinforcement Learning for Multimodal Grounding

Fuente: arXiv
Salvato in:
Dettagli Bibliografici
Autori principali: Wu, Jiahe, Cao, Bing, Wang, Qilong, Hu, Qinghua, Li, Dongdong, Zhu, Pengfei
Natura: Preprint
Pubblicazione: 2026
Soggetti:
Accesso online:
Tags: Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!

Documenti analoghi