MoDoMoDo: Multi-Domain Data Mixtures for Multimodal LLM Reinforcement Learning

Fuente: arXiv
Salvato in:
Dettagli Bibliografici
Autori principali: Liang, Yiqing, Qiu, Jielin, Ding, Wenhao, Liu, Zuxin, Tompkin, James, Xu, Mengdi, Xia, Mengzhou, Tu, Zhengzhong, Shi, Laixi, Zhu, Jiacheng
Natura: Preprint
Pubblicazione: 2025
Soggetti:
Accesso online:
Tags: Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!