MOSS-ChatV: Reinforcement Learning with Process Reasoning Reward for Video Temporal Reasoning

Fuente: arXiv
Salvato in:
Dettagli Bibliografici
Autori principali: Tao, Sicheng, Li, Jungang, Yan, Yibo, Zhang, Junyan, Gao, Yubo, Li, Hanqian, Xun, ShuHang, Fan, Yuxuan, Chen, Hong, He, Jianxiang, Hu, Xuming
Natura: Preprint
Pubblicazione: 2025
Soggetti:
Accesso online:
Tags: Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!

Documenti analoghi