LANG: Reinforcement Learning for Multilingual Reasoning with Language-Adaptive Hint Guidance

Fuente: arXiv
Enregistré dans:
Détails bibliographiques
Auteurs principaux: Fan, Yuchun, Li, Bei, Li, Peiguang, Wang, Yilin, Mu, Yongyu, Yang, Jian, Chen, Xin, Weng, Rongxiang, Wang, Jingang, Cai, Xunliang, Zhu, Jingbo, Xiao, Tong
Format: Preprint
Publié: 2026
Sujets:
Accès en ligne:
Tags: Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!