INTELLECT-2: A Reasoning Model Trained Through Globally Decentralized Reinforcement Learning

Fuente: arXiv
Enregistré dans:
Détails bibliographiques
Auteurs principaux: Prime Intellect Team, Jaghouar, Sami, Mattern, Justus, Ong, Jack Min, Straube, Jannik, Basra, Manveer, Pazdera, Aaron, Thaman, Kushal, Di Ferrante, Matthew, Gabriel, Felix, Obeid, Fares, Erdem, Kemal, Keiblinger, Michael, Hagemann, Johannes
Format: Preprint
Publié: 2025
Sujets:
Accès en ligne:
Tags: Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!

Documents similaires