Aller au contenu
Universidad del Mar SIBUMAR Descubridor Institucional UMAR
  • Inicio
  • Búsqueda avanzada
  • Explorar
  • Connexion
    • English
    • Deutsch
    • Español
    • Français
    • Italiano
Recherche avancée
  • RLAX: Large-Scale, Distributed Reinforcement Learning for Large Language Models on TPUs
Image de couverture de livre

RLAX: Large-Scale, Distributed Reinforcement Learning for Large Language Models on TPUs

Fuente: arXiv
Enregistré dans:
Détails bibliographiques
Auteurs principaux: Zhou, Runlong, Zhang, Lefan, Wu, Shang-Chen, Zou, Kelvin, Zhou, Hanzhi, Ye, Ke, Feng, Yihao, Yin, Dong, Garcia, Alex Guillen, Babych, Dmytro, Chatterjee, Rohit, Hopkins, Matthew, Kong, Xiang, Lan, Chang, Li, Lezhi, Ma, Yiping, Molinari, Daniele, Tong, Senyu, Sun, Yanchao, Voice, Thomas, Wang, Jianyu, Wang, Chong, Wang, Simon, Weers, Floris, Xu, Yechen, Yin, Guolin, Yu, Muyang, Zhang, Yi, Zhou, Zheng, Zhuo, Danyang, Pang, Ruoming, Leong, Cheng
Format: Preprint
Publié: 2025
Sujets:
Machine Learning
Artificial Intelligence
Accès en ligne:
Acceder al recurso
Tags: Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
  • Citer
  • Envoyer par SMS
  • Envoyer par courriel
  • Imprimer
  • Exporter les notices
    • Exporter vers RefWorks
    • Exporter vers EndNoteWeb
    • Exporter vers EndNote
  • Ajouter aux favoris
  • Permalien
  • Exemplaires
  • Description
  • Commentaires
  • Documents similaires
  • Affichage MARC

Internet

https://arxiv.org/abs/2512.06392

Documents similaires

  • Can External Validation Tools Improve Annotation Quality for LLM-as-a-Judge?
    par: Findeis, Arduin, et autres
    Publié: (2025)
  • AXLearn: Modular, Hardware-Agnostic Large Model Training
    par: Lee, Mark, et autres
    Publié: (2025)
  • Reusing Pre-Training Data at Test Time is a Compute Multiplier
    par: Fang, Alex, et autres
    Publié: (2025)
  • Parallel Track Transformers: Enabling Fast GPU Inference with Reduced Synchronization
    par: Wang, Chong, et autres
    Publié: (2026)
  • Nixie: Efficient, Transparent Temporal Multiplexing for Consumer GPUs
    par: Xu, Yechen, et autres
    Publié: (2026)
Universidad del Mar
Universidad del MarSistema Bibliotecario de la Universidad del MarDescubridor Institucional UMARImplementación y desarrollo: Mtro. Carlos Alonso Albores Pérez
InicioBúsqueda avanzadaExplorar
Visitas al Descubridor: 47,692© 2026 Universidad del Mar