Weiter zum Inhalt
Universidad del Mar SIBUMAR Descubridor Institucional UMAR
  • Inicio
  • Búsqueda avanzada
  • Explorar
  • Login
    • English
    • Deutsch
    • Español
    • Français
    • Italiano
Erweitert
  • RLAX: Large-Scale, Distributed Reinforcement Learning for Large Language Models on TPUs
Buchumschlag

RLAX: Large-Scale, Distributed Reinforcement Learning for Large Language Models on TPUs

Fuente: arXiv
Gespeichert in:
Bibliographische Detailangaben
Hauptverfasser: Zhou, Runlong, Zhang, Lefan, Wu, Shang-Chen, Zou, Kelvin, Zhou, Hanzhi, Ye, Ke, Feng, Yihao, Yin, Dong, Garcia, Alex Guillen, Babych, Dmytro, Chatterjee, Rohit, Hopkins, Matthew, Kong, Xiang, Lan, Chang, Li, Lezhi, Ma, Yiping, Molinari, Daniele, Tong, Senyu, Sun, Yanchao, Voice, Thomas, Wang, Jianyu, Wang, Chong, Wang, Simon, Weers, Floris, Xu, Yechen, Yin, Guolin, Yu, Muyang, Zhang, Yi, Zhou, Zheng, Zhuo, Danyang, Pang, Ruoming, Leong, Cheng
Format: Preprint
Veröffentlicht: 2025
Schlagworte:
Machine Learning
Artificial Intelligence
Online-Zugang:
Acceder al recurso
Tags: Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
  • Zitieren
  • SMS versenden
  • Als E-Mail versenden
  • Drucken
  • Datensatz exportieren
    • Exportieren nach RefWorks
    • Exportieren nach EndNoteWeb
    • Exportieren nach EndNote
  • Zu den Favoriten
  • Persistenter Link
  • Exemplare
  • Beschreibung
  • Kommentare
  • Ähnliche Einträge
  • Internformat
Schreiben Sie den ersten Kommentar!
Bitte loggen Sie sich zuerst ein

Ähnliche Einträge

  • Can External Validation Tools Improve Annotation Quality for LLM-as-a-Judge?
    von: Findeis, Arduin, et al.
    Veröffentlicht: (2025)
  • AXLearn: Modular, Hardware-Agnostic Large Model Training
    von: Lee, Mark, et al.
    Veröffentlicht: (2025)
  • Reusing Pre-Training Data at Test Time is a Compute Multiplier
    von: Fang, Alex, et al.
    Veröffentlicht: (2025)
  • Parallel Track Transformers: Enabling Fast GPU Inference with Reduced Synchronization
    von: Wang, Chong, et al.
    Veröffentlicht: (2026)
  • Nixie: Efficient, Transparent Temporal Multiplexing for Consumer GPUs
    von: Xu, Yechen, et al.
    Veröffentlicht: (2026)
Universidad del Mar
Universidad del MarSistema Bibliotecario de la Universidad del MarDescubridor Institucional UMARImplementación y desarrollo: Mtro. Carlos Alonso Albores Pérez
InicioBúsqueda avanzadaExplorar
Visitas al Descubridor: 191,910© 2026 Universidad del Mar