Saltar al contenido
Universidad del Mar SIBUMAR Descubridor Institucional UMAR
  • Inicio
  • Búsqueda avanzada
  • Explorar
  • Entrar
    • English
    • Deutsch
    • Español
    • Français
    • Italiano
Búsqueda avanzada
  • Dolma: an Open Corpus of Three Trillion Tokens for Language Model Pretraining Research
Imagen de Portada

Dolma: an Open Corpus of Three Trillion Tokens for Language Model Pretraining Research

Fuente: arXiv
Guardado en:
Detalles Bibliográficos
Autores principales: Soldaini, Luca, Kinney, Rodney, Bhagia, Akshita, Schwenk, Dustin, Atkinson, David, Authur, Russell, Bogin, Ben, Chandu, Khyathi, Dumas, Jennifer, Elazar, Yanai, Hofmann, Valentin, Jha, Ananya Harsh, Kumar, Sachin, Lucy, Li, Lyu, Xinxi, Lambert, Nathan, Magnusson, Ian, Morrison, Jacob, Muennighoff, Niklas, Naik, Aakanksha, Nam, Crystal, Peters, Matthew E., Ravichander, Abhilasha, Richardson, Kyle, Shen, Zejiang, Strubell, Emma, Subramani, Nishant, Tafjord, Oyvind, Walsh, Pete, Zettlemoyer, Luke, Smith, Noah A., Hajishirzi, Hannaneh, Beltagy, Iz, Groeneveld, Dirk, Dodge, Jesse, Lo, Kyle
Formato: Preprint
Publicado: 2024
Materias:
Computation and Language
Acceso en línea:
Acceder al recurso
Etiquetas: Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
  • Citar
  • Describir
  • Enviar este por Correo electrónico
  • Imprimir
  • Exportar Registro
    • Exportar a RefWorks
    • Exportar a EndNoteWeb
    • Exportar a EndNote
  • Agregar a favoritos
  • Enlace Permanente
  • Existencias
  • Descripción
  • Comentarios
  • Ejemplares similares
  • Vista Equipo

Internet

https://arxiv.org/abs/2402.00159

Ejemplares similares

  • Paloma: A Benchmark for Evaluating Language Model Fit
    por: Magnusson, Ian, et al.
    Publicado: (2023)
  • OLMo: Accelerating the Science of Language Models
    por: Groeneveld, Dirk, et al.
    Publicado: (2024)
  • What's In My Big Data?
    por: Elazar, Yanai, et al.
    Publicado: (2023)
  • Infini-gram: Scaling Unbounded n-gram Language Models to a Trillion Tokens
    por: Liu, Jiacheng, et al.
    Publicado: (2024)
  • RESTOR: Knowledge Recovery in Machine Unlearning
    por: Rezaei, Keivan, et al.
    Publicado: (2024)
Universidad del Mar
Universidad del MarSistema Bibliotecario de la Universidad del MarDescubridor Institucional UMARImplementación y desarrollo: Mtro. Carlos Alonso Albores Pérez
InicioBúsqueda avanzadaExplorar
Visitas al Descubridor: 33,245© 2026 Universidad del Mar