Aller au contenu
Universidad del Mar SIBUMAR Descubridor Institucional UMAR
  • Inicio
  • Búsqueda avanzada
  • Explorar
  • Connexion
    • English
    • Deutsch
    • Español
    • Français
    • Italiano
Recherche avancée
  • An Expanded Massive Multilingual Dataset for High-Performance Language Technologies (HPLT)
Image de couverture de livre

An Expanded Massive Multilingual Dataset for High-Performance Language Technologies (HPLT)

Fuente: arXiv
Enregistré dans:
Détails bibliographiques
Auteurs principaux: Burchell, Laurie, de Gibert, Ona, Arefyev, Nikolay, Aulamo, Mikko, Bañón, Marta, Chen, Pinzhen, Fedorova, Mariia, Guillou, Liane, Haddow, Barry, Hajič, Jan, Helcl, Jindřich, Henriksson, Erik, Klimaszewski, Mateusz, Komulainen, Ville, Kutuzov, Andrey, Kytöniemi, Joona, Laippala, Veronika, Mæhlum, Petter, Malik, Bhavitvya, Mehryary, Farrokh, Mikhailov, Vladislav, Moghe, Nikita, Myntti, Amanda, O'Brien, Dayyán, Oepen, Stephan, Pal, Proyag, Piha, Jousia, Pyysalo, Sampo, Ramírez-Sánchez, Gema, Samuel, David, Stepachev, Pavel, Tiedemann, Jörg, Variš, Dušan, Vojtěchová, Tereza, Zaragoza-Bernabeu, Jaume
Format: Preprint
Publié: 2025
Sujets:
Computation and Language
Accès en ligne:
Acceder al recurso
Tags: Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
  • Citer
  • Envoyer par SMS
  • Envoyer par courriel
  • Imprimer
  • Exporter les notices
    • Exporter vers RefWorks
    • Exporter vers EndNoteWeb
    • Exporter vers EndNote
  • Ajouter aux favoris
  • Permalien
  • Exemplaires
  • Description
  • Commentaires
  • Documents similaires
  • Affichage MARC
Description
Aucune description n'est disponible.

Documents similaires

  • HPLT 3.0: Very Large-Scale Multilingual Resources for LLMs and MT. Mono- and Bi-lingual Data, Multilingual Evaluation, and Pre-Trained Models
    par: Oepen, Stephan, et autres
    Publié: (2025)
  • FIN-bench-v2: A Unified and Robust Benchmark Suite for Evaluating Finnish Large Language Models
    par: Kytöniemi, Joona, et autres
    Publié: (2025)
  • DocHPLT: A Massively Multilingual Document-Level Translation Dataset
    par: O'Brien, Dayyán, et autres
    Publié: (2025)
  • Register Always Matters: Analysis of LLM Pretraining Data Through the Lens of Language Variation
    par: Myntti, Amanda, et autres
    Publié: (2025)
  • Quality or Quantity? On Data Scale and Diversity in Adapting Large Language Models for Low-Resource Translation
    par: Iyer, Vivek, et autres
    Publié: (2024)
Universidad del Mar
Universidad del MarSistema Bibliotecario de la Universidad del MarDescubridor Institucional UMARImplementación y desarrollo: Mtro. Carlos Alonso Albores Pérez
InicioBúsqueda avanzadaExplorar
Visitas al Descubridor: 33,245© 2026 Universidad del Mar