Saltar al contenido
Universidad del Mar SIBUMAR Descubridor Institucional UMAR
  • Inicio
  • Búsqueda avanzada
  • Explorar
  • Entrar
    • English
    • Deutsch
    • Español
    • Français
    • Italiano
Búsqueda avanzada
  • When AI Benchmarks Plateau: A Systematic Study of Benchmark Saturation
Imagen de Portada

When AI Benchmarks Plateau: A Systematic Study of Benchmark Saturation

Fuente: arXiv
Guardado en:
Detalles Bibliográficos
Autores principales: Akhtar, Mubashara, Reuel, Anka, Soni, Prajna, Ahuja, Sanchit, Ammanamanchi, Pawan Sasanka, Rawal, Ruchit, Zouhar, Vilém, Yadav, Srishti, Whitehouse, Chenxi, Ki, Dayeon, Mickel, Jennifer, Choshen, Leshem, Šuppa, Marek, Batzner, Jan, Chim, Jenny, Sania, Jeba, Long, Yanan, Rahmani, Hossein A., Knight, Christina, Nan, Yiyang, Raj, Jyoutir, Fan, Yu, Singh, Shubham, Sahoo, Subramanyam, Habba, Eliya, Gohar, Usman, Pawar, Siddhesh, Scholz, Robert, Subramonian, Arjun, Ni, Jingwei, Kochenderfer, Mykel, Koyejo, Sanmi, Sachan, Mrinmaya, Biderman, Stella, Talat, Zeerak, Ghosh, Avijit, Solaiman, Irene
Formato: Preprint
Publicado: 2026
Materias:
Artificial Intelligence
Acceso en línea:
Acceder al recurso
Etiquetas: Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
  • Citar
  • Describir
  • Enviar este por Correo electrónico
  • Imprimir
  • Exportar Registro
    • Exportar a RefWorks
    • Exportar a EndNoteWeb
    • Exportar a EndNote
  • Agregar a favoritos
  • Enlace Permanente
  • Existencias
  • Descripción
  • Comentarios
  • Ejemplares similares
  • Vista Equipo
Descripción
Descripción no disponible.

Ejemplares similares

  • Who Evaluates AI's Social Impacts? Mapping Coverage and Gaps in First and Third Party Evaluations
    por: Reuel, Anka, et al.
    Publicado: (2025)
  • Beyond Benchmarks: On The False Promise of AI Regulation
    por: Stanovsky, Gabriel, et al.
    Publicado: (2025)
  • Stolen Subwords: Importance of Vocabularies for Machine Translation Model Stealing
    por: Zouhar, Vilém
    Publicado: (2024)
  • Growing Pains: Extensible and Efficient LLM Benchmarking Via Fixed Parameter Calibration
    por: Habba, Eliya, et al.
    Publicado: (2026)
  • BlasBench: An Open Benchmark for Irish Speech Recognition
    por: Raj, Jyoutir, et al.
    Publicado: (2026)
Universidad del Mar
Universidad del MarSistema Bibliotecario de la Universidad del MarDescubridor Institucional UMARImplementación y desarrollo: Mtro. Carlos Alonso Albores Pérez
InicioBúsqueda avanzadaExplorar
Visitas al Descubridor: 55,643© 2026 Universidad del Mar