Saltar al contenido
VuFind
  • Entrar
    • English
    • Deutsch
    • Español
    • Français
    • Italiano
Avanzado
  • Citar
  • Describir
  • Enviar este por Correo electrónico
  • Imprimir
  • Exportar Registro
    • Exportar a RefWorks
    • Exportar a EndNoteWeb
    • Exportar a EndNote
  • Agregar a favoritos
  • Enlace Permanente
Imagen de Portada

Guardado en:
Detalles Bibliográficos
Autores principales: Sun, Ao, Zhao, Weilin, Han, Xu, Yang, Cheng, Liu, Zhiyuan, Shi, Chuan, Sun, Maosong
Formato: Preprint
Publicado: 2024
Materias:
Distributed, Parallel, and Cluster Computing
Machine Learning
Acceso en línea:https://arxiv.org/abs/2403.09347
Etiquetas: Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
  • Existencias
  • Descripción
  • Tabla de Contenidos
  • Comentarios
  • Ejemplares similares
  • Vista Equipo

Internet

https://arxiv.org/abs/2403.09347

Ejemplares similares

  • BurstEngine: an Efficient Distributed Framework for Training Transformers on Extremely Long Sequences of over 1M Tokens
    por: Sun, Ao, et al.
    Publicado: (2025)
  • Seq1F1B: Efficient Sequence-Level Pipeline Parallelism for Large Language Model Training
    por: Sun, Ao, et al.
    Publicado: (2024)
  • HelixPipe: Efficient Distributed Training of Long Sequence Transformers with Attention Parallel Pipeline Parallelism
    por: Zhang, Geng, et al.
    Publicado: (2025)
  • Infinite-LLM: Efficient LLM Service for Long Context with DistAttention and Distributed KVCache
    por: Lin, Bin, et al.
    Publicado: (2024)
  • AB-Sparse: Sparse Attention with Adaptive Block Size for Accurate and Efficient Long-Context Inference
    por: Liu, Di, et al.
    Publicado: (2026)

Opciones de búsqueda

  • Historial de Búsqueda
  • Búsqueda Avanzada

Buscar Más

  • Revisar el Catálogo
  • Lista Alfabética
  • Explorar canales
  • Reservas de Curso
  • Nuevos ejemplares

¿Necesita Ayuda?

  • Consejos de búsqueda
  • Consulte a un Bibliotecario
  • Preguntas Frecuentes