Serving LLMs in HPC Clusters: A Comparative Study of Qualcomm Cloud AI 100 Ultra and NVIDIA Data Center GPUs

Fuente: arXiv
Gespeichert in:
Bibliographische Detailangaben
Hauptverfasser: Sada, Mohammad Firas, Graham, John J., Khoda, Elham E, Tatineni, Mahidhar, Mishin, Dmitry, Gupta, Rajesh K., Wagner, Rick, Smarr, Larry, DeFanti, Thomas A., Würthwein, Frank
Format: Preprint
Veröffentlicht: 2025
Schlagworte:
Online-Zugang:
Tags: Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!