HPU: High-Bandwidth Processing Unit for Scalable, Cost-effective LLM Inference via GPU Co-processing

Fuente: arXiv
Salvato in:
Dettagli Bibliografici
Autori principali: Rhee, Myunghyun, Sim, Joonseop, Ahn, Taeyoung, Lee, Seungyong, Yoon, Daegun, Kim, Euiseok, Park, Kyoung, Joo, Youngpyo, Kim, Hoshik
Natura: Preprint
Pubblicazione: 2025
Soggetti:
Accesso online:
Tags: Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!

Documenti analoghi