LPU: A Latency-Optimized and Highly Scalable Processor for Large Language Model Inference

Fuente: arXiv
Saved in:
Bibliographic Details
Main Authors: Moon, Seungjae, Kim, Jung-Hoon, Kim, Junsoo, Hong, Seongmin, Cha, Junseo, Kim, Minsu, Lim, Sukbin, Choi, Gyubin, Seo, Dongjin, Kim, Jongho, Lee, Hunjong, Park, Hyunjun, Ko, Ryeowook, Choi, Soongyu, Park, Jongse, Lee, Jinwon, Kim, Joo-Young
Format: Preprint
Published: 2024
Subjects:
Online Access:
Tags: Add Tag
No Tags, Be the first to tag this record!