Optimizing Long-context LLM Serving via Fine-grained Sequence Parallelism

Fuente: arXiv
Saved in:
Bibliographic Details
Main Authors: Li, Cong, Yang, Yuzhe, Zheng, Xuegui, Yang, Qifan, Guan, Yijin, Zheng, Size, Chang, Li-Wen, Liu, Shufan, Liu, Xin, Sun, Guangyu
Format: Preprint
Published: 2025
Subjects:
Online Access:
Tags: Add Tag
No Tags, Be the first to tag this record!