Efficient Prompt Compression with Evaluator Heads for Long-Context Transformer Inference

Fuente: arXiv
Salvato in:
Dettagli Bibliografici
Autori principali: Fei, Weizhi, Niu, Xueyan, Xie, Guoqing, Liu, Yingqing, Bai, Bo, Han, Wei
Natura: Preprint
Pubblicazione: 2025
Soggetti:
Accesso online:
Tags: Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!