Scaling Down, Serving Fast: Compressing and Deploying Efficient LLMs for Recommendation Systems

Fuente: arXiv
Guardado en:
Detalles Bibliográficos
Autores principales: Behdin, Kayhan, Fatahibaarzi, Ata, Song, Qingquan, Dai, Yun, Gupta, Aman, Wang, Zhipeng, Tang, Shao, Sang, Hejian, Dexter, Gregory, Zhu, Sirou, Zhu, Siyu, Dharamsi, Tejas, Kothapalli, Vignesh, Fu, Zhoutong, Cao, Yihan, Hsu, Pin-Lun, Borisyuk, Fedor, Pillai, Natesh, Simon, Luke, Mazumder, Rahul
Formato: Preprint
Publicado: 2025
Materias:
Acceso en línea:
Etiquetas: Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!

Ejemplares similares