100x Cost & Latency Reduction: Performance Analysis of AI Query Approximation using Lightweight Proxy Models

Fuente: arXiv
Gespeichert in:
Bibliographische Detailangaben
Hauptverfasser: Chung, Yeounoh, Desai, Rushabh, He, Jian, Xiao, Yu, Hottelier, Thibaud, Samo, Yves-Laurent Kom, Khadilkar, Pushkar, Chen, Xianshun, Idicula, Sam, Özcan, Fatma, Halevy, Alon, Papakonstantinou, Yannis
Format: Preprint
Veröffentlicht: 2026
Schlagworte:
Online-Zugang:
Tags: Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!