100x Cost & Latency Reduction: Performance Analysis of AI Query Approximation using Lightweight Proxy Models

Fuente: arXiv
Enregistré dans:
Détails bibliographiques
Auteurs principaux: Chung, Yeounoh, Desai, Rushabh, He, Jian, Xiao, Yu, Hottelier, Thibaud, Samo, Yves-Laurent Kom, Khadilkar, Pushkar, Chen, Xianshun, Idicula, Sam, Özcan, Fatma, Halevy, Alon, Papakonstantinou, Yannis
Format: Preprint
Publié: 2026
Sujets:
Accès en ligne:
Tags: Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!

Documents similaires