Regmi, S., & Pun, C. P. (2024). GPT Semantic Cache: Reducing LLM Costs and Latency via Semantic Embedding Caching.
Chicago Style (17th ed.) CitationRegmi, Sajal, and Chetan Phakami Pun. GPT Semantic Cache: Reducing LLM Costs and Latency via Semantic Embedding Caching. 2024.
MLA (9th ed.) CitationRegmi, Sajal, and Chetan Phakami Pun. GPT Semantic Cache: Reducing LLM Costs and Latency via Semantic Embedding Caching. 2024.
Warning: These citations may not always be 100% accurate.