APA (7th ed.) Citation

Regmi, S., & Pun, C. P. (2024). GPT Semantic Cache: Reducing LLM Costs and Latency via Semantic Embedding Caching.

Chicago Style (17th ed.) Citation

Regmi, Sajal, and Chetan Phakami Pun. GPT Semantic Cache: Reducing LLM Costs and Latency via Semantic Embedding Caching. 2024.

MLA (9th ed.) Citation

Regmi, Sajal, and Chetan Phakami Pun. GPT Semantic Cache: Reducing LLM Costs and Latency via Semantic Embedding Caching. 2024.

Warning: These citations may not always be 100% accurate.