RAC: Relation-Aware Cache Replacement for Large Language Models
Fuente:
arXiv
Saved in:
| Main Authors: | Wu, Yuchong, Xu, Zihuan, Ni, Wangze, Cheng, Peng, Chen, Lei, Lin, Xuemin, Shen, Heng Tao, Ren, Kui |
|---|---|
| Format: | Preprint |
| Published: |
2026
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
ContextCache: Context-Aware Semantic Cache for Multi-Turn Queries in Large Language Models
by: Yan, Jianxin, et al.
Published: (2025)
by: Yan, Jianxin, et al.
Published: (2025)
StructRide: A Framework to Exploit the Structure Information of Shareability Graph in Ridesharing
by: Zhan, Jiexi, et al.
Published: (2024)
by: Zhan, Jiexi, et al.
Published: (2024)
Wait to be Faster: a Smart Pooling Framework for Dynamic Ridesharing
by: Zhong, Xiaoyao, et al.
Published: (2024)
by: Zhong, Xiaoyao, et al.
Published: (2024)
QCFuse: Query-Centric Cache Fusion for Efficient RAG Inference
by: Yan, Jianxin, et al.
Published: (2026)
by: Yan, Jianxin, et al.
Published: (2026)
Efficient Multiple Temporal Network Kernel Density Estimation
by: Shao, Yu, et al.
Published: (2025)
by: Shao, Yu, et al.
Published: (2025)
Infinite Stream Estimation under Personalized $w$-Event Privacy
by: Du, Leilei, et al.
Published: (2025)
by: Du, Leilei, et al.
Published: (2025)
SINDI: an Efficient Index for Approximate Maximum Inner Product Search on Sparse Vectors
by: Li, Ruoxuan, et al.
Published: (2025)
by: Li, Ruoxuan, et al.
Published: (2025)
FGIM: a Fast Graph-based Indexes Merging Framework for Approximate Nearest Neighbor Search
by: Wu, Zekai, et al.
Published: (2026)
by: Wu, Zekai, et al.
Published: (2026)
Numerical Estimation of Spatial Distributions under Differential Privacy
by: Du, Leilei, et al.
Published: (2024)
by: Du, Leilei, et al.
Published: (2024)
Approximate Nearest Neighbor Search of Large Scale Vectors on Distributed Storage
by: Yu, Kun, et al.
Published: (2025)
by: Yu, Kun, et al.
Published: (2025)
Are Large Language Models a Good Replacement of Taxonomies?
by: Sun, Yushi, et al.
Published: (2024)
by: Sun, Yushi, et al.
Published: (2024)
Can Large Language Models Be Query Optimizer for Relational Databases?
by: Tan, Jie, et al.
Published: (2025)
by: Tan, Jie, et al.
Published: (2025)
Batch Hop-Constrained s-t Simple Path Query Processing in Large Graphs
by: Yuan, Long, et al.
Published: (2023)
by: Yuan, Long, et al.
Published: (2023)
VSAG: An Optimized Search Framework for Graph-based Approximate Nearest Neighbor Search
by: Zhong, Xiaoyao, et al.
Published: (2025)
by: Zhong, Xiaoyao, et al.
Published: (2025)
Personalized w-Event Privacy for Infinite Stream Estimation
by: Du, Leilei, et al.
Published: (2026)
by: Du, Leilei, et al.
Published: (2026)
Poodle: Seamlessly Scaling Down Large Language Models with Just-in-Time Model Replacement
by: Strassenburg, Nils, et al.
Published: (2025)
by: Strassenburg, Nils, et al.
Published: (2025)
SEMA-SQL: Beyond Traditional Relational Querying with Large Language Models
by: Lin, Yin, et al.
Published: (2026)
by: Lin, Yin, et al.
Published: (2026)
Large Language Model-Enhanced Relational Operators: Taxonomy, Benchmark, and Analysis
by: Su, Yunxiang, et al.
Published: (2026)
by: Su, Yunxiang, et al.
Published: (2026)
EnhanceGraph: A Continuously Enhanced Graph-based Index for High-dimensional Approximate Nearest Neighbor Search
by: Zhong, Xiaoyao, et al.
Published: (2025)
by: Zhong, Xiaoyao, et al.
Published: (2025)
Simpler is More: Efficient Top-K Nearest Neighbors Search on Large Road Networks
by: Wang, Yiqi, et al.
Published: (2024)
by: Wang, Yiqi, et al.
Published: (2024)
LogLite: Lightweight Plug-and-Play Streaming Log Compression
by: Tang, Benzhao, et al.
Published: (2025)
by: Tang, Benzhao, et al.
Published: (2025)
Castle: Causal Cascade Updates in Relational Databases with Large Language Models
by: Su, Yongye, et al.
Published: (2025)
by: Su, Yongye, et al.
Published: (2025)
Relational Database Augmented Large Language Model
by: Qin, Zongyue, et al.
Published: (2024)
by: Qin, Zongyue, et al.
Published: (2024)
Efficient Approximate Nearest Neighbor Search under Multi-Attribute Range Filter
by: Yu, Yuanhang, et al.
Published: (2026)
by: Yu, Yuanhang, et al.
Published: (2026)
StreamLink: Large-Language-Model Driven Distributed Data Engineering System
by: Feng, Dawei, et al.
Published: (2025)
by: Feng, Dawei, et al.
Published: (2025)
Towards Accurate and Efficient Document Analytics with Large Language Models
by: Lin, Yiming, et al.
Published: (2024)
by: Lin, Yiming, et al.
Published: (2024)
Constant-time Connectivity and 2-Edge Connectivity Querying in Dynamic Graphs
by: Xu, Lantian, et al.
Published: (2026)
by: Xu, Lantian, et al.
Published: (2026)
Data Cleaning Using Large Language Models
by: Zhang, Shuo, et al.
Published: (2024)
by: Zhang, Shuo, et al.
Published: (2024)
Towards Automated Cross-domain Exploratory Data Analysis through Large Language Models
by: Zhu, Jun-Peng, et al.
Published: (2024)
by: Zhu, Jun-Peng, et al.
Published: (2024)
A Generative Caching System for Large Language Models
by: Iyengar, Arun, et al.
Published: (2025)
by: Iyengar, Arun, et al.
Published: (2025)
Hybrid Querying Over Relational Databases and Large Language Models
by: Zhao, Fuheng, et al.
Published: (2024)
by: Zhao, Fuheng, et al.
Published: (2024)
Cocoon: Semantic Table Profiling Using Large Language Models
by: Huang, Zezhou, et al.
Published: (2024)
by: Huang, Zezhou, et al.
Published: (2024)
C$^{2}$TC: A Training-Free Framework for Efficient Tabular Data Condensation
by: Xu, Sijia, et al.
Published: (2026)
by: Xu, Sijia, et al.
Published: (2026)
ZeroED: Hybrid Zero-shot Error Detection through Large Language Model Reasoning
by: Ni, Wei, et al.
Published: (2025)
by: Ni, Wei, et al.
Published: (2025)
ZipCache: A DRAM/SSD Cache with Built-in Transparent Compression
by: Xie, Rui, et al.
Published: (2024)
by: Xie, Rui, et al.
Published: (2024)
Common Neighborhood Estimation over Bipartite Graphs under Local Differential Privacy
by: He, Yizhang, et al.
Published: (2025)
by: He, Yizhang, et al.
Published: (2025)
GTRSS: Graph-based Top-$k$ Representative Similar Subtrajectory Query
by: Ge, Mingchang, et al.
Published: (2025)
by: Ge, Mingchang, et al.
Published: (2025)
MageSQL: Enhancing In-context Learning for Text-to-SQL Applications with Large Language Models
by: Shen, Chen, et al.
Published: (2025)
by: Shen, Chen, et al.
Published: (2025)
Efficient Cloud-edge Collaborative Approaches to SPARQL Queries over Large RDF graphs
by: Ma, Shidan, et al.
Published: (2026)
by: Ma, Shidan, et al.
Published: (2026)
Efficient Influence Minimization via Node Blocking
by: Wang, Jinghao, et al.
Published: (2024)
by: Wang, Jinghao, et al.
Published: (2024)
Similar Items
-
ContextCache: Context-Aware Semantic Cache for Multi-Turn Queries in Large Language Models
by: Yan, Jianxin, et al.
Published: (2025) -
StructRide: A Framework to Exploit the Structure Information of Shareability Graph in Ridesharing
by: Zhan, Jiexi, et al.
Published: (2024) -
Wait to be Faster: a Smart Pooling Framework for Dynamic Ridesharing
by: Zhong, Xiaoyao, et al.
Published: (2024) -
QCFuse: Query-Centric Cache Fusion for Efficient RAG Inference
by: Yan, Jianxin, et al.
Published: (2026) -
Efficient Multiple Temporal Network Kernel Density Estimation
by: Shao, Yu, et al.
Published: (2025)