Auditing Prompt Caching in Language Model APIs
Fuente:
arXiv
Guardado en:
| Autores principales: | Gu, Chenchen, Li, Xiang Lisa, Kuditipudi, Rohith, Liang, Percy, Hashimoto, Tatsunori |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Robust Distortion-free Watermarks for Language Models
por: Kuditipudi, Rohith, et al.
Publicado: (2023)
por: Kuditipudi, Rohith, et al.
Publicado: (2023)
On the Learnability of Watermarks for Language Models
por: Gu, Chenchen, et al.
Publicado: (2023)
por: Gu, Chenchen, et al.
Publicado: (2023)
CacheProbe: Auditing Prompt Cache Isolation in Gateway APIs
por: Fahey, Ryan
Publicado: (2026)
por: Fahey, Ryan
Publicado: (2026)
Are You Getting What You Pay For? Auditing Model Substitution in LLM APIs
por: Cai, Will, et al.
Publicado: (2025)
por: Cai, Will, et al.
Publicado: (2025)
Resampling methods for private statistical inference
por: Chadha, Karan, et al.
Publicado: (2024)
por: Chadha, Karan, et al.
Publicado: (2024)
Beyond Indistinguishability: Measuring Extraction Risk in LLM APIs
por: Liu, Ruixuan, et al.
Publicado: (2026)
por: Liu, Ruixuan, et al.
Publicado: (2026)
Independence Tests for Language Models
por: Zhu, Sally, et al.
Publicado: (2025)
por: Zhu, Sally, et al.
Publicado: (2025)
Trustless Audits without Revealing Data or Models
por: Waiwitlikhit, Suppakit, et al.
Publicado: (2024)
por: Waiwitlikhit, Suppakit, et al.
Publicado: (2024)
Backdooring Instruction-Tuned Large Language Models with Virtual Prompt Injection
por: Yan, Jun, et al.
Publicado: (2023)
por: Yan, Jun, et al.
Publicado: (2023)
PromptRobust: Towards Evaluating the Robustness of Large Language Models on Adversarial Prompts
por: Zhu, Kaijie, et al.
Publicado: (2023)
por: Zhu, Kaijie, et al.
Publicado: (2023)
An Early Categorization of Prompt Injection Attacks on Large Language Models
por: Rossi, Sippo, et al.
Publicado: (2024)
por: Rossi, Sippo, et al.
Publicado: (2024)
Securing Large Language Models (LLMs) from Prompt Injection Attacks
por: Suri, Omar Farooq Khan, et al.
Publicado: (2025)
por: Suri, Omar Farooq Khan, et al.
Publicado: (2025)
Prompt Public Large Language Models to Synthesize Data for Private On-device Applications
por: Wu, Shanshan, et al.
Publicado: (2024)
por: Wu, Shanshan, et al.
Publicado: (2024)
SOS! Soft Prompt Attack Against Open-Source Large Language Models
por: Yang, Ziqing, et al.
Publicado: (2024)
por: Yang, Ziqing, et al.
Publicado: (2024)
Checkpoint-GCG: Auditing and Attacking Fine-Tuning-Based Prompt Injection Defenses
por: Yang, Xiaoxue, et al.
Publicado: (2025)
por: Yang, Xiaoxue, et al.
Publicado: (2025)
Empirical Analysis of Large Vision-Language Models against Goal Hijacking via Visual Prompt Injection
por: Kimura, Subaru, et al.
Publicado: (2024)
por: Kimura, Subaru, et al.
Publicado: (2024)
SPML: A DSL for Defending Language Models Against Prompt Attacks
por: Sharma, Reshabh K, et al.
Publicado: (2024)
por: Sharma, Reshabh K, et al.
Publicado: (2024)
Language Models May Verbatim Complete Text They Were Not Explicitly Trained On
por: Liu, Ken Ziyu, et al.
Publicado: (2025)
por: Liu, Ken Ziyu, et al.
Publicado: (2025)
The Canary's Echo: Auditing Privacy Risks of LLM-Generated Synthetic Text
por: Meeus, Matthieu, et al.
Publicado: (2025)
por: Meeus, Matthieu, et al.
Publicado: (2025)
Improved Techniques for Optimization-Based Jailbreaking on Large Language Models
por: Jia, Xiaojun, et al.
Publicado: (2024)
por: Jia, Xiaojun, et al.
Publicado: (2024)
Debiasing Watermarks for Large Language Models via Maximal Coupling
por: Xie, Yangxinyu, et al.
Publicado: (2024)
por: Xie, Yangxinyu, et al.
Publicado: (2024)
Token-Specific Watermarking with Enhanced Detectability and Semantic Coherence for Large Language Models
por: Huo, Mingjia, et al.
Publicado: (2024)
por: Huo, Mingjia, et al.
Publicado: (2024)
Watermarking Language Models through Language Models
por: Dasgupta, Agnibh, et al.
Publicado: (2024)
por: Dasgupta, Agnibh, et al.
Publicado: (2024)
Deciphering the Chaos: Enhancing Jailbreak Attacks via Adversarial Prompt Translation
por: Li, Qizhang, et al.
Publicado: (2024)
por: Li, Qizhang, et al.
Publicado: (2024)
CR-UTP: Certified Robustness against Universal Text Perturbations on Large Language Models
por: Lou, Qian, et al.
Publicado: (2024)
por: Lou, Qian, et al.
Publicado: (2024)
Automatic Pseudo-Harmful Prompt Generation for Evaluating False Refusals in Large Language Models
por: An, Bang, et al.
Publicado: (2024)
por: An, Bang, et al.
Publicado: (2024)
SequentialBreak: Large Language Models Can be Fooled by Embedding Jailbreak Prompts into Sequential Prompt Chains
por: Saiem, Bijoy Ahmed, et al.
Publicado: (2024)
por: Saiem, Bijoy Ahmed, et al.
Publicado: (2024)
Unlocking Memorization in Large Language Models with Dynamic Soft Prompting
por: Wang, Zhepeng, et al.
Publicado: (2024)
por: Wang, Zhepeng, et al.
Publicado: (2024)
Differentially Private Tabular Data Synthesis using Large Language Models
por: Tran, Toan V., et al.
Publicado: (2024)
por: Tran, Toan V., et al.
Publicado: (2024)
Hidden Ads: Behavior Triggered Semantic Backdoors for Advertisement Injection in Vision Language Models
por: Yao, Duanyi, et al.
Publicado: (2026)
por: Yao, Duanyi, et al.
Publicado: (2026)
Model Provenance Testing for Large Language Models
por: Nikolic, Ivica, et al.
Publicado: (2025)
por: Nikolic, Ivica, et al.
Publicado: (2025)
Defending Against Indirect Prompt Injection Attacks With Spotlighting
por: Hines, Keegan, et al.
Publicado: (2024)
por: Hines, Keegan, et al.
Publicado: (2024)
Towards the Anonymization of the Language Modeling
por: Boutet, Antoine, et al.
Publicado: (2025)
por: Boutet, Antoine, et al.
Publicado: (2025)
Privately Learning from Graphs with Applications in Fine-tuning Large Language Models
por: Yin, Haoteng, et al.
Publicado: (2024)
por: Yin, Haoteng, et al.
Publicado: (2024)
Digger: Detecting Copyright Content Mis-usage in Large Language Model Training
por: Li, Haodong, et al.
Publicado: (2024)
por: Li, Haodong, et al.
Publicado: (2024)
Exploiting Novel GPT-4 APIs
por: Pelrine, Kellin, et al.
Publicado: (2023)
por: Pelrine, Kellin, et al.
Publicado: (2023)
RECAP: A Resource-Efficient Method for Adversarial Prompting in Large Language Models
por: Chugh, Rishit
Publicado: (2026)
por: Chugh, Rishit
Publicado: (2026)
MIA-Tuner: Adapting Large Language Models as Pre-training Text Detector
por: Fu, Wenjie, et al.
Publicado: (2024)
por: Fu, Wenjie, et al.
Publicado: (2024)
A Watermark for Large Language Models
por: Kirchenbauer, John, et al.
Publicado: (2023)
por: Kirchenbauer, John, et al.
Publicado: (2023)
Localizing Paragraph Memorization in Language Models
por: Stoehr, Niklas, et al.
Publicado: (2024)
por: Stoehr, Niklas, et al.
Publicado: (2024)
Ejemplares similares
-
Robust Distortion-free Watermarks for Language Models
por: Kuditipudi, Rohith, et al.
Publicado: (2023) -
On the Learnability of Watermarks for Language Models
por: Gu, Chenchen, et al.
Publicado: (2023) -
CacheProbe: Auditing Prompt Cache Isolation in Gateway APIs
por: Fahey, Ryan
Publicado: (2026) -
Are You Getting What You Pay For? Auditing Model Substitution in LLM APIs
por: Cai, Will, et al.
Publicado: (2025) -
Resampling methods for private statistical inference
por: Chadha, Karan, et al.
Publicado: (2024)