Benchmarking Knowledge-Extraction Attack and Defense on Retrieval-Augmented Generation
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Qi, Zhisheng, Sahu, Utkarsh, Ma, Li, Han, Haoyu, Rossi, Ryan, Dernoncourt, Franck, Halappanavar, Mahantesh, Ahmed, Nesreen, Dong, Yushun, Zhao, Yue, Zhang, Yu, Wang, Yu |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
A Graph Perspective to Probe Structural Patterns of Knowledge in Large Language Models
par: Sahu, Utkarsh, et autres
Publié: (2025)
par: Sahu, Utkarsh, et autres
Publié: (2025)
External Data Extraction Attacks against Retrieval-Augmented Large Language Models
par: He, Yu, et autres
Publié: (2025)
par: He, Yu, et autres
Publié: (2025)
A Survey on Model Extraction Attacks and Defenses for Large Language Models
par: Zhao, Kaixiang, et autres
Publié: (2025)
par: Zhao, Kaixiang, et autres
Publié: (2025)
A Survey of Model Extraction Attacks and Defenses in Distributed Computing Environments
par: Zhao, Kaixiang, et autres
Publié: (2025)
par: Zhao, Kaixiang, et autres
Publié: (2025)
A Systematic Survey of Model Extraction Attacks and Defenses: State-of-the-Art and Perspectives
par: Zhao, Kaixiang, et autres
Publié: (2025)
par: Zhao, Kaixiang, et autres
Publié: (2025)
Knowledge Homophily in Large Language Models
par: Sahu, Utkarsh, et autres
Publié: (2025)
par: Sahu, Utkarsh, et autres
Publié: (2025)
Data Extraction Attacks in Retrieval-Augmented Generation via Backdoors
par: Peng, Yuefeng, et autres
Publié: (2024)
par: Peng, Yuefeng, et autres
Publié: (2024)
Defensive Prompt Patch: A Robust and Interpretable Defense of LLMs against Jailbreak Attacks
par: Xiong, Chen, et autres
Publié: (2024)
par: Xiong, Chen, et autres
Publié: (2024)
System Prompt Extraction Attacks and Defenses in Large Language Models
par: Das, Badhan Chandra, et autres
Publié: (2025)
par: Das, Badhan Chandra, et autres
Publié: (2025)
Feedback-Guided Extraction of Knowledge Base from Retrieval-Augmented LLM Applications
par: Jiang, Changyue, et autres
Publié: (2024)
par: Jiang, Changyue, et autres
Publié: (2024)
"Someone Hid It": Query-Agnostic Black-Box Attacks on LLM-Based Retrieval
par: Li, Jiate, et autres
Publié: (2026)
par: Li, Jiate, et autres
Publié: (2026)
Securing Retrieval-Augmented Generation: A Taxonomy of Attacks, Defenses, and Future Directions
par: Xu, Yuming, et autres
Publié: (2026)
par: Xu, Yuming, et autres
Publié: (2026)
Knowledge Poisoning Attacks on Medical Multi-Modal Retrieval-Augmented Generation
par: Yang, Peiru, et autres
Publié: (2026)
par: Yang, Peiru, et autres
Publié: (2026)
Intellectual Property in Graph-Based Machine Learning as a Service: Attacks and Defenses
par: Li, Lincan, et autres
Publié: (2025)
par: Li, Lincan, et autres
Publié: (2025)
Fine-Grained Privacy Extraction from Retrieval-Augmented Generation Systems via Knowledge Asymmetry Exploitation
par: Chen, Yufei, et autres
Publié: (2025)
par: Chen, Yufei, et autres
Publié: (2025)
Towards Secure Retrieval-Augmented Generation: A Comprehensive Review of Threats, Defenses and Benchmarks
par: Mu, Yanming, et autres
Publié: (2026)
par: Mu, Yanming, et autres
Publié: (2026)
RAG Safety: Exploring Knowledge Poisoning Attacks to Retrieval-Augmented Generation
par: Zhao, Tianzhe, et autres
Publié: (2025)
par: Zhao, Tianzhe, et autres
Publié: (2025)
Poisoned-MRAG: Knowledge Poisoning Attacks to Multimodal Retrieval Augmented Generation
par: Liu, Yinuo, et autres
Publié: (2025)
par: Liu, Yinuo, et autres
Publié: (2025)
Cybersecurity Defenses: Exploration of CVE Types through Attack Descriptions
par: Othman, Refat, et autres
Publié: (2024)
par: Othman, Refat, et autres
Publié: (2024)
Defenses Against Prompt Attacks Learn Surface Heuristics
par: Li, Shawn, et autres
Publié: (2026)
par: Li, Shawn, et autres
Publié: (2026)
Certified Defense on the Fairness of Graph Neural Networks
par: Dong, Yushun, et autres
Publié: (2023)
par: Dong, Yushun, et autres
Publié: (2023)
JNI Global References Are Still Vulnerable: Attacks and Defenses
par: He, Yi, et autres
Publié: (2024)
par: He, Yi, et autres
Publié: (2024)
Hoist with His Own Petard: Inducing Guardrails to Facilitate Denial-of-Service Attacks on Retrieval-Augmented Generation of LLMs
par: Suo, Pan, et autres
Publié: (2025)
par: Suo, Pan, et autres
Publié: (2025)
ATOM: A Framework of Detecting Query-Based Model Extraction Attacks for Graph Neural Networks
par: Cheng, Zhan, et autres
Publié: (2025)
par: Cheng, Zhan, et autres
Publié: (2025)
A Systematic Study of Model Extraction Attacks on Graph Foundation Models
par: Xu, Haoyan, et autres
Publié: (2025)
par: Xu, Haoyan, et autres
Publié: (2025)
Benchmarking Poisoning Attacks against Retrieval-Augmented Generation
par: Zhang, Baolei, et autres
Publié: (2025)
par: Zhang, Baolei, et autres
Publié: (2025)
One Shot Dominance: Knowledge Poisoning Attack on Retrieval-Augmented Generation Systems
par: Chang, Zhiyuan, et autres
Publié: (2025)
par: Chang, Zhiyuan, et autres
Publié: (2025)
MIBench: A Comprehensive Framework for Benchmarking Model Inversion Attack and Defense
par: Qiu, Yixiang, et autres
Publié: (2024)
par: Qiu, Yixiang, et autres
Publié: (2024)
MIRAGE: Misleading Retrieval-Augmented Generation via Black-box and Query-agnostic Poisoning Attacks
par: Chen, Tailun, et autres
Publié: (2025)
par: Chen, Tailun, et autres
Publié: (2025)
PoisonedRAG: Knowledge Corruption Attacks to Retrieval-Augmented Generation of Large Language Models
par: Zou, Wei, et autres
Publié: (2024)
par: Zou, Wei, et autres
Publié: (2024)
Towards Model Extraction Attacks in GAN-Based Image Translation via Domain Shift Mitigation
par: Mi, Di, et autres
Publié: (2024)
par: Mi, Di, et autres
Publié: (2024)
AutoJailbreak: Exploring Jailbreak Attacks and Defenses through a Dependency Lens
par: Lu, Lin, et autres
Publié: (2024)
par: Lu, Lin, et autres
Publié: (2024)
RoboJailBench: Benchmarking Adversarial Attacks and Defenses in Embodied Robotic Agents
par: Yeke, Doguhuan, et autres
Publié: (2026)
par: Yeke, Doguhuan, et autres
Publié: (2026)
Defense Against Prompt Injection Attack by Leveraging Attack Techniques
par: Chen, Yulin, et autres
Publié: (2024)
par: Chen, Yulin, et autres
Publié: (2024)
E-SAGE: Explainability-based Defense Against Backdoor Attacks on Graph Neural Networks
par: Yuan, Dingqiang, et autres
Publié: (2024)
par: Yuan, Dingqiang, et autres
Publié: (2024)
PRAG: End-to-End Privacy-Preserving Retrieval-Augmented Generation
par: Li, Zhijun, et autres
Publié: (2026)
par: Li, Zhijun, et autres
Publié: (2026)
ThreatPilot: Attack-Driven Threat Intelligence Extraction
par: Xu, Ming, et autres
Publié: (2024)
par: Xu, Ming, et autres
Publié: (2024)
Spore: Efficient and Training-Free Privacy Extraction Attack on LLMs via Inference-Time Hybrid Probing
par: Cui, Yu, et autres
Publié: (2026)
par: Cui, Yu, et autres
Publié: (2026)
$\textit{MMJ-Bench}$: A Comprehensive Study on Jailbreak Attacks and Defenses for Multimodal Large Language Models
par: Weng, Fenghua, et autres
Publié: (2024)
par: Weng, Fenghua, et autres
Publié: (2024)
Federated Learning: Attacks, Defenses, Opportunities, and Challenges
par: Shirvani, Ghazaleh, et autres
Publié: (2024)
par: Shirvani, Ghazaleh, et autres
Publié: (2024)
Documents similaires
-
A Graph Perspective to Probe Structural Patterns of Knowledge in Large Language Models
par: Sahu, Utkarsh, et autres
Publié: (2025) -
External Data Extraction Attacks against Retrieval-Augmented Large Language Models
par: He, Yu, et autres
Publié: (2025) -
A Survey on Model Extraction Attacks and Defenses for Large Language Models
par: Zhao, Kaixiang, et autres
Publié: (2025) -
A Survey of Model Extraction Attacks and Defenses in Distributed Computing Environments
par: Zhao, Kaixiang, et autres
Publié: (2025) -
A Systematic Survey of Model Extraction Attacks and Defenses: State-of-the-Art and Perspectives
par: Zhao, Kaixiang, et autres
Publié: (2025)