Enregistré dans:
| Auteurs principaux: | Dai, Yanbo, Ji, Zhenlan, Li, Zongjie, Li, Kuan, Wang, Shuai |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | https://arxiv.org/abs/2508.20083 |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
SEAL: Subspace-Anchored Watermarks for LLM Ownership
par: Dai, Yanbo, et autres
Publié: (2025)
par: Dai, Yanbo, et autres
Publié: (2025)
STShield: Single-Token Sentinel for Real-Time Jailbreak Detection in Large Language Models
par: Wang, Xunguang, et autres
Publié: (2025)
par: Wang, Xunguang, et autres
Publié: (2025)
Retrieval-Augmented Review Generation for Poisoning Recommender Systems
par: Yang, Shiyi, et autres
Publié: (2025)
par: Yang, Shiyi, et autres
Publié: (2025)
IP Leakage Attacks Targeting LLM-Based Multi-Agent Systems
par: Wang, Liwen, et autres
Publié: (2025)
par: Wang, Liwen, et autres
Publié: (2025)
RAG Safety: Exploring Knowledge Poisoning Attacks to Retrieval-Augmented Generation
par: Zhao, Tianzhe, et autres
Publié: (2025)
par: Zhao, Tianzhe, et autres
Publié: (2025)
Riddle Me This! Stealthy Membership Inference for Retrieval-Augmented Generation
par: Naseh, Ali, et autres
Publié: (2025)
par: Naseh, Ali, et autres
Publié: (2025)
EAMET: Robust Massive Model Editing via Embedding Alignment Optimization
par: Dai, Yanbo, et autres
Publié: (2025)
par: Dai, Yanbo, et autres
Publié: (2025)
Data Extraction Attacks in Retrieval-Augmented Generation via Backdoors
par: Peng, Yuefeng, et autres
Publié: (2024)
par: Peng, Yuefeng, et autres
Publié: (2024)
GuidedBench: Measuring and Mitigating the Evaluation Discrepancies of In-the-wild LLM Jailbreak Methods
par: Huang, Ruixuan, et autres
Publié: (2025)
par: Huang, Ruixuan, et autres
Publié: (2025)
SoK: Evaluating Jailbreak Guardrails for Large Language Models
par: Wang, Xunguang, et autres
Publié: (2025)
par: Wang, Xunguang, et autres
Publié: (2025)
Differentially Private Retrieval-Augmented Generation
par: Tang, Tingting, et autres
Publié: (2026)
par: Tang, Tingting, et autres
Publié: (2026)
Compiling Activation Steering into Weights via Null-Space Constraints for Stealthy Backdoors
par: Yin, Rui, et autres
Publié: (2026)
par: Yin, Rui, et autres
Publié: (2026)
Bias Amplification in RAG: Poisoning Knowledge Retrieval to Steer LLMs
par: Wang, Linlin, et autres
Publié: (2025)
par: Wang, Linlin, et autres
Publié: (2025)
Dataset Protection via Watermarked Canaries in Retrieval-Augmented LLMs
par: Liu, Yepeng, et autres
Publié: (2025)
par: Liu, Yepeng, et autres
Publié: (2025)
Pandora: Jailbreak GPTs by Retrieval Augmented Generation Poisoning
par: Deng, Gelei, et autres
Publié: (2024)
par: Deng, Gelei, et autres
Publié: (2024)
SoK: Privacy Risks and Mitigations in Retrieval-Augmented Generation Systems
par: Bodea, Andreea-Elena, et autres
Publié: (2026)
par: Bodea, Andreea-Elena, et autres
Publié: (2026)
Efficient and Stealthy Jailbreak Attacks via Adversarial Prompt Distillation from LLMs to SLMs
par: Li, Xiang, et autres
Publié: (2025)
par: Li, Xiang, et autres
Publié: (2025)
When Machine Unlearning Meets Retrieval-Augmented Generation (RAG): Keep Secret or Forget Knowledge?
par: Wang, Shang, et autres
Publié: (2024)
par: Wang, Shang, et autres
Publié: (2024)
Beyond Text: Unveiling Privacy Vulnerabilities in Multi-modal Retrieval-Augmented Generation
par: Zhang, Jiankun, et autres
Publié: (2025)
par: Zhang, Jiankun, et autres
Publié: (2025)
One Pic is All it Takes: Poisoning Visual Document Retrieval Augmented Generation with a Single Image
par: Shereen, Ezzeldin, et autres
Publié: (2025)
par: Shereen, Ezzeldin, et autres
Publié: (2025)
Fight Poison with Poison: Enhancing Robustness in Few-shot Machine-Generated Text Detection with Adversarial Training
par: Duan, Wenjing, et autres
Publié: (2026)
par: Duan, Wenjing, et autres
Publié: (2026)
TrojanRAG: Retrieval-Augmented Generation Can Be Backdoor Driver in Large Language Models
par: Cheng, Pengzhou, et autres
Publié: (2024)
par: Cheng, Pengzhou, et autres
Publié: (2024)
Phantom: General Backdoor Attacks on Retrieval Augmented Language Generation
par: Chaudhari, Harsh, et autres
Publié: (2024)
par: Chaudhari, Harsh, et autres
Publié: (2024)
Privacy-Preserving Retrieval-Augmented Generation with Differential Privacy
par: Koga, Tatsuki, et autres
Publié: (2024)
par: Koga, Tatsuki, et autres
Publié: (2024)
AutoBnB-RAG: Enhancing Multi-Agent Incident Response with Retrieval-Augmented Generation
par: Liu, Zefang, et autres
Publié: (2025)
par: Liu, Zefang, et autres
Publié: (2025)
Differentially Private Synthetic Text Generation for Retrieval-Augmented Generation (RAG)
par: Mori, Junki, et autres
Publié: (2025)
par: Mori, Junki, et autres
Publié: (2025)
The Good and The Bad: Exploring Privacy Issues in Retrieval-Augmented Generation (RAG)
par: Zeng, Shenglai, et autres
Publié: (2024)
par: Zeng, Shenglai, et autres
Publié: (2024)
Large Language Models are Good Attackers: Efficient and Stealthy Textual Backdoor Attacks
par: Li, Ziqiang, et autres
Publié: (2024)
par: Li, Ziqiang, et autres
Publié: (2024)
SelfDefend: LLMs Can Defend Themselves against Jailbreaking in a Practical Manner
par: Wang, Xunguang, et autres
Publié: (2024)
par: Wang, Xunguang, et autres
Publié: (2024)
Machine Against the RAG: Jamming Retrieval-Augmented Generation with Blocker Documents
par: Shafran, Avital, et autres
Publié: (2024)
par: Shafran, Avital, et autres
Publié: (2024)
MARAGE: Transferable Multi-Model Adversarial Attack for Retrieval-Augmented Generation Data Extraction
par: Hu, Xiao, et autres
Publié: (2025)
par: Hu, Xiao, et autres
Publié: (2025)
Retrieval-Augmented Defense: Adaptive and Controllable Jailbreak Prevention for Large Language Models
par: Yang, Guangyu, et autres
Publié: (2025)
par: Yang, Guangyu, et autres
Publié: (2025)
Beyond Content Safety: Real-Time Monitoring for Reasoning Vulnerabilities in Large Language Models
par: Wang, Xunguang, et autres
Publié: (2026)
par: Wang, Xunguang, et autres
Publié: (2026)
A Decentralized Retrieval Augmented Generation System with Source Reliabilities Secured on Blockchain
par: Lu, Yining, et autres
Publié: (2025)
par: Lu, Yining, et autres
Publié: (2025)
UniC-RAG: Universal Knowledge Corruption Attacks to Retrieval-Augmented Generation
par: Geng, Runpeng, et autres
Publié: (2025)
par: Geng, Runpeng, et autres
Publié: (2025)
MIRAGE: Misleading Retrieval-Augmented Generation via Black-box and Query-agnostic Poisoning Attacks
par: Chen, Tailun, et autres
Publié: (2025)
par: Chen, Tailun, et autres
Publié: (2025)
Traceback of Poisoning Attacks to Retrieval-Augmented Generation
par: Zhang, Baolei, et autres
Publié: (2025)
par: Zhang, Baolei, et autres
Publié: (2025)
Black-Box Opinion Manipulation Attacks to Retrieval-Augmented Generation of Large Language Models
par: Chen, Zhuo, et autres
Publié: (2024)
par: Chen, Zhuo, et autres
Publié: (2024)
CPA-RAG:Covert Poisoning Attacks on Retrieval-Augmented Generation in Large Language Models
par: Li, Chunyang, et autres
Publié: (2025)
par: Li, Chunyang, et autres
Publié: (2025)
Topic-FlipRAG: Topic-Orientated Adversarial Opinion Manipulation Attacks to Retrieval-Augmented Generation Models
par: Gong, Yuyang, et autres
Publié: (2025)
par: Gong, Yuyang, et autres
Publié: (2025)
Documents similaires
-
SEAL: Subspace-Anchored Watermarks for LLM Ownership
par: Dai, Yanbo, et autres
Publié: (2025) -
STShield: Single-Token Sentinel for Real-Time Jailbreak Detection in Large Language Models
par: Wang, Xunguang, et autres
Publié: (2025) -
Retrieval-Augmented Review Generation for Poisoning Recommender Systems
par: Yang, Shiyi, et autres
Publié: (2025) -
IP Leakage Attacks Targeting LLM-Based Multi-Agent Systems
par: Wang, Liwen, et autres
Publié: (2025) -
RAG Safety: Exploring Knowledge Poisoning Attacks to Retrieval-Augmented Generation
par: Zhao, Tianzhe, et autres
Publié: (2025)