Safeguarding Multimodal Knowledge Copyright in the RAG-as-a-Service Environment
Fuente:
arXiv
Salvato in:
| Autori principali: | Chen, Tianyu, Lou, Jian, Wang, Wenjie |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Silent Leaks: Implicit Knowledge Extraction Attack on RAG Systems through Benign Queries
di: Wang, Yuhao, et al.
Pubblicazione: (2025)
di: Wang, Yuhao, et al.
Pubblicazione: (2025)
Why Safeguarded Ships Run Aground? Aligned Large Language Models' Safety Mechanisms Tend to Be Anchored in The Template Region
di: Leong, Chak Tou, et al.
Pubblicazione: (2025)
di: Leong, Chak Tou, et al.
Pubblicazione: (2025)
Safeguarding Text-to-Image Generative Models Against Unauthorized Knowledge Distillation
di: Gao, Yilan, et al.
Pubblicazione: (2026)
di: Gao, Yilan, et al.
Pubblicazione: (2026)
AdaShield: Safeguarding Multimodal Large Language Models from Structure-based Attack via Adaptive Shield Prompting
di: Wang, Yu, et al.
Pubblicazione: (2024)
di: Wang, Yu, et al.
Pubblicazione: (2024)
P$^2$RAG: Efficient Privacy-Preserving RAG Service Supporting Arbitrary Top-$k$ Retrieval
di: Ming, Yulong, et al.
Pubblicazione: (2026)
di: Ming, Yulong, et al.
Pubblicazione: (2026)
AGATE: Stealthy Black-box Watermarking for Multimodal Model Copyright Protection
di: Gao, Jianbo, et al.
Pubblicazione: (2025)
di: Gao, Jianbo, et al.
Pubblicazione: (2025)
CopyrightMeter: Revisiting Copyright Protection in Text-to-image Models
di: Xu, Naen, et al.
Pubblicazione: (2024)
di: Xu, Naen, et al.
Pubblicazione: (2024)
LLM Safeguard is a Double-Edged Sword: Exploiting False Positives for Denial-of-Service Attacks
di: Zhang, Qingzhao, et al.
Pubblicazione: (2024)
di: Zhang, Qingzhao, et al.
Pubblicazione: (2024)
TransLinkGuard: Safeguarding Transformer Models Against Model Stealing in Edge Deployment
di: Li, Qinfeng, et al.
Pubblicazione: (2024)
di: Li, Qinfeng, et al.
Pubblicazione: (2024)
A Trajectory-Based Safety Audit of Clawdbot (OpenClaw)
di: Chen, Tianyu, et al.
Pubblicazione: (2026)
di: Chen, Tianyu, et al.
Pubblicazione: (2026)
An AI Agent Execution Environment to Safeguard User Data
di: Stanley, Robert, et al.
Pubblicazione: (2026)
di: Stanley, Robert, et al.
Pubblicazione: (2026)
GuardReasoner-VL: Safeguarding VLMs via Reinforced Reasoning
di: Liu, Yue, et al.
Pubblicazione: (2025)
di: Liu, Yue, et al.
Pubblicazione: (2025)
Privacy-Aware RAG: Secure and Isolated Knowledge Retrieval
di: Zhou, Pengcheng, et al.
Pubblicazione: (2025)
di: Zhou, Pengcheng, et al.
Pubblicazione: (2025)
On the Evidentiary Limits of Membership Inference for Copyright Auditing
di: Ertan, Murat Bilgehan, et al.
Pubblicazione: (2026)
di: Ertan, Murat Bilgehan, et al.
Pubblicazione: (2026)
Cordon-MAS: Defending RAG against Knowledge Poisoning via Information-Flow Control
di: Yu, Zhe, et al.
Pubblicazione: (2026)
di: Yu, Zhe, et al.
Pubblicazione: (2026)
On Evaluating the Durability of Safeguards for Open-Weight LLMs
di: Qi, Xiangyu, et al.
Pubblicazione: (2024)
di: Qi, Xiangyu, et al.
Pubblicazione: (2024)
Safeguarding Large Language Models: A Survey
di: Dong, Yi, et al.
Pubblicazione: (2024)
di: Dong, Yi, et al.
Pubblicazione: (2024)
PromptKeeper: Safeguarding System Prompts for LLMs
di: Jiang, Zhifeng, et al.
Pubblicazione: (2024)
di: Jiang, Zhifeng, et al.
Pubblicazione: (2024)
Exploring and Developing a Pre-Model Safeguard with Draft Models
di: Cai, Hongyu, et al.
Pubblicazione: (2026)
di: Cai, Hongyu, et al.
Pubblicazione: (2026)
RTLMarker: Protecting LLM-Generated RTL Copyright via a Hardware Watermarking Framework
di: Wang, Kun, et al.
Pubblicazione: (2025)
di: Wang, Kun, et al.
Pubblicazione: (2025)
Safeguarding Federated Learning-based Road Condition Classification
di: Liu, Sheng, et al.
Pubblicazione: (2025)
di: Liu, Sheng, et al.
Pubblicazione: (2025)
Safeguarding AI Agents: Developing and Analyzing Safety Architectures
di: Domkundwar, Ishaan, et al.
Pubblicazione: (2024)
di: Domkundwar, Ishaan, et al.
Pubblicazione: (2024)
Re-Triggering Safeguards within LLMs for Jailbreak Detection
di: Lin, Zheng, et al.
Pubblicazione: (2026)
di: Lin, Zheng, et al.
Pubblicazione: (2026)
Do Multimodal RAG Systems Leak Data? A Comprehensive Evaluation of Membership Inference and Image Caption Retrieval Attacks
di: Al-Lawati, Ali, et al.
Pubblicazione: (2026)
di: Al-Lawati, Ali, et al.
Pubblicazione: (2026)
Shattering the Echo Chamber: Hidden Safeguards in Manuscripts Against the AI Takeover of Peer Review
di: Ma, Oubo, et al.
Pubblicazione: (2026)
di: Ma, Oubo, et al.
Pubblicazione: (2026)
PIR-RAG: A System for Private Information Retrieval in Retrieval-Augmented Generation
di: Wang, Baiqiang, et al.
Pubblicazione: (2025)
di: Wang, Baiqiang, et al.
Pubblicazione: (2025)
Embedding with Large Language Models for Classification of HIPAA Safeguard Compliance Rules
di: Rahman, Md Abdur, et al.
Pubblicazione: (2024)
di: Rahman, Md Abdur, et al.
Pubblicazione: (2024)
Do Not Merge My Model! Safeguarding Open-Source LLMs Against Unauthorized Model Merging
di: Li, Qinfeng, et al.
Pubblicazione: (2025)
di: Li, Qinfeng, et al.
Pubblicazione: (2025)
CoopGuard: Stateful Cooperative Agents Safeguarding LLMs Against Evolving Multi-Round Attacks
di: Li, Siyuan, et al.
Pubblicazione: (2026)
di: Li, Siyuan, et al.
Pubblicazione: (2026)
Reflect-Guard: Enhancing LLM Safeguards against Adversarial Prompts via Logical Self-Reflection
di: Lin, Lixing, et al.
Pubblicazione: (2026)
di: Lin, Lixing, et al.
Pubblicazione: (2026)
ME: Trigger Element Combination Backdoor Attack on Copyright Infringement
di: Yang, Feiyu, et al.
Pubblicazione: (2025)
di: Yang, Feiyu, et al.
Pubblicazione: (2025)
CrossGuard: Safeguarding MLLMs against Joint-Modal Implicit Malicious Attacks
di: Zhang, Xu, et al.
Pubblicazione: (2025)
di: Zhang, Xu, et al.
Pubblicazione: (2025)
Bridging the Copyright Gap: Do Large Vision-Language Models Recognize and Respect Copyrighted Content?
di: Xu, Naen, et al.
Pubblicazione: (2025)
di: Xu, Naen, et al.
Pubblicazione: (2025)
ProjLens: Unveiling the Role of Projectors in Multimodal Model Safety
di: Wang, Kun, et al.
Pubblicazione: (2026)
di: Wang, Kun, et al.
Pubblicazione: (2026)
Deep Learning-based Dual Watermarking for Image Copyright Protection and Authentication
di: Padhi, Sudev Kumar, et al.
Pubblicazione: (2025)
di: Padhi, Sudev Kumar, et al.
Pubblicazione: (2025)
MCP Guardian: A Security-First Layer for Safeguarding MCP-Based AI System
di: Kumar, Sonu, et al.
Pubblicazione: (2025)
di: Kumar, Sonu, et al.
Pubblicazione: (2025)
SecPE: Secure Prompt Ensembling for Private and Robust Large Language Models
di: Zhang, Jiawen, et al.
Pubblicazione: (2025)
di: Zhang, Jiawen, et al.
Pubblicazione: (2025)
ReliabilityRAG: Effective and Provably Robust Defense for RAG-based Web-Search
di: Shen, Zeyu, et al.
Pubblicazione: (2025)
di: Shen, Zeyu, et al.
Pubblicazione: (2025)
RAG-WM: An Efficient Black-Box Watermarking Approach for Retrieval-Augmented Generation of Large Language Models
di: Lv, Peizhuo, et al.
Pubblicazione: (2025)
di: Lv, Peizhuo, et al.
Pubblicazione: (2025)
The Stronger the Diffusion Model, the Easier the Backdoor: Data Poisoning to Induce Copyright Breaches Without Adjusting Finetuning Pipeline
di: Wang, Haonan, et al.
Pubblicazione: (2024)
di: Wang, Haonan, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Silent Leaks: Implicit Knowledge Extraction Attack on RAG Systems through Benign Queries
di: Wang, Yuhao, et al.
Pubblicazione: (2025) -
Why Safeguarded Ships Run Aground? Aligned Large Language Models' Safety Mechanisms Tend to Be Anchored in The Template Region
di: Leong, Chak Tou, et al.
Pubblicazione: (2025) -
Safeguarding Text-to-Image Generative Models Against Unauthorized Knowledge Distillation
di: Gao, Yilan, et al.
Pubblicazione: (2026) -
AdaShield: Safeguarding Multimodal Large Language Models from Structure-based Attack via Adaptive Shield Prompting
di: Wang, Yu, et al.
Pubblicazione: (2024) -
P$^2$RAG: Efficient Privacy-Preserving RAG Service Supporting Arbitrary Top-$k$ Retrieval
di: Ming, Yulong, et al.
Pubblicazione: (2026)