On Protecting Agentic Systems' Intellectual Property via Watermarking
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Wang, Liwen, Li, Zongjie, Xie, Yuchong, Wang, Shuai, She, Dongdong, Wang, Wei, Rahmel, Juergen |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
QueryIPI: Query-agnostic Indirect Prompt Injection on Coding Agents
par: Xie, Yuchong, et autres
Publié: (2025)
par: Xie, Yuchong, et autres
Publié: (2025)
Red-Teaming Coding Agents from a Tool-Invocation Perspective: An Empirical Security Assessment
par: Xie, Yuchong, et autres
Publié: (2025)
par: Xie, Yuchong, et autres
Publié: (2025)
SelfDefend: LLMs Can Defend Themselves against Jailbreaking in a Practical Manner
par: Wang, Xunguang, et autres
Publié: (2024)
par: Wang, Xunguang, et autres
Publié: (2024)
CompressionAttack: Exploiting Prompt Compression as a New Attack Surface in LLM-Powered Agents
par: Liu, Zesen, et autres
Publié: (2025)
par: Liu, Zesen, et autres
Publié: (2025)
From Similarity to Vulnerability: Key Collision Attack on LLM Semantic Caching
par: Zhang, Zhixiang, et autres
Publié: (2026)
par: Zhang, Zhixiang, et autres
Publié: (2026)
Protecting Your Voice: Temporal-aware Robust Watermarking
par: Li, Yue, et autres
Publié: (2025)
par: Li, Yue, et autres
Publié: (2025)
Protecting Deep Neural Network Intellectual Property with Chaos-Based White-Box Watermarking
par: B, Sangeeth, et autres
Publié: (2025)
par: B, Sangeeth, et autres
Publié: (2025)
Differentiation-Based Extraction of Proprietary Data from Fine-Tuned LLMs
par: Li, Zongjie, et autres
Publié: (2025)
par: Li, Zongjie, et autres
Publié: (2025)
IP Leakage Attacks Targeting LLM-Based Multi-Agent Systems
par: Wang, Liwen, et autres
Publié: (2025)
par: Wang, Liwen, et autres
Publié: (2025)
Watermarking Graph Neural Networks via Explanations for Ownership Protection
par: Downer, Jane, et autres
Publié: (2025)
par: Downer, Jane, et autres
Publié: (2025)
SoK: Evaluating Jailbreak Guardrails for Large Language Models
par: Wang, Xunguang, et autres
Publié: (2025)
par: Wang, Xunguang, et autres
Publié: (2025)
RTLMarker: Protecting LLM-Generated RTL Copyright via a Hardware Watermarking Framework
par: Wang, Kun, et autres
Publié: (2025)
par: Wang, Kun, et autres
Publié: (2025)
PragLocker: Protecting Agent Intellectual Property in Untrusted Deployments via Non-Portable Prompts
par: Li, Qinfeng, et autres
Publié: (2026)
par: Li, Qinfeng, et autres
Publié: (2026)
SOLIDO: A Robust Watermarking Method for Speech Synthesis via Low-Rank Adaptation
par: Li, Yue, et autres
Publié: (2025)
par: Li, Yue, et autres
Publié: (2025)
Beyond Content Safety: Real-Time Monitoring for Reasoning Vulnerabilities in Large Language Models
par: Wang, Xunguang, et autres
Publié: (2026)
par: Wang, Xunguang, et autres
Publié: (2026)
SEAL: Subspace-Anchored Watermarks for LLM Ownership
par: Dai, Yanbo, et autres
Publié: (2025)
par: Dai, Yanbo, et autres
Publié: (2025)
DNF: Dual-Layer Nested Fingerprinting for Large Language Model Intellectual Property Protection
par: Xu, Zhenhua, et autres
Publié: (2026)
par: Xu, Zhenhua, et autres
Publié: (2026)
Learning to Watermark: A Selective Watermarking Framework for Large Language Models via Multi-Objective Optimization
par: Wang, Chenrui, et autres
Publié: (2025)
par: Wang, Chenrui, et autres
Publié: (2025)
Attack-Resistant Watermarking for AIGC Image Forensics via Diffusion-based Semantic Deflection
par: Liu, Qingyu, et autres
Publié: (2026)
par: Liu, Qingyu, et autres
Publié: (2026)
Measuring the Permission Gate: A Stress-Test Evaluation of Claude Code's Auto Mode
par: Ji, Zimo, et autres
Publié: (2026)
par: Ji, Zimo, et autres
Publié: (2026)
When Alignment Isn't Enough: Response-Path Attacks on LLM Agents
par: Luo, Mingyu, et autres
Publié: (2026)
par: Luo, Mingyu, et autres
Publié: (2026)
Taxonomy, Evaluation and Exploitation of IPI-Centric LLM Agent Defense Frameworks
par: Ji, Zimo, et autres
Publié: (2025)
par: Ji, Zimo, et autres
Publié: (2025)
ZTaint-Havoc: From Havoc Mode to Zero-Execution Fuzzing-Driven Taint Inference
par: Xie, Yuchong, et autres
Publié: (2025)
par: Xie, Yuchong, et autres
Publié: (2025)
STShield: Single-Token Sentinel for Real-Time Jailbreak Detection in Large Language Models
par: Wang, Xunguang, et autres
Publié: (2025)
par: Wang, Xunguang, et autres
Publié: (2025)
Revisiting the Information Capacity of Neural Network Watermarks: Upper Bound Estimation and Beyond
par: Li, Fangqi, et autres
Publié: (2024)
par: Li, Fangqi, et autres
Publié: (2024)
Intellectual Property Protection for Deep Learning Model and Dataset Intelligence
par: Jiang, Yongqi, et autres
Publié: (2024)
par: Jiang, Yongqi, et autres
Publié: (2024)
On Google's SynthID-Text LLM Watermarking System: Theoretical Analysis and Empirical Validation
par: Omidi, Romina, et autres
Publié: (2026)
par: Omidi, Romina, et autres
Publié: (2026)
AGATE: Stealthy Black-box Watermarking for Multimodal Model Copyright Protection
par: Gao, Jianbo, et autres
Publié: (2025)
par: Gao, Jianbo, et autres
Publié: (2025)
Deep Learning-based Dual Watermarking for Image Copyright Protection and Authentication
par: Padhi, Sudev Kumar, et autres
Publié: (2025)
par: Padhi, Sudev Kumar, et autres
Publié: (2025)
PCDiff: Proactive Control for Ownership Protection in Diffusion Models with Watermark Compatibility
par: Gai, Keke, et autres
Publié: (2025)
par: Gai, Keke, et autres
Publié: (2025)
Building Intelligence Identification System via Large Language Model Watermarking: A Survey and Beyond
par: Wang, Xuhong, et autres
Publié: (2024)
par: Wang, Xuhong, et autres
Publié: (2024)
RobWE: Robust Watermark Embedding for Personalized Federated Learning Model Ownership Protection
par: Xu, Yang, et autres
Publié: (2024)
par: Xu, Yang, et autres
Publié: (2024)
Multi-Designated Detector Watermarking for Language Models
par: Huang, Zhengan, et autres
Publié: (2024)
par: Huang, Zhengan, et autres
Publié: (2024)
ChainMarks: Securing DNN Watermark with Cryptographic Chain
par: Choi, Brian, et autres
Publié: (2025)
par: Choi, Brian, et autres
Publié: (2025)
Intellectual Property in Graph-Based Machine Learning as a Service: Attacks and Defenses
par: Li, Lincan, et autres
Publié: (2025)
par: Li, Lincan, et autres
Publié: (2025)
FLClear: Visually Verifiable Multi-Client Watermarking for Federated Learning
par: Gu, Chen, et autres
Publié: (2025)
par: Gu, Chen, et autres
Publié: (2025)
Asking Back: Interaction-Layer Antidistillation Watermarks
par: Yang, Guang, et autres
Publié: (2026)
par: Yang, Guang, et autres
Publié: (2026)
Reliable Model Watermarking: Defending Against Theft without Compromising on Evasion
par: Zhu, Hongyu, et autres
Publié: (2024)
par: Zhu, Hongyu, et autres
Publié: (2024)
AdapTools: Adaptive Tool-based Indirect Prompt Injection Attacks on Agentic LLMs
par: Wang, Che, et autres
Publié: (2026)
par: Wang, Che, et autres
Publié: (2026)
SSCL-BW: Sample-Specific Clean-Label Backdoor Watermarking for Dataset Ownership Verification
par: Wang, Yingjia, et autres
Publié: (2025)
par: Wang, Yingjia, et autres
Publié: (2025)
Documents similaires
-
QueryIPI: Query-agnostic Indirect Prompt Injection on Coding Agents
par: Xie, Yuchong, et autres
Publié: (2025) -
Red-Teaming Coding Agents from a Tool-Invocation Perspective: An Empirical Security Assessment
par: Xie, Yuchong, et autres
Publié: (2025) -
SelfDefend: LLMs Can Defend Themselves against Jailbreaking in a Practical Manner
par: Wang, Xunguang, et autres
Publié: (2024) -
CompressionAttack: Exploiting Prompt Compression as a New Attack Surface in LLM-Powered Agents
par: Liu, Zesen, et autres
Publié: (2025) -
From Similarity to Vulnerability: Key Collision Attack on LLM Semantic Caching
par: Zhang, Zhixiang, et autres
Publié: (2026)