CoSPED: Consistent Soft Prompt Targeted Data Extraction and Defense
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Yang, Zhuochen, Fok, Kar Wai, Thing, Vrizlynn L. L. |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Enhanced MLLM Black-Box Jailbreaking Attacks and Defenses
par: Zhong, Xingwei, et autres
Publié: (2025)
par: Zhong, Xingwei, et autres
Publié: (2025)
DefenSee: Dissecting Threat from Sight and Text -- A Multi-View Defensive Pipeline for Multi-modal Jailbreaks
par: Wang, Zihao, et autres
Publié: (2025)
par: Wang, Zihao, et autres
Publié: (2025)
Enhanced Consistency Bi-directional GAN (CBiGAN) for Malware Anomaly Detection
par: Wijayasiri, Thesath, et autres
Publié: (2025)
par: Wijayasiri, Thesath, et autres
Publié: (2025)
ExpIDS: A Drift-adaptable Network Intrusion Detection System With Improved Explainability
par: Kumar, Ayush, et autres
Publié: (2025)
par: Kumar, Ayush, et autres
Publié: (2025)
Network Attack Traffic Detection With Hybrid Quantum-Enhanced Convolution Neural Network
par: Wang, Zihao, et autres
Publié: (2025)
par: Wang, Zihao, et autres
Publié: (2025)
Enhancing Network Intrusion Detection Performance using Generative Adversarial Networks
par: Zhao, Xinxing, et autres
Publié: (2024)
par: Zhao, Xinxing, et autres
Publié: (2024)
Exploring Emerging Trends in 5G Malicious Traffic Analysis and Incremental Learning Intrusion Detection Strategies
par: Wang, Zihao, et autres
Publié: (2024)
par: Wang, Zihao, et autres
Publié: (2024)
Privacy preserving layer partitioning for Deep Neural Network models
par: Rajasekar, Kishore, et autres
Publié: (2024)
par: Rajasekar, Kishore, et autres
Publié: (2024)
A Survey of Transaction Tracing Techniques for Blockchain Systems
par: Kumar, Ayush, et autres
Publié: (2025)
par: Kumar, Ayush, et autres
Publié: (2025)
Evaluating The Explainability of State-of-the-Art Deep Learning-based Network Intrusion Detection Systems
par: Kumar, Ayush, et autres
Publié: (2024)
par: Kumar, Ayush, et autres
Publié: (2024)
CPE-Identifier: Automated CPE identification and CVE summaries annotation with Deep Learning and NLP
par: Hu, Wanyu, et autres
Publié: (2024)
par: Hu, Wanyu, et autres
Publié: (2024)
Privacy-Preserving Intrusion Detection using Convolutional Neural Networks
par: Kodys, Martin, et autres
Publié: (2024)
par: Kodys, Martin, et autres
Publié: (2024)
SLIP: Soft Label Mechanism and Key-Extraction-Guided CoT-based Defense Against Instruction Backdoor in APIs
par: Wu, Zhengxian, et autres
Publié: (2025)
par: Wu, Zhengxian, et autres
Publié: (2025)
System Prompt Extraction Attacks and Defenses in Large Language Models
par: Das, Badhan Chandra, et autres
Publié: (2025)
par: Das, Badhan Chandra, et autres
Publié: (2025)
Defensive Prompt Patch: A Robust and Interpretable Defense of LLMs against Jailbreak Attacks
par: Xiong, Chen, et autres
Publié: (2024)
par: Xiong, Chen, et autres
Publié: (2024)
LocalAlign: Enabling Generalizable Prompt Injection Defense via Generation of Near-Target Adversarial Examples for Alignment Training
par: Gong, Yuyang, et autres
Publié: (2026)
par: Gong, Yuyang, et autres
Publié: (2026)
ProxyPrompt: Securing System Prompts against Prompt Extraction Attacks
par: Zhuang, Zhixiong, et autres
Publié: (2025)
par: Zhuang, Zhixiong, et autres
Publié: (2025)
Benchmarking Knowledge-Extraction Attack and Defense on Retrieval-Augmented Generation
par: Qi, Zhisheng, et autres
Publié: (2026)
par: Qi, Zhisheng, et autres
Publié: (2026)
AegisAgent: An Autonomous Defense Agent Against Prompt Injection Attacks in LLM-HARs
par: Wang, Yihan, et autres
Publié: (2025)
par: Wang, Yihan, et autres
Publié: (2025)
Soft Instruction De-escalation Defense
par: Walter, Nils Philipp, et autres
Publié: (2025)
par: Walter, Nils Philipp, et autres
Publié: (2025)
Backdoor-Powered Prompt Injection Attacks Nullify Defense Methods
par: Chen, Yulin, et autres
Publié: (2025)
par: Chen, Yulin, et autres
Publié: (2025)
Defending Against Prompt Injection With a Few DefensiveTokens
par: Chen, Sizhe, et autres
Publié: (2025)
par: Chen, Sizhe, et autres
Publié: (2025)
Defense Against Prompt Injection Attack by Leveraging Attack Techniques
par: Chen, Yulin, et autres
Publié: (2024)
par: Chen, Yulin, et autres
Publié: (2024)
PromptArmor: Simple yet Effective Prompt Injection Defenses
par: Shi, Tianneng, et autres
Publié: (2025)
par: Shi, Tianneng, et autres
Publié: (2025)
The Defense Trilemma: Why Prompt Injection Defense Wrappers Fail?
par: Bhatt, Manish, et autres
Publié: (2026)
par: Bhatt, Manish, et autres
Publié: (2026)
MisGUIDE : Defense Against Data-Free Deep Learning Model Extraction
par: Gurve, Mahendra, et autres
Publié: (2024)
par: Gurve, Mahendra, et autres
Publié: (2024)
Prompt Control-Flow Integrity: A Priority-Aware Runtime Defense Against Prompt Injection in LLM Systems
par: Alam, Md Takrim Ul, et autres
Publié: (2026)
par: Alam, Md Takrim Ul, et autres
Publié: (2026)
ProtoGuard-SL: Prototype Consistency Based Backdoor Defense for Vertical Split Learning
par: Shui, Yuhan, et autres
Publié: (2026)
par: Shui, Yuhan, et autres
Publié: (2026)
ADAGE: Active Defenses Against GNN Extraction
par: Xu, Jing, et autres
Publié: (2025)
par: Xu, Jing, et autres
Publié: (2025)
MELON: Provable Defense Against Indirect Prompt Injection Attacks in AI Agents
par: Zhu, Kaijie, et autres
Publié: (2025)
par: Zhu, Kaijie, et autres
Publié: (2025)
System-Level Defense against Indirect Prompt Injection Attacks: An Information Flow Control Perspective
par: Wu, Fangzhou, et autres
Publié: (2024)
par: Wu, Fangzhou, et autres
Publié: (2024)
Quantum Attacks Targeting Nuclear Power Plants: Threat Analysis, Defense and Mitigation Strategies
par: Baseri, Yaser, et autres
Publié: (2026)
par: Baseri, Yaser, et autres
Publié: (2026)
Non-control-Data Attacks and Defenses: A review
par: Chong, Lei
Publié: (2025)
par: Chong, Lei
Publié: (2025)
Raccoon: Prompt Extraction Benchmark of LLM-Integrated Applications
par: Wang, Junlin, et autres
Publié: (2024)
par: Wang, Junlin, et autres
Publié: (2024)
Evaluation of Prompt Injection Defenses in Large Language Models
par: Deep, Priyal, et autres
Publié: (2026)
par: Deep, Priyal, et autres
Publié: (2026)
Defenses Against Prompt Attacks Learn Surface Heuristics
par: Li, Shawn, et autres
Publié: (2026)
par: Li, Shawn, et autres
Publié: (2026)
Leveraging Soft Prompts for Privacy Attacks in Federated Prompt Tuning
par: Nguyen, Quan Minh, et autres
Publié: (2026)
par: Nguyen, Quan Minh, et autres
Publié: (2026)
EvoDefense: Co-Evolving Black-Box Defense with Large Language Models
par: Li, Yu, et autres
Publié: (2026)
par: Li, Yu, et autres
Publié: (2026)
Target Attack Backdoor Malware Analysis and Attribution
par: Lai, Anthony Cheuk Tung, et autres
Publié: (2025)
par: Lai, Anthony Cheuk Tung, et autres
Publié: (2025)
ICON: Indirect Prompt Injection Defense for Agents based on Inference-Time Correction
par: Wang, Che, et autres
Publié: (2026)
par: Wang, Che, et autres
Publié: (2026)
Documents similaires
-
Enhanced MLLM Black-Box Jailbreaking Attacks and Defenses
par: Zhong, Xingwei, et autres
Publié: (2025) -
DefenSee: Dissecting Threat from Sight and Text -- A Multi-View Defensive Pipeline for Multi-modal Jailbreaks
par: Wang, Zihao, et autres
Publié: (2025) -
Enhanced Consistency Bi-directional GAN (CBiGAN) for Malware Anomaly Detection
par: Wijayasiri, Thesath, et autres
Publié: (2025) -
ExpIDS: A Drift-adaptable Network Intrusion Detection System With Improved Explainability
par: Kumar, Ayush, et autres
Publié: (2025) -
Network Attack Traffic Detection With Hybrid Quantum-Enhanced Convolution Neural Network
par: Wang, Zihao, et autres
Publié: (2025)