WHITE PAPER: A Brief Exploration of Data Exfiltration using GCG Suffixes
Fuente:
arXiv
Salvato in:
| Autore principale: | Valbuena, Victor |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Mask-GCG: Are All Tokens in Adversarial Suffixes Necessary for Jailbreak Attacks?
di: Mu, Junjie, et al.
Pubblicazione: (2025)
di: Mu, Junjie, et al.
Pubblicazione: (2025)
Trojan Hippo: Weaponizing Agent Memory for Data Exfiltration
di: Das, Debeshee, et al.
Pubblicazione: (2026)
di: Das, Debeshee, et al.
Pubblicazione: (2026)
Your LLM Agent Can Leak Your Data: Data Exfiltration via Backdoored Tool Use
di: Zhang, Wuyang, et al.
Pubblicazione: (2026)
di: Zhang, Wuyang, et al.
Pubblicazione: (2026)
Trivial Trojans: How Minimal MCP Servers Enable Cross-Tool Exfiltration of Sensitive Data
di: Croce, Nicola, et al.
Pubblicazione: (2025)
di: Croce, Nicola, et al.
Pubblicazione: (2025)
Joint-GCG: Unified Gradient-Based Poisoning Attacks on Retrieval-Augmented Generation Systems
di: Wang, Haowei, et al.
Pubblicazione: (2025)
di: Wang, Haowei, et al.
Pubblicazione: (2025)
Evasion-Resilient Detection of DNS-over-HTTPS Data Exfiltration: A Practical Evaluation and Toolkit
di: Elaoumari, Adam
Pubblicazione: (2025)
di: Elaoumari, Adam
Pubblicazione: (2025)
The Resurgence of GCG Adversarial Attacks on Large Language Models
di: Tan, Yuting, et al.
Pubblicazione: (2025)
di: Tan, Yuting, et al.
Pubblicazione: (2025)
Checkpoint-GCG: Auditing and Attacking Fine-Tuning-Based Prompt Injection Defenses
di: Yang, Xiaoxue, et al.
Pubblicazione: (2025)
di: Yang, Xiaoxue, et al.
Pubblicazione: (2025)
A Simple Data Exfiltration Game
di: Caulfield, Tristan
Pubblicazione: (2025)
di: Caulfield, Tristan
Pubblicazione: (2025)
Faster-GCG: Efficient Discrete Optimization Jailbreak Attacks against Aligned Large Language Models
di: Li, Xiao, et al.
Pubblicazione: (2024)
di: Li, Xiao, et al.
Pubblicazione: (2024)
Super Suffixes: Bypassing Text Generation Alignment and Guard Models Simultaneously
di: Adiletta, Andrew, et al.
Pubblicazione: (2025)
di: Adiletta, Andrew, et al.
Pubblicazione: (2025)
Exfiltration of personal information from ChatGPT via prompt injection
di: Schwartzman, Gregory
Pubblicazione: (2024)
di: Schwartzman, Gregory
Pubblicazione: (2024)
Towards Reinforcement Learning for Exploration of Speculative Execution Vulnerabilities
di: Lai, Evan, et al.
Pubblicazione: (2025)
di: Lai, Evan, et al.
Pubblicazione: (2025)
Accelerating Suffix Jailbreak attacks with Prefix-Shared KV-cache
di: Wang, Xinhai, et al.
Pubblicazione: (2026)
di: Wang, Xinhai, et al.
Pubblicazione: (2026)
Data Exfiltration by Compression Attack: Definition and Evaluation on Medical Image Data
di: Li, Huiyu, et al.
Pubblicazione: (2025)
di: Li, Huiyu, et al.
Pubblicazione: (2025)
X-DFS: Explainable Artificial Intelligence Guided Design-for-Security Solution Space Exploration
di: Mahfuz, Tanzim, et al.
Pubblicazione: (2024)
di: Mahfuz, Tanzim, et al.
Pubblicazione: (2024)
NEXUS: Network Exploration for eXploiting Unsafe Sequences in Multi-Turn LLM Jailbreaks
di: Asl, Javad Rafiei, et al.
Pubblicazione: (2025)
di: Asl, Javad Rafiei, et al.
Pubblicazione: (2025)
Automating Security Audit Using Large Language Model based Agent: An Exploration Experiment
di: Chin, Jia Hui, et al.
Pubblicazione: (2025)
di: Chin, Jia Hui, et al.
Pubblicazione: (2025)
Route to Rome Attack: Directing LLM Routers to Expensive Models via Adversarial Suffix Optimization
di: Tang, Haochun, et al.
Pubblicazione: (2026)
di: Tang, Haochun, et al.
Pubblicazione: (2026)
Decoding Complexity: Intelligent Pattern Exploration with CHPDA (Context Aware Hybrid Pattern Detection Algorithm)
di: Koli, Lokesh, et al.
Pubblicazione: (2025)
di: Koli, Lokesh, et al.
Pubblicazione: (2025)
AutoDAN-Reasoning: Enhancing Strategies Exploration based Jailbreak Attacks with Test-Time Scaling
di: Liu, Xiaogeng, et al.
Pubblicazione: (2025)
di: Liu, Xiaogeng, et al.
Pubblicazione: (2025)
A Behavioral Fingerprint for Large Language Models: Provenance Tracking via Refusal Vectors
di: Xu, Zhenyu, et al.
Pubblicazione: (2026)
di: Xu, Zhenyu, et al.
Pubblicazione: (2026)
EMPalm: Exfiltrating Palm Biometric Data via Electromagnetic Side-Channel
di: Xu, Haowen, et al.
Pubblicazione: (2025)
di: Xu, Haowen, et al.
Pubblicazione: (2025)
Data Poisoning in Deep Learning: A Survey
di: Zhao, Pinlong, et al.
Pubblicazione: (2025)
di: Zhao, Pinlong, et al.
Pubblicazione: (2025)
GASP: Efficient Black-Box Generation of Adversarial Suffixes for Jailbreaking LLMs
di: Basani, Advik Raj, et al.
Pubblicazione: (2024)
di: Basani, Advik Raj, et al.
Pubblicazione: (2024)
TrapSuffix: Proactive Defense Against Adversarial Suffixes in Jailbreaking
di: Du, Mengyao, et al.
Pubblicazione: (2026)
di: Du, Mengyao, et al.
Pubblicazione: (2026)
A Survey on Data Security in Large Language Models
di: Chen, Kang, et al.
Pubblicazione: (2025)
di: Chen, Kang, et al.
Pubblicazione: (2025)
A Consensus Privacy Metrics Framework for Synthetic Data
di: Pilgram, Lisa, et al.
Pubblicazione: (2025)
di: Pilgram, Lisa, et al.
Pubblicazione: (2025)
Proof-of-Data: A Consensus Protocol for Collaborative Intelligence
di: Liu, Huiwen, et al.
Pubblicazione: (2025)
di: Liu, Huiwen, et al.
Pubblicazione: (2025)
Malicious GenAI Chrome Extensions: Unpacking Data Exfiltration and Malicious Behaviours
di: Seetharam, Shresta B., et al.
Pubblicazione: (2025)
di: Seetharam, Shresta B., et al.
Pubblicazione: (2025)
Password Strength Analysis Through Social Network Data Exposure: A Combined Approach Relying on Data Reconstruction and Generative Models
di: Atzori, Maurizio, et al.
Pubblicazione: (2025)
di: Atzori, Maurizio, et al.
Pubblicazione: (2025)
Phantom Transfer: Data-level Defences are Insufficient Against Data Poisoning
di: Draganov, Andrew, et al.
Pubblicazione: (2026)
di: Draganov, Andrew, et al.
Pubblicazione: (2026)
DataSentinel: A Game-Theoretic Detection of Prompt Injection Attacks
di: Liu, Yupei, et al.
Pubblicazione: (2025)
di: Liu, Yupei, et al.
Pubblicazione: (2025)
A Framework for Agricultural Food Supply Chain using Blockchain
di: N, Sudarssan
Pubblicazione: (2024)
di: N, Sudarssan
Pubblicazione: (2024)
Secure Federated Data Distillation
di: Arazzi, Marco, et al.
Pubblicazione: (2025)
di: Arazzi, Marco, et al.
Pubblicazione: (2025)
Data Duplication: A Novel Multi-Purpose Attack Paradigm in Machine Unlearning
di: Ye, Dayong, et al.
Pubblicazione: (2025)
di: Ye, Dayong, et al.
Pubblicazione: (2025)
A Privacy-Preserving Federated Learning Method with Homomorphic Encryption in Omics Data
di: Negoya, Yusaku, et al.
Pubblicazione: (2025)
di: Negoya, Yusaku, et al.
Pubblicazione: (2025)
The MESA Security Model 2.0: A Dynamic Framework for Mitigating Stealth Data Exfiltration
di: Singh, Sanjeev Pratap, et al.
Pubblicazione: (2024)
di: Singh, Sanjeev Pratap, et al.
Pubblicazione: (2024)
Anonymity Unveiled: A Practical Framework for Auditing Data Use in Deep Learning Models
di: Chen, Zitao, et al.
Pubblicazione: (2024)
di: Chen, Zitao, et al.
Pubblicazione: (2024)
Data Poisoning Vulnerabilities Across Healthcare AI Architectures: A Security Threat Analysis
di: Abtahi, Farhad, et al.
Pubblicazione: (2025)
di: Abtahi, Farhad, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Mask-GCG: Are All Tokens in Adversarial Suffixes Necessary for Jailbreak Attacks?
di: Mu, Junjie, et al.
Pubblicazione: (2025) -
Trojan Hippo: Weaponizing Agent Memory for Data Exfiltration
di: Das, Debeshee, et al.
Pubblicazione: (2026) -
Your LLM Agent Can Leak Your Data: Data Exfiltration via Backdoored Tool Use
di: Zhang, Wuyang, et al.
Pubblicazione: (2026) -
Trivial Trojans: How Minimal MCP Servers Enable Cross-Tool Exfiltration of Sensitive Data
di: Croce, Nicola, et al.
Pubblicazione: (2025) -
Joint-GCG: Unified Gradient-Based Poisoning Attacks on Retrieval-Augmented Generation Systems
di: Wang, Haowei, et al.
Pubblicazione: (2025)