WHITE PAPER: A Brief Exploration of Data Exfiltration using GCG Suffixes
Fuente:
arXiv
Gespeichert in:
| 1. Verfasser: | Valbuena, Victor |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2024
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Mask-GCG: Are All Tokens in Adversarial Suffixes Necessary for Jailbreak Attacks?
von: Mu, Junjie, et al.
Veröffentlicht: (2025)
von: Mu, Junjie, et al.
Veröffentlicht: (2025)
Trojan Hippo: Weaponizing Agent Memory for Data Exfiltration
von: Das, Debeshee, et al.
Veröffentlicht: (2026)
von: Das, Debeshee, et al.
Veröffentlicht: (2026)
Your LLM Agent Can Leak Your Data: Data Exfiltration via Backdoored Tool Use
von: Zhang, Wuyang, et al.
Veröffentlicht: (2026)
von: Zhang, Wuyang, et al.
Veröffentlicht: (2026)
Trivial Trojans: How Minimal MCP Servers Enable Cross-Tool Exfiltration of Sensitive Data
von: Croce, Nicola, et al.
Veröffentlicht: (2025)
von: Croce, Nicola, et al.
Veröffentlicht: (2025)
Joint-GCG: Unified Gradient-Based Poisoning Attacks on Retrieval-Augmented Generation Systems
von: Wang, Haowei, et al.
Veröffentlicht: (2025)
von: Wang, Haowei, et al.
Veröffentlicht: (2025)
Evasion-Resilient Detection of DNS-over-HTTPS Data Exfiltration: A Practical Evaluation and Toolkit
von: Elaoumari, Adam
Veröffentlicht: (2025)
von: Elaoumari, Adam
Veröffentlicht: (2025)
The Resurgence of GCG Adversarial Attacks on Large Language Models
von: Tan, Yuting, et al.
Veröffentlicht: (2025)
von: Tan, Yuting, et al.
Veröffentlicht: (2025)
Checkpoint-GCG: Auditing and Attacking Fine-Tuning-Based Prompt Injection Defenses
von: Yang, Xiaoxue, et al.
Veröffentlicht: (2025)
von: Yang, Xiaoxue, et al.
Veröffentlicht: (2025)
A Simple Data Exfiltration Game
von: Caulfield, Tristan
Veröffentlicht: (2025)
von: Caulfield, Tristan
Veröffentlicht: (2025)
Faster-GCG: Efficient Discrete Optimization Jailbreak Attacks against Aligned Large Language Models
von: Li, Xiao, et al.
Veröffentlicht: (2024)
von: Li, Xiao, et al.
Veröffentlicht: (2024)
Super Suffixes: Bypassing Text Generation Alignment and Guard Models Simultaneously
von: Adiletta, Andrew, et al.
Veröffentlicht: (2025)
von: Adiletta, Andrew, et al.
Veröffentlicht: (2025)
Exfiltration of personal information from ChatGPT via prompt injection
von: Schwartzman, Gregory
Veröffentlicht: (2024)
von: Schwartzman, Gregory
Veröffentlicht: (2024)
Towards Reinforcement Learning for Exploration of Speculative Execution Vulnerabilities
von: Lai, Evan, et al.
Veröffentlicht: (2025)
von: Lai, Evan, et al.
Veröffentlicht: (2025)
Accelerating Suffix Jailbreak attacks with Prefix-Shared KV-cache
von: Wang, Xinhai, et al.
Veröffentlicht: (2026)
von: Wang, Xinhai, et al.
Veröffentlicht: (2026)
Data Exfiltration by Compression Attack: Definition and Evaluation on Medical Image Data
von: Li, Huiyu, et al.
Veröffentlicht: (2025)
von: Li, Huiyu, et al.
Veröffentlicht: (2025)
X-DFS: Explainable Artificial Intelligence Guided Design-for-Security Solution Space Exploration
von: Mahfuz, Tanzim, et al.
Veröffentlicht: (2024)
von: Mahfuz, Tanzim, et al.
Veröffentlicht: (2024)
NEXUS: Network Exploration for eXploiting Unsafe Sequences in Multi-Turn LLM Jailbreaks
von: Asl, Javad Rafiei, et al.
Veröffentlicht: (2025)
von: Asl, Javad Rafiei, et al.
Veröffentlicht: (2025)
Automating Security Audit Using Large Language Model based Agent: An Exploration Experiment
von: Chin, Jia Hui, et al.
Veröffentlicht: (2025)
von: Chin, Jia Hui, et al.
Veröffentlicht: (2025)
Route to Rome Attack: Directing LLM Routers to Expensive Models via Adversarial Suffix Optimization
von: Tang, Haochun, et al.
Veröffentlicht: (2026)
von: Tang, Haochun, et al.
Veröffentlicht: (2026)
Decoding Complexity: Intelligent Pattern Exploration with CHPDA (Context Aware Hybrid Pattern Detection Algorithm)
von: Koli, Lokesh, et al.
Veröffentlicht: (2025)
von: Koli, Lokesh, et al.
Veröffentlicht: (2025)
AutoDAN-Reasoning: Enhancing Strategies Exploration based Jailbreak Attacks with Test-Time Scaling
von: Liu, Xiaogeng, et al.
Veröffentlicht: (2025)
von: Liu, Xiaogeng, et al.
Veröffentlicht: (2025)
A Behavioral Fingerprint for Large Language Models: Provenance Tracking via Refusal Vectors
von: Xu, Zhenyu, et al.
Veröffentlicht: (2026)
von: Xu, Zhenyu, et al.
Veröffentlicht: (2026)
EMPalm: Exfiltrating Palm Biometric Data via Electromagnetic Side-Channel
von: Xu, Haowen, et al.
Veröffentlicht: (2025)
von: Xu, Haowen, et al.
Veröffentlicht: (2025)
Data Poisoning in Deep Learning: A Survey
von: Zhao, Pinlong, et al.
Veröffentlicht: (2025)
von: Zhao, Pinlong, et al.
Veröffentlicht: (2025)
GASP: Efficient Black-Box Generation of Adversarial Suffixes for Jailbreaking LLMs
von: Basani, Advik Raj, et al.
Veröffentlicht: (2024)
von: Basani, Advik Raj, et al.
Veröffentlicht: (2024)
TrapSuffix: Proactive Defense Against Adversarial Suffixes in Jailbreaking
von: Du, Mengyao, et al.
Veröffentlicht: (2026)
von: Du, Mengyao, et al.
Veröffentlicht: (2026)
A Survey on Data Security in Large Language Models
von: Chen, Kang, et al.
Veröffentlicht: (2025)
von: Chen, Kang, et al.
Veröffentlicht: (2025)
A Consensus Privacy Metrics Framework for Synthetic Data
von: Pilgram, Lisa, et al.
Veröffentlicht: (2025)
von: Pilgram, Lisa, et al.
Veröffentlicht: (2025)
Proof-of-Data: A Consensus Protocol for Collaborative Intelligence
von: Liu, Huiwen, et al.
Veröffentlicht: (2025)
von: Liu, Huiwen, et al.
Veröffentlicht: (2025)
Malicious GenAI Chrome Extensions: Unpacking Data Exfiltration and Malicious Behaviours
von: Seetharam, Shresta B., et al.
Veröffentlicht: (2025)
von: Seetharam, Shresta B., et al.
Veröffentlicht: (2025)
Password Strength Analysis Through Social Network Data Exposure: A Combined Approach Relying on Data Reconstruction and Generative Models
von: Atzori, Maurizio, et al.
Veröffentlicht: (2025)
von: Atzori, Maurizio, et al.
Veröffentlicht: (2025)
Phantom Transfer: Data-level Defences are Insufficient Against Data Poisoning
von: Draganov, Andrew, et al.
Veröffentlicht: (2026)
von: Draganov, Andrew, et al.
Veröffentlicht: (2026)
DataSentinel: A Game-Theoretic Detection of Prompt Injection Attacks
von: Liu, Yupei, et al.
Veröffentlicht: (2025)
von: Liu, Yupei, et al.
Veröffentlicht: (2025)
A Framework for Agricultural Food Supply Chain using Blockchain
von: N, Sudarssan
Veröffentlicht: (2024)
von: N, Sudarssan
Veröffentlicht: (2024)
Secure Federated Data Distillation
von: Arazzi, Marco, et al.
Veröffentlicht: (2025)
von: Arazzi, Marco, et al.
Veröffentlicht: (2025)
Data Duplication: A Novel Multi-Purpose Attack Paradigm in Machine Unlearning
von: Ye, Dayong, et al.
Veröffentlicht: (2025)
von: Ye, Dayong, et al.
Veröffentlicht: (2025)
A Privacy-Preserving Federated Learning Method with Homomorphic Encryption in Omics Data
von: Negoya, Yusaku, et al.
Veröffentlicht: (2025)
von: Negoya, Yusaku, et al.
Veröffentlicht: (2025)
The MESA Security Model 2.0: A Dynamic Framework for Mitigating Stealth Data Exfiltration
von: Singh, Sanjeev Pratap, et al.
Veröffentlicht: (2024)
von: Singh, Sanjeev Pratap, et al.
Veröffentlicht: (2024)
Anonymity Unveiled: A Practical Framework for Auditing Data Use in Deep Learning Models
von: Chen, Zitao, et al.
Veröffentlicht: (2024)
von: Chen, Zitao, et al.
Veröffentlicht: (2024)
Data Poisoning Vulnerabilities Across Healthcare AI Architectures: A Security Threat Analysis
von: Abtahi, Farhad, et al.
Veröffentlicht: (2025)
von: Abtahi, Farhad, et al.
Veröffentlicht: (2025)
Ähnliche Einträge
-
Mask-GCG: Are All Tokens in Adversarial Suffixes Necessary for Jailbreak Attacks?
von: Mu, Junjie, et al.
Veröffentlicht: (2025) -
Trojan Hippo: Weaponizing Agent Memory for Data Exfiltration
von: Das, Debeshee, et al.
Veröffentlicht: (2026) -
Your LLM Agent Can Leak Your Data: Data Exfiltration via Backdoored Tool Use
von: Zhang, Wuyang, et al.
Veröffentlicht: (2026) -
Trivial Trojans: How Minimal MCP Servers Enable Cross-Tool Exfiltration of Sensitive Data
von: Croce, Nicola, et al.
Veröffentlicht: (2025) -
Joint-GCG: Unified Gradient-Based Poisoning Attacks on Retrieval-Augmented Generation Systems
von: Wang, Haowei, et al.
Veröffentlicht: (2025)