HoneyTrap: Deceiving Large Language Model Attackers to Honeypot Traps with Resilient Multi-Agent Defense
Fuente:
arXiv
Salvato in:
| Autori principali: | Li, Siyuan, Lin, Xi, Wu, Jun, Liu, Zehao, Li, Haoyu, Ju, Tianjie, Chen, Xiang, Li, Jianhua |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
CoopGuard: Stateful Cooperative Agents Safeguarding LLMs Against Evolving Multi-Round Attacks
di: Li, Siyuan, et al.
Pubblicazione: (2026)
di: Li, Siyuan, et al.
Pubblicazione: (2026)
HoneyWin: High-Interaction Windows Honeypot in Enterprise Environment
di: Aung, Yan Lin, et al.
Pubblicazione: (2025)
di: Aung, Yan Lin, et al.
Pubblicazione: (2025)
HoneySat: A Network-based Satellite Honeypot Framework
di: López-Morales, Efrén, et al.
Pubblicazione: (2025)
di: López-Morales, Efrén, et al.
Pubblicazione: (2025)
HoneyGAN Pots: A Deep Learning Approach for Generating Honeypots
di: Gabrys, Ryan, et al.
Pubblicazione: (2024)
di: Gabrys, Ryan, et al.
Pubblicazione: (2024)
HoneyGPT: Breaking the Trilemma in Terminal Honeypots with Large Language Model
di: Wang, Ziyang, et al.
Pubblicazione: (2024)
di: Wang, Ziyang, et al.
Pubblicazione: (2024)
TrapSuffix: Proactive Defense Against Adversarial Suffixes in Jailbreaking
di: Du, Mengyao, et al.
Pubblicazione: (2026)
di: Du, Mengyao, et al.
Pubblicazione: (2026)
Copyright Traps for Large Language Models
di: Meeus, Matthieu, et al.
Pubblicazione: (2024)
di: Meeus, Matthieu, et al.
Pubblicazione: (2024)
Breaking Minds, Breaking Systems: Jailbreaking Large Language Models via Human-like Psychological Manipulation
di: Liu, Zehao, et al.
Pubblicazione: (2025)
di: Liu, Zehao, et al.
Pubblicazione: (2025)
The 'Sure' Trap: Multi-Scale Poisoning Analysis of Stealthy Compliance-Only Backdoors in Fine-Tuned Large Language Models
di: Tan, Yuting, et al.
Pubblicazione: (2025)
di: Tan, Yuting, et al.
Pubblicazione: (2025)
Large Language Models are Good Attackers: Efficient and Stealthy Textual Backdoor Attacks
di: Li, Ziqiang, et al.
Pubblicazione: (2024)
di: Li, Ziqiang, et al.
Pubblicazione: (2024)
Trapping Attacker in Dilemma: Examining Internal Correlations and External Influences of Trigger for Defending GNN Backdoors
di: Yang, Fan, et al.
Pubblicazione: (2026)
di: Yang, Fan, et al.
Pubblicazione: (2026)
PreCurious: How Innocent Pre-Trained Language Models Turn into Privacy Traps
di: Liu, Ruixuan, et al.
Pubblicazione: (2024)
di: Liu, Ruixuan, et al.
Pubblicazione: (2024)
CTRAP: Embedding Collapse Trap to Safeguard Large Language Models from Harmful Fine-Tuning
di: Yi, Biao, et al.
Pubblicazione: (2025)
di: Yi, Biao, et al.
Pubblicazione: (2025)
Honeypot Protocol
di: Hasan, Najmul
Pubblicazione: (2026)
di: Hasan, Najmul
Pubblicazione: (2026)
Transferring Backdoors between Large Language Models by Knowledge Distillation
di: Cheng, Pengzhou, et al.
Pubblicazione: (2024)
di: Cheng, Pengzhou, et al.
Pubblicazione: (2024)
Defenses at Odds: Measuring and Explaining Defense Conflicts in Large Language Models
di: Meng, Xiangtao, et al.
Pubblicazione: (2026)
di: Meng, Xiangtao, et al.
Pubblicazione: (2026)
Trustworthy AI-Generative Content for Intelligent Network Service: Robustness, Security, and Fairness
di: Li, Siyuan, et al.
Pubblicazione: (2024)
di: Li, Siyuan, et al.
Pubblicazione: (2024)
NSmark: Null Space Based Black-box Watermarking Defense Framework for Language Models
di: Zhao, Haodong, et al.
Pubblicazione: (2024)
di: Zhao, Haodong, et al.
Pubblicazione: (2024)
LLMAtKGE: Large Language Models as Explainable Attackers against Knowledge Graph Embeddings
di: Li, Ting, et al.
Pubblicazione: (2025)
di: Li, Ting, et al.
Pubblicazione: (2025)
Seeing is Deceiving: Exploitation of Visual Pathways in Multi-Modal Language Models
di: Janowczyk, Pete, et al.
Pubblicazione: (2024)
di: Janowczyk, Pete, et al.
Pubblicazione: (2024)
The Invitation Trap: Proactive Availability Backdoor in LLMs via Conversational Induction
di: Wang, He, et al.
Pubblicazione: (2026)
di: Wang, He, et al.
Pubblicazione: (2026)
Defensible Design for OpenClaw: Securing Autonomous Tool-Invoking Agents
di: Li, Zongwei, et al.
Pubblicazione: (2026)
di: Li, Zongwei, et al.
Pubblicazione: (2026)
LLMHoney: A Real-Time SSH Honeypot with Large Language Model-Driven Dynamic Response Generation
di: Malhotra, Pranjay
Pubblicazione: (2025)
di: Malhotra, Pranjay
Pubblicazione: (2025)
LLM Agent Honeypot: Monitoring AI Hacking Agents in the Wild
di: Reworr, et al.
Pubblicazione: (2024)
di: Reworr, et al.
Pubblicazione: (2024)
Descriptor: Multi-Regional Cloud Honeypot Dataset (MURHCAD)
di: Feito-Casares, Enrique, et al.
Pubblicazione: (2026)
di: Feito-Casares, Enrique, et al.
Pubblicazione: (2026)
LoopTrap: Termination Poisoning Attacks on LLM Agents
di: Xu, Huiyu, et al.
Pubblicazione: (2026)
di: Xu, Huiyu, et al.
Pubblicazione: (2026)
Honeypot Implementation in a Cloud Environment
di: Machmeier, Stefan
Pubblicazione: (2023)
di: Machmeier, Stefan
Pubblicazione: (2023)
Honeypot-powered Malware Reverse Engineering
di: Bombardieri, Michele, et al.
Pubblicazione: (2015)
di: Bombardieri, Michele, et al.
Pubblicazione: (2015)
AutoAttacker: A Large Language Model Guided System to Implement Automatic Cyber-attacks
di: Xu, Jiacen, et al.
Pubblicazione: (2024)
di: Xu, Jiacen, et al.
Pubblicazione: (2024)
Attacker Control and Bug Prioritization
di: Lacombe, Guilhem, et al.
Pubblicazione: (2025)
di: Lacombe, Guilhem, et al.
Pubblicazione: (2025)
Uplifted Attackers, Human Defenders: The Cyber Offense-Defense Balance for Trailing-Edge Organizations
di: Murphy, Benjamin, et al.
Pubblicazione: (2025)
di: Murphy, Benjamin, et al.
Pubblicazione: (2025)
CacheTrap: Unveiling a Stealthier Gray-Box Trojan against LLMs
di: Nahian, Mohaiminul Al, et al.
Pubblicazione: (2025)
di: Nahian, Mohaiminul Al, et al.
Pubblicazione: (2025)
AgentTrap: Measuring Runtime Trust Failures in Third-Party Agent Skills
di: Zhuang, Haomin, et al.
Pubblicazione: (2026)
di: Zhuang, Haomin, et al.
Pubblicazione: (2026)
DCS Chain: A Flexible Private Blockchain System
di: Zheng, Jianwu, et al.
Pubblicazione: (2024)
di: Zheng, Jianwu, et al.
Pubblicazione: (2024)
TrapFlow: Controllable Website Fingerprinting Defense via Dynamic Backdoor Learning
di: Liang, Siyuan, et al.
Pubblicazione: (2024)
di: Liang, Siyuan, et al.
Pubblicazione: (2024)
How Agentic AI Coding Assistants Become the Attacker's Shell
di: Liu, Yue, et al.
Pubblicazione: (2026)
di: Liu, Yue, et al.
Pubblicazione: (2026)
HoneyDOC: An Efficient Honeypot Architecture Enabling All-Round Design
di: Fan, Wenjun, et al.
Pubblicazione: (2024)
di: Fan, Wenjun, et al.
Pubblicazione: (2024)
ToDA: Target-oriented Diffusion Attacker against Recommendation System
di: Liu, Xiaohao, et al.
Pubblicazione: (2024)
di: Liu, Xiaohao, et al.
Pubblicazione: (2024)
A Defender-Attacker-Defender Model for Optimizing the Resilience of Hospital Networks to Cyberattacks
di: Helfrich, Stephan, et al.
Pubblicazione: (2026)
di: Helfrich, Stephan, et al.
Pubblicazione: (2026)
Jailbreaking LLMs & VLMs: Mechanisms, Evaluation, and Unified Defense
di: Chen, Zejian, et al.
Pubblicazione: (2026)
di: Chen, Zejian, et al.
Pubblicazione: (2026)
Documenti analoghi
-
CoopGuard: Stateful Cooperative Agents Safeguarding LLMs Against Evolving Multi-Round Attacks
di: Li, Siyuan, et al.
Pubblicazione: (2026) -
HoneyWin: High-Interaction Windows Honeypot in Enterprise Environment
di: Aung, Yan Lin, et al.
Pubblicazione: (2025) -
HoneySat: A Network-based Satellite Honeypot Framework
di: López-Morales, Efrén, et al.
Pubblicazione: (2025) -
HoneyGAN Pots: A Deep Learning Approach for Generating Honeypots
di: Gabrys, Ryan, et al.
Pubblicazione: (2024) -
HoneyGPT: Breaking the Trilemma in Terminal Honeypots with Large Language Model
di: Wang, Ziyang, et al.
Pubblicazione: (2024)