Chain-of-Lure: A Universal Jailbreak Attack Framework using Unconstrained Synthetic Narratives
Fuente:
arXiv
Saved in:
| Main Authors: | Chang, Wenhan, Zhu, Tianqing, Zhao, Yu, Song, Shuangyong, Xiong, Ping, Zhou, Wanlei |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Unreal Thinking: Chain-of-Thought Hijacking via Two-stage Backdoor
by: Chang, Wenhan, et al.
Published: (2026)
by: Chang, Wenhan, et al.
Published: (2026)
Large Language Models Merging for Enhancing the Link Stealing Attack on Graph Neural Networks
by: Guan, Faqian, et al.
Published: (2024)
by: Guan, Faqian, et al.
Published: (2024)
Zero-shot Class Unlearning via Layer-wise Relevance Analysis and Neuronal Path Perturbation
by: Chang, Wenhan, et al.
Published: (2024)
by: Chang, Wenhan, et al.
Published: (2024)
When Machine Unlearning Meets Retrieval-Augmented Generation (RAG): Keep Secret or Forget Knowledge?
by: Wang, Shang, et al.
Published: (2024)
by: Wang, Shang, et al.
Published: (2024)
Defending Against Neural Network Model Inversion Attacks via Data Poisoning
by: Zhou, Shuai, et al.
Published: (2024)
by: Zhou, Shuai, et al.
Published: (2024)
When LLMs Team Up: A Coordinated Attack Framework for Automated Cyber Intrusions
by: Qi, Minfeng, et al.
Published: (2026)
by: Qi, Minfeng, et al.
Published: (2026)
Evaluating of Machine Unlearning: Robustness Verification Without Prior Modifications
by: Xu, Heng, et al.
Published: (2024)
by: Xu, Heng, et al.
Published: (2024)
Bias Amplification in RAG: Poisoning Knowledge Retrieval to Steer LLMs
by: Wang, Linlin, et al.
Published: (2025)
by: Wang, Linlin, et al.
Published: (2025)
Don't Forget Too Much: Towards Machine Unlearning on Feature Level
by: Xu, Heng, et al.
Published: (2024)
by: Xu, Heng, et al.
Published: (2024)
Federated TrustChain: Blockchain-Enhanced LLM Training and Unlearning
by: Zuo, Xuhan, et al.
Published: (2024)
by: Zuo, Xuhan, et al.
Published: (2024)
Really Unlearned? Verifying Machine Unlearning via Influential Sample Pairs
by: Xu, Heng, et al.
Published: (2024)
by: Xu, Heng, et al.
Published: (2024)
Poisoning the Pixels: Revisiting Backdoor Attacks on Semantic Segmentation
by: Zhang, Guangsheng, et al.
Published: (2026)
by: Zhang, Guangsheng, et al.
Published: (2026)
Large Language Model Federated Learning with Blockchain and Unlearning for Cross-Organizational Collaboration
by: Zuo, Xuhan, et al.
Published: (2024)
by: Zuo, Xuhan, et al.
Published: (2024)
Sugar-Coated Poison: Benign Generation Unlocks LLM Jailbreaking
by: Wu, Yu-Hang, et al.
Published: (2025)
by: Wu, Yu-Hang, et al.
Published: (2025)
Harnessing Task Overload for Scalable Jailbreak Attacks on Large Language Models
by: Dong, Yiting, et al.
Published: (2024)
by: Dong, Yiting, et al.
Published: (2024)
Proactive defense against LLM Jailbreak
by: Zhao, Weiliang, et al.
Published: (2025)
by: Zhao, Weiliang, et al.
Published: (2025)
Frequency Bias Matters: Diving into Robust and Generalized Deep Image Forgery Detection
by: Liu, Chi, et al.
Published: (2025)
by: Liu, Chi, et al.
Published: (2025)
The Emerged Security and Privacy of LLM Agent: A Survey with Case Studies
by: He, Feng, et al.
Published: (2024)
by: He, Feng, et al.
Published: (2024)
PandaGuard: Systematic Evaluation of LLM Safety against Jailbreaking Attacks
by: Shen, Guobin, et al.
Published: (2025)
by: Shen, Guobin, et al.
Published: (2025)
Data-Free Model-Related Attacks: Unleashing the Potential of Generative AI
by: Ye, Dayong, et al.
Published: (2025)
by: Ye, Dayong, et al.
Published: (2025)
Bag of Tricks: Benchmarking of Jailbreak Attacks on LLMs
by: Xu, Zhao, et al.
Published: (2024)
by: Xu, Zhao, et al.
Published: (2024)
Towards Efficient Target-Level Machine Unlearning Based on Essential Graph
by: Xu, Heng, et al.
Published: (2024)
by: Xu, Heng, et al.
Published: (2024)
SafeAligner: Safety Alignment against Jailbreak Attacks via Response Disparity Guidance
by: Huang, Caishuang, et al.
Published: (2024)
by: Huang, Caishuang, et al.
Published: (2024)
Jailbreaking Leaves a Trace: Understanding and Detecting Jailbreak Attacks from Internal Representations of Large Language Models
by: Kadali, Sri Durga Sai Sowmya, et al.
Published: (2026)
by: Kadali, Sri Durga Sai Sowmya, et al.
Published: (2026)
LLM-Virus: Evolutionary Jailbreak Attack on Large Language Models
by: Yu, Miao, et al.
Published: (2024)
by: Yu, Miao, et al.
Published: (2024)
Evolve the Method, Not the Prompts: Evolutionary Synthesis of Jailbreak Attacks on LLMs
by: Chen, Yunhao, et al.
Published: (2025)
by: Chen, Yunhao, et al.
Published: (2025)
Large Language Models for Link Stealing Attacks Against Graph Neural Networks
by: Guan, Faqian, et al.
Published: (2024)
by: Guan, Faqian, et al.
Published: (2024)
Knowledge-to-Jailbreak: Investigating Knowledge-driven Jailbreaking Attacks for Large Language Models
by: Tu, Shangqing, et al.
Published: (2024)
by: Tu, Shangqing, et al.
Published: (2024)
Adversarial Tuning: Defending Against Jailbreak Attacks for LLMs
by: Liu, Fan, et al.
Published: (2024)
by: Liu, Fan, et al.
Published: (2024)
Privacy Intelligence: A Survey on Image Privacy in Online Social Networks
by: Liu, Chi, et al.
Published: (2020)
by: Liu, Chi, et al.
Published: (2020)
A Survey on Machine Unlearning: Techniques and New Emerged Privacy Risks
by: Liu, Hengzhu, et al.
Published: (2024)
by: Liu, Hengzhu, et al.
Published: (2024)
Activation-Guided Local Editing for Jailbreaking Attacks
by: Wang, Jiecong, et al.
Published: (2025)
by: Wang, Jiecong, et al.
Published: (2025)
Siren: A Learning-Based Multi-Turn Attack Framework for Simulating Real-World Human Jailbreak Behaviors
by: Zhao, Yi, et al.
Published: (2025)
by: Zhao, Yi, et al.
Published: (2025)
JailbreakLens: Visual Analysis of Jailbreak Attacks Against Large Language Models
by: Feng, Yingchaojie, et al.
Published: (2024)
by: Feng, Yingchaojie, et al.
Published: (2024)
Data Duplication: A Novel Multi-Purpose Attack Paradigm in Machine Unlearning
by: Ye, Dayong, et al.
Published: (2025)
by: Ye, Dayong, et al.
Published: (2025)
Unique Security and Privacy Threats of Large Language Models: A Comprehensive Survey
by: Wang, Shang, et al.
Published: (2024)
by: Wang, Shang, et al.
Published: (2024)
Mitigating Fine-tuning based Jailbreak Attack with Backdoor Enhanced Safety Alignment
by: Wang, Jiongxiao, et al.
Published: (2024)
by: Wang, Jiongxiao, et al.
Published: (2024)
MIRAGE: Multimodal Immersive Reasoning and Guided Exploration for Red-Team Jailbreak Attacks
by: You, Wenhao, et al.
Published: (2025)
by: You, Wenhao, et al.
Published: (2025)
CCJA: Context-Coherent Jailbreak Attack for Aligned Large Language Models
by: Zhou, Guanghao, et al.
Published: (2025)
by: Zhou, Guanghao, et al.
Published: (2025)
Towards Robust GAN-generated Image Detection: a Multi-view Completion Representation
by: Liu, Chi, et al.
Published: (2023)
by: Liu, Chi, et al.
Published: (2023)
Similar Items
-
Unreal Thinking: Chain-of-Thought Hijacking via Two-stage Backdoor
by: Chang, Wenhan, et al.
Published: (2026) -
Large Language Models Merging for Enhancing the Link Stealing Attack on Graph Neural Networks
by: Guan, Faqian, et al.
Published: (2024) -
Zero-shot Class Unlearning via Layer-wise Relevance Analysis and Neuronal Path Perturbation
by: Chang, Wenhan, et al.
Published: (2024) -
When Machine Unlearning Meets Retrieval-Augmented Generation (RAG): Keep Secret or Forget Knowledge?
by: Wang, Shang, et al.
Published: (2024) -
Defending Against Neural Network Model Inversion Attacks via Data Poisoning
by: Zhou, Shuai, et al.
Published: (2024)