QueryAttack: Jailbreaking Aligned Large Language Models Using Structured Non-natural Query Language
Fuente:
arXiv
Salvato in:
| Autori principali: | Zou, Qingsong, Xiao, Jingyu, Li, Qing, Yan, Zhi, Wang, Yuhang, Xu, Li, Wang, Wenxuan, Gao, Kuofeng, Li, Ruoyu, Jiang, Yong |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Imperceptible Jailbreaking against Large Language Models
di: Gao, Kuofeng, et al.
Pubblicazione: (2025)
di: Gao, Kuofeng, et al.
Pubblicazione: (2025)
Knowledge-to-Jailbreak: Investigating Knowledge-driven Jailbreaking Attacks for Large Language Models
di: Tu, Shangqing, et al.
Pubblicazione: (2024)
di: Tu, Shangqing, et al.
Pubblicazione: (2024)
Query Provenance Analysis: Efficient and Robust Defense against Query-based Black-box Attacks
di: Li, Shaofei, et al.
Pubblicazione: (2024)
di: Li, Shaofei, et al.
Pubblicazione: (2024)
Not All Tokens Are Created Equal: Query-Efficient Jailbreak Fuzzing for LLMs
di: Chen, Wenyu, et al.
Pubblicazione: (2026)
di: Chen, Wenyu, et al.
Pubblicazione: (2026)
SoK: Evaluating Jailbreak Guardrails for Large Language Models
di: Wang, Xunguang, et al.
Pubblicazione: (2025)
di: Wang, Xunguang, et al.
Pubblicazione: (2025)
Denial-of-Service Poisoning Attacks against Large Language Models
di: Gao, Kuofeng, et al.
Pubblicazione: (2024)
di: Gao, Kuofeng, et al.
Pubblicazione: (2024)
ProGQL: A Provenance Graph Query System for Cyber Attack Investigation
di: Shao, Fei, et al.
Pubblicazione: (2025)
di: Shao, Fei, et al.
Pubblicazione: (2025)
Align is not Enough: Multimodal Universal Jailbreak Attack against Multimodal Large Language Models
di: Wang, Youze, et al.
Pubblicazione: (2025)
di: Wang, Youze, et al.
Pubblicazione: (2025)
StructuralSleight: Automated Jailbreak Attacks on Large Language Models Utilizing Uncommon Text-Organization Structures
di: Li, Bangxin, et al.
Pubblicazione: (2024)
di: Li, Bangxin, et al.
Pubblicazione: (2024)
LLM-Virus: Evolutionary Jailbreak Attack on Large Language Models
di: Yu, Miao, et al.
Pubblicazione: (2024)
di: Yu, Miao, et al.
Pubblicazione: (2024)
JPRO: Automated Multimodal Jailbreaking via Multi-Agent Collaboration Framework
di: Zhou, Yuxuan, et al.
Pubblicazione: (2025)
di: Zhou, Yuxuan, et al.
Pubblicazione: (2025)
Faster-GCG: Efficient Discrete Optimization Jailbreak Attacks against Aligned Large Language Models
di: Li, Xiao, et al.
Pubblicazione: (2024)
di: Li, Xiao, et al.
Pubblicazione: (2024)
"Someone Hid It": Query-Agnostic Black-Box Attacks on LLM-Based Retrieval
di: Li, Jiate, et al.
Pubblicazione: (2026)
di: Li, Jiate, et al.
Pubblicazione: (2026)
Jailbreaking Large Language Models through Iterative Tool-Disguised Attacks via Reinforcement Learning
di: Wang, Zhaoqi, et al.
Pubblicazione: (2026)
di: Wang, Zhaoqi, et al.
Pubblicazione: (2026)
PolyJailbreak: Cross-Modal Jailbreaking Attacks on Black-Box Multimodal LLMs
di: Wang, Xinkai, et al.
Pubblicazione: (2025)
di: Wang, Xinkai, et al.
Pubblicazione: (2025)
Towards Robust Multimodal Large Language Models Against Jailbreak Attacks
di: Yin, Ziyi, et al.
Pubblicazione: (2025)
di: Yin, Ziyi, et al.
Pubblicazione: (2025)
A Cross-Language Investigation into Jailbreak Attacks in Large Language Models
di: Li, Jie, et al.
Pubblicazione: (2024)
di: Li, Jie, et al.
Pubblicazione: (2024)
Exploiting Prefix-Tree in Structured Output Interfaces for Enhancing Jailbreak Attacking
di: Li, Yanzeng, et al.
Pubblicazione: (2025)
di: Li, Yanzeng, et al.
Pubblicazione: (2025)
Making Them Ask and Answer: Jailbreaking Large Language Models in Few Queries via Disguise and Reconstruction
di: Liu, Tong, et al.
Pubblicazione: (2024)
di: Liu, Tong, et al.
Pubblicazione: (2024)
CCJA: Context-Coherent Jailbreak Attack for Aligned Large Language Models
di: Zhou, Guanghao, et al.
Pubblicazione: (2025)
di: Zhou, Guanghao, et al.
Pubblicazione: (2025)
Blockchain Data Analysis in the Era of Large-Language Models
di: Toyoda, Kentaroh, et al.
Pubblicazione: (2024)
di: Toyoda, Kentaroh, et al.
Pubblicazione: (2024)
Query Recovery from Easy to Hard: Jigsaw Attack against SSE
di: Nie, Hao, et al.
Pubblicazione: (2024)
di: Nie, Hao, et al.
Pubblicazione: (2024)
Five Queries Are Enough: Query-Efficient and Surrogate-Free Membership Inference Attacks on RAG via Entailment
di: Nguyen, Nguyen Linh Bao, et al.
Pubblicazione: (2026)
di: Nguyen, Nguyen Linh Bao, et al.
Pubblicazione: (2026)
Amplified Vulnerabilities: Structured Jailbreak Attacks on LLM-based Multi-Agent Debate
di: Qi, Senmao, et al.
Pubblicazione: (2025)
di: Qi, Senmao, et al.
Pubblicazione: (2025)
ADAM: A Systematic Data Extraction Attack on Agent Memory via Adaptive Querying
di: Lyu, Xingyu, et al.
Pubblicazione: (2026)
di: Lyu, Xingyu, et al.
Pubblicazione: (2026)
Systematic Scaling Analysis of Jailbreak Attacks in Large Language Models
di: Wang, Xiangwen, et al.
Pubblicazione: (2026)
di: Wang, Xiangwen, et al.
Pubblicazione: (2026)
MasterKey: Automated Jailbreak Across Multiple Large Language Model Chatbots
di: Deng, Gelei, et al.
Pubblicazione: (2023)
di: Deng, Gelei, et al.
Pubblicazione: (2023)
Jailbreak and Guard Aligned Language Models with Only Few In-Context Demonstrations
di: Wei, Zeming, et al.
Pubblicazione: (2023)
di: Wei, Zeming, et al.
Pubblicazione: (2023)
MIRAGE: Misleading Retrieval-Augmented Generation via Black-box and Query-agnostic Poisoning Attacks
di: Chen, Tailun, et al.
Pubblicazione: (2025)
di: Chen, Tailun, et al.
Pubblicazione: (2025)
Evolving Skill-Structured Attack Memory Enhances LLM Jailbreaking
di: Zhang, Junke, et al.
Pubblicazione: (2026)
di: Zhang, Junke, et al.
Pubblicazione: (2026)
JailDAM: Jailbreak Detection with Adaptive Memory for Vision-Language Model
di: Nian, Yi, et al.
Pubblicazione: (2025)
di: Nian, Yi, et al.
Pubblicazione: (2025)
STShield: Single-Token Sentinel for Real-Time Jailbreak Detection in Large Language Models
di: Wang, Xunguang, et al.
Pubblicazione: (2025)
di: Wang, Xunguang, et al.
Pubblicazione: (2025)
FastQuery: Communication-efficient Embedding Table Query for Private LLM Inference
di: Lin, Chenqi, et al.
Pubblicazione: (2024)
di: Lin, Chenqi, et al.
Pubblicazione: (2024)
Bones of Contention: Exploring Query-Efficient Attacks against Skeleton Recognition Systems
di: Cao, Yuxin, et al.
Pubblicazione: (2025)
di: Cao, Yuxin, et al.
Pubblicazione: (2025)
Evolving Jailbreaks: Automated Multi-Objective Long-Tail Attacks on Large Language Models
di: Hong, Wenjing, et al.
Pubblicazione: (2026)
di: Hong, Wenjing, et al.
Pubblicazione: (2026)
GeneBreaker: Jailbreak Attacks against DNA Language Models with Pathogenicity Guidance
di: Zhang, Zaixi, et al.
Pubblicazione: (2025)
di: Zhang, Zaixi, et al.
Pubblicazione: (2025)
BaThe: Defense against the Jailbreak Attack in Multimodal Large Language Models by Treating Harmful Instruction as Backdoor Trigger
di: Chen, Yulin, et al.
Pubblicazione: (2024)
di: Chen, Yulin, et al.
Pubblicazione: (2024)
A Comprehensive Study of Jailbreak Attack versus Defense for Large Language Models
di: Xu, Zihao, et al.
Pubblicazione: (2024)
di: Xu, Zihao, et al.
Pubblicazione: (2024)
ATOM: A Framework of Detecting Query-Based Model Extraction Attacks for Graph Neural Networks
di: Cheng, Zhan, et al.
Pubblicazione: (2025)
di: Cheng, Zhan, et al.
Pubblicazione: (2025)
Query-Efficient Video Adversarial Attack with Stylized Logo
di: Tang, Duoxun, et al.
Pubblicazione: (2024)
di: Tang, Duoxun, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Imperceptible Jailbreaking against Large Language Models
di: Gao, Kuofeng, et al.
Pubblicazione: (2025) -
Knowledge-to-Jailbreak: Investigating Knowledge-driven Jailbreaking Attacks for Large Language Models
di: Tu, Shangqing, et al.
Pubblicazione: (2024) -
Query Provenance Analysis: Efficient and Robust Defense against Query-based Black-box Attacks
di: Li, Shaofei, et al.
Pubblicazione: (2024) -
Not All Tokens Are Created Equal: Query-Efficient Jailbreak Fuzzing for LLMs
di: Chen, Wenyu, et al.
Pubblicazione: (2026) -
SoK: Evaluating Jailbreak Guardrails for Large Language Models
di: Wang, Xunguang, et al.
Pubblicazione: (2025)