A Survey of Attacks on Large Language Models
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Xu, Wenrui, Parhi, Keshab K. |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
The Equivalence of Fast Algorithms for Convolution, Parallel FIR Filters, Polynomial Modular Multiplication, and Pointwise Multiplication in DFT/NTT Domain
par: Parhi, Keshab K.
Publié: (2025)
par: Parhi, Keshab K.
Publié: (2025)
Adversarial Attacks on Multimodal Large Language Models: A Comprehensive Survey
par: Jain, Bhavuk, et autres
Publié: (2026)
par: Jain, Bhavuk, et autres
Publié: (2026)
A Survey on Backdoor Threats in Large Language Models (LLMs): Attacks, Defenses, and Evaluations
par: Zhou, Yihe, et autres
Publié: (2025)
par: Zhou, Yihe, et autres
Publié: (2025)
A Survey of Recent Backdoor Attacks and Defenses in Large Language Models
par: Zhao, Shuai, et autres
Publié: (2024)
par: Zhao, Shuai, et autres
Publié: (2024)
A Survey on Model Extraction Attacks and Defenses for Large Language Models
par: Zhao, Kaixiang, et autres
Publié: (2025)
par: Zhao, Kaixiang, et autres
Publié: (2025)
Recent Advances in Attack and Defense Approaches of Large Language Models
par: Cui, Jing, et autres
Publié: (2024)
par: Cui, Jing, et autres
Publié: (2024)
A Comprehensive Study of Jailbreak Attack versus Defense for Large Language Models
par: Xu, Zihao, et autres
Publié: (2024)
par: Xu, Zihao, et autres
Publié: (2024)
A Cross-Language Investigation into Jailbreak Attacks in Large Language Models
par: Li, Jie, et autres
Publié: (2024)
par: Li, Jie, et autres
Publié: (2024)
A Survey of Large Language Models in Cybersecurity
par: da Silva, Gabriel de Jesus Coelho, et autres
Publié: (2024)
par: da Silva, Gabriel de Jesus Coelho, et autres
Publié: (2024)
Safeguarding Large Language Models: A Survey
par: Dong, Yi, et autres
Publié: (2024)
par: Dong, Yi, et autres
Publié: (2024)
A Survey: Towards Privacy and Security in Mobile Large Language Models
par: Xu, Honghui, et autres
Publié: (2025)
par: Xu, Honghui, et autres
Publié: (2025)
Membership Inference Attacks on Tokenizers of Large Language Models
par: Tong, Meng, et autres
Publié: (2025)
par: Tong, Meng, et autres
Publié: (2025)
Security Concerns for Large Language Models: A Survey
par: Li, Miles Q., et autres
Publié: (2025)
par: Li, Miles Q., et autres
Publié: (2025)
A Survey on Data Security in Large Language Models
par: Chen, Kang, et autres
Publié: (2025)
par: Chen, Kang, et autres
Publié: (2025)
Watermarking Techniques for Large Language Models: A Survey
par: Liang, Yuqing, et autres
Publié: (2024)
par: Liang, Yuqing, et autres
Publié: (2024)
CleanGen: Mitigating Backdoor Attacks for Generation Tasks in Large Language Models
par: Li, Yuetai, et autres
Publié: (2024)
par: Li, Yuetai, et autres
Publié: (2024)
SoK: Robustness in Large Language Models against Jailbreak Attacks
par: Xu, Feiyue, et autres
Publié: (2026)
par: Xu, Feiyue, et autres
Publié: (2026)
Harmful Fine-tuning Attacks and Defenses for Large Language Models: A Survey
par: Huang, Tiansheng, et autres
Publié: (2024)
par: Huang, Tiansheng, et autres
Publié: (2024)
Persona Attack: Incremental Memory Injection Jailbreak Attack against Large Language Models
par: Park, Junyoung, et autres
Publié: (2026)
par: Park, Junyoung, et autres
Publié: (2026)
A Survey on Large Language Model (LLM) Security and Privacy: The Good, the Bad, and the Ugly
par: Yao, Yifan, et autres
Publié: (2023)
par: Yao, Yifan, et autres
Publié: (2023)
Long Polynomial Modular Multiplication using Low-Complexity Number Theoretic Transform
par: Chiu, Sin-Wei, et autres
Publié: (2023)
par: Chiu, Sin-Wei, et autres
Publié: (2023)
Chain-of-Scrutiny: Detecting Backdoor Attacks for Large Language Models
par: Li, Xi, et autres
Publié: (2024)
par: Li, Xi, et autres
Publié: (2024)
Multi-turn Jailbreaking Attack in Multi-Modal Large Language Models
par: Das, Badhan Chandra, et autres
Publié: (2026)
par: Das, Badhan Chandra, et autres
Publié: (2026)
Jailbreak Attacks and Defenses Against Large Language Models: A Survey
par: Yi, Sibo, et autres
Publié: (2024)
par: Yi, Sibo, et autres
Publié: (2024)
Large Language Models for Security Operations Centers: A Comprehensive Survey
par: Habibzadeh, Ali, et autres
Publié: (2025)
par: Habibzadeh, Ali, et autres
Publié: (2025)
A Framework for Rapidly Developing and Deploying Protection Against Large Language Model Attacks
par: Swanda, Adam, et autres
Publié: (2025)
par: Swanda, Adam, et autres
Publié: (2025)
Concept-Guided Backdoor Attack on Vision Language Models
par: Shen, Haoyu, et autres
Publié: (2025)
par: Shen, Haoyu, et autres
Publié: (2025)
Conflicts Make Large Reasoning Models Vulnerable to Attacks
par: Liu, Honghao, et autres
Publié: (2026)
par: Liu, Honghao, et autres
Publié: (2026)
Safe2Harm: Semantic Isomorphism Attacks for Jailbreaking Large Language Models
par: Yang, Fan
Publié: (2025)
par: Yang, Fan
Publié: (2025)
ELBA-Bench: An Efficient Learning Backdoor Attacks Benchmark for Large Language Models
par: Liu, Xuxu, et autres
Publié: (2025)
par: Liu, Xuxu, et autres
Publié: (2025)
Step-by-Step Reasoning Attack: Revealing 'Erased' Knowledge in Large Language Models
par: Sinha, Yash, et autres
Publié: (2025)
par: Sinha, Yash, et autres
Publié: (2025)
Automating Prompt Leakage Attacks on Large Language Models Using Agentic Approach
par: Sternak, Tvrtko, et autres
Publié: (2025)
par: Sternak, Tvrtko, et autres
Publié: (2025)
AttacKG+:Boosting Attack Knowledge Graph Construction with Large Language Models
par: Zhang, Yongheng, et autres
Publié: (2024)
par: Zhang, Yongheng, et autres
Publié: (2024)
Hallucinating AI Hijacking Attack: Large Language Models and Malicious Code Recommenders
par: Noever, David, et autres
Publié: (2024)
par: Noever, David, et autres
Publié: (2024)
HarmNet: A Framework for Adaptive Multi-Turn Jailbreak Attacks on Large Language Models
par: Narula, Sidhant, et autres
Publié: (2025)
par: Narula, Sidhant, et autres
Publié: (2025)
Transferable & Stealthy Ensemble Attacks: A Black-Box Jailbreaking Framework for Large Language Models
par: Yang, Yiqi, et autres
Publié: (2024)
par: Yang, Yiqi, et autres
Publié: (2024)
PR-Attack: Coordinated Prompt-RAG Attacks on Retrieval-Augmented Generation in Large Language Models via Bilevel Optimization
par: Jiao, Yang, et autres
Publié: (2025)
par: Jiao, Yang, et autres
Publié: (2025)
Align is not Enough: Multimodal Universal Jailbreak Attack against Multimodal Large Language Models
par: Wang, Youze, et autres
Publié: (2025)
par: Wang, Youze, et autres
Publié: (2025)
System Prompt Poisoning: Persistent Attacks on Large Language Models Beyond User Injection
par: Li, Zongze, et autres
Publié: (2025)
par: Li, Zongze, et autres
Publié: (2025)
BadThink: Triggered Overthinking Attacks on Chain-of-Thought Reasoning in Large Language Models
par: Liu, Shuaitong, et autres
Publié: (2025)
par: Liu, Shuaitong, et autres
Publié: (2025)
Documents similaires
-
The Equivalence of Fast Algorithms for Convolution, Parallel FIR Filters, Polynomial Modular Multiplication, and Pointwise Multiplication in DFT/NTT Domain
par: Parhi, Keshab K.
Publié: (2025) -
Adversarial Attacks on Multimodal Large Language Models: A Comprehensive Survey
par: Jain, Bhavuk, et autres
Publié: (2026) -
A Survey on Backdoor Threats in Large Language Models (LLMs): Attacks, Defenses, and Evaluations
par: Zhou, Yihe, et autres
Publié: (2025) -
A Survey of Recent Backdoor Attacks and Defenses in Large Language Models
par: Zhao, Shuai, et autres
Publié: (2024) -
A Survey on Model Extraction Attacks and Defenses for Large Language Models
par: Zhao, Kaixiang, et autres
Publié: (2025)