A Survey of Attacks on Large Language Models
Fuente:
arXiv
Guardado en:
| Autores principales: | Xu, Wenrui, Parhi, Keshab K. |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
The Equivalence of Fast Algorithms for Convolution, Parallel FIR Filters, Polynomial Modular Multiplication, and Pointwise Multiplication in DFT/NTT Domain
por: Parhi, Keshab K.
Publicado: (2025)
por: Parhi, Keshab K.
Publicado: (2025)
Adversarial Attacks on Multimodal Large Language Models: A Comprehensive Survey
por: Jain, Bhavuk, et al.
Publicado: (2026)
por: Jain, Bhavuk, et al.
Publicado: (2026)
A Survey on Backdoor Threats in Large Language Models (LLMs): Attacks, Defenses, and Evaluations
por: Zhou, Yihe, et al.
Publicado: (2025)
por: Zhou, Yihe, et al.
Publicado: (2025)
A Survey of Recent Backdoor Attacks and Defenses in Large Language Models
por: Zhao, Shuai, et al.
Publicado: (2024)
por: Zhao, Shuai, et al.
Publicado: (2024)
A Survey on Model Extraction Attacks and Defenses for Large Language Models
por: Zhao, Kaixiang, et al.
Publicado: (2025)
por: Zhao, Kaixiang, et al.
Publicado: (2025)
Recent Advances in Attack and Defense Approaches of Large Language Models
por: Cui, Jing, et al.
Publicado: (2024)
por: Cui, Jing, et al.
Publicado: (2024)
A Comprehensive Study of Jailbreak Attack versus Defense for Large Language Models
por: Xu, Zihao, et al.
Publicado: (2024)
por: Xu, Zihao, et al.
Publicado: (2024)
A Cross-Language Investigation into Jailbreak Attacks in Large Language Models
por: Li, Jie, et al.
Publicado: (2024)
por: Li, Jie, et al.
Publicado: (2024)
A Survey of Large Language Models in Cybersecurity
por: da Silva, Gabriel de Jesus Coelho, et al.
Publicado: (2024)
por: da Silva, Gabriel de Jesus Coelho, et al.
Publicado: (2024)
Safeguarding Large Language Models: A Survey
por: Dong, Yi, et al.
Publicado: (2024)
por: Dong, Yi, et al.
Publicado: (2024)
A Survey: Towards Privacy and Security in Mobile Large Language Models
por: Xu, Honghui, et al.
Publicado: (2025)
por: Xu, Honghui, et al.
Publicado: (2025)
Membership Inference Attacks on Tokenizers of Large Language Models
por: Tong, Meng, et al.
Publicado: (2025)
por: Tong, Meng, et al.
Publicado: (2025)
Security Concerns for Large Language Models: A Survey
por: Li, Miles Q., et al.
Publicado: (2025)
por: Li, Miles Q., et al.
Publicado: (2025)
A Survey on Data Security in Large Language Models
por: Chen, Kang, et al.
Publicado: (2025)
por: Chen, Kang, et al.
Publicado: (2025)
Watermarking Techniques for Large Language Models: A Survey
por: Liang, Yuqing, et al.
Publicado: (2024)
por: Liang, Yuqing, et al.
Publicado: (2024)
CleanGen: Mitigating Backdoor Attacks for Generation Tasks in Large Language Models
por: Li, Yuetai, et al.
Publicado: (2024)
por: Li, Yuetai, et al.
Publicado: (2024)
SoK: Robustness in Large Language Models against Jailbreak Attacks
por: Xu, Feiyue, et al.
Publicado: (2026)
por: Xu, Feiyue, et al.
Publicado: (2026)
Harmful Fine-tuning Attacks and Defenses for Large Language Models: A Survey
por: Huang, Tiansheng, et al.
Publicado: (2024)
por: Huang, Tiansheng, et al.
Publicado: (2024)
Persona Attack: Incremental Memory Injection Jailbreak Attack against Large Language Models
por: Park, Junyoung, et al.
Publicado: (2026)
por: Park, Junyoung, et al.
Publicado: (2026)
A Survey on Large Language Model (LLM) Security and Privacy: The Good, the Bad, and the Ugly
por: Yao, Yifan, et al.
Publicado: (2023)
por: Yao, Yifan, et al.
Publicado: (2023)
Long Polynomial Modular Multiplication using Low-Complexity Number Theoretic Transform
por: Chiu, Sin-Wei, et al.
Publicado: (2023)
por: Chiu, Sin-Wei, et al.
Publicado: (2023)
Chain-of-Scrutiny: Detecting Backdoor Attacks for Large Language Models
por: Li, Xi, et al.
Publicado: (2024)
por: Li, Xi, et al.
Publicado: (2024)
Multi-turn Jailbreaking Attack in Multi-Modal Large Language Models
por: Das, Badhan Chandra, et al.
Publicado: (2026)
por: Das, Badhan Chandra, et al.
Publicado: (2026)
Jailbreak Attacks and Defenses Against Large Language Models: A Survey
por: Yi, Sibo, et al.
Publicado: (2024)
por: Yi, Sibo, et al.
Publicado: (2024)
Large Language Models for Security Operations Centers: A Comprehensive Survey
por: Habibzadeh, Ali, et al.
Publicado: (2025)
por: Habibzadeh, Ali, et al.
Publicado: (2025)
A Framework for Rapidly Developing and Deploying Protection Against Large Language Model Attacks
por: Swanda, Adam, et al.
Publicado: (2025)
por: Swanda, Adam, et al.
Publicado: (2025)
Concept-Guided Backdoor Attack on Vision Language Models
por: Shen, Haoyu, et al.
Publicado: (2025)
por: Shen, Haoyu, et al.
Publicado: (2025)
Conflicts Make Large Reasoning Models Vulnerable to Attacks
por: Liu, Honghao, et al.
Publicado: (2026)
por: Liu, Honghao, et al.
Publicado: (2026)
Safe2Harm: Semantic Isomorphism Attacks for Jailbreaking Large Language Models
por: Yang, Fan
Publicado: (2025)
por: Yang, Fan
Publicado: (2025)
ELBA-Bench: An Efficient Learning Backdoor Attacks Benchmark for Large Language Models
por: Liu, Xuxu, et al.
Publicado: (2025)
por: Liu, Xuxu, et al.
Publicado: (2025)
Step-by-Step Reasoning Attack: Revealing 'Erased' Knowledge in Large Language Models
por: Sinha, Yash, et al.
Publicado: (2025)
por: Sinha, Yash, et al.
Publicado: (2025)
Automating Prompt Leakage Attacks on Large Language Models Using Agentic Approach
por: Sternak, Tvrtko, et al.
Publicado: (2025)
por: Sternak, Tvrtko, et al.
Publicado: (2025)
AttacKG+:Boosting Attack Knowledge Graph Construction with Large Language Models
por: Zhang, Yongheng, et al.
Publicado: (2024)
por: Zhang, Yongheng, et al.
Publicado: (2024)
Hallucinating AI Hijacking Attack: Large Language Models and Malicious Code Recommenders
por: Noever, David, et al.
Publicado: (2024)
por: Noever, David, et al.
Publicado: (2024)
HarmNet: A Framework for Adaptive Multi-Turn Jailbreak Attacks on Large Language Models
por: Narula, Sidhant, et al.
Publicado: (2025)
por: Narula, Sidhant, et al.
Publicado: (2025)
Transferable & Stealthy Ensemble Attacks: A Black-Box Jailbreaking Framework for Large Language Models
por: Yang, Yiqi, et al.
Publicado: (2024)
por: Yang, Yiqi, et al.
Publicado: (2024)
PR-Attack: Coordinated Prompt-RAG Attacks on Retrieval-Augmented Generation in Large Language Models via Bilevel Optimization
por: Jiao, Yang, et al.
Publicado: (2025)
por: Jiao, Yang, et al.
Publicado: (2025)
Align is not Enough: Multimodal Universal Jailbreak Attack against Multimodal Large Language Models
por: Wang, Youze, et al.
Publicado: (2025)
por: Wang, Youze, et al.
Publicado: (2025)
System Prompt Poisoning: Persistent Attacks on Large Language Models Beyond User Injection
por: Li, Zongze, et al.
Publicado: (2025)
por: Li, Zongze, et al.
Publicado: (2025)
BadThink: Triggered Overthinking Attacks on Chain-of-Thought Reasoning in Large Language Models
por: Liu, Shuaitong, et al.
Publicado: (2025)
por: Liu, Shuaitong, et al.
Publicado: (2025)
Ejemplares similares
-
The Equivalence of Fast Algorithms for Convolution, Parallel FIR Filters, Polynomial Modular Multiplication, and Pointwise Multiplication in DFT/NTT Domain
por: Parhi, Keshab K.
Publicado: (2025) -
Adversarial Attacks on Multimodal Large Language Models: A Comprehensive Survey
por: Jain, Bhavuk, et al.
Publicado: (2026) -
A Survey on Backdoor Threats in Large Language Models (LLMs): Attacks, Defenses, and Evaluations
por: Zhou, Yihe, et al.
Publicado: (2025) -
A Survey of Recent Backdoor Attacks and Defenses in Large Language Models
por: Zhao, Shuai, et al.
Publicado: (2024) -
A Survey on Model Extraction Attacks and Defenses for Large Language Models
por: Zhao, Kaixiang, et al.
Publicado: (2025)