Breaking Down the Defenses: A Comparative Survey of Attacks on Large Language Models
Fuente:
arXiv
Salvato in:
| Autori principali: | Chowdhury, Arijit Ghosh, Islam, Md Mofijul, Kumar, Vaibhav, Shezan, Faysal Hossain, Jain, Vinija, Chadha, Aman |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Breaking the illusion: Automated Reasoning of GDPR Consent Violations
di: Li, Ying, et al.
Pubblicazione: (2025)
di: Li, Ying, et al.
Pubblicazione: (2025)
A Novel XAI-Enhanced Quantum Adversarial Networks for Velocity Dispersion Modeling in MaNGA Galaxies
di: Narkedimilli, Sathwik, et al.
Pubblicazione: (2025)
di: Narkedimilli, Sathwik, et al.
Pubblicazione: (2025)
AntiFLipper: A Secure and Efficient Defense Against Label-Flipping Attacks in Federated Learning
di: Rahman, Aashnan, et al.
Pubblicazione: (2025)
di: Rahman, Aashnan, et al.
Pubblicazione: (2025)
Quantum-Resistant Authentication Scheme for RFID Systems Using Lattice-Based Cryptography
di: Kumar, Vaibhav, et al.
Pubblicazione: (2025)
di: Kumar, Vaibhav, et al.
Pubblicazione: (2025)
DSTAN-Med: Dual-Channel Spatiotemporal Attention with Physiological Plausibility Filtering for False Data Injection Attack Detection in IoT-Based Medical Devices
di: Hasan, Md Mehedi, et al.
Pubblicazione: (2026)
di: Hasan, Md Mehedi, et al.
Pubblicazione: (2026)
Latent Geometry as a Structural Monitor: Eigenspace Alignment for Anomaly Detection in Anonymity Networks
di: Chhabra, Vaibhav
Pubblicazione: (2026)
di: Chhabra, Vaibhav
Pubblicazione: (2026)
Options, Not Clicks: Lattice Refinement for Consent-Driven MCP Authorization
di: Li, Ying, et al.
Pubblicazione: (2026)
di: Li, Ying, et al.
Pubblicazione: (2026)
LLM-Driven SAST-Genius: A Hybrid Static Analysis Framework for Comprehensive and Actionable Security
di: Agrawal, Vaibhav, et al.
Pubblicazione: (2025)
di: Agrawal, Vaibhav, et al.
Pubblicazione: (2025)
How Resilient is QUIC to Security and Privacy Attacks?
di: Sengupta, Jayasree, et al.
Pubblicazione: (2024)
di: Sengupta, Jayasree, et al.
Pubblicazione: (2024)
PRvL: Quantifying the Capabilities and Risks of Large Language Models for PII Redaction
di: Garza, Leon, et al.
Pubblicazione: (2025)
di: Garza, Leon, et al.
Pubblicazione: (2025)
System Prompt Extraction Attacks and Defenses in Large Language Models
di: Das, Badhan Chandra, et al.
Pubblicazione: (2025)
di: Das, Badhan Chandra, et al.
Pubblicazione: (2025)
Adversarial Threats in Quantum Machine Learning: A Survey of Attacks and Defenses
di: Ghosh, Archisman, et al.
Pubblicazione: (2025)
di: Ghosh, Archisman, et al.
Pubblicazione: (2025)
A Survey on Backdoor Threats in Large Language Models (LLMs): Attacks, Defenses, and Evaluations
di: Zhou, Yihe, et al.
Pubblicazione: (2025)
di: Zhou, Yihe, et al.
Pubblicazione: (2025)
"I Strongly Suspect This Website Is a Scam": Benchmarking PII Leakage and Detection without Defense in Autonomous Web Agents
di: Roy, Soham, et al.
Pubblicazione: (2026)
di: Roy, Soham, et al.
Pubblicazione: (2026)
Adversarial Attacks on Multimodal Large Language Models: A Comprehensive Survey
di: Jain, Bhavuk, et al.
Pubblicazione: (2026)
di: Jain, Bhavuk, et al.
Pubblicazione: (2026)
A Comparative Analysis of Ensemble-Based Machine Learning Approaches with Explainable AI for Multi-Class Intrusion Detection in Drone Networks
di: Hossain, Md. Alamgir, et al.
Pubblicazione: (2025)
di: Hossain, Md. Alamgir, et al.
Pubblicazione: (2025)
A Learning-Based Attack Framework to Break SOTA Poisoning Defenses in Federated Learning
di: Yang, Yuxin, et al.
Pubblicazione: (2024)
di: Yang, Yuxin, et al.
Pubblicazione: (2024)
Semantic Stealth: Adversarial Text Attacks on NLP Using Several Methods
di: Dey, Roopkatha, et al.
Pubblicazione: (2024)
di: Dey, Roopkatha, et al.
Pubblicazione: (2024)
Membership Inference Attacks and Defenses in Federated Learning: A Survey
di: Bai, Li, et al.
Pubblicazione: (2024)
di: Bai, Li, et al.
Pubblicazione: (2024)
Backdoor Attacks and Defenses in Computer Vision Domain: A Survey
di: Abbasi, Bilal Hussain, et al.
Pubblicazione: (2025)
di: Abbasi, Bilal Hussain, et al.
Pubblicazione: (2025)
A Survey of Recent Backdoor Attacks and Defenses in Large Language Models
di: Zhao, Shuai, et al.
Pubblicazione: (2024)
di: Zhao, Shuai, et al.
Pubblicazione: (2024)
A Survey on Model Extraction Attacks and Defenses for Large Language Models
di: Zhao, Kaixiang, et al.
Pubblicazione: (2025)
di: Zhao, Kaixiang, et al.
Pubblicazione: (2025)
A Multi-Agent LLM Defense Pipeline Against Prompt Injection Attacks
di: Hossain, S M Asif, et al.
Pubblicazione: (2025)
di: Hossain, S M Asif, et al.
Pubblicazione: (2025)
Deep Learning Model Inversion Attacks and Defenses: A Comprehensive Survey
di: Yang, Wencheng, et al.
Pubblicazione: (2025)
di: Yang, Wencheng, et al.
Pubblicazione: (2025)
Adaptive Attacks Break Defenses Against Indirect Prompt Injection Attacks on LLM Agents
di: Zhan, Qiusi, et al.
Pubblicazione: (2025)
di: Zhan, Qiusi, et al.
Pubblicazione: (2025)
A Survey of Safety on Large Vision-Language Models: Attacks, Defenses and Evaluations
di: Ye, Mang, et al.
Pubblicazione: (2025)
di: Ye, Mang, et al.
Pubblicazione: (2025)
Harmful Fine-tuning Attacks and Defenses for Large Language Models: A Survey
di: Huang, Tiansheng, et al.
Pubblicazione: (2024)
di: Huang, Tiansheng, et al.
Pubblicazione: (2024)
A Comparative Study of Watering Hole Attack Detection Using Supervised Neural Network
di: Aktar, Mst. Nishita, et al.
Pubblicazione: (2023)
di: Aktar, Mst. Nishita, et al.
Pubblicazione: (2023)
Modelling Attacks in Blockchain Systems using Petri Nets
di: Shahriar, Md. Atik, et al.
Pubblicazione: (2020)
di: Shahriar, Md. Atik, et al.
Pubblicazione: (2020)
Quantum Cyber-Attack on Blockchain-based VANET
di: Shakib, Kazi Hassan, et al.
Pubblicazione: (2023)
di: Shakib, Kazi Hassan, et al.
Pubblicazione: (2023)
A Novel Framework for Transmitter Privacy in Integrated Sensing and Communication
di: Kumar, Vaibhav, et al.
Pubblicazione: (2026)
di: Kumar, Vaibhav, et al.
Pubblicazione: (2026)
Secure Audio Embedding in Images using Nature-Inspired Optimization
di: Kumar, Aman, et al.
Pubblicazione: (2025)
di: Kumar, Aman, et al.
Pubblicazione: (2025)
Privacy in Large Language Models: Attacks, Defenses and Future Directions
di: Li, Haoran, et al.
Pubblicazione: (2023)
di: Li, Haoran, et al.
Pubblicazione: (2023)
Recent Advances in Attack and Defense Approaches of Large Language Models
di: Cui, Jing, et al.
Pubblicazione: (2024)
di: Cui, Jing, et al.
Pubblicazione: (2024)
Rotated Robustness: A Training-Free Defense against Bit-Flip Attacks on Large Language Models
di: Liu, Deng, et al.
Pubblicazione: (2026)
di: Liu, Deng, et al.
Pubblicazione: (2026)
$\textit{MMJ-Bench}$: A Comprehensive Study on Jailbreak Attacks and Defenses for Multimodal Large Language Models
di: Weng, Fenghua, et al.
Pubblicazione: (2024)
di: Weng, Fenghua, et al.
Pubblicazione: (2024)
Tit-for-Tat: Safeguarding Large Vision-Language Models Against Jailbreak Attacks via Adversarial Defense
di: Hao, Shuyang, et al.
Pubblicazione: (2025)
di: Hao, Shuyang, et al.
Pubblicazione: (2025)
PhishGuard: A Multi-Layered Ensemble Model for Optimal Phishing Website Detection
di: Ovi, Md Sultanul Islam, et al.
Pubblicazione: (2024)
di: Ovi, Md Sultanul Islam, et al.
Pubblicazione: (2024)
Towards Robust IoT Defense: Comparative Statistics of Attack Detection in Resource-Constrained Scenarios
di: Alwaisi, Zainab, et al.
Pubblicazione: (2024)
di: Alwaisi, Zainab, et al.
Pubblicazione: (2024)
A Comprehensive Survey of Website Fingerprinting Attacks and Defenses in Tor: Advances and Open Challenges
di: Cui, Yuwen, et al.
Pubblicazione: (2025)
di: Cui, Yuwen, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Breaking the illusion: Automated Reasoning of GDPR Consent Violations
di: Li, Ying, et al.
Pubblicazione: (2025) -
A Novel XAI-Enhanced Quantum Adversarial Networks for Velocity Dispersion Modeling in MaNGA Galaxies
di: Narkedimilli, Sathwik, et al.
Pubblicazione: (2025) -
AntiFLipper: A Secure and Efficient Defense Against Label-Flipping Attacks in Federated Learning
di: Rahman, Aashnan, et al.
Pubblicazione: (2025) -
Quantum-Resistant Authentication Scheme for RFID Systems Using Lattice-Based Cryptography
di: Kumar, Vaibhav, et al.
Pubblicazione: (2025) -
DSTAN-Med: Dual-Channel Spatiotemporal Attention with Physiological Plausibility Filtering for False Data Injection Attack Detection in IoT-Based Medical Devices
di: Hasan, Md Mehedi, et al.
Pubblicazione: (2026)