Securing Large Language Models: Threats, Vulnerabilities and Responsible Practices
Fuente:
arXiv
Salvato in:
| Autori principali: | Abdali, Sara, Anarfi, Richard, Barberan, CJ, He, Jia, Shayegani, Erfan |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Can LLMs be Fooled? Investigating Vulnerabilities in LLMs
di: Abdali, Sara, et al.
Pubblicazione: (2024)
di: Abdali, Sara, et al.
Pubblicazione: (2024)
Decoding the AI Pen: Techniques and Challenges in Detecting AI-Generated Text
di: Abdali, Sara, et al.
Pubblicazione: (2024)
di: Abdali, Sara, et al.
Pubblicazione: (2024)
Misaligned Roles, Misplaced Images: Structural Input Perturbations Expose Multimodal Alignment Blind Spots
di: Shayegani, Erfan, et al.
Pubblicazione: (2025)
di: Shayegani, Erfan, et al.
Pubblicazione: (2025)
Security in the Fine-Tuning Lifecycle of Large Language Models: Threats, Defenses,Evaluation, and Future Directions
di: Li, Wenjuan, et al.
Pubblicazione: (2026)
di: Li, Wenjuan, et al.
Pubblicazione: (2026)
Large Language Models Are Unreliable for Cyber Threat Intelligence
di: Mezzi, Emanuele, et al.
Pubblicazione: (2025)
di: Mezzi, Emanuele, et al.
Pubblicazione: (2025)
Jailbreaking and Mitigation of Vulnerabilities in Large Language Models
di: Peng, Benji, et al.
Pubblicazione: (2024)
di: Peng, Benji, et al.
Pubblicazione: (2024)
Finetuning Large Language Models for Vulnerability Detection
di: Shestov, Alexey, et al.
Pubblicazione: (2024)
di: Shestov, Alexey, et al.
Pubblicazione: (2024)
Cyber Threat Detection and Vulnerability Assessment System using Generative AI and Large Language Model
di: M, Keerthi Kumar., et al.
Pubblicazione: (2026)
di: M, Keerthi Kumar., et al.
Pubblicazione: (2026)
Large Language Models in Cybersecurity: Applications, Vulnerabilities, and Defense Techniques
di: Jaffal, Niveen O., et al.
Pubblicazione: (2025)
di: Jaffal, Niveen O., et al.
Pubblicazione: (2025)
Distributed Threat Intelligence at the Edge Devices: A Large Language Model-Driven Approach
di: Hasan, Syed Mhamudul, et al.
Pubblicazione: (2024)
di: Hasan, Syed Mhamudul, et al.
Pubblicazione: (2024)
Weakest Link in the Chain: Security Vulnerabilities in Advanced Reasoning Models
di: Krishna, Arjun, et al.
Pubblicazione: (2025)
di: Krishna, Arjun, et al.
Pubblicazione: (2025)
CTINexus: Automatic Cyber Threat Intelligence Knowledge Graph Construction Using Large Language Models
di: Cheng, Yutong, et al.
Pubblicazione: (2024)
di: Cheng, Yutong, et al.
Pubblicazione: (2024)
Evaluating Large Language Models for Security Bug Report Prediction
di: Soltaniani, Farnaz, et al.
Pubblicazione: (2026)
di: Soltaniani, Farnaz, et al.
Pubblicazione: (2026)
Securing Healthcare with Deep Learning: A CNN-Based Model for medical IoT Threat Detection
di: Mohamadi, Alireza, et al.
Pubblicazione: (2024)
di: Mohamadi, Alireza, et al.
Pubblicazione: (2024)
AED: Automatic Discovery of Effective and Diverse Vulnerabilities for Autonomous Driving Policy with Large Language Models
di: Qiu, Le, et al.
Pubblicazione: (2025)
di: Qiu, Le, et al.
Pubblicazione: (2025)
ExploitGym: Can AI Agents Turn Security Vulnerabilities into Real Attacks?
di: Wang, Zhun, et al.
Pubblicazione: (2026)
di: Wang, Zhun, et al.
Pubblicazione: (2026)
How to make Medical AI Systems safer? Simulating Vulnerabilities, and Threats in Multimodal Medical RAG System
di: Zuo, Kaiwen, et al.
Pubblicazione: (2025)
di: Zuo, Kaiwen, et al.
Pubblicazione: (2025)
LISAA: A Framework for Large Language Model Information Security Awareness Assessment
di: Cohen, Ofir, et al.
Pubblicazione: (2024)
di: Cohen, Ofir, et al.
Pubblicazione: (2024)
Security and Detectability Analysis of Unicode Text Watermarking Methods Against Large Language Models
di: Hellmeier, Malte
Pubblicazione: (2025)
di: Hellmeier, Malte
Pubblicazione: (2025)
Towards more Practical Threat Models in Artificial Intelligence Security
di: Grosse, Kathrin, et al.
Pubblicazione: (2023)
di: Grosse, Kathrin, et al.
Pubblicazione: (2023)
An Interpretable N-gram Perplexity Threat Model for Large Language Model Jailbreaks
di: Boreiko, Valentyn, et al.
Pubblicazione: (2024)
di: Boreiko, Valentyn, et al.
Pubblicazione: (2024)
Model-based Large Language Model Customization as Service
di: Wu, Zhaomin, et al.
Pubblicazione: (2024)
di: Wu, Zhaomin, et al.
Pubblicazione: (2024)
Adversarial Vulnerabilities in Large Language Models for Time Series Forecasting
di: Liu, Fuqiang, et al.
Pubblicazione: (2024)
di: Liu, Fuqiang, et al.
Pubblicazione: (2024)
Preserving Privacy in Large Language Models: A Survey on Current Threats and Solutions
di: Miranda, Michele, et al.
Pubblicazione: (2024)
di: Miranda, Michele, et al.
Pubblicazione: (2024)
Detection Made Easy: Potentials of Large Language Models for Solidity Vulnerabilities
di: Alam, Md Tauseef, et al.
Pubblicazione: (2024)
di: Alam, Md Tauseef, et al.
Pubblicazione: (2024)
Instructions as Backdoors: Backdoor Vulnerabilities of Instruction Tuning for Large Language Models
di: Xu, Jiashu, et al.
Pubblicazione: (2023)
di: Xu, Jiashu, et al.
Pubblicazione: (2023)
CySecBench: Generative AI-based CyberSecurity-focused Prompt Dataset for Benchmarking Large Language Models
di: Wahréus, Johan, et al.
Pubblicazione: (2025)
di: Wahréus, Johan, et al.
Pubblicazione: (2025)
Logic layer Prompt Control Injection (LPCI): A Novel Security Vulnerability Class in Agentic Systems
di: Atta, Hammad, et al.
Pubblicazione: (2025)
di: Atta, Hammad, et al.
Pubblicazione: (2025)
Enhancing GraphQL Security by Detecting Malicious Queries Using Large Language Models, Sentence Transformers, and Convolutional Neural Networks
di: Perera, Irash, et al.
Pubblicazione: (2025)
di: Perera, Irash, et al.
Pubblicazione: (2025)
The Security Threat of Compressed Projectors in Large Vision-Language Models
di: Zhang, Yudong, et al.
Pubblicazione: (2025)
di: Zhang, Yudong, et al.
Pubblicazione: (2025)
Reconstructing Training Data from Adapter-based Federated Large Language Models
di: Chen, Silong, et al.
Pubblicazione: (2026)
di: Chen, Silong, et al.
Pubblicazione: (2026)
Practical Adversarial Attacks on Stochastic Bandits via Fake Data Injection
di: Zeng, Qirun, et al.
Pubblicazione: (2025)
di: Zeng, Qirun, et al.
Pubblicazione: (2025)
SecureBERT 2.0: Advanced Language Model for Cybersecurity Intelligence
di: Aghaei, Ehsan, et al.
Pubblicazione: (2025)
di: Aghaei, Ehsan, et al.
Pubblicazione: (2025)
PHANTOM: Progressive High-fidelity Adversarial Network for Threat Object Modeling
di: Al-Karaki, Jamal, et al.
Pubblicazione: (2025)
di: Al-Karaki, Jamal, et al.
Pubblicazione: (2025)
Adversarial Machine Learning Threats to Spacecraft
di: Thummala, Rajiv, et al.
Pubblicazione: (2024)
di: Thummala, Rajiv, et al.
Pubblicazione: (2024)
Watermark Stealing in Large Language Models
di: Jovanović, Nikola, et al.
Pubblicazione: (2024)
di: Jovanović, Nikola, et al.
Pubblicazione: (2024)
Privacy Auditing of Large Language Models
di: Panda, Ashwinee, et al.
Pubblicazione: (2025)
di: Panda, Ashwinee, et al.
Pubblicazione: (2025)
LLA: Enhancing Security and Privacy for Generative Models with Logic-Locked Accelerators
di: Li, You, et al.
Pubblicazione: (2025)
di: Li, You, et al.
Pubblicazione: (2025)
Exploring the Secondary Risks of Large Language Models
di: Chen, Jiawei, et al.
Pubblicazione: (2025)
di: Chen, Jiawei, et al.
Pubblicazione: (2025)
OBLIVIATE: Robust and Practical Machine Unlearning for Large Language Models
di: Xu, Xiaoyu, et al.
Pubblicazione: (2025)
di: Xu, Xiaoyu, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Can LLMs be Fooled? Investigating Vulnerabilities in LLMs
di: Abdali, Sara, et al.
Pubblicazione: (2024) -
Decoding the AI Pen: Techniques and Challenges in Detecting AI-Generated Text
di: Abdali, Sara, et al.
Pubblicazione: (2024) -
Misaligned Roles, Misplaced Images: Structural Input Perturbations Expose Multimodal Alignment Blind Spots
di: Shayegani, Erfan, et al.
Pubblicazione: (2025) -
Security in the Fine-Tuning Lifecycle of Large Language Models: Threats, Defenses,Evaluation, and Future Directions
di: Li, Wenjuan, et al.
Pubblicazione: (2026) -
Large Language Models Are Unreliable for Cyber Threat Intelligence
di: Mezzi, Emanuele, et al.
Pubblicazione: (2025)