Security and Privacy Challenges of Large Language Models: A Survey
Fuente:
arXiv
Salvato in:
| Autori principali: | Das, Badhan Chandra, Amini, M. Hadi, Wu, Yanzhao |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Multi-turn Jailbreaking Attack in Multi-Modal Large Language Models
di: Das, Badhan Chandra, et al.
Pubblicazione: (2026)
di: Das, Badhan Chandra, et al.
Pubblicazione: (2026)
System Prompt Extraction Attacks and Defenses in Large Language Models
di: Das, Badhan Chandra, et al.
Pubblicazione: (2025)
di: Das, Badhan Chandra, et al.
Pubblicazione: (2025)
GUARD-SLM: Token Activation-Based Defense Against Jailbreak Attacks for Small Language Models
di: Mia, Md Jueal, et al.
Pubblicazione: (2026)
di: Mia, Md Jueal, et al.
Pubblicazione: (2026)
Balancing Innovation and Privacy: Data Security Strategies in Natural Language Processing Applications
di: Liu, Shaobo, et al.
Pubblicazione: (2024)
di: Liu, Shaobo, et al.
Pubblicazione: (2024)
A Survey of Recent Backdoor Attacks and Defenses in Large Language Models
di: Zhao, Shuai, et al.
Pubblicazione: (2024)
di: Zhao, Shuai, et al.
Pubblicazione: (2024)
Preserving Privacy in Large Language Models: A Survey on Current Threats and Solutions
di: Miranda, Michele, et al.
Pubblicazione: (2024)
di: Miranda, Michele, et al.
Pubblicazione: (2024)
A Comprehensive Survey on Trustworthiness in Reasoning with Large Language Models
di: Wang, Yanbo, et al.
Pubblicazione: (2025)
di: Wang, Yanbo, et al.
Pubblicazione: (2025)
Quantifying Association Capabilities of Large Language Models and Its Implications on Privacy Leakage
di: Shao, Hanyin, et al.
Pubblicazione: (2023)
di: Shao, Hanyin, et al.
Pubblicazione: (2023)
Institutional Platform for Secure Self-Service Large Language Model Exploration
di: Bumgardner, V. K. Cody, et al.
Pubblicazione: (2024)
di: Bumgardner, V. K. Cody, et al.
Pubblicazione: (2024)
PrivacyLens: Evaluating Privacy Norm Awareness of Language Models in Action
di: Shao, Yijia, et al.
Pubblicazione: (2024)
di: Shao, Yijia, et al.
Pubblicazione: (2024)
NeuroFilter: Privacy Guardrails for Conversational LLM Agents
di: Das, Saswat, et al.
Pubblicazione: (2026)
di: Das, Saswat, et al.
Pubblicazione: (2026)
A Survey: Towards Privacy and Security in Mobile Large Language Models
di: Xu, Honghui, et al.
Pubblicazione: (2025)
di: Xu, Honghui, et al.
Pubblicazione: (2025)
Guarding Your Conversations: Privacy Gatekeepers for Secure Interactions with Cloud-Based AI Models
di: Uzor, GodsGift, et al.
Pubblicazione: (2025)
di: Uzor, GodsGift, et al.
Pubblicazione: (2025)
Building Intelligence Identification System via Large Language Model Watermarking: A Survey and Beyond
di: Wang, Xuhong, et al.
Pubblicazione: (2024)
di: Wang, Xuhong, et al.
Pubblicazione: (2024)
Private Memorization Editing: Turning Memorization into a Defense to Strengthen Data Privacy in Large Language Models
di: Ruzzetti, Elena Sofia, et al.
Pubblicazione: (2025)
di: Ruzzetti, Elena Sofia, et al.
Pubblicazione: (2025)
A Survey on Agentic Security: Applications, Threats and Defenses
di: Shahriar, Asif, et al.
Pubblicazione: (2025)
di: Shahriar, Asif, et al.
Pubblicazione: (2025)
Beyond Jailbreaking: Auditing Contextual Privacy in LLM Agents
di: Das, Saswat, et al.
Pubblicazione: (2025)
di: Das, Saswat, et al.
Pubblicazione: (2025)
How Well Can LLM Agents Simulate End-User Security and Privacy Attitudes and Behaviors?
di: Li, Yuxuan, et al.
Pubblicazione: (2026)
di: Li, Yuxuan, et al.
Pubblicazione: (2026)
Text Embedding Inversion Security for Multilingual Language Models
di: Chen, Yiyi, et al.
Pubblicazione: (2024)
di: Chen, Yiyi, et al.
Pubblicazione: (2024)
Privacy-Preserving Retrieval-Augmented Generation with Differential Privacy
di: Koga, Tatsuki, et al.
Pubblicazione: (2024)
di: Koga, Tatsuki, et al.
Pubblicazione: (2024)
A Survey on Large Language Model (LLM) Security and Privacy: The Good, the Bad, and the Ugly
di: Yao, Yifan, et al.
Pubblicazione: (2023)
di: Yao, Yifan, et al.
Pubblicazione: (2023)
PRISON: Unmasking the Criminal Potential of Large Language Models
di: Wu, Xinyi, et al.
Pubblicazione: (2025)
di: Wu, Xinyi, et al.
Pubblicazione: (2025)
Internal Safety Collapse in Frontier Large Language Models
di: Wu, Yutao, et al.
Pubblicazione: (2026)
di: Wu, Yutao, et al.
Pubblicazione: (2026)
QuanCrypt-FL: Quantized Homomorphic Encryption with Pruning for Secure Federated Learning
di: Mia, Md Jueal, et al.
Pubblicazione: (2024)
di: Mia, Md Jueal, et al.
Pubblicazione: (2024)
Gracefully Filtering Backdoor Samples for Generative Large Language Models without Retraining
di: Wu, Zongru, et al.
Pubblicazione: (2024)
di: Wu, Zongru, et al.
Pubblicazione: (2024)
ForgeDAN: An Evolutionary Framework for Jailbreaking Aligned Large Language Models
di: Cheng, Siyang, et al.
Pubblicazione: (2025)
di: Cheng, Siyang, et al.
Pubblicazione: (2025)
Jailbreak Attacks and Defenses Against Large Language Models: A Survey
di: Yi, Sibo, et al.
Pubblicazione: (2024)
di: Yi, Sibo, et al.
Pubblicazione: (2024)
Security Concerns for Large Language Models: A Survey
di: Li, Miles Q., et al.
Pubblicazione: (2025)
di: Li, Miles Q., et al.
Pubblicazione: (2025)
When RAG Chatbots Expose Their Backend: An Anonymized Case Study of Privacy and Security Risks in Patient-Facing Medical AI
di: Madrid-García, Alfredo, et al.
Pubblicazione: (2026)
di: Madrid-García, Alfredo, et al.
Pubblicazione: (2026)
Resource Consumption Threats in Large Language Models
di: Zhang, Yuanhe, et al.
Pubblicazione: (2026)
di: Zhang, Yuanhe, et al.
Pubblicazione: (2026)
Imperceptible Jailbreaking against Large Language Models
di: Gao, Kuofeng, et al.
Pubblicazione: (2025)
di: Gao, Kuofeng, et al.
Pubblicazione: (2025)
STShield: Single-Token Sentinel for Real-Time Jailbreak Detection in Large Language Models
di: Wang, Xunguang, et al.
Pubblicazione: (2025)
di: Wang, Xunguang, et al.
Pubblicazione: (2025)
Can LLMs Keep a Secret? Testing Privacy Implications of Language Models via Contextual Integrity Theory
di: Mireshghallah, Niloofar, et al.
Pubblicazione: (2023)
di: Mireshghallah, Niloofar, et al.
Pubblicazione: (2023)
Citation: A Key to Building Responsible and Accountable Large Language Models
di: Huang, Jie, et al.
Pubblicazione: (2023)
di: Huang, Jie, et al.
Pubblicazione: (2023)
ForensicsData: A Digital Forensics Dataset for Large Language Models
di: Chakir, Youssef, et al.
Pubblicazione: (2025)
di: Chakir, Youssef, et al.
Pubblicazione: (2025)
REEF: Representation Encoding Fingerprints for Large Language Models
di: Zhang, Jie, et al.
Pubblicazione: (2024)
di: Zhang, Jie, et al.
Pubblicazione: (2024)
Distract Large Language Models for Automatic Jailbreak Attack
di: Xiao, Zeguan, et al.
Pubblicazione: (2024)
di: Xiao, Zeguan, et al.
Pubblicazione: (2024)
Children's Voice Privacy: First Steps And Emerging Challenges
di: Kulkarni, Ajinkya, et al.
Pubblicazione: (2025)
di: Kulkarni, Ajinkya, et al.
Pubblicazione: (2025)
Jailbreaking Large Language Models Through Content Concretization
di: Wahréus, Johan, et al.
Pubblicazione: (2025)
di: Wahréus, Johan, et al.
Pubblicazione: (2025)
FNF: Functional Network Fingerprint for Large Language Models
di: Liu, Yiheng, et al.
Pubblicazione: (2026)
di: Liu, Yiheng, et al.
Pubblicazione: (2026)
Documenti analoghi
-
Multi-turn Jailbreaking Attack in Multi-Modal Large Language Models
di: Das, Badhan Chandra, et al.
Pubblicazione: (2026) -
System Prompt Extraction Attacks and Defenses in Large Language Models
di: Das, Badhan Chandra, et al.
Pubblicazione: (2025) -
GUARD-SLM: Token Activation-Based Defense Against Jailbreak Attacks for Small Language Models
di: Mia, Md Jueal, et al.
Pubblicazione: (2026) -
Balancing Innovation and Privacy: Data Security Strategies in Natural Language Processing Applications
di: Liu, Shaobo, et al.
Pubblicazione: (2024) -
A Survey of Recent Backdoor Attacks and Defenses in Large Language Models
di: Zhao, Shuai, et al.
Pubblicazione: (2024)