Evaluating Adversarial Vulnerabilities in Modern Large Language Models
Fuente:
arXiv
Saved in:
| Main Author: | Perel, Tom |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Adversarial attacks against Modern Vision-Language Models
by: La Torre, Alejandro Paredes
Published: (2026)
by: La Torre, Alejandro Paredes
Published: (2026)
Exploring Membership Inference Vulnerabilities in Clinical Large Language Models
by: Nemecek, Alexander, et al.
Published: (2025)
by: Nemecek, Alexander, et al.
Published: (2025)
Unvalidated Trust: Cross-Stage Vulnerabilities in Large Language Model Architectures
by: Schwarz, Dominik
Published: (2025)
by: Schwarz, Dominik
Published: (2025)
Adversarial Vulnerabilities in Large Language Models for Time Series Forecasting
by: Liu, Fuqiang, et al.
Published: (2024)
by: Liu, Fuqiang, et al.
Published: (2024)
MARVEL: Multi-Agent RTL Vulnerability Extraction using Large Language Models
by: Collini, Luca, et al.
Published: (2025)
by: Collini, Luca, et al.
Published: (2025)
Beyond Single Bugs: Benchmarking Large Language Models for Multi-Vulnerability Detection
by: Pushkar, Chinmay, et al.
Published: (2025)
by: Pushkar, Chinmay, et al.
Published: (2025)
A Study of Vulnerability Repair in JavaScript Programs with Large Language Models
by: Le, Tan Khang, et al.
Published: (2024)
by: Le, Tan Khang, et al.
Published: (2024)
PrompTrend: Continuous Community-Driven Vulnerability Discovery and Assessment for Large Language Models
by: Gasmi, Tarek, et al.
Published: (2025)
by: Gasmi, Tarek, et al.
Published: (2025)
CryptoScope: Utilizing Large Language Models for Automated Cryptographic Logic Vulnerability Detection
by: Li, Zhihao, et al.
Published: (2025)
by: Li, Zhihao, et al.
Published: (2025)
Can Transformer Memory Be Corrupted? Investigating Cache-Side Vulnerabilities in Large Language Models
by: Hossain, Elias, et al.
Published: (2025)
by: Hossain, Elias, et al.
Published: (2025)
Retrieval Augmented Generation Integrated Large Language Models in Smart Contract Vulnerability Detection
by: Yu, Jeffy
Published: (2024)
by: Yu, Jeffy
Published: (2024)
Code Vulnerability Repair with Large Language Model using Context-Aware Prompt Tuning
by: Khan, Arshiya, et al.
Published: (2024)
by: Khan, Arshiya, et al.
Published: (2024)
Transient Turn Injection: Exposing Stateless Multi-Turn Vulnerabilities in Large Language Models
by: Rayhan, Naheed, et al.
Published: (2026)
by: Rayhan, Naheed, et al.
Published: (2026)
Beyond Content Safety: Real-Time Monitoring for Reasoning Vulnerabilities in Large Language Models
by: Wang, Xunguang, et al.
Published: (2026)
by: Wang, Xunguang, et al.
Published: (2026)
Evaluating the Reliability and Fidelity of Automated Judgment Systems of Large Language Models
by: Biskupski, Tom, et al.
Published: (2026)
by: Biskupski, Tom, et al.
Published: (2026)
Adversarial Attacks on Multimodal Large Language Models: A Comprehensive Survey
by: Jain, Bhavuk, et al.
Published: (2026)
by: Jain, Bhavuk, et al.
Published: (2026)
Enhancing Reverse Engineering: Investigating and Benchmarking Large Language Models for Vulnerability Analysis in Decompiled Binaries
by: Manuel, Dylan, et al.
Published: (2024)
by: Manuel, Dylan, et al.
Published: (2024)
Explainable but Vulnerable: Adversarial Attacks on XAI Explanation in Cybersecurity Applications
by: Mia, Maraz, et al.
Published: (2025)
by: Mia, Maraz, et al.
Published: (2025)
Jailbreaking and Mitigation of Vulnerabilities in Large Language Models
by: Peng, Benji, et al.
Published: (2024)
by: Peng, Benji, et al.
Published: (2024)
Finetuning Large Language Models for Vulnerability Detection
by: Shestov, Alexey, et al.
Published: (2024)
by: Shestov, Alexey, et al.
Published: (2024)
VulDetectBench: Evaluating the Deep Capability of Vulnerability Detection with Large Language Models
by: Liu, Yu, et al.
Published: (2024)
by: Liu, Yu, et al.
Published: (2024)
Conflicts Make Large Reasoning Models Vulnerable to Attacks
by: Liu, Honghao, et al.
Published: (2026)
by: Liu, Honghao, et al.
Published: (2026)
Vulnerability Disclosure through Adaptive Black-Box Adversarial Attacks on NIDS
by: Ennaji, Sabrine, et al.
Published: (2025)
by: Ennaji, Sabrine, et al.
Published: (2025)
Anticipating Adversary Behavior in DevSecOps Scenarios through Large Language Models
by: Caballero, Mario Marín, et al.
Published: (2026)
by: Caballero, Mario Marín, et al.
Published: (2026)
Distilling Lightweight Language Models for C/C++ Vulnerabilities
by: Wei, Zhiyuan, et al.
Published: (2025)
by: Wei, Zhiyuan, et al.
Published: (2025)
LLbezpeky: Leveraging Large Language Models for Vulnerability Detection
by: Mathews, Noble Saji, et al.
Published: (2024)
by: Mathews, Noble Saji, et al.
Published: (2024)
ParaVul: A Parallel Large Language Model and Retrieval-Augmented Framework for Smart Contract Vulnerability Detection
by: Huang, Tenghui, et al.
Published: (2025)
by: Huang, Tenghui, et al.
Published: (2025)
Analysis of Threat-Based Manipulation in Large Language Models: A Dual Perspective on Vulnerabilities and Performance Enhancement Opportunities
by: Samancioglu, Atil
Published: (2025)
by: Samancioglu, Atil
Published: (2025)
Breaking the Loop: Detecting and Mitigating Denial-of-Service Vulnerabilities in Large Language Models
by: Yu, Junzhe, et al.
Published: (2025)
by: Yu, Junzhe, et al.
Published: (2025)
ExplainableGuard: Interpretable Adversarial Defense for Large Language Models Using Chain-of-Thought Reasoning
by: Guan, Shaowei, et al.
Published: (2025)
by: Guan, Shaowei, et al.
Published: (2025)
Evaluation of Prompt Injection Defenses in Large Language Models
by: Deep, Priyal, et al.
Published: (2026)
by: Deep, Priyal, et al.
Published: (2026)
Large Language Models in Cybersecurity: Applications, Vulnerabilities, and Defense Techniques
by: Jaffal, Niveen O., et al.
Published: (2025)
by: Jaffal, Niveen O., et al.
Published: (2025)
Securing Large Language Models: Threats, Vulnerabilities and Responsible Practices
by: Abdali, Sara, et al.
Published: (2024)
by: Abdali, Sara, et al.
Published: (2024)
SoK: Evaluating Jailbreak Guardrails for Large Language Models
by: Wang, Xunguang, et al.
Published: (2025)
by: Wang, Xunguang, et al.
Published: (2025)
CryptoX : Compositional Reasoning Evaluation of Large Language Models
by: Shi, Jiajun, et al.
Published: (2025)
by: Shi, Jiajun, et al.
Published: (2025)
VisInject: Disruption != Injection -- A Dual-Dimension Evaluation of Universal Adversarial Attacks on Vision-Language Models
by: Liu, Pang, et al.
Published: (2026)
by: Liu, Pang, et al.
Published: (2026)
Has My System Prompt Been Used? Large Language Model Prompt Membership Inference
by: Levin, Roman, et al.
Published: (2025)
by: Levin, Roman, et al.
Published: (2025)
SafeGenes: Evaluating the Adversarial Robustness of Genomic Foundation Models
by: Zhan, Huixin, et al.
Published: (2025)
by: Zhan, Huixin, et al.
Published: (2025)
Information Theoretic Adversarial Training of Large Language Models
by: Zhang, Yiwei, et al.
Published: (2026)
by: Zhang, Yiwei, et al.
Published: (2026)
SoK: Taxonomy and Evaluation of Prompt Security in Large Language Models
by: Hong, Hanbin, et al.
Published: (2025)
by: Hong, Hanbin, et al.
Published: (2025)
Similar Items
-
Adversarial attacks against Modern Vision-Language Models
by: La Torre, Alejandro Paredes
Published: (2026) -
Exploring Membership Inference Vulnerabilities in Clinical Large Language Models
by: Nemecek, Alexander, et al.
Published: (2025) -
Unvalidated Trust: Cross-Stage Vulnerabilities in Large Language Model Architectures
by: Schwarz, Dominik
Published: (2025) -
Adversarial Vulnerabilities in Large Language Models for Time Series Forecasting
by: Liu, Fuqiang, et al.
Published: (2024) -
MARVEL: Multi-Agent RTL Vulnerability Extraction using Large Language Models
by: Collini, Luca, et al.
Published: (2025)