Good News for Script Kiddies? Evaluating Large Language Models for Automated Exploit Generation
Fuente:
arXiv
Saved in:
| Main Authors: | Jin, David, Fu, Qian, Li, Yuekang |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Prompt to Pwn: Automated Exploit Generation for Smart Contracts
by: Xiao, ZeKe, et al.
Published: (2025)
by: Xiao, ZeKe, et al.
Published: (2025)
A Comprehensive Study of Jailbreak Attack versus Defense for Large Language Models
by: Xu, Zihao, et al.
Published: (2024)
by: Xu, Zihao, et al.
Published: (2024)
A Rusty Link in the AI Supply Chain: Detecting Evil Configurations in Model Repositories
by: Ding, Ziqi, et al.
Published: (2025)
by: Ding, Ziqi, et al.
Published: (2025)
Retrieval-Confused Generation is a Good Defender for Privacy Violation Attack of Large Language Models
by: Peng, Wanli, et al.
Published: (2025)
by: Peng, Wanli, et al.
Published: (2025)
A Study of Vulnerability Repair in JavaScript Programs with Large Language Models
by: Le, Tan Khang, et al.
Published: (2024)
by: Le, Tan Khang, et al.
Published: (2024)
Defending Large Language Models Against Jailbreak Exploits with Responsible AI Considerations
by: Wong, Ryan, et al.
Published: (2025)
by: Wong, Ryan, et al.
Published: (2025)
Continuous Embedding Attacks via Clipped Inputs in Jailbreaking Large Language Models
by: Xu, Zihao, et al.
Published: (2024)
by: Xu, Zihao, et al.
Published: (2024)
ThreatModeling-LLM: Automating Threat Modeling using Large Language Models for Banking System
by: Wu, Tingmin, et al.
Published: (2024)
by: Wu, Tingmin, et al.
Published: (2024)
APT-Agent: Automated Penetration Testing using Large Language Models
by: Li, William Guanting, et al.
Published: (2026)
by: Li, William Guanting, et al.
Published: (2026)
A Survey on Large Language Model (LLM) Security and Privacy: The Good, the Bad, and the Ugly
by: Yao, Yifan, et al.
Published: (2023)
by: Yao, Yifan, et al.
Published: (2023)
"Glue pizza and eat rocks" -- Exploiting Vulnerabilities in Retrieval-Augmented Generative Models
by: Tan, Zhen, et al.
Published: (2024)
by: Tan, Zhen, et al.
Published: (2024)
CryptoScope: Utilizing Large Language Models for Automated Cryptographic Logic Vulnerability Detection
by: Li, Zhihao, et al.
Published: (2025)
by: Li, Zhihao, et al.
Published: (2025)
Evolving Jailbreaks: Automated Multi-Objective Long-Tail Attacks on Large Language Models
by: Hong, Wenjing, et al.
Published: (2026)
by: Hong, Wenjing, et al.
Published: (2026)
TombRaider: Entering the Vault of History to Jailbreak Large Language Models
by: Ding, Junchen, et al.
Published: (2025)
by: Ding, Junchen, et al.
Published: (2025)
Measuring Physical-World Privacy Awareness of Large Language Models: An Evaluation Benchmark
by: Shen, Xinjie, et al.
Published: (2025)
by: Shen, Xinjie, et al.
Published: (2025)
SoK: Evaluating Jailbreak Guardrails for Large Language Models
by: Wang, Xunguang, et al.
Published: (2025)
by: Wang, Xunguang, et al.
Published: (2025)
Evaluating the Reliability and Fidelity of Automated Judgment Systems of Large Language Models
by: Biskupski, Tom, et al.
Published: (2026)
by: Biskupski, Tom, et al.
Published: (2026)
Automating Prompt Leakage Attacks on Large Language Models Using Agentic Approach
by: Sternak, Tvrtko, et al.
Published: (2025)
by: Sternak, Tvrtko, et al.
Published: (2025)
LLM-CSEC: Empirical Evaluation of Security in C/C++ Code Generated by Large Language Models
by: Shahid, Muhammad Usman, et al.
Published: (2025)
by: Shahid, Muhammad Usman, et al.
Published: (2025)
CEFW: A Comprehensive Evaluation Framework for Watermark in Large Language Models
by: Zhang, Shuhao, et al.
Published: (2025)
by: Zhang, Shuhao, et al.
Published: (2025)
CoTSRF: Utilize Chain of Thought as Stealthy and Robust Fingerprint of Large Language Models
by: Ren, Zhenzhen, et al.
Published: (2025)
by: Ren, Zhenzhen, et al.
Published: (2025)
Evaluating Adversarial Vulnerabilities in Modern Large Language Models
by: Perel, Tom
Published: (2025)
by: Perel, Tom
Published: (2025)
Evaluation of Prompt Injection Defenses in Large Language Models
by: Deep, Priyal, et al.
Published: (2026)
by: Deep, Priyal, et al.
Published: (2026)
CryptoTensors: A Light-Weight Large Language Model File Format for Highly-Secure Model Distribution
by: Zhu, Huifeng, et al.
Published: (2025)
by: Zhu, Huifeng, et al.
Published: (2025)
Automating Security Audit Using Large Language Model based Agent: An Exploration Experiment
by: Chin, Jia Hui, et al.
Published: (2025)
by: Chin, Jia Hui, et al.
Published: (2025)
Automated Malware Family Classification using Weighted Hierarchical Ensembles of Large Language Models
by: Bai, Samita, et al.
Published: (2026)
by: Bai, Samita, et al.
Published: (2026)
AI Agent Smart Contract Exploit Generation
by: Gervais, Arthur, et al.
Published: (2025)
by: Gervais, Arthur, et al.
Published: (2025)
Credential Leakage in LLM Agent Skills: A Large-Scale Empirical Study
by: Chen, Zhihao, et al.
Published: (2026)
by: Chen, Zhihao, et al.
Published: (2026)
Distilled Large Language Model in Confidential Computing Environment for System-on-Chip Design
by: Ben, Dong, et al.
Published: (2025)
by: Ben, Dong, et al.
Published: (2025)
Exploiting the Vulnerability of Large Language Models via Defense-Aware Architectural Backdoor
by: Miah, Abdullah Arafat, et al.
Published: (2024)
by: Miah, Abdullah Arafat, et al.
Published: (2024)
CryptoX : Compositional Reasoning Evaluation of Large Language Models
by: Shi, Jiajun, et al.
Published: (2025)
by: Shi, Jiajun, et al.
Published: (2025)
Transferable & Stealthy Ensemble Attacks: A Black-Box Jailbreaking Framework for Large Language Models
by: Yang, Yiqi, et al.
Published: (2024)
by: Yang, Yiqi, et al.
Published: (2024)
CodeBC: A More Secure Large Language Model for Smart Contract Code Generation in Blockchain
by: Wang, Lingxiang, et al.
Published: (2025)
by: Wang, Lingxiang, et al.
Published: (2025)
SoK: Taxonomy and Evaluation of Prompt Security in Large Language Models
by: Hong, Hanbin, et al.
Published: (2025)
by: Hong, Hanbin, et al.
Published: (2025)
Prompt Injection as an Emerging Threat: Evaluating the Resilience of Large Language Models
by: Ganiuly, Daniyal, et al.
Published: (2025)
by: Ganiuly, Daniyal, et al.
Published: (2025)
OCCULT: Evaluating Large Language Models for Offensive Cyber Operation Capabilities
by: Kouremetis, Michael, et al.
Published: (2025)
by: Kouremetis, Michael, et al.
Published: (2025)
How Good LLM-Generated Password Policies Are?
by: Vaidya, Vivek, et al.
Published: (2025)
by: Vaidya, Vivek, et al.
Published: (2025)
CleanGen: Mitigating Backdoor Attacks for Generation Tasks in Large Language Models
by: Li, Yuetai, et al.
Published: (2024)
by: Li, Yuetai, et al.
Published: (2024)
Pattern Enhanced Multi-Turn Jailbreaking: Exploiting Structural Vulnerabilities in Large Language Models
by: Nihal, Ragib Amin, et al.
Published: (2025)
by: Nihal, Ragib Amin, et al.
Published: (2025)
Vaporizer: Breaking Watermarking Schemes for Large Language Model Outputs
by: Ng, Jonathan Hong Jin, et al.
Published: (2026)
by: Ng, Jonathan Hong Jin, et al.
Published: (2026)
Similar Items
-
Prompt to Pwn: Automated Exploit Generation for Smart Contracts
by: Xiao, ZeKe, et al.
Published: (2025) -
A Comprehensive Study of Jailbreak Attack versus Defense for Large Language Models
by: Xu, Zihao, et al.
Published: (2024) -
A Rusty Link in the AI Supply Chain: Detecting Evil Configurations in Model Repositories
by: Ding, Ziqi, et al.
Published: (2025) -
Retrieval-Confused Generation is a Good Defender for Privacy Violation Attack of Large Language Models
by: Peng, Wanli, et al.
Published: (2025) -
A Study of Vulnerability Repair in JavaScript Programs with Large Language Models
by: Le, Tan Khang, et al.
Published: (2024)