Good News for Script Kiddies? Evaluating Large Language Models for Automated Exploit Generation
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Jin, David, Fu, Qian, Li, Yuekang |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Prompt to Pwn: Automated Exploit Generation for Smart Contracts
par: Xiao, ZeKe, et autres
Publié: (2025)
par: Xiao, ZeKe, et autres
Publié: (2025)
A Comprehensive Study of Jailbreak Attack versus Defense for Large Language Models
par: Xu, Zihao, et autres
Publié: (2024)
par: Xu, Zihao, et autres
Publié: (2024)
A Rusty Link in the AI Supply Chain: Detecting Evil Configurations in Model Repositories
par: Ding, Ziqi, et autres
Publié: (2025)
par: Ding, Ziqi, et autres
Publié: (2025)
Retrieval-Confused Generation is a Good Defender for Privacy Violation Attack of Large Language Models
par: Peng, Wanli, et autres
Publié: (2025)
par: Peng, Wanli, et autres
Publié: (2025)
A Study of Vulnerability Repair in JavaScript Programs with Large Language Models
par: Le, Tan Khang, et autres
Publié: (2024)
par: Le, Tan Khang, et autres
Publié: (2024)
Defending Large Language Models Against Jailbreak Exploits with Responsible AI Considerations
par: Wong, Ryan, et autres
Publié: (2025)
par: Wong, Ryan, et autres
Publié: (2025)
Continuous Embedding Attacks via Clipped Inputs in Jailbreaking Large Language Models
par: Xu, Zihao, et autres
Publié: (2024)
par: Xu, Zihao, et autres
Publié: (2024)
ThreatModeling-LLM: Automating Threat Modeling using Large Language Models for Banking System
par: Wu, Tingmin, et autres
Publié: (2024)
par: Wu, Tingmin, et autres
Publié: (2024)
APT-Agent: Automated Penetration Testing using Large Language Models
par: Li, William Guanting, et autres
Publié: (2026)
par: Li, William Guanting, et autres
Publié: (2026)
A Survey on Large Language Model (LLM) Security and Privacy: The Good, the Bad, and the Ugly
par: Yao, Yifan, et autres
Publié: (2023)
par: Yao, Yifan, et autres
Publié: (2023)
"Glue pizza and eat rocks" -- Exploiting Vulnerabilities in Retrieval-Augmented Generative Models
par: Tan, Zhen, et autres
Publié: (2024)
par: Tan, Zhen, et autres
Publié: (2024)
CryptoScope: Utilizing Large Language Models for Automated Cryptographic Logic Vulnerability Detection
par: Li, Zhihao, et autres
Publié: (2025)
par: Li, Zhihao, et autres
Publié: (2025)
Evolving Jailbreaks: Automated Multi-Objective Long-Tail Attacks on Large Language Models
par: Hong, Wenjing, et autres
Publié: (2026)
par: Hong, Wenjing, et autres
Publié: (2026)
TombRaider: Entering the Vault of History to Jailbreak Large Language Models
par: Ding, Junchen, et autres
Publié: (2025)
par: Ding, Junchen, et autres
Publié: (2025)
Measuring Physical-World Privacy Awareness of Large Language Models: An Evaluation Benchmark
par: Shen, Xinjie, et autres
Publié: (2025)
par: Shen, Xinjie, et autres
Publié: (2025)
SoK: Evaluating Jailbreak Guardrails for Large Language Models
par: Wang, Xunguang, et autres
Publié: (2025)
par: Wang, Xunguang, et autres
Publié: (2025)
Evaluating the Reliability and Fidelity of Automated Judgment Systems of Large Language Models
par: Biskupski, Tom, et autres
Publié: (2026)
par: Biskupski, Tom, et autres
Publié: (2026)
Automating Prompt Leakage Attacks on Large Language Models Using Agentic Approach
par: Sternak, Tvrtko, et autres
Publié: (2025)
par: Sternak, Tvrtko, et autres
Publié: (2025)
LLM-CSEC: Empirical Evaluation of Security in C/C++ Code Generated by Large Language Models
par: Shahid, Muhammad Usman, et autres
Publié: (2025)
par: Shahid, Muhammad Usman, et autres
Publié: (2025)
CEFW: A Comprehensive Evaluation Framework for Watermark in Large Language Models
par: Zhang, Shuhao, et autres
Publié: (2025)
par: Zhang, Shuhao, et autres
Publié: (2025)
CoTSRF: Utilize Chain of Thought as Stealthy and Robust Fingerprint of Large Language Models
par: Ren, Zhenzhen, et autres
Publié: (2025)
par: Ren, Zhenzhen, et autres
Publié: (2025)
Evaluating Adversarial Vulnerabilities in Modern Large Language Models
par: Perel, Tom
Publié: (2025)
par: Perel, Tom
Publié: (2025)
Evaluation of Prompt Injection Defenses in Large Language Models
par: Deep, Priyal, et autres
Publié: (2026)
par: Deep, Priyal, et autres
Publié: (2026)
CryptoTensors: A Light-Weight Large Language Model File Format for Highly-Secure Model Distribution
par: Zhu, Huifeng, et autres
Publié: (2025)
par: Zhu, Huifeng, et autres
Publié: (2025)
Automating Security Audit Using Large Language Model based Agent: An Exploration Experiment
par: Chin, Jia Hui, et autres
Publié: (2025)
par: Chin, Jia Hui, et autres
Publié: (2025)
Automated Malware Family Classification using Weighted Hierarchical Ensembles of Large Language Models
par: Bai, Samita, et autres
Publié: (2026)
par: Bai, Samita, et autres
Publié: (2026)
AI Agent Smart Contract Exploit Generation
par: Gervais, Arthur, et autres
Publié: (2025)
par: Gervais, Arthur, et autres
Publié: (2025)
Credential Leakage in LLM Agent Skills: A Large-Scale Empirical Study
par: Chen, Zhihao, et autres
Publié: (2026)
par: Chen, Zhihao, et autres
Publié: (2026)
Distilled Large Language Model in Confidential Computing Environment for System-on-Chip Design
par: Ben, Dong, et autres
Publié: (2025)
par: Ben, Dong, et autres
Publié: (2025)
Exploiting the Vulnerability of Large Language Models via Defense-Aware Architectural Backdoor
par: Miah, Abdullah Arafat, et autres
Publié: (2024)
par: Miah, Abdullah Arafat, et autres
Publié: (2024)
CryptoX : Compositional Reasoning Evaluation of Large Language Models
par: Shi, Jiajun, et autres
Publié: (2025)
par: Shi, Jiajun, et autres
Publié: (2025)
Transferable & Stealthy Ensemble Attacks: A Black-Box Jailbreaking Framework for Large Language Models
par: Yang, Yiqi, et autres
Publié: (2024)
par: Yang, Yiqi, et autres
Publié: (2024)
CodeBC: A More Secure Large Language Model for Smart Contract Code Generation in Blockchain
par: Wang, Lingxiang, et autres
Publié: (2025)
par: Wang, Lingxiang, et autres
Publié: (2025)
SoK: Taxonomy and Evaluation of Prompt Security in Large Language Models
par: Hong, Hanbin, et autres
Publié: (2025)
par: Hong, Hanbin, et autres
Publié: (2025)
Prompt Injection as an Emerging Threat: Evaluating the Resilience of Large Language Models
par: Ganiuly, Daniyal, et autres
Publié: (2025)
par: Ganiuly, Daniyal, et autres
Publié: (2025)
OCCULT: Evaluating Large Language Models for Offensive Cyber Operation Capabilities
par: Kouremetis, Michael, et autres
Publié: (2025)
par: Kouremetis, Michael, et autres
Publié: (2025)
How Good LLM-Generated Password Policies Are?
par: Vaidya, Vivek, et autres
Publié: (2025)
par: Vaidya, Vivek, et autres
Publié: (2025)
CleanGen: Mitigating Backdoor Attacks for Generation Tasks in Large Language Models
par: Li, Yuetai, et autres
Publié: (2024)
par: Li, Yuetai, et autres
Publié: (2024)
Pattern Enhanced Multi-Turn Jailbreaking: Exploiting Structural Vulnerabilities in Large Language Models
par: Nihal, Ragib Amin, et autres
Publié: (2025)
par: Nihal, Ragib Amin, et autres
Publié: (2025)
Vaporizer: Breaking Watermarking Schemes for Large Language Model Outputs
par: Ng, Jonathan Hong Jin, et autres
Publié: (2026)
par: Ng, Jonathan Hong Jin, et autres
Publié: (2026)
Documents similaires
-
Prompt to Pwn: Automated Exploit Generation for Smart Contracts
par: Xiao, ZeKe, et autres
Publié: (2025) -
A Comprehensive Study of Jailbreak Attack versus Defense for Large Language Models
par: Xu, Zihao, et autres
Publié: (2024) -
A Rusty Link in the AI Supply Chain: Detecting Evil Configurations in Model Repositories
par: Ding, Ziqi, et autres
Publié: (2025) -
Retrieval-Confused Generation is a Good Defender for Privacy Violation Attack of Large Language Models
par: Peng, Wanli, et autres
Publié: (2025) -
A Study of Vulnerability Repair in JavaScript Programs with Large Language Models
par: Le, Tan Khang, et autres
Publié: (2024)