VulnRepairEval: An Exploit-Based Evaluation Framework for Assessing Large Language Model Vulnerability Repair Capabilities
Fuente:
arXiv
Salvato in:
| Autori principali: | Wang, Weizhe, Ma, Wei, Hu, Qiang, Zhang, Yao, Sun, Jianfei, Wu, Bin, Liu, Yang, Xu, Guangquan, Jiang, Lingxiao |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Towards Demystifying and Repairing LLM-in-the-Loop Vulnerabilities
di: Ma, Yujie, et al.
Pubblicazione: (2026)
di: Ma, Yujie, et al.
Pubblicazione: (2026)
LLM4Vuln: A Unified Evaluation Framework for Decoupling and Enhancing LLMs' Vulnerability Reasoning
di: Sun, Yuqiang, et al.
Pubblicazione: (2024)
di: Sun, Yuqiang, et al.
Pubblicazione: (2024)
Semantics-Aligned, Curriculum-Driven, and Reasoning-Enhanced Vulnerability Repair Framework
di: Yang, Chengran, et al.
Pubblicazione: (2025)
di: Yang, Chengran, et al.
Pubblicazione: (2025)
Root-Cause-Driven Automated Vulnerability Repair
di: Wang, Hulin, et al.
Pubblicazione: (2026)
di: Wang, Hulin, et al.
Pubblicazione: (2026)
VulKey: Automated Vulnerability Repair Guided by Domain-Specific Repair Patterns
di: Li, Jia, et al.
Pubblicazione: (2026)
di: Li, Jia, et al.
Pubblicazione: (2026)
AutoVulnPHP: LLM-Powered Two-Stage PHP Vulnerability Detection and Automated Localization
di: Wang, Zhiqiang, et al.
Pubblicazione: (2026)
di: Wang, Zhiqiang, et al.
Pubblicazione: (2026)
LLM4CVE: Enabling Iterative Automated Vulnerability Repair with Large Language Models
di: Fakih, Mohamad, et al.
Pubblicazione: (2025)
di: Fakih, Mohamad, et al.
Pubblicazione: (2025)
VulEval: Towards Repository-Level Evaluation of Software Vulnerability Detection
di: Wen, Xin-Cheng, et al.
Pubblicazione: (2024)
di: Wen, Xin-Cheng, et al.
Pubblicazione: (2024)
Unlocking User-oriented Pages: Intention-driven Black-box Scanner for Real-world Web Applications
di: Wang, Weizhe, et al.
Pubblicazione: (2025)
di: Wang, Weizhe, et al.
Pubblicazione: (2025)
CrossCommitVuln-Bench: A Dataset of Multi-Commit Python Vulnerabilities Invisible to Per-Commit Static Analysis
di: Majumdar, Arunabh
Pubblicazione: (2026)
di: Majumdar, Arunabh
Pubblicazione: (2026)
ContractTinker: LLM-Empowered Vulnerability Repair for Real-World Smart Contracts
di: Wang, Che, et al.
Pubblicazione: (2024)
di: Wang, Che, et al.
Pubblicazione: (2024)
Vital: Vulnerability-Oriented Symbolic Execution via Type-Unsafe Pointer-Guided Monte Carlo Tree Search
di: Tu, Haoxin, et al.
Pubblicazione: (2024)
di: Tu, Haoxin, et al.
Pubblicazione: (2024)
A Large-scale Empirical Study on the Generalizability of Disclosed Java Library Vulnerability Exploits
di: Chen, Zirui, et al.
Pubblicazione: (2026)
di: Chen, Zirui, et al.
Pubblicazione: (2026)
HALURust: Exploiting Hallucinations of Large Language Models to Detect Vulnerabilities in Rust
di: Luo, Yu, et al.
Pubblicazione: (2025)
di: Luo, Yu, et al.
Pubblicazione: (2025)
Code Security Vulnerability Repair Using Reinforcement Learning with Large Language Models
di: Islam, Nafis Tanveer, et al.
Pubblicazione: (2024)
di: Islam, Nafis Tanveer, et al.
Pubblicazione: (2024)
Repairing Leaks in Resource Wrappers
di: Malakar, Sanjay, et al.
Pubblicazione: (2025)
di: Malakar, Sanjay, et al.
Pubblicazione: (2025)
MulVuln: Enhancing Pre-trained LMs with Shared and Language-Specific Knowledge for Multilingual Vulnerability Detection
di: Nguyen, Van, et al.
Pubblicazione: (2025)
di: Nguyen, Van, et al.
Pubblicazione: (2025)
ACFIX: Guiding LLMs with Mined Common RBAC Practices for Context-Aware Repair of Access Control Vulnerabilities in Smart Contracts
di: Zhang, Lyuye, et al.
Pubblicazione: (2024)
di: Zhang, Lyuye, et al.
Pubblicazione: (2024)
AgentGuard: A Multi-Agent Framework for Robust Package Confusion Detection via Hybrid Search and Metadata-Content Fusion
di: Li, Yu, et al.
Pubblicazione: (2026)
di: Li, Yu, et al.
Pubblicazione: (2026)
Agent Skills in the Wild: An Empirical Study of Security Vulnerabilities at Scale
di: Liu, Yi, et al.
Pubblicazione: (2026)
di: Liu, Yi, et al.
Pubblicazione: (2026)
Evaluating Large Language Models for Line-Level Vulnerability Localization
di: Zhang, Jian, et al.
Pubblicazione: (2024)
di: Zhang, Jian, et al.
Pubblicazione: (2024)
Secure Coding with AI -- From Detection to Repair
di: Belozerov, Vladislav, et al.
Pubblicazione: (2025)
di: Belozerov, Vladislav, et al.
Pubblicazione: (2025)
PoCGen: Generating Proof-of-Concept Exploits for Vulnerabilities in Npm Packages
di: Simsek, Deniz, et al.
Pubblicazione: (2025)
di: Simsek, Deniz, et al.
Pubblicazione: (2025)
Automated Repair of TEE Partitioning Issues via DSL-Guided and LLM-Assisted Patching
di: Ma, Chengyan, et al.
Pubblicazione: (2026)
di: Ma, Chengyan, et al.
Pubblicazione: (2026)
Unity is Strength: Enhancing Precision in Reentrancy Vulnerability Detection of Smart Contract Analysis Tools
di: Wang, Zexu, et al.
Pubblicazione: (2024)
di: Wang, Zexu, et al.
Pubblicazione: (2024)
Automated Repair of OpenID Connect Programs (Extended Version)
di: Rahat, Tamjid Al, et al.
Pubblicazione: (2025)
di: Rahat, Tamjid Al, et al.
Pubblicazione: (2025)
Accelerating Automatic Program Repair with Dual Retrieval-Augmented Fine-Tuning and Patch Generation on Large Language Models
di: Guo, Hanyang, et al.
Pubblicazione: (2025)
di: Guo, Hanyang, et al.
Pubblicazione: (2025)
Zero-Shot Vulnerability Detection in Low-Resource Smart Contracts Through Solidity-Only Training
di: Hu, Minghao, et al.
Pubblicazione: (2026)
di: Hu, Minghao, et al.
Pubblicazione: (2026)
Towards Understanding and Characterizing Vulnerabilities in Intelligent Connected Vehicles through Real-World Exploits
di: Wang, Yuelin, et al.
Pubblicazione: (2026)
di: Wang, Yuelin, et al.
Pubblicazione: (2026)
VulDetectBench: Evaluating the Deep Capability of Vulnerability Detection with Large Language Models
di: Liu, Yu, et al.
Pubblicazione: (2024)
di: Liu, Yu, et al.
Pubblicazione: (2024)
SecureFixAgent: A Hybrid LLM Agent for Automated Python Static Vulnerability Repair
di: Gajjar, Jugal, et al.
Pubblicazione: (2025)
di: Gajjar, Jugal, et al.
Pubblicazione: (2025)
Fixing 7,400 Bugs for 1$: Cheap Crash-Site Program Repair
di: Zheng, Han, et al.
Pubblicazione: (2025)
di: Zheng, Han, et al.
Pubblicazione: (2025)
Understanding the Supply Chain and Risks of Large Language Model Applications
di: Ma, Yujie, et al.
Pubblicazione: (2025)
di: Ma, Yujie, et al.
Pubblicazione: (2025)
One Signature, Multiple Payments: Demystifying and Detecting Signature Replay Vulnerabilities in Smart Contracts
di: Wang, Zexu, et al.
Pubblicazione: (2025)
di: Wang, Zexu, et al.
Pubblicazione: (2025)
Closing the Gap: A User Study on the Real-world Usefulness of AI-powered Vulnerability Detection & Repair in the IDE
di: Steenhoek, Benjamin, et al.
Pubblicazione: (2024)
di: Steenhoek, Benjamin, et al.
Pubblicazione: (2024)
Securing Smart Contract Languages with a Unified Agentic Framework for Vulnerability Repair in Solidity and Move
di: Karanjai, Rabimba, et al.
Pubblicazione: (2025)
di: Karanjai, Rabimba, et al.
Pubblicazione: (2025)
Assessing Vulnerability in Smart Contracts: The Role of Code Complexity Metrics in Security Analysis
di: Tehrani, Masoud Jamshidiyan
Pubblicazione: (2024)
di: Tehrani, Masoud Jamshidiyan
Pubblicazione: (2024)
DLAP: A Deep Learning Augmented Large Language Model Prompting Framework for Software Vulnerability Detection
di: Yang, Yanjing, et al.
Pubblicazione: (2024)
di: Yang, Yanjing, et al.
Pubblicazione: (2024)
Vulnerability Detection with Interprocedural Context in Multiple Languages: Assessing Effectiveness and Cost of Modern LLMs
di: Lira, Kevin, et al.
Pubblicazione: (2026)
di: Lira, Kevin, et al.
Pubblicazione: (2026)
APPATCH: Automated Adaptive Prompting Large Language Models for Real-World Software Vulnerability Patching
di: Nong, Yu, et al.
Pubblicazione: (2024)
di: Nong, Yu, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Towards Demystifying and Repairing LLM-in-the-Loop Vulnerabilities
di: Ma, Yujie, et al.
Pubblicazione: (2026) -
LLM4Vuln: A Unified Evaluation Framework for Decoupling and Enhancing LLMs' Vulnerability Reasoning
di: Sun, Yuqiang, et al.
Pubblicazione: (2024) -
Semantics-Aligned, Curriculum-Driven, and Reasoning-Enhanced Vulnerability Repair Framework
di: Yang, Chengran, et al.
Pubblicazione: (2025) -
Root-Cause-Driven Automated Vulnerability Repair
di: Wang, Hulin, et al.
Pubblicazione: (2026) -
VulKey: Automated Vulnerability Repair Guided by Domain-Specific Repair Patterns
di: Li, Jia, et al.
Pubblicazione: (2026)