VADER: A Human-Evaluated Benchmark for Vulnerability Assessment, Detection, Explanation, and Remediation
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Liu, Ethan TS., Wang, Austin, Mateega, Spencer, Georgescu, Carlos, Tang, Danny |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
MalURLBench: A Benchmark Evaluating Agents' Vulnerabilities When Processing Web URLs
par: Kong, Dezhang, et autres
Publié: (2026)
par: Kong, Dezhang, et autres
Publié: (2026)
Graph Neural Networks for Vulnerability Detection: A Counterfactual Explanation
par: Chu, Zhaoyang, et autres
Publié: (2024)
par: Chu, Zhaoyang, et autres
Publié: (2024)
Explainable but Vulnerable: Adversarial Attacks on XAI Explanation in Cybersecurity Applications
par: Mia, Maraz, et autres
Publié: (2025)
par: Mia, Maraz, et autres
Publié: (2025)
MalCodeAI: Autonomous Vulnerability Detection and Remediation via Language Agnostic Code Reasoning
par: Gajjar, Jugal, et autres
Publié: (2025)
par: Gajjar, Jugal, et autres
Publié: (2025)
Beyond Single Bugs: Benchmarking Large Language Models for Multi-Vulnerability Detection
par: Pushkar, Chinmay, et autres
Publié: (2025)
par: Pushkar, Chinmay, et autres
Publié: (2025)
DCVD: Dual-Channel Cross-Modal Fusion for Joint Vulnerability Detection and Localization
par: Tang, Wenxin, et autres
Publié: (2026)
par: Tang, Wenxin, et autres
Publié: (2026)
A Practical Framework for Evaluating Medical AI Security: Reproducible Assessment of Jailbreaking and Privacy Vulnerabilities Across Clinical Specialties
par: Wang, Jinghao, et autres
Publié: (2025)
par: Wang, Jinghao, et autres
Publié: (2025)
SafeGenBench: A Benchmark Framework for Security Vulnerability Detection in LLM-Generated Code
par: Li, Xinghang, et autres
Publié: (2025)
par: Li, Xinghang, et autres
Publié: (2025)
MCPGuard : Automatically Detecting Vulnerabilities in MCP Servers
par: Wang, Bin, et autres
Publié: (2025)
par: Wang, Bin, et autres
Publié: (2025)
From Vulnerabilities to Remediation: A Systematic Literature Review of LLMs in Code Security
par: Basic, Enna, et autres
Publié: (2024)
par: Basic, Enna, et autres
Publié: (2024)
Evaluating Jailbreaking Vulnerabilities in LLMs Deployed as Assistants for Smart Grid Operations: A Benchmark Against NERC Standards
par: Hammadia, Taha, et autres
Publié: (2026)
par: Hammadia, Taha, et autres
Publié: (2026)
VisualDAN: Exposing Vulnerabilities in VLMs with Visual-Driven DAN Commands
par: Liu, Aofan, et autres
Publié: (2025)
par: Liu, Aofan, et autres
Publié: (2025)
CIA+TA Risk Assessment for AI Reasoning Vulnerabilities
par: Aydin, Yuksel
Publié: (2025)
par: Aydin, Yuksel
Publié: (2025)
When the Manual Lies: A Realistic Benchmark to Evaluate MCP Poisoning Attacks for LLM Agents
par: Liu, Shi, et autres
Publié: (2026)
par: Liu, Shi, et autres
Publié: (2026)
Data Quality Issues in Vulnerability Detection Datasets
par: Guo, Yuejun, et autres
Publié: (2024)
par: Guo, Yuejun, et autres
Publié: (2024)
LLMpatronous: Harnessing the Power of LLMs For Vulnerability Detection
par: Yarra, Rajesh
Publié: (2025)
par: Yarra, Rajesh
Publié: (2025)
LProtector: An LLM-driven Vulnerability Detection System
par: Sheng, Ze, et autres
Publié: (2024)
par: Sheng, Ze, et autres
Publié: (2024)
White-Basilisk: A Hybrid Model for Code Vulnerability Detection
par: Lamprou, Ioannis, et autres
Publié: (2025)
par: Lamprou, Ioannis, et autres
Publié: (2025)
Leveraging Digital Twin Technologies for Public Space Protection and Vulnerability Assessment
par: Stefanidou, Artemis, et autres
Publié: (2024)
par: Stefanidou, Artemis, et autres
Publié: (2024)
Prompt Inject Detection with Generative Explanation as an Investigative Tool
par: Pan, Jonathan, et autres
Publié: (2025)
par: Pan, Jonathan, et autres
Publié: (2025)
ParaVul: A Parallel Large Language Model and Retrieval-Augmented Framework for Smart Contract Vulnerability Detection
par: Huang, Tenghui, et autres
Publié: (2025)
par: Huang, Tenghui, et autres
Publié: (2025)
Decoding FL Defenses: Systemization, Pitfalls, and Remedies
par: Khan, Momin Ahmad, et autres
Publié: (2025)
par: Khan, Momin Ahmad, et autres
Publié: (2025)
Smart-LLaMA: Two-Stage Post-Training of Large Language Models for Smart Contract Vulnerability Detection and Explanation
par: Yu, Lei, et autres
Publié: (2024)
par: Yu, Lei, et autres
Publié: (2024)
Evaluating Adversarial Vulnerabilities in Modern Large Language Models
par: Perel, Tom
Publié: (2025)
par: Perel, Tom
Publié: (2025)
CloudLens: Modeling and Detecting Cloud Security Vulnerabilities
par: Kazdagli, Mikhail, et autres
Publié: (2024)
par: Kazdagli, Mikhail, et autres
Publié: (2024)
LLMs in Software Security: A Survey of Vulnerability Detection Techniques and Insights
par: Sheng, Ze, et autres
Publié: (2025)
par: Sheng, Ze, et autres
Publié: (2025)
VulDetectBench: Evaluating the Deep Capability of Vulnerability Detection with Large Language Models
par: Liu, Yu, et autres
Publié: (2024)
par: Liu, Yu, et autres
Publié: (2024)
Bridging AI and Software Security: A Comparative Vulnerability Assessment of LLM Agent Deployment Paradigms
par: Gasmi, Tarek, et autres
Publié: (2025)
par: Gasmi, Tarek, et autres
Publié: (2025)
When Backdoors Speak: Understanding LLM Backdoor Attacks Through Model-Generated Explanations
par: Ge, Huaizhi, et autres
Publié: (2024)
par: Ge, Huaizhi, et autres
Publié: (2024)
Harnessing Large Language Models for Software Vulnerability Detection: A Comprehensive Benchmarking Study
par: Tamberg, Karl, et autres
Publié: (2024)
par: Tamberg, Karl, et autres
Publié: (2024)
VulnLLM-R: Specialized Reasoning LLM with Agent Scaffold for Vulnerability Detection
par: Nie, Yuzhou, et autres
Publié: (2025)
par: Nie, Yuzhou, et autres
Publié: (2025)
Watermarking Graph Neural Networks via Explanations for Ownership Protection
par: Downer, Jane, et autres
Publié: (2025)
par: Downer, Jane, et autres
Publié: (2025)
PrompTrend: Continuous Community-Driven Vulnerability Discovery and Assessment for Large Language Models
par: Gasmi, Tarek, et autres
Publié: (2025)
par: Gasmi, Tarek, et autres
Publié: (2025)
Routing-Aware Explanations for Mixture of Experts Graph Models in Malware Detection
par: Shokouhinejad, Hossein, et autres
Publié: (2026)
par: Shokouhinejad, Hossein, et autres
Publié: (2026)
Weaponizing Language Models for Cybersecurity Offensive Operations: Automating Vulnerability Assessment Report Validation; A Review Paper
par: Almuhaidib, Abdulrahman S, et autres
Publié: (2025)
par: Almuhaidib, Abdulrahman S, et autres
Publié: (2025)
Enhancing Reverse Engineering: Investigating and Benchmarking Large Language Models for Vulnerability Analysis in Decompiled Binaries
par: Manuel, Dylan, et autres
Publié: (2024)
par: Manuel, Dylan, et autres
Publié: (2024)
SmartLLMSentry: A Comprehensive LLM Based Smart Contract Vulnerability Detection Framework
par: Zaazaa, Oualid, et autres
Publié: (2024)
par: Zaazaa, Oualid, et autres
Publié: (2024)
Automated Vulnerability Detection in Source Code Using Deep Representation Learning
par: Seas, C., et autres
Publié: (2026)
par: Seas, C., et autres
Publié: (2026)
VerilogLAVD: LLM-Aided Rule Generation for Vulnerability Detection in Verilog
par: Long, Xiang, et autres
Publié: (2025)
par: Long, Xiang, et autres
Publié: (2025)
SecureFalcon: Are We There Yet in Automated Software Vulnerability Detection with LLMs?
par: Ferrag, Mohamed Amine, et autres
Publié: (2023)
par: Ferrag, Mohamed Amine, et autres
Publié: (2023)
Documents similaires
-
MalURLBench: A Benchmark Evaluating Agents' Vulnerabilities When Processing Web URLs
par: Kong, Dezhang, et autres
Publié: (2026) -
Graph Neural Networks for Vulnerability Detection: A Counterfactual Explanation
par: Chu, Zhaoyang, et autres
Publié: (2024) -
Explainable but Vulnerable: Adversarial Attacks on XAI Explanation in Cybersecurity Applications
par: Mia, Maraz, et autres
Publié: (2025) -
MalCodeAI: Autonomous Vulnerability Detection and Remediation via Language Agnostic Code Reasoning
par: Gajjar, Jugal, et autres
Publié: (2025) -
Beyond Single Bugs: Benchmarking Large Language Models for Multi-Vulnerability Detection
par: Pushkar, Chinmay, et autres
Publié: (2025)