RealVul: Can We Detect Vulnerabilities in Web Applications with LLM?
Fuente:
arXiv
Salvato in:
| Autori principali: | Cao, Di, Liao, Yong, Shang, Xiuwei |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
VulBinLLM: LLM-powered Vulnerability Detection for Stripped Binaries
di: Hussain, Nasir, et al.
Pubblicazione: (2025)
di: Hussain, Nasir, et al.
Pubblicazione: (2025)
HackWorld: Evaluating Computer-Use Agents on Exploiting Web Application Vulnerabilities
di: Ren, Xiaoxue, et al.
Pubblicazione: (2025)
di: Ren, Xiaoxue, et al.
Pubblicazione: (2025)
VulMatch: Binary-level Vulnerability Detection Through Signature
di: Liu, Zian, et al.
Pubblicazione: (2023)
di: Liu, Zian, et al.
Pubblicazione: (2023)
Relevance as a Vulnerability: How Web Retrieval Degrades Safety Alignment in LLM Agents
di: Nawal, Aditya, et al.
Pubblicazione: (2026)
di: Nawal, Aditya, et al.
Pubblicazione: (2026)
FuncVul: An Effective Function Level Vulnerability Detection Model using LLM and Code Chunk
di: Halder, Sajal, et al.
Pubblicazione: (2025)
di: Halder, Sajal, et al.
Pubblicazione: (2025)
Can LLM Prompting Serve as a Proxy for Static Analysis in Vulnerability Detection
di: Ceka, Ira, et al.
Pubblicazione: (2024)
di: Ceka, Ira, et al.
Pubblicazione: (2024)
VulGD: A LLM-Powered Dynamic Open-Access Vulnerability Graph Database
di: Do, Luat, et al.
Pubblicazione: (2026)
di: Do, Luat, et al.
Pubblicazione: (2026)
Can Federated Learning Safeguard Private Data in LLM Training? Vulnerabilities, Attacks, and Defense Evaluation
di: Guo, Wenkai, et al.
Pubblicazione: (2025)
di: Guo, Wenkai, et al.
Pubblicazione: (2025)
CVE-LLM : Ontology-Assisted Automatic Vulnerability Evaluation Using Large Language Models
di: Ghosh, Rikhiya, et al.
Pubblicazione: (2025)
di: Ghosh, Rikhiya, et al.
Pubblicazione: (2025)
Improving LLM Reasoning for Vulnerability Detection via Group Relative Policy Optimization
di: Simoni, Marco, et al.
Pubblicazione: (2025)
di: Simoni, Marco, et al.
Pubblicazione: (2025)
AdvAgent: Controllable Blackbox Red-teaming on Web Agents
di: Xu, Chejian, et al.
Pubblicazione: (2024)
di: Xu, Chejian, et al.
Pubblicazione: (2024)
CleanVul: Automatic Function-Level Vulnerability Detection in Code Commits Using LLM Heuristics
di: Li, Yikun, et al.
Pubblicazione: (2024)
di: Li, Yikun, et al.
Pubblicazione: (2024)
Rethinking LLM Watermark Detection in Black-Box Settings: A Non-Intrusive Third-Party Framework
di: Wang, Zhuoshang, et al.
Pubblicazione: (2026)
di: Wang, Zhuoshang, et al.
Pubblicazione: (2026)
Can LLM Infer Risk Information From MCP Server System Logs?
di: Fu, Jiayi, et al.
Pubblicazione: (2025)
di: Fu, Jiayi, et al.
Pubblicazione: (2025)
The Obvious Invisible Threat: LLM-Powered GUI Agents' Vulnerability to Fine-Print Injections
di: Chen, Chaoran, et al.
Pubblicazione: (2025)
di: Chen, Chaoran, et al.
Pubblicazione: (2025)
Root Defence Strategies: Ensuring Safety of LLM at the Decoding Level
di: Zeng, Xinyi, et al.
Pubblicazione: (2024)
di: Zeng, Xinyi, et al.
Pubblicazione: (2024)
CyberThreat-Eval: Can Large Language Models Automate Real-World Threat Research?
di: Chen, Xiangsen, et al.
Pubblicazione: (2026)
di: Chen, Xiangsen, et al.
Pubblicazione: (2026)
Can We Infer Confidential Properties of Training Data from LLMs?
di: Huang, Pengrun, et al.
Pubblicazione: (2025)
di: Huang, Pengrun, et al.
Pubblicazione: (2025)
The Surprising Universality of LLM Outputs: A Real-Time Verification Primitive
di: Bogdan, Alex, et al.
Pubblicazione: (2026)
di: Bogdan, Alex, et al.
Pubblicazione: (2026)
LITMUS: Benchmarking Behavioral Jailbreaks of LLM Agents in Real OS Environments
di: Zhang, Chiyu, et al.
Pubblicazione: (2026)
di: Zhang, Chiyu, et al.
Pubblicazione: (2026)
Self-Jailbreaking: Language Models Can Reason Themselves Out of Safety Alignment After Benign Reasoning Training
di: Yong, Zheng-Xin, et al.
Pubblicazione: (2025)
di: Yong, Zheng-Xin, et al.
Pubblicazione: (2025)
ReposVul: A Repository-Level High-Quality Vulnerability Dataset
di: Wang, Xinchen, et al.
Pubblicazione: (2024)
di: Wang, Xinchen, et al.
Pubblicazione: (2024)
Raccoon: Prompt Extraction Benchmark of LLM-Integrated Applications
di: Wang, Junlin, et al.
Pubblicazione: (2024)
di: Wang, Junlin, et al.
Pubblicazione: (2024)
The Double-edged Sword of LLM-based Data Reconstruction: Understanding and Mitigating Contextual Vulnerability in Word-level Differential Privacy Text Sanitization
di: Meisenbacher, Stephen, et al.
Pubblicazione: (2025)
di: Meisenbacher, Stephen, et al.
Pubblicazione: (2025)
Importing Phantoms: Measuring LLM Package Hallucination Vulnerabilities
di: Krishna, Arjun, et al.
Pubblicazione: (2025)
di: Krishna, Arjun, et al.
Pubblicazione: (2025)
BadJudge: Backdoor Vulnerabilities of LLM-as-a-Judge
di: Tong, Terry, et al.
Pubblicazione: (2025)
di: Tong, Terry, et al.
Pubblicazione: (2025)
VulEval: Towards Repository-Level Evaluation of Software Vulnerability Detection
di: Wen, Xin-Cheng, et al.
Pubblicazione: (2024)
di: Wen, Xin-Cheng, et al.
Pubblicazione: (2024)
Two Birds with One Stone: Multi-Task Detection and Attribution of LLM-Generated Text
di: Rao, Zixin, et al.
Pubblicazione: (2025)
di: Rao, Zixin, et al.
Pubblicazione: (2025)
SecureForge: Finding and Preventing Vulnerabilities in LLM-Generated Code via Prompt Optimization
di: Liu, Houjun, et al.
Pubblicazione: (2026)
di: Liu, Houjun, et al.
Pubblicazione: (2026)
Multi-use LLM Watermarking and the False Detection Problem
di: Fu, Zihao, et al.
Pubblicazione: (2025)
di: Fu, Zihao, et al.
Pubblicazione: (2025)
WorldCup Sampling for Multi-bit LLM Watermarking
di: Wang, Yidan, et al.
Pubblicazione: (2026)
di: Wang, Yidan, et al.
Pubblicazione: (2026)
A First Look at GPT Apps: Landscape and Vulnerability
di: Zhang, Zejun, et al.
Pubblicazione: (2024)
di: Zhang, Zejun, et al.
Pubblicazione: (2024)
WebSentinel: Detecting and Localizing Prompt Injection Attacks for Web Agents
di: Wang, Xilong, et al.
Pubblicazione: (2026)
di: Wang, Xilong, et al.
Pubblicazione: (2026)
"I Strongly Suspect This Website Is a Scam": Benchmarking PII Leakage and Detection without Defense in Autonomous Web Agents
di: Roy, Soham, et al.
Pubblicazione: (2026)
di: Roy, Soham, et al.
Pubblicazione: (2026)
LLM Agents for Automated Web Vulnerability Reproduction: Are We There Yet?
di: Liu, Bin, et al.
Pubblicazione: (2025)
di: Liu, Bin, et al.
Pubblicazione: (2025)
FakeZero: Real-Time, Privacy-Preserving Misinformation Detection for Facebook and X
di: Essahli, Soufiane, et al.
Pubblicazione: (2025)
di: Essahli, Soufiane, et al.
Pubblicazione: (2025)
GASLITEing the Retrieval: Exploring Vulnerabilities in Dense Embedding-based Search
di: Ben-Tov, Matan, et al.
Pubblicazione: (2024)
di: Ben-Tov, Matan, et al.
Pubblicazione: (2024)
Counterfactual Evaluation for Blind Attack Detection in LLM-based Evaluation Systems
di: Liu, Lijia, et al.
Pubblicazione: (2025)
di: Liu, Lijia, et al.
Pubblicazione: (2025)
ChatNVD: Advancing Cybersecurity Vulnerability Assessment with Large Language Models
di: Chopra, Shivansh, et al.
Pubblicazione: (2024)
di: Chopra, Shivansh, et al.
Pubblicazione: (2024)
Detecting and Understanding Vulnerabilities in Language Models via Mechanistic Interpretability
di: García-Carrasco, Jorge, et al.
Pubblicazione: (2024)
di: García-Carrasco, Jorge, et al.
Pubblicazione: (2024)
Documenti analoghi
-
VulBinLLM: LLM-powered Vulnerability Detection for Stripped Binaries
di: Hussain, Nasir, et al.
Pubblicazione: (2025) -
HackWorld: Evaluating Computer-Use Agents on Exploiting Web Application Vulnerabilities
di: Ren, Xiaoxue, et al.
Pubblicazione: (2025) -
VulMatch: Binary-level Vulnerability Detection Through Signature
di: Liu, Zian, et al.
Pubblicazione: (2023) -
Relevance as a Vulnerability: How Web Retrieval Degrades Safety Alignment in LLM Agents
di: Nawal, Aditya, et al.
Pubblicazione: (2026) -
FuncVul: An Effective Function Level Vulnerability Detection Model using LLM and Code Chunk
di: Halder, Sajal, et al.
Pubblicazione: (2025)