Ensembling Large Language Models for Code Vulnerability Detection: An Empirical Evaluation
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Sun, Zhihong, Li, Jia, Wan, Yao, Li, Chuanyi, Zhang, Hongyu, jin, Zhi, Li, Ge, Liu, Hong, Lyu, Chen, Hu, Songlin |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2025
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Sifting through the Chaff: On Utilizing Execution Feedback for Ranking the Generated Code Candidates
von: Sun, Zhihong, et al.
Veröffentlicht: (2024)
von: Sun, Zhihong, et al.
Veröffentlicht: (2024)
Enhancing Code Generation Performance of Smaller Models by Distilling the Reasoning Ability of LLMs
von: Sun, Zhihong, et al.
Veröffentlicht: (2024)
von: Sun, Zhihong, et al.
Veröffentlicht: (2024)
Knowledge-Aware Code Generation with Large Language Models
von: Huang, Tao, et al.
Veröffentlicht: (2024)
von: Huang, Tao, et al.
Veröffentlicht: (2024)
IRCoCo: Immediate Rewards-Guided Deep Reinforcement Learning for Code Completion
von: Li, Bolun, et al.
Veröffentlicht: (2024)
von: Li, Bolun, et al.
Veröffentlicht: (2024)
M2CVD: Enhancing Vulnerability Semantic through Multi-Model Collaboration for Code Vulnerability Detection
von: Wang, Ziliang, et al.
Veröffentlicht: (2024)
von: Wang, Ziliang, et al.
Veröffentlicht: (2024)
Line-level Semantic Structure Learning for Code Vulnerability Detection
von: Wang, Ziliang, et al.
Veröffentlicht: (2024)
von: Wang, Ziliang, et al.
Veröffentlicht: (2024)
SemGuard: Real-Time Semantic Evaluator for Correcting LLM-Generated Code
von: Wang, Qinglin, et al.
Veröffentlicht: (2025)
von: Wang, Qinglin, et al.
Veröffentlicht: (2025)
Empirical Evaluation of Large Language Models in Automated Program Repair
von: Sun, Jiajun, et al.
Veröffentlicht: (2025)
von: Sun, Jiajun, et al.
Veröffentlicht: (2025)
Beyond Autoregression: An Empirical Study of Diffusion Large Language Models for Code Generation
von: Li, Chengze, et al.
Veröffentlicht: (2025)
von: Li, Chengze, et al.
Veröffentlicht: (2025)
VulAgent: Hypothesis-Validation based Multi-Agent Vulnerability Detection
von: Wang, Ziliang, et al.
Veröffentlicht: (2025)
von: Wang, Ziliang, et al.
Veröffentlicht: (2025)
Towards Explainable Vulnerability Detection with Large Language Models
von: Mao, Qiheng, et al.
Veröffentlicht: (2024)
von: Mao, Qiheng, et al.
Veröffentlicht: (2024)
Can Large Language Models Serve as Evaluators for Code Summarization?
von: Wu, Yang, et al.
Veröffentlicht: (2024)
von: Wu, Yang, et al.
Veröffentlicht: (2024)
Enhancement Report Approval Prediction: A Comparative Study of Large Language Models
von: Zuo, Haosheng, et al.
Veröffentlicht: (2025)
von: Zuo, Haosheng, et al.
Veröffentlicht: (2025)
On Evaluating the Efficiency of Source Code Generated by LLMs
von: Niu, Changan, et al.
Veröffentlicht: (2024)
von: Niu, Changan, et al.
Veröffentlicht: (2024)
CodeScore: Evaluating Code Generation by Learning Code Execution
von: Dong, Yihong, et al.
Veröffentlicht: (2023)
von: Dong, Yihong, et al.
Veröffentlicht: (2023)
CodeAgent: Enhancing Code Generation with Tool-Integrated Agent Systems for Real-World Repo-level Coding Challenges
von: Zhang, Kechi, et al.
Veröffentlicht: (2024)
von: Zhang, Kechi, et al.
Veröffentlicht: (2024)
ClassEval-T: Evaluating Large Language Models in Class-Level Code Translation
von: Xue, Pengyu, et al.
Veröffentlicht: (2024)
von: Xue, Pengyu, et al.
Veröffentlicht: (2024)
Large Language Model Unlearning for Source Code
von: Jiang, Xue, et al.
Veröffentlicht: (2025)
von: Jiang, Xue, et al.
Veröffentlicht: (2025)
Uncertainty-Guided Chain-of-Thought for Code Generation with LLMs
von: Zhu, Yuqi, et al.
Veröffentlicht: (2025)
von: Zhu, Yuqi, et al.
Veröffentlicht: (2025)
Focused-DPO: Enhancing Code Generation Through Focused Preference Optimization on Error-Prone Points
von: Zhang, Kechi, et al.
Veröffentlicht: (2025)
von: Zhang, Kechi, et al.
Veröffentlicht: (2025)
EnStack: An Ensemble Stacking Framework of Large Language Models for Enhanced Vulnerability Detection in Source Code
von: Ridoy, Shahriyar Zaman, et al.
Veröffentlicht: (2024)
von: Ridoy, Shahriyar Zaman, et al.
Veröffentlicht: (2024)
LLM-based Vulnerability Detection at Project Scale: An Empirical Study
von: Li, Fengjie, et al.
Veröffentlicht: (2026)
von: Li, Fengjie, et al.
Veröffentlicht: (2026)
Benchmarking Large Language Models for Multi-Language Software Vulnerability Detection
von: Zhang, Ting, et al.
Veröffentlicht: (2025)
von: Zhang, Ting, et al.
Veröffentlicht: (2025)
LONGCODEU: Benchmarking Long-Context Language Models on Long Code Understanding
von: Li, Jia, et al.
Veröffentlicht: (2025)
von: Li, Jia, et al.
Veröffentlicht: (2025)
Exploring and Unleashing the Power of Large Language Models in Automated Code Translation
von: Yang, Zhen, et al.
Veröffentlicht: (2024)
von: Yang, Zhen, et al.
Veröffentlicht: (2024)
Self-planning Code Generation with Large Language Models
von: Jiang, Xue, et al.
Veröffentlicht: (2023)
von: Jiang, Xue, et al.
Veröffentlicht: (2023)
Large Language Models for Fault Localization: An Empirical Study
von: Xiao, YingJian, et al.
Veröffentlicht: (2025)
von: Xiao, YingJian, et al.
Veröffentlicht: (2025)
An Empirical Study on the Effectiveness of Large Language Models for Binary Code Understanding
von: Shang, Xiuwei, et al.
Veröffentlicht: (2025)
von: Shang, Xiuwei, et al.
Veröffentlicht: (2025)
Empirical Study of Code Large Language Models for Binary Security Patch Detection
von: Li, Qingyuan, et al.
Veröffentlicht: (2025)
von: Li, Qingyuan, et al.
Veröffentlicht: (2025)
Code Vulnerability Detection: A Comparative Analysis of Emerging Large Language Models
von: Sultana, Shaznin, et al.
Veröffentlicht: (2024)
von: Sultana, Shaznin, et al.
Veröffentlicht: (2024)
EvoCodeBench: An Evolving Code Generation Benchmark with Domain-Specific Evaluations
von: Li, Jia, et al.
Veröffentlicht: (2024)
von: Li, Jia, et al.
Veröffentlicht: (2024)
On the Effectiveness of Large Language Models in Domain-Specific Code Generation
von: Gu, Xiaodong, et al.
Veröffentlicht: (2023)
von: Gu, Xiaodong, et al.
Veröffentlicht: (2023)
ROCODE: Integrating Backtracking Mechanism and Program Analysis in Large Language Models for Code Generation
von: Jiang, Xue, et al.
Veröffentlicht: (2024)
von: Jiang, Xue, et al.
Veröffentlicht: (2024)
VulStamp: Vulnerability Assessment using Large Language Model
von: Shen, Hao, et al.
Veröffentlicht: (2025)
von: Shen, Hao, et al.
Veröffentlicht: (2025)
Evaluating Large Language Models for Multilingual Vulnerability Detection at Dual Granularities
von: Shu, Honglin, et al.
Veröffentlicht: (2025)
von: Shu, Honglin, et al.
Veröffentlicht: (2025)
Context-Enhanced Vulnerability Detection Based on Large Language Model
von: Yang, Yixin, et al.
Veröffentlicht: (2025)
von: Yang, Yixin, et al.
Veröffentlicht: (2025)
Showing LLM-Generated Code Selectively Based on Confidence of LLMs
von: Li, Jia, et al.
Veröffentlicht: (2024)
von: Li, Jia, et al.
Veröffentlicht: (2024)
TransferFuzz: Fuzzing with Historical Trace for Verifying Propagated Vulnerability Code
von: Li, Siyuan, et al.
Veröffentlicht: (2024)
von: Li, Siyuan, et al.
Veröffentlicht: (2024)
Evaluating Large Language Models for Line-Level Vulnerability Localization
von: Zhang, Jian, et al.
Veröffentlicht: (2024)
von: Zhang, Jian, et al.
Veröffentlicht: (2024)
StackTrans: From Large Language Model to Large Pushdown Automata Model
von: Zhang, Kechi, et al.
Veröffentlicht: (2025)
von: Zhang, Kechi, et al.
Veröffentlicht: (2025)
Ähnliche Einträge
-
Sifting through the Chaff: On Utilizing Execution Feedback for Ranking the Generated Code Candidates
von: Sun, Zhihong, et al.
Veröffentlicht: (2024) -
Enhancing Code Generation Performance of Smaller Models by Distilling the Reasoning Ability of LLMs
von: Sun, Zhihong, et al.
Veröffentlicht: (2024) -
Knowledge-Aware Code Generation with Large Language Models
von: Huang, Tao, et al.
Veröffentlicht: (2024) -
IRCoCo: Immediate Rewards-Guided Deep Reinforcement Learning for Code Completion
von: Li, Bolun, et al.
Veröffentlicht: (2024) -
M2CVD: Enhancing Vulnerability Semantic through Multi-Model Collaboration for Code Vulnerability Detection
von: Wang, Ziliang, et al.
Veröffentlicht: (2024)