Secure Code Generation via Online Reinforcement Learning with Vulnerability Reward Model
Fuente:
arXiv
Guardado en:
| Autores principales: | Wu, Tianyi, Du, Mingzhe, Liu, Yue, Yang, Chengran, Zhuo, Terry Yue, Zhang, Jiaheng, Ng, See-Kiong |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Geneshift: Impact of different scenario shift on Jailbreaking LLM
por: Wu, Tianyi, et al.
Publicado: (2025)
por: Wu, Tianyi, et al.
Publicado: (2025)
Confidence Elicitation: A New Attack Vector for Large Language Models
por: Formento, Brian, et al.
Publicado: (2025)
por: Formento, Brian, et al.
Publicado: (2025)
HackWorld: Evaluating Computer-Use Agents on Exploiting Web Application Vulnerabilities
por: Ren, Xiaoxue, et al.
Publicado: (2025)
por: Ren, Xiaoxue, et al.
Publicado: (2025)
SecureVibeBench: Benchmarking Secure Vibe Coding of AI Agents via Reconstructing Vulnerability-Introducing Scenarios
por: Chen, Junkai, et al.
Publicado: (2025)
por: Chen, Junkai, et al.
Publicado: (2025)
SecureForge: Finding and Preventing Vulnerabilities in LLM-Generated Code via Prompt Optimization
por: Liu, Houjun, et al.
Publicado: (2026)
por: Liu, Houjun, et al.
Publicado: (2026)
SecureCodeRL: Security-Aware Reinforcement Learning for Code Generation with Partial-Credit Rewards
por: Sijwali, Suryansh Singh, et al.
Publicado: (2026)
por: Sijwali, Suryansh Singh, et al.
Publicado: (2026)
Auditing Data Membership in Reinforcement Learning With Verifiable Rewards
por: Liu, Yule, et al.
Publicado: (2025)
por: Liu, Yule, et al.
Publicado: (2025)
Training Language Model Agents to Find Vulnerabilities with CTF-Dojo
por: Zhuo, Terry Yue, et al.
Publicado: (2025)
por: Zhuo, Terry Yue, et al.
Publicado: (2025)
PrivCode: When Code Generation Meets Differential Privacy
por: Liu, Zheng, et al.
Publicado: (2025)
por: Liu, Zheng, et al.
Publicado: (2025)
Generalization-Enhanced Code Vulnerability Detection via Multi-Task Instruction Fine-Tuning
por: Du, Xiaohu, et al.
Publicado: (2024)
por: Du, Xiaohu, et al.
Publicado: (2024)
Rethinking Machine Unlearning in Image Generation Models
por: Liu, Renyang, et al.
Publicado: (2025)
por: Liu, Renyang, et al.
Publicado: (2025)
A Mixture of Linear Corrections Generates Secure Code
por: Yu, Weichen, et al.
Publicado: (2025)
por: Yu, Weichen, et al.
Publicado: (2025)
Cyber-Zero: Training Cybersecurity Agents without Runtime
por: Zhuo, Terry Yue, et al.
Publicado: (2025)
por: Zhuo, Terry Yue, et al.
Publicado: (2025)
Watermarking LLM Agent Trajectories
por: Meng, Wenlong, et al.
Publicado: (2026)
por: Meng, Wenlong, et al.
Publicado: (2026)
From Vulnerabilities to Remediation: A Systematic Literature Review of LLMs in Code Security
por: Basic, Enna, et al.
Publicado: (2024)
por: Basic, Enna, et al.
Publicado: (2024)
Efficient Provably Secure Linguistic Steganography via Range Coding
por: Yan, Ruiyi, et al.
Publicado: (2026)
por: Yan, Ruiyi, et al.
Publicado: (2026)
An Empirical Study of Vulnerabilities in Python Packages and Their Detection
por: Quan, Haowei, et al.
Publicado: (2025)
por: Quan, Haowei, et al.
Publicado: (2025)
Lightweight Yet Secure: Secure Scripting Language Generation via Lightweight LLMs
por: Zhang, Keyang, et al.
Publicado: (2026)
por: Zhang, Keyang, et al.
Publicado: (2026)
Learning to Generate Secure Code via Token-Level Rewards
por: Quan, Jiazheng, et al.
Publicado: (2026)
por: Quan, Jiazheng, et al.
Publicado: (2026)
GuardReasoner-VL: Safeguarding VLMs via Reinforced Reasoning
por: Liu, Yue, et al.
Publicado: (2025)
por: Liu, Yue, et al.
Publicado: (2025)
BadJudge: Backdoor Vulnerabilities of LLM-as-a-Judge
por: Tong, Terry, et al.
Publicado: (2025)
por: Tong, Terry, et al.
Publicado: (2025)
Security Attacks on LLM-based Code Completion Tools
por: Cheng, Wen, et al.
Publicado: (2024)
por: Cheng, Wen, et al.
Publicado: (2024)
Chain-of-Code Collapse: Reasoning Failures in LLMs via Adversarial Prompting in Code Generation
por: Roh, Jaechul, et al.
Publicado: (2025)
por: Roh, Jaechul, et al.
Publicado: (2025)
GradingAttack: Exposing Security Vulnerabilities in LLM Based Educational Grading Agents
por: Li, Xueyi, et al.
Publicado: (2026)
por: Li, Xueyi, et al.
Publicado: (2026)
Argus: Reorchestrating Static Analysis via a Multi-Agent Ensemble for Full-Chain Security Vulnerability Detection
por: Liang, Zi, et al.
Publicado: (2026)
por: Liang, Zi, et al.
Publicado: (2026)
DeepCode AI Fix: Fixing Security Vulnerabilities with Large Language Models
por: Berabi, Berkay, et al.
Publicado: (2024)
por: Berabi, Berkay, et al.
Publicado: (2024)
Watermarking Conditional Text Generation for AI Detection: Unveiling Challenges and a Semantic-Aware Watermark Remedy
por: Fu, Yu, et al.
Publicado: (2023)
por: Fu, Yu, et al.
Publicado: (2023)
SecurityLingua: Efficient Defense of LLM Jailbreak Attacks via Security-Aware Prompt Compression
por: Li, Yucheng, et al.
Publicado: (2025)
por: Li, Yucheng, et al.
Publicado: (2025)
Image Can Bring Your Memory Back: A Novel Multi-Modal Guided Attack against Image Generation Model Unlearning
por: Liu, Renyang, et al.
Publicado: (2025)
por: Liu, Renyang, et al.
Publicado: (2025)
Persistent Human Feedback, LLMs, and Static Analyzers for Secure Code Generation and Vulnerability Detection
por: Firouzi, Ehsan, et al.
Publicado: (2026)
por: Firouzi, Ehsan, et al.
Publicado: (2026)
A Systematic Study of Code Obfuscation Against LLM-based Vulnerability Detection
por: Li, Xiao, et al.
Publicado: (2025)
por: Li, Xiao, et al.
Publicado: (2025)
Enhancing Code Vulnerability Detection via Vulnerability-Preserving Data Augmentation
por: Liu, Shangqing, et al.
Publicado: (2024)
por: Liu, Shangqing, et al.
Publicado: (2024)
TypePilot: Leveraging the Scala Type System for Secure LLM-generated Code
por: Sternfeld, Alexander, et al.
Publicado: (2025)
por: Sternfeld, Alexander, et al.
Publicado: (2025)
ExtremeAIGC: Benchmarking LMM Vulnerability to AI-Generated Extremist Content
por: Chandna, Bhavik, et al.
Publicado: (2025)
por: Chandna, Bhavik, et al.
Publicado: (2025)
Semantics-Aligned, Curriculum-Driven, and Reasoning-Enhanced Vulnerability Repair Framework
por: Yang, Chengran, et al.
Publicado: (2025)
por: Yang, Chengran, et al.
Publicado: (2025)
IRIS: LLM-Assisted Static Analysis for Detecting Security Vulnerabilities
por: Li, Ziyang, et al.
Publicado: (2024)
por: Li, Ziyang, et al.
Publicado: (2024)
Understanding the Effectiveness of Large Language Models in Detecting Security Vulnerabilities
por: Khare, Avishree, et al.
Publicado: (2023)
por: Khare, Avishree, et al.
Publicado: (2023)
QLCoder: A Query Synthesizer For Static Analysis of Security Vulnerabilities
por: Wang, Claire, et al.
Publicado: (2025)
por: Wang, Claire, et al.
Publicado: (2025)
SecRef*: Securely Sharing Mutable References Between Verified and Unverified Code in F*
por: Andrici, Cezar-Constantin, et al.
Publicado: (2025)
por: Andrici, Cezar-Constantin, et al.
Publicado: (2025)
SDLLMFuzz: Dynamic-static LLM-assisted greybox fuzzing for structured input programs
por: Zou, Yihao, et al.
Publicado: (2026)
por: Zou, Yihao, et al.
Publicado: (2026)
Ejemplares similares
-
Geneshift: Impact of different scenario shift on Jailbreaking LLM
por: Wu, Tianyi, et al.
Publicado: (2025) -
Confidence Elicitation: A New Attack Vector for Large Language Models
por: Formento, Brian, et al.
Publicado: (2025) -
HackWorld: Evaluating Computer-Use Agents on Exploiting Web Application Vulnerabilities
por: Ren, Xiaoxue, et al.
Publicado: (2025) -
SecureVibeBench: Benchmarking Secure Vibe Coding of AI Agents via Reconstructing Vulnerability-Introducing Scenarios
por: Chen, Junkai, et al.
Publicado: (2025) -
SecureForge: Finding and Preventing Vulnerabilities in LLM-Generated Code via Prompt Optimization
por: Liu, Houjun, et al.
Publicado: (2026)