Case Study: Fine-tuning Small Language Models for Accurate and Private CWE Detection in Python Code
Fuente:
arXiv
Saved in:
| Main Authors: | Bappy, Md. Azizul Hakim, Mustafa, Hossen A, Saha, Prottoy, Salehat, Rajinus |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Systematically Deconstructing APVD Steganography and its Payload with a Unified Deep Learning Paradigm
by: Deb, Kabbo Jit, et al.
Published: (2025)
by: Deb, Kabbo Jit, et al.
Published: (2025)
Fine-tuning Large Language Models for DGA and DNS Exfiltration Detection
by: Sayed, Md Abu, et al.
Published: (2024)
by: Sayed, Md Abu, et al.
Published: (2024)
On the Adversarial Robustness of Instruction-Tuned Large Language Models for Code
by: Hossen, Md Imran, et al.
Published: (2024)
by: Hossen, Md Imran, et al.
Published: (2024)
Differentially Private Parameter-Efficient Fine-tuning for Large ASR Models
by: Liu, Hongbin, et al.
Published: (2024)
by: Liu, Hongbin, et al.
Published: (2024)
CASTLE: Benchmarking Dataset for Static Code Analyzers and LLMs towards CWE Detection
by: Dubniczky, Richard A., et al.
Published: (2025)
by: Dubniczky, Richard A., et al.
Published: (2025)
From Generalist to Specialist: Exploring CWE-Specific Vulnerability Detection
by: Atiiq, Syafiq Al, et al.
Published: (2024)
by: Atiiq, Syafiq Al, et al.
Published: (2024)
From Theory to Practice: Code Generation Using LLMs for CAPEC and CWE Frameworks
by: Shahzad, Murtuza, et al.
Published: (2026)
by: Shahzad, Murtuza, et al.
Published: (2026)
Selective Pre-training for Private Fine-tuning
by: Yu, Da, et al.
Published: (2023)
by: Yu, Da, et al.
Published: (2023)
Uncovering CWE-CVE-CPE Relations with Threat Knowledge Graphs
by: Shi, Zhenpeng, et al.
Published: (2023)
by: Shi, Zhenpeng, et al.
Published: (2023)
Double Backdoored: Converting Code Large Language Model Backdoors to Traditional Malware via Adversarial Instruction Tuning Attacks
by: Hossen, Md Imran, et al.
Published: (2024)
by: Hossen, Md Imran, et al.
Published: (2024)
Private Fine-tuning of Large Language Models with Zeroth-order Optimization
by: Tang, Xinyu, et al.
Published: (2024)
by: Tang, Xinyu, et al.
Published: (2024)
Think Broad, Act Narrow: CWE Identification with Multi-Agent Large Language Models
by: Sayagh, Mohammed, et al.
Published: (2025)
by: Sayagh, Mohammed, et al.
Published: (2025)
DP-SAPF: Saliency-Aware Parameter Fine-tuning of Public Models for Differentially Private Image Synthesis
by: Gong, Chen, et al.
Published: (2026)
by: Gong, Chen, et al.
Published: (2026)
Fine-tuning RoBERTa for CVE-to-CWE Classification: A 125M Parameter Model Competitive with LLMs
by: Mosievskiy, Nikita
Published: (2026)
by: Mosievskiy, Nikita
Published: (2026)
Privately Learning from Graphs with Applications in Fine-tuning Large Language Models
by: Yin, Haoteng, et al.
Published: (2024)
by: Yin, Haoteng, et al.
Published: (2024)
How Much Do Code Language Models Remember? An Investigation on Data Extraction Attacks before and after Fine-tuning
by: Salerno, Fabio, et al.
Published: (2025)
by: Salerno, Fabio, et al.
Published: (2025)
StrTune: Data Dependence-based Code Slicing for Binary Similarity Detection with Fine-tuned Representation
by: He, Kaiyan, et al.
Published: (2024)
by: He, Kaiyan, et al.
Published: (2024)
Protected QR Code-based Anti-counterfeit System for Pharmaceutical Manufacturing
by: Aulia, Md Masruk, et al.
Published: (2024)
by: Aulia, Md Masruk, et al.
Published: (2024)
VeriCWEty: Embedding enabled Line-Level CWE Detection in Verilog
by: Roy, Prithwish Basu, et al.
Published: (2026)
by: Roy, Prithwish Basu, et al.
Published: (2026)
Private LoRA Fine-tuning of Open-Source LLMs with Homomorphic Encryption
by: Frery, Jordan, et al.
Published: (2025)
by: Frery, Jordan, et al.
Published: (2025)
ThermoCAPTCHA: Privacy-Preserving Human Verification with Farm-Resistant Traceable Tokens
by: Paul, Shovon, et al.
Published: (2026)
by: Paul, Shovon, et al.
Published: (2026)
Nebula: Efficient, Private and Accurate Histogram Estimation
by: Shamsabadi, Ali Shahin, et al.
Published: (2024)
by: Shamsabadi, Ali Shahin, et al.
Published: (2024)
UniASM: Binary Code Similarity Detection without Fine-tuning
by: Gu, Yeming, et al.
Published: (2022)
by: Gu, Yeming, et al.
Published: (2022)
Detecting Adversarial Fine-tuning with Auditing Agents
by: Egler, Sarah, et al.
Published: (2025)
by: Egler, Sarah, et al.
Published: (2025)
Practical Secure Inference Algorithm for Fine-tuned Large Language Model Based on Fully Homomorphic Encryption
by: Ruoyan, Zhang, et al.
Published: (2025)
by: Ruoyan, Zhang, et al.
Published: (2025)
Differentially Private Subspace Fine-Tuning for Large Language Models
by: Zheng, Lele, et al.
Published: (2026)
by: Zheng, Lele, et al.
Published: (2026)
Antidote: Post-fine-tuning Safety Alignment for Large Language Models against Harmful Fine-tuning
by: Huang, Tiansheng, et al.
Published: (2024)
by: Huang, Tiansheng, et al.
Published: (2024)
PriFFT: Privacy-preserving Federated Fine-tuning of Large Language Models via Hybrid Secret Sharing
by: You, Zhichao, et al.
Published: (2025)
by: You, Zhichao, et al.
Published: (2025)
Navigating the Designs of Privacy-Preserving Fine-tuning for Large Language Models
by: Shi, Haonan, et al.
Published: (2025)
by: Shi, Haonan, et al.
Published: (2025)
Fine-tuning of Large Language Models for Domain-Specific Cybersecurity Knowledge
by: Huang, Yuan
Published: (2025)
by: Huang, Yuan
Published: (2025)
SentinelLMs: Encrypted Input Adaptation and Fine-tuning of Language Models for Private and Secure Inference
by: Mishra, Abhijit, et al.
Published: (2023)
by: Mishra, Abhijit, et al.
Published: (2023)
Out of Distribution, Out of Luck: How Well Can LLMs Trained on Vulnerability Datasets Detect Top 25 CWE Weaknesses?
by: Li, Yikun, et al.
Published: (2025)
by: Li, Yikun, et al.
Published: (2025)
Modelling Attacks in Blockchain Systems using Petri Nets
by: Shahriar, Md. Atik, et al.
Published: (2020)
by: Shahriar, Md. Atik, et al.
Published: (2020)
Black-box Membership Inference Attacks against Fine-tuned Diffusion Models
by: Pang, Yan, et al.
Published: (2023)
by: Pang, Yan, et al.
Published: (2023)
ReCIT: Reconstructing Full Private Data from Gradient in Parameter-Efficient Fine-Tuning of Large Language Models
by: Xie, Jin, et al.
Published: (2025)
by: Xie, Jin, et al.
Published: (2025)
Alleviating the Fear of Losing Alignment in LLM Fine-tuning
by: Yang, Kang, et al.
Published: (2025)
by: Yang, Kang, et al.
Published: (2025)
FixV2W: Correcting Invalid CVE-CWE Mappings with Knowledge Graph Embeddings
by: Simsek, Sevval, et al.
Published: (2026)
by: Simsek, Sevval, et al.
Published: (2026)
PickleFuzzer: A Case Study in Fuzzing for Discrepancies Between Python Pickle Implementations
by: Applegate, Justin, et al.
Published: (2026)
by: Applegate, Justin, et al.
Published: (2026)
Detecting Instruction Fine-tuning Attacks using Influence Function
by: Li, Jiawei
Published: (2025)
by: Li, Jiawei
Published: (2025)
Teaching DevOps Security Education with Hands-on Labware: Automated Detection of Security Weakness in Python
by: Akter, Mst Shapna, et al.
Published: (2023)
by: Akter, Mst Shapna, et al.
Published: (2023)
Similar Items
-
Systematically Deconstructing APVD Steganography and its Payload with a Unified Deep Learning Paradigm
by: Deb, Kabbo Jit, et al.
Published: (2025) -
Fine-tuning Large Language Models for DGA and DNS Exfiltration Detection
by: Sayed, Md Abu, et al.
Published: (2024) -
On the Adversarial Robustness of Instruction-Tuned Large Language Models for Code
by: Hossen, Md Imran, et al.
Published: (2024) -
Differentially Private Parameter-Efficient Fine-tuning for Large ASR Models
by: Liu, Hongbin, et al.
Published: (2024) -
CASTLE: Benchmarking Dataset for Static Code Analyzers and LLMs towards CWE Detection
by: Dubniczky, Richard A., et al.
Published: (2025)