Code Membership Inference for Detecting Unauthorized Data Use in Code Pre-trained Language Models
Fuente:
arXiv
Guardado en:
| Autores principales: | Zhang, Sheng, Li, Hui |
|---|---|
| Formato: | Preprint |
| Publicado: |
2023
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Does Your Neural Code Completion Model Use My Code? A Membership Inference Approach
por: Wan, Yao, et al.
Publicado: (2024)
por: Wan, Yao, et al.
Publicado: (2024)
Coding-PTMs: How to Find Optimal Code Pre-trained Models for Code Embedding in Vulnerability Detection?
por: Zhao, Yu, et al.
Publicado: (2024)
por: Zhao, Yu, et al.
Publicado: (2024)
Effective Code Membership Inference for Code Completion Models via Adversarial Prompts
por: Jiang, Yuan, et al.
Publicado: (2025)
por: Jiang, Yuan, et al.
Publicado: (2025)
On the Effect of Token Merging on Pre-trained Models for Code
por: Saad, Mootez, et al.
Publicado: (2025)
por: Saad, Mootez, et al.
Publicado: (2025)
Bridge and Hint: Extending Pre-trained Language Models for Long-Range Code
por: Chen, Yujia, et al.
Publicado: (2024)
por: Chen, Yujia, et al.
Publicado: (2024)
Natural Is The Best: Model-Agnostic Code Simplification for Pre-trained Large Language Models
por: Wang, Yan, et al.
Publicado: (2024)
por: Wang, Yan, et al.
Publicado: (2024)
SERSEM: Selective Entropy-Weighted Scoring for Membership Inference in Code Language Models
por: Dikici, Kıvanç Kuzey, et al.
Publicado: (2026)
por: Dikici, Kıvanç Kuzey, et al.
Publicado: (2026)
Learning in the Wild: Towards Leveraging Unlabeled Data for Effectively Tuning Pre-trained Code Models
por: Gao, Shuzheng, et al.
Publicado: (2024)
por: Gao, Shuzheng, et al.
Publicado: (2024)
Train in Vain: Functionality-Preserving Poisoning to Prevent Unauthorized Use of Code Datasets
por: Xiao, Yuan, et al.
Publicado: (2026)
por: Xiao, Yuan, et al.
Publicado: (2026)
Directional Diffusion-Style Code Editing Pre-training
por: Liang, Qingyuan, et al.
Publicado: (2025)
por: Liang, Qingyuan, et al.
Publicado: (2025)
AST-PAC: AST-guided Membership Inference for Code
por: Koohestani, Roham, et al.
Publicado: (2026)
por: Koohestani, Roham, et al.
Publicado: (2026)
CoderEval: A Benchmark of Pragmatic Code Generation with Generative Pre-trained Models
por: Yu, Hao, et al.
Publicado: (2023)
por: Yu, Hao, et al.
Publicado: (2023)
Genetic Auto-prompt Learning for Pre-trained Code Intelligence Language Models
por: Feng, Chengzhe, et al.
Publicado: (2024)
por: Feng, Chengzhe, et al.
Publicado: (2024)
Models Are Codes: Towards Measuring Malicious Code Poisoning Attacks on Pre-trained Model Hubs
por: Zhao, Jian, et al.
Publicado: (2024)
por: Zhao, Jian, et al.
Publicado: (2024)
LEANCODE: Understanding Models Better for Code Simplification of Pre-trained Large Language Models
por: Wang, Yan, et al.
Publicado: (2025)
por: Wang, Yan, et al.
Publicado: (2025)
On the Usage of Continual Learning for Out-of-Distribution Generalization in Pre-trained Language Models of Code
por: Weyssow, Martin, et al.
Publicado: (2023)
por: Weyssow, Martin, et al.
Publicado: (2023)
StagedVulBERT: Multi-Granular Vulnerability Detection with a Novel Pre-trained Code Model
por: Jiang, Yuan, et al.
Publicado: (2024)
por: Jiang, Yuan, et al.
Publicado: (2024)
Gotcha! This Model Uses My Code! Evaluating Membership Leakage Risks in Code Models
por: Yang, Zhou, et al.
Publicado: (2023)
por: Yang, Zhou, et al.
Publicado: (2023)
How Do Semantically Equivalent Code Transformations Impact Membership Inference on LLMs for Code?
por: Yang, Hua, et al.
Publicado: (2025)
por: Yang, Hua, et al.
Publicado: (2025)
Ensembling Large Language Models for Code Vulnerability Detection: An Empirical Evaluation
por: Sun, Zhihong, et al.
Publicado: (2025)
por: Sun, Zhihong, et al.
Publicado: (2025)
Fine-Tuning Code Language Models to Detect Cross-Language Bugs
por: Li, Zengyang, et al.
Publicado: (2025)
por: Li, Zengyang, et al.
Publicado: (2025)
Structure-aware Fine-tuning for Code Pre-trained Models
por: Wu, Jiayi, et al.
Publicado: (2024)
por: Wu, Jiayi, et al.
Publicado: (2024)
Teaching Code LLMs to Use Autocompletion Tools in Repository-Level Code Generation
por: Wang, Chong, et al.
Publicado: (2024)
por: Wang, Chong, et al.
Publicado: (2024)
DocChecker: Bootstrapping Code Large Language Model for Detecting and Resolving Code-Comment Inconsistencies
por: Dau, Anh T. V., et al.
Publicado: (2023)
por: Dau, Anh T. V., et al.
Publicado: (2023)
Large Language Model Unlearning for Source Code
por: Jiang, Xue, et al.
Publicado: (2025)
por: Jiang, Xue, et al.
Publicado: (2025)
Evaluating Small-Scale Code Models for Code Clone Detection
por: Martinez-Gil, Jorge
Publicado: (2025)
por: Martinez-Gil, Jorge
Publicado: (2025)
CodeDPO: Aligning Code Models with Self Generated and Verified Source Code
por: Zhang, Kechi, et al.
Publicado: (2024)
por: Zhang, Kechi, et al.
Publicado: (2024)
Secret Breach Detection in Source Code with Large Language Models
por: Rahman, Md Nafiu, et al.
Publicado: (2025)
por: Rahman, Md Nafiu, et al.
Publicado: (2025)
On the Use of Agentic Coding Manifests: An Empirical Study of Claude Code
por: Chatlatanagulchai, Worawalan, et al.
Publicado: (2025)
por: Chatlatanagulchai, Worawalan, et al.
Publicado: (2025)
CodeVision: Detecting LLM-Generated Code Using 2D Token Probability Maps and Vision Models
por: Xu, Zhenyu, et al.
Publicado: (2025)
por: Xu, Zhenyu, et al.
Publicado: (2025)
Improving the Ability of Pre-trained Language Model by Imparting Large Language Model's Experience
por: Yin, Xin, et al.
Publicado: (2024)
por: Yin, Xin, et al.
Publicado: (2024)
CodeEval: A pedagogical approach for targeted evaluation of code-trained Large Language Models
por: Brahman, Danny, et al.
Publicado: (2026)
por: Brahman, Danny, et al.
Publicado: (2026)
Practical Program Repair in the Era of Large Pre-trained Language Models
por: Xia, Chunqiu Steven, et al.
Publicado: (2022)
por: Xia, Chunqiu Steven, et al.
Publicado: (2022)
Detecting Malicious Intents in Smart Contracts with Pre-trained Programming Language Models
por: Huang, Youwei, et al.
Publicado: (2025)
por: Huang, Youwei, et al.
Publicado: (2025)
Challenges of Using Pre-trained Models: the Practitioners' Perspective
por: Tan, Xin, et al.
Publicado: (2024)
por: Tan, Xin, et al.
Publicado: (2024)
On Inter-dataset Code Duplication and Data Leakage in Large Language Models
por: López, José Antonio Hernández, et al.
Publicado: (2024)
por: López, José Antonio Hernández, et al.
Publicado: (2024)
CodeMorph: Mitigating Data Leakage in Large Language Model Assessment
por: Rao, Hongzhou, et al.
Publicado: (2025)
por: Rao, Hongzhou, et al.
Publicado: (2025)
A Hybrid Approach for EMF Code Generation:Code Templates Meet Large Language Models
por: He, Xiao, et al.
Publicado: (2025)
por: He, Xiao, et al.
Publicado: (2025)
Assessing the Code Clone Detection Capability of Large Language Models
por: Zhang, Zixian, et al.
Publicado: (2024)
por: Zhang, Zixian, et al.
Publicado: (2024)
An Empirical Study on Influence-Based Pretraining Data Selection for Code Large Language Models
por: Xing, Chengli, et al.
Publicado: (2026)
por: Xing, Chengli, et al.
Publicado: (2026)
Ejemplares similares
-
Does Your Neural Code Completion Model Use My Code? A Membership Inference Approach
por: Wan, Yao, et al.
Publicado: (2024) -
Coding-PTMs: How to Find Optimal Code Pre-trained Models for Code Embedding in Vulnerability Detection?
por: Zhao, Yu, et al.
Publicado: (2024) -
Effective Code Membership Inference for Code Completion Models via Adversarial Prompts
por: Jiang, Yuan, et al.
Publicado: (2025) -
On the Effect of Token Merging on Pre-trained Models for Code
por: Saad, Mootez, et al.
Publicado: (2025) -
Bridge and Hint: Extending Pre-trained Language Models for Long-Range Code
por: Chen, Yujia, et al.
Publicado: (2024)