AIGCodeSet: A New Annotated Dataset for AI Generated Code Detection
Fuente:
arXiv
Saved in:
| Main Authors: | Demirok, Basak, Kutlu, Mucahid |
|---|---|
| Format: | Preprint |
| Published: |
2024
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
MultiAIGCD: A Comprehensive dataset for AI Generated Code Detection Covering Multiple Languages, Models,Prompts, and Scenarios
by: Demirok, Basak, et al.
Published: (2025)
by: Demirok, Basak, et al.
Published: (2025)
A Survey of Bugs in AI-Generated Code
by: Gao, Ruofan, et al.
Published: (2025)
by: Gao, Ruofan, et al.
Published: (2025)
GPT-Powered Elicitation Interview Script Generator for Requirements Engineering Training
by: Görer, Binnur, et al.
Published: (2024)
by: Görer, Binnur, et al.
Published: (2024)
Future of Code with Generative AI: Transparency and Safety in the Era of AI Generated Software
by: Hanson, David
Published: (2025)
by: Hanson, David
Published: (2025)
AI Code in the Wild: Measuring Security Risks and Ecosystem Shifts of AI-Generated Code in Modern Software
by: Wang, Bin, et al.
Published: (2025)
by: Wang, Bin, et al.
Published: (2025)
Assessing AI Detectors in Identifying AI-Generated Code: Implications for Education
by: Pan, Wei Hung, et al.
Published: (2024)
by: Pan, Wei Hung, et al.
Published: (2024)
Empowering AI to Generate Better AI Code: Guided Generation of Deep Learning Projects with LLMs
by: Xie, Chen, et al.
Published: (2025)
by: Xie, Chen, et al.
Published: (2025)
Instruction-Tuning Open-Weight Language Models for BPMN Model Generation
by: Çelikmasat, Gökberk, et al.
Published: (2025)
by: Çelikmasat, Gökberk, et al.
Published: (2025)
$\texttt{Droid}$: A Resource Suite for AI-Generated Code Detection
by: Orel, Daniil, et al.
Published: (2025)
by: Orel, Daniil, et al.
Published: (2025)
Automating Patch Set Generation from Code Review Comments Using Large Language Models
by: Rahman, Tajmilur, et al.
Published: (2024)
by: Rahman, Tajmilur, et al.
Published: (2024)
Will It Survive? Deciphering the Fate of AI-Generated Code in Open Source
by: Rahman, Musfiqur, et al.
Published: (2026)
by: Rahman, Musfiqur, et al.
Published: (2026)
On Developers' Self-Declaration of AI-Generated Code: An Analysis of Practices
by: Kashif, Syed Mohammad, et al.
Published: (2025)
by: Kashif, Syed Mohammad, et al.
Published: (2025)
Factors Influencing the Quality of AI-Generated Code: A Synthesis of Empirical Evidence
by: Geruslu, Vehid, et al.
Published: (2026)
by: Geruslu, Vehid, et al.
Published: (2026)
Generating High-Quality Datasets for Code Editing via Open-Source Language Models
by: Zhang, Zekai, et al.
Published: (2025)
by: Zhang, Zekai, et al.
Published: (2025)
A.S.E: A Repository-Level Benchmark for Evaluating Security in AI-Generated Code
by: Lian, Keke, et al.
Published: (2025)
by: Lian, Keke, et al.
Published: (2025)
DevLicOps: A Framework for Mitigating Licensing Risks in AI-Generated Code
by: Sharma, Pratyush Nidhi, et al.
Published: (2025)
by: Sharma, Pratyush Nidhi, et al.
Published: (2025)
SWE-QA: A Dataset and Benchmark for Complex Code Understanding
by: Elkoussy, Laïla, et al.
Published: (2026)
by: Elkoussy, Laïla, et al.
Published: (2026)
CodeSense: a Real-World Benchmark and Dataset for Code Semantic Reasoning
by: Roy, Monoshi Kumar, et al.
Published: (2025)
by: Roy, Monoshi Kumar, et al.
Published: (2025)
Defective Task Descriptions in LLM-Based Code Generation: Detection and Analysis
by: Akli, Amal, et al.
Published: (2026)
by: Akli, Amal, et al.
Published: (2026)
ChatGPT vs. DeepSeek: A Comparative Study on AI-Based Code Generation
by: Manik, Md Motaleb Hossen
Published: (2025)
by: Manik, Md Motaleb Hossen
Published: (2025)
AI-Generated Smells: An Analysis of Code and Architecture in LLM and Agent-Driven Development
by: Zhu, Yuecai, et al.
Published: (2026)
by: Zhu, Yuecai, et al.
Published: (2026)
From Natural Language to Verified Code: Toward AI Assisted Problem-to-Code Generation with Dafny-Based Formal Verification
by: Erfan, Md, et al.
Published: (2026)
by: Erfan, Md, et al.
Published: (2026)
CodeVision: Detecting LLM-Generated Code Using 2D Token Probability Maps and Vision Models
by: Xu, Zhenyu, et al.
Published: (2025)
by: Xu, Zhenyu, et al.
Published: (2025)
Rethinking Code Review in the Age of AI: A Vision for Agentic Code Review
by: Kamalı, Hüseyin Özgür, et al.
Published: (2026)
by: Kamalı, Hüseyin Özgür, et al.
Published: (2026)
An Approach to Detect Abnormal Submissions for CodeWorkout Dataset
by: Hicks, Alex, et al.
Published: (2024)
by: Hicks, Alex, et al.
Published: (2024)
AI-Assisted Assessment of Coding Practices in Modern Code Review
by: Vijayvergiya, Manushree, et al.
Published: (2024)
by: Vijayvergiya, Manushree, et al.
Published: (2024)
Hallucinations in Code Change to Natural Language Generation: Prevalence and Evaluation of Detection Metrics
by: Liu, Chunhua, et al.
Published: (2025)
by: Liu, Chunhua, et al.
Published: (2025)
Detecting and Correcting Hallucinations in LLM-Generated Code via Deterministic AST Analysis
by: Khati, Dipin, et al.
Published: (2026)
by: Khati, Dipin, et al.
Published: (2026)
CodeAssistBench (CAB): Dataset & Benchmarking for Multi-turn Chat-Based Code Assistance
by: Kim, Myeongsoo, et al.
Published: (2025)
by: Kim, Myeongsoo, et al.
Published: (2025)
Enhancing Code Consistency in AI Research with Large Language Models and Retrieval-Augmented Generation
by: Keshri, Rajat, et al.
Published: (2025)
by: Keshri, Rajat, et al.
Published: (2025)
API-guided Dataset Synthesis to Finetune Large Code Models
by: Li, Zongjie, et al.
Published: (2024)
by: Li, Zongjie, et al.
Published: (2024)
RedCode: Risky Code Execution and Generation Benchmark for Code Agents
by: Guo, Chengquan, et al.
Published: (2024)
by: Guo, Chengquan, et al.
Published: (2024)
A Dataset and Preliminary Study of Using GPT-5 for Code-change Impact Analysis
by: Stengg, Katharina, et al.
Published: (2025)
by: Stengg, Katharina, et al.
Published: (2025)
Leveraging LLMs for User Stories in AI Systems: UStAI Dataset
by: Yamani, Asma, et al.
Published: (2025)
by: Yamani, Asma, et al.
Published: (2025)
Analyzing Message-Code Inconsistency in AI Coding Agent-Authored Pull Requests
by: Gong, Jingzhi, et al.
Published: (2026)
by: Gong, Jingzhi, et al.
Published: (2026)
Spec-Driven Development:From Code to Contract in the Age of AI Coding Assistants
by: Piskala, Deepak Babu
Published: (2026)
by: Piskala, Deepak Babu
Published: (2026)
Code for Machines, Not Just Humans: Quantifying AI-Friendliness with Code Health Metrics
by: Borg, Markus, et al.
Published: (2026)
by: Borg, Markus, et al.
Published: (2026)
Uncovering LLM-Generated Code: A Zero-Shot Synthetic Code Detector via Code Rewriting
by: Ye, Tong, et al.
Published: (2024)
by: Ye, Tong, et al.
Published: (2024)
Evaluating Large Language Models for Functional and Maintainable Code in Industrial Settings: A Case Study at ASML
by: Mundhra, Yash, et al.
Published: (2025)
by: Mundhra, Yash, et al.
Published: (2025)
A Controlled Experiment on the Energy Efficiency of the Source Code Generated by Code Llama
by: Cursaru, Vlad-Andrei, et al.
Published: (2024)
by: Cursaru, Vlad-Andrei, et al.
Published: (2024)
Similar Items
-
MultiAIGCD: A Comprehensive dataset for AI Generated Code Detection Covering Multiple Languages, Models,Prompts, and Scenarios
by: Demirok, Basak, et al.
Published: (2025) -
A Survey of Bugs in AI-Generated Code
by: Gao, Ruofan, et al.
Published: (2025) -
GPT-Powered Elicitation Interview Script Generator for Requirements Engineering Training
by: Görer, Binnur, et al.
Published: (2024) -
Future of Code with Generative AI: Transparency and Safety in the Era of AI Generated Software
by: Hanson, David
Published: (2025) -
AI Code in the Wild: Measuring Security Risks and Ecosystem Shifts of AI-Generated Code in Modern Software
by: Wang, Bin, et al.
Published: (2025)