CodeInsight: A Curated Dataset of Practical Coding Solutions from Stack Overflow
Fuente:
arXiv
Salvato in:
| Autori principali: | Beau, Nathanaël, Crabbé, Benoît |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
RETROcode: Leveraging a Code Database for Improved Natural Language to Code Generation
di: Beau, Nathanaël, et al.
Pubblicazione: (2025)
di: Beau, Nathanaël, et al.
Pubblicazione: (2025)
Code2Doc: A Quality-First Curated Dataset for Code Documentation
di: Karaman, Recep Kaan, et al.
Pubblicazione: (2025)
di: Karaman, Recep Kaan, et al.
Pubblicazione: (2025)
Can ChatGPT replace StackOverflow? A Study on Robustness and Reliability of Large Language Model Code Generation
di: Zhong, Li, et al.
Pubblicazione: (2023)
di: Zhong, Li, et al.
Pubblicazione: (2023)
Seed-Coder: Let the Code Model Curate Data for Itself
di: Seed, ByteDance, et al.
Pubblicazione: (2025)
di: Seed, ByteDance, et al.
Pubblicazione: (2025)
EnStack: An Ensemble Stacking Framework of Large Language Models for Enhanced Vulnerability Detection in Source Code
di: Ridoy, Shahriyar Zaman, et al.
Pubblicazione: (2024)
di: Ridoy, Shahriyar Zaman, et al.
Pubblicazione: (2024)
OpenCodeInstruct: A Large-scale Instruction Tuning Dataset for Code LLMs
di: Ahmad, Wasi Uddin, et al.
Pubblicazione: (2025)
di: Ahmad, Wasi Uddin, et al.
Pubblicazione: (2025)
The Influence of Code Comments on the Perceived Helpfulness of Stack Overflow Posts
di: Figl, Kathrin, et al.
Pubblicazione: (2025)
di: Figl, Kathrin, et al.
Pubblicazione: (2025)
ArkTS-CodeSearch: A Open-Source ArkTS Dataset for Code Retrieval
di: He, Yulong, et al.
Pubblicazione: (2026)
di: He, Yulong, et al.
Pubblicazione: (2026)
Evaluating Privacy Questions From Stack Overflow: Can ChatGPT Compete?
di: Delile, Zack, et al.
Pubblicazione: (2023)
di: Delile, Zack, et al.
Pubblicazione: (2023)
Code2API: A Tool for Generating Reusable APIs from Stack Overflow Code Snippets
di: Mai, Yubo, et al.
Pubblicazione: (2025)
di: Mai, Yubo, et al.
Pubblicazione: (2025)
From Code Foundation Models to Agents and Applications: A Comprehensive Survey and Practical Guide to Code Intelligence
di: Yang, Jian, et al.
Pubblicazione: (2025)
di: Yang, Jian, et al.
Pubblicazione: (2025)
StackEval: Benchmarking LLMs in Coding Assistance
di: Shah, Nidhish, et al.
Pubblicazione: (2024)
di: Shah, Nidhish, et al.
Pubblicazione: (2024)
Studying and Recommending Information Highlighting in Stack Overflow Answers
di: Ahmed, Shahla Shaan, et al.
Pubblicazione: (2024)
di: Ahmed, Shahla Shaan, et al.
Pubblicazione: (2024)
Identifying Smart Contract Security Issues in Code Snippets from Stack Overflow
di: Chen, Jiachi, et al.
Pubblicazione: (2024)
di: Chen, Jiachi, et al.
Pubblicazione: (2024)
Searching by Code: a New SearchBySnippet Dataset and SnippeR Retrieval Model for Searching by Code Snippets
di: Sedykh, Ivan, et al.
Pubblicazione: (2023)
di: Sedykh, Ivan, et al.
Pubblicazione: (2023)
LeetCodeDataset: A Temporal Dataset for Robust Evaluation and Efficient Training of Code LLMs
di: Xia, Yunhui, et al.
Pubblicazione: (2025)
di: Xia, Yunhui, et al.
Pubblicazione: (2025)
An Empirical Study on Logging Evolution On Stack Overflow: Trends, Topics, and Challenges
di: Foalem, Patrick Loic, et al.
Pubblicazione: (2026)
di: Foalem, Patrick Loic, et al.
Pubblicazione: (2026)
AgentPack: A Dataset of Code Changes, Co-Authored by Agents and Humans
di: Zi, Yangtian, et al.
Pubblicazione: (2025)
di: Zi, Yangtian, et al.
Pubblicazione: (2025)
An Empirical Study of Java Code Improvements Based on Stack Overflow Answer Edits
di: Wiratsin, In-on, et al.
Pubblicazione: (2025)
di: Wiratsin, In-on, et al.
Pubblicazione: (2025)
SOSecure: Safer Code Generation with RAG and StackOverflow Discussions
di: Mukherjee, Manisha, et al.
Pubblicazione: (2025)
di: Mukherjee, Manisha, et al.
Pubblicazione: (2025)
Evaluation of Code LLMs on Geospatial Code Generation
di: Gramacki, Piotr, et al.
Pubblicazione: (2024)
di: Gramacki, Piotr, et al.
Pubblicazione: (2024)
Enhancing Code LLMs with Reinforcement Learning in Code Generation: A Survey
di: Wang, Junqiao, et al.
Pubblicazione: (2024)
di: Wang, Junqiao, et al.
Pubblicazione: (2024)
Mercury: A Code Efficiency Benchmark for Code Large Language Models
di: Du, Mingzhe, et al.
Pubblicazione: (2024)
di: Du, Mingzhe, et al.
Pubblicazione: (2024)
VersiCode: Towards Version-controllable Code Generation
di: Wu, Tongtong, et al.
Pubblicazione: (2024)
di: Wu, Tongtong, et al.
Pubblicazione: (2024)
Evaluating and Achieving Controllable Code Completion in Code LLM
di: Zhang, Jiajun, et al.
Pubblicazione: (2026)
di: Zhang, Jiajun, et al.
Pubblicazione: (2026)
Code Fingerprints: Disentangled Attribution of LLM-Generated Code
di: Guo, Jiaxun, et al.
Pubblicazione: (2026)
di: Guo, Jiaxun, et al.
Pubblicazione: (2026)
Vibe Coding vs. Agentic Coding: Fundamentals and Practical Implications of Agentic AI
di: Sapkota, Ranjan, et al.
Pubblicazione: (2025)
di: Sapkota, Ranjan, et al.
Pubblicazione: (2025)
Can We Identify Stack Overflow Questions Requiring Code Snippets? Investigating the Cause & Effect of Missing Code Snippets
di: Mondal, Saikat, et al.
Pubblicazione: (2024)
di: Mondal, Saikat, et al.
Pubblicazione: (2024)
CodeRAG-Bench: Can Retrieval Augment Code Generation?
di: Wang, Zora Zhiruo, et al.
Pubblicazione: (2024)
di: Wang, Zora Zhiruo, et al.
Pubblicazione: (2024)
CodeOCR: On the Effectiveness of Vision Language Models in Code Understanding
di: Shi, Yuling, et al.
Pubblicazione: (2026)
di: Shi, Yuling, et al.
Pubblicazione: (2026)
CodeFlowBench: A Multi-turn, Iterative Benchmark for Complex Code Generation
di: Wang, Sizhe, et al.
Pubblicazione: (2025)
di: Wang, Sizhe, et al.
Pubblicazione: (2025)
LongCodeZip: Compress Long Context for Code Language Models
di: Shi, Yuling, et al.
Pubblicazione: (2025)
di: Shi, Yuling, et al.
Pubblicazione: (2025)
Bridging Code Graphs and Large Language Models for Better Code Understanding
di: Chen, Zeqi, et al.
Pubblicazione: (2025)
di: Chen, Zeqi, et al.
Pubblicazione: (2025)
Is Your AI-Generated Code Really Safe? Evaluating Large Language Models on Secure Code Generation with CodeSecEval
di: Wang, Jiexin, et al.
Pubblicazione: (2024)
di: Wang, Jiexin, et al.
Pubblicazione: (2024)
CodeHalu: Investigating Code Hallucinations in LLMs via Execution-based Verification
di: Tian, Yuchen, et al.
Pubblicazione: (2024)
di: Tian, Yuchen, et al.
Pubblicazione: (2024)
EvoCodeBench: An Evolving Code Generation Benchmark with Domain-Specific Evaluations
di: Li, Jia, et al.
Pubblicazione: (2024)
di: Li, Jia, et al.
Pubblicazione: (2024)
CodeBenchGen: Creating Scalable Execution-based Code Generation Benchmarks
di: Xie, Yiqing, et al.
Pubblicazione: (2024)
di: Xie, Yiqing, et al.
Pubblicazione: (2024)
CodeReviewQA: The Code Review Comprehension Assessment for Large Language Models
di: Lin, Hong Yi, et al.
Pubblicazione: (2025)
di: Lin, Hong Yi, et al.
Pubblicazione: (2025)
CCT-Code: Cross-Consistency Training for Multilingual Clone Detection and Code Search
di: Tikhonov, Anton, et al.
Pubblicazione: (2023)
di: Tikhonov, Anton, et al.
Pubblicazione: (2023)
AutoCodeBench: Large Language Models are Automatic Code Benchmark Generators
di: Chou, Jason, et al.
Pubblicazione: (2025)
di: Chou, Jason, et al.
Pubblicazione: (2025)
Documenti analoghi
-
RETROcode: Leveraging a Code Database for Improved Natural Language to Code Generation
di: Beau, Nathanaël, et al.
Pubblicazione: (2025) -
Code2Doc: A Quality-First Curated Dataset for Code Documentation
di: Karaman, Recep Kaan, et al.
Pubblicazione: (2025) -
Can ChatGPT replace StackOverflow? A Study on Robustness and Reliability of Large Language Model Code Generation
di: Zhong, Li, et al.
Pubblicazione: (2023) -
Seed-Coder: Let the Code Model Curate Data for Itself
di: Seed, ByteDance, et al.
Pubblicazione: (2025) -
EnStack: An Ensemble Stacking Framework of Large Language Models for Enhanced Vulnerability Detection in Source Code
di: Ridoy, Shahriyar Zaman, et al.
Pubblicazione: (2024)