CoDocBench: A Dataset for Code-Documentation Alignment in Software Maintenance
Fuente:
arXiv
Guardado en:
| Autores principales: | Pai, Kunal, Devanbu, Premkumar, Ahmed, Toufique |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Automatic Semantic Augmentation of Language Model Prompts (for Code Summarization)
por: Ahmed, Toufique, et al.
Publicado: (2023)
por: Ahmed, Toufique, et al.
Publicado: (2023)
Can LLMs Replace Manual Annotation of Software Engineering Artifacts?
por: Ahmed, Toufique, et al.
Publicado: (2024)
por: Ahmed, Toufique, et al.
Publicado: (2024)
Studying LLM Performance on Closed- and Open-source Data
por: Ahmed, Toufique, et al.
Publicado: (2024)
por: Ahmed, Toufique, et al.
Publicado: (2024)
Calibration of Large Language Models on Code Summarization
por: Virk, Yuvraj, et al.
Publicado: (2024)
por: Virk, Yuvraj, et al.
Publicado: (2024)
Trojans in Large Language Models of Code: A Critical Review through a Trigger-Based Taxonomy
por: Hussain, Aftab, et al.
Publicado: (2024)
por: Hussain, Aftab, et al.
Publicado: (2024)
Calibration and Correctness of Language Models for Code
por: Spiess, Claudio, et al.
Publicado: (2024)
por: Spiess, Claudio, et al.
Publicado: (2024)
Towards Understanding What Code Language Models Learned
por: Ahmed, Toufique, et al.
Publicado: (2023)
por: Ahmed, Toufique, et al.
Publicado: (2023)
TDD-Bench Verified: Can LLMs Generate Tests for Issues Before They Get Resolved?
por: Ahmed, Toufique, et al.
Publicado: (2024)
por: Ahmed, Toufique, et al.
Publicado: (2024)
Ecosystem of Large Language Models for Code
por: Yang, Zhou, et al.
Publicado: (2024)
por: Yang, Zhou, et al.
Publicado: (2024)
Investigating Test Overfitting on SWE-bench
por: Ahmed, Toufique, et al.
Publicado: (2025)
por: Ahmed, Toufique, et al.
Publicado: (2025)
On LLMs' Internal Representation of Code Correctness
por: Ribeiro, Francisco, et al.
Publicado: (2025)
por: Ribeiro, Francisco, et al.
Publicado: (2025)
Otter: Generating Tests from Issues to Validate SWE Patches
por: Ahmed, Toufique, et al.
Publicado: (2025)
por: Ahmed, Toufique, et al.
Publicado: (2025)
Prompting and Fine-tuning Large Language Models for Automated Code Review Comment Generation
por: Haider, Md. Asif, et al.
Publicado: (2024)
por: Haider, Md. Asif, et al.
Publicado: (2024)
A Survey of Trojans in Neural Models of Source Code: Taxonomy and Techniques
por: Hussain, Aftab, et al.
Publicado: (2023)
por: Hussain, Aftab, et al.
Publicado: (2023)
Robustness, Security, Privacy, Explainability, Efficiency, and Usability of Large Language Models for Code
por: Yang, Zhou, et al.
Publicado: (2024)
por: Yang, Zhou, et al.
Publicado: (2024)
RepairAgent: An Autonomous, LLM-Based Agent for Program Repair
por: Bouzenia, Islem, et al.
Publicado: (2024)
por: Bouzenia, Islem, et al.
Publicado: (2024)
DocAgent: A Multi-Agent System for Automated Code Documentation Generation
por: Yang, Dayu, et al.
Publicado: (2025)
por: Yang, Dayu, et al.
Publicado: (2025)
How Robustly do LLMs Understand Execution Semantics?
por: Spiess, Claudio, et al.
Publicado: (2026)
por: Spiess, Claudio, et al.
Publicado: (2026)
Deep-Bench: Deep Learning Benchmark Dataset for Code Generation
por: Daghighfarsoodeh, Alireza, et al.
Publicado: (2025)
por: Daghighfarsoodeh, Alireza, et al.
Publicado: (2025)
OSS-Bench: Benchmark Generator for Coding LLMs
por: Jiang, Yuancheng, et al.
Publicado: (2025)
por: Jiang, Yuancheng, et al.
Publicado: (2025)
AICD Bench: A Challenging Benchmark for AI-Generated Code Detection
por: Orel, Daniil, et al.
Publicado: (2026)
por: Orel, Daniil, et al.
Publicado: (2026)
InfiBench: Evaluating the Question-Answering Capabilities of Code Large Language Models
por: Li, Linyi, et al.
Publicado: (2024)
por: Li, Linyi, et al.
Publicado: (2024)
IDE-Bench: Evaluating Large Language Models as IDE Agents on Real-World Software Engineering Tasks
por: Mateega, Spencer, et al.
Publicado: (2026)
por: Mateega, Spencer, et al.
Publicado: (2026)
An Efficient Model Maintenance Approach for MLOps
por: Majidi, Forough, et al.
Publicado: (2024)
por: Majidi, Forough, et al.
Publicado: (2024)
Investigating Autonomous Agent Contributions in the Wild: Activity Patterns and Code Change over Time
por: Popescu, Razvan Mihai, et al.
Publicado: (2026)
por: Popescu, Razvan Mihai, et al.
Publicado: (2026)
CoCoNUT: Structural Code Understanding does not fall out of a tree
por: Beger, Claas, et al.
Publicado: (2025)
por: Beger, Claas, et al.
Publicado: (2025)
Enhancing Software Vulnerability Detection Using Code Property Graphs and Convolutional Neural Networks
por: Saimbhi, Amanpreet Singh
Publicado: (2025)
por: Saimbhi, Amanpreet Singh
Publicado: (2025)
Cuvis.Ai: An Open-Source, Low-Code Software Ecosystem for Hyperspectral Processing and Classification
por: Hanson, Nathaniel, et al.
Publicado: (2024)
por: Hanson, Nathaniel, et al.
Publicado: (2024)
Language Models are Better Bug Detector Through Code-Pair Classification
por: Alrashedy, Kamel, et al.
Publicado: (2023)
por: Alrashedy, Kamel, et al.
Publicado: (2023)
When Less is More: On the Value of "Co-training" for Semi-Supervised Software Defect Predictors
por: Majumder, Suvodeep, et al.
Publicado: (2022)
por: Majumder, Suvodeep, et al.
Publicado: (2022)
Should Code Models Learn Pedagogically? A Preliminary Evaluation of Curriculum Learning for Real-World Software Engineering Tasks
por: Khant, Kyi Shin, et al.
Publicado: (2025)
por: Khant, Kyi Shin, et al.
Publicado: (2025)
Code Graph Model (CGM): A Graph-Integrated Large Language Model for Repository-Level Software Engineering Tasks
por: Tao, Hongyuan, et al.
Publicado: (2025)
por: Tao, Hongyuan, et al.
Publicado: (2025)
An Exploratory Investigation into Code License Infringements in Large Language Model Training Datasets
por: Katzy, Jonathan, et al.
Publicado: (2024)
por: Katzy, Jonathan, et al.
Publicado: (2024)
The State of Documentation Practices of Third-party Machine Learning Models and Datasets
por: Oreamuno, Ernesto Lang, et al.
Publicado: (2023)
por: Oreamuno, Ernesto Lang, et al.
Publicado: (2023)
The Rise of AI Teammates in Software Engineering (SE) 3.0: How Autonomous Coding Agents Are Reshaping Software Engineering
por: Li, Hao, et al.
Publicado: (2025)
por: Li, Hao, et al.
Publicado: (2025)
SelfCodeAlign: Self-Alignment for Code Generation
por: Wei, Yuxiang, et al.
Publicado: (2024)
por: Wei, Yuxiang, et al.
Publicado: (2024)
LeetCodeDataset: A Temporal Dataset for Robust Evaluation and Efficient Training of Code LLMs
por: Xia, Yunhui, et al.
Publicado: (2025)
por: Xia, Yunhui, et al.
Publicado: (2025)
DocFetch - Towards Generating Software Documentation from Multiple Software Artifacts
por: Venigalla, Akhila Sri Manasa, et al.
Publicado: (2025)
por: Venigalla, Akhila Sri Manasa, et al.
Publicado: (2025)
SWE-Bench-CL: Continual Learning for Coding Agents
por: Joshi, Thomas, et al.
Publicado: (2025)
por: Joshi, Thomas, et al.
Publicado: (2025)
LiveCodeBench: Holistic and Contamination Free Evaluation of Large Language Models for Code
por: Jain, Naman, et al.
Publicado: (2024)
por: Jain, Naman, et al.
Publicado: (2024)
Ejemplares similares
-
Automatic Semantic Augmentation of Language Model Prompts (for Code Summarization)
por: Ahmed, Toufique, et al.
Publicado: (2023) -
Can LLMs Replace Manual Annotation of Software Engineering Artifacts?
por: Ahmed, Toufique, et al.
Publicado: (2024) -
Studying LLM Performance on Closed- and Open-source Data
por: Ahmed, Toufique, et al.
Publicado: (2024) -
Calibration of Large Language Models on Code Summarization
por: Virk, Yuvraj, et al.
Publicado: (2024) -
Trojans in Large Language Models of Code: A Critical Review through a Trigger-Based Taxonomy
por: Hussain, Aftab, et al.
Publicado: (2024)