CupCleaner: A Hybrid Data Cleaning Approach for Comment Updating
Fuente:
arXiv
Saved in:
| Main Authors: | Liang, Qingyuan, Sun, Zeyu, Zhu, Qihao, Hu, Junhao, Zhao, Yifan, Zhang, Yakun, Zhang, Lu |
|---|---|
| Format: | Preprint |
| Published: |
2023
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Directional Diffusion-Style Code Editing Pre-training
by: Liang, Qingyuan, et al.
Published: (2025)
by: Liang, Qingyuan, et al.
Published: (2025)
Contextualized Code Pretraining for Code Generation
by: Liu, Chen, et al.
Published: (2026)
by: Liu, Chen, et al.
Published: (2026)
Automatically Learning a Precise Measurement for Fault Diagnosis Capability of Test Cases
by: Zhao, Yifan, et al.
Published: (2025)
by: Zhao, Yifan, et al.
Published: (2025)
Lyra: A Benchmark for Turducken-Style Code Generation
by: Liang, Qingyuan, et al.
Published: (2021)
by: Liang, Qingyuan, et al.
Published: (2021)
Toward Functional and Non-Functional Evaluation of Application-Level Code Generation
by: Pan, Ruwei, et al.
Published: (2026)
by: Pan, Ruwei, et al.
Published: (2026)
GramTrans: A Better Code Representation Approach in Code Generation
by: Zhang, Zhao, et al.
Published: (2025)
by: Zhang, Zhao, et al.
Published: (2025)
DSCodeBench: A Realistic Benchmark for Data Science Code Generation
by: Ouyang, Shuyin, et al.
Published: (2025)
by: Ouyang, Shuyin, et al.
Published: (2025)
Do Advanced Language Models Eliminate the Need for Prompt Engineering in Software Engineering?
by: Wang, Guoqing, et al.
Published: (2024)
by: Wang, Guoqing, et al.
Published: (2024)
TRACE: Evaluating Execution Efficiency of LLM-Based Code Translation
by: Gong, Zhihao, et al.
Published: (2026)
by: Gong, Zhihao, et al.
Published: (2026)
TRACE: Evaluating Execution Efficiency of LLM-Based Code Translation
by: Gong, Zhihao, et al.
Published: (2025)
by: Gong, Zhihao, et al.
Published: (2025)
Condor: A Code Discriminator Integrating General Semantics with Code Details
by: Liang, Qingyuan, et al.
Published: (2024)
by: Liang, Qingyuan, et al.
Published: (2024)
Clean Code, Better Models: Enhancing LLM Performance with Smell-Cleaned Dataset
by: Xue, Zhipeng, et al.
Published: (2025)
by: Xue, Zhipeng, et al.
Published: (2025)
Prompt Alchemy: Automatic Prompt Refinement for Enhancing Code Generation
by: Ye, Sixiang, et al.
Published: (2025)
by: Ye, Sixiang, et al.
Published: (2025)
SateLight: A Satellite Application Update Framework for Satellite Computing
by: Wen, Jinfeng, et al.
Published: (2025)
by: Wen, Jinfeng, et al.
Published: (2025)
Knowledge-Enhanced Program Repair for Data Science Code
by: Ouyang, Shuyin, et al.
Published: (2025)
by: Ouyang, Shuyin, et al.
Published: (2025)
Reinforcement Learning with Negative Tests as Completeness Signal for Formal Specification Synthesis
by: Huang, Zhechong, et al.
Published: (2026)
by: Huang, Zhechong, et al.
Published: (2026)
Mono: Is Your "Clean" Vulnerability Dataset Really Solvable? Exposing and Trapping Undecidable Patches and Beyond
by: Gao, Zeyu, et al.
Published: (2025)
by: Gao, Zeyu, et al.
Published: (2025)
Rethinking the effects of data contamination in Code Intelligence
by: Yang, Zhen, et al.
Published: (2025)
by: Yang, Zhen, et al.
Published: (2025)
Boosting Automatic Java-to-Cangjie Translation with Multi-Stage LLM Training and Error Repair
by: Liang, Xinyue, et al.
Published: (2026)
by: Liang, Xinyue, et al.
Published: (2026)
Refactoring to Pythonic Idioms: A Hybrid Knowledge-Driven Approach Leveraging Large Language Models
by: Zhang, Zejun, et al.
Published: (2024)
by: Zhang, Zejun, et al.
Published: (2024)
Evaluating the Impact of Data Cleaning on the Quality of Generated Pull Request Descriptions
by: Tire, Kutay, et al.
Published: (2025)
by: Tire, Kutay, et al.
Published: (2025)
CITYWALK: Enhancing LLM-Based C++ Unit Test Generation via Project-Dependency Awareness and Language-Specific Knowledge
by: Zhang, Yuwei, et al.
Published: (2025)
by: Zhang, Yuwei, et al.
Published: (2025)
CodeUpdateArena: Benchmarking Knowledge Editing on API Updates
by: Liu, Zeyu Leo, et al.
Published: (2024)
by: Liu, Zeyu Leo, et al.
Published: (2024)
Search-Induced Issues in Web-Augmented LLM Code Generation: Detecting and Repairing Error-Inducing Pages
by: Wang, Guoqing, et al.
Published: (2026)
by: Wang, Guoqing, et al.
Published: (2026)
Learning to Guarantee Type Correctness in Code Generation through Type-Guided Program Synthesis
by: Huang, Zhechong, et al.
Published: (2025)
by: Huang, Zhechong, et al.
Published: (2025)
Bridging the Gap between User Intent and LLM: A Requirement Alignment Approach for Code Generation
by: Li, Jia, et al.
Published: (2026)
by: Li, Jia, et al.
Published: (2026)
Toward Executable Repository-Level Code Generation via Environment Alignment
by: Pan, Ruwei, et al.
Published: (2026)
by: Pan, Ruwei, et al.
Published: (2026)
LAURA: Enhancing Code Review Generation with Context-Enriched Retrieval-Augmented LLM
by: Zhang, Yuxin, et al.
Published: (2025)
by: Zhang, Yuxin, et al.
Published: (2025)
SQL-Commenter: Aligning Large Language Models for SQL Comment Generation with Direct Preference Optimization
by: Yu, Lei, et al.
Published: (2026)
by: Yu, Lei, et al.
Published: (2026)
When Model Editing Meets Service Evolution: A Knowledge-Update Perspective for Service Recommendation
by: Fan, Guodong, et al.
Published: (2026)
by: Fan, Guodong, et al.
Published: (2026)
Towards Better Answers: Automated Stack Overflow Post Updating
by: Mai, Yubo, et al.
Published: (2024)
by: Mai, Yubo, et al.
Published: (2024)
Context-Aware Functional Test Generation via Business Logic Extraction and Adaptation
by: Zhang, Yakun, et al.
Published: (2026)
by: Zhang, Yakun, et al.
Published: (2026)
Persistent Cross-Attempt State Optimization for Repository-Level Code Generation
by: Pan, Ruwei, et al.
Published: (2026)
by: Pan, Ruwei, et al.
Published: (2026)
Back to the Future! Studying Data Cleanness in Defects4J and its Impact on Fault Localization
by: Rafi, Md Nakhla, et al.
Published: (2023)
by: Rafi, Md Nakhla, et al.
Published: (2023)
Clean Code In Practice: Challenges and Opportunities
by: Yan, Dapeng, et al.
Published: (2025)
by: Yan, Dapeng, et al.
Published: (2025)
Improving Retrieval-Augmented Code Comment Generation by Retrieving for Generation
by: Lu, Hanzhen, et al.
Published: (2024)
by: Lu, Hanzhen, et al.
Published: (2024)
Tree-of-Code: A Hybrid Approach for Robust Complex Task Planning and Execution
by: Ni, Ziyi, et al.
Published: (2024)
by: Ni, Ziyi, et al.
Published: (2024)
MuMuTestUp: Mutation-based Multi-Agent Test Case Update
by: Tian, Dawei, et al.
Published: (2026)
by: Tian, Dawei, et al.
Published: (2026)
Self-Organizing Multi-Agent Systems for Continuous Software Development
by: Lyu, Wenhan, et al.
Published: (2026)
by: Lyu, Wenhan, et al.
Published: (2026)
VulnResolver: A Hybrid Agent Framework for LLM-Based Automated Vulnerability Issue Resolution
by: Zhang, Mingming, et al.
Published: (2026)
by: Zhang, Mingming, et al.
Published: (2026)
Similar Items
-
Directional Diffusion-Style Code Editing Pre-training
by: Liang, Qingyuan, et al.
Published: (2025) -
Contextualized Code Pretraining for Code Generation
by: Liu, Chen, et al.
Published: (2026) -
Automatically Learning a Precise Measurement for Fault Diagnosis Capability of Test Cases
by: Zhao, Yifan, et al.
Published: (2025) -
Lyra: A Benchmark for Turducken-Style Code Generation
by: Liang, Qingyuan, et al.
Published: (2021) -
Toward Functional and Non-Functional Evaluation of Application-Level Code Generation
by: Pan, Ruwei, et al.
Published: (2026)