ChangeGuard: Validating Code Changes via Pairwise Learning-Guided Execution
Fuente:
arXiv
Guardado en:
| Autores principales: | Gröninger, Lars, Souza, Beatriz, Pradel, Michael |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Treefix: Enabling Execution with a Tree of Prefixes
por: Souza, Beatriz, et al.
Publicado: (2025)
por: Souza, Beatriz, et al.
Publicado: (2025)
RippleGUItester: Change-Aware Exploratory Testing
por: Su, Yanqi, et al.
Publicado: (2026)
por: Su, Yanqi, et al.
Publicado: (2026)
De-Hallucinator: Mitigating LLM Hallucinations in Code Generation Tasks via Iterative Grounding
por: Eghbali, Aryaz, et al.
Publicado: (2024)
por: Eghbali, Aryaz, et al.
Publicado: (2024)
CodeMapper: A Language-Agnostic Approach to Mapping Code Regions Across Commits
por: Hu, Huimin, et al.
Publicado: (2025)
por: Hu, Huimin, et al.
Publicado: (2025)
Change And Cover: Last-Mile, Pull Request-Based Regression Test Augmentation
por: Zhou, Zitong, et al.
Publicado: (2026)
por: Zhou, Zitong, et al.
Publicado: (2026)
DyPyBench: A Benchmark of Executable Python Software
por: Bouzenia, Islem, et al.
Publicado: (2024)
por: Bouzenia, Islem, et al.
Publicado: (2024)
You Name It, I Run It: An LLM Agent to Execute Tests of Arbitrary Projects
por: Bouzenia, Islem, et al.
Publicado: (2024)
por: Bouzenia, Islem, et al.
Publicado: (2024)
FlyCatcher: Neural Inference of Runtime Checkers from Tests
por: Souza, Beatriz, et al.
Publicado: (2026)
por: Souza, Beatriz, et al.
Publicado: (2026)
Testora: Using Natural Language Intent to Detect Behavioral Regressions
por: Pradel, Michael
Publicado: (2025)
por: Pradel, Michael
Publicado: (2025)
Execution-Aware Program Reduction for WebAssembly via Record and Replay
por: Baek, Doehyun, et al.
Publicado: (2025)
por: Baek, Doehyun, et al.
Publicado: (2025)
Understanding Code Change with Micro-Changes
por: Chen, Lei, et al.
Publicado: (2024)
por: Chen, Lei, et al.
Publicado: (2024)
Artisan: Agentic Artifact Evaluation
por: Baek, Doehyun, et al.
Publicado: (2026)
por: Baek, Doehyun, et al.
Publicado: (2026)
ChangePrism: Visualizing the Essence of Code Changes
por: Chen, Lei, et al.
Publicado: (2025)
por: Chen, Lei, et al.
Publicado: (2025)
CodeCureAgent: Automatic Classification and Repair of Static Analysis Warnings
por: Joos, Pascal, et al.
Publicado: (2025)
por: Joos, Pascal, et al.
Publicado: (2025)
NoCode-bench: A Benchmark for Evaluating Natural Language-Driven Feature Addition
por: Deng, Le, et al.
Publicado: (2025)
por: Deng, Le, et al.
Publicado: (2025)
CodeScore: Evaluating Code Generation by Learning Code Execution
por: Dong, Yihong, et al.
Publicado: (2023)
por: Dong, Yihong, et al.
Publicado: (2023)
Changes in Coding Behavior and Performance Since the Introduction of LLMs
por: Zhang, Yufan, et al.
Publicado: (2026)
por: Zhang, Yufan, et al.
Publicado: (2026)
Evaluating LLM Agents on Automated Software Analysis Tasks
por: Bouzenia, Islem, et al.
Publicado: (2026)
por: Bouzenia, Islem, et al.
Publicado: (2026)
Are "Solved Issues" in SWE-bench Really Solved Correctly? An Empirical Study
por: Wang, You, et al.
Publicado: (2025)
por: Wang, You, et al.
Publicado: (2025)
Names Are All You Need: Effective and Safe Regression Test Selection for Python
por: Wang, You, et al.
Publicado: (2026)
por: Wang, You, et al.
Publicado: (2026)
SelfPiCo: Self-Guided Partial Code Execution with LLMs
por: Xue, Zhipeng, et al.
Publicado: (2024)
por: Xue, Zhipeng, et al.
Publicado: (2024)
Large Language Model Critics for Execution-Free Evaluation of Code Changes
por: Yadavally, Aashish, et al.
Publicado: (2025)
por: Yadavally, Aashish, et al.
Publicado: (2025)
Understanding Software Engineering Agents: A Study of Thought-Action-Result Trajectories
por: Bouzenia, Islem, et al.
Publicado: (2025)
por: Bouzenia, Islem, et al.
Publicado: (2025)
AgentStepper: Interactive Debugging of Software Development Agents
por: Hutter, Robert, et al.
Publicado: (2026)
por: Hutter, Robert, et al.
Publicado: (2026)
Delving into Parameter-Efficient Fine-Tuning in Code Change Learning: An Empirical Study
por: Liu, Shuo, et al.
Publicado: (2024)
por: Liu, Shuo, et al.
Publicado: (2024)
Exploring the Capabilities of LLMs for Code Change Related Tasks
por: Fan, Lishui, et al.
Publicado: (2024)
por: Fan, Lishui, et al.
Publicado: (2024)
Information-Theoretic Detection of Unusual Source Code Changes
por: Torres, Adriano, et al.
Publicado: (2025)
por: Torres, Adriano, et al.
Publicado: (2025)
LLM Security Guard for Code
por: Kavian, Arya, et al.
Publicado: (2024)
por: Kavian, Arya, et al.
Publicado: (2024)
VFDelta: A Framework for Detecting Silent Vulnerability Fixes by Enhancing Code Change Learning
por: Yang, Xu, et al.
Publicado: (2024)
por: Yang, Xu, et al.
Publicado: (2024)
Analyzing Quantum Programs with LintQ: A Static Analysis Framework for Qiskit
por: Paltenghi, Matteo, et al.
Publicado: (2023)
por: Paltenghi, Matteo, et al.
Publicado: (2023)
PyTy: Repairing Static Type Errors in Python
por: Chow, Yiu Wai, et al.
Publicado: (2024)
por: Chow, Yiu Wai, et al.
Publicado: (2024)
Issue2Test: Generating Reproducing Test Cases from Issue Reports
por: Nashid, Noor, et al.
Publicado: (2025)
por: Nashid, Noor, et al.
Publicado: (2025)
Unprecedented Code Change Automation: The Fusion of LLMs and Transformation by Example
por: Dilhara, Malinda, et al.
Publicado: (2024)
por: Dilhara, Malinda, et al.
Publicado: (2024)
Compiling Code LLMs into Lightweight Executables
por: Shi, Jieke, et al.
Publicado: (2026)
por: Shi, Jieke, et al.
Publicado: (2026)
Identifying Inaccurate Descriptions in LLM-generated Code Comments via Test Execution
por: Kang, Sungmin, et al.
Publicado: (2024)
por: Kang, Sungmin, et al.
Publicado: (2024)
Analyzing Dependency Distribution Changes Arising from Code Smell Interactions
por: Zhang, Zushuai, et al.
Publicado: (2025)
por: Zhang, Zushuai, et al.
Publicado: (2025)
Fine-grained Multi-Document Extraction and Generation of Code Change Rationale
por: Sun, Mehedi, et al.
Publicado: (2026)
por: Sun, Mehedi, et al.
Publicado: (2026)
StepCodeReasoner: Aligning Code Reasoning with Stepwise Execution Traces via Reinforcement Learning
por: Wang, Hao, et al.
Publicado: (2026)
por: Wang, Hao, et al.
Publicado: (2026)
VisualCoder: Guiding Large Language Models in Code Execution with Fine-grained Multimodal Chain-of-Thought Reasoning
por: Le, Cuong Chi, et al.
Publicado: (2024)
por: Le, Cuong Chi, et al.
Publicado: (2024)
SemGuard: Real-Time Semantic Evaluator for Correcting LLM-Generated Code
por: Wang, Qinglin, et al.
Publicado: (2025)
por: Wang, Qinglin, et al.
Publicado: (2025)
Ejemplares similares
-
Treefix: Enabling Execution with a Tree of Prefixes
por: Souza, Beatriz, et al.
Publicado: (2025) -
RippleGUItester: Change-Aware Exploratory Testing
por: Su, Yanqi, et al.
Publicado: (2026) -
De-Hallucinator: Mitigating LLM Hallucinations in Code Generation Tasks via Iterative Grounding
por: Eghbali, Aryaz, et al.
Publicado: (2024) -
CodeMapper: A Language-Agnostic Approach to Mapping Code Regions Across Commits
por: Hu, Huimin, et al.
Publicado: (2025) -
Change And Cover: Last-Mile, Pull Request-Based Regression Test Augmentation
por: Zhou, Zitong, et al.
Publicado: (2026)