What can Large Language Models Capture about Code Functional Equivalence?
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Maveli, Nickil, Vergari, Antonio, Cohen, Shay B. |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2024
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Can LLMs Compress (and Decompress)? Evaluating Code Understanding and Execution via Invertibility
von: Maveli, Nickil, et al.
Veröffentlicht: (2026)
von: Maveli, Nickil, et al.
Veröffentlicht: (2026)
EquiBench: Benchmarking Large Language Models' Reasoning about Program Semantics via Equivalence Checking
von: Wei, Anjiang, et al.
Veröffentlicht: (2025)
von: Wei, Anjiang, et al.
Veröffentlicht: (2025)
CodeEditorBench: Evaluating Code Editing Capability of Large Language Models
von: Guo, Jiawei, et al.
Veröffentlicht: (2024)
von: Guo, Jiawei, et al.
Veröffentlicht: (2024)
code_transformed: The Influence of Large Language Models on Code
von: Xu, Yuliang, et al.
Veröffentlicht: (2025)
von: Xu, Yuliang, et al.
Veröffentlicht: (2025)
CODEMENV: Benchmarking Large Language Models on Code Migration
von: Cheng, Keyuan, et al.
Veröffentlicht: (2025)
von: Cheng, Keyuan, et al.
Veröffentlicht: (2025)
CodeVisionary: An Agent-based Framework for Evaluating Large Language Models in Code Generation
von: Wang, Xinchen, et al.
Veröffentlicht: (2025)
von: Wang, Xinchen, et al.
Veröffentlicht: (2025)
Investigating the Efficacy of Large Language Models for Code Clone Detection
von: Khajezade, Mohamad, et al.
Veröffentlicht: (2024)
von: Khajezade, Mohamad, et al.
Veröffentlicht: (2024)
DDPT: Diffusion-Driven Prompt Tuning for Large Language Model Code Generation
von: Li, Jinyang, et al.
Veröffentlicht: (2025)
von: Li, Jinyang, et al.
Veröffentlicht: (2025)
Large Language Models for Code Summarization
von: Szalontai, Balázs, et al.
Veröffentlicht: (2024)
von: Szalontai, Balázs, et al.
Veröffentlicht: (2024)
Regression Language Models for Code
von: Akhauri, Yash, et al.
Veröffentlicht: (2025)
von: Akhauri, Yash, et al.
Veröffentlicht: (2025)
HGAdapter: Hypergraph-based Adapters in Language Models for Code Summarization and Clone Detection
von: Yang, Guang, et al.
Veröffentlicht: (2025)
von: Yang, Guang, et al.
Veröffentlicht: (2025)
CodeAttack: Revealing Safety Generalization Challenges of Large Language Models via Code Completion
von: Ren, Qibing, et al.
Veröffentlicht: (2024)
von: Ren, Qibing, et al.
Veröffentlicht: (2024)
Applying Large Language Models API to Issue Classification Problem
von: Aracena, Gabriel, et al.
Veröffentlicht: (2024)
von: Aracena, Gabriel, et al.
Veröffentlicht: (2024)
Improving Code Generation by Training with Natural Language Feedback
von: Chen, Angelica, et al.
Veröffentlicht: (2023)
von: Chen, Angelica, et al.
Veröffentlicht: (2023)
RovoDev Code Reviewer: A Large-Scale Online Evaluation of LLM-based Code Review Automation at Atlassian
von: Tantithamthavorn, Kla, et al.
Veröffentlicht: (2026)
von: Tantithamthavorn, Kla, et al.
Veröffentlicht: (2026)
The Impact of Fine-tuning Large Language Models on Automated Program Repair
von: Macháček, Roman, et al.
Veröffentlicht: (2025)
von: Macháček, Roman, et al.
Veröffentlicht: (2025)
LLMEffiChecker: Understanding and Testing Efficiency Degradation of Large Language Models
von: Feng, Xiaoning, et al.
Veröffentlicht: (2022)
von: Feng, Xiaoning, et al.
Veröffentlicht: (2022)
Evaluating the Formal Reasoning Capabilities of Large Language Models through Chomsky Hierarchy
von: Dong, Yihong, et al.
Veröffentlicht: (2026)
von: Dong, Yihong, et al.
Veröffentlicht: (2026)
Automated Factual Benchmarking for In-Car Conversational Systems using Large Language Models
von: Giebisch, Rafael, et al.
Veröffentlicht: (2025)
von: Giebisch, Rafael, et al.
Veröffentlicht: (2025)
CodeSteer: Symbolic-Augmented Language Models via Code/Text Guidance
von: Chen, Yongchao, et al.
Veröffentlicht: (2025)
von: Chen, Yongchao, et al.
Veröffentlicht: (2025)
NoFunEval: Funny How Code LMs Falter on Requirements Beyond Functional Correctness
von: Singhal, Manav, et al.
Veröffentlicht: (2024)
von: Singhal, Manav, et al.
Veröffentlicht: (2024)
REFLEX: Reference-Free Evaluation of Log Summarization via Large Language Model Judgment
von: Mudgal, Priyanka
Veröffentlicht: (2025)
von: Mudgal, Priyanka
Veröffentlicht: (2025)
KOCO-BENCH: Can Large Language Models Leverage Domain Knowledge in Software Development?
von: Jiang, Xue, et al.
Veröffentlicht: (2026)
von: Jiang, Xue, et al.
Veröffentlicht: (2026)
Code to Think, Think to Code: A Survey on Code-Enhanced Reasoning and Reasoning-Driven Code Intelligence in LLMs
von: Yang, Dayu, et al.
Veröffentlicht: (2025)
von: Yang, Dayu, et al.
Veröffentlicht: (2025)
A Multi-Expert Large Language Model Architecture for Verilog Code Generation
von: Nadimi, Bardia, et al.
Veröffentlicht: (2024)
von: Nadimi, Bardia, et al.
Veröffentlicht: (2024)
What Is Wrong with My Model? Identifying Systematic Problems with Semantic Data Slicing
von: Yang, Chenyang, et al.
Veröffentlicht: (2024)
von: Yang, Chenyang, et al.
Veröffentlicht: (2024)
CodeKGC: Code Language Model for Generative Knowledge Graph Construction
von: Bi, Zhen, et al.
Veröffentlicht: (2023)
von: Bi, Zhen, et al.
Veröffentlicht: (2023)
ReCode: Reinforcing Code Generation with Reasoning-Process Rewards
von: Fan, Lishui, et al.
Veröffentlicht: (2025)
von: Fan, Lishui, et al.
Veröffentlicht: (2025)
Can It Edit? Evaluating the Ability of Large Language Models to Follow Code Editing Instructions
von: Cassano, Federico, et al.
Veröffentlicht: (2023)
von: Cassano, Federico, et al.
Veröffentlicht: (2023)
Let the Code LLM Edit Itself When You Edit the Code
von: He, Zhenyu, et al.
Veröffentlicht: (2024)
von: He, Zhenyu, et al.
Veröffentlicht: (2024)
JavaBench: A Benchmark of Object-Oriented Code Generation for Evaluating Large Language Models
von: Cao, Jialun, et al.
Veröffentlicht: (2024)
von: Cao, Jialun, et al.
Veröffentlicht: (2024)
NExT: Teaching Large Language Models to Reason about Code Execution
von: Ni, Ansong, et al.
Veröffentlicht: (2024)
von: Ni, Ansong, et al.
Veröffentlicht: (2024)
How Do Your Code LLMs Perform? Empowering Code Instruction Tuning with High-Quality Data
von: Wang, Yejie, et al.
Veröffentlicht: (2024)
von: Wang, Yejie, et al.
Veröffentlicht: (2024)
Selective Prompt Anchoring for Code Generation
von: Tian, Yuan, et al.
Veröffentlicht: (2024)
von: Tian, Yuan, et al.
Veröffentlicht: (2024)
Do Large Code Models Understand Programming Concepts? Counterfactual Analysis for Code Predicates
von: Hooda, Ashish, et al.
Veröffentlicht: (2024)
von: Hooda, Ashish, et al.
Veröffentlicht: (2024)
MonoCoder: Domain-Specific Code Language Model for HPC Codes and Tasks
von: Kadosh, Tal, et al.
Veröffentlicht: (2023)
von: Kadosh, Tal, et al.
Veröffentlicht: (2023)
Scaling Test-Time Compute for Agentic Coding
von: Kim, Joongwon, et al.
Veröffentlicht: (2026)
von: Kim, Joongwon, et al.
Veröffentlicht: (2026)
Rethinking Repetition Problems of LLMs in Code Generation
von: Dong, Yihong, et al.
Veröffentlicht: (2025)
von: Dong, Yihong, et al.
Veröffentlicht: (2025)
From I/O to Code with Discovery Agent
von: Dong, Yihong, et al.
Veröffentlicht: (2026)
von: Dong, Yihong, et al.
Veröffentlicht: (2026)
Tool Calling is Linearly Readable and Steerable in Language Models
von: Wu, Zekun, et al.
Veröffentlicht: (2026)
von: Wu, Zekun, et al.
Veröffentlicht: (2026)
Ähnliche Einträge
-
Can LLMs Compress (and Decompress)? Evaluating Code Understanding and Execution via Invertibility
von: Maveli, Nickil, et al.
Veröffentlicht: (2026) -
EquiBench: Benchmarking Large Language Models' Reasoning about Program Semantics via Equivalence Checking
von: Wei, Anjiang, et al.
Veröffentlicht: (2025) -
CodeEditorBench: Evaluating Code Editing Capability of Large Language Models
von: Guo, Jiawei, et al.
Veröffentlicht: (2024) -
code_transformed: The Influence of Large Language Models on Code
von: Xu, Yuliang, et al.
Veröffentlicht: (2025) -
CODEMENV: Benchmarking Large Language Models on Code Migration
von: Cheng, Keyuan, et al.
Veröffentlicht: (2025)