Automatically Testing Functional Properties of Code Translation Models
Fuente:
arXiv
Guardado en:
| Autores principales: | Eniser, Hasan Ferit, Wüstholz, Valentin, Christakis, Maria |
|---|---|
| Formato: | Preprint |
| Publicado: |
2023
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Arguzz: Testing zkVMs for Soundness and Completeness Bugs
por: Hochrainer, Christoph, et al.
Publicado: (2025)
por: Hochrainer, Christoph, et al.
Publicado: (2025)
Fuzzing Processing Pipelines for Zero-Knowledge Circuits
por: Hochrainer, Christoph, et al.
Publicado: (2024)
por: Hochrainer, Christoph, et al.
Publicado: (2024)
Towards Translating Real-World Code with LLMs: A Study of Translating to Rust
por: Eniser, Hasan Ferit, et al.
Publicado: (2024)
por: Eniser, Hasan Ferit, et al.
Publicado: (2024)
Assured Automatic Programming via Large Language Models
por: Mirchev, Martin, et al.
Publicado: (2024)
por: Mirchev, Martin, et al.
Publicado: (2024)
Language Models for Code Completion: A Practical Evaluation
por: Izadi, Maliheh, et al.
Publicado: (2024)
por: Izadi, Maliheh, et al.
Publicado: (2024)
Large Language Models for Code: Security Hardening and Adversarial Testing
por: He, Jingxuan, et al.
Publicado: (2023)
por: He, Jingxuan, et al.
Publicado: (2023)
Large Language Models for Multilingual Code Intelligence: A Survey
por: Jiang, Chao, et al.
Publicado: (2026)
por: Jiang, Chao, et al.
Publicado: (2026)
FlakyGuard: Automatically Fixing Flaky Tests at Industry Scale
por: Li, Chengpeng, et al.
Publicado: (2025)
por: Li, Chengpeng, et al.
Publicado: (2025)
SIMCOPILOT: Evaluating Large Language Models for Copilot-Style Code Generation
por: Jiang, Mingchao, et al.
Publicado: (2025)
por: Jiang, Mingchao, et al.
Publicado: (2025)
Incoherence as Oracle-less Measure of Error in LLM-Based Code Generation
por: Valentin, Thomas, et al.
Publicado: (2025)
por: Valentin, Thomas, et al.
Publicado: (2025)
Neural Models for Source Code Synthesis and Completion
por: Niyogi, Mitodru
Publicado: (2024)
por: Niyogi, Mitodru
Publicado: (2024)
Constrained Decoding for Fill-in-the-Middle Code Language Models via Efficient Left and Right Quotienting of Context-Sensitive Grammars
por: Melcer, Daniel, et al.
Publicado: (2024)
por: Melcer, Daniel, et al.
Publicado: (2024)
Correctness-Guaranteed Code Generation via Constrained Decoding
por: Li, Lingxiao, et al.
Publicado: (2025)
por: Li, Lingxiao, et al.
Publicado: (2025)
Detecting Buggy Contracts via Smart Testing
por: Wang, Sally Junsong, et al.
Publicado: (2024)
por: Wang, Sally Junsong, et al.
Publicado: (2024)
Finding Missed Code Size Optimizations in Compilers using LLMs
por: Italiano, Davide, et al.
Publicado: (2024)
por: Italiano, Davide, et al.
Publicado: (2024)
Grounding Data Science Code Generation with Input-Output Specifications
por: Wen, Yeming, et al.
Publicado: (2024)
por: Wen, Yeming, et al.
Publicado: (2024)
NExT: Teaching Large Language Models to Reason about Code Execution
por: Ni, Ansong, et al.
Publicado: (2024)
por: Ni, Ansong, et al.
Publicado: (2024)
Coeditor: Leveraging Contextual Changes for Multi-round Code Auto-editing
por: Wei, Jiayi, et al.
Publicado: (2023)
por: Wei, Jiayi, et al.
Publicado: (2023)
GraphMend: Code Transformations for Fixing Graph Breaks in PyTorch 2
por: Kashmira, Savini, et al.
Publicado: (2025)
por: Kashmira, Savini, et al.
Publicado: (2025)
MLCPD: A Unified Multi-Language Code Parsing Dataset with Universal AST Schema
por: Gajjar, Jugal, et al.
Publicado: (2025)
por: Gajjar, Jugal, et al.
Publicado: (2025)
Top Leaderboard Ranking = Top Coding Proficiency, Always? EvoEval: Evolving Coding Benchmarks via LLM
por: Xia, Chunqiu Steven, et al.
Publicado: (2024)
por: Xia, Chunqiu Steven, et al.
Publicado: (2024)
MonoCoder: Domain-Specific Code Language Model for HPC Codes and Tasks
por: Kadosh, Tal, et al.
Publicado: (2023)
por: Kadosh, Tal, et al.
Publicado: (2023)
Large Language Models for Code Summarization
por: Szalontai, Balázs, et al.
Publicado: (2024)
por: Szalontai, Balázs, et al.
Publicado: (2024)
CoCoST: Automatic Complex Code Generation with Online Searching and Correctness Testing
por: He, Xinyi, et al.
Publicado: (2024)
por: He, Xinyi, et al.
Publicado: (2024)
A Multi-Perspective Architecture for Semantic Code Search
por: Haldar, Rajarshi, et al.
Publicado: (2020)
por: Haldar, Rajarshi, et al.
Publicado: (2020)
Do Large Code Models Understand Programming Concepts? Counterfactual Analysis for Code Predicates
por: Hooda, Ashish, et al.
Publicado: (2024)
por: Hooda, Ashish, et al.
Publicado: (2024)
A Joint Learning Model with Variational Interaction for Multilingual Program Translation
por: Du, Yali, et al.
Publicado: (2024)
por: Du, Yali, et al.
Publicado: (2024)
SwiftEval: Developing a Language-Specific Benchmark for LLM-generated Code Evaluation
por: Petrukha, Ivan, et al.
Publicado: (2025)
por: Petrukha, Ivan, et al.
Publicado: (2025)
Guess & Sketch: Language Model Guided Transpilation
por: Lee, Celine, et al.
Publicado: (2023)
por: Lee, Celine, et al.
Publicado: (2023)
APRIL: API Synthesis with Automatic Prompt Optimization and Reinforcement Learning
por: Zhong, Hua, et al.
Publicado: (2025)
por: Zhong, Hua, et al.
Publicado: (2025)
$\textbf{PLUM}$: Improving Code LMs with Execution-Guided On-Policy Preference Learning Driven By Synthetic Test Cases
por: Zhang, Dylan, et al.
Publicado: (2024)
por: Zhang, Dylan, et al.
Publicado: (2024)
PerfRL: A Small Language Model Framework for Efficient Code Optimization
por: Duan, Shukai, et al.
Publicado: (2023)
por: Duan, Shukai, et al.
Publicado: (2023)
DeepCode AI Fix: Fixing Security Vulnerabilities with Large Language Models
por: Berabi, Berkay, et al.
Publicado: (2024)
por: Berabi, Berkay, et al.
Publicado: (2024)
A Multi-Expert Large Language Model Architecture for Verilog Code Generation
por: Nadimi, Bardia, et al.
Publicado: (2024)
por: Nadimi, Bardia, et al.
Publicado: (2024)
WhiteFox: White-Box Compiler Fuzzing Empowered by Large Language Models
por: Yang, Chenyuan, et al.
Publicado: (2023)
por: Yang, Chenyuan, et al.
Publicado: (2023)
Shedding Light in Task Decomposition in Program Synthesis: The Driving Force of the Synthesizer Model
por: Zenkner, Janis, et al.
Publicado: (2025)
por: Zenkner, Janis, et al.
Publicado: (2025)
Bootstrapping Fuzzers for Compilers of Low-Resource Language Dialects Using Language Models
por: Vaidya, Sairam, et al.
Publicado: (2025)
por: Vaidya, Sairam, et al.
Publicado: (2025)
MoTCoder: Elevating Large Language Models with Modular of Thought for Challenging Programming Tasks
por: Li, Jingyao, et al.
Publicado: (2023)
por: Li, Jingyao, et al.
Publicado: (2023)
Can It Edit? Evaluating the Ability of Large Language Models to Follow Code Editing Instructions
por: Cassano, Federico, et al.
Publicado: (2023)
por: Cassano, Federico, et al.
Publicado: (2023)
JavaBench: A Benchmark of Object-Oriented Code Generation for Evaluating Large Language Models
por: Cao, Jialun, et al.
Publicado: (2024)
por: Cao, Jialun, et al.
Publicado: (2024)
Ejemplares similares
-
Arguzz: Testing zkVMs for Soundness and Completeness Bugs
por: Hochrainer, Christoph, et al.
Publicado: (2025) -
Fuzzing Processing Pipelines for Zero-Knowledge Circuits
por: Hochrainer, Christoph, et al.
Publicado: (2024) -
Towards Translating Real-World Code with LLMs: A Study of Translating to Rust
por: Eniser, Hasan Ferit, et al.
Publicado: (2024) -
Assured Automatic Programming via Large Language Models
por: Mirchev, Martin, et al.
Publicado: (2024) -
Language Models for Code Completion: A Practical Evaluation
por: Izadi, Maliheh, et al.
Publicado: (2024)