Can Large Language Models Model Programs Formally?
Fuente:
arXiv
Saved in:
| Main Authors: | Chen, Zhiyong, Cao, Jialun, Wu, Jiarong, Xu, Chang, Cheung, Shing-Chi |
|---|---|
| Format: | Preprint |
| Published: |
2026
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
JavaBench: A Benchmark of Object-Oriented Code Generation for Evaluating Large Language Models
by: Cao, Jialun, et al.
Published: (2024)
by: Cao, Jialun, et al.
Published: (2024)
Can Emulating Semantic Translation Help LLMs with Code Translation? A Study Based on Pseudocode
by: Chen, Songqiang, et al.
Published: (2025)
by: Chen, Songqiang, et al.
Published: (2025)
ModelWisdom: An Integrated Toolkit for TLA+ Model Visualization, Digest and Repair
by: Chen, Zhiyong, et al.
Published: (2026)
by: Chen, Zhiyong, et al.
Published: (2026)
Concerned with Data Contamination? Assessing Countermeasures in Code Language Model
by: Cao, Jialun, et al.
Published: (2024)
by: Cao, Jialun, et al.
Published: (2024)
Isolating Language-Coding from Problem-Solving: Benchmarking LLMs with PseudoEval
by: Wu, Jiarong, et al.
Published: (2025)
by: Wu, Jiarong, et al.
Published: (2025)
Enchanting Program Specification Synthesis by Large Language Models using Static Analysis and Program Verification
by: Wen, Cheng, et al.
Published: (2024)
by: Wen, Cheng, et al.
Published: (2024)
MR-Adopt: Automatic Deduction of Input Transformation Function for Metamorphic Testing
by: Xu, Congying, et al.
Published: (2024)
by: Xu, Congying, et al.
Published: (2024)
When LLMs Meet API Documentation: Can Retrieval Augmentation Aid Code Generation Just as It Helps Developers?
by: Chen, Jingyi, et al.
Published: (2025)
by: Chen, Jingyi, et al.
Published: (2025)
What Builds Effective In-Context Examples for Code Generation?
by: Li, Dongze, et al.
Published: (2025)
by: Li, Dongze, et al.
Published: (2025)
EmbedAgent: Benchmarking Large Language Models in Embedded System Development
by: Xu, Ruiyang, et al.
Published: (2025)
by: Xu, Ruiyang, et al.
Published: (2025)
ReuseDroid: A VLM-empowered Android UI Test Migrator Boosted by Active Feedback
by: Li, Xiaolei, et al.
Published: (2025)
by: Li, Xiaolei, et al.
Published: (2025)
MR-Scout: Automated Synthesis of Metamorphic Relations from Existing Test Cases
by: Xu, Congying, et al.
Published: (2023)
by: Xu, Congying, et al.
Published: (2023)
Across Programming Language Silos: A Study on Cross-Lingual Retrieval-augmented Code Generation
by: Zhu, Qiming, et al.
Published: (2025)
by: Zhu, Qiming, et al.
Published: (2025)
CODECLEANER: Elevating Standards with A Robust Data Contamination Mitigation Toolkit
by: Cao, Jialun, et al.
Published: (2024)
by: Cao, Jialun, et al.
Published: (2024)
MR-Coupler: Automated Metamorphic Test Generation via Functional Coupling Analysis
by: Xu, Congying, et al.
Published: (2026)
by: Xu, Congying, et al.
Published: (2026)
Understanding and Characterizing Mock Assertions in Unit Tests
by: Zhu, Hengcheng, et al.
Published: (2025)
by: Zhu, Hengcheng, et al.
Published: (2025)
From What to How: Bridging User Requirements with Software Development Using Large Language Models
by: He, Xiao, et al.
Published: (2026)
by: He, Xiao, et al.
Published: (2026)
Automatic Build Repair for Test Cases using Incompatible Java Versions
by: Mak, Ching Hang, et al.
Published: (2024)
by: Mak, Ching Hang, et al.
Published: (2024)
DOMAINEVAL: An Auto-Constructed Benchmark for Multi-Domain Code Generation
by: Zhu, Qiming, et al.
Published: (2024)
by: Zhu, Qiming, et al.
Published: (2024)
COMET: Coverage-guided Model Generation For Deep Learning Library Testing
by: Li, Meiziniu, et al.
Published: (2022)
by: Li, Meiziniu, et al.
Published: (2022)
LSPFuzz: Hunting Bugs in Language Servers
by: Zhu, Hengcheng, et al.
Published: (2025)
by: Zhu, Hengcheng, et al.
Published: (2025)
Word Closure-Based Metamorphic Testing for Machine Translation
by: Xie, Xiaoyuan, et al.
Published: (2023)
by: Xie, Xiaoyuan, et al.
Published: (2023)
RulER: Automated Rule-Based Semantic Error Localization and Repair for Code Translation
by: Jin, Shuo, et al.
Published: (2025)
by: Jin, Shuo, et al.
Published: (2025)
SpecGen: Automated Generation of Formal Program Specifications via Large Language Models
by: Ma, Lezhi, et al.
Published: (2024)
by: Ma, Lezhi, et al.
Published: (2024)
Multi-Agent Systems for Dataset Adaptation in Software Engineering: Capabilities, Limitations, and Future Directions
by: Chen, Jingyi, et al.
Published: (2025)
by: Chen, Jingyi, et al.
Published: (2025)
Exploring the Potential and Limitations of Large Language Models for Novice Program Fault Localization
by: Xu, Hexiang, et al.
Published: (2025)
by: Xu, Hexiang, et al.
Published: (2025)
Can Large Language Models Generate Geospatial Code?
by: Hou, Shuyang, et al.
Published: (2024)
by: Hou, Shuyang, et al.
Published: (2024)
FeedbackEval: A Benchmark for Evaluating Large Language Models in Feedback-Driven Code Repair Tasks
by: Dai, Dekun, et al.
Published: (2025)
by: Dai, Dekun, et al.
Published: (2025)
An Empirical Evaluation of Pre-trained Large Language Models for Repairing Declarative Formal Specifications
by: Alhanahnah, Mohannad, et al.
Published: (2024)
by: Alhanahnah, Mohannad, et al.
Published: (2024)
Enhancing Differential Testing With LLMs For Testing Deep Learning Libraries
by: Li, Meiziniu, et al.
Published: (2024)
by: Li, Meiziniu, et al.
Published: (2024)
Can Large Language Models Serve as Evaluators for Code Summarization?
by: Wu, Yang, et al.
Published: (2024)
by: Wu, Yang, et al.
Published: (2024)
Enhancing Large Language Model Efficiencyvia Symbolic Compression: A Formal Approach Towards Interpretability
by: AI, Lumen, et al.
Published: (2025)
by: AI, Lumen, et al.
Published: (2025)
Formalizing and validating properties in Asmeta with Large Language Models (Extended Abstract)
by: Bombarda, Andrea, et al.
Published: (2026)
by: Bombarda, Andrea, et al.
Published: (2026)
Supporting Software Formal Verification with Large Language Models: An Experimental Study
by: Wang, Weiqi, et al.
Published: (2025)
by: Wang, Weiqi, et al.
Published: (2025)
Towards Understanding the Bugs in Solidity Compiler
by: Ma, Haoyang, et al.
Published: (2024)
by: Ma, Haoyang, et al.
Published: (2024)
Advancing Code Coverage: Incorporating Program Analysis with Large Language Models
by: Yang, Chen, et al.
Published: (2024)
by: Yang, Chen, et al.
Published: (2024)
Planning-Driven Programming: A Large Language Model Programming Workflow
by: Lei, Chao, et al.
Published: (2024)
by: Lei, Chao, et al.
Published: (2024)
Can Large Language Models Transform Natural Language Intent into Formal Method Postconditions?
by: Endres, Madeline, et al.
Published: (2023)
by: Endres, Madeline, et al.
Published: (2023)
Program Slicing in the Era of Large Language Models
by: Shahandashti, Kimya Khakzad, et al.
Published: (2024)
by: Shahandashti, Kimya Khakzad, et al.
Published: (2024)
Can Large Language Models Solve Path Constraints in Symbolic Execution?
by: Wang, Wenhan, et al.
Published: (2025)
by: Wang, Wenhan, et al.
Published: (2025)
Similar Items
-
JavaBench: A Benchmark of Object-Oriented Code Generation for Evaluating Large Language Models
by: Cao, Jialun, et al.
Published: (2024) -
Can Emulating Semantic Translation Help LLMs with Code Translation? A Study Based on Pseudocode
by: Chen, Songqiang, et al.
Published: (2025) -
ModelWisdom: An Integrated Toolkit for TLA+ Model Visualization, Digest and Repair
by: Chen, Zhiyong, et al.
Published: (2026) -
Concerned with Data Contamination? Assessing Countermeasures in Code Language Model
by: Cao, Jialun, et al.
Published: (2024) -
Isolating Language-Coding from Problem-Solving: Benchmarking LLMs with PseudoEval
by: Wu, Jiarong, et al.
Published: (2025)