Can Large Language Models Help Students Prove Software Correctness? An Experimental Study with Dafny
Fuente:
arXiv
Saved in:
| Main Authors: | Carreira, Carolina, Silva, Álvaro, Abreu, Alexandre, Mendes, Alexandra |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Specification-Guided Repair of Arithmetic Errors in Dafny Programs using LLMs
by: Wu, Valentina, et al.
Published: (2025)
by: Wu, Valentina, et al.
Published: (2025)
Leveraging Large Language Models to Boost Dafny's Developers Productivity
by: Silva, Álvaro, et al.
Published: (2024)
by: Silva, Álvaro, et al.
Published: (2024)
MutDafny: A Mutation-Based Approach to Assess Dafny Specifications
by: Amaral, Isabel, et al.
Published: (2025)
by: Amaral, Isabel, et al.
Published: (2025)
What Challenges Do Developers Face When Using Verification-Aware Programming Languages?
by: Oliveira, Francisco, et al.
Published: (2025)
by: Oliveira, Francisco, et al.
Published: (2025)
Inferring multiple helper Dafny assertions with LLMs
by: Silva, Álvaro, et al.
Published: (2025)
by: Silva, Álvaro, et al.
Published: (2025)
Towards AI-Assisted Synthesis of Verified Dafny Methods
by: Misu, Md Rakib Hossain, et al.
Published: (2024)
by: Misu, Md Rakib Hossain, et al.
Published: (2024)
DafnyBench: A Benchmark for Formal Software Verification
by: Loughridge, Chloe, et al.
Published: (2024)
by: Loughridge, Chloe, et al.
Published: (2024)
dafny-annotator: AI-Assisted Verification of Dafny Programs
by: Poesia, Gabriel, et al.
Published: (2024)
by: Poesia, Gabriel, et al.
Published: (2024)
Beyond Postconditions: Can Large Language Models infer Formal Contracts for Automatic Software Verification?
by: Richter, Cedric, et al.
Published: (2025)
by: Richter, Cedric, et al.
Published: (2025)
Can Large Language Models Simulate Symbolic Execution Output Like KLEE?
by: Feng, Rong, et al.
Published: (2025)
by: Feng, Rong, et al.
Published: (2025)
Dafny as Verification-Aware Intermediate Language for Code Generation
by: Li, Yue Chen, et al.
Published: (2025)
by: Li, Yue Chen, et al.
Published: (2025)
Language-Driven Engineering An Interdisciplinary Software Development Paradigm
by: Steffen, Bernhard, et al.
Published: (2024)
by: Steffen, Bernhard, et al.
Published: (2024)
Can Large Language Models Transform Natural Language Intent into Formal Method Postconditions?
by: Endres, Madeline, et al.
Published: (2023)
by: Endres, Madeline, et al.
Published: (2023)
A Roadmap for Tamed Interactions with Large Language Models
by: Scotti, Vincenzo, et al.
Published: (2025)
by: Scotti, Vincenzo, et al.
Published: (2025)
LPR: Large Language Models-Aided Program Reduction
by: Zhang, Mengxiao, et al.
Published: (2023)
by: Zhang, Mengxiao, et al.
Published: (2023)
LPO: Discovering Missed Peephole Optimizations with Large Language Models
by: Xu, Zhenyang, et al.
Published: (2025)
by: Xu, Zhenyang, et al.
Published: (2025)
Enhancing Translation Validation of Compiler Transformations with Large Language Models
by: Wang, Yanzhao, et al.
Published: (2024)
by: Wang, Yanzhao, et al.
Published: (2024)
SWE-QA: Can Language Models Answer Repository-level Code Questions?
by: Peng, Weihan, et al.
Published: (2025)
by: Peng, Weihan, et al.
Published: (2025)
How Natural Language Proficiency Shapes GenAI Code for Software Engineering Tasks
by: Rojpaisarnkit, Ruksit, et al.
Published: (2025)
by: Rojpaisarnkit, Ruksit, et al.
Published: (2025)
Strengthening Programming Comprehension in Large Language Models through Code Generation
by: Ren, Xiaoning, et al.
Published: (2025)
by: Ren, Xiaoning, et al.
Published: (2025)
Floating-Point Usage on GitHub: A Large-Scale Study of Statically Typed Languages
by: Gilot, Andrea, et al.
Published: (2025)
by: Gilot, Andrea, et al.
Published: (2025)
Software Model Checking via Summary-Guided Search (Extended Version)
by: Fang, Ruijie, et al.
Published: (2025)
by: Fang, Ruijie, et al.
Published: (2025)
LLMigrate: Transforming "Lazy" Large Language Models into Efficient Source Code Migrators
by: Liu, Yuchen, et al.
Published: (2025)
by: Liu, Yuchen, et al.
Published: (2025)
Fully Automated Generation of Combinatorial Optimisation Systems Using Large Language Models
by: Karapetyan, Daniel
Published: (2025)
by: Karapetyan, Daniel
Published: (2025)
Scalable, Validated Code Translation of Entire Projects using Large Language Models
by: Zhang, Hanliang, et al.
Published: (2024)
by: Zhang, Hanliang, et al.
Published: (2024)
ViScratch: Using Large Language Models and Gameplay Videos for Automated Feedback in Scratch
by: Si, Yuan, et al.
Published: (2025)
by: Si, Yuan, et al.
Published: (2025)
VERT: Verified Equivalent Rust Transpilation with Large Language Models as Few-Shot Learners
by: Yang, Aidan Z. H., et al.
Published: (2024)
by: Yang, Aidan Z. H., et al.
Published: (2024)
COBOL-Coder: Domain-Adapted Large Language Models for COBOL Code Generation and Translation
by: Dau, Anh T. V., et al.
Published: (2026)
by: Dau, Anh T. V., et al.
Published: (2026)
Search-Based Multi-Trajectory Refinement for Safe C-to-Rust Translation with Large Language Models
by: Sim, HoHyun, et al.
Published: (2025)
by: Sim, HoHyun, et al.
Published: (2025)
DeCon: Detecting Incorrect Assertions via Postconditions Generated by a Large Language Model
by: Yu, Hao, et al.
Published: (2025)
by: Yu, Hao, et al.
Published: (2025)
From Effectiveness to Efficiency: Uncovering Linguistic Bias in Large Language Model-based Code Generation
by: Jiang, Weipeng, et al.
Published: (2024)
by: Jiang, Weipeng, et al.
Published: (2024)
Generalized Software Product Line Extraction
by: Bruzzone, Federico, et al.
Published: (2026)
by: Bruzzone, Federico, et al.
Published: (2026)
iScript: A Domain-Adapted Large Language Model and Benchmark for Physical Design Tcl Script Generation
by: Xu, Ning, et al.
Published: (2026)
by: Xu, Ning, et al.
Published: (2026)
Semantic Source Code Segmentation using Small and Large Language Models
by: Dahou, Abdelhalim, et al.
Published: (2025)
by: Dahou, Abdelhalim, et al.
Published: (2025)
Efficient Symbolic Execution of Software under Fault Attacks
by: Fang, Yuzhou, et al.
Published: (2025)
by: Fang, Yuzhou, et al.
Published: (2025)
Catalpa: GC for a Low-Variance Software Stack
by: Arnold, Anthony, et al.
Published: (2025)
by: Arnold, Anthony, et al.
Published: (2025)
Correctness Witnesses with Function Contracts
by: Heizmann, Matthias, et al.
Published: (2025)
by: Heizmann, Matthias, et al.
Published: (2025)
Caruca: Effective and Efficient Specification Mining for Opaque Software Components
by: Lamprou, Evangelos, et al.
Published: (2025)
by: Lamprou, Evangelos, et al.
Published: (2025)
Local Software Buildability across Java Versions (Registered Report)
by: Sulír, Matúš, et al.
Published: (2024)
by: Sulír, Matúš, et al.
Published: (2024)
Conceptual Mutation Testing for Student Programming Misconceptions
by: Prasad, Siddhartha, et al.
Published: (2023)
by: Prasad, Siddhartha, et al.
Published: (2023)
Similar Items
-
Specification-Guided Repair of Arithmetic Errors in Dafny Programs using LLMs
by: Wu, Valentina, et al.
Published: (2025) -
Leveraging Large Language Models to Boost Dafny's Developers Productivity
by: Silva, Álvaro, et al.
Published: (2024) -
MutDafny: A Mutation-Based Approach to Assess Dafny Specifications
by: Amaral, Isabel, et al.
Published: (2025) -
What Challenges Do Developers Face When Using Verification-Aware Programming Languages?
by: Oliveira, Francisco, et al.
Published: (2025) -
Inferring multiple helper Dafny assertions with LLMs
by: Silva, Álvaro, et al.
Published: (2025)