DafnyBench: A Benchmark for Formal Software Verification
Fuente:
arXiv
Salvato in:
| Autori principali: | Loughridge, Chloe, Sun, Qinyi, Ahrenbach, Seth, Cassano, Federico, Sun, Chuyue, Sheng, Ying, Mudide, Anish, Misu, Md Rakib Hossain, Amin, Nada, Tegmark, Max |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
dafny-annotator: AI-Assisted Verification of Dafny Programs
di: Poesia, Gabriel, et al.
Pubblicazione: (2024)
di: Poesia, Gabriel, et al.
Pubblicazione: (2024)
Towards AI-Assisted Synthesis of Verified Dafny Methods
di: Misu, Md Rakib Hossain, et al.
Pubblicazione: (2024)
di: Misu, Md Rakib Hossain, et al.
Pubblicazione: (2024)
VeriAct: Beyond Verifiability -- Agentic Synthesis of Correct and Complete Formal Specifications
di: Misu, Md Rakib Hossain, et al.
Pubblicazione: (2026)
di: Misu, Md Rakib Hossain, et al.
Pubblicazione: (2026)
Löb-Safe Logics for Reflective Agents
di: Ahrenbach, Seth
Pubblicazione: (2024)
di: Ahrenbach, Seth
Pubblicazione: (2024)
Opening the AI black box: program synthesis via mechanistic interpretability
di: Michaud, Eric J., et al.
Pubblicazione: (2024)
di: Michaud, Eric J., et al.
Pubblicazione: (2024)
Efficient Dictionary Learning with Switch Sparse Autoencoders
di: Mudide, Anish, et al.
Pubblicazione: (2024)
di: Mudide, Anish, et al.
Pubblicazione: (2024)
From Natural Language to Verified Code: Toward AI Assisted Problem-to-Code Generation with Dafny-Based Formal Verification
di: Erfan, Md, et al.
Pubblicazione: (2026)
di: Erfan, Md, et al.
Pubblicazione: (2026)
Test Smell: A Parasitic Energy Consumer in Software Testing
di: Misu, Md Rakib Hossain, et al.
Pubblicazione: (2023)
di: Misu, Md Rakib Hossain, et al.
Pubblicazione: (2023)
DafnyPro: LLM-Assisted Automated Verification for Dafny Programs
di: Banerjee, Debangshu, et al.
Pubblicazione: (2026)
di: Banerjee, Debangshu, et al.
Pubblicazione: (2026)
VerMCTS: Synthesizing Multi-Step Programs using a Verifier, a Large Language Model, and Tree Search
di: Brandfonbrener, David, et al.
Pubblicazione: (2024)
di: Brandfonbrener, David, et al.
Pubblicazione: (2024)
Re:Form -- Reducing Human Priors in Scalable Formal Software Verification with RL in LLMs: A Preliminary Study on Dafny
di: Yan, Chuanhao, et al.
Pubblicazione: (2025)
di: Yan, Chuanhao, et al.
Pubblicazione: (2025)
Formal Verification of a Token Sale Launchpad: A Compositional Approach in Dafny
di: Ukhanov, Evgeny
Pubblicazione: (2025)
di: Ukhanov, Evgeny
Pubblicazione: (2025)
Verification of E-Voting Algorithms in Dafny
di: Büttner, Robert, et al.
Pubblicazione: (2025)
di: Büttner, Robert, et al.
Pubblicazione: (2025)
What's in a Proof? Analyzing Expert Proof-Writing Processes in F* and Verus
di: Jain, Rijul, et al.
Pubblicazione: (2025)
di: Jain, Rijul, et al.
Pubblicazione: (2025)
Library and Information Science Education in Morocco: Observations on a Recent Visit to the "Ecole des Sciences de l'Information" and the "Centre National de Documentation" in Rabat.
di: Loughridge, B.
Pubblicazione: (1987)
di: Loughridge, B.
Pubblicazione: (1987)
Dafny as Verification-Aware Intermediate Language for Code Generation
di: Li, Yue Chen, et al.
Pubblicazione: (2025)
di: Li, Yue Chen, et al.
Pubblicazione: (2025)
Toward Automated Validation of Language Model Synthesized Test Cases using Semantic Entropy
di: Taherkhani, Hamed, et al.
Pubblicazione: (2024)
di: Taherkhani, Hamed, et al.
Pubblicazione: (2024)
Detecting Hate and Inflammatory Content in Bengali Memes: A New Multimodal Dataset and Co-Attention Framework
di: Ullah, Rakib, et al.
Pubblicazione: (2026)
di: Ullah, Rakib, et al.
Pubblicazione: (2026)
Derivation and Verification of Array Sorting by Merging, and its Certification in Dafny
di: Carbonell, Juan Pablo, et al.
Pubblicazione: (2025)
di: Carbonell, Juan Pablo, et al.
Pubblicazione: (2025)
Language Models Use Trigonometry to Do Addition
di: Kantamneni, Subhash, et al.
Pubblicazione: (2025)
di: Kantamneni, Subhash, et al.
Pubblicazione: (2025)
A Neural Scaling Law from Lottery Ticket Ensembling
di: Liu, Ziming, et al.
Pubblicazione: (2023)
di: Liu, Ziming, et al.
Pubblicazione: (2023)
The Geometry of Truth: Emergent Linear Structure in Large Language Model Representations of True/False Datasets
di: Marks, Samuel, et al.
Pubblicazione: (2023)
di: Marks, Samuel, et al.
Pubblicazione: (2023)
Language Models Represent Space and Time
di: Gurnee, Wes, et al.
Pubblicazione: (2023)
di: Gurnee, Wes, et al.
Pubblicazione: (2023)
Baking for Dafny: A CakeML Backend for Dafny
di: Nezamabadi, Daniel, et al.
Pubblicazione: (2025)
di: Nezamabadi, Daniel, et al.
Pubblicazione: (2025)
Towards Understanding Distilled Reasoning Models: A Representational Approach
di: Baek, David D., et al.
Pubblicazione: (2025)
di: Baek, David D., et al.
Pubblicazione: (2025)
Automating Formal Verification with Reinforcement Learning and Recursive Inference
di: Tan, Max
Pubblicazione: (2026)
di: Tan, Max
Pubblicazione: (2026)
VLAgeBench: Benchmarking Large Vision-Language Models for Zero-Shot Human Age Estimation
di: Sajib, Rakib Hossain, et al.
Pubblicazione: (2026)
di: Sajib, Rakib Hossain, et al.
Pubblicazione: (2026)
MutDafny: A Mutation-Based Approach to Assess Dafny Specifications
di: Amaral, Isabel, et al.
Pubblicazione: (2025)
di: Amaral, Isabel, et al.
Pubblicazione: (2025)
A New Era in Software Security: Towards Self-Healing Software via Large Language Models and Formal Verification
di: Tihanyi, Norbert, et al.
Pubblicazione: (2023)
di: Tihanyi, Norbert, et al.
Pubblicazione: (2023)
Evaluating Control Protocols for Untrusted AI Agents
di: Kutasov, Jon, et al.
Pubblicazione: (2025)
di: Kutasov, Jon, et al.
Pubblicazione: (2025)
DafnyMPI: A Dafny Library for Verifying Message-Passing Concurrent Programs
di: Fedchin, Aleksandr, et al.
Pubblicazione: (2025)
di: Fedchin, Aleksandr, et al.
Pubblicazione: (2025)
VeriStruct: AI-assisted Automated Verification of Data-Structure Modules in Verus
di: Sun, Chuyue, et al.
Pubblicazione: (2025)
di: Sun, Chuyue, et al.
Pubblicazione: (2025)
Low-Rank Adapting Models for Sparse Autoencoders
di: Chen, Matthew, et al.
Pubblicazione: (2025)
di: Chen, Matthew, et al.
Pubblicazione: (2025)
Decomposing The Dark Matter of Sparse Autoencoders
di: Engels, Joshua, et al.
Pubblicazione: (2024)
di: Engels, Joshua, et al.
Pubblicazione: (2024)
OptPDE: Discovering Novel Integrable Systems via AI-Human Collaboration
di: Kantamneni, Subhash, et al.
Pubblicazione: (2024)
di: Kantamneni, Subhash, et al.
Pubblicazione: (2024)
How Do Transformers "Do" Physics? Investigating the Simple Harmonic Oscillator
di: Kantamneni, Subhash, et al.
Pubblicazione: (2024)
di: Kantamneni, Subhash, et al.
Pubblicazione: (2024)
Do Two AI Scientists Agree?
di: Fu, Xinghong, et al.
Pubblicazione: (2025)
di: Fu, Xinghong, et al.
Pubblicazione: (2025)
VeriSoftBench: Repository-Scale Formal Verification Benchmarks for Lean
di: Xin, Yutong, et al.
Pubblicazione: (2026)
di: Xin, Yutong, et al.
Pubblicazione: (2026)
A game-theoretic approach to the asymptotic behavior of solutions to an obstacle problem for the mean curvature flow equation
di: Misu, Kuniyasu
Pubblicazione: (2024)
di: Misu, Kuniyasu
Pubblicazione: (2024)
ProVerif Formal Verification Model for SSI-Mediated Wearable Health Data Sharing Architecture
di: Kazi Md Arif Shahriar
Pubblicazione: (2026)
di: Kazi Md Arif Shahriar
Pubblicazione: (2026)
Documenti analoghi
-
dafny-annotator: AI-Assisted Verification of Dafny Programs
di: Poesia, Gabriel, et al.
Pubblicazione: (2024) -
Towards AI-Assisted Synthesis of Verified Dafny Methods
di: Misu, Md Rakib Hossain, et al.
Pubblicazione: (2024) -
VeriAct: Beyond Verifiability -- Agentic Synthesis of Correct and Complete Formal Specifications
di: Misu, Md Rakib Hossain, et al.
Pubblicazione: (2026) -
Löb-Safe Logics for Reflective Agents
di: Ahrenbach, Seth
Pubblicazione: (2024) -
Opening the AI black box: program synthesis via mechanistic interpretability
di: Michaud, Eric J., et al.
Pubblicazione: (2024)