MINIF2F-DAFNY: LLM-Guided Mathematical Theorem Proving via Auto-Active Verification
Fuente:
arXiv
Salvato in:
| Autori principali: | Baksys, Mantas, Zetzsche, Stefan, Bouissou, Olivier, Holden, Sean B. |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
ATLAS: Automated Toolkit for Large-Scale Verified Code Synthesis
di: Baksys, Mantas, et al.
Pubblicazione: (2025)
di: Baksys, Mantas, et al.
Pubblicazione: (2025)
DafnyPro: LLM-Assisted Automated Verification for Dafny Programs
di: Banerjee, Debangshu, et al.
Pubblicazione: (2026)
di: Banerjee, Debangshu, et al.
Pubblicazione: (2026)
Teaching LLMs Program Semantics via Symbolic Execution Traces
di: Bayer, Jonas, et al.
Pubblicazione: (2026)
di: Bayer, Jonas, et al.
Pubblicazione: (2026)
miniCTX: Neural Theorem Proving with (Long-)Contexts
di: Hu, Jiewen, et al.
Pubblicazione: (2024)
di: Hu, Jiewen, et al.
Pubblicazione: (2024)
FVEL: Interactive Formal Verification Environment with Large Language Models via Theorem Proving
di: Lin, Xiaohan, et al.
Pubblicazione: (2024)
di: Lin, Xiaohan, et al.
Pubblicazione: (2024)
BAIT: Benchmarking (Embedding) Architectures for Interactive Theorem-Proving
di: Lamont, Sean, et al.
Pubblicazione: (2024)
di: Lamont, Sean, et al.
Pubblicazione: (2024)
Neural Theorem Proving: Generating and Structuring Proofs for Formal Verification
di: Rao, Balaji, et al.
Pubblicazione: (2025)
di: Rao, Balaji, et al.
Pubblicazione: (2025)
STP: Self-play LLM Theorem Provers with Iterative Conjecturing and Proving
di: Dong, Kefan, et al.
Pubblicazione: (2025)
di: Dong, Kefan, et al.
Pubblicazione: (2025)
Steering LLMs for Formal Theorem Proving
di: Kirtania, Shashank, et al.
Pubblicazione: (2025)
di: Kirtania, Shashank, et al.
Pubblicazione: (2025)
A Theoretical Framework for Self-Play Theorem Proving Algorithms
di: Chen, Thomas, et al.
Pubblicazione: (2026)
di: Chen, Thomas, et al.
Pubblicazione: (2026)
Formal Theorem Proving by Rewarding LLMs to Decompose Proofs Hierarchically
di: Dong, Kefan, et al.
Pubblicazione: (2024)
di: Dong, Kefan, et al.
Pubblicazione: (2024)
Learning to Reason with Insight for Informal Theorem Proving
di: Li, Yunhe, et al.
Pubblicazione: (2026)
di: Li, Yunhe, et al.
Pubblicazione: (2026)
What are the Right Symmetries for Formal Theorem Proving?
di: Olejniczak, Krzysztof, et al.
Pubblicazione: (2026)
di: Olejniczak, Krzysztof, et al.
Pubblicazione: (2026)
Bourbaki: Self-Generated and Goal-Conditioned MDPs for Theorem Proving
di: Zimmer, Matthieu, et al.
Pubblicazione: (2025)
di: Zimmer, Matthieu, et al.
Pubblicazione: (2025)
GAR: Generative Adversarial Reinforcement Learning for Formal Theorem Proving
di: Wang, Ruida, et al.
Pubblicazione: (2025)
di: Wang, Ruida, et al.
Pubblicazione: (2025)
ProofAug: Efficient Neural Theorem Proving via Fine-grained Proof Structure Analysis
di: Liu, Haoxiong, et al.
Pubblicazione: (2025)
di: Liu, Haoxiong, et al.
Pubblicazione: (2025)
LeanAgent: Lifelong Learning for Formal Theorem Proving
di: Kumarappan, Adarsh, et al.
Pubblicazione: (2024)
di: Kumarappan, Adarsh, et al.
Pubblicazione: (2024)
An In-Context Learning Agent for Formal Theorem-Proving
di: Thakur, Amitayush, et al.
Pubblicazione: (2023)
di: Thakur, Amitayush, et al.
Pubblicazione: (2023)
CuDIP: Enhancing Theorem Proving in LLMs via Curriculum Learning-based Direct Preference Optimization
di: Shi, Shuming, et al.
Pubblicazione: (2025)
di: Shi, Shuming, et al.
Pubblicazione: (2025)
BrokenMath: A Benchmark for Sycophancy in Theorem Proving with LLMs
di: Petrov, Ivo, et al.
Pubblicazione: (2025)
di: Petrov, Ivo, et al.
Pubblicazione: (2025)
Goedel-Prover: A Frontier Model for Open-Source Automated Theorem Proving
di: Lin, Yong, et al.
Pubblicazione: (2025)
di: Lin, Yong, et al.
Pubblicazione: (2025)
Proving membership in LLM pretraining data via data watermarks
di: Wei, Johnny Tian-Zheng, et al.
Pubblicazione: (2024)
di: Wei, Johnny Tian-Zheng, et al.
Pubblicazione: (2024)
Local Look-Ahead Guidance via Verifier-in-the-Loop for Automated Theorem Proving
di: Rajaee, Sara, et al.
Pubblicazione: (2025)
di: Rajaee, Sara, et al.
Pubblicazione: (2025)
Goedel-Prover-V2: Scaling Formal Theorem Proving with Scaffolded Data Synthesis and Self-Correction
di: Lin, Yong, et al.
Pubblicazione: (2025)
di: Lin, Yong, et al.
Pubblicazione: (2025)
LLM-AutoSciLab: Closed-Loop Scientific Discovery via Active Experimentation with LLMs
di: Kabra, Sanchit, et al.
Pubblicazione: (2026)
di: Kabra, Sanchit, et al.
Pubblicazione: (2026)
QED-Nano: Teaching a Tiny Model to Prove Hard Theorems
di: LM-Provers, et al.
Pubblicazione: (2026)
di: LM-Provers, et al.
Pubblicazione: (2026)
Nazrin: Atomic Tactics for Graph Neural Networks for Theorem Proving in Lean 4
di: Aniva, Leni, et al.
Pubblicazione: (2026)
di: Aniva, Leni, et al.
Pubblicazione: (2026)
OptProver: Bridging Olympiad and Optimization through Continual Training in Formal Theorem Proving
di: Li, Chenyi, et al.
Pubblicazione: (2026)
di: Li, Chenyi, et al.
Pubblicazione: (2026)
miniCodeProps: a Minimal Benchmark for Proving Code Properties
di: Lohn, Evan, et al.
Pubblicazione: (2024)
di: Lohn, Evan, et al.
Pubblicazione: (2024)
Lean Copilot: Large Language Models as Copilots for Theorem Proving in Lean
di: Song, Peiyang, et al.
Pubblicazione: (2024)
di: Song, Peiyang, et al.
Pubblicazione: (2024)
SubgoalXL: Subgoal-based Expert Learning for Theorem Proving
di: Zhao, Xueliang, et al.
Pubblicazione: (2024)
di: Zhao, Xueliang, et al.
Pubblicazione: (2024)
Accurate and Diverse LLM Mathematical Reasoning via Automated PRM-Guided GFlowNets
di: Younsi, Adam, et al.
Pubblicazione: (2025)
di: Younsi, Adam, et al.
Pubblicazione: (2025)
Enhancing Neural Theorem Proving through Data Augmentation and Dynamic Sampling Method
di: Vishwakarma, Rahul, et al.
Pubblicazione: (2023)
di: Vishwakarma, Rahul, et al.
Pubblicazione: (2023)
Ineq-Comp: Benchmarking Human-Intuitive Compositional Reasoning in Automated Theorem Proving on Inequalities
di: Zhao, Haoyu, et al.
Pubblicazione: (2025)
di: Zhao, Haoyu, et al.
Pubblicazione: (2025)
Proving Linear Mode Connectivity of Neural Networks via Optimal Transport
di: Ferbach, Damien, et al.
Pubblicazione: (2023)
di: Ferbach, Damien, et al.
Pubblicazione: (2023)
ProofWala: A Framework for Multilingual Proof Data Synthesis and Theorem-Proving
di: Thakur, Amitayush, et al.
Pubblicazione: (2025)
di: Thakur, Amitayush, et al.
Pubblicazione: (2025)
Learning Rules Explaining Interactive Theorem Proving Tactic Prediction
di: Zhang, Liao, et al.
Pubblicazione: (2024)
di: Zhang, Liao, et al.
Pubblicazione: (2024)
Aggressive Compression Enables LLM Weight Theft
di: Brown, Davis, et al.
Pubblicazione: (2026)
di: Brown, Davis, et al.
Pubblicazione: (2026)
ContextFlow: Context-Aware Flow Matching For Trajectory Inference From Spatial Omics Data
di: Rathod, Santanu Subhash, et al.
Pubblicazione: (2025)
di: Rathod, Santanu Subhash, et al.
Pubblicazione: (2025)
WybeCoder: Verified Imperative Code Generation
di: Gloeckle, Fabian, et al.
Pubblicazione: (2026)
di: Gloeckle, Fabian, et al.
Pubblicazione: (2026)
Documenti analoghi
-
ATLAS: Automated Toolkit for Large-Scale Verified Code Synthesis
di: Baksys, Mantas, et al.
Pubblicazione: (2025) -
DafnyPro: LLM-Assisted Automated Verification for Dafny Programs
di: Banerjee, Debangshu, et al.
Pubblicazione: (2026) -
Teaching LLMs Program Semantics via Symbolic Execution Traces
di: Bayer, Jonas, et al.
Pubblicazione: (2026) -
miniCTX: Neural Theorem Proving with (Long-)Contexts
di: Hu, Jiewen, et al.
Pubblicazione: (2024) -
FVEL: Interactive Formal Verification Environment with Large Language Models via Theorem Proving
di: Lin, Xiaohan, et al.
Pubblicazione: (2024)