APOLLO: Automated LLM and Lean Collaboration for Advanced Formal Reasoning
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Ospanov, Azim, Farnia, Farzan, Yousefzadeh, Roozbeh |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
miniF2F-Lean Revisited: Reviewing Limitations and Charting a Path Forward
par: Ospanov, Azim, et autres
Publié: (2025)
par: Ospanov, Azim, et autres
Publié: (2025)
Advocate for Complete Benchmarks for Formal Reasoning with Formal/Informal Statements and Formal/Informal Proofs
par: Yousefzadeh, Roozbeh, et autres
Publié: (2025)
par: Yousefzadeh, Roozbeh, et autres
Publié: (2025)
Do Vendi Scores Converge with Finite Samples? Truncated Vendi Score for Finite-Sample Convergence Guarantees
par: Ospanov, Azim, et autres
Publié: (2024)
par: Ospanov, Azim, et autres
Publié: (2024)
Exposing Diversity Bias in Deep Generative Models: Statistical Origins and Correction of Diversity Error
par: Farnia, Farzan, et autres
Publié: (2026)
par: Farnia, Farzan, et autres
Publié: (2026)
Lean Atlas: An Integrated Proof Environment for Scalable Human-AI Collaborative Formalization
par: Yanahama, Banri, et autres
Publié: (2026)
par: Yanahama, Banri, et autres
Publié: (2026)
LeanAgent: Lifelong Learning for Formal Theorem Proving
par: Kumarappan, Adarsh, et autres
Publié: (2024)
par: Kumarappan, Adarsh, et autres
Publié: (2024)
Conditional Vendi Score: An Information-Theoretic Approach to Diversity Evaluation of Prompt-based Generative Models
par: Jalali, Mohammad, et autres
Publié: (2024)
par: Jalali, Mohammad, et autres
Publié: (2024)
LLM-ARC: Enhancing LLMs with an Automated Reasoning Critic
par: Kalyanpur, Aditya, et autres
Publié: (2024)
par: Kalyanpur, Aditya, et autres
Publié: (2024)
Risk-Controlled Lean-as-Judge for Natural-Language Mathematical Reasoning
par: Bourigault, Pauline, et autres
Publié: (2026)
par: Bourigault, Pauline, et autres
Publié: (2026)
Logic-Parametric Neuro-Symbolic NLI: Controlling Logical Formalisms for Verifiable LLM Reasoning
par: Farjami, Ali, et autres
Publié: (2026)
par: Farjami, Ali, et autres
Publié: (2026)
A Modal Logic for Possibilistic Reasoning with Fuzzy Formal Contexts
par: Howlader, Prosenjit, et autres
Publié: (2025)
par: Howlader, Prosenjit, et autres
Publié: (2025)
Analysing Temporal Reasoning in Description Logics Using Formal Grammars
par: Bourgaux, Camille, et autres
Publié: (2025)
par: Bourgaux, Camille, et autres
Publié: (2025)
Reasoning Systems as Structured Processes: Foundations, Failures, and Formal Criteria
par: Nikooroo, Saleh, et autres
Publié: (2025)
par: Nikooroo, Saleh, et autres
Publié: (2025)
Formal Reasoning About Confidence and Automated Verification of Neural Networks
par: Afzal, Mohammad, et autres
Publié: (2025)
par: Afzal, Mohammad, et autres
Publié: (2025)
VeriThoughts: Enabling Automated Verilog Code Generation using Reasoning and Formal Verification
par: Yubeaton, Patrick, et autres
Publié: (2025)
par: Yubeaton, Patrick, et autres
Publié: (2025)
Stress-Testing the Reasoning Competence of LLMs With Proofs Under Minimal Formalism
par: Arkoudas, Konstantine, et autres
Publié: (2026)
par: Arkoudas, Konstantine, et autres
Publié: (2026)
Grammars of Formal Uncertainty: When to Trust LLMs in Automated Reasoning Tasks
par: Ganguly, Debargha, et autres
Publié: (2025)
par: Ganguly, Debargha, et autres
Publié: (2025)
MSC-180: A Benchmark for Automated Formal Theorem Proving from Mathematical Subject Classification
par: Li, Sirui, et autres
Publié: (2025)
par: Li, Sirui, et autres
Publié: (2025)
Discover and Prove: An Open-source Agentic Framework for Hard Mode Automated Theorem Proving in Lean 4
par: Liu, Chengwu, et autres
Publié: (2026)
par: Liu, Chengwu, et autres
Publié: (2026)
Bridging LLM Planning Agents and Formal Methods: A Case Study in Plan Verification
par: Ramani, Keshav, et autres
Publié: (2025)
par: Ramani, Keshav, et autres
Publié: (2025)
PBLean: Pseudo-Boolean Proof Certificates for Lean 4
par: Szeider, Stefan
Publié: (2026)
par: Szeider, Stefan
Publié: (2026)
Automated Verification of Equivalence Properties in Advanced Logic Programs -- Bachelor Thesis
par: Heuer, Jan
Publié: (2023)
par: Heuer, Jan
Publié: (2023)
ReasonOps: A Unified Operational Paradigm for Trustworthy Verified LLM Reasoning
par: Rashid, Adnan
Publié: (2026)
par: Rashid, Adnan
Publié: (2026)
Generating Millions Of Lean Theorems With Proofs By Exploring State Transition Graphs
par: Yin, David, et autres
Publié: (2025)
par: Yin, David, et autres
Publié: (2025)
Keep the Proof State Live: Snapshotting for Efficient Tactic Search in Lean 4
par: Shen, Austin, et autres
Publié: (2026)
par: Shen, Austin, et autres
Publié: (2026)
A Lean Dataset for International Math Olympiad: Small Steps towards Writing Math Proofs for Hard Problems
par: Yousefzadeh, Roozbeh, et autres
Publié: (2024)
par: Yousefzadeh, Roozbeh, et autres
Publié: (2024)
Cobblestone: A Divide-and-Conquer Approach for Automating Formal Verification
par: Kasibatla, Saketh Ram, et autres
Publié: (2024)
par: Kasibatla, Saketh Ram, et autres
Publié: (2024)
REAL-Prover: Retrieval Augmented Lean Prover for Mathematical Reasoning
par: Shen, Ziju, et autres
Publié: (2025)
par: Shen, Ziju, et autres
Publié: (2025)
Lean Copilot: Large Language Models as Copilots for Theorem Proving in Lean
par: Song, Peiyang, et autres
Publié: (2024)
par: Song, Peiyang, et autres
Publié: (2024)
Lean Meets Theoretical Computer Science: Scalable Synthesis of Theorem Proving Challenges in Formal-Informal Pairs
par: Zhang, Terry Jingchen, et autres
Publié: (2025)
par: Zhang, Terry Jingchen, et autres
Publié: (2025)
Abductive Reasoning in a Paraconsistent Framework
par: Bienvenu, Meghyn, et autres
Publié: (2024)
par: Bienvenu, Meghyn, et autres
Publié: (2024)
An Automated Theorem Generator with Theoretical Foundation Based on Rectangular Standard Contradiction
par: Xu, Yang, et autres
Publié: (2025)
par: Xu, Yang, et autres
Publié: (2025)
Formal Mathematical Reasoning: A New Frontier in AI
par: Yang, Kaiyu, et autres
Publié: (2024)
par: Yang, Kaiyu, et autres
Publié: (2024)
Rational Inference in Formal Concept Analysis
par: Carr, Lucas, et autres
Publié: (2025)
par: Carr, Lucas, et autres
Publié: (2025)
On Formally Undecidable Traits of Intelligent Machines
par: Fox, Matthew
Publié: (2024)
par: Fox, Matthew
Publié: (2024)
Formally Certified Approximate Model Counting
par: Tan, Yong Kiam, et autres
Publié: (2024)
par: Tan, Yong Kiam, et autres
Publié: (2024)
Formally Verified Approximate Policy Iteration
par: Schäffeler, Maximilian, et autres
Publié: (2024)
par: Schäffeler, Maximilian, et autres
Publié: (2024)
Learning Formal Mathematics From Intrinsic Motivation
par: Poesia, Gabriel, et autres
Publié: (2024)
par: Poesia, Gabriel, et autres
Publié: (2024)
VEL: A Formally Verified Reasoner for OWL2 EL Profile
par: Ileri, Atalay Mert, et autres
Publié: (2024)
par: Ileri, Atalay Mert, et autres
Publié: (2024)
Formally Verified Certification of Unsolvability of Temporal Planning Problems
par: Wang, David, et autres
Publié: (2025)
par: Wang, David, et autres
Publié: (2025)
Documents similaires
-
miniF2F-Lean Revisited: Reviewing Limitations and Charting a Path Forward
par: Ospanov, Azim, et autres
Publié: (2025) -
Advocate for Complete Benchmarks for Formal Reasoning with Formal/Informal Statements and Formal/Informal Proofs
par: Yousefzadeh, Roozbeh, et autres
Publié: (2025) -
Do Vendi Scores Converge with Finite Samples? Truncated Vendi Score for Finite-Sample Convergence Guarantees
par: Ospanov, Azim, et autres
Publié: (2024) -
Exposing Diversity Bias in Deep Generative Models: Statistical Origins and Correction of Diversity Error
par: Farnia, Farzan, et autres
Publié: (2026) -
Lean Atlas: An Integrated Proof Environment for Scalable Human-AI Collaborative Formalization
par: Yanahama, Banri, et autres
Publié: (2026)