Formal Mathematical Reasoning: A New Frontier in AI
Fuente:
arXiv
Salvato in:
| Autori principali: | Yang, Kaiyu, Poesia, Gabriel, He, Jingxuan, Li, Wenda, Lauter, Kristin, Chaudhuri, Swarat, Song, Dawn |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
An In-Context Learning Agent for Formal Theorem-Proving
di: Thakur, Amitayush, et al.
Pubblicazione: (2023)
di: Thakur, Amitayush, et al.
Pubblicazione: (2023)
Learning Formal Mathematics From Intrinsic Motivation
di: Poesia, Gabriel, et al.
Pubblicazione: (2024)
di: Poesia, Gabriel, et al.
Pubblicazione: (2024)
VERINA: Benchmarking Verifiable Code Generation
di: Ye, Zhe, et al.
Pubblicazione: (2025)
di: Ye, Zhe, et al.
Pubblicazione: (2025)
ProofWala: A Framework for Multilingual Proof Data Synthesis and Theorem-Proving
di: Thakur, Amitayush, et al.
Pubblicazione: (2025)
di: Thakur, Amitayush, et al.
Pubblicazione: (2025)
Lean Copilot: Large Language Models as Copilots for Theorem Proving in Lean
di: Song, Peiyang, et al.
Pubblicazione: (2024)
di: Song, Peiyang, et al.
Pubblicazione: (2024)
PutnamBench: Evaluating Neural Theorem-Provers on the Putnam Mathematical Competition
di: Tsoukalas, George, et al.
Pubblicazione: (2024)
di: Tsoukalas, George, et al.
Pubblicazione: (2024)
CLEVER: A Curated Benchmark for Formally Verified Code Generation
di: Thakur, Amitayush, et al.
Pubblicazione: (2025)
di: Thakur, Amitayush, et al.
Pubblicazione: (2025)
Advocate for Complete Benchmarks for Formal Reasoning with Formal/Informal Statements and Formal/Informal Proofs
di: Yousefzadeh, Roozbeh, et al.
Pubblicazione: (2025)
di: Yousefzadeh, Roozbeh, et al.
Pubblicazione: (2025)
MathlibLemma: Folklore Lemma Generation and Benchmark for Formal Mathematics
di: Liu, Xinyu, et al.
Pubblicazione: (2026)
di: Liu, Xinyu, et al.
Pubblicazione: (2026)
MathlibPR: Pull Request Merge-Readiness Benchmark for Formal Mathematical Libraries
di: Xie, Zixuan, et al.
Pubblicazione: (2026)
di: Xie, Zixuan, et al.
Pubblicazione: (2026)
Formal Explanations for Neuro-Symbolic AI
di: Paul, Sushmita, et al.
Pubblicazione: (2024)
di: Paul, Sushmita, et al.
Pubblicazione: (2024)
REAL-Prover: Retrieval Augmented Lean Prover for Mathematical Reasoning
di: Shen, Ziju, et al.
Pubblicazione: (2025)
di: Shen, Ziju, et al.
Pubblicazione: (2025)
LeanAgent: Lifelong Learning for Formal Theorem Proving
di: Kumarappan, Adarsh, et al.
Pubblicazione: (2024)
di: Kumarappan, Adarsh, et al.
Pubblicazione: (2024)
Geometry of Reason: Spectral Signatures of Valid Mathematical Reasoning
di: Noël, Valentin
Pubblicazione: (2026)
di: Noël, Valentin
Pubblicazione: (2026)
Autoformalizing Euclidean Geometry
di: Murphy, Logan, et al.
Pubblicazione: (2024)
di: Murphy, Logan, et al.
Pubblicazione: (2024)
FATE: A Formal Benchmark Series for Frontier Algebra of Multiple Difficulty Levels
di: Jiang, Jiedong, et al.
Pubblicazione: (2025)
di: Jiang, Jiedong, et al.
Pubblicazione: (2025)
Transformer Encoder Satisfiability: Complexity and Impact on Formal Reasoning
di: Sälzer, Marco, et al.
Pubblicazione: (2024)
di: Sälzer, Marco, et al.
Pubblicazione: (2024)
Neurosymbolic AI for Reasoning over Knowledge Graphs: A Survey
di: DeLong, Lauren Nicole, et al.
Pubblicazione: (2023)
di: DeLong, Lauren Nicole, et al.
Pubblicazione: (2023)
What are the Right Symmetries for Formal Theorem Proving?
di: Olejniczak, Krzysztof, et al.
Pubblicazione: (2026)
di: Olejniczak, Krzysztof, et al.
Pubblicazione: (2026)
Intent-aligned Formal Specification Synthesis via Traceable Refinement
di: Ye, Zhe, et al.
Pubblicazione: (2026)
di: Ye, Zhe, et al.
Pubblicazione: (2026)
Solving Formal Math Problems by Decomposition and Iterative Reflection
di: Zhou, Yichi, et al.
Pubblicazione: (2025)
di: Zhou, Yichi, et al.
Pubblicazione: (2025)
Approximating Pareto Frontiers in Stochastic Multi-Objective Optimization via Hashing and Randomization
di: Li, Jinzhao, et al.
Pubblicazione: (2026)
di: Li, Jinzhao, et al.
Pubblicazione: (2026)
Marabou 2.0: A Versatile Formal Analyzer of Neural Networks
di: Wu, Haoze, et al.
Pubblicazione: (2024)
di: Wu, Haoze, et al.
Pubblicazione: (2024)
Learning Quantitative Automata Modulo Theories
di: Hsiung, Eric, et al.
Pubblicazione: (2024)
di: Hsiung, Eric, et al.
Pubblicazione: (2024)
Temporal Inductive Logic Reasoning over Hypergraphs
di: Yang, Yuan, et al.
Pubblicazione: (2022)
di: Yang, Yuan, et al.
Pubblicazione: (2022)
Efficient Certified Reasoning for Binarized Neural Networks
di: Yang, Jiong, et al.
Pubblicazione: (2025)
di: Yang, Jiong, et al.
Pubblicazione: (2025)
Formally Verified Neurosymbolic Trajectory Learning via Tensor-based Linear Temporal Logic on Finite Traces
di: Chevallier, Mark, et al.
Pubblicazione: (2025)
di: Chevallier, Mark, et al.
Pubblicazione: (2025)
Formal Methods Meet LLMs: Auditing, Monitoring, and Intervention for Compliance of Advanced AI Systems
di: Alamdari, Parand A., et al.
Pubblicazione: (2026)
di: Alamdari, Parand A., et al.
Pubblicazione: (2026)
Learning to Rank the Initial Branching Order of SAT Solvers
di: Eriksson, Arvid, et al.
Pubblicazione: (2026)
di: Eriksson, Arvid, et al.
Pubblicazione: (2026)
Inference of Abstraction for a Unified Account of Reasoning and Learning
di: Kido, Hiroyuki
Pubblicazione: (2024)
di: Kido, Hiroyuki
Pubblicazione: (2024)
Can Transformers Reason Logically? A Study in SAT Solving
di: Pan, Leyan, et al.
Pubblicazione: (2024)
di: Pan, Leyan, et al.
Pubblicazione: (2024)
GLIDR: Graph-Like Inductive Logic Programming with Differentiable Reasoning
di: Johnson, Blair, et al.
Pubblicazione: (2025)
di: Johnson, Blair, et al.
Pubblicazione: (2025)
MathConstraint: Automated Generation of Verified Combinatorial Reasoning Instances for LLMs
di: Pati, Viresh, et al.
Pubblicazione: (2026)
di: Pati, Viresh, et al.
Pubblicazione: (2026)
Fully Geometric Multi-Hop Reasoning on Knowledge Graphs with Transitive Relations
di: Zhapa-Camacho, Fernando, et al.
Pubblicazione: (2025)
di: Zhapa-Camacho, Fernando, et al.
Pubblicazione: (2025)
A Logic for Reasoning About Aggregate-Combine Graph Neural Networks
di: Nunn, Pierre, et al.
Pubblicazione: (2024)
di: Nunn, Pierre, et al.
Pubblicazione: (2024)
Dualformer: Controllable Fast and Slow Thinking by Learning with Randomized Reasoning Traces
di: Su, DiJia, et al.
Pubblicazione: (2024)
di: Su, DiJia, et al.
Pubblicazione: (2024)
Enhancing Reasoning Capabilities of LLMs via Principled Synthetic Logic Corpus
di: Morishita, Terufumi, et al.
Pubblicazione: (2024)
di: Morishita, Terufumi, et al.
Pubblicazione: (2024)
Structured Abductive-Deductive-Inductive Reasoning for LLMs via Algebraic Invariants
di: Gilda, Sankalp, et al.
Pubblicazione: (2026)
di: Gilda, Sankalp, et al.
Pubblicazione: (2026)
SATQuest: A Verifier for Logical Reasoning Evaluation and Reinforcement Fine-Tuning of LLMs
di: Zhao, Yanxiao, et al.
Pubblicazione: (2025)
di: Zhao, Yanxiao, et al.
Pubblicazione: (2025)
Application of AI to formal methods - an analysis of current trends
di: Stock, Sebastian, et al.
Pubblicazione: (2024)
di: Stock, Sebastian, et al.
Pubblicazione: (2024)
Documenti analoghi
-
An In-Context Learning Agent for Formal Theorem-Proving
di: Thakur, Amitayush, et al.
Pubblicazione: (2023) -
Learning Formal Mathematics From Intrinsic Motivation
di: Poesia, Gabriel, et al.
Pubblicazione: (2024) -
VERINA: Benchmarking Verifiable Code Generation
di: Ye, Zhe, et al.
Pubblicazione: (2025) -
ProofWala: A Framework for Multilingual Proof Data Synthesis and Theorem-Proving
di: Thakur, Amitayush, et al.
Pubblicazione: (2025) -
Lean Copilot: Large Language Models as Copilots for Theorem Proving in Lean
di: Song, Peiyang, et al.
Pubblicazione: (2024)