ProofOptimizer: Training Language Models to Simplify Proofs without Human Demonstrations
Fuente:
arXiv
Salvato in:
| Autori principali: | Gu, Alex, Piotrowski, Bartosz, Gloeckle, Fabian, Yang, Kaiyu, Markosyan, Aram H. |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
FormalProofBench: Can Models Write Graduate Level Math Proofs That Are Formally Verified?
di: Ravi, Nikil, et al.
Pubblicazione: (2026)
di: Ravi, Nikil, et al.
Pubblicazione: (2026)
From Informal to Formal -- Incorporating and Evaluating LLMs on Natural Language Requirements to Verifiable Formal Proofs
di: Cao, Jialun, et al.
Pubblicazione: (2025)
di: Cao, Jialun, et al.
Pubblicazione: (2025)
A Case Study on the Effectiveness of LLMs in Verification with Proof Assistants
di: Bayazıt, Barış, et al.
Pubblicazione: (2025)
di: Bayazıt, Barış, et al.
Pubblicazione: (2025)
Solving Inequality Proofs with Large Language Models
di: Lu, Pan, et al.
Pubblicazione: (2025)
di: Lu, Pan, et al.
Pubblicazione: (2025)
ProofWala: A Framework for Multilingual Proof Data Synthesis and Theorem-Proving
di: Thakur, Amitayush, et al.
Pubblicazione: (2025)
di: Thakur, Amitayush, et al.
Pubblicazione: (2025)
What I cannot execute, I do not understand: Training and Evaluating LLMs on Program Execution Traces
di: Armengol-Estapé, Jordi, et al.
Pubblicazione: (2025)
di: Armengol-Estapé, Jordi, et al.
Pubblicazione: (2025)
Towards Neural Synthesis for SMT-Assisted Proof-Oriented Programming
di: Chakraborty, Saikat, et al.
Pubblicazione: (2024)
di: Chakraborty, Saikat, et al.
Pubblicazione: (2024)
MUSTARD: Mastering Uniform Synthesis of Theorem and Proof Data
di: Huang, Yinya, et al.
Pubblicazione: (2024)
di: Huang, Yinya, et al.
Pubblicazione: (2024)
A Certified Proof Checker for Deep Neural Network Verification in Imandra
di: Desmartin, Remi, et al.
Pubblicazione: (2024)
di: Desmartin, Remi, et al.
Pubblicazione: (2024)
Detecting Prefix Bias in LLM-based Reward Models
di: Kumar, Ashwin, et al.
Pubblicazione: (2025)
di: Kumar, Ashwin, et al.
Pubblicazione: (2025)
Beyond Pass-by-Pass Optimization: Intent-Driven IR Optimization with Large Language Models
di: Qiu, Lei, et al.
Pubblicazione: (2026)
di: Qiu, Lei, et al.
Pubblicazione: (2026)
Proof Automation with Large Language Models
di: Lu, Minghai, et al.
Pubblicazione: (2024)
di: Lu, Minghai, et al.
Pubblicazione: (2024)
Can Proof Assistants Verify Multi-Agent Systems?
di: Mendez, Julian Alfredo, et al.
Pubblicazione: (2025)
di: Mendez, Julian Alfredo, et al.
Pubblicazione: (2025)
Proof2Hybrid: Automatic Mathematical Benchmark Synthesis for Proof-Centric Problems
di: Peng, Yebo, et al.
Pubblicazione: (2025)
di: Peng, Yebo, et al.
Pubblicazione: (2025)
Meta Large Language Model Compiler: Foundation Models of Compiler Optimization
di: Cummins, Chris, et al.
Pubblicazione: (2024)
di: Cummins, Chris, et al.
Pubblicazione: (2024)
SLaDe: A Portable Small Language Model Decompiler for Optimized Assembly
di: Armengol-Estapé, Jordi, et al.
Pubblicazione: (2023)
di: Armengol-Estapé, Jordi, et al.
Pubblicazione: (2023)
Lean Refactor: Multi-Objective Controllable Proof Optimization via Agentic Strategy Search
di: Lu, Jialin, et al.
Pubblicazione: (2026)
di: Lu, Jialin, et al.
Pubblicazione: (2026)
The Proof is in the Almond Cookies
di: van Trijp, Remi, et al.
Pubblicazione: (2025)
di: van Trijp, Remi, et al.
Pubblicazione: (2025)
The Open Proof Corpus: A Large-Scale Study of LLM-Generated Mathematical Proofs
di: Dekoninck, Jasper, et al.
Pubblicazione: (2025)
di: Dekoninck, Jasper, et al.
Pubblicazione: (2025)
Emergent Representations of Program Semantics in Language Models Trained on Programs
di: Jin, Charles, et al.
Pubblicazione: (2023)
di: Jin, Charles, et al.
Pubblicazione: (2023)
Reliable Fine-Grained Evaluation of Natural Language Math Proofs
di: Ma, Wenjie, et al.
Pubblicazione: (2025)
di: Ma, Wenjie, et al.
Pubblicazione: (2025)
ProofSketch: Efficient Verified Reasoning for Large Language Models
di: Sheshanarayana, Disha, et al.
Pubblicazione: (2025)
di: Sheshanarayana, Disha, et al.
Pubblicazione: (2025)
Exploring the Role of Reasoning Structures for Constructing Proofs in Multi-Step Natural Language Reasoning with Large Language Models
di: Zheng, Zi'ou, et al.
Pubblicazione: (2024)
di: Zheng, Zi'ou, et al.
Pubblicazione: (2024)
Next-Token Prediction Task Assumes Optimal Data Ordering for LLM Training in Proof Generation
di: An, Chenyang, et al.
Pubblicazione: (2024)
di: An, Chenyang, et al.
Pubblicazione: (2024)
SAC-Opt: Semantic Anchors for Iterative Correction in Optimization Modeling
di: Zhang, Yansen, et al.
Pubblicazione: (2025)
di: Zhang, Yansen, et al.
Pubblicazione: (2025)
Neuro-Symbolic Integration Brings Causal and Reliable Reasoning Proofs
di: Yang, Sen, et al.
Pubblicazione: (2023)
di: Yang, Sen, et al.
Pubblicazione: (2023)
SGLang: Efficient Execution of Structured Language Model Programs
di: Zheng, Lianmin, et al.
Pubblicazione: (2023)
di: Zheng, Lianmin, et al.
Pubblicazione: (2023)
How Do Humans Write Code? Large Models Do It the Same Way Too
di: Li, Long, et al.
Pubblicazione: (2024)
di: Li, Long, et al.
Pubblicazione: (2024)
Algorithmic Language Models with Neurally Compiled Libraries
di: Saldyt, Lucas, et al.
Pubblicazione: (2024)
di: Saldyt, Lucas, et al.
Pubblicazione: (2024)
Can Language Models Solve Olympiad Programming?
di: Shi, Quan, et al.
Pubblicazione: (2024)
di: Shi, Quan, et al.
Pubblicazione: (2024)
EnvTrace: Simulation-Based Semantic Evaluation of LLM Code via Execution Trace Alignment -- Demonstrated at Synchrotron Beamlines
di: van der Vleuten, Noah, et al.
Pubblicazione: (2025)
di: van der Vleuten, Noah, et al.
Pubblicazione: (2025)
A Natural Formalized Proof Language
di: Xie, Lihan, et al.
Pubblicazione: (2024)
di: Xie, Lihan, et al.
Pubblicazione: (2024)
From Reasoning to Learning: A Survey on Hypothesis Discovery and Rule Learning with Large Language Models
di: He, Kaiyu, et al.
Pubblicazione: (2025)
di: He, Kaiyu, et al.
Pubblicazione: (2025)
Aletheia tackles FirstProof autonomously
di: Feng, Tony, et al.
Pubblicazione: (2026)
di: Feng, Tony, et al.
Pubblicazione: (2026)
Autograding Mathematical Induction Proofs with Natural Language Processing
di: Zhao, Chenyan, et al.
Pubblicazione: (2024)
di: Zhao, Chenyan, et al.
Pubblicazione: (2024)
Assessing the Interpretability of Programmatic Policies with Large Language Models
di: Bashir, Zahra, et al.
Pubblicazione: (2023)
di: Bashir, Zahra, et al.
Pubblicazione: (2023)
XGrammar: Flexible and Efficient Structured Generation Engine for Large Language Models
di: Dong, Yixin, et al.
Pubblicazione: (2024)
di: Dong, Yixin, et al.
Pubblicazione: (2024)
DSPy Assertions: Computational Constraints for Self-Refining Language Model Pipelines
di: Singhvi, Arnav, et al.
Pubblicazione: (2023)
di: Singhvi, Arnav, et al.
Pubblicazione: (2023)
SuperCoder: Assembly Program Superoptimization with Large Language Models
di: Wei, Anjiang, et al.
Pubblicazione: (2025)
di: Wei, Anjiang, et al.
Pubblicazione: (2025)
CodeMind: Evaluating Large Language Models for Code Reasoning
di: Liu, Changshu, et al.
Pubblicazione: (2024)
di: Liu, Changshu, et al.
Pubblicazione: (2024)
Documenti analoghi
-
FormalProofBench: Can Models Write Graduate Level Math Proofs That Are Formally Verified?
di: Ravi, Nikil, et al.
Pubblicazione: (2026) -
From Informal to Formal -- Incorporating and Evaluating LLMs on Natural Language Requirements to Verifiable Formal Proofs
di: Cao, Jialun, et al.
Pubblicazione: (2025) -
A Case Study on the Effectiveness of LLMs in Verification with Proof Assistants
di: Bayazıt, Barış, et al.
Pubblicazione: (2025) -
Solving Inequality Proofs with Large Language Models
di: Lu, Pan, et al.
Pubblicazione: (2025) -
ProofWala: A Framework for Multilingual Proof Data Synthesis and Theorem-Proving
di: Thakur, Amitayush, et al.
Pubblicazione: (2025)