ProofCompass: Enhancing Specialized Provers with LLM Guidance
Fuente:
arXiv
Guardado en:
| Autores principales: | Wischermann, Nicolas, Verdun, Claudio Mayrink, Poesia, Gabriel, Noseda, Francesco |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Soft Best-of-n Sampling for Model Alignment
por: Verdun, Claudio Mayrink, et al.
Publicado: (2025)
por: Verdun, Claudio Mayrink, et al.
Publicado: (2025)
The Token Games: Evaluating Language Model Reasoning with Puzzle Duels
por: Henniger, Simon, et al.
Publicado: (2026)
por: Henniger, Simon, et al.
Publicado: (2026)
Temporal Sparse Autoencoders: Leveraging the Sequential Nature of Language for Interpretability
por: Bhalla, Usha, et al.
Publicado: (2025)
por: Bhalla, Usha, et al.
Publicado: (2025)
Multi-Group Proportional Representation for Text-to-Image Models
por: Jung, Sangwon, et al.
Publicado: (2025)
por: Jung, Sangwon, et al.
Publicado: (2025)
Optimized Couplings for Watermarking Large Language Models
por: Tsur, Dor, et al.
Publicado: (2025)
por: Tsur, Dor, et al.
Publicado: (2025)
Proof Recommendation System for the HOL4 Theorem Prover
por: Dekhil, Nour, et al.
Publicado: (2024)
por: Dekhil, Nour, et al.
Publicado: (2024)
Prover Agent: An Agent-Based Framework for Formal Mathematical Proofs
por: Baba, Kaito, et al.
Publicado: (2025)
por: Baba, Kaito, et al.
Publicado: (2025)
HybridProver: Augmenting Theorem Proving with LLM-Driven Proof Synthesis and Refinement
por: Hu, Jilin, et al.
Publicado: (2025)
por: Hu, Jilin, et al.
Publicado: (2025)
dafny-annotator: AI-Assisted Verification of Dafny Programs
por: Poesia, Gabriel, et al.
Publicado: (2024)
por: Poesia, Gabriel, et al.
Publicado: (2024)
When Do Skills Help Reinforcement Learning? A Theoretical Analysis of Temporal Abstractions
por: Li, Zhening, et al.
Publicado: (2024)
por: Li, Zhening, et al.
Publicado: (2024)
From Next-Token to Mathematics: The Learning Dynamics of Mathematical Reasoning in Language Models
por: Mishra, Shubhra, et al.
Publicado: (2024)
por: Mishra, Shubhra, et al.
Publicado: (2024)
AI Alignment at Your Discretion
por: Buyl, Maarten, et al.
Publicado: (2025)
por: Buyl, Maarten, et al.
Publicado: (2025)
Measuring Progress in Dictionary Learning for Language Model Interpretability with Board Game Models
por: Karvonen, Adam, et al.
Publicado: (2024)
por: Karvonen, Adam, et al.
Publicado: (2024)
HeavyWater and SimplexWater: Distortion-Free LLM Watermarks for Low-Entropy Next-Token Predictions
por: Tsur, Dor, et al.
Publicado: (2025)
por: Tsur, Dor, et al.
Publicado: (2025)
Goedel-Code-Prover: Hierarchical Proof Search for Open State-of-the-Art Code Verification
por: Li, Zenan, et al.
Publicado: (2026)
por: Li, Zenan, et al.
Publicado: (2026)
Vibe Coding an LLM-powered Theorem Prover
por: Hou, Zhe
Publicado: (2026)
por: Hou, Zhe
Publicado: (2026)
Learning Formal Mathematics From Intrinsic Motivation
por: Poesia, Gabriel, et al.
Publicado: (2024)
por: Poesia, Gabriel, et al.
Publicado: (2024)
Multi-Group Proportional Representation in Retrieval
por: Oesterling, Alex, et al.
Publicado: (2024)
por: Oesterling, Alex, et al.
Publicado: (2024)
ImProver 2: Iteratively Self-Improving LMs for Neurosymbolic Proof Optimization
por: Ahuja, Riyaz, et al.
Publicado: (2026)
por: Ahuja, Riyaz, et al.
Publicado: (2026)
Towards Automated Readable Proofs of Ruler and Compass Constructions
por: Marinković, Vesna, et al.
Publicado: (2024)
por: Marinković, Vesna, et al.
Publicado: (2024)
BFS-Prover: Scalable Best-First Tree Search for LLM-based Automatic Theorem Proving
por: Xin, Ran, et al.
Publicado: (2025)
por: Xin, Ran, et al.
Publicado: (2025)
Steamroller Problems: An Evaluation of LLM Reasoning Capability with Automated Theorem Prover Strategies
por: McGinness, Lachlan, et al.
Publicado: (2024)
por: McGinness, Lachlan, et al.
Publicado: (2024)
Leanabell-Prover: Posttraining Scaling in Formal Reasoning
por: Zhang, Jingyuan, et al.
Publicado: (2025)
por: Zhang, Jingyuan, et al.
Publicado: (2025)
Theorem Prover as a Judge for Synthetic Data Generation
por: Leang, Joshua Ong Jun, et al.
Publicado: (2025)
por: Leang, Joshua Ong Jun, et al.
Publicado: (2025)
Mitigating Legibility Tax with Decoupled Prover-Verifier Games
por: Kim, Yegon, et al.
Publicado: (2026)
por: Kim, Yegon, et al.
Publicado: (2026)
Scaling up Multi-Turn Off-Policy RL and Multi-Agent Tree Search for LLM Step-Provers
por: Xin, Ran, et al.
Publicado: (2025)
por: Xin, Ran, et al.
Publicado: (2025)
REAL-Prover: Retrieval Augmented Lean Prover for Mathematical Reasoning
por: Shen, Ziju, et al.
Publicado: (2025)
por: Shen, Ziju, et al.
Publicado: (2025)
Learning to Rank the Initial Branching Order of SAT Solvers
por: Eriksson, Arvid, et al.
Publicado: (2026)
por: Eriksson, Arvid, et al.
Publicado: (2026)
Code-enabled language models can outperform reasoning models on diverse tasks
por: Zhang, Cedegao E., et al.
Publicado: (2025)
por: Zhang, Cedegao E., et al.
Publicado: (2025)
STP: Self-play LLM Theorem Provers with Iterative Conjecturing and Proving
por: Dong, Kefan, et al.
Publicado: (2025)
por: Dong, Kefan, et al.
Publicado: (2025)
Clarifying Before Reasoning: A Coq Prover with Structural Context
por: Lu, Yanzhen, et al.
Publicado: (2025)
por: Lu, Yanzhen, et al.
Publicado: (2025)
StepFun-Prover Preview: Let's Think and Verify Step by Step
por: Shang, Shijie, et al.
Publicado: (2025)
por: Shang, Shijie, et al.
Publicado: (2025)
PhysProver: Advancing Automatic Theorem Proving for Physics
por: Zhang, Hanning, et al.
Publicado: (2026)
por: Zhang, Hanning, et al.
Publicado: (2026)
Kimina-Prover Preview: Towards Large Formal Reasoning Models with Reinforcement Learning
por: Wang, Haiming, et al.
Publicado: (2025)
por: Wang, Haiming, et al.
Publicado: (2025)
Compass: Navigating Global Marine Lead Data Integration through Expert-Guided LLM Agent
por: Liu, Yiming, et al.
Publicado: (2026)
por: Liu, Yiming, et al.
Publicado: (2026)
Avoiding Obfuscation with Prover-Estimator Debate
por: Brown-Cohen, Jonah, et al.
Publicado: (2025)
por: Brown-Cohen, Jonah, et al.
Publicado: (2025)
Seed-Prover: Deep and Broad Reasoning for Automated Theorem Proving
por: Chen, Luoxin, et al.
Publicado: (2025)
por: Chen, Luoxin, et al.
Publicado: (2025)
MPS-Prover: Advancing Stepwise Theorem Proving by Multi-Perspective Search and Data Curation
por: Liang, Zhenwen, et al.
Publicado: (2025)
por: Liang, Zhenwen, et al.
Publicado: (2025)
Inference-Time Diversity in RL-Trained Lean Theorem Provers: A Diagnostic Study
por: Burton, Zachary
Publicado: (2026)
por: Burton, Zachary
Publicado: (2026)
Hypothesis Search: Inductive Reasoning with Language Models
por: Wang, Ruocheng, et al.
Publicado: (2023)
por: Wang, Ruocheng, et al.
Publicado: (2023)
Ejemplares similares
-
Soft Best-of-n Sampling for Model Alignment
por: Verdun, Claudio Mayrink, et al.
Publicado: (2025) -
The Token Games: Evaluating Language Model Reasoning with Puzzle Duels
por: Henniger, Simon, et al.
Publicado: (2026) -
Temporal Sparse Autoencoders: Leveraging the Sequential Nature of Language for Interpretability
por: Bhalla, Usha, et al.
Publicado: (2025) -
Multi-Group Proportional Representation for Text-to-Image Models
por: Jung, Sangwon, et al.
Publicado: (2025) -
Optimized Couplings for Watermarking Large Language Models
por: Tsur, Dor, et al.
Publicado: (2025)