REFACTOR: Learning to Extract Theorems from Proofs
Fuente:
arXiv
Salvato in:
| Autori principali: | Zhou, Jin Peng, Wu, Yuhuai, Li, Qiyang, Grosse, Roger |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Reinforcement Learning with Action Chunking
di: Li, Qiyang, et al.
Pubblicazione: (2025)
di: Li, Qiyang, et al.
Pubblicazione: (2025)
Don't Trust: Verify -- Grounding LLM Quantitative Reasoning with Autoformalization
di: Zhou, Jin Peng, et al.
Pubblicazione: (2024)
di: Zhou, Jin Peng, et al.
Pubblicazione: (2024)
Flow Q-Learning
di: Park, Seohong, et al.
Pubblicazione: (2025)
di: Park, Seohong, et al.
Pubblicazione: (2025)
ProofAug: Efficient Neural Theorem Proving via Fine-grained Proof Structure Analysis
di: Liu, Haoxiong, et al.
Pubblicazione: (2025)
di: Liu, Haoxiong, et al.
Pubblicazione: (2025)
EXPO: Stable Reinforcement Learning with Expressive Policies
di: Dong, Perry, et al.
Pubblicazione: (2025)
di: Dong, Perry, et al.
Pubblicazione: (2025)
Q-learning with Adjoint Matching
di: Li, Qiyang, et al.
Pubblicazione: (2026)
di: Li, Qiyang, et al.
Pubblicazione: (2026)
Stabilizing Long-term Multi-turn Reinforcement Learning with Gated Rewards
di: Sun, Zetian, et al.
Pubblicazione: (2025)
di: Sun, Zetian, et al.
Pubblicazione: (2025)
RLDG: Robotic Generalist Policy Distillation via Reinforcement Learning
di: Xu, Charles, et al.
Pubblicazione: (2024)
di: Xu, Charles, et al.
Pubblicazione: (2024)
Leveraging Skills from Unlabeled Prior Data for Efficient Online Exploration
di: Wilcoxson, Max, et al.
Pubblicazione: (2024)
di: Wilcoxson, Max, et al.
Pubblicazione: (2024)
Discovering New Theorems via LLMs with In-Context Proof Learning in Lean
di: Kasaura, Kazumi, et al.
Pubblicazione: (2025)
di: Kasaura, Kazumi, et al.
Pubblicazione: (2025)
Decoupled Q-Chunking
di: Li, Qiyang, et al.
Pubblicazione: (2025)
di: Li, Qiyang, et al.
Pubblicazione: (2025)
Memorize Theorems, Not Instances: Probing SFT Generalization through Mathematical Reasoning
di: Peng, Ruiying, et al.
Pubblicazione: (2026)
di: Peng, Ruiying, et al.
Pubblicazione: (2026)
Task Expansion and Cross Refinement for Open-World Conditional Modeling
di: Brahmavar, Shreyas Bhat, et al.
Pubblicazione: (2026)
di: Brahmavar, Shreyas Bhat, et al.
Pubblicazione: (2026)
When Does Persona Prompting Actually Help? A Retrieval and Metric Analysis of Expert Role Injection in LLMs
di: Xiao, Shuai, et al.
Pubblicazione: (2026)
di: Xiao, Shuai, et al.
Pubblicazione: (2026)
Subgoal Search For Complex Reasoning Tasks
di: Czechowski, Konrad, et al.
Pubblicazione: (2021)
di: Czechowski, Konrad, et al.
Pubblicazione: (2021)
Reducing the Probability of Undesirable Outputs in Language Models Using Probabilistic Inference
di: Zhao, Stephen, et al.
Pubblicazione: (2025)
di: Zhao, Stephen, et al.
Pubblicazione: (2025)
ProofWala: A Framework for Multilingual Proof Data Synthesis and Theorem-Proving
di: Thakur, Amitayush, et al.
Pubblicazione: (2025)
di: Thakur, Amitayush, et al.
Pubblicazione: (2025)
Magnushammer: A Transformer-Based Approach to Premise Selection
di: Mikuła, Maciej, et al.
Pubblicazione: (2023)
di: Mikuła, Maciej, et al.
Pubblicazione: (2023)
Towards Universal Neural Likelihood Inference
di: Brahmavar, Shreyas Bhat, et al.
Pubblicazione: (2025)
di: Brahmavar, Shreyas Bhat, et al.
Pubblicazione: (2025)
Goedel-Prover: A Frontier Model for Open-Source Automated Theorem Proving
di: Lin, Yong, et al.
Pubblicazione: (2025)
di: Lin, Yong, et al.
Pubblicazione: (2025)
Probabilistic Inference in Language Models via Twisted Sequential Monte Carlo
di: Zhao, Stephen, et al.
Pubblicazione: (2024)
di: Zhao, Stephen, et al.
Pubblicazione: (2024)
Extracting Heuristics from Large Language Models for Reward Shaping in Reinforcement Learning
di: Bhambri, Siddhant, et al.
Pubblicazione: (2024)
di: Bhambri, Siddhant, et al.
Pubblicazione: (2024)
The Interaction Bottleneck of Deep Neural Networks: Discovery, Proof, and Modulation
di: Deng, Huiqi, et al.
Pubblicazione: (2025)
di: Deng, Huiqi, et al.
Pubblicazione: (2025)
PoLO: Proof-of-Learning and Proof-of-Ownership at Once with Chained Watermarking
di: Deng, Haiyu, et al.
Pubblicazione: (2025)
di: Deng, Haiyu, et al.
Pubblicazione: (2025)
Neural Interactive Proofs
di: Hammond, Lewis, et al.
Pubblicazione: (2024)
di: Hammond, Lewis, et al.
Pubblicazione: (2024)
Representer Theorems for Metric and Preference Learning: Geometric Insights and Algorithms
di: Morteza, Peyman
Pubblicazione: (2023)
di: Morteza, Peyman
Pubblicazione: (2023)
GAR: Generative Adversarial Reinforcement Learning for Formal Theorem Proving
di: Wang, Ruida, et al.
Pubblicazione: (2025)
di: Wang, Ruida, et al.
Pubblicazione: (2025)
Latent Knowledge Scalpel: Precise and Massive Knowledge Editing for Large Language Models
di: Liu, Xin, et al.
Pubblicazione: (2025)
di: Liu, Xin, et al.
Pubblicazione: (2025)
Precise gradient descent training dynamics for finite-width multi-layer neural networks
di: Han, Qiyang, et al.
Pubblicazione: (2025)
di: Han, Qiyang, et al.
Pubblicazione: (2025)
Frac-Connections: Fractional Extension of Hyper-Connections
di: Zhu, Defa, et al.
Pubblicazione: (2025)
di: Zhu, Defa, et al.
Pubblicazione: (2025)
TimeSieve: Extracting Temporal Dynamics through Information Bottlenecks
di: Feng, Ninghui, et al.
Pubblicazione: (2024)
di: Feng, Ninghui, et al.
Pubblicazione: (2024)
Learning from Teaching Regularization: Generalizable Correlations Should be Easy to Imitate
di: Jin, Can, et al.
Pubblicazione: (2024)
di: Jin, Can, et al.
Pubblicazione: (2024)
A Survey of Zero-Knowledge Proof Based Verifiable Machine Learning
di: Peng, Zhizhi, et al.
Pubblicazione: (2025)
di: Peng, Zhizhi, et al.
Pubblicazione: (2025)
The FIX Benchmark: Extracting Features Interpretable to eXperts
di: Jin, Helen, et al.
Pubblicazione: (2024)
di: Jin, Helen, et al.
Pubblicazione: (2024)
Distributional Training Data Attribution: What do Influence Functions Sample?
di: Mlodozeniec, Bruno, et al.
Pubblicazione: (2025)
di: Mlodozeniec, Bruno, et al.
Pubblicazione: (2025)
PoGO: A Scalable Proof of Useful Work via Quantized Gradient Descent and Merkle Proofs
di: Orlicki, José I.
Pubblicazione: (2025)
di: Orlicki, José I.
Pubblicazione: (2025)
Learning Reconstructive Embeddings in Reproducing Kernel Hilbert Spaces via the Representer Theorem
di: Feito-Casares, Enrique, et al.
Pubblicazione: (2026)
di: Feito-Casares, Enrique, et al.
Pubblicazione: (2026)
Learning to Reason with Insight for Informal Theorem Proving
di: Li, Yunhe, et al.
Pubblicazione: (2026)
di: Li, Yunhe, et al.
Pubblicazione: (2026)
BlackBoxToBlueprint: Extracting Interpretable Logic from Legacy Systems using Reinforcement Learning and Counterfactual Analysis
di: Rathore, Vidhi
Pubblicazione: (2025)
di: Rathore, Vidhi
Pubblicazione: (2025)
Impossibility Theorems for Feature Attribution
di: Bilodeau, Blair, et al.
Pubblicazione: (2022)
di: Bilodeau, Blair, et al.
Pubblicazione: (2022)
Documenti analoghi
-
Reinforcement Learning with Action Chunking
di: Li, Qiyang, et al.
Pubblicazione: (2025) -
Don't Trust: Verify -- Grounding LLM Quantitative Reasoning with Autoformalization
di: Zhou, Jin Peng, et al.
Pubblicazione: (2024) -
Flow Q-Learning
di: Park, Seohong, et al.
Pubblicazione: (2025) -
ProofAug: Efficient Neural Theorem Proving via Fine-grained Proof Structure Analysis
di: Liu, Haoxiong, et al.
Pubblicazione: (2025) -
EXPO: Stable Reinforcement Learning with Expressive Policies
di: Dong, Perry, et al.
Pubblicazione: (2025)