FANS -- Formal Answer Selection for Natural Language Math Reasoning Using Lean4
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Yao, Jiarui, Wang, Ruida, Zhang, Tong |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Let's Reason Formally: Natural-Formal Hybrid Reasoning Enhances LLM's Math Capability
par: Wang, Ruida, et autres
Publié: (2025)
par: Wang, Ruida, et autres
Publié: (2025)
MA-LoT: Model-Collaboration Lean-based Long Chain-of-Thought Reasoning enhances Formal Theorem Proving
par: Wang, Ruida, et autres
Publié: (2025)
par: Wang, Ruida, et autres
Publié: (2025)
Math Neurosurgery: Isolating Language Models' Math Reasoning Abilities Using Only Forward Passes
par: Christ, Bryan R., et autres
Publié: (2024)
par: Christ, Bryan R., et autres
Publié: (2024)
Risk-Controlled Lean-as-Judge for Natural-Language Mathematical Reasoning
par: Bourigault, Pauline, et autres
Publié: (2026)
par: Bourigault, Pauline, et autres
Publié: (2026)
Sandwich Reasoning: An Answer-Reasoning-Answer Approach for Low-Latency Query Correction
par: Zhang, Chen, et autres
Publié: (2026)
par: Zhang, Chen, et autres
Publié: (2026)
TabularMath: Understanding Math Reasoning over Tables with Large Language Models
par: Tian, Shi-Yu, et autres
Publié: (2025)
par: Tian, Shi-Yu, et autres
Publié: (2025)
TheoremLlama: Transforming General-Purpose LLMs into Lean4 Experts
par: Wang, Ruida, et autres
Publié: (2024)
par: Wang, Ruida, et autres
Publié: (2024)
Reliable Fine-Grained Evaluation of Natural Language Math Proofs
par: Ma, Wenjie, et autres
Publié: (2025)
par: Ma, Wenjie, et autres
Publié: (2025)
Herald: A Natural Language Annotated Lean 4 Dataset
par: Gao, Guoxiong, et autres
Publié: (2024)
par: Gao, Guoxiong, et autres
Publié: (2024)
AgenticMath: Enhancing LLM Reasoning via Agentic-based Math Data Generation
par: Liu, Xianyang, et autres
Publié: (2025)
par: Liu, Xianyang, et autres
Publié: (2025)
FormalScience: Scalable Human-in-the-Loop Autoformalisation of Science with Agentic Code Generation in Lean
par: Meadows, Jordan, et autres
Publié: (2026)
par: Meadows, Jordan, et autres
Publié: (2026)
GAR: Generative Adversarial Reinforcement Learning for Formal Theorem Proving
par: Wang, Ruida, et autres
Publié: (2025)
par: Wang, Ruida, et autres
Publié: (2025)
Correct Answers from Sound Reasoning: Verifiable Process Supervision for Language Models
par: Kim, Kyuyoung, et autres
Publié: (2026)
par: Kim, Kyuyoung, et autres
Publié: (2026)
MultiMath: Bridging Visual and Mathematical Reasoning for Large Language Models
par: Peng, Shuai, et autres
Publié: (2024)
par: Peng, Shuai, et autres
Publié: (2024)
Do Large Language Models Excel in Complex Logical Reasoning with Formal Language?
par: Jiang, Jin, et autres
Publié: (2025)
par: Jiang, Jin, et autres
Publié: (2025)
Self-Consistency Boosts Calibration for Math Reasoning
par: Wang, Ante, et autres
Publié: (2024)
par: Wang, Ante, et autres
Publié: (2024)
PhysProver: Advancing Automatic Theorem Proving for Physics
par: Zhang, Hanning, et autres
Publié: (2026)
par: Zhang, Hanning, et autres
Publié: (2026)
Beyond Natural Language: LLMs Leveraging Alternative Formats for Enhanced Reasoning and Communication
par: Chen, Weize, et autres
Publié: (2024)
par: Chen, Weize, et autres
Publié: (2024)
From Informal to Formal -- Incorporating and Evaluating LLMs on Natural Language Requirements to Verifiable Formal Proofs
par: Cao, Jialun, et autres
Publié: (2025)
par: Cao, Jialun, et autres
Publié: (2025)
Reasoning or Retrieval? A Study of Answer Attribution on Large Reasoning Models
par: Wang, Yuhui, et autres
Publié: (2025)
par: Wang, Yuhui, et autres
Publié: (2025)
Latent Self-Consistency for Reliable Majority-Set Selection in Short- and Long-Answer Reasoning
par: Oh, Jungsuk, et autres
Publié: (2025)
par: Oh, Jungsuk, et autres
Publié: (2025)
MathOdyssey: Benchmarking Mathematical Problem-Solving Skills in Large Language Models Using Odyssey Math Data
par: Fang, Meng, et autres
Publié: (2024)
par: Fang, Meng, et autres
Publié: (2024)
Logic Contrastive Reasoning with Lightweight Large Language Model for Math Word Problems
par: Kai, Ding, et autres
Publié: (2024)
par: Kai, Ding, et autres
Publié: (2024)
GRIP: In-Parameter Graph Reasoning through Fine-Tuning Large Language Models
par: Feng, Jiarui, et autres
Publié: (2025)
par: Feng, Jiarui, et autres
Publié: (2025)
Formal-LLM: Integrating Formal Language and Natural Language for Controllable LLM-based Agents
par: Li, Zelong, et autres
Publié: (2024)
par: Li, Zelong, et autres
Publié: (2024)
Reasoning Curriculum: Bootstrapping Broad LLM Reasoning from Math
par: Pang, Bo, et autres
Publié: (2025)
par: Pang, Bo, et autres
Publié: (2025)
REAMS: Reasoning Enhanced Algorithm for Maths Solving
par: Singh, Eishkaran, et autres
Publié: (2025)
par: Singh, Eishkaran, et autres
Publié: (2025)
DART-Math: Difficulty-Aware Rejection Tuning for Mathematical Problem-Solving
par: Tong, Yuxuan, et autres
Publié: (2024)
par: Tong, Yuxuan, et autres
Publié: (2024)
SuperCLUE-Math6: Graded Multi-Step Math Reasoning Benchmark for LLMs in Chinese
par: Xu, Liang, et autres
Publié: (2024)
par: Xu, Liang, et autres
Publié: (2024)
DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models
par: Shao, Zhihong, et autres
Publié: (2024)
par: Shao, Zhihong, et autres
Publié: (2024)
ConceptMath: A Bilingual Concept-wise Benchmark for Measuring Mathematical Reasoning of Large Language Models
par: Wu, Yanan, et autres
Publié: (2024)
par: Wu, Yanan, et autres
Publié: (2024)
Finding Answers in Thought Matters: Revisiting Evaluation on Large Language Models with Reasoning
par: Jo, Hwiyeol, et autres
Publié: (2025)
par: Jo, Hwiyeol, et autres
Publié: (2025)
Implicit Probabilistic Reasoning Does Not Reflect Explicit Answers in Large Language Models
par: Mondal, Manuel, et autres
Publié: (2024)
par: Mondal, Manuel, et autres
Publié: (2024)
MuggleMath: Assessing the Impact of Query and Response Augmentation on Math Reasoning
par: Li, Chengpeng, et autres
Publié: (2023)
par: Li, Chengpeng, et autres
Publié: (2023)
FormalProofBench: Can Models Write Graduate Level Math Proofs That Are Formally Verified?
par: Ravi, Nikil, et autres
Publié: (2026)
par: Ravi, Nikil, et autres
Publié: (2026)
MathScale: Scaling Instruction Tuning for Mathematical Reasoning
par: Tang, Zhengyang, et autres
Publié: (2024)
par: Tang, Zhengyang, et autres
Publié: (2024)
DataAgent: Evaluating Large Language Models' Ability to Answer Zero-Shot, Natural Language Queries
par: Mishra, Manit, et autres
Publié: (2024)
par: Mishra, Manit, et autres
Publié: (2024)
RoMath: A Mathematical Reasoning Benchmark in Romanian
par: Cosma, Adrian, et autres
Publié: (2024)
par: Cosma, Adrian, et autres
Publié: (2024)
Reasoning with Natural Language Explanations
par: Valentino, Marco, et autres
Publié: (2024)
par: Valentino, Marco, et autres
Publié: (2024)
SLAM: Towards Efficient Multilingual Reasoning via Selective Language Alignment
par: Fan, Yuchun, et autres
Publié: (2025)
par: Fan, Yuchun, et autres
Publié: (2025)
Documents similaires
-
Let's Reason Formally: Natural-Formal Hybrid Reasoning Enhances LLM's Math Capability
par: Wang, Ruida, et autres
Publié: (2025) -
MA-LoT: Model-Collaboration Lean-based Long Chain-of-Thought Reasoning enhances Formal Theorem Proving
par: Wang, Ruida, et autres
Publié: (2025) -
Math Neurosurgery: Isolating Language Models' Math Reasoning Abilities Using Only Forward Passes
par: Christ, Bryan R., et autres
Publié: (2024) -
Risk-Controlled Lean-as-Judge for Natural-Language Mathematical Reasoning
par: Bourigault, Pauline, et autres
Publié: (2026) -
Sandwich Reasoning: An Answer-Reasoning-Answer Approach for Low-Latency Query Correction
par: Zhang, Chen, et autres
Publié: (2026)