Lean-STaR: Learning to Interleave Thinking and Proving
Fuente:
arXiv
Salvato in:
| Autori principali: | Lin, Haohan, Sun, Zhiqing, Welleck, Sean, Yang, Yiming |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Kwai-STaR: Transform LLMs into State-Transition Reasoners
di: Lu, Xingyu, et al.
Pubblicazione: (2024)
di: Lu, Xingyu, et al.
Pubblicazione: (2024)
Quiet-STaR: Language Models Can Teach Themselves to Think Before Speaking
di: Zelikman, Eric, et al.
Pubblicazione: (2024)
di: Zelikman, Eric, et al.
Pubblicazione: (2024)
STaR: Towards Effective and Stable Table Reasoning via Slow-Thinking Large Language Models
di: Zhang, Huajian, et al.
Pubblicazione: (2025)
di: Zhang, Huajian, et al.
Pubblicazione: (2025)
STaR: Sensitive Trajectory Regulation for Unlearning in Large Reasoning Models
di: Zhou, Jingjing, et al.
Pubblicazione: (2026)
di: Zhou, Jingjing, et al.
Pubblicazione: (2026)
V-STaR: Training Verifiers for Self-Taught Reasoners
di: Hosseini, Arian, et al.
Pubblicazione: (2024)
di: Hosseini, Arian, et al.
Pubblicazione: (2024)
STaR-GATE: Teaching Language Models to Ask Clarifying Questions
di: Andukuri, Chinmaya, et al.
Pubblicazione: (2024)
di: Andukuri, Chinmaya, et al.
Pubblicazione: (2024)
Inference Scaling Laws: An Empirical Analysis of Compute-Optimal Inference for Problem-Solving with Language Models
di: Wu, Yangzhen, et al.
Pubblicazione: (2024)
di: Wu, Yangzhen, et al.
Pubblicazione: (2024)
RL-STaR: Theoretical Analysis of Reinforcement Learning Frameworks for Self-Taught Reasoner
di: Chang, Fu-Chieh, et al.
Pubblicazione: (2024)
di: Chang, Fu-Chieh, et al.
Pubblicazione: (2024)
STaR-DRO: Stateful Tsallis Reweighting for Group-Robust Structured Prediction
di: Fodeh, Samah, et al.
Pubblicazione: (2026)
di: Fodeh, Samah, et al.
Pubblicazione: (2026)
STaR: Scalable Task-Conditioned Retrieval for Long-Horizon Multimodal Robot Memory
di: Yuan, Mingfeng, et al.
Pubblicazione: (2026)
di: Yuan, Mingfeng, et al.
Pubblicazione: (2026)
miniCodeProps: a Minimal Benchmark for Proving Code Properties
di: Lohn, Evan, et al.
Pubblicazione: (2024)
di: Lohn, Evan, et al.
Pubblicazione: (2024)
B-STaR: Monitoring and Balancing Exploration and Exploitation in Self-Taught Reasoners
di: Zeng, Weihao, et al.
Pubblicazione: (2024)
di: Zeng, Weihao, et al.
Pubblicazione: (2024)
Video-STaR: Self-Training Enables Video Instruction Tuning with Any Supervision
di: Zohar, Orr, et al.
Pubblicazione: (2024)
di: Zohar, Orr, et al.
Pubblicazione: (2024)
miniCTX: Neural Theorem Proving with (Long-)Contexts
di: Hu, Jiewen, et al.
Pubblicazione: (2024)
di: Hu, Jiewen, et al.
Pubblicazione: (2024)
L1: Controlling How Long A Reasoning Model Thinks With Reinforcement Learning
di: Aggarwal, Pranjal, et al.
Pubblicazione: (2025)
di: Aggarwal, Pranjal, et al.
Pubblicazione: (2025)
STaR-Attack: A Spatio-Temporal and Narrative Reasoning Attack Framework for Unified Multimodal Understanding and Generation Models
di: Guo, Shaoxiong, et al.
Pubblicazione: (2025)
di: Guo, Shaoxiong, et al.
Pubblicazione: (2025)
HS-STaR: Hierarchical Sampling for Self-Taught Reasoners via Difficulty Estimation and Budget Reallocation
di: Xiong, Feng, et al.
Pubblicazione: (2025)
di: Xiong, Feng, et al.
Pubblicazione: (2025)
STaR-KV: Spatio-Temporal Adaptive Re-weighting for KV Cache Compression in GUI Vision-Language Models
di: Han, Yuhang, et al.
Pubblicazione: (2026)
di: Han, Yuhang, et al.
Pubblicazione: (2026)
Agentic-R1: Distilled Dual-Strategy Reasoning
di: Du, Weihua, et al.
Pubblicazione: (2025)
di: Du, Weihua, et al.
Pubblicazione: (2025)
Fast Quiet-STaR: Thinking Without Thought Tokens
di: Huang, Wei, et al.
Pubblicazione: (2025)
di: Huang, Wei, et al.
Pubblicazione: (2025)
Optimizing Temperature for Language Models with Multi-Sample Inference
di: Du, Weihua, et al.
Pubblicazione: (2025)
di: Du, Weihua, et al.
Pubblicazione: (2025)
GradAlign: Gradient-Aligned Data Selection for LLM Reinforcement Learning
di: Yang, Ningyuan, et al.
Pubblicazione: (2026)
di: Yang, Ningyuan, et al.
Pubblicazione: (2026)
Easy-to-Hard Generalization: Scalable Alignment Beyond Human Supervision
di: Sun, Zhiqing, et al.
Pubblicazione: (2024)
di: Sun, Zhiqing, et al.
Pubblicazione: (2024)
Premise Selection for a Lean Hammer
di: Zhu, Thomas, et al.
Pubblicazione: (2025)
di: Zhu, Thomas, et al.
Pubblicazione: (2025)
Distilling LLM Feedback for Lean Theorem Proving
di: Narozniak, Gaetan, et al.
Pubblicazione: (2026)
di: Narozniak, Gaetan, et al.
Pubblicazione: (2026)
LeanSearch v2: Global Premise Retrieval for Lean 4 Theorem Proving
di: Gao, Guoxiong, et al.
Pubblicazione: (2026)
di: Gao, Guoxiong, et al.
Pubblicazione: (2026)
Lean Copilot: Large Language Models as Copilots for Theorem Proving in Lean
di: Song, Peiyang, et al.
Pubblicazione: (2024)
di: Song, Peiyang, et al.
Pubblicazione: (2024)
LeanAgent: Lifelong Learning for Formal Theorem Proving
di: Kumarappan, Adarsh, et al.
Pubblicazione: (2024)
di: Kumarappan, Adarsh, et al.
Pubblicazione: (2024)
Thinking in Text and Images: Interleaved Vision--Language Reasoning Traces for Long-Horizon Robot Manipulation
di: Liu, Jinkun, et al.
Pubblicazione: (2026)
di: Liu, Jinkun, et al.
Pubblicazione: (2026)
LeanConjecturer: Automatic Generation of Mathematical Conjectures for Theorem Proving
di: Onda, Naoto, et al.
Pubblicazione: (2025)
di: Onda, Naoto, et al.
Pubblicazione: (2025)
AlphaVerus: Bootstrapping Formally Verified Code Generation through Self-Improving Translation and Treefinement
di: Aggarwal, Pranjal, et al.
Pubblicazione: (2024)
di: Aggarwal, Pranjal, et al.
Pubblicazione: (2024)
Gym-Anything: Turn any Software into an Agent Environment
di: Aggarwal, Pranjal, et al.
Pubblicazione: (2026)
di: Aggarwal, Pranjal, et al.
Pubblicazione: (2026)
From LLM-Generated Conjectures to Lean Formalizations: Automated Polynomial Inequality Proving via Sum-of-Squares Certificates
di: Zuo, Ruobing, et al.
Pubblicazione: (2026)
di: Zuo, Ruobing, et al.
Pubblicazione: (2026)
STaR-SQL: Self-Taught Reasoner for Text-to-SQL
di: He, Mingqian, et al.
Pubblicazione: (2025)
di: He, Mingqian, et al.
Pubblicazione: (2025)
Discover and Prove: An Open-source Agentic Framework for Hard Mode Automated Theorem Proving in Lean 4
di: Liu, Chengwu, et al.
Pubblicazione: (2026)
di: Liu, Chengwu, et al.
Pubblicazione: (2026)
A Survey on Deep Learning for Theorem Proving
di: Li, Zhaoyu, et al.
Pubblicazione: (2024)
di: Li, Zhaoyu, et al.
Pubblicazione: (2024)
Training Proactive and Personalized LLM Agents
di: Sun, Weiwei, et al.
Pubblicazione: (2025)
di: Sun, Weiwei, et al.
Pubblicazione: (2025)
FinSTaR: Towards Financial Reasoning with Time Series Reasoning Models
di: Lee, Seunghan, et al.
Pubblicazione: (2026)
di: Lee, Seunghan, et al.
Pubblicazione: (2026)
STaR: Seamless Spatial-Temporal Aware Motion Retargeting with Penetration and Consistency Constraints
di: Yang, Xiaohang, et al.
Pubblicazione: (2025)
di: Yang, Xiaohang, et al.
Pubblicazione: (2025)
Thinking with Constructions: A Benchmark and Policy Optimization for Visual-Text Interleaved Geometric Reasoning
di: Zhao, Haokun, et al.
Pubblicazione: (2026)
di: Zhao, Haokun, et al.
Pubblicazione: (2026)
Documenti analoghi
-
Kwai-STaR: Transform LLMs into State-Transition Reasoners
di: Lu, Xingyu, et al.
Pubblicazione: (2024) -
Quiet-STaR: Language Models Can Teach Themselves to Think Before Speaking
di: Zelikman, Eric, et al.
Pubblicazione: (2024) -
STaR: Towards Effective and Stable Table Reasoning via Slow-Thinking Large Language Models
di: Zhang, Huajian, et al.
Pubblicazione: (2025) -
STaR: Sensitive Trajectory Regulation for Unlearning in Large Reasoning Models
di: Zhou, Jingjing, et al.
Pubblicazione: (2026) -
V-STaR: Training Verifiers for Self-Taught Reasoners
di: Hosseini, Arian, et al.
Pubblicazione: (2024)