Solving Inequality Proofs with Large Language Models
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Lu, Pan, Sheng, Jiayi, Lyu, Luna, Jin, Jikai, Xia, Tony, Gu, Alex, Zou, James |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
ProofOptimizer: Training Language Models to Simplify Proofs without Human Demonstrations
par: Gu, Alex, et autres
Publié: (2025)
par: Gu, Alex, et autres
Publié: (2025)
Prescriptive Scaling Reveals the Evolution of Language Model Capabilities
par: Zhang, Hanlin, et autres
Publié: (2026)
par: Zhang, Hanlin, et autres
Publié: (2026)
Discovering Hierarchical Latent Capabilities of Language Models via Causal Representation Learning
par: Jin, Jikai, et autres
Publié: (2025)
par: Jin, Jikai, et autres
Publié: (2025)
SciBench: Evaluating College-Level Scientific Problem-Solving Abilities of Large Language Models
par: Wang, Xiaoxuan, et autres
Publié: (2023)
par: Wang, Xiaoxuan, et autres
Publié: (2023)
Talking Nonsense: Probing Large Language Models' Understanding of Adversarial Gibberish Inputs
par: Cherepanova, Valeriia, et autres
Publié: (2024)
par: Cherepanova, Valeriia, et autres
Publié: (2024)
ProofSketch: Efficient Verified Reasoning for Large Language Models
par: Sheshanarayana, Disha, et autres
Publié: (2025)
par: Sheshanarayana, Disha, et autres
Publié: (2025)
An Evaluation on Large Language Model Outputs: Discourse and Memorization
par: de Wynter, Adrian, et autres
Publié: (2023)
par: de Wynter, Adrian, et autres
Publié: (2023)
Graph of Thoughts: Solving Elaborate Problems with Large Language Models
par: Besta, Maciej, et autres
Publié: (2023)
par: Besta, Maciej, et autres
Publié: (2023)
Analyzing the Role of Semantic Representations in the Era of Large Language Models
par: Jin, Zhijing, et autres
Publié: (2024)
par: Jin, Zhijing, et autres
Publié: (2024)
StyleBench: Evaluating thinking styles in Large Language Models
par: Guo, Junyu, et autres
Publié: (2025)
par: Guo, Junyu, et autres
Publié: (2025)
Boosting of Thoughts: Trial-and-Error Problem Solving with Large Language Models
par: Chen, Sijia, et autres
Publié: (2024)
par: Chen, Sijia, et autres
Publié: (2024)
Branch-Solve-Merge Improves Large Language Model Evaluation and Generation
par: Saha, Swarnadeep, et autres
Publié: (2023)
par: Saha, Swarnadeep, et autres
Publié: (2023)
Offset Unlearning for Large Language Models
par: Huang, James Y., et autres
Publié: (2024)
par: Huang, James Y., et autres
Publié: (2024)
Can Large Language Models Solve Robot Routing?
par: Huang, Zhehui, et autres
Publié: (2024)
par: Huang, Zhehui, et autres
Publié: (2024)
Collaborative Performance Prediction for Large Language Models
par: Zhang, Qiyuan, et autres
Publié: (2024)
par: Zhang, Qiyuan, et autres
Publié: (2024)
Can Large Language Models Infer Causation from Correlation?
par: Jin, Zhijing, et autres
Publié: (2023)
par: Jin, Zhijing, et autres
Publié: (2023)
Solving for X and Beyond: Can Large Language Models Solve Complex Math Problems with More-Than-Two Unknowns?
par: Kao, Kuei-Chun, et autres
Publié: (2024)
par: Kao, Kuei-Chun, et autres
Publié: (2024)
Rethinking the Potential of Multimodality in Collaborative Problem Solving Diagnosis with Large Language Models
par: Wong, K., et autres
Publié: (2025)
par: Wong, K., et autres
Publié: (2025)
Characterizing Large Language Model Geometry Helps Solve Toxicity Detection and Generation
par: Balestriero, Randall, et autres
Publié: (2023)
par: Balestriero, Randall, et autres
Publié: (2023)
LogicTree: Structured Proof Exploration for Coherent and Rigorous Logical Reasoning with Large Language Models
par: He, Kang, et autres
Publié: (2025)
par: He, Kang, et autres
Publié: (2025)
FormalProofBench: Can Models Write Graduate Level Math Proofs That Are Formally Verified?
par: Ravi, Nikil, et autres
Publié: (2026)
par: Ravi, Nikil, et autres
Publié: (2026)
Taylor Unswift: Secured Weight Release for Large Language Models via Taylor Expansion
par: Wang, Guanchu, et autres
Publié: (2024)
par: Wang, Guanchu, et autres
Publié: (2024)
LLMExplainer: Large Language Model based Bayesian Inference for Graph Explanation Generation
par: Zhang, Jiaxing, et autres
Publié: (2024)
par: Zhang, Jiaxing, et autres
Publié: (2024)
ArCHer: Training Language Model Agents via Hierarchical Multi-Turn RL
par: Zhou, Yifei, et autres
Publié: (2024)
par: Zhou, Yifei, et autres
Publié: (2024)
Accelerated Preference Optimization for Large Language Model Alignment
par: He, Jiafan, et autres
Publié: (2024)
par: He, Jiafan, et autres
Publié: (2024)
Integration of Large Language Models and Federated Learning
par: Chen, Chaochao, et autres
Publié: (2023)
par: Chen, Chaochao, et autres
Publié: (2023)
Are Large Language Models Reliable AI Scientists? Assessing Reverse-Engineering of Black-Box Systems
par: Geng, Jiayi, et autres
Publié: (2025)
par: Geng, Jiayi, et autres
Publié: (2025)
Sysformer: Safeguarding Frozen Large Language Models with Adaptive System Prompts
par: Sharma, Kartik, et autres
Publié: (2025)
par: Sharma, Kartik, et autres
Publié: (2025)
Generative Evaluation of Complex Reasoning in Large Language Models
par: Lin, Haowei, et autres
Publié: (2025)
par: Lin, Haowei, et autres
Publié: (2025)
FactTest: Factuality Testing in Large Language Models with Finite-Sample and Distribution-Free Guarantees
par: Nie, Fan, et autres
Publié: (2024)
par: Nie, Fan, et autres
Publié: (2024)
GUNDAM: Aligning Large Language Models with Graph Understanding
par: Ouyang, Sheng, et autres
Publié: (2024)
par: Ouyang, Sheng, et autres
Publié: (2024)
Equivalent Linear Mappings of Large Language Models
par: Golden, James R.
Publié: (2025)
par: Golden, James R.
Publié: (2025)
A Human-Like Reasoning Framework for Multi-Phases Planning Task with Large Language Models
par: Xie, Chengxing, et autres
Publié: (2024)
par: Xie, Chengxing, et autres
Publié: (2024)
L3Ms -- Lagrange Large Language Models
par: Dhillon, Guneet S., et autres
Publié: (2024)
par: Dhillon, Guneet S., et autres
Publié: (2024)
Knowledge Boundary Discovery for Large Language Models
par: Wang, Ziquan, et autres
Publié: (2026)
par: Wang, Ziquan, et autres
Publié: (2026)
Ineq-Comp: Benchmarking Human-Intuitive Compositional Reasoning in Automated Theorem Proving on Inequalities
par: Zhao, Haoyu, et autres
Publié: (2025)
par: Zhao, Haoyu, et autres
Publié: (2025)
Leveraging Large Language Models for Solving Rare MIP Challenges
par: Wang, Teng, et autres
Publié: (2024)
par: Wang, Teng, et autres
Publié: (2024)
Training Large Language Models To Reason In Parallel With Global Forking Tokens
par: Jia, Sheng, et autres
Publié: (2025)
par: Jia, Sheng, et autres
Publié: (2025)
Self-play with Execution Feedback: Improving Instruction-following Capabilities of Large Language Models
par: Dong, Guanting, et autres
Publié: (2024)
par: Dong, Guanting, et autres
Publié: (2024)
Trustworthy Summarization via Uncertainty Quantification and Risk Awareness in Large Language Models
par: Pan, Shuaidong, et autres
Publié: (2025)
par: Pan, Shuaidong, et autres
Publié: (2025)
Documents similaires
-
ProofOptimizer: Training Language Models to Simplify Proofs without Human Demonstrations
par: Gu, Alex, et autres
Publié: (2025) -
Prescriptive Scaling Reveals the Evolution of Language Model Capabilities
par: Zhang, Hanlin, et autres
Publié: (2026) -
Discovering Hierarchical Latent Capabilities of Language Models via Causal Representation Learning
par: Jin, Jikai, et autres
Publié: (2025) -
SciBench: Evaluating College-Level Scientific Problem-Solving Abilities of Large Language Models
par: Wang, Xiaoxuan, et autres
Publié: (2023) -
Talking Nonsense: Probing Large Language Models' Understanding of Adversarial Gibberish Inputs
par: Cherepanova, Valeriia, et autres
Publié: (2024)