Can Large Language Models Always Solve Easy Problems if They Can Solve Harder Ones?
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Yang, Zhe, Zhang, Yichang, Liu, Tianyu, Yang, Jian, Lin, Junyang, Zhou, Chang, Sui, Zhifang |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
A Probabilistic Inference Scaling Theory for LLM Self-Correction
par: Yang, Zhe, et autres
Publié: (2025)
par: Yang, Zhe, et autres
Publié: (2025)
Confidence v.s. Critique: A Decomposition of Self-Correction Capability for LLMs
par: Yang, Zhe, et autres
Publié: (2024)
par: Yang, Zhe, et autres
Publié: (2024)
Can Large Multimodal Models Uncover Deep Semantics Behind Images?
par: Yang, Yixin, et autres
Publié: (2024)
par: Yang, Yixin, et autres
Publié: (2024)
Can Language Models Solve Graph Problems in Natural Language?
par: Wang, Heng, et autres
Publié: (2023)
par: Wang, Heng, et autres
Publié: (2023)
Can LLMs Solve longer Math Word Problems Better?
par: Xu, Xin, et autres
Publié: (2024)
par: Xu, Xin, et autres
Publié: (2024)
Can Language Models Solve Olympiad Programming?
par: Shi, Quan, et autres
Publié: (2024)
par: Shi, Quan, et autres
Publié: (2024)
Large Language Models Can Solve Real-World Planning Rigorously with Formal Verification Tools
par: Hao, Yilun, et autres
Publié: (2024)
par: Hao, Yilun, et autres
Publié: (2024)
Can Vision-Language Models Solve the Shell Game?
par: Liu, Tiedong, et autres
Publié: (2026)
par: Liu, Tiedong, et autres
Publié: (2026)
Solving for X and Beyond: Can Large Language Models Solve Complex Math Problems with More-Than-Two Unknowns?
par: Kao, Kuei-Chun, et autres
Publié: (2024)
par: Kao, Kuei-Chun, et autres
Publié: (2024)
Can Large Language Models Solve Robot Routing?
par: Huang, Zhehui, et autres
Publié: (2024)
par: Huang, Zhehui, et autres
Publié: (2024)
Can Language Models Be Tricked by Language Illusions? Easier with Syntax, Harder with Semantics
par: Zhang, Yuhan, et autres
Publié: (2023)
par: Zhang, Yuhan, et autres
Publié: (2023)
Unlocking Efficiency in Large Language Model Inference: A Comprehensive Survey of Speculative Decoding
par: Xia, Heming, et autres
Publié: (2024)
par: Xia, Heming, et autres
Publié: (2024)
Physics Reasoner: Knowledge-Augmented Reasoning for Solving Physics Problems with Large Language Models
par: Pang, Xinyu, et autres
Publié: (2024)
par: Pang, Xinyu, et autres
Publié: (2024)
Pass@K Policy Optimization: Solving Harder Reinforcement Learning Problems
par: Walder, Christian, et autres
Publié: (2025)
par: Walder, Christian, et autres
Publié: (2025)
Solving Math Word Problems via Cooperative Reasoning induced Language Models
par: Zhu, Xinyu, et autres
Publié: (2022)
par: Zhu, Xinyu, et autres
Publié: (2022)
Exploring Solution Divergence and Its Effect on Large Language Model Problem Solving
par: Li, Hang, et autres
Publié: (2025)
par: Li, Hang, et autres
Publié: (2025)
Plan of Thoughts: Heuristic-Guided Problem Solving with Large Language Models
par: Liu, Houjun
Publié: (2024)
par: Liu, Houjun
Publié: (2024)
Solving General Natural-Language-Description Optimization Problems with Large Language Models
par: Zhang, Jihai, et autres
Publié: (2024)
par: Zhang, Jihai, et autres
Publié: (2024)
FCoReBench: Can Large Language Models Solve Challenging First-Order Combinatorial Reasoning Problems?
par: Mittal, Chinmay, et autres
Publié: (2024)
par: Mittal, Chinmay, et autres
Publié: (2024)
Linear Reasoning vs. Proof by Cases: Obstacles for Large Language Models in FOL Problem Solving
par: Ji, Yuliang, et autres
Publié: (2026)
par: Ji, Yuliang, et autres
Publié: (2026)
Can Vision-Language Models Solve Visual Math Equations?
par: Choudhury, Monjoy Narayan, et autres
Publié: (2025)
par: Choudhury, Monjoy Narayan, et autres
Publié: (2025)
Distill Not Only Data but Also Rewards: Can Smaller Language Models Surpass Larger Ones?
par: Zhang, Yudi, et autres
Publié: (2025)
par: Zhang, Yudi, et autres
Publié: (2025)
How Diversely Can Language Models Solve Problems? Exploring the Algorithmic Diversity of Model-Generated Code
par: Lee, Seonghyeon, et autres
Publié: (2025)
par: Lee, Seonghyeon, et autres
Publié: (2025)
GCoder: Improving Large Language Model for Generalized Graph Problem Solving
par: Zhang, Qifan, et autres
Publié: (2024)
par: Zhang, Qifan, et autres
Publié: (2024)
Reinforcement Learning Problem Solving with Large Language Models
par: Gholamian, Sina, et autres
Publié: (2024)
par: Gholamian, Sina, et autres
Publié: (2024)
Speak It Out: Solving Symbol-Related Problems with Symbol-to-Language Conversion for Language Models
par: Wang, Yile, et autres
Publié: (2024)
par: Wang, Yile, et autres
Publié: (2024)
StrategyLLM: Large Language Models as Strategy Generators, Executors, Optimizers, and Evaluators for Problem Solving
par: Gao, Chang, et autres
Publié: (2023)
par: Gao, Chang, et autres
Publié: (2023)
Token-Supervised Value Models for Enhancing Mathematical Problem-Solving Capabilities of Large Language Models
par: Lee, Jung Hyun, et autres
Publié: (2024)
par: Lee, Jung Hyun, et autres
Publié: (2024)
Alvorada-Bench: Can Language Models Solve Brazilian University Entrance Exams?
par: Godoy, Henrique
Publié: (2025)
par: Godoy, Henrique
Publié: (2025)
Taking a Deep Breath: Enhancing Language Modeling of Large Language Models with Sentinel Tokens
par: Luo, Weiyao, et autres
Publié: (2024)
par: Luo, Weiyao, et autres
Publié: (2024)
Can LLMs Generate and Solve Linguistic Olympiad Puzzles?
par: Majmudar, Neh, et autres
Publié: (2025)
par: Majmudar, Neh, et autres
Publié: (2025)
Large Language Models Struggle with Unreasonability in Math Problems
par: Ma, Jingyuan, et autres
Publié: (2024)
par: Ma, Jingyuan, et autres
Publié: (2024)
Language Models can Self-Lengthen to Generate Long Texts
par: Quan, Shanghaoran, et autres
Publié: (2024)
par: Quan, Shanghaoran, et autres
Publié: (2024)
Not All Demonstration Examples are Equally Beneficial: Reweighting Demonstration Examples for In-Context Learning
par: Yang, Zhe, et autres
Publié: (2023)
par: Yang, Zhe, et autres
Publié: (2023)
Towards Better RL Training Data Utilization via Second-Order Rollout
par: Yang, Zhe, et autres
Publié: (2026)
par: Yang, Zhe, et autres
Publié: (2026)
The Effect of Sampling Temperature on Problem Solving in Large Language Models
par: Renze, Matthew, et autres
Publié: (2024)
par: Renze, Matthew, et autres
Publié: (2024)
Perspective Transition of Large Language Models for Solving Subjective Tasks
par: Wang, Xiaolong, et autres
Publié: (2025)
par: Wang, Xiaolong, et autres
Publié: (2025)
MathLearner: A Large Language Model Agent Framework for Learning to Solve Mathematical Problems
par: Xie, Wenbei, et autres
Publié: (2024)
par: Xie, Wenbei, et autres
Publié: (2024)
Token Pruning in Multimodal Large Language Models: Are We Solving the Right Problem?
par: Wen, Zichen, et autres
Publié: (2025)
par: Wen, Zichen, et autres
Publié: (2025)
Can LLMs Solve My Grandma's Riddle? Evaluating Multilingual Large Language Models on Reasoning Traditional Bangla Tricky Riddles
par: Sayeedi, Nurul Labib, et autres
Publié: (2025)
par: Sayeedi, Nurul Labib, et autres
Publié: (2025)
Documents similaires
-
A Probabilistic Inference Scaling Theory for LLM Self-Correction
par: Yang, Zhe, et autres
Publié: (2025) -
Confidence v.s. Critique: A Decomposition of Self-Correction Capability for LLMs
par: Yang, Zhe, et autres
Publié: (2024) -
Can Large Multimodal Models Uncover Deep Semantics Behind Images?
par: Yang, Yixin, et autres
Publié: (2024) -
Can Language Models Solve Graph Problems in Natural Language?
par: Wang, Heng, et autres
Publié: (2023) -
Can LLMs Solve longer Math Word Problems Better?
par: Xu, Xin, et autres
Publié: (2024)