Exposing Weaknesses of Large Reasoning Models through Graph Algorithm Problems
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Zhang, Qifan, Ruan, Jianhao, Chen, Aochuan, Zeng, Kang, Chen, Nuo, Tang, Jing, Li, Jia |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Improving LLMs' Generalized Reasoning Abilities by Graph Problems
par: Zhang, Qifan, et autres
Publié: (2025)
par: Zhang, Qifan, et autres
Publié: (2025)
GraphArena: Evaluating and Exploring Large Language Models on Graph Computation
par: Tang, Jianheng, et autres
Publié: (2024)
par: Tang, Jianheng, et autres
Publié: (2024)
NPG-Muse: Scaling Long Chain-of-Thought Reasoning with NP-Hard Graph Problems
par: Wang, Yuyao, et autres
Publié: (2025)
par: Wang, Yuyao, et autres
Publié: (2025)
AlgBench: To What Extent Do Large Reasoning Models Understand Algorithms?
par: Sun, Henan, et autres
Publié: (2026)
par: Sun, Henan, et autres
Publié: (2026)
Rewarding Graph Reasoning Process makes LLMs more Generalized Reasoners
par: Peng, Miao, et autres
Publié: (2025)
par: Peng, Miao, et autres
Publié: (2025)
Training LLM Agents for Spontaneous, Reward-Free Self-Evolution via World Knowledge Exploration
par: Zhang, Qifan, et autres
Publié: (2026)
par: Zhang, Qifan, et autres
Publié: (2026)
How does Misinformation Affect Large Language Model Behaviors and Preferences?
par: Peng, Miao, et autres
Publié: (2025)
par: Peng, Miao, et autres
Publié: (2025)
BrainBench: Exposing the Commonsense Reasoning Gap in Large Language Models
par: Tang, Yuzhe
Publié: (2026)
par: Tang, Yuzhe
Publié: (2026)
A Survey of Cross-domain Graph Learning: Progress and Future Directions
par: Zhao, Haihong, et autres
Publié: (2025)
par: Zhao, Haihong, et autres
Publié: (2025)
From Good to Great: Improving Math Reasoning with Tool-Augmented Interleaf Prompting
par: Chen, Nuo, et autres
Publié: (2023)
par: Chen, Nuo, et autres
Publié: (2023)
GCoder: Improving Large Language Model for Generalized Graph Problem Solving
par: Zhang, Qifan, et autres
Publié: (2024)
par: Zhang, Qifan, et autres
Publié: (2024)
RAJ-PGA: Reasoning-Activated Jailbreak and Principle-Guided Alignment Framework for Large Reasoning Models
par: Chen, Jianhao, et autres
Publié: (2025)
par: Chen, Jianhao, et autres
Publié: (2025)
GRIP: In-Parameter Graph Reasoning through Fine-Tuning Large Language Models
par: Feng, Jiarui, et autres
Publié: (2025)
par: Feng, Jiarui, et autres
Publié: (2025)
Chain of Execution Supervision Promotes General Reasoning in Large Language Models
par: Chen, Nuo, et autres
Publié: (2025)
par: Chen, Nuo, et autres
Publié: (2025)
Are Large-Language Models Graph Algorithmic Reasoners?
par: Taylor, Alexander K, et autres
Publié: (2024)
par: Taylor, Alexander K, et autres
Publié: (2024)
Topology of Reasoning: Understanding Large Reasoning Models through Reasoning Graph Properties
par: Minegishi, Gouki, et autres
Publié: (2025)
par: Minegishi, Gouki, et autres
Publié: (2025)
Breaking Language Barriers in Multilingual Mathematical Reasoning: Insights and Observations
par: Chen, Nuo, et autres
Publié: (2023)
par: Chen, Nuo, et autres
Publié: (2023)
Weak-to-Strong GraphRAG: Aligning Weak Retrievers with Large Language Models for Graph-based Retrieval Augmented Generation
par: Zou, Deyu, et autres
Publié: (2025)
par: Zou, Deyu, et autres
Publié: (2025)
JudgeLRM: Large Reasoning Models as a Judge
par: Chen, Nuo, et autres
Publié: (2025)
par: Chen, Nuo, et autres
Publié: (2025)
Tackling GNARLy Problems: Graph Neural Algorithmic Reasoning Reimagined through Reinforcement Learning
par: Schutz, Alex, et autres
Publié: (2025)
par: Schutz, Alex, et autres
Publié: (2025)
SHARP: Synthesizing High-quality Aligned Reasoning Problems for Large Reasoning Models Reinforcement Learning
par: Wu, Xiong Jun, et autres
Publié: (2025)
par: Wu, Xiong Jun, et autres
Publié: (2025)
Exposing Numeracy Gaps: A Benchmark to Evaluate Fundamental Numerical Abilities in Large Language Models
par: Li, Haoyang, et autres
Publié: (2025)
par: Li, Haoyang, et autres
Publié: (2025)
Truly Assessing Fluid Intelligence of Large Language Models through Dynamic Reasoning Evaluation
par: Yang, Yue, et autres
Publié: (2025)
par: Yang, Yue, et autres
Publié: (2025)
The Oscars of AI Theater: A Survey on Role-Playing with Language Models
par: Chen, Nuo, et autres
Publié: (2024)
par: Chen, Nuo, et autres
Publié: (2024)
Incentivizing In-depth Reasoning over Long Contexts with Process Advantage Shaping
par: Peng, Miao, et autres
Publié: (2026)
par: Peng, Miao, et autres
Publié: (2026)
SpotAgent: Grounding Visual Geo-localization in Large Vision-Language Models through Agentic Reasoning
par: Jia, Furong, et autres
Publié: (2026)
par: Jia, Furong, et autres
Publié: (2026)
Micro-Defects Expose Macro-Fakes: Detecting AI-Generated Images via Local Distributional Shifts
par: Zhang, Boxuan, et autres
Publié: (2026)
par: Zhang, Boxuan, et autres
Publié: (2026)
Conflict Detection for Temporal Knowledge Graphs:A Fast Constraint Mining Algorithm and New Benchmarks
par: Chen, Jianhao, et autres
Publié: (2023)
par: Chen, Jianhao, et autres
Publié: (2023)
Incentivizing Multimodal Reasoning in Large Models for Direct Robot Manipulation
par: Tang, Weiliang, et autres
Publié: (2025)
par: Tang, Weiliang, et autres
Publié: (2025)
Parameter-Efficient Fine-Tuning with Discrete Fourier Transform
par: Gao, Ziqi, et autres
Publié: (2024)
par: Gao, Ziqi, et autres
Publié: (2024)
GraphReason: Enhancing Reasoning Capabilities of Large Language Models through A Graph-Based Verification Approach
par: Cao, Lang
Publié: (2023)
par: Cao, Lang
Publié: (2023)
ReasonGRM: Enhancing Generative Reward Models through Large Reasoning Models
par: Chen, Bin, et autres
Publié: (2025)
par: Chen, Bin, et autres
Publié: (2025)
NP-Engine: Empowering Optimization Reasoning in Large Language Models with Verifiable Synthetic NP Problems
par: Li, Xiaozhe, et autres
Publié: (2025)
par: Li, Xiaozhe, et autres
Publié: (2025)
FGeo-DRL: Deductive Reasoning for Geometric Problems through Deep Reinforcement Learning
par: Zou, Jia, et autres
Publié: (2024)
par: Zou, Jia, et autres
Publié: (2024)
Expose Before You Defend: Unifying and Enhancing Backdoor Defenses via Exposed Models
par: Li, Yige, et autres
Publié: (2024)
par: Li, Yige, et autres
Publié: (2024)
ReasonCache: Accelerating Large Reasoning Model Serving through KV Cache Sharing
par: Chen, Kaiwen, et autres
Publié: (2025)
par: Chen, Kaiwen, et autres
Publié: (2025)
Crimson: Empowering Strategic Reasoning in Cybersecurity through Large Language Models
par: Jin, Jiandong, et autres
Publié: (2024)
par: Jin, Jiandong, et autres
Publié: (2024)
Accurate and Interpretable Postmenstrual Age Prediction via Multimodal Large Language Model
par: Chen, Qifan, et autres
Publié: (2025)
par: Chen, Qifan, et autres
Publié: (2025)
ControlMath: Controllable Data Generation Promotes Math Generalist Models
par: Chen, Nuo, et autres
Publié: (2024)
par: Chen, Nuo, et autres
Publié: (2024)
Large Language Models Meet Graph Neural Networks for Text-Numeric Graph Reasoning
par: Song, Haoran, et autres
Publié: (2025)
par: Song, Haoran, et autres
Publié: (2025)
Documents similaires
-
Improving LLMs' Generalized Reasoning Abilities by Graph Problems
par: Zhang, Qifan, et autres
Publié: (2025) -
GraphArena: Evaluating and Exploring Large Language Models on Graph Computation
par: Tang, Jianheng, et autres
Publié: (2024) -
NPG-Muse: Scaling Long Chain-of-Thought Reasoning with NP-Hard Graph Problems
par: Wang, Yuyao, et autres
Publié: (2025) -
AlgBench: To What Extent Do Large Reasoning Models Understand Algorithms?
par: Sun, Henan, et autres
Publié: (2026) -
Rewarding Graph Reasoning Process makes LLMs more Generalized Reasoners
par: Peng, Miao, et autres
Publié: (2025)