Less Is More: Cognitive Load and the Single-Prompt Ceiling in LLM Mathematical Reasoning
Fuente:
arXiv
Enregistré dans:
| Auteur principal: | Cazares, Manuel Israel |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Cognitive Load Limits in Large Language Models: Benchmarking Multi-Hop Reasoning
par: Adapala, Sai Teja Reddy
Publié: (2025)
par: Adapala, Sai Teja Reddy
Publié: (2025)
Sarcasm Detection in a Less-Resourced Language
par: Đoković, Lazar, et autres
Publié: (2024)
par: Đoković, Lazar, et autres
Publié: (2024)
Integrating Expert Labels into LLM-based Emission Goal Detection: Example Selection vs Automatic Prompt Design
par: Wrzalik, Marco, et autres
Publié: (2024)
par: Wrzalik, Marco, et autres
Publié: (2024)
Language Models, Graph Searching, and Supervision Adulteration: When More Supervision is Less and How to Make More More
par: Frydenlund, Arvid
Publié: (2025)
par: Frydenlund, Arvid
Publié: (2025)
Large Language Model (LLM) Bias Index -- LLMBI
par: Oketunji, Abiodun Finbarrs, et autres
Publié: (2023)
par: Oketunji, Abiodun Finbarrs, et autres
Publié: (2023)
Mathador-LM: A Dynamic Benchmark for Mathematical Reasoning on Large Language Models
par: Kurtic, Eldar, et autres
Publié: (2024)
par: Kurtic, Eldar, et autres
Publié: (2024)
Is Less More? Quality, Quantity and Context in Idiom Processing with Natural Language Models
par: Knietaite, Agne, et autres
Publié: (2024)
par: Knietaite, Agne, et autres
Publié: (2024)
ZERA: Zero-init Instruction Evolving Refinement Agent -- From Zero Instructions to Structured Prompts via Principle-based Optimization
par: Yi, Seungyoun, et autres
Publié: (2025)
par: Yi, Seungyoun, et autres
Publié: (2025)
Thread Detection and Response Generation using Transformers with Prompt Optimisation
par: T, Kevin Joshua, et autres
Publié: (2024)
par: T, Kevin Joshua, et autres
Publié: (2024)
QUAD: Quantization and Parameter-Efficient Tuning of LLM with Activation Decomposition
par: Hu, Yuxuan, et autres
Publié: (2025)
par: Hu, Yuxuan, et autres
Publié: (2025)
Unsolvability Ceiling in Multi-LLM Routing: An Empirical Study of Evaluation Artifacts
par: Garg, Saloni, et autres
Publié: (2026)
par: Garg, Saloni, et autres
Publié: (2026)
Generalizable LLM Learning of Graph Synthetic Data with Post-training Alignment
par: Zhang, Yizhuo, et autres
Publié: (2025)
par: Zhang, Yizhuo, et autres
Publié: (2025)
External Hippocampus: Topological Cognitive Maps for Guiding Large Language Model Reasoning
par: Yan, Jian
Publié: (2025)
par: Yan, Jian
Publié: (2025)
Evaluating the Efficacy of Hybrid Deep Learning Models in Distinguishing AI-Generated Text
par: Oketunji, Abiodun Finbarrs
Publié: (2023)
par: Oketunji, Abiodun Finbarrs
Publié: (2023)
Geometric Deviation as an Unsupervised Pre-Generation Reliability Signal: Probing LLM Representations for Answerability
par: Du, Yucheng
Publié: (2026)
par: Du, Yucheng
Publié: (2026)
HYPEROFA: Expanding LLM Vocabulary to New Languages via Hypernetwork-Based Embedding Initialization
par: Özeren, Enes, et autres
Publié: (2025)
par: Özeren, Enes, et autres
Publié: (2025)
WSM: Decay-Free Learning Rate Schedule via Checkpoint Merging for LLM Pre-training
par: Tian, Changxin, et autres
Publié: (2025)
par: Tian, Changxin, et autres
Publié: (2025)
SocraSynth: Multi-LLM Reasoning with Conditional Statistics
par: Chang, Edward Y.
Publié: (2024)
par: Chang, Edward Y.
Publié: (2024)
Neural Activation Patterns Across Language Model Architectures: A Comprehensive Analysis of Cognitive Task Performance
par: Naser-Moghadasi, Mahdi, et autres
Publié: (2026)
par: Naser-Moghadasi, Mahdi, et autres
Publié: (2026)
Reasoning Over the Glyphs: Evaluation of LLM's Decipherment of Rare Scripts
par: Shih, Yu-Fei, et autres
Publié: (2025)
par: Shih, Yu-Fei, et autres
Publié: (2025)
Statistical Scouting Finds Debate-Safe but Not Debate-Useful Cases: A Matched-Ceiling Study of Open-Weight LLM Reasoning Protocols
par: Hu, Julia, et autres
Publié: (2026)
par: Hu, Julia, et autres
Publié: (2026)
PersonalLLM: Tailoring LLMs to Individual Preferences
par: Zollo, Thomas P., et autres
Publié: (2024)
par: Zollo, Thomas P., et autres
Publié: (2024)
LLM Vocabulary Compression for Low-Compute Environments
par: Vennam, Sreeram, et autres
Publié: (2024)
par: Vennam, Sreeram, et autres
Publié: (2024)
TIME: Temporally Intelligent Meta-reasoning Engine for Context-Triggered Explicit Reasoning
par: Das, Susmit
Publié: (2026)
par: Das, Susmit
Publié: (2026)
Quantization-Robust LLM Unlearning via Low-Rank Adaptation
par: Abitante, João Vitor Boer, et autres
Publié: (2026)
par: Abitante, João Vitor Boer, et autres
Publié: (2026)
HyDRA: Hybrid Dynamic Routing Architecture for Heterogeneous LLM Pools
par: Garg, Aashna, et autres
Publié: (2026)
par: Garg, Aashna, et autres
Publié: (2026)
Digital Guardians: Can GPT-4, Perspective API, and Moderation API reliably detect hate speech in reader comments of German online newspapers?
par: Weber, Manuel, et autres
Publié: (2025)
par: Weber, Manuel, et autres
Publié: (2025)
Harnessing Negative Signals: Reinforcement Distillation from Teacher Data for LLM Reasoning
par: Xu, Shuyao, et autres
Publié: (2025)
par: Xu, Shuyao, et autres
Publié: (2025)
Are LLM Uncertainty and Correctness Encoded by the Same Features? A Functional Dissociation via Sparse Autoencoders
par: Patel, Het, et autres
Publié: (2026)
par: Patel, Het, et autres
Publié: (2026)
Self-Consistency from Only Two Samples: CoT-PoT Ensembling for Efficient LLM Reasoning
par: Saparkhan, Raman, et autres
Publié: (2026)
par: Saparkhan, Raman, et autres
Publié: (2026)
Lossless Prompt Compression via Dictionary-Encoding and In-Context Learning: Enabling Cost-Effective LLM Analysis of Repetitive Data
par: de Campos, Andresa Rodrigues, et autres
Publié: (2026)
par: de Campos, Andresa Rodrigues, et autres
Publié: (2026)
Does LLM Alignment Really Need Diversity? An Empirical Study of Adapting RLVR Methods for Moral Reasoning
par: Zhang, Zhaowei, et autres
Publié: (2026)
par: Zhang, Zhaowei, et autres
Publié: (2026)
Engineering A Large Language Model From Scratch
par: Oketunji, Abiodun Finbarrs
Publié: (2024)
par: Oketunji, Abiodun Finbarrs
Publié: (2024)
Prompted Contextual Vectors for Spear-Phishing Detection
par: Nahmias, Daniel, et autres
Publié: (2024)
par: Nahmias, Daniel, et autres
Publié: (2024)
HumanLLM: Benchmarking and Improving LLM Anthropomorphism via Human Cognitive Patterns
par: Wang, Xintao, et autres
Publié: (2026)
par: Wang, Xintao, et autres
Publié: (2026)
Self-Pruned Key-Value Attention: Learning When to Write by Predicting Future Utility
par: Szilvasy, Gergely, et autres
Publié: (2026)
par: Szilvasy, Gergely, et autres
Publié: (2026)
SpatialMath: Spatial Comprehension-Infused Symbolic Reasoning for Mathematical Problem-Solving
par: Bajpai, Ashutosh, et autres
Publié: (2026)
par: Bajpai, Ashutosh, et autres
Publié: (2026)
Benchmarking Cognitive Biases in Large Language Models as Evaluators
par: Koo, Ryan, et autres
Publié: (2023)
par: Koo, Ryan, et autres
Publié: (2023)
Diagnosing and Addressing Pitfalls in KG-RAG Datasets: Toward More Reliable Benchmarking
par: Zhang, Liangliang, et autres
Publié: (2025)
par: Zhang, Liangliang, et autres
Publié: (2025)
Towards Latent Diffusion Suitable For Text
par: Midavaine, Nesta, et autres
Publié: (2026)
par: Midavaine, Nesta, et autres
Publié: (2026)
Documents similaires
-
Cognitive Load Limits in Large Language Models: Benchmarking Multi-Hop Reasoning
par: Adapala, Sai Teja Reddy
Publié: (2025) -
Sarcasm Detection in a Less-Resourced Language
par: Đoković, Lazar, et autres
Publié: (2024) -
Integrating Expert Labels into LLM-based Emission Goal Detection: Example Selection vs Automatic Prompt Design
par: Wrzalik, Marco, et autres
Publié: (2024) -
Language Models, Graph Searching, and Supervision Adulteration: When More Supervision is Less and How to Make More More
par: Frydenlund, Arvid
Publié: (2025) -
Large Language Model (LLM) Bias Index -- LLMBI
par: Oketunji, Abiodun Finbarrs, et autres
Publié: (2023)