A Measure-Theoretic Analysis of Reasoning: Structural Generalization and Approximation Limits
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Zhang, Yuyang, Zhang, Yifu, Zhou, Xuehai, Chen, Xiaoyin |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
The Computational Limits of State-Space Models and Mamba via the Lens of Circuit Complexity
par: Chen, Yifang, et autres
Publié: (2024)
par: Chen, Yifang, et autres
Publié: (2024)
NPHardEval: Dynamic Benchmark on Reasoning Ability of Large Language Models via Complexity Classes
par: Fan, Lizhou, et autres
Publié: (2023)
par: Fan, Lizhou, et autres
Publié: (2023)
Theoretical Constraints on the Expressive Power of $\mathsf{RoPE}$-based Tensor Attention Transformers
par: Li, Xiaoyu, et autres
Publié: (2024)
par: Li, Xiaoyu, et autres
Publié: (2024)
Neural Algorithmic Reasoning for Hypergraphs with Looped Transformers
par: Huang, Zekai, et autres
Publié: (2025)
par: Huang, Zekai, et autres
Publié: (2025)
Reinforced Generation of Combinatorial Structures: Hardness of Approximation
par: Nagda, Ansh, et autres
Publié: (2025)
par: Nagda, Ansh, et autres
Publié: (2025)
Limitations on Accurate, Trusted, Human-level Reasoning
par: Panigrahy, Rina, et autres
Publié: (2025)
par: Panigrahy, Rina, et autres
Publié: (2025)
On Fine-Grained I/O Complexity of Attention Backward Passes
par: Li, Xiaoyu, et autres
Publié: (2024)
par: Li, Xiaoyu, et autres
Publié: (2024)
Time and Memory Trade-off of KV-Cache Compression in Tensor Transformer Decoding
par: Chen, Yifang, et autres
Publié: (2025)
par: Chen, Yifang, et autres
Publié: (2025)
Circuit Complexity Bounds for RoPE-based Transformer Architecture
par: Chen, Bo, et autres
Publié: (2024)
par: Chen, Bo, et autres
Publié: (2024)
Demystifying the unreasonable effectiveness of online alignment methods
par: Kang, Enoch Hyunwook
Publié: (2026)
par: Kang, Enoch Hyunwook
Publié: (2026)
RoPE Attention Can Be Trained in Almost Linear Time
par: Cao, Yang, et autres
Publié: (2024)
par: Cao, Yang, et autres
Publié: (2024)
Modern Hopfield Networks Require Chain-of-Thought to Solve $\mathsf{NC}^1$-Hard Problems
par: Cao, Yang, et autres
Publié: (2024)
par: Cao, Yang, et autres
Publié: (2024)
Circuit Complexity Bounds for Visual Autoregressive Model
par: Ke, Yekun, et autres
Publié: (2025)
par: Ke, Yekun, et autres
Publié: (2025)
Unlocking the Theory Behind Scaling 1-Bit Neural Networks
par: Daliri, Majid, et autres
Publié: (2024)
par: Daliri, Majid, et autres
Publié: (2024)
Position: Scaling LLM Agents Requires Asymptotic Analysis with LLM Primitives
par: Meyerson, Elliot, et autres
Publié: (2025)
par: Meyerson, Elliot, et autres
Publié: (2025)
On the Expressive Power and Limitations of Multi-Layer SSMs
par: Zubić, Nikola, et autres
Publié: (2026)
par: Zubić, Nikola, et autres
Publié: (2026)
AgentDoG: A Diagnostic Guardrail Framework for AI Agent Safety and Security
par: Liu, Dongrui, et autres
Publié: (2026)
par: Liu, Dongrui, et autres
Publié: (2026)
When Can We Solve the Weighted Low Rank Approximation Problem in Truly Subquadratic Time?
par: Li, Chenyang, et autres
Publié: (2025)
par: Li, Chenyang, et autres
Publié: (2025)
Computational Limits of Low-Rank Adaptation (LoRA) Fine-Tuning for Transformer Models
par: Hu, Jerry Yao-Chieh, et autres
Publié: (2024)
par: Hu, Jerry Yao-Chieh, et autres
Publié: (2024)
GTBench: Uncovering the Strategic Reasoning Limitations of LLMs via Game-Theoretic Evaluations
par: Duan, Jinhao, et autres
Publié: (2024)
par: Duan, Jinhao, et autres
Publié: (2024)
Have Large Language Models Learned to Reason? A Characterization via 3-SAT Phase Transition
par: Hazra, Rishi, et autres
Publié: (2025)
par: Hazra, Rishi, et autres
Publié: (2025)
Provable Failure of Language Models in Learning Majority Boolean Logic via Gradient Descent
par: Chen, Bo, et autres
Publié: (2025)
par: Chen, Bo, et autres
Publié: (2025)
Compositional Generalization from Learned Skills via CoT Training: A Theoretical and Structural Analysis for Reasoning
par: Yao, Xinhao, et autres
Publié: (2025)
par: Yao, Xinhao, et autres
Publié: (2025)
A Complexity Map of Probabilistic Reasoning for Neurosymbolic Classification Techniques
par: Ledaguenel, Arthur, et autres
Publié: (2024)
par: Ledaguenel, Arthur, et autres
Publié: (2024)
How Much Cache Does Reasoning Need? Depth-Cache Tradeoffs in KV-Compressed Transformers
par: Wang, Xiao
Publié: (2026)
par: Wang, Xiao
Publié: (2026)
Lossless Model Compression via Joint Low-Rank Factorization Optimization
par: Zhang, Boyang, et autres
Publié: (2024)
par: Zhang, Boyang, et autres
Publié: (2024)
Revisiting Padded Transformer Expressivity: Which Architectural Choices Matter and Which Don't
par: Svete, Anej, et autres
Publié: (2026)
par: Svete, Anej, et autres
Publié: (2026)
Transformers Can Represent $n$-gram Language Models
par: Svete, Anej, et autres
Publié: (2024)
par: Svete, Anej, et autres
Publié: (2024)
On the Computational Capability of Graph Neural Networks: A Circuit Complexity Bound Perspective
par: Li, Xiaoyu, et autres
Publié: (2025)
par: Li, Xiaoyu, et autres
Publié: (2025)
Inference Scaling vs Reasoning: An Empirical Analysis of Compute-Optimal LLM Problem-Solving
par: AbdElhameed, Marwan, et autres
Publié: (2024)
par: AbdElhameed, Marwan, et autres
Publié: (2024)
Theoretical limitations of multi-layer Transformer
par: Chen, Lijie, et autres
Publié: (2024)
par: Chen, Lijie, et autres
Publié: (2024)
On Computational Limits and Provably Efficient Criteria of Visual Autoregressive Models: A Fine-Grained Complexity Analysis
par: Ke, Yekun, et autres
Publié: (2025)
par: Ke, Yekun, et autres
Publié: (2025)
Fundamental Limitations on Subquadratic Alternatives to Transformers
par: Alman, Josh, et autres
Publié: (2024)
par: Alman, Josh, et autres
Publié: (2024)
Journalists, Emotions, and the Introduction of Generative AI Chatbots: A Large-Scale Analysis of Tweets Before and After the Launch of ChatGPT
par: Lewis, Seth C., et autres
Publié: (2024)
par: Lewis, Seth C., et autres
Publié: (2024)
A Provable Expressiveness Hierarchy in Hybrid Linear-Full Attention
par: Ye, Xiaowei, et autres
Publié: (2026)
par: Ye, Xiaowei, et autres
Publié: (2026)
Looped ReLU MLPs May Be All You Need as Practical Programmable Computers
par: Liang, Yingyu, et autres
Publié: (2024)
par: Liang, Yingyu, et autres
Publié: (2024)
The Agent Capability Problem: Predicting Solvability Through Information-Theoretic Bounds
par: Lutati, Shahar
Publié: (2025)
par: Lutati, Shahar
Publié: (2025)
Transformer Encoder Satisfiability: Complexity and Impact on Formal Reasoning
par: Sälzer, Marco, et autres
Publié: (2024)
par: Sälzer, Marco, et autres
Publié: (2024)
Infinite Time Turing Machines and their Applications
par: Weerawarana, Rukmal, et autres
Publié: (2025)
par: Weerawarana, Rukmal, et autres
Publié: (2025)
Stronger Approximation Guarantees for Non-Monotone γ-Weakly DR-Submodular Maximization
par: Jadav, Hareshkumar, et autres
Publié: (2026)
par: Jadav, Hareshkumar, et autres
Publié: (2026)
Documents similaires
-
The Computational Limits of State-Space Models and Mamba via the Lens of Circuit Complexity
par: Chen, Yifang, et autres
Publié: (2024) -
NPHardEval: Dynamic Benchmark on Reasoning Ability of Large Language Models via Complexity Classes
par: Fan, Lizhou, et autres
Publié: (2023) -
Theoretical Constraints on the Expressive Power of $\mathsf{RoPE}$-based Tensor Attention Transformers
par: Li, Xiaoyu, et autres
Publié: (2024) -
Neural Algorithmic Reasoning for Hypergraphs with Looped Transformers
par: Huang, Zekai, et autres
Publié: (2025) -
Reinforced Generation of Combinatorial Structures: Hardness of Approximation
par: Nagda, Ansh, et autres
Publié: (2025)