Capabilities and Fundamental Limits of Latent Chain-of-Thought
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Zou, Jiaxuan, Xiong, Yaozhong, Liu, Yong |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Effective Frontiers: A Unification of Neural Scaling Laws
par: Zou, Jiaxuan, et autres
Publié: (2026)
par: Zou, Jiaxuan, et autres
Publié: (2026)
On the optimization dynamics of RLVR: Gradient gap and step size thresholds
par: Suk, Joe, et autres
Publié: (2025)
par: Suk, Joe, et autres
Publié: (2025)
One if by Land, Two if by Sea, Three if by Four Seas, and More to Come -- Values of Perception, Prediction, Communication, and Common Sense in Decision Making
par: Xu, Aolin
Publié: (2025)
par: Xu, Aolin
Publié: (2025)
Comparing Few to Rank Many: Active Human Preference Learning using Randomized Frank-Wolfe
par: Thekumparampil, Kiran Koshy, et autres
Publié: (2024)
par: Thekumparampil, Kiran Koshy, et autres
Publié: (2024)
Accelerating Convergence of Score-Based Diffusion Models, Provably
par: Li, Gen, et autres
Publié: (2024)
par: Li, Gen, et autres
Publié: (2024)
Multi-head Transformers Provably Learn Symbolic Multi-step Reasoning via Gradient Descent
par: Yang, Tong, et autres
Publié: (2025)
par: Yang, Tong, et autres
Publié: (2025)
Transformers Provably Learn Chain-of-Thought Reasoning with Length Generalization
par: Huang, Yu, et autres
Publié: (2025)
par: Huang, Yu, et autres
Publié: (2025)
Queueing-Aware Optimization of Reasoning Tokens for Accuracy-Latency Trade-offs in LLM Servers
par: Ozbas, Emre, et autres
Publié: (2026)
par: Ozbas, Emre, et autres
Publié: (2026)
Stochastic Optimization of Inventory at Large-scale Supply Chains
par: Jin, Zhaoyang Larry, et autres
Publié: (2025)
par: Jin, Zhaoyang Larry, et autres
Publié: (2025)
Exploring Applications of State Space Models and Advanced Training Techniques in Sequential Recommendations: A Comparative Study on Efficiency and Performance
par: Obozov, Mark, et autres
Publié: (2024)
par: Obozov, Mark, et autres
Publié: (2024)
Group Projected Subspace Pursuit for Block Sparse Signal Reconstruction: Convergence Analysis and Applications
par: He, Roy Y., et autres
Publié: (2024)
par: He, Roy Y., et autres
Publié: (2024)
The Local Landscape of Phase Retrieval Under Limited Samples
par: Liu, Kaizhao, et autres
Publié: (2023)
par: Liu, Kaizhao, et autres
Publié: (2023)
Reinforcement Learning under Latent Dynamics: Toward Statistical and Algorithmic Modularity
par: Amortila, Philip, et autres
Publié: (2024)
par: Amortila, Philip, et autres
Publié: (2024)
Finite-Time Minimax Bounds and an Optimal Lyapunov Policy in Queueing Control
par: Liu, Yujie, et autres
Publié: (2025)
par: Liu, Yujie, et autres
Publié: (2025)
Multi-beam Beamforming in RIS-aided MIMO Subject to Reradiation Mask Constraints -- Optimization and Machine Learning Design
par: Wang, Shumin, et autres
Publié: (2025)
par: Wang, Shumin, et autres
Publié: (2025)
OptiRepair: Closed-Loop Diagnosis and Repair of Supply Chain Optimization Models with LLM Agents
par: Ao, Ruicheng, et autres
Publié: (2026)
par: Ao, Ruicheng, et autres
Publié: (2026)
Capabilities of Large Language Models in Control Engineering: A Benchmark Study on GPT-4, Claude 3 Opus, and Gemini 1.0 Ultra
par: Kevian, Darioush, et autres
Publié: (2024)
par: Kevian, Darioush, et autres
Publié: (2024)
Decoupled Continuous-Time Reinforcement Learning via Hamiltonian Flow
par: Nguyen, Minh
Publié: (2026)
par: Nguyen, Minh
Publié: (2026)
Byzantine Machine Learning: MultiKrum and an optimal notion of robustness
par: Bareilles, Gilles, et autres
Publié: (2026)
par: Bareilles, Gilles, et autres
Publié: (2026)
Sinkhorn Based Associative Memory Retrieval Using Spherical Hellinger Kantorovich Dynamics
par: Mustafi, Aratrika, et autres
Publié: (2026)
par: Mustafi, Aratrika, et autres
Publié: (2026)
Optimism Stabilizes Thompson Sampling for Adaptive Inference
par: Yan, Shunxing, et autres
Publié: (2026)
par: Yan, Shunxing, et autres
Publié: (2026)
Straight-Through meets Sparse Recovery: the Support Exploration Algorithm
par: Mohamed, Mimoun, et autres
Publié: (2023)
par: Mohamed, Mimoun, et autres
Publié: (2023)
Inverse Mixed-Integer Programming: Learning Constraints then Objective Functions
par: Kitaoka, Akira
Publié: (2025)
par: Kitaoka, Akira
Publié: (2025)
A Differential and Pointwise Control Approach to Reinforcement Learning
par: Nguyen, Minh, et autres
Publié: (2024)
par: Nguyen, Minh, et autres
Publié: (2024)
Precise gradient descent training dynamics for finite-width multi-layer neural networks
par: Han, Qiyang, et autres
Publié: (2025)
par: Han, Qiyang, et autres
Publié: (2025)
Training Dynamics of Multi-Head Softmax Attention for In-Context Learning: Emergence, Convergence, and Optimality
par: Chen, Siyu, et autres
Publié: (2024)
par: Chen, Siyu, et autres
Publié: (2024)
Learning to Fuse Temporal Proximity Networks: A Case Study in Chimpanzee Social Interactions
par: He, Yixuan, et autres
Publié: (2025)
par: He, Yixuan, et autres
Publié: (2025)
Sail into the Headwind: Alignment via Robust Rewards and Dynamic Labels against Reward Hacking
par: Rashidinejad, Paria, et autres
Publié: (2024)
par: Rashidinejad, Paria, et autres
Publié: (2024)
FraPPE: Fast and Efficient Preference-based Pure Exploration
par: Das, Udvas, et autres
Publié: (2025)
par: Das, Udvas, et autres
Publié: (2025)
Statistical and Algorithmic Foundations of Reinforcement Learning
par: Chi, Yuejie, et autres
Publié: (2025)
par: Chi, Yuejie, et autres
Publié: (2025)
Smooth Non-Stationary Bandits
par: Jia, Su, et autres
Publié: (2023)
par: Jia, Su, et autres
Publié: (2023)
Piecewise Polynomial Regression of Tame Functions via Integer Programming
par: Bareilles, Gilles, et autres
Publié: (2023)
par: Bareilles, Gilles, et autres
Publié: (2023)
Classical and Deep Reinforcement Learning Inventory Control Policies for Pharmaceutical Supply Chains with Perishability and Non-Stationarity
par: Stranieri, Francesco, et autres
Publié: (2025)
par: Stranieri, Francesco, et autres
Publié: (2025)
Convexity in Disguise: A Theoretical Framework for Nonconvex Low-Rank Matrix Estimation
par: Cui, Chengyu, et autres
Publié: (2026)
par: Cui, Chengyu, et autres
Publié: (2026)
Optimal Variance-Dependent Regret Bounds for Infinite-Horizon MDPs
par: Zamir, Guy, et autres
Publié: (2026)
par: Zamir, Guy, et autres
Publié: (2026)
The augmented NLP bound for maximum-entropy remote sampling
par: Ponte, Gabriel, et autres
Publié: (2026)
par: Ponte, Gabriel, et autres
Publié: (2026)
Adversarial Water-Filling: Theory, Algorithms and Foundation Model
par: Tong, Xindi, et autres
Publié: (2026)
par: Tong, Xindi, et autres
Publié: (2026)
Linear regression with overparameterized linear neural networks: Tight upper and lower bounds for implicit $\ell^1$-regularization
par: Matt, Hannes, et autres
Publié: (2025)
par: Matt, Hannes, et autres
Publié: (2025)
Recovering Simultaneously Structured Data via Non-Convex Iteratively Reweighted Least Squares
par: Kümmerle, Christian, et autres
Publié: (2023)
par: Kümmerle, Christian, et autres
Publié: (2023)
Generalized Orthogonal Procrustes Problem under Arbitrary Adversaries
par: Ling, Shuyang
Publié: (2021)
par: Ling, Shuyang
Publié: (2021)
Documents similaires
-
Effective Frontiers: A Unification of Neural Scaling Laws
par: Zou, Jiaxuan, et autres
Publié: (2026) -
On the optimization dynamics of RLVR: Gradient gap and step size thresholds
par: Suk, Joe, et autres
Publié: (2025) -
One if by Land, Two if by Sea, Three if by Four Seas, and More to Come -- Values of Perception, Prediction, Communication, and Common Sense in Decision Making
par: Xu, Aolin
Publié: (2025) -
Comparing Few to Rank Many: Active Human Preference Learning using Randomized Frank-Wolfe
par: Thekumparampil, Kiran Koshy, et autres
Publié: (2024) -
Accelerating Convergence of Score-Based Diffusion Models, Provably
par: Li, Gen, et autres
Publié: (2024)