Deep Think with Confidence
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Fu, Yichao, Wang, Xuewei, Tian, Yuandong, Zhao, Jiawei |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Provable Scaling Laws of Feature Emergence from Learning Dynamics of Grokking
par: Tian, Yuandong
Publié: (2025)
par: Tian, Yuandong
Publié: (2025)
GaLore: Memory-Efficient LLM Training by Gradient Low-Rank Projection
par: Zhao, Jiawei, et autres
Publié: (2024)
par: Zhao, Jiawei, et autres
Publié: (2024)
Are LLM Decisions Faithful to Verbal Confidence?
par: Wang, Jiawei, et autres
Publié: (2026)
par: Wang, Jiawei, et autres
Publié: (2026)
GaLore 2: Large-Scale LLM Pre-Training by Gradient Low-Rank Projection
par: Su, DiJia, et autres
Publié: (2025)
par: Su, DiJia, et autres
Publié: (2025)
Q-GaLore: Quantized GaLore with INT4 Projection and Layer-Adaptive Low-Rank Gradients
par: Zhang, Zhenyu, et autres
Publié: (2024)
par: Zhang, Zhenyu, et autres
Publié: (2024)
Composing Global Solutions to Reasoning Tasks via Algebraic Objects in Neural Nets
par: Tian, Yuandong
Publié: (2024)
par: Tian, Yuandong
Publié: (2024)
Dualformer: Controllable Fast and Slow Thinking by Learning with Randomized Reasoning Traces
par: Su, DiJia, et autres
Publié: (2024)
par: Su, DiJia, et autres
Publié: (2024)
From Low Rank Gradient Subspace Stabilization to Low-Rank Weights: Observations, Theories, and Applications
par: Jaiswal, Ajay, et autres
Publié: (2024)
par: Jaiswal, Ajay, et autres
Publié: (2024)
Few-shot Neural Architecture Search
par: Zhao, Yiyang, et autres
Publié: (2020)
par: Zhao, Yiyang, et autres
Publié: (2020)
TensorGRaD: Tensor Gradient Robust Decomposition for Memory-Efficient Neural Operator Training
par: Loeschcke, Sebastian, et autres
Publié: (2025)
par: Loeschcke, Sebastian, et autres
Publié: (2025)
Sail into the Headwind: Alignment via Robust Rewards and Dynamic Labels against Reward Hacking
par: Rashidinejad, Paria, et autres
Publié: (2024)
par: Rashidinejad, Paria, et autres
Publié: (2024)
Multi-objective Optimization by Learning Space Partitions
par: Zhao, Yiyang, et autres
Publié: (2021)
par: Zhao, Yiyang, et autres
Publié: (2021)
A Principled Loss Function for Direct Language Model Alignment
par: Tan, Yuandong
Publié: (2025)
par: Tan, Yuandong
Publié: (2025)
Confidence Intervals and Simultaneous Confidence Bands Based on Deep Learning
par: Arie, Asaf Ben, et autres
Publié: (2024)
par: Arie, Asaf Ben, et autres
Publié: (2024)
Spectral Journey: How Transformers Predict the Shortest Path
par: Cohen, Andrew, et autres
Publié: (2025)
par: Cohen, Andrew, et autres
Publié: (2025)
LoCoCo: Dropping In Convolutions for Long Context Compression
par: Cai, Ruisi, et autres
Publié: (2024)
par: Cai, Ruisi, et autres
Publié: (2024)
Thinking Fast and Slow with Deep Learning and Tree Search
par: Anthony, Thomas, et autres
Publié: (2017)
par: Anthony, Thomas, et autres
Publié: (2017)
Thinking Short and Right Over Thinking Long: Serving LLM Reasoning Efficiently and Accurately
par: Wang, Yuhang, et autres
Publié: (2025)
par: Wang, Yuhang, et autres
Publié: (2025)
Principled Confidence Estimation for Deep Computed Tomography
par: Gätzner, Matteo, et autres
Publié: (2026)
par: Gätzner, Matteo, et autres
Publié: (2026)
Diffusion World Model: Future Modeling Beyond Step-by-Step Rollout for Offline Reinforcement Learning
par: Ding, Zihan, et autres
Publié: (2024)
par: Ding, Zihan, et autres
Publié: (2024)
Examining Reasoning LLMs-as-Judges in Non-Verifiable LLM Post-Training
par: Liu, Yixin, et autres
Publié: (2026)
par: Liu, Yixin, et autres
Publié: (2026)
GenCO: Generating Diverse Designs with Combinatorial Constraints
par: Ferber, Aaron, et autres
Publié: (2023)
par: Ferber, Aaron, et autres
Publié: (2023)
R-Sparse: Rank-Aware Activation Sparsity for Efficient LLM Inference
par: Zhang, Zhenyu, et autres
Publié: (2025)
par: Zhang, Zhenyu, et autres
Publié: (2025)
SHARP: Accelerating Language Model Inference by SHaring Adjacent layers with Recovery Parameters
par: Wang, Yiping, et autres
Publié: (2025)
par: Wang, Yiping, et autres
Publié: (2025)
Confident Natural Policy Gradient for Local Planning in $q_π$-realizable Constrained MDPs
par: Tian, Tian, et autres
Publié: (2024)
par: Tian, Tian, et autres
Publié: (2024)
Think Just Enough: Sequence-Level Entropy as a Confidence Signal for LLM Reasoning
par: Sharma, Aman, et autres
Publié: (2025)
par: Sharma, Aman, et autres
Publié: (2025)
Exploring the Effects of Population and Employment Characteristics on Truck Flows: An Analysis of NextGen NHTS Origin-Destination Data
par: Uddin, Majbah, et autres
Publié: (2024)
par: Uddin, Majbah, et autres
Publié: (2024)
Deep Thinking by Markov Chain of Continuous Thoughts
par: Liu, Jiayu, et autres
Publié: (2025)
par: Liu, Jiayu, et autres
Publié: (2025)
Enhance GNNs with Reliable Confidence Estimation via Adversarial Calibration Learning
par: Wang, Yilong, et autres
Publié: (2025)
par: Wang, Yilong, et autres
Publié: (2025)
Reasoning by Superposition: A Theoretical Perspective on Chain of Continuous Thought
par: Zhu, Hanlin, et autres
Publié: (2025)
par: Zhu, Hanlin, et autres
Publié: (2025)
Emergence of Superposition: Unveiling the Training Dynamics of Chain of Continuous Thought
par: Zhu, Hanlin, et autres
Publié: (2025)
par: Zhu, Hanlin, et autres
Publié: (2025)
JoMA: Demystifying Multilayer Transformers via JOint Dynamics of MLP and Attention
par: Tian, Yuandong, et autres
Publié: (2023)
par: Tian, Yuandong, et autres
Publié: (2023)
TriForce: Lossless Acceleration of Long Sequence Generation with Hierarchical Speculative Decoding
par: Sun, Hanshi, et autres
Publié: (2024)
par: Sun, Hanshi, et autres
Publié: (2024)
PACER: A Fully Push-forward-based Distributional Reinforcement Learning Algorithm
par: Bai, Wensong, et autres
Publié: (2023)
par: Bai, Wensong, et autres
Publié: (2023)
ORCE: Order-Aware Alignment of Verbalized Confidence in Large Language Models
par: Li, Chen, et autres
Publié: (2026)
par: Li, Chen, et autres
Publié: (2026)
Deep Confident Steps to New Pockets: Strategies for Docking Generalization
par: Corso, Gabriele, et autres
Publié: (2024)
par: Corso, Gabriele, et autres
Publié: (2024)
Global Confidence Degree Based Graph Neural Network for Financial Fraud Detection
par: Liu, Jiaxun, et autres
Publié: (2024)
par: Liu, Jiaxun, et autres
Publié: (2024)
Increasing the Confidence of Deep Neural Networks by Coverage Analysis
par: Rossolini, Giulio, et autres
Publié: (2021)
par: Rossolini, Giulio, et autres
Publié: (2021)
Confidence-aware Self-Semantic Distillation on Knowledge Graph Embedding
par: Liu, Yichen, et autres
Publié: (2022)
par: Liu, Yichen, et autres
Publié: (2022)
Confidence-Aware Deep Learning for Load Plan Adjustments in the Parcel Service Industry
par: Bruys, Thomas, et autres
Publié: (2024)
par: Bruys, Thomas, et autres
Publié: (2024)
Documents similaires
-
Provable Scaling Laws of Feature Emergence from Learning Dynamics of Grokking
par: Tian, Yuandong
Publié: (2025) -
GaLore: Memory-Efficient LLM Training by Gradient Low-Rank Projection
par: Zhao, Jiawei, et autres
Publié: (2024) -
Are LLM Decisions Faithful to Verbal Confidence?
par: Wang, Jiawei, et autres
Publié: (2026) -
GaLore 2: Large-Scale LLM Pre-Training by Gradient Low-Rank Projection
par: Su, DiJia, et autres
Publié: (2025) -
Q-GaLore: Quantized GaLore with INT4 Projection and Layer-Adaptive Low-Rank Gradients
par: Zhang, Zhenyu, et autres
Publié: (2024)