Optimizing Chain-of-Thought Confidence via Topological and Dirichlet Risk Analysis
Fuente:
arXiv
Guardado en:
| Autores principales: | More, Abhishek, Zhang, Anthony, Bonilla, Nicole, Vivekan, Ashvik, Zhu, Kevin, Sharafoleslami, Parham, Chaudhary, Maheep |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Visualizing and Benchmarking LLM Factual Hallucination Tendencies via Internal State Analysis and Clustering
por: Mao, Nathan, et al.
Publicado: (2026)
por: Mao, Nathan, et al.
Publicado: (2026)
In-Context Environments Induce Evaluation-Awareness in Language Models
por: Chaudhary, Maheep
Publicado: (2026)
por: Chaudhary, Maheep
Publicado: (2026)
SALT: Steering Activations towards Leakage-free Thinking in Chain of Thought
por: Batra, Shourya, et al.
Publicado: (2025)
por: Batra, Shourya, et al.
Publicado: (2025)
SafetyNet: Detecting Harmful Outputs in LLMs by Modeling and Monitoring Deceptive Behaviors
por: Chaudhary, Maheep, et al.
Publicado: (2025)
por: Chaudhary, Maheep, et al.
Publicado: (2025)
Broken Chains: The Cost of Incomplete Reasoning in LLMs
por: Su, Ian, et al.
Publicado: (2026)
por: Su, Ian, et al.
Publicado: (2026)
Weight space Detection of Backdoors in LoRA Adapters
por: Merenciano, David Puertolas, et al.
Publicado: (2026)
por: Merenciano, David Puertolas, et al.
Publicado: (2026)
ConMax: Confidence-Maximizing Compression for Efficient Chain-of-Thought Reasoning
por: Hu, Minda, et al.
Publicado: (2026)
por: Hu, Minda, et al.
Publicado: (2026)
The Molecular Structure of Thought: Mapping the Topology of Long Chain-of-Thought Reasoning
por: Chen, Qiguang, et al.
Publicado: (2026)
por: Chen, Qiguang, et al.
Publicado: (2026)
FRIT: Using Causal Importance to Improve Chain-of-Thought Faithfulness
por: Swaroop, Anand, et al.
Publicado: (2025)
por: Swaroop, Anand, et al.
Publicado: (2025)
Thoughts-as-Planning: Latent World Models for Chain-of-Thoughts Optimization via Reinforcement Planning
por: Liu, Dong, et al.
Publicado: (2026)
por: Liu, Dong, et al.
Publicado: (2026)
VeriCoT: Neuro-symbolic Chain-of-Thought Validation via Logical Consistency Checks
por: Feng, Yu, et al.
Publicado: (2025)
por: Feng, Yu, et al.
Publicado: (2025)
A Formal Comparison Between Chain of Thought and Latent Thought
por: Xu, Kevin, et al.
Publicado: (2025)
por: Xu, Kevin, et al.
Publicado: (2025)
Alignment-Constrained Dynamic Pruning for LLMs: Identifying and Preserving Alignment-Critical Circuits
por: Patel, Dev, et al.
Publicado: (2025)
por: Patel, Dev, et al.
Publicado: (2025)
Eliciting Uncertainty in Chain-of-Thought to Mitigate Bias against Forecasting Harmful User Behaviors
por: Sicilia, Anthony, et al.
Publicado: (2024)
por: Sicilia, Anthony, et al.
Publicado: (2024)
Chain-of-Thought Tokens are Computer Program Variables
por: Zhu, Fangwei, et al.
Publicado: (2025)
por: Zhu, Fangwei, et al.
Publicado: (2025)
Upfront Chain-of-Thought: A Cooperative Framework for Chain-of-Thought Compression
por: Li, Chengzhengxu, et al.
Publicado: (2025)
por: Li, Chengzhengxu, et al.
Publicado: (2025)
Why Chain of Thought Fails in Clinical Text Understanding
por: Wu, Jiageng, et al.
Publicado: (2025)
por: Wu, Jiageng, et al.
Publicado: (2025)
Implicit Sentiment Analysis Based on Chain of Thought Prompting
por: Duan, Zhihua, et al.
Publicado: (2024)
por: Duan, Zhihua, et al.
Publicado: (2024)
MANATEE: Inference-Time Lightweight Diffusion Based Safety Defense for LLMs
por: Kan, Chun Yan Ryan, et al.
Publicado: (2026)
por: Kan, Chun Yan Ryan, et al.
Publicado: (2026)
Supervised Chain of Thought
por: Zhang, Xiang, et al.
Publicado: (2024)
por: Zhang, Xiang, et al.
Publicado: (2024)
VCORE: Variance-Controlled Optimization-based Reweighting for Chain-of-Thought Supervision
por: Gong, Xuan, et al.
Publicado: (2025)
por: Gong, Xuan, et al.
Publicado: (2025)
Reassessing the Role of Chain-of-Thought in Sentiment Analysis: Insights and Limitations
por: Zheng, Kaiyuan, et al.
Publicado: (2025)
por: Zheng, Kaiyuan, et al.
Publicado: (2025)
Teaching LLMs to Plan: Logical Chain-of-Thought Instruction Tuning for Symbolic Planning
por: Verma, Pulkit, et al.
Publicado: (2025)
por: Verma, Pulkit, et al.
Publicado: (2025)
Evaluating Open-Source Sparse Autoencoders on Disentangling Factual Knowledge in GPT-2 Small
por: Chaudhary, Maheep, et al.
Publicado: (2024)
por: Chaudhary, Maheep, et al.
Publicado: (2024)
Rethinking Chain-of-Thought from the Perspective of Self-Training
por: Wu, Zongqian, et al.
Publicado: (2024)
por: Wu, Zongqian, et al.
Publicado: (2024)
Learning Composable Chains-of-Thought
por: Yin, Fangcong, et al.
Publicado: (2025)
por: Yin, Fangcong, et al.
Publicado: (2025)
COTCAgent: Preventive Consultation via Probabilistic Chain-of-Thought Completion
por: Deng, Zihan, et al.
Publicado: (2026)
por: Deng, Zihan, et al.
Publicado: (2026)
DRT: Deep Reasoning Translation via Long Chain-of-Thought
por: Wang, Jiaan, et al.
Publicado: (2024)
por: Wang, Jiaan, et al.
Publicado: (2024)
How does Chain of Thought Think? Mechanistic Interpretability of Chain-of-Thought Reasoning with Sparse Autoencoding
por: Chen, Xi, et al.
Publicado: (2025)
por: Chen, Xi, et al.
Publicado: (2025)
Evolving Demonstration Optimization for Chain-of-Thought Feature Transformation
por: Wang, Xinyuan, et al.
Publicado: (2026)
por: Wang, Xinyuan, et al.
Publicado: (2026)
Direct Value Optimization: Improving Chain-of-Thought Reasoning in LLMs with Refined Values
por: Zhang, Hongbo, et al.
Publicado: (2025)
por: Zhang, Hongbo, et al.
Publicado: (2025)
AdvChain: Adversarial Chain-of-Thought Tuning for Robust Safety Alignment of Large Reasoning Models
por: Zhu, Zihao, et al.
Publicado: (2025)
por: Zhu, Zihao, et al.
Publicado: (2025)
Optimizing Chain-of-Thought Reasoners via Gradient Variance Minimization in Rejection Sampling and RL
por: Yao, Jiarui, et al.
Publicado: (2025)
por: Yao, Jiarui, et al.
Publicado: (2025)
Scalable Chain of Thoughts via Elastic Reasoning
por: Xu, Yuhui, et al.
Publicado: (2025)
por: Xu, Yuhui, et al.
Publicado: (2025)
Self-Compression of Chain-of-Thought via Multi-Agent Reinforcement Learning
por: Chen, Yiqun, et al.
Publicado: (2026)
por: Chen, Yiqun, et al.
Publicado: (2026)
Enhancing Semantics in Multimodal Chain of Thought via Soft Negative Sampling
por: Zheng, Guangmin, et al.
Publicado: (2024)
por: Zheng, Guangmin, et al.
Publicado: (2024)
SAFEPATH: Preventing Harmful Reasoning in Chain-of-Thought via Early Alignment
por: Jeung, Wonje, et al.
Publicado: (2025)
por: Jeung, Wonje, et al.
Publicado: (2025)
Mind the Gap: Bridging Thought Leap for Improved Chain-of-Thought Tuning
por: Xu, Haolei, et al.
Publicado: (2025)
por: Xu, Haolei, et al.
Publicado: (2025)
Latent Chain-of-Thought for Visual Reasoning
por: Sun, Guohao, et al.
Publicado: (2025)
por: Sun, Guohao, et al.
Publicado: (2025)
Rethinking the Chain-of-Thought: The Roles of In-Context Learning and Pre-trained Priors
por: Yang, Hao, et al.
Publicado: (2025)
por: Yang, Hao, et al.
Publicado: (2025)
Ejemplares similares
-
Visualizing and Benchmarking LLM Factual Hallucination Tendencies via Internal State Analysis and Clustering
por: Mao, Nathan, et al.
Publicado: (2026) -
In-Context Environments Induce Evaluation-Awareness in Language Models
por: Chaudhary, Maheep
Publicado: (2026) -
SALT: Steering Activations towards Leakage-free Thinking in Chain of Thought
por: Batra, Shourya, et al.
Publicado: (2025) -
SafetyNet: Detecting Harmful Outputs in LLMs by Modeling and Monitoring Deceptive Behaviors
por: Chaudhary, Maheep, et al.
Publicado: (2025) -
Broken Chains: The Cost of Incomplete Reasoning in LLMs
por: Su, Ian, et al.
Publicado: (2026)