Temporalizing Confidence: Evaluation of Chain-of-Thought Reasoning with Signal Temporal Logic
Fuente:
arXiv
Guardado en:
| Autores principales: | Mao, Zhenjiang, Bisliouk, Artem, Nama, Rohith Reddy, Ruchkin, Ivan |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Confidence over Time: Confidence Calibration with Temporal Logic for Large Language Model Reasoning
por: Mao, Zhenjiang, et al.
Publicado: (2026)
por: Mao, Zhenjiang, et al.
Publicado: (2026)
Recurrent Confidence Chain: Temporal-Aware Uncertainty Quantification in Large Language Models
por: Mao, Zhenjiang, et al.
Publicado: (2026)
por: Mao, Zhenjiang, et al.
Publicado: (2026)
Improving Chain-of-Thought for Logical Reasoning via Attention-Aware Intervention
por: Phuong, Nguyen Minh, et al.
Publicado: (2026)
por: Phuong, Nguyen Minh, et al.
Publicado: (2026)
Benchmarking and Confidence Evaluation of LALMs For Temporal Reasoning
por: Bhattacharya, Debarpan, et al.
Publicado: (2025)
por: Bhattacharya, Debarpan, et al.
Publicado: (2025)
Agentic Literacy Debt: A Structural Problem the AI Literacy Field Has Not Yet Named
por: Nama, Rohith
Publicado: (2026)
por: Nama, Rohith
Publicado: (2026)
TGPO: Temporal Grounded Policy Optimization for Signal Temporal Logic Tasks
por: Meng, Yue, et al.
Publicado: (2025)
por: Meng, Yue, et al.
Publicado: (2025)
Chain-of-Thought Reasoning In The Wild Is Not Always Faithful
por: Arcuschin, Iván, et al.
Publicado: (2025)
por: Arcuschin, Iván, et al.
Publicado: (2025)
Temporal Inductive Logic Reasoning over Hypergraphs
por: Yang, Yuan, et al.
Publicado: (2022)
por: Yang, Yuan, et al.
Publicado: (2022)
Hidden Error Awareness in Chain-of-Thought Reasoning: The Signal Is Diagnostic, Not Causal
por: Yuan, Aojie, et al.
Publicado: (2026)
por: Yuan, Aojie, et al.
Publicado: (2026)
How Safe Am I Given What I See? Calibrated Prediction of Safety Chances for Image-Controlled Autonomy
por: Mao, Zhenjiang, et al.
Publicado: (2023)
por: Mao, Zhenjiang, et al.
Publicado: (2023)
Unveiling Confirmation Bias in Chain-of-Thought Reasoning
por: Wan, Yue, et al.
Publicado: (2025)
por: Wan, Yue, et al.
Publicado: (2025)
Zero-Shot Trajectory Planning for Signal Temporal Logic Tasks
por: Liu, Ruijia, et al.
Publicado: (2025)
por: Liu, Ruijia, et al.
Publicado: (2025)
Diverse Controllable Diffusion Policy with Signal Temporal Logic
por: Meng, Yue, et al.
Publicado: (2025)
por: Meng, Yue, et al.
Publicado: (2025)
Model Predictive Robustness of Signal Temporal Logic Predicates
por: Lin, Yuanfei, et al.
Publicado: (2022)
por: Lin, Yuanfei, et al.
Publicado: (2022)
LongCoT: Benchmarking Long-Horizon Chain-of-Thought Reasoning
por: Motwani, Sumeet Ramesh, et al.
Publicado: (2026)
por: Motwani, Sumeet Ramesh, et al.
Publicado: (2026)
Fractured Chain-of-Thought Reasoning
por: Liao, Baohao, et al.
Publicado: (2025)
por: Liao, Baohao, et al.
Publicado: (2025)
Dynamic Chain-of-Thought: Towards Adaptive Deep Reasoning
por: Wang, Libo
Publicado: (2025)
por: Wang, Libo
Publicado: (2025)
Reinforcing Chain-of-Thought Reasoning with Self-Evolving Rubrics
por: Sheng, Leheng, et al.
Publicado: (2026)
por: Sheng, Leheng, et al.
Publicado: (2026)
Optimizing Chain-of-Thought Confidence via Topological and Dirichlet Risk Analysis
por: More, Abhishek, et al.
Publicado: (2025)
por: More, Abhishek, et al.
Publicado: (2025)
Cross Domain Evaluation of Multimodal Chain-of-Thought Reasoning of different datasets into the Amazon CoT Framework
por: Tiwari, Nitya, et al.
Publicado: (2025)
por: Tiwari, Nitya, et al.
Publicado: (2025)
Contrastive Representations for Temporal Reasoning
por: Ziarko, Alicja, et al.
Publicado: (2025)
por: Ziarko, Alicja, et al.
Publicado: (2025)
Physically Interpretable World Models via Weakly Supervised Representation Learning
por: Mao, Zhenjiang, et al.
Publicado: (2024)
por: Mao, Zhenjiang, et al.
Publicado: (2024)
Diffusion of Thoughts: Chain-of-Thought Reasoning in Diffusion Language Models
por: Ye, Jiacheng, et al.
Publicado: (2024)
por: Ye, Jiacheng, et al.
Publicado: (2024)
The Kinetics of Reasoning: How Chain-of-Thought Shapes Learning in Transformers?
por: Pengmei, Zihan, et al.
Publicado: (2025)
por: Pengmei, Zihan, et al.
Publicado: (2025)
Temporal Inductive Path Neural Network for Temporal Knowledge Graph Reasoning
por: Dong, Hao, et al.
Publicado: (2023)
por: Dong, Hao, et al.
Publicado: (2023)
Enhancing Zero-Shot Chain-of-Thought Reasoning in Large Language Models through Logic
por: Zhao, Xufeng, et al.
Publicado: (2023)
por: Zhao, Xufeng, et al.
Publicado: (2023)
Temporal-Aware Evaluation and Learning for Temporal Graph Neural Networks
por: Su, Junwei, et al.
Publicado: (2024)
por: Su, Junwei, et al.
Publicado: (2024)
FinChain: A Symbolic Benchmark for Verifiable Chain-of-Thought Financial Reasoning
por: Xie, Zhuohan, et al.
Publicado: (2025)
por: Xie, Zhuohan, et al.
Publicado: (2025)
CoTox: Chain-of-Thought-Based Molecular Toxicity Reasoning and Prediction
por: Park, Jueon, et al.
Publicado: (2025)
por: Park, Jueon, et al.
Publicado: (2025)
Re-FORC: Adaptive Reward Prediction for Efficient Chain-of-Thought Reasoning
por: Zabounidis, Renos, et al.
Publicado: (2025)
por: Zabounidis, Renos, et al.
Publicado: (2025)
Drop the Act: Probe-Filtered RL for Faithful Chain-of-Thought Reasoning
por: Parekh, Swapnil
Publicado: (2026)
por: Parekh, Swapnil
Publicado: (2026)
Compositional Reasoning with Transformers, RNNs, and Chain of Thought
por: Yehudai, Gilad, et al.
Publicado: (2025)
por: Yehudai, Gilad, et al.
Publicado: (2025)
Scalable Chain of Thoughts via Elastic Reasoning
por: Xu, Yuhui, et al.
Publicado: (2025)
por: Xu, Yuhui, et al.
Publicado: (2025)
Long Chain-of-Thought Reasoning Across Languages
por: Barua, Josh, et al.
Publicado: (2025)
por: Barua, Josh, et al.
Publicado: (2025)
Temporal Sampling for Forgotten Reasoning in LLMs
por: Li, Yuetai, et al.
Publicado: (2025)
por: Li, Yuetai, et al.
Publicado: (2025)
Metastable Dynamics of Chain-of-Thought Reasoning: Provable Benefits of Search, RL and Distillation
por: Kim, Juno, et al.
Publicado: (2025)
por: Kim, Juno, et al.
Publicado: (2025)
Learning from Partial Chain-of-Thought via Truncated-Reasoning Self-Distillation
por: Silvestri, Gianluigi, et al.
Publicado: (2026)
por: Silvestri, Gianluigi, et al.
Publicado: (2026)
TimeGraphs: Graph-based Temporal Reasoning
por: Maheshwari, Paridhi, et al.
Publicado: (2024)
por: Maheshwari, Paridhi, et al.
Publicado: (2024)
Lattice Annotated Temporal (LAT) Logic for Non-Markovian Reasoning
por: Mukherji, Kaustuv, et al.
Publicado: (2025)
por: Mukherji, Kaustuv, et al.
Publicado: (2025)
Value-Guided Search for Efficient Chain-of-Thought Reasoning
por: Wang, Kaiwen, et al.
Publicado: (2025)
por: Wang, Kaiwen, et al.
Publicado: (2025)
Ejemplares similares
-
Confidence over Time: Confidence Calibration with Temporal Logic for Large Language Model Reasoning
por: Mao, Zhenjiang, et al.
Publicado: (2026) -
Recurrent Confidence Chain: Temporal-Aware Uncertainty Quantification in Large Language Models
por: Mao, Zhenjiang, et al.
Publicado: (2026) -
Improving Chain-of-Thought for Logical Reasoning via Attention-Aware Intervention
por: Phuong, Nguyen Minh, et al.
Publicado: (2026) -
Benchmarking and Confidence Evaluation of LALMs For Temporal Reasoning
por: Bhattacharya, Debarpan, et al.
Publicado: (2025) -
Agentic Literacy Debt: A Structural Problem the AI Literacy Field Has Not Yet Named
por: Nama, Rohith
Publicado: (2026)