GeoFaith: A Spatio-Temporal Dual View of Faithful Chain-of-Thought
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Lv, Weijiang, Zhao, Wentong, Wang, Jiayu, Wu, Yuhao, Wei, Jiaheng, Xia, Xiaobo |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
SPD-Faith Bench: Diagnosing and Improving Faithfulness in Chain-of-Thought for Multimodal Large Language Models
par: Lv, Weijiang, et autres
Publié: (2026)
par: Lv, Weijiang, et autres
Publié: (2026)
Counterfactual Simulation Training for Chain-of-Thought Faithfulness
par: Hase, Peter, et autres
Publié: (2026)
par: Hase, Peter, et autres
Publié: (2026)
C2-Faith: Benchmarking LLM Judges for Causal and Coverage Faithfulness in Chain-of-Thought Reasoning
par: Mittal, Avni, et autres
Publié: (2026)
par: Mittal, Avni, et autres
Publié: (2026)
Towards Better Chain-of-Thought: A Reflection on Effectiveness and Faithfulness
par: Li, Jiachun, et autres
Publié: (2024)
par: Li, Jiachun, et autres
Publié: (2024)
Chain-of-Thought Reasoning In The Wild Is Not Always Faithful
par: Arcuschin, Iván, et autres
Publié: (2025)
par: Arcuschin, Iván, et autres
Publié: (2025)
Measuring Chain-of-Thought Monitorability Through Faithfulness and Verbosity
par: Meek, Austin, et autres
Publié: (2025)
par: Meek, Austin, et autres
Publié: (2025)
Lie to Me: How Faithful Is Chain-of-Thought Reasoning in Reasoning Models?
par: Young, Richard J.
Publié: (2026)
par: Young, Richard J.
Publié: (2026)
Is Chain-of-Thought Really Not Explainability? Chain-of-Thought Can Be Faithful without Hint Verbalization
par: Zaman, Kerem, et autres
Publié: (2025)
par: Zaman, Kerem, et autres
Publié: (2025)
Investigating the Interplay between Contextual and Parametric Chain-of-Thought Faithfulness under Optimization
par: Sun, Jingyi, et autres
Publié: (2026)
par: Sun, Jingyi, et autres
Publié: (2026)
FaithLens: Detecting and Explaining Faithfulness Hallucination
par: Si, Shuzheng, et autres
Publié: (2025)
par: Si, Shuzheng, et autres
Publié: (2025)
FaithLM: Towards Faithful Explanations for Large Language Models
par: Chuang, Yu-Neng, et autres
Publié: (2024)
par: Chuang, Yu-Neng, et autres
Publié: (2024)
Measuring Faithfulness Depends on How You Measure: Classifier Sensitivity in LLM Chain-of-Thought Evaluation
par: Young, Richard J.
Publié: (2026)
par: Young, Richard J.
Publié: (2026)
Faithfulness-QA: A Counterfactual Entity Substitution Dataset for Training Context-Faithful RAG Models
par: Ju, Li, et autres
Publié: (2026)
par: Ju, Li, et autres
Publié: (2026)
FaithUn: Toward Faithful Forgetting in Language Models by Investigating the Interconnectedness of Knowledge
par: Yang, Nakyeong, et autres
Publié: (2025)
par: Yang, Nakyeong, et autres
Publié: (2025)
FaithCoT-Bench: Benchmarking Instance-Level Faithfulness of Chain-of-Thought Reasoning
par: Shen, Xu, et autres
Publié: (2025)
par: Shen, Xu, et autres
Publié: (2025)
Faithfulness Serum: Mitigating the Faithfulness Gap in Textual Explanations of LLM Decisions via Attribution Guidance
par: Alon, Bar, et autres
Publié: (2026)
par: Alon, Bar, et autres
Publié: (2026)
A Closer Look at Bias and Chain-of-Thought Faithfulness of Large (Vision) Language Models
par: Balasubramanian, Sriram, et autres
Publié: (2025)
par: Balasubramanian, Sriram, et autres
Publié: (2025)
Dissociation of Faithful and Unfaithful Reasoning in LLMs
par: Yee, Evelyn, et autres
Publié: (2024)
par: Yee, Evelyn, et autres
Publié: (2024)
STORYSUMM: Evaluating Faithfulness in Story Summarization
par: Subbiah, Melanie, et autres
Publié: (2024)
par: Subbiah, Melanie, et autres
Publié: (2024)
The Probabilities Also Matter: A More Faithful Metric for Faithfulness of Free-Text Explanations in Large Language Models
par: Siegel, Noah Y., et autres
Publié: (2024)
par: Siegel, Noah Y., et autres
Publié: (2024)
Do Models Know Why They Changed Their Mind? Interpretability and Faithfulness of Chain-of-Thought Under Knowledge Conflict
par: Venkata, Pruthvinath Jeripity
Publié: (2026)
par: Venkata, Pruthvinath Jeripity
Publié: (2026)
Incorporating Attribution Importance for Improving Faithfulness Metrics
par: Zhao, Zhixue, et autres
Publié: (2023)
par: Zhao, Zhixue, et autres
Publié: (2023)
Exploring Knowledge Conflicts for Faithful LLM Reasoning: Benchmark and Method
par: Zhao, Tianzhe, et autres
Publié: (2026)
par: Zhao, Tianzhe, et autres
Publié: (2026)
CSRP: Chain-of-Thought Reasoning for Chinese Text Correction via Reinforcement Learning with Efficiency-Aware Rewards
par: Tian, Wei, et autres
Publié: (2026)
par: Tian, Wei, et autres
Publié: (2026)
SFR-RAG: Towards Contextually Faithful LLMs
par: Nguyen, Xuan-Phi, et autres
Publié: (2024)
par: Nguyen, Xuan-Phi, et autres
Publié: (2024)
Faithful Chart Summarization with ChaTS-Pi
par: Krichene, Syrine, et autres
Publié: (2024)
par: Krichene, Syrine, et autres
Publié: (2024)
Faithful Autoformalization via Roundtrip Verification and Repair
par: Amrollahi, Daneshvar, et autres
Publié: (2026)
par: Amrollahi, Daneshvar, et autres
Publié: (2026)
Benchmarking LLM Faithfulness in RAG with Evolving Leaderboards
par: Tamber, Manveer Singh, et autres
Publié: (2025)
par: Tamber, Manveer Singh, et autres
Publié: (2025)
Faithfulness and the Notion of Adversarial Sensitivity in NLP Explanations
par: Manna, Supriya, et autres
Publié: (2024)
par: Manna, Supriya, et autres
Publié: (2024)
CtrlCoT: Dual-Granularity Chain-of-Thought Compression for Controllable Reasoning
par: Fan, Zhenxuan, et autres
Publié: (2026)
par: Fan, Zhenxuan, et autres
Publié: (2026)
Comparing Explanation Faithfulness between Multilingual and Monolingual Fine-tuned Language Models
par: Zhao, Zhixue, et autres
Publié: (2024)
par: Zhao, Zhixue, et autres
Publié: (2024)
FaithfulSAE: Towards Capturing Faithful Features with Sparse Autoencoders without External Dataset Dependencies
par: Cho, Seonglae, et autres
Publié: (2025)
par: Cho, Seonglae, et autres
Publié: (2025)
SSFO: Self-Supervised Faithfulness Optimization for Retrieval-Augmented Generation
par: Tang, Xiaqiang, et autres
Publié: (2025)
par: Tang, Xiaqiang, et autres
Publié: (2025)
RPTS: Tree-Structured Reasoning Process Scoring for Faithful Multimodal Evaluation
par: Wang, Haofeng, et autres
Publié: (2025)
par: Wang, Haofeng, et autres
Publié: (2025)
Closing the Confidence-Faithfulness Gap in Large Language Models
par: Miao, Miranda Muqing, et autres
Publié: (2026)
par: Miao, Miranda Muqing, et autres
Publié: (2026)
Evaluating Human Alignment and Model Faithfulness of LLM Rationale
par: Fayyaz, Mohsen, et autres
Publié: (2024)
par: Fayyaz, Mohsen, et autres
Publié: (2024)
Toward Faithful Retrieval-Augmented Generation with Sparse Autoencoders
par: Xiong, Guangzhi, et autres
Publié: (2025)
par: Xiong, Guangzhi, et autres
Publié: (2025)
The Gray Zone of Faithfulness: Taming Ambiguity in Unfaithfulness Detection
par: Ding, Qiang, et autres
Publié: (2025)
par: Ding, Qiang, et autres
Publié: (2025)
From Context to EDUs: Faithful and Structured Context Compression via Elementary Discourse Unit Decomposition
par: Zhou, Yiqing, et autres
Publié: (2025)
par: Zhou, Yiqing, et autres
Publié: (2025)
FaithEval: Can Your Language Model Stay Faithful to Context, Even If "The Moon is Made of Marshmallows"
par: Ming, Yifei, et autres
Publié: (2024)
par: Ming, Yifei, et autres
Publié: (2024)
Documents similaires
-
SPD-Faith Bench: Diagnosing and Improving Faithfulness in Chain-of-Thought for Multimodal Large Language Models
par: Lv, Weijiang, et autres
Publié: (2026) -
Counterfactual Simulation Training for Chain-of-Thought Faithfulness
par: Hase, Peter, et autres
Publié: (2026) -
C2-Faith: Benchmarking LLM Judges for Causal and Coverage Faithfulness in Chain-of-Thought Reasoning
par: Mittal, Avni, et autres
Publié: (2026) -
Towards Better Chain-of-Thought: A Reflection on Effectiveness and Faithfulness
par: Li, Jiachun, et autres
Publié: (2024) -
Chain-of-Thought Reasoning In The Wild Is Not Always Faithful
par: Arcuschin, Iván, et autres
Publié: (2025)