FaithRL: Learning to Reason Faithfully through Step-Level Faithfulness Maximization
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Gui, Runquan, Li, Yafu, Qu, Xiaoye, Liu, Ziyan, Cheng, Yeqiu, Cheng, Yu |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Stop Rewarding Hallucinated Steps: Faithfulness-Aware Step-Level Reinforcement Learning for Small Reasoning Models
par: Nie, Shuo, et autres
Publié: (2026)
par: Nie, Shuo, et autres
Publié: (2026)
Measuring Chain of Thought Faithfulness by Unlearning Reasoning Steps
par: Tutek, Martin, et autres
Publié: (2025)
par: Tutek, Martin, et autres
Publié: (2025)
LongFaith: Enhancing Long-Context Reasoning in LLMs with Faithful Synthetic Data
par: Yang, Cehao, et autres
Publié: (2025)
par: Yang, Cehao, et autres
Publié: (2025)
Faithful-MR1: Faithful Multimodal Reasoning via Anchoring and Reinforcing Visual Attention
par: Tian, Changyuan, et autres
Publié: (2026)
par: Tian, Changyuan, et autres
Publié: (2026)
FaithfulRAG: Fact-Level Conflict Modeling for Context-Faithful Retrieval-Augmented Generation
par: Zhang, Qinggang, et autres
Publié: (2025)
par: Zhang, Qinggang, et autres
Publié: (2025)
Faithfulness as Information Flow: Evaluating and Training Faithful Chain-of-Thought Reasoning
par: Jia, Jinghan, et autres
Publié: (2026)
par: Jia, Jinghan, et autres
Publié: (2026)
FaithLens: Detecting and Explaining Faithfulness Hallucination
par: Si, Shuzheng, et autres
Publié: (2025)
par: Si, Shuzheng, et autres
Publié: (2025)
Scaling Reasoning, Losing Control: Evaluating Instruction Following in Large Reasoning Models
par: Fu, Tingchen, et autres
Publié: (2025)
par: Fu, Tingchen, et autres
Publié: (2025)
Mapping Faithful Reasoning in Language Models
par: Li, Jiazheng, et autres
Publié: (2025)
par: Li, Jiazheng, et autres
Publié: (2025)
Dissociation of Faithful and Unfaithful Reasoning in LLMs
par: Yee, Evelyn, et autres
Publié: (2024)
par: Yee, Evelyn, et autres
Publié: (2024)
MetaFaith: Faithful Natural Language Uncertainty Expression in LLMs
par: Liu, Gabrielle Kaili-May, et autres
Publié: (2025)
par: Liu, Gabrielle Kaili-May, et autres
Publié: (2025)
Faithful Logical Reasoning via Symbolic Chain-of-Thought
par: Xu, Jundong, et autres
Publié: (2024)
par: Xu, Jundong, et autres
Publié: (2024)
FaithCAMERA: Construction of a Faithful Dataset for Ad Text Generation
par: Kato, Akihiko, et autres
Publié: (2024)
par: Kato, Akihiko, et autres
Publié: (2024)
C2-Faith: Benchmarking LLM Judges for Causal and Coverage Faithfulness in Chain-of-Thought Reasoning
par: Mittal, Avni, et autres
Publié: (2026)
par: Mittal, Avni, et autres
Publié: (2026)
FaithLM: Towards Faithful Explanations for Large Language Models
par: Chuang, Yu-Neng, et autres
Publié: (2024)
par: Chuang, Yu-Neng, et autres
Publié: (2024)
Faithfulness Metrics Don't Measure Faithfulness: A Meta-Evaluation with Ground Truth
par: Gur-Arieh, Yoav, et autres
Publié: (2026)
par: Gur-Arieh, Yoav, et autres
Publié: (2026)
SEE: Continual Fine-tuning with Sequential Ensemble of Experts
par: Wang, Zhilin, et autres
Publié: (2025)
par: Wang, Zhilin, et autres
Publié: (2025)
NeuroFaith: Evaluating LLM Self-Explanation Faithfulness via Internal Representation Alignment
par: Bhan, Milan, et autres
Publié: (2025)
par: Bhan, Milan, et autres
Publié: (2025)
Mechanistic Evidence for Faithfulness Decay in Chain-of-Thought Reasoning
par: Ye, Donald, et autres
Publié: (2026)
par: Ye, Donald, et autres
Publié: (2026)
Reasoning on Graphs: Faithful and Interpretable Large Language Model Reasoning
par: Luo, Linhao, et autres
Publié: (2023)
par: Luo, Linhao, et autres
Publié: (2023)
GeoFaith: A Spatio-Temporal Dual View of Faithful Chain-of-Thought
par: Lv, Weijiang, et autres
Publié: (2026)
par: Lv, Weijiang, et autres
Publié: (2026)
FaithUn: Toward Faithful Forgetting in Language Models by Investigating the Interconnectedness of Knowledge
par: Yang, Nakyeong, et autres
Publié: (2025)
par: Yang, Nakyeong, et autres
Publié: (2025)
Faithfulness-QA: A Counterfactual Entity Substitution Dataset for Training Context-Faithful RAG Models
par: Ju, Li, et autres
Publié: (2026)
par: Ju, Li, et autres
Publié: (2026)
When AI Takes Sides on Questions of Faith: Persistent Asymmetries in AI-Mediated Faith Guidance
par: Israelsen, Brett, et autres
Publié: (2026)
par: Israelsen, Brett, et autres
Publié: (2026)
Test-Time Preference Optimization: On-the-Fly Alignment via Iterative Textual Feedback
par: Li, Yafu, et autres
Publié: (2025)
par: Li, Yafu, et autres
Publié: (2025)
AtManRL: Towards Faithful Reasoning via Differentiable Attention Saliency
par: Höth, Max Henning, et autres
Publié: (2026)
par: Höth, Max Henning, et autres
Publié: (2026)
Faithful Summarisation under Disagreement via Belief-Level Aggregation
par: Aghaebe, Favour Yahdii, et autres
Publié: (2026)
par: Aghaebe, Favour Yahdii, et autres
Publié: (2026)
Chain-of-Thought Reasoning In The Wild Is Not Always Faithful
par: Arcuschin, Iván, et autres
Publié: (2025)
par: Arcuschin, Iván, et autres
Publié: (2025)
FLARE: Faithful Logic-Aided Reasoning and Exploration
par: Arakelyan, Erik, et autres
Publié: (2024)
par: Arakelyan, Erik, et autres
Publié: (2024)
Benchmarking LLM Faithfulness in RAG with Evolving Leaderboards
par: Tamber, Manveer Singh, et autres
Publié: (2025)
par: Tamber, Manveer Singh, et autres
Publié: (2025)
Making Reasoning Matter: Measuring and Improving Faithfulness of Chain-of-Thought Reasoning
par: Paul, Debjit, et autres
Publié: (2024)
par: Paul, Debjit, et autres
Publié: (2024)
Graph-constrained Reasoning: Faithful Reasoning on Knowledge Graphs with Large Language Models
par: Luo, Linhao, et autres
Publié: (2024)
par: Luo, Linhao, et autres
Publié: (2024)
Reason and Verify: A Framework for Faithful Retrieval-Augmented Generation
par: Khan, Eeham, et autres
Publié: (2026)
par: Khan, Eeham, et autres
Publié: (2026)
Evaluating GRPO and DPO for Faithful Chain-of-Thought Reasoning in LLMs
par: Mohammadi, Hadi, et autres
Publié: (2025)
par: Mohammadi, Hadi, et autres
Publié: (2025)
Beyond Correctness: Rewarding Faithful Reasoning in Retrieval-Augmented Generation
par: Xu, Zhichao, et autres
Publié: (2025)
par: Xu, Zhichao, et autres
Publié: (2025)
On the Hardness of Faithful Chain-of-Thought Reasoning in Large Language Models
par: Tanneru, Sree Harsha, et autres
Publié: (2024)
par: Tanneru, Sree Harsha, et autres
Publié: (2024)
AutoRubric: Rubric-Based Generative Rewards for Faithful Multimodal Reasoning
par: Jia, Mengzhao, et autres
Publié: (2025)
par: Jia, Mengzhao, et autres
Publié: (2025)
Characterizing, Evaluating, and Optimizing Complex Reasoning
par: Zhang, Haoran, et autres
Publié: (2026)
par: Zhang, Haoran, et autres
Publié: (2026)
Exploring Knowledge Conflicts for Faithful LLM Reasoning: Benchmark and Method
par: Zhao, Tianzhe, et autres
Publié: (2026)
par: Zhao, Tianzhe, et autres
Publié: (2026)
RPTS: Tree-Structured Reasoning Process Scoring for Faithful Multimodal Evaluation
par: Wang, Haofeng, et autres
Publié: (2025)
par: Wang, Haofeng, et autres
Publié: (2025)
Documents similaires
-
Stop Rewarding Hallucinated Steps: Faithfulness-Aware Step-Level Reinforcement Learning for Small Reasoning Models
par: Nie, Shuo, et autres
Publié: (2026) -
Measuring Chain of Thought Faithfulness by Unlearning Reasoning Steps
par: Tutek, Martin, et autres
Publié: (2025) -
LongFaith: Enhancing Long-Context Reasoning in LLMs with Faithful Synthetic Data
par: Yang, Cehao, et autres
Publié: (2025) -
Faithful-MR1: Faithful Multimodal Reasoning via Anchoring and Reinforcing Visual Attention
par: Tian, Changyuan, et autres
Publié: (2026) -
FaithfulRAG: Fact-Level Conflict Modeling for Context-Faithful Retrieval-Augmented Generation
par: Zhang, Qinggang, et autres
Publié: (2025)