DeepFaith: A Domain-Free and Model-Agnostic Unified Framework for Highly Faithful Explanations
Fuente:
arXiv
Guardado en:
| Autores principales: | Guo, Yuhan, Ding, Lizhong, Jia, Shihan, Ren, Yanyu, Li, Pengqi, Fu, Jiarun, Li, Changsheng, yuan, Ye, Wang, Guoren |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Unveiling and Causalizing CoT: A Causal Pespective
por: Fu, Jiarun, et al.
Publicado: (2025)
por: Fu, Jiarun, et al.
Publicado: (2025)
Macformer: Transformer with Random Maclaurin Feature Attention
por: Guo, Yuhan, et al.
Publicado: (2024)
por: Guo, Yuhan, et al.
Publicado: (2024)
FaithLM: Towards Faithful Explanations for Large Language Models
por: Chuang, Yu-Neng, et al.
Publicado: (2024)
por: Chuang, Yu-Neng, et al.
Publicado: (2024)
Explanation-Driven Counterfactual Testing for Faithfulness in Vision-Language Model Explanations
por: Ding, Sihao, et al.
Publicado: (2025)
por: Ding, Sihao, et al.
Publicado: (2025)
On the Faithfulness of Vision Transformer Explanations
por: Wu, Junyi, et al.
Publicado: (2024)
por: Wu, Junyi, et al.
Publicado: (2024)
The Probabilities Also Matter: A More Faithful Metric for Faithfulness of Free-Text Explanations in Large Language Models
por: Siegel, Noah Y., et al.
Publicado: (2024)
por: Siegel, Noah Y., et al.
Publicado: (2024)
Evaluating Readability and Faithfulness of Concept-based Explanations
por: Li, Meng, et al.
Publicado: (2024)
por: Li, Meng, et al.
Publicado: (2024)
Diffusion-CAM: Faithful Visual Explanations for dMLLMs
por: Zuo, Haomin, et al.
Publicado: (2026)
por: Zuo, Haomin, et al.
Publicado: (2026)
Astro: Activation-guided Structured Regularization for Outlier-Robust LLM Post-Training Quantization
por: Chen, Xi, et al.
Publicado: (2026)
por: Chen, Xi, et al.
Publicado: (2026)
FIRE: Faithful Interpretable Recommendation Explanations
por: Sani, S. M. F., et al.
Publicado: (2025)
por: Sani, S. M. F., et al.
Publicado: (2025)
Faithful Counterfactual Visual Explanations (FCVE)
por: Khan, Bismillah, et al.
Publicado: (2025)
por: Khan, Bismillah, et al.
Publicado: (2025)
Towards Faithful Explanations: Boosting Rationalization with Shortcuts Discovery
por: Yue, Linan, et al.
Publicado: (2024)
por: Yue, Linan, et al.
Publicado: (2024)
NeuroFaith: Evaluating LLM Self-Explanation Faithfulness via Internal Representation Alignment
por: Bhan, Milan, et al.
Publicado: (2025)
por: Bhan, Milan, et al.
Publicado: (2025)
Towards Faithful Explanations for Text Classification with Robustness Improvement and Explanation Guided Training
por: Li, Dongfang, et al.
Publicado: (2023)
por: Li, Dongfang, et al.
Publicado: (2023)
DISCRET: Synthesizing Faithful Explanations For Treatment Effect Estimation
por: Wu, Yinjun, et al.
Publicado: (2024)
por: Wu, Yinjun, et al.
Publicado: (2024)
FaithRL: Learning to Reason Faithfully through Step-Level Faithfulness Maximization
por: Gui, Runquan, et al.
Publicado: (2026)
por: Gui, Runquan, et al.
Publicado: (2026)
Faithfulness Serum: Mitigating the Faithfulness Gap in Textual Explanations of LLM Decisions via Attribution Guidance
por: Alon, Bar, et al.
Publicado: (2026)
por: Alon, Bar, et al.
Publicado: (2026)
Testing for Causal Fairness
por: Fu, Jiarun, et al.
Publicado: (2025)
por: Fu, Jiarun, et al.
Publicado: (2025)
QGShap: Quantum Acceleration for Faithful GNN Explanations
por: Jena, Haribandhu, et al.
Publicado: (2025)
por: Jena, Haribandhu, et al.
Publicado: (2025)
"Faithful to What?" On the Limits of Fidelity-Based Explanations
por: Eshbaugh, Jackson
Publicado: (2025)
por: Eshbaugh, Jackson
Publicado: (2025)
Toward Faithful Explanations in Acoustic Anomaly Detection
por: Elrashid, Maab, et al.
Publicado: (2026)
por: Elrashid, Maab, et al.
Publicado: (2026)
Measuring the (Un)Faithfulness of Concept-Based Explanations
por: Kumar, Shubham, et al.
Publicado: (2025)
por: Kumar, Shubham, et al.
Publicado: (2025)
Faithfulness and the Notion of Adversarial Sensitivity in NLP Explanations
por: Manna, Supriya, et al.
Publicado: (2024)
por: Manna, Supriya, et al.
Publicado: (2024)
Sparse and Faithful Explanations Without Sparse Models
por: Sun, Yiyang, et al.
Publicado: (2024)
por: Sun, Yiyang, et al.
Publicado: (2024)
Technical Note: Defining and Quantifying AND-OR Interactions for Faithful and Concise Explanation of DNNs
por: Li, Mingjie, et al.
Publicado: (2023)
por: Li, Mingjie, et al.
Publicado: (2023)
Can LLMs Produce Faithful Explanations For Fact-checking? Towards Faithful Explainable Fact-Checking via Multi-Agent Debate
por: Kim, Kyungha, et al.
Publicado: (2024)
por: Kim, Kyungha, et al.
Publicado: (2024)
EviSnap: Faithful Evidence-Cited Explanations for Cold-Start Cross-Domain Recommendation
por: Dai, Yingjun, et al.
Publicado: (2026)
por: Dai, Yingjun, et al.
Publicado: (2026)
Faithfulness as Information Flow: Evaluating and Training Faithful Chain-of-Thought Reasoning
por: Jia, Jinghan, et al.
Publicado: (2026)
por: Jia, Jinghan, et al.
Publicado: (2026)
Faith in Law, Law in Faith
Publicado: (2024)
Publicado: (2024)
Comparables XAI: Faithful Example-based AI Explanations with Counterfactual Trace Adjustments
por: Zhang, Yifan, et al.
Publicado: (2026)
por: Zhang, Yifan, et al.
Publicado: (2026)
Local Explanations and Self-Explanations for Assessing Faithfulness in black-box LLMs
por: Fragkathoulas, Christos, et al.
Publicado: (2024)
por: Fragkathoulas, Christos, et al.
Publicado: (2024)
A Necessary Step toward Faithfulness: Measuring and Improving Consistency in Free-Text Explanations
por: Zhao, Lingjun, et al.
Publicado: (2025)
por: Zhao, Lingjun, et al.
Publicado: (2025)
DREAM: Domain-agnostic Reverse Engineering Attributes of Black-box Model
por: Li, Rongqing, et al.
Publicado: (2024)
por: Li, Rongqing, et al.
Publicado: (2024)
Faithful and Stable Neuron Explanations for Trustworthy Mechanistic Interpretability
por: Yan, Ge, et al.
Publicado: (2025)
por: Yan, Ge, et al.
Publicado: (2025)
Self-Critique and Refinement for Faithful Natural Language Explanations
por: Wang, Yingming, et al.
Publicado: (2025)
por: Wang, Yingming, et al.
Publicado: (2025)
Towards Faithful Model Explanation in NLP: A Survey
por: Lyu, Qing, et al.
Publicado: (2022)
por: Lyu, Qing, et al.
Publicado: (2022)
LIMEtree: Consistent and Faithful Surrogate Explanations of Multiple Classes
por: Sokol, Kacper, et al.
Publicado: (2020)
por: Sokol, Kacper, et al.
Publicado: (2020)
On Measuring Faithfulness or Self-consistency of Natural Language Explanations
por: Parcalabescu, Letitia, et al.
Publicado: (2023)
por: Parcalabescu, Letitia, et al.
Publicado: (2023)
On the Complexity-Faithfulness Trade-off of Gradient-Based Explanations
por: Mehrpanah, Amir, et al.
Publicado: (2025)
por: Mehrpanah, Amir, et al.
Publicado: (2025)
FaithfulFaces: Pose-Faithful Facial Identity Preservation for Text-to-Video Generation
por: Wang, Yuanzhi, et al.
Publicado: (2026)
por: Wang, Yuanzhi, et al.
Publicado: (2026)
Ejemplares similares
-
Unveiling and Causalizing CoT: A Causal Pespective
por: Fu, Jiarun, et al.
Publicado: (2025) -
Macformer: Transformer with Random Maclaurin Feature Attention
por: Guo, Yuhan, et al.
Publicado: (2024) -
FaithLM: Towards Faithful Explanations for Large Language Models
por: Chuang, Yu-Neng, et al.
Publicado: (2024) -
Explanation-Driven Counterfactual Testing for Faithfulness in Vision-Language Model Explanations
por: Ding, Sihao, et al.
Publicado: (2025) -
On the Faithfulness of Vision Transformer Explanations
por: Wu, Junyi, et al.
Publicado: (2024)