How Interpretable are Reasoning Explanations from Prompting Large Language Models?
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Yeo, Wei Jie, Satapathy, Ranjan, Goh, Rick Siow Mong, Cambria, Erik |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Towards Faithful Natural Language Explanations: A Study Using Activation Patching in Large Language Models
par: Yeo, Wei Jie, et autres
Publié: (2024)
par: Yeo, Wei Jie, et autres
Publié: (2024)
Plausible Extractive Rationalization through Semi-Supervised Entailment Signal
par: Yeo, Wei Jie, et autres
Publié: (2024)
par: Yeo, Wei Jie, et autres
Publié: (2024)
Self-training Large Language Models through Knowledge Detection
par: Yeo, Wei Jie, et autres
Publié: (2024)
par: Yeo, Wei Jie, et autres
Publié: (2024)
Mitigating Jailbreaks with Intent-Aware LLMs
par: Yeo, Wei Jie, et autres
Publié: (2025)
par: Yeo, Wei Jie, et autres
Publié: (2025)
Debiasing CLIP: Interpreting and Correcting Bias in Attention Heads
par: Yeo, Wei Jie, et autres
Publié: (2025)
par: Yeo, Wei Jie, et autres
Publié: (2025)
Beyond I'm Sorry, I Can't: Dissecting Large Language Model Refusal
par: Prakash, Nirmalendu, et autres
Publié: (2025)
par: Prakash, Nirmalendu, et autres
Publié: (2025)
Understanding Refusal in Language Models with Sparse Autoencoders
par: Yeo, Wei Jie, et autres
Publié: (2025)
par: Yeo, Wei Jie, et autres
Publié: (2025)
Structured Semantic Cloaking for Jailbreak Attacks on Large Language Models
par: Sun, Xiaobing, et autres
Publié: (2026)
par: Sun, Xiaobing, et autres
Publié: (2026)
Beyond Correlation: Refutation-Validated Aspect-Based Sentiment Analysis for Explainable Energy Market Returns
par: van der Heever, Wihan, et autres
Publié: (2026)
par: van der Heever, Wihan, et autres
Publié: (2026)
FinXABSA: Explainable Finance through Aspect-Based Sentiment Analysis
par: Ong, Keane, et autres
Publié: (2023)
par: Ong, Keane, et autres
Publié: (2023)
Explainable Natural Language Processing for Corporate Sustainability Analysis
par: Ong, Keane, et autres
Publié: (2024)
par: Ong, Keane, et autres
Publié: (2024)
A Systematic Analysis of Biases in Large Language Models
par: Zhang, Xulang, et autres
Publié: (2025)
par: Zhang, Xulang, et autres
Publié: (2025)
ESGSenticNet: A Neurosymbolic Knowledge Base for Corporate Sustainability Analysis
par: Ong, Keane, et autres
Publié: (2025)
par: Ong, Keane, et autres
Publié: (2025)
MaskedCLIP: Bridging the Masked and CLIP Space for Semi-Supervised Medical Vision-Language Pre-training
par: Zhu, Lei, et autres
Publié: (2025)
par: Zhu, Lei, et autres
Publié: (2025)
Are Large Language Models Really Good Logical Reasoners? A Comprehensive Evaluation and Beyond
par: Xu, Fangzhi, et autres
Publié: (2023)
par: Xu, Fangzhi, et autres
Publié: (2023)
AdvMIM: Adversarial Masked Image Modeling for Semi-Supervised Medical Image Segmentation
par: Zhu, Lei, et autres
Publié: (2025)
par: Zhu, Lei, et autres
Publié: (2025)
Language Models as Inductive Reasoners
par: Yang, Zonglin, et autres
Publié: (2022)
par: Yang, Zonglin, et autres
Publié: (2022)
Large Language Models for Automated Open-domain Scientific Hypotheses Discovery
par: Yang, Zonglin, et autres
Publié: (2023)
par: Yang, Zonglin, et autres
Publié: (2023)
Large Language Models for Few-Shot Named Entity Recognition
par: Zhao, Yufei, et autres
Publié: (2018)
par: Zhao, Yufei, et autres
Publié: (2018)
PromptExp: Multi-granularity Prompt Explanation of Large Language Models
par: Dong, Ximing, et autres
Publié: (2024)
par: Dong, Ximing, et autres
Publié: (2024)
XAI meets LLMs: A Survey of the Relation between Explainable AI and Large Language Models
par: Cambria, Erik, et autres
Publié: (2024)
par: Cambria, Erik, et autres
Publié: (2024)
Prompted Aspect Key Point Analysis for Quantitative Review Summarization
par: Tang, An Quang, et autres
Publié: (2024)
par: Tang, An Quang, et autres
Publié: (2024)
Harnessing Large Language Models for Scientific Novelty Detection
par: Liu, Yan, et autres
Publié: (2025)
par: Liu, Yan, et autres
Publié: (2025)
Logical Reasoning over Natural Language as Knowledge Representation: A Survey
par: Yang, Zonglin, et autres
Publié: (2023)
par: Yang, Zonglin, et autres
Publié: (2023)
A Survey of Large Language Models for Healthcare: from Data, Technology, and Applications to Accountability and Ethics
par: He, Kai, et autres
Publié: (2023)
par: He, Kai, et autres
Publié: (2023)
Large Language Models are Clinical Reasoners: Reasoning-Aware Diagnosis Framework with Prompt-Generated Rationales
par: Kwon, Taeyoon, et autres
Publié: (2023)
par: Kwon, Taeyoon, et autres
Publié: (2023)
Psychologically-Grounded Graph Modeling for Interpretable Depression Detection
par: Vyalla, Rishitej Reddy, et autres
Publié: (2026)
par: Vyalla, Rishitej Reddy, et autres
Publié: (2026)
PHAnToM: Persona-based Prompting Has An Effect on Theory-of-Mind Reasoning in Large Language Models
par: Tan, Fiona Anting, et autres
Publié: (2024)
par: Tan, Fiona Anting, et autres
Publié: (2024)
Beyond Context to Cognitive Appraisal: Emotion Reasoning as a Theory of Mind Benchmark for Large Language Models
par: Yeo, Gerard Christopher, et autres
Publié: (2025)
par: Yeo, Gerard Christopher, et autres
Publié: (2025)
iPOE: Interpretable Prompt Optimization via Explanations
par: Li, Jiahui, et autres
Publié: (2026)
par: Li, Jiahui, et autres
Publié: (2026)
From Generalist to Specialist: Adapting Vision Language Models via Task-Specific Visual Instruction Tuning
par: Bai, Yang, et autres
Publié: (2024)
par: Bai, Yang, et autres
Publié: (2024)
CELL your Model: Contrastive Explanations for Large Language Models
par: Luss, Ronny, et autres
Publié: (2024)
par: Luss, Ronny, et autres
Publié: (2024)
Leveraging Prompt-Tuning for Bengali Grammatical Error Explanation Using Large Language Models
par: Maity, Subhankar, et autres
Publié: (2025)
par: Maity, Subhankar, et autres
Publié: (2025)
Large Language Models Are Better Logical Fallacy Reasoners with Counterargument, Explanation, and Goal-Aware Prompt Formulation
par: Jeong, Jiwon, et autres
Publié: (2025)
par: Jeong, Jiwon, et autres
Publié: (2025)
Negation Blindness in Large Language Models: Unveiling the NO Syndrome in Image Generation
par: Nadeem, Mohammad, et autres
Publié: (2024)
par: Nadeem, Mohammad, et autres
Publié: (2024)
PromptCoT 2.0: Scaling Prompt Synthesis for Large Language Model Reasoning
par: Zhao, Xueliang, et autres
Publié: (2025)
par: Zhao, Xueliang, et autres
Publié: (2025)
MARS: Multi-Agent Adaptive Reasoning with Socratic Guidance for Automated Prompt Optimization
par: Zhang, Jian, et autres
Publié: (2025)
par: Zhang, Jian, et autres
Publié: (2025)
Deriving Strategic Market Insights with Large Language Models: A Benchmark for Forward Counterfactual Generation
par: Ong, Keane, et autres
Publié: (2025)
par: Ong, Keane, et autres
Publié: (2025)
Reasoning on Graphs: Faithful and Interpretable Large Language Model Reasoning
par: Luo, Linhao, et autres
Publié: (2023)
par: Luo, Linhao, et autres
Publié: (2023)
Exchange of Perspective Prompting Enhances Reasoning in Large Language Models
par: Sun, Lin, et autres
Publié: (2025)
par: Sun, Lin, et autres
Publié: (2025)
Documents similaires
-
Towards Faithful Natural Language Explanations: A Study Using Activation Patching in Large Language Models
par: Yeo, Wei Jie, et autres
Publié: (2024) -
Plausible Extractive Rationalization through Semi-Supervised Entailment Signal
par: Yeo, Wei Jie, et autres
Publié: (2024) -
Self-training Large Language Models through Knowledge Detection
par: Yeo, Wei Jie, et autres
Publié: (2024) -
Mitigating Jailbreaks with Intent-Aware LLMs
par: Yeo, Wei Jie, et autres
Publié: (2025) -
Debiasing CLIP: Interpreting and Correcting Bias in Attention Heads
par: Yeo, Wei Jie, et autres
Publié: (2025)