Evaluating Explanations Through LLMs: Beyond Traditional User Studies
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | De Bona, Francesco Bombassei, Dominici, Gabriele, Miller, Tim, Langheinrich, Marc, Gjoreski, Martin |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Counterfactual Concept Bottleneck Models
par: Dominici, Gabriele, et autres
Publié: (2024)
par: Dominici, Gabriele, et autres
Publié: (2024)
Neuron-Anchored Rule Extraction for Large Language Models via Contrastive Hierarchical Ablation
par: Sovrano, Francesco, et autres
Publié: (2026)
par: Sovrano, Francesco, et autres
Publié: (2026)
Causal Concept Graph Models: Beyond Causal Opacity in Deep Learning
par: Dominici, Gabriele, et autres
Publié: (2024)
par: Dominici, Gabriele, et autres
Publié: (2024)
Counterfactual Explanations for Clustering Models
par: Spagnol, Aurora, et autres
Publié: (2024)
par: Spagnol, Aurora, et autres
Publié: (2024)
A foundation model for electrodermal activity data
par: Alchieri, Leonardo, et autres
Publié: (2026)
par: Alchieri, Leonardo, et autres
Publié: (2026)
Towards Transparent Reasoning: What Drives Faithfulness in Large Language Models?
par: McMillan, Teague, et autres
Publié: (2025)
par: McMillan, Teague, et autres
Publié: (2025)
Federated Behavioural Planes: Explaining the Evolution of Client Behaviour in Federated Learning
par: Fenoglio, Dario, et autres
Publié: (2024)
par: Fenoglio, Dario, et autres
Publié: (2024)
Differential Privacy for Anomaly Detection: Analyzing the Trade-off Between Privacy and Explainability
par: Ezzeddine, Fatima, et autres
Publié: (2024)
par: Ezzeddine, Fatima, et autres
Publié: (2024)
Mitigating Prompt-Induced Cognitive Biases in General-Purpose AI for Software Engineering
par: Sovrano, Francesco, et autres
Publié: (2026)
par: Sovrano, Francesco, et autres
Publié: (2026)
In-Context Symbolic Regression for Robustness-Improved Kolmogorov-Arnold Networks
par: Sovrano, Francesco, et autres
Publié: (2026)
par: Sovrano, Francesco, et autres
Publié: (2026)
On the interplay of Explainability, Privacy and Predictive Performance with Explanation-assisted Model Extraction
par: Ezzeddine, Fatima, et autres
Publié: (2025)
par: Ezzeddine, Fatima, et autres
Publié: (2025)
AnyCBMs: How to Turn Any Black Box into a Concept Bottleneck Model
par: Dominici, Gabriele, et autres
Publié: (2024)
par: Dominici, Gabriele, et autres
Publié: (2024)
Federated Concept-Based Models: Interpretable models with distributed supervision
par: Fenoglio, Dario, et autres
Publié: (2026)
par: Fenoglio, Dario, et autres
Publié: (2026)
A User Study Evaluating Argumentative Explanations in Diagnostic Decision Support
par: Liedeker, Felix, et autres
Publié: (2025)
par: Liedeker, Felix, et autres
Publié: (2025)
Federated Learning with Profile Mapping under Distribution Shifts and Drifts
par: Li, Mohan, et autres
Publié: (2026)
par: Li, Mohan, et autres
Publié: (2026)
Evaluating Counterfactual Explanation Methods on Incomplete Inputs
par: Leofante, Francesco, et autres
Publié: (2026)
par: Leofante, Francesco, et autres
Publié: (2026)
Is General-Purpose AI Reasoning Sensitive to Data-Induced Cognitive Biases? Dynamic Benchmarking on Typical Software Engineering Dilemmas
par: Sovrano, Francesco, et autres
Publié: (2025)
par: Sovrano, Francesco, et autres
Publié: (2025)
Interpretable Hierarchical Concept Reasoning through Attention-Guided Graph Learning
par: Debot, David, et autres
Publié: (2025)
par: Debot, David, et autres
Publié: (2025)
A Comparative User Evaluation of XRL Explanations using Goal Identification
par: Towers, Mark, et autres
Publié: (2025)
par: Towers, Mark, et autres
Publié: (2025)
Rule-Bottleneck Reinforcement Learning: Joint Explanation and Decision Optimization for Resource Allocation with Language Agents
par: Tec, Mauricio, et autres
Publié: (2025)
par: Tec, Mauricio, et autres
Publié: (2025)
Beyond One-Size-Fits-All: Adapting Counterfactual Explanations to User Objectives
par: Mastromichalakis, Orfeas Menis, et autres
Publié: (2024)
par: Mastromichalakis, Orfeas Menis, et autres
Publié: (2024)
Digital Socrates: Evaluating LLMs through Explanation Critiques
par: Gu, Yuling, et autres
Publié: (2023)
par: Gu, Yuling, et autres
Publié: (2023)
Textual Explanations and Their Evaluations for Reinforcement Learning Policy
par: Terra, Ahmad, et autres
Publié: (2026)
par: Terra, Ahmad, et autres
Publié: (2026)
Implicit Intelligence -- Evaluating Agents on What Users Don't Say
par: Sirdeshmukh, Ved, et autres
Publié: (2026)
par: Sirdeshmukh, Ved, et autres
Publié: (2026)
Explanation User Interfaces: A Systematic Literature Review
par: Cappuccio, Eleonora, et autres
Publié: (2025)
par: Cappuccio, Eleonora, et autres
Publié: (2025)
M2-PALE: A Framework for Explaining Multi-Agent MCTS--Minimax Hybrids via Process Mining and LLMs
par: Qian, Yiyu, et autres
Publié: (2026)
par: Qian, Yiyu, et autres
Publié: (2026)
Automatic Evaluation of Healthcare LLMs Beyond Question-Answering
par: Arias-Duart, Anna, et autres
Publié: (2025)
par: Arias-Duart, Anna, et autres
Publié: (2025)
LLMs Should Not Yet Be Credited with Decision Explanation
par: Wang, Wenshuo
Publié: (2026)
par: Wang, Wenshuo
Publié: (2026)
Visual Evaluative AI: A Hypothesis-Driven Tool with Concept-Based Explanations and Weight of Evidence
par: Le, Thao, et autres
Publié: (2024)
par: Le, Thao, et autres
Publié: (2024)
Beyond Ethical Alignment: Evaluating LLMs as Artificial Moral Assistants
par: Galatolo, Alessio, et autres
Publié: (2025)
par: Galatolo, Alessio, et autres
Publié: (2025)
R-ConstraintBench: Evaluating LLMs on NP-Complete Scheduling
par: Jain, Raj, et autres
Publié: (2025)
par: Jain, Raj, et autres
Publié: (2025)
Local Explanations and Self-Explanations for Assessing Faithfulness in black-box LLMs
par: Fragkathoulas, Christos, et autres
Publié: (2024)
par: Fragkathoulas, Christos, et autres
Publié: (2024)
A Taxonomy for Design and Evaluation of Prompt-Based Natural Language Explanations
par: Nejadgholi, Isar, et autres
Publié: (2025)
par: Nejadgholi, Isar, et autres
Publié: (2025)
Exploring the Effect of Explanation Content and Format on User Comprehension and Trust in Healthcare
par: Rago, Antonio, et autres
Publié: (2024)
par: Rago, Antonio, et autres
Publié: (2024)
Towards Piece-by-Piece Explanations for Chess Positions with SHAP
par: Spinnato, Francesco
Publié: (2025)
par: Spinnato, Francesco
Publié: (2025)
Towards Human-centered Explainable AI: A Survey of User Studies for Model Explanations
par: Rong, Yao, et autres
Publié: (2022)
par: Rong, Yao, et autres
Publié: (2022)
An Ontology-Enabled Approach For User-Centered and Knowledge-Enabled Explanations of AI Systems
par: Chari, Shruthi
Publié: (2024)
par: Chari, Shruthi
Publié: (2024)
Counterfactual Explanations for Hypergraph Neural Networks
par: Veglianti, Fabiano, et autres
Publié: (2026)
par: Veglianti, Fabiano, et autres
Publié: (2026)
Beyond Factual Correctness: Mitigating Preference-Inconsistent Explanations in Explainable Recommendation
par: Wang, Chengkai, et autres
Publié: (2026)
par: Wang, Chengkai, et autres
Publié: (2026)
Beyond Verification: Abductive Explanations for Post-AI Assessment of Privacy Leakage
par: Sonna, Belona, et autres
Publié: (2025)
par: Sonna, Belona, et autres
Publié: (2025)
Documents similaires
-
Counterfactual Concept Bottleneck Models
par: Dominici, Gabriele, et autres
Publié: (2024) -
Neuron-Anchored Rule Extraction for Large Language Models via Contrastive Hierarchical Ablation
par: Sovrano, Francesco, et autres
Publié: (2026) -
Causal Concept Graph Models: Beyond Causal Opacity in Deep Learning
par: Dominici, Gabriele, et autres
Publié: (2024) -
Counterfactual Explanations for Clustering Models
par: Spagnol, Aurora, et autres
Publié: (2024) -
A foundation model for electrodermal activity data
par: Alchieri, Leonardo, et autres
Publié: (2026)