Evaluate with the Inverse: Efficient Approximation of Latent Explanation Quality Distribution
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Eiras-Franco, Carlos, Hedström, Anna, Höhne, Marina M. -C. |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
CoSy: Evaluating Textual Explanations of Neurons
par: Kopf, Laura, et autres
Publié: (2024)
par: Kopf, Laura, et autres
Publié: (2024)
Finding the right XAI method -- A Guide for the Evaluation and Ranking of Explainable AI Methods in Climate Science
par: Bommer, Philine, et autres
Publié: (2023)
par: Bommer, Philine, et autres
Publié: (2023)
A Fresh Look at Sanity Checks for Saliency Maps
par: Hedström, Anna, et autres
Publié: (2024)
par: Hedström, Anna, et autres
Publié: (2024)
Sanity Checks Revisited: An Exploration to Repair the Model Parameter Randomisation Test
par: Hedström, Anna, et autres
Publié: (2024)
par: Hedström, Anna, et autres
Publié: (2024)
Labeling Neural Representations with Inverse Recognition
par: Bykov, Kirill, et autres
Publié: (2023)
par: Bykov, Kirill, et autres
Publié: (2023)
Capturing Polysemanticity with PRISM: A Multi-Concept Feature Description Framework
par: Kopf, Laura, et autres
Publié: (2025)
par: Kopf, Laura, et autres
Publié: (2025)
Unsupervised Dynamic Feature Selection for Robust Latent Spaces in Vision Tasks
par: Corcuera, Bruno, et autres
Publié: (2025)
par: Corcuera, Bruno, et autres
Publié: (2025)
From Flexibility to Manipulation: The Slippery Slope of XAI Evaluation
par: Wickstrøm, Kristoffer, et autres
Publié: (2024)
par: Wickstrøm, Kristoffer, et autres
Publié: (2024)
Latent-IMH: Efficient Bayesian Inference for Inverse Problems with Approximate Operators
par: Chen, Youguang, et autres
Publié: (2026)
par: Chen, Youguang, et autres
Publié: (2026)
Uncertainty Gating for Cost-Aware Explainable Artificial Intelligence
par: Mikriukov, Georgii, et autres
Publié: (2026)
par: Mikriukov, Georgii, et autres
Publié: (2026)
Prototypical Self-Explainable Models Without Re-training
par: Gautam, Srishti, et autres
Publié: (2023)
par: Gautam, Srishti, et autres
Publié: (2023)
Efficient and Accurate Explanation Estimation with Distribution Compression
par: Baniecki, Hubert, et autres
Publié: (2024)
par: Baniecki, Hubert, et autres
Publié: (2024)
Quantifying Explanation Quality in Graph Neural Networks using Out-of-Distribution Generalization
par: Zhang, Ding, et autres
Publié: (2026)
par: Zhang, Ding, et autres
Publié: (2026)
Approximating Shapley Explanations in Reinforcement Learning
par: Beechey, Daniel, et autres
Publié: (2025)
par: Beechey, Daniel, et autres
Publié: (2025)
Know Thy Judge: On the Robustness Meta-Evaluation of LLM Safety Judges
par: Eiras, Francisco, et autres
Publié: (2025)
par: Eiras, Francisco, et autres
Publié: (2025)
Quanda: An Interpretability Toolkit for Training Data Attribution Evaluation and Beyond
par: Bareeva, Dilyara, et autres
Publié: (2024)
par: Bareeva, Dilyara, et autres
Publié: (2024)
Deep Learning Meets Teleconnections: Improving S2S Predictions for European Winter Weather
par: Bommer, Philine L., et autres
Publié: (2025)
par: Bommer, Philine L., et autres
Publié: (2025)
Counterfactual Explanations via Riemannian Latent Space Traversal
par: Pegios, Paraskevas, et autres
Publié: (2024)
par: Pegios, Paraskevas, et autres
Publié: (2024)
Can LLM Assist in the Evaluation of the Quality of Machine Learning Explanations?
par: Wang, Bo, et autres
Publié: (2025)
par: Wang, Bo, et autres
Publié: (2025)
InverseCrafter: Efficient Video ReCapture as a Latent Domain Inverse Problem
par: Hong, Yeobin, et autres
Publié: (2025)
par: Hong, Yeobin, et autres
Publié: (2025)
Latent Space Translation via Inverse Relative Projection
par: Maiorca, Valentino, et autres
Publié: (2024)
par: Maiorca, Valentino, et autres
Publié: (2024)
To Steer or Not to Steer? Mechanistic Error Reduction with Abstention for Language Models
par: Hedström, Anna, et autres
Publié: (2025)
par: Hedström, Anna, et autres
Publié: (2025)
Transparent Neighborhood Approximation for Text Classifier Explanation
par: Cai, Yi, et autres
Publié: (2024)
par: Cai, Yi, et autres
Publié: (2024)
Efficient Contrastive Explanations on Demand
par: Izza, Yacine, et autres
Publié: (2024)
par: Izza, Yacine, et autres
Publié: (2024)
Exact Evaluation of the Accuracy of Diffusion Models for Inverse Problems with Gaussian Data Distributions
par: Pierret, Emile, et autres
Publié: (2025)
par: Pierret, Emile, et autres
Publié: (2025)
Corrected Integrated Laplace Approximation for Bayesian Inference in Latent Gaussian Models
par: Lai, Jinlin, et autres
Publié: (2026)
par: Lai, Jinlin, et autres
Publié: (2026)
Latent-Conditioned Parameterized Quantum Circuits as Universal Approximators for Distributions over Quantum States
par: Tran, Quoc Hoan, et autres
Publié: (2026)
par: Tran, Quoc Hoan, et autres
Publié: (2026)
Distributional Inverse Reinforcement Learning
par: Wu, Feiyang, et autres
Publié: (2025)
par: Wu, Feiyang, et autres
Publié: (2025)
Predictively Combatting Toxicity in Health-related Online Discussions through Machine Learning
par: Paz-Ruza, Jorge, et autres
Publié: (2025)
par: Paz-Ruza, Jorge, et autres
Publié: (2025)
Efficient Error Certification for Physics-Informed Neural Networks
par: Eiras, Francisco, et autres
Publié: (2023)
par: Eiras, Francisco, et autres
Publié: (2023)
A Bayesian Framework for Uncertainty-Aware Explanations in Power Quality Disturbance Classification
par: Chen, Yinsong, et autres
Publié: (2026)
par: Chen, Yinsong, et autres
Publié: (2026)
DISCOVER: A Solver for Distributional Counterfactual Explanations
par: Gu, Yikai, et autres
Publié: (2026)
par: Gu, Yikai, et autres
Publié: (2026)
Generative modeling of Sparse Approximate Inverse Preconditioners
par: Li, Mou, et autres
Publié: (2024)
par: Li, Mou, et autres
Publié: (2024)
Inverse Design for Conditional Distribution Matching
par: Meidler, Ori, et autres
Publié: (2026)
par: Meidler, Ori, et autres
Publié: (2026)
ReasonX: Declarative Reasoning on Explanations
par: State, Laura, et autres
Publié: (2026)
par: State, Laura, et autres
Publié: (2026)
Uncovering the Structure of Explanation Quality with Spectral Analysis
par: Maeß, Johannes, et autres
Publié: (2025)
par: Maeß, Johannes, et autres
Publié: (2025)
Beyond RMSE and MAE: Introducing EAUC to unmask hidden bias and unfairness in dyadic regression models
par: Paz-Ruza, Jorge, et autres
Publié: (2024)
par: Paz-Ruza, Jorge, et autres
Publié: (2024)
BELLA: Black box model Explanations by Local Linear Approximations
par: Radulovic, Nedeljko, et autres
Publié: (2023)
par: Radulovic, Nedeljko, et autres
Publié: (2023)
Explanations are a Means to an End: Decision Theoretic Explanation Evaluation
par: Guo, Ziyang, et autres
Publié: (2025)
par: Guo, Ziyang, et autres
Publié: (2025)
Approximating Latent Manifolds in Neural Networks via Vanishing Ideals
par: Pelleriti, Nico, et autres
Publié: (2025)
par: Pelleriti, Nico, et autres
Publié: (2025)
Documents similaires
-
CoSy: Evaluating Textual Explanations of Neurons
par: Kopf, Laura, et autres
Publié: (2024) -
Finding the right XAI method -- A Guide for the Evaluation and Ranking of Explainable AI Methods in Climate Science
par: Bommer, Philine, et autres
Publié: (2023) -
A Fresh Look at Sanity Checks for Saliency Maps
par: Hedström, Anna, et autres
Publié: (2024) -
Sanity Checks Revisited: An Exploration to Repair the Model Parameter Randomisation Test
par: Hedström, Anna, et autres
Publié: (2024) -
Labeling Neural Representations with Inverse Recognition
par: Bykov, Kirill, et autres
Publié: (2023)