Knowing What You Cannot Explain: Learning to Reject Low-Quality Explanations
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Stradiotti, Luca, Pesenti, Dario, Teso, Stefano, Davis, Jesse |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
xAI-Drop: Don't Use What You Cannot Explain
par: De Luca, Vincenzo Marco, et autres
Publié: (2024)
par: De Luca, Vincenzo Marco, et autres
Publié: (2024)
GNN Explanations that do not Explain and How to find Them
par: Azzolin, Steve, et autres
Publié: (2026)
par: Azzolin, Steve, et autres
Publié: (2026)
Bounded-Abstention Multi-horizon Time-series Forecasting
par: Stradiotti, Luca, et autres
Publié: (2026)
par: Stradiotti, Luca, et autres
Publié: (2026)
Human Cognitive Biases in Explanation-Based Interaction: The Case of Within and Between Session Order Effect
par: Pesenti, Dario, et autres
Publié: (2025)
par: Pesenti, Dario, et autres
Publié: (2025)
Explaining deep neural network models for electricity price forecasting with XAI
par: Pesenti, Antoine, et autres
Publié: (2025)
par: Pesenti, Antoine, et autres
Publié: (2025)
Explaining GNN Explanations with Edge Gradients
par: He, Jesse, et autres
Publié: (2025)
par: He, Jesse, et autres
Publié: (2025)
Spurious Correlations in Concept Drift: Can Explanatory Interaction Help?
par: Lalletti, Cristiana, et autres
Publié: (2024)
par: Lalletti, Cristiana, et autres
Publié: (2024)
Concisely Explaining the Doubt: Minimum-Size Abductive Explanations for Linear Models with a Reject Option
par: Fernandes, Gleilson Pedro, et autres
Publié: (2026)
par: Fernandes, Gleilson Pedro, et autres
Publié: (2026)
Experts Don't Cheat: Learning What You Don't Know By Predicting Pairs
par: Johnson, Daniel D., et autres
Publié: (2024)
par: Johnson, Daniel D., et autres
Publié: (2024)
Knowing What You Know Is Not Enough: Large Language Model Confidences Don't Align With Their Actions
par: Pal, Arka, et autres
Publié: (2025)
par: Pal, Arka, et autres
Publié: (2025)
Know What You Don't Know: Uncertainty Calibration of Process Reward Models
par: Park, Young-Jin, et autres
Publié: (2025)
par: Park, Young-Jin, et autres
Publié: (2025)
Know What You Don't Know: Selective Prediction for Early Exit DNNs
par: Bajpai, Divya Jyoti, et autres
Publié: (2025)
par: Bajpai, Divya Jyoti, et autres
Publié: (2025)
Trusting What You Cannot See: Auditable Fine-Tuning and Inference for Proprietary AI
par: Jin, Heng, et autres
Publié: (2026)
par: Jin, Heng, et autres
Publié: (2026)
Avoid What You Know: Divergent Trajectory Balance for GFlowNets
par: Dall'Antonia, Pedro, et autres
Publié: (2026)
par: Dall'Antonia, Pedro, et autres
Publié: (2026)
Use What You Know: Causal Foundation Models with Partial Graphs
par: Reuter, Arik, et autres
Publié: (2026)
par: Reuter, Arik, et autres
Publié: (2026)
Specifying What You Know or Not for Multi-Label Class-Incremental Learning
par: Zhang, Aoting, et autres
Publié: (2025)
par: Zhang, Aoting, et autres
Publié: (2025)
Towards Logically Consistent Language Models via Probabilistic Reasoning
par: Calanzone, Diego, et autres
Publié: (2024)
par: Calanzone, Diego, et autres
Publié: (2024)
Machine Learning with a Reject Option: A survey
par: Hendrickx, Kilian, et autres
Publié: (2021)
par: Hendrickx, Kilian, et autres
Publié: (2021)
First, Learn What You Don't Know: Active Information Gathering for Driving at the Limits of Handling
par: Davydov, Alexander, et autres
Publié: (2024)
par: Davydov, Alexander, et autres
Publié: (2024)
Beyond Topological Self-Explainable GNNs: A Formal Explainability Perspective
par: Azzolin, Steve, et autres
Publié: (2025)
par: Azzolin, Steve, et autres
Publié: (2025)
Comparing Explanations is Not Enough, Explain the Change: New Standards are Needed to Explain Behavioral Shifts in Large Language Models
par: Ciaperoni, Martino, et autres
Publié: (2026)
par: Ciaperoni, Martino, et autres
Publié: (2026)
Logically Consistent Language Models via Neuro-Symbolic Integration
par: Calanzone, Diego, et autres
Publié: (2024)
par: Calanzone, Diego, et autres
Publié: (2024)
When No-Rejection Learning is Consistent for Regression with Rejection
par: Li, Xiaocheng, et autres
Publié: (2023)
par: Li, Xiaocheng, et autres
Publié: (2023)
Show Me What You Don't Know: Efficient Sampling from Invariant Sets for Model Validation
par: Rousselot, Armand, et autres
Publié: (2026)
par: Rousselot, Armand, et autres
Publié: (2026)
Know What You do Not Know: Verbalized Uncertainty Estimation Robustness on Corrupted Images in Vision-Language Models
par: Borszukovszki, Mirko, et autres
Publié: (2025)
par: Borszukovszki, Mirko, et autres
Publié: (2025)
When Can You Trust Your Explanations? A Robustness Analysis on Feature Importances
par: Vascotto, Ilaria, et autres
Publié: (2024)
par: Vascotto, Ilaria, et autres
Publié: (2024)
Do You Know What You Are Talking About? Characterizing Query-Knowledge Relevance For Reliable Retrieval Augmented Generation
par: Li, Zhuohang, et autres
Publié: (2024)
par: Li, Zhuohang, et autres
Publié: (2024)
Reconsidering Faithfulness in Regular, Self-Explainable and Domain Invariant GNNs
par: Azzolin, Steve, et autres
Publié: (2024)
par: Azzolin, Steve, et autres
Publié: (2024)
Robots That Know What to Ask: Recovering Misaligned Rewards through Targeted Explanations
par: Merker, Helena, et autres
Publié: (2026)
par: Merker, Helena, et autres
Publié: (2026)
Dealing with Uncertainty in Contextual Anomaly Detection
par: Bindini, Luca, et autres
Publié: (2025)
par: Bindini, Luca, et autres
Publié: (2025)
You Are What You Eat -- AI Alignment Requires Understanding How Data Shapes Structure and Generalisation
par: Lehalleur, Simon Pepin, et autres
Publié: (2025)
par: Lehalleur, Simon Pepin, et autres
Publié: (2025)
Forget What You Know about LLMs Evaluations -- LLMs are Like a Chameleon
par: Cohen-Inger, Nurit, et autres
Publié: (2025)
par: Cohen-Inger, Nurit, et autres
Publié: (2025)
Learn What You Need in Personalized Federated Learning
par: Lv, Kexin, et autres
Publié: (2024)
par: Lv, Kexin, et autres
Publié: (2024)
Time Can Invalidate Algorithmic Recourse
par: De Toni, Giovanni, et autres
Publié: (2024)
par: De Toni, Giovanni, et autres
Publié: (2024)
A Neuro-Symbolic Benchmark Suite for Concept Quality and Reasoning Shortcuts
par: Bortolotti, Samuele, et autres
Publié: (2024)
par: Bortolotti, Samuele, et autres
Publié: (2024)
Explaining k-Nearest Neighbors: Abductive and Counterfactual Explanations
par: Barceló, Pablo, et autres
Publié: (2025)
par: Barceló, Pablo, et autres
Publié: (2025)
Explaining Hypergraph Neural Networks: From Local Explanations to Global Concepts
par: Su, Shiye, et autres
Publié: (2024)
par: Su, Shiye, et autres
Publié: (2024)
What You See is Not What You Get: Neural Partial Differential Equations and The Illusion of Learning
par: Mohan, Arvind, et autres
Publié: (2024)
par: Mohan, Arvind, et autres
Publié: (2024)
Shortcuts and Identifiability in Concept-based Models from a Neuro-Symbolic Lens
par: Bortolotti, Samuele, et autres
Publié: (2025)
par: Bortolotti, Samuele, et autres
Publié: (2025)
Concise and Logically Consistent Conformal Sets for Neuro-Symbolic Concept-Based Models
par: Bortolotti, Samuele, et autres
Publié: (2026)
par: Bortolotti, Samuele, et autres
Publié: (2026)
Documents similaires
-
xAI-Drop: Don't Use What You Cannot Explain
par: De Luca, Vincenzo Marco, et autres
Publié: (2024) -
GNN Explanations that do not Explain and How to find Them
par: Azzolin, Steve, et autres
Publié: (2026) -
Bounded-Abstention Multi-horizon Time-series Forecasting
par: Stradiotti, Luca, et autres
Publié: (2026) -
Human Cognitive Biases in Explanation-Based Interaction: The Case of Within and Between Session Order Effect
par: Pesenti, Dario, et autres
Publié: (2025) -
Explaining deep neural network models for electricity price forecasting with XAI
par: Pesenti, Antoine, et autres
Publié: (2025)