Feature Attribution Stability Suite: How Stable Are Post-Hoc Attributions?
Fuente:
arXiv
Salvato in:
| Autori principali: | Subramaniakuppusamy, Kamalasankari, Gajjar, Jugal |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
RSAT: Structured Attribution Makes Small Language Models Faithful Table Reasoners
di: Gajjar, Jugal, et al.
Pubblicazione: (2026)
di: Gajjar, Jugal, et al.
Pubblicazione: (2026)
MLCPD: A Unified Multi-Language Code Parsing Dataset with Universal AST Schema
di: Gajjar, Jugal, et al.
Pubblicazione: (2025)
di: Gajjar, Jugal, et al.
Pubblicazione: (2025)
HyperComplEx: Adaptive Multi-Space Knowledge Graph Embeddings
di: Gajjar, Jugal, et al.
Pubblicazione: (2025)
di: Gajjar, Jugal, et al.
Pubblicazione: (2025)
Bridging Semantics & Structure for Software Vulnerability Detection using Hybrid Network Models
di: Gajjar, Jugal, et al.
Pubblicazione: (2025)
di: Gajjar, Jugal, et al.
Pubblicazione: (2025)
Discriminative Feature Attributions: Bridging Post Hoc Explainability and Inherent Interpretability
di: Bhalla, Usha, et al.
Pubblicazione: (2023)
di: Bhalla, Usha, et al.
Pubblicazione: (2023)
Provably Better Explanations with Optimized Aggregation of Feature Attributions
di: Decker, Thomas, et al.
Pubblicazione: (2024)
di: Decker, Thomas, et al.
Pubblicazione: (2024)
MalCodeAI: Autonomous Vulnerability Detection and Remediation via Language Agnostic Code Reasoning
di: Gajjar, Jugal, et al.
Pubblicazione: (2025)
di: Gajjar, Jugal, et al.
Pubblicazione: (2025)
Rethinking Robustness: A New Approach to Evaluating Feature Attribution Methods
di: Kiourti, Panagiota, et al.
Pubblicazione: (2025)
di: Kiourti, Panagiota, et al.
Pubblicazione: (2025)
Visual-TCAV: Concept-based Attribution and Saliency Maps for Post-hoc Explainability in Image Classification
di: De Santis, Antonio, et al.
Pubblicazione: (2024)
di: De Santis, Antonio, et al.
Pubblicazione: (2024)
Exp-Graph: How Connections Learn Facial Attributes in Graph-based Expression Recognition
di: Sharma, Nandani, et al.
Pubblicazione: (2025)
di: Sharma, Nandani, et al.
Pubblicazione: (2025)
Attributing Data for Sharpness-Aware Minimization
di: Ren, Chenyang, et al.
Pubblicazione: (2025)
di: Ren, Chenyang, et al.
Pubblicazione: (2025)
Post-Hoc Concept Disentanglement: From Correlated to Isolated Concept Representations
di: Erogullari, Eren, et al.
Pubblicazione: (2025)
di: Erogullari, Eren, et al.
Pubblicazione: (2025)
On Background Bias of Post-Hoc Concept Embeddings in Computer Vision DNNs
di: Schwalbe, Gesina, et al.
Pubblicazione: (2025)
di: Schwalbe, Gesina, et al.
Pubblicazione: (2025)
Towards Attributions of Input Variables in a Coalition
di: Zheng, Xinhao, et al.
Pubblicazione: (2023)
di: Zheng, Xinhao, et al.
Pubblicazione: (2023)
Intriguing Properties of Data Attribution on Diffusion Models
di: Zheng, Xiaosen, et al.
Pubblicazione: (2023)
di: Zheng, Xiaosen, et al.
Pubblicazione: (2023)
SEM: Sparse Embedding Modulation for Post-Hoc Debiasing of Vision-Language Models
di: Guimard, Quentin, et al.
Pubblicazione: (2026)
di: Guimard, Quentin, et al.
Pubblicazione: (2026)
SecureFixAgent: A Hybrid LLM Agent for Automated Python Static Vulnerability Repair
di: Gajjar, Jugal, et al.
Pubblicazione: (2025)
di: Gajjar, Jugal, et al.
Pubblicazione: (2025)
Biased Binary Attribute Classifiers Ignore the Majority Classes
di: Zhang, Xinyi, et al.
Pubblicazione: (2024)
di: Zhang, Xinyi, et al.
Pubblicazione: (2024)
Tree of Attributes Prompt Learning for Vision-Language Models
di: Ding, Tong, et al.
Pubblicazione: (2024)
di: Ding, Tong, et al.
Pubblicazione: (2024)
Attribution-Guided Model Rectification of Unreliable Neural Network Behaviors
di: Yang, Peiyu, et al.
Pubblicazione: (2026)
di: Yang, Peiyu, et al.
Pubblicazione: (2026)
AAPL: Adding Attributes to Prompt Learning for Vision-Language Models
di: Kim, Gahyeon, et al.
Pubblicazione: (2024)
di: Kim, Gahyeon, et al.
Pubblicazione: (2024)
Better Understanding Differences in Attribution Methods via Systematic Evaluations
di: Rao, Sukrut, et al.
Pubblicazione: (2023)
di: Rao, Sukrut, et al.
Pubblicazione: (2023)
Private Attribute Inference from Images with Vision-Language Models
di: Tömekçe, Batuhan, et al.
Pubblicazione: (2024)
di: Tömekçe, Batuhan, et al.
Pubblicazione: (2024)
Adversarial Semantic and Label Perturbation Attack for Pedestrian Attribute Recognition
di: Kong, Weizhe, et al.
Pubblicazione: (2025)
di: Kong, Weizhe, et al.
Pubblicazione: (2025)
SUB: Benchmarking CBM Generalization via Synthetic Attribute Substitutions
di: Bader, Jessica, et al.
Pubblicazione: (2025)
di: Bader, Jessica, et al.
Pubblicazione: (2025)
Clinical Domain Knowledge-Derived Template Improves Post Hoc AI Explanations in Pneumothorax Classification
di: Yuan, Han, et al.
Pubblicazione: (2024)
di: Yuan, Han, et al.
Pubblicazione: (2024)
Explaining Black-box Model Predictions via Two-level Nested Feature Attributions with Consistency Property
di: Yoshikawa, Yuya, et al.
Pubblicazione: (2024)
di: Yoshikawa, Yuya, et al.
Pubblicazione: (2024)
Pruning By Explaining Revisited: Optimizing Attribution Methods to Prune CNNs and Transformers
di: Hatefi, Sayed Mohammad Vakilzadeh, et al.
Pubblicazione: (2024)
di: Hatefi, Sayed Mohammad Vakilzadeh, et al.
Pubblicazione: (2024)
Not All Splits Are Equal: Rethinking Attribute Generalization Across Unrelated Categories
di: Fircă, Liviu Nicolae, et al.
Pubblicazione: (2025)
di: Fircă, Liviu Nicolae, et al.
Pubblicazione: (2025)
Reliable Evaluation of Attribution Maps in CNNs: A Perturbation-Based Approach
di: Nieradzik, Lars, et al.
Pubblicazione: (2024)
di: Nieradzik, Lars, et al.
Pubblicazione: (2024)
What You See is What You Classify: Black Box Attributions
di: Stalder, Steven, et al.
Pubblicazione: (2022)
di: Stalder, Steven, et al.
Pubblicazione: (2022)
From Baselines to Transport Geodesics: Axiomatic Attribution via Optimal Generative Flows
di: Zhang, Cenwei, et al.
Pubblicazione: (2026)
di: Zhang, Cenwei, et al.
Pubblicazione: (2026)
When Graph meets Multimodal: Benchmarking and Meditating on Multimodal Attributed Graphs Learning
di: Yan, Hao, et al.
Pubblicazione: (2024)
di: Yan, Hao, et al.
Pubblicazione: (2024)
LibraGrad: Balancing Gradient Flow for Universally Better Vision Transformer Attributions
di: Mehri, Faridoun, et al.
Pubblicazione: (2024)
di: Mehri, Faridoun, et al.
Pubblicazione: (2024)
PAE: LLM-based Product Attribute Extraction for E-Commerce Fashion Trends
di: Sinha, Apurva, et al.
Pubblicazione: (2024)
di: Sinha, Apurva, et al.
Pubblicazione: (2024)
Visual Explanations of Image-Text Representations via Multi-Modal Information Bottleneck Attribution
di: Wang, Ying, et al.
Pubblicazione: (2023)
di: Wang, Ying, et al.
Pubblicazione: (2023)
Combo-Gait: Unified Transformer Framework for Multi-Modal Gait Recognition and Attribute Analysis
di: Wang, Zhao-Yang, et al.
Pubblicazione: (2025)
di: Wang, Zhao-Yang, et al.
Pubblicazione: (2025)
Enhancing Worldwide Image Geolocation by Ensembling Satellite-Based Ground-Level Attribute Predictors
di: Bianco, Michael J., et al.
Pubblicazione: (2024)
di: Bianco, Michael J., et al.
Pubblicazione: (2024)
Continuous, Subject-Specific Attribute Control in T2I Models by Identifying Semantic Directions
di: Baumann, Stefan Andreas, et al.
Pubblicazione: (2024)
di: Baumann, Stefan Andreas, et al.
Pubblicazione: (2024)
Auditing Sybil: Explaining Deep Lung Cancer Risk Prediction Through Generative Interventional Attributions
di: Sobieski, Bartlomiej, et al.
Pubblicazione: (2026)
di: Sobieski, Bartlomiej, et al.
Pubblicazione: (2026)
Documenti analoghi
-
RSAT: Structured Attribution Makes Small Language Models Faithful Table Reasoners
di: Gajjar, Jugal, et al.
Pubblicazione: (2026) -
MLCPD: A Unified Multi-Language Code Parsing Dataset with Universal AST Schema
di: Gajjar, Jugal, et al.
Pubblicazione: (2025) -
HyperComplEx: Adaptive Multi-Space Knowledge Graph Embeddings
di: Gajjar, Jugal, et al.
Pubblicazione: (2025) -
Bridging Semantics & Structure for Software Vulnerability Detection using Hybrid Network Models
di: Gajjar, Jugal, et al.
Pubblicazione: (2025) -
Discriminative Feature Attributions: Bridging Post Hoc Explainability and Inherent Interpretability
di: Bhalla, Usha, et al.
Pubblicazione: (2023)