ABE: A Unified Framework for Robust and Faithful Attribution-Based Explainability
Fuente:
arXiv
Salvato in:
| Autori principali: | Zhu, Zhiyu, Zhang, Jiayu, Jin, Zhibo, Chen, Fang, Zhou, Jianlong |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Enhancing Model Interpretability with Local Attribution over Global Exploration
di: Zhu, Zhiyu, et al.
Pubblicazione: (2024)
di: Zhu, Zhiyu, et al.
Pubblicazione: (2024)
Attribution for Enhanced Explanation with Transferable Adversarial eXploration
di: Zhu, Zhiyu, et al.
Pubblicazione: (2024)
di: Zhu, Zhiyu, et al.
Pubblicazione: (2024)
Revisiting Sharpness-Aware Minimization: A More Faithful and Effective Implementation
di: Chen, Jianlong, et al.
Pubblicazione: (2026)
di: Chen, Jianlong, et al.
Pubblicazione: (2026)
Leveraging Information Consistency in Frequency and Spatial Domain for Adversarial Attacks
di: Jin, Zhibo, et al.
Pubblicazione: (2024)
di: Jin, Zhibo, et al.
Pubblicazione: (2024)
F-Fidelity: A Robust Framework for Faithfulness Evaluation of Explainable AI
di: Zheng, Xu, et al.
Pubblicazione: (2024)
di: Zheng, Xu, et al.
Pubblicazione: (2024)
Enhancing Transferability of Adversarial Attacks with GE-AdvGAN+: A Comprehensive Framework for Gradient Editing
di: Jin, Zhibo, et al.
Pubblicazione: (2024)
di: Jin, Zhibo, et al.
Pubblicazione: (2024)
PAR-AdvGAN: Improving Adversarial Attack Capability with Progressive Auto-Regression AdvGAN
di: Zhang, Jiayu, et al.
Pubblicazione: (2025)
di: Zhang, Jiayu, et al.
Pubblicazione: (2025)
Beyond Noisy-TVs: Noise-Robust Exploration Via Learning Progress Monitoring
di: Hou, Zhibo, et al.
Pubblicazione: (2025)
di: Hou, Zhibo, et al.
Pubblicazione: (2025)
Hybrid Attribution Priors for Explainable and Robust Model Training
di: Zhang, Zhuoran, et al.
Pubblicazione: (2025)
di: Zhang, Zhuoran, et al.
Pubblicazione: (2025)
DeepFaith: A Domain-Free and Model-Agnostic Unified Framework for Highly Faithful Explanations
di: Guo, Yuhan, et al.
Pubblicazione: (2025)
di: Guo, Yuhan, et al.
Pubblicazione: (2025)
Towards Unified Attribution in Explainable AI, Data-Centric AI, and Mechanistic Interpretability
di: Zhang, Shichang, et al.
Pubblicazione: (2025)
di: Zhang, Shichang, et al.
Pubblicazione: (2025)
Correlation-Aware Feature Attribution Based Explainable AI
di: Sengupta, Poushali, et al.
Pubblicazione: (2025)
di: Sengupta, Poushali, et al.
Pubblicazione: (2025)
Beyond Output Faithfulness: Learning Attributions that Preserve Computational Pathways
di: Zhang, Siyu, et al.
Pubblicazione: (2025)
di: Zhang, Siyu, et al.
Pubblicazione: (2025)
Explainability in Generative Medical Diffusion Models: A Faithfulness-Based Analysis on MRI Synthesis
di: Dey, Surjo, et al.
Pubblicazione: (2026)
di: Dey, Surjo, et al.
Pubblicazione: (2026)
Enhancing Adversarial Attacks via Parameter Adaptive Adversarial Attack
di: Jin, Zhibo, et al.
Pubblicazione: (2024)
di: Jin, Zhibo, et al.
Pubblicazione: (2024)
Optimal Look-back Horizon for Time Series Forecasting in Federated Learning
di: Tang, Dahao, et al.
Pubblicazione: (2025)
di: Tang, Dahao, et al.
Pubblicazione: (2025)
Narrowing Information Bottleneck Theory for Multimodal Image-Text Representations Interpretability
di: Zhu, Zhiyu, et al.
Pubblicazione: (2025)
di: Zhu, Zhiyu, et al.
Pubblicazione: (2025)
Reconsidering Faithfulness in Regular, Self-Explainable and Domain Invariant GNNs
di: Azzolin, Steve, et al.
Pubblicazione: (2024)
di: Azzolin, Steve, et al.
Pubblicazione: (2024)
Unifying VXAI: A Systematic Review and Framework for the Evaluation of Explainable AI
di: Dembinsky, David, et al.
Pubblicazione: (2025)
di: Dembinsky, David, et al.
Pubblicazione: (2025)
Incorporating Attribution Importance for Improving Faithfulness Metrics
di: Zhao, Zhixue, et al.
Pubblicazione: (2023)
di: Zhao, Zhixue, et al.
Pubblicazione: (2023)
Unifying Attribution-Based Explanations Using Functional Decomposition
di: Gevaert, Arne, et al.
Pubblicazione: (2024)
di: Gevaert, Arne, et al.
Pubblicazione: (2024)
Unraveling LoRA Interference: Orthogonal Subspaces for Robust Model Merging
di: Zhang, Haobo, et al.
Pubblicazione: (2025)
di: Zhang, Haobo, et al.
Pubblicazione: (2025)
AI Pangaea: Unifying Intelligence Islands for Adapting Myriad Tasks
di: Chang, Jianlong, et al.
Pubblicazione: (2025)
di: Chang, Jianlong, et al.
Pubblicazione: (2025)
Learning Unified Distance Metric for Heterogeneous Attribute Data Clustering
di: Zhang, Yiqun, et al.
Pubblicazione: (2026)
di: Zhang, Yiqun, et al.
Pubblicazione: (2026)
LEGO: A Lightweight and Efficient Multiple-Attribute Unlearning Framework for Recommender Systems
di: Yu, Fengyuan, et al.
Pubblicazione: (2025)
di: Yu, Fengyuan, et al.
Pubblicazione: (2025)
Enhancing Robustness of Offline Reinforcement Learning Under Data Corruption via Sharpness-Aware Minimization
di: Xu, Le, et al.
Pubblicazione: (2025)
di: Xu, Le, et al.
Pubblicazione: (2025)
Does Faithfulness Conflict with Plausibility? An Empirical Study in Explainable AI across NLP Tasks
di: Lu, Xiaolei, et al.
Pubblicazione: (2024)
di: Lu, Xiaolei, et al.
Pubblicazione: (2024)
Sparse, Efficient and Explainable Data Attribution with DualXDA
di: Yolcu, Galip Ümit, et al.
Pubblicazione: (2024)
di: Yolcu, Galip Ümit, et al.
Pubblicazione: (2024)
Towards a Unified Framework of Clustering-based Anomaly Detection
di: Fang, Zeyu, et al.
Pubblicazione: (2024)
di: Fang, Zeyu, et al.
Pubblicazione: (2024)
UFO: A Unified Flow-Oriented Framework for Robust Continual Graph Learning
di: Zhang, Danhui, et al.
Pubblicazione: (2026)
di: Zhang, Danhui, et al.
Pubblicazione: (2026)
A Unified Framework for Generative Data Augmentation: A Comprehensive Survey
di: Chen, Yunhao, et al.
Pubblicazione: (2023)
di: Chen, Yunhao, et al.
Pubblicazione: (2023)
High-order Knowledge Based Network Controllability Robustness Prediction: A Hypergraph Neural Network Approach
di: Mo, Shibing, et al.
Pubblicazione: (2026)
di: Mo, Shibing, et al.
Pubblicazione: (2026)
Explainable Human Activity Recognition: A Unified Review of Concepts and Mechanisms
di: Kundu, Mainak, et al.
Pubblicazione: (2026)
di: Kundu, Mainak, et al.
Pubblicazione: (2026)
FedEAT: A Robustness Optimization Framework for Federated LLMs
di: Pang, Yahao, et al.
Pubblicazione: (2025)
di: Pang, Yahao, et al.
Pubblicazione: (2025)
Faithfulness Evaluation for Decoder-only LLM Attributions with Controlled Retained Information
di: Huang, Xin, et al.
Pubblicazione: (2026)
di: Huang, Xin, et al.
Pubblicazione: (2026)
A Unified Frequency Domain Decomposition Framework for Interpretable and Robust Time Series Forecasting
di: He, Cheng, et al.
Pubblicazione: (2025)
di: He, Cheng, et al.
Pubblicazione: (2025)
Faithful Path Language Modeling for Explainable Recommendation over Knowledge Graph
di: Balloccu, Giacomo, et al.
Pubblicazione: (2023)
di: Balloccu, Giacomo, et al.
Pubblicazione: (2023)
Transformer Circuit Faithfulness Metrics are not Robust
di: Miller, Joseph, et al.
Pubblicazione: (2024)
di: Miller, Joseph, et al.
Pubblicazione: (2024)
Wrapper Boxes: Faithful Attribution of Model Predictions to Training Data
di: Su, Yiheng, et al.
Pubblicazione: (2023)
di: Su, Yiheng, et al.
Pubblicazione: (2023)
ANO: A Principled Approach to Robust Policy Optimization
di: Zhang, Yiheng, et al.
Pubblicazione: (2026)
di: Zhang, Yiheng, et al.
Pubblicazione: (2026)
Documenti analoghi
-
Enhancing Model Interpretability with Local Attribution over Global Exploration
di: Zhu, Zhiyu, et al.
Pubblicazione: (2024) -
Attribution for Enhanced Explanation with Transferable Adversarial eXploration
di: Zhu, Zhiyu, et al.
Pubblicazione: (2024) -
Revisiting Sharpness-Aware Minimization: A More Faithful and Effective Implementation
di: Chen, Jianlong, et al.
Pubblicazione: (2026) -
Leveraging Information Consistency in Frequency and Spatial Domain for Adversarial Attacks
di: Jin, Zhibo, et al.
Pubblicazione: (2024) -
F-Fidelity: A Robust Framework for Faithfulness Evaluation of Explainable AI
di: Zheng, Xu, et al.
Pubblicazione: (2024)