Enhancing Model Interpretability with Local Attribution over Global Exploration
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Zhu, Zhiyu, Jin, Zhibo, Zhang, Jiayu, Chen, Huaming |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
ABE: A Unified Framework for Robust and Faithful Attribution-Based Explainability
par: Zhu, Zhiyu, et autres
Publié: (2025)
par: Zhu, Zhiyu, et autres
Publié: (2025)
Leveraging Information Consistency in Frequency and Spatial Domain for Adversarial Attacks
par: Jin, Zhibo, et autres
Publié: (2024)
par: Jin, Zhibo, et autres
Publié: (2024)
PAR-AdvGAN: Improving Adversarial Attack Capability with Progressive Auto-Regression AdvGAN
par: Zhang, Jiayu, et autres
Publié: (2025)
par: Zhang, Jiayu, et autres
Publié: (2025)
Attribution for Enhanced Explanation with Transferable Adversarial eXploration
par: Zhu, Zhiyu, et autres
Publié: (2024)
par: Zhu, Zhiyu, et autres
Publié: (2024)
Beyond Noisy-TVs: Noise-Robust Exploration Via Learning Progress Monitoring
par: Hou, Zhibo, et autres
Publié: (2025)
par: Hou, Zhibo, et autres
Publié: (2025)
Benchmarking Transferable Adversarial Attacks
par: Jin, Zhibo, et autres
Publié: (2024)
par: Jin, Zhibo, et autres
Publié: (2024)
DMS: Addressing Information Loss with More Steps for Pragmatic Adversarial Attacks
par: Zhu, Zhiyu, et autres
Publié: (2024)
par: Zhu, Zhiyu, et autres
Publié: (2024)
Optimal Look-back Horizon for Time Series Forecasting in Federated Learning
par: Tang, Dahao, et autres
Publié: (2025)
par: Tang, Dahao, et autres
Publié: (2025)
SL-CBM: Enhancing Concept Bottleneck Models with Semantic Locality for Better Interpretability
par: Zhang, Hanwei, et autres
Publié: (2026)
par: Zhang, Hanwei, et autres
Publié: (2026)
AIM: Attributing, Interpreting, Mitigating Data Unfairness
par: Liu, Zhining, et autres
Publié: (2024)
par: Liu, Zhining, et autres
Publié: (2024)
Learning to Price: Interpretable Attribute-Level Models for Dynamic Markets
par: Sethuraman, Srividhya, et autres
Publié: (2026)
par: Sethuraman, Srividhya, et autres
Publié: (2026)
Using a Local Surrogate Model to Interpret Temporal Shifts in Global Annual Data
par: Nakano, Shou, et autres
Publié: (2024)
par: Nakano, Shou, et autres
Publié: (2024)
What You See Is Not Always What You Get: Evaluating GPT's Comprehension of Source Code
par: Wen, Jiawen, et autres
Publié: (2024)
par: Wen, Jiawen, et autres
Publié: (2024)
ST-TGExplainer: Disentangling Stability and Transition Patterns for Temporal GNN Interpretability
par: Chen, Hongjiang, et autres
Publié: (2026)
par: Chen, Hongjiang, et autres
Publié: (2026)
Attributions All the Way Down? The Metagame of Interpretability
par: Baniecki, Hubert, et autres
Publié: (2026)
par: Baniecki, Hubert, et autres
Publié: (2026)
Enhancing Robustness of Offline Reinforcement Learning Under Data Corruption via Sharpness-Aware Minimization
par: Xu, Le, et autres
Publié: (2025)
par: Xu, Le, et autres
Publié: (2025)
FreqLens: Interpretable Frequency Attribution for Time Series Forecasting
par: Chen, Chi-Sheng, et autres
Publié: (2026)
par: Chen, Chi-Sheng, et autres
Publié: (2026)
GraphCLIP: Enhancing Transferability in Graph Foundation Models for Text-Attributed Graphs
par: Zhu, Yun, et autres
Publié: (2024)
par: Zhu, Yun, et autres
Publié: (2024)
VRAIL: Vectorized Reward-based Attribution for Interpretable Learning
par: Kim, Jina, et autres
Publié: (2025)
par: Kim, Jina, et autres
Publié: (2025)
GradCFA: A Hybrid Gradient-Based Counterfactual and Feature Attribution Explanation Algorithm for Local Interpretation of Neural Networks
par: Sanderson, Jacob, et autres
Publié: (2026)
par: Sanderson, Jacob, et autres
Publié: (2026)
Towards Unified Attribution in Explainable AI, Data-Centric AI, and Mechanistic Interpretability
par: Zhang, Shichang, et autres
Publié: (2025)
par: Zhang, Shichang, et autres
Publié: (2025)
EVGeoQA: Benchmarking LLMs on Dynamic, Multi-Objective Geo-Spatial Exploration
par: Wu, Jianfei, et autres
Publié: (2026)
par: Wu, Jianfei, et autres
Publié: (2026)
Quanda: An Interpretability Toolkit for Training Data Attribution Evaluation and Beyond
par: Bareeva, Dilyara, et autres
Publié: (2024)
par: Bareeva, Dilyara, et autres
Publié: (2024)
Causality-Aware Local Interpretable Model-Agnostic Explanations
par: Cinquini, Martina, et autres
Publié: (2022)
par: Cinquini, Martina, et autres
Publié: (2022)
Hybrid Attribution Priors for Explainable and Robust Model Training
par: Zhang, Zhuoran, et autres
Publié: (2025)
par: Zhang, Zhuoran, et autres
Publié: (2025)
FA-INR: Adaptive Implicit Neural Representations for Interpretable Exploration of Simulation Ensembles
par: Li, Ziwei, et autres
Publié: (2025)
par: Li, Ziwei, et autres
Publié: (2025)
Enhancing Model Privacy in Federated Learning with Random Masking and Quantization
par: Xu, Zhibo, et autres
Publié: (2025)
par: Xu, Zhibo, et autres
Publié: (2025)
Locally Interpretable Individualized Treatment Rules for Black-Box Decision Models
par: Charvadeh, Yasin Khadem, et autres
Publié: (2026)
par: Charvadeh, Yasin Khadem, et autres
Publié: (2026)
SHapley Estimated Explanation (SHEP): A Fast Post-Hoc Attribution Method for Interpreting Intelligent Fault Diagnosis
par: Chen, Qian, et autres
Publié: (2025)
par: Chen, Qian, et autres
Publié: (2025)
Feature-Selective Representation Misdirection for Machine Unlearning
par: Chen, Taozhao, et autres
Publié: (2025)
par: Chen, Taozhao, et autres
Publié: (2025)
Concept Influence: Leveraging Interpretability to Improve Performance and Efficiency in Training Data Attribution
par: Kowal, Matthew, et autres
Publié: (2026)
par: Kowal, Matthew, et autres
Publié: (2026)
Representational Homomorphism Predicts and Improves Compositional Generalization In Transformer Language Model
par: An, Zhiyu, et autres
Publié: (2026)
par: An, Zhiyu, et autres
Publié: (2026)
External Model Motivated Agents: Reinforcement Learning for Enhanced Environment Sampling
par: Bhagat, Rishav, et autres
Publié: (2024)
par: Bhagat, Rishav, et autres
Publié: (2024)
Mechanistic Data Attribution: Tracing the Training Origins of Interpretable LLM Units
par: Chen, Jianhui, et autres
Publié: (2026)
par: Chen, Jianhui, et autres
Publié: (2026)
Enhancing Transferability of Adversarial Attacks with GE-AdvGAN+: A Comprehensive Framework for Gradient Editing
par: Jin, Zhibo, et autres
Publié: (2024)
par: Jin, Zhibo, et autres
Publié: (2024)
KDSelector: A Knowledge-Enhanced and Data-Efficient Model Selector Learning Framework for Time Series Anomaly Detection
par: Liang, Zhiyu, et autres
Publié: (2025)
par: Liang, Zhiyu, et autres
Publié: (2025)
Scalable Hyperparameter-Divergent Ensemble Training with Automatic Learning Rate Exploration for Large Models
par: Cheng, Hailing, et autres
Publié: (2026)
par: Cheng, Hailing, et autres
Publié: (2026)
Interpretability-by-Design with Accurate Locally Additive Models and Conditional Feature Effects
par: Gkolemis, Vasilis, et autres
Publié: (2026)
par: Gkolemis, Vasilis, et autres
Publié: (2026)
Revisiting Data Attribution for Influence Functions
par: Zhu, Hongbo, et autres
Publié: (2025)
par: Zhu, Hongbo, et autres
Publié: (2025)
HiMAC: Hierarchical Macro-Micro Learning for Long-Horizon LLM Agents
par: Jin, Hongbo, et autres
Publié: (2026)
par: Jin, Hongbo, et autres
Publié: (2026)
Documents similaires
-
ABE: A Unified Framework for Robust and Faithful Attribution-Based Explainability
par: Zhu, Zhiyu, et autres
Publié: (2025) -
Leveraging Information Consistency in Frequency and Spatial Domain for Adversarial Attacks
par: Jin, Zhibo, et autres
Publié: (2024) -
PAR-AdvGAN: Improving Adversarial Attack Capability with Progressive Auto-Regression AdvGAN
par: Zhang, Jiayu, et autres
Publié: (2025) -
Attribution for Enhanced Explanation with Transferable Adversarial eXploration
par: Zhu, Zhiyu, et autres
Publié: (2024) -
Beyond Noisy-TVs: Noise-Robust Exploration Via Learning Progress Monitoring
par: Hou, Zhibo, et autres
Publié: (2025)