Probabilistic Conceptual Explainers: Trustworthy Conceptual Explanations for Vision Foundation Models
Fuente:
arXiv
Salvato in:
| Autori principali: | Wang, Hengyi, Tan, Shiwei, Wang, Hao |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Causal Decoding for Hallucination-Resistant Multimodal Large Language Models
di: Tan, Shiwei, et al.
Pubblicazione: (2026)
di: Tan, Shiwei, et al.
Pubblicazione: (2026)
TVE: Learning Meta-attribution for Transferable Vision Explainer
di: Wang, Guanchu, et al.
Pubblicazione: (2023)
di: Wang, Guanchu, et al.
Pubblicazione: (2023)
Multimodal Needle in a Haystack: Benchmarking Long-Context Capability of Multimodal Large Language Models
di: Wang, Hengyi, et al.
Pubblicazione: (2024)
di: Wang, Hengyi, et al.
Pubblicazione: (2024)
PointExplainer: Towards Transparent Parkinson's Disease Diagnosis
di: Wang, Xuechao, et al.
Pubblicazione: (2025)
di: Wang, Xuechao, et al.
Pubblicazione: (2025)
Distilling Out-of-Distribution Robustness from Vision-Language Foundation Models
di: Zhou, Andy, et al.
Pubblicazione: (2023)
di: Zhou, Andy, et al.
Pubblicazione: (2023)
Enhancing CLIP Conceptual Embedding through Knowledge Distillation
di: Kao, Kuei-Chun
Pubblicazione: (2024)
di: Kao, Kuei-Chun
Pubblicazione: (2024)
TraNCE: Transformative Non-linear Concept Explainer for CNNs
di: Akpudo, Ugochukwu Ejike, et al.
Pubblicazione: (2025)
di: Akpudo, Ugochukwu Ejike, et al.
Pubblicazione: (2025)
AVA-Bench: Atomic Visual Ability Benchmark for Vision Foundation Models
di: Mai, Zheda, et al.
Pubblicazione: (2025)
di: Mai, Zheda, et al.
Pubblicazione: (2025)
LINE: LLM-based Iterative Neuron Explanations for Vision Models
di: Zaigrajew, Vladimir, et al.
Pubblicazione: (2026)
di: Zaigrajew, Vladimir, et al.
Pubblicazione: (2026)
Accessing Vision Foundation Models via ImageNet-1K
di: Zhang, Yitian, et al.
Pubblicazione: (2024)
di: Zhang, Yitian, et al.
Pubblicazione: (2024)
AdjointDPM: Adjoint Sensitivity Method for Gradient Backpropagation of Diffusion Probabilistic Models
di: Pan, Jiachun, et al.
Pubblicazione: (2023)
di: Pan, Jiachun, et al.
Pubblicazione: (2023)
ViTime: Foundation Model for Time Series Forecasting Powered by Vision Intelligence
di: Yang, Luoxiao, et al.
Pubblicazione: (2024)
di: Yang, Luoxiao, et al.
Pubblicazione: (2024)
Energy-Based Concept Bottleneck Models: Unifying Prediction, Concept Intervention, and Probabilistic Interpretations
di: Xu, Xinyue, et al.
Pubblicazione: (2024)
di: Xu, Xinyue, et al.
Pubblicazione: (2024)
V-CECE: Visual Counterfactual Explanations via Conceptual Edits
di: Spanos, Nikolaos, et al.
Pubblicazione: (2025)
di: Spanos, Nikolaos, et al.
Pubblicazione: (2025)
Connecting the Dots: Collaborative Fine-tuning for Black-Box Vision-Language Models
di: Wang, Zhengbo, et al.
Pubblicazione: (2024)
di: Wang, Zhengbo, et al.
Pubblicazione: (2024)
VFMF: World Modeling by Forecasting Vision Foundation Model Features
di: Boduljak, Gabrijel, et al.
Pubblicazione: (2025)
di: Boduljak, Gabrijel, et al.
Pubblicazione: (2025)
Revisiting Model Stitching In the Foundation Model Era
di: Mai, Zheda, et al.
Pubblicazione: (2026)
di: Mai, Zheda, et al.
Pubblicazione: (2026)
CFM: Language-aligned Concept Foundation Model for Vision
di: Wittenmayer, Kai, et al.
Pubblicazione: (2026)
di: Wittenmayer, Kai, et al.
Pubblicazione: (2026)
What Helps---and What Hurts: Bidirectional Explanations for Vision Transformers
di: Su, Qin, et al.
Pubblicazione: (2026)
di: Su, Qin, et al.
Pubblicazione: (2026)
ViGText: Deepfake Image Detection with Vision-Language Model Explanations and Graph Neural Networks
di: ALBarqawi, Ahmad, et al.
Pubblicazione: (2025)
di: ALBarqawi, Ahmad, et al.
Pubblicazione: (2025)
Leveraging Local Structure for Improving Model Explanations: An Information Propagation Approach
di: Yang, Ruo, et al.
Pubblicazione: (2024)
di: Yang, Ruo, et al.
Pubblicazione: (2024)
Explanation Bottleneck Models
di: Yamaguchi, Shin'ya, et al.
Pubblicazione: (2024)
di: Yamaguchi, Shin'ya, et al.
Pubblicazione: (2024)
ERA-Solver: Error-Robust Adams Solver for Fast Sampling of Diffusion Probabilistic Models
di: Li, Shengming, et al.
Pubblicazione: (2023)
di: Li, Shengming, et al.
Pubblicazione: (2023)
Post-pre-training for Modality Alignment in Vision-Language Foundation Models
di: Yamaguchi, Shin'ya, et al.
Pubblicazione: (2025)
di: Yamaguchi, Shin'ya, et al.
Pubblicazione: (2025)
Conceptualizing Embeddings: Sparse Disentanglement for Vision-Language Models
di: Kubaty, Piotr, et al.
Pubblicazione: (2026)
di: Kubaty, Piotr, et al.
Pubblicazione: (2026)
A Reasoning-Enabled Vision-Language Foundation Model for Chest X-ray Interpretation
di: Zhang, Yabin, et al.
Pubblicazione: (2026)
di: Zhang, Yabin, et al.
Pubblicazione: (2026)
From Spatial to Actions: Grounding Vision-Language-Action Model in Spatial Foundation Priors
di: Zhang, Zhengshen, et al.
Pubblicazione: (2025)
di: Zhang, Zhengshen, et al.
Pubblicazione: (2025)
Scaling Laws for Robust Comparison of Open Foundation Language-Vision Models and Datasets
di: Nezhurina, Marianna, et al.
Pubblicazione: (2025)
di: Nezhurina, Marianna, et al.
Pubblicazione: (2025)
Benchmarking Feature Upsampling Methods for Vision Foundation Models using Interactive Segmentation
di: Havrylov, Volodymyr, et al.
Pubblicazione: (2025)
di: Havrylov, Volodymyr, et al.
Pubblicazione: (2025)
Cross-Domain Generalization Limits of Vision Foundation Models in Facial Deepfake Detection
di: Delibasoglu, Ibrahim
Pubblicazione: (2026)
di: Delibasoglu, Ibrahim
Pubblicazione: (2026)
Variational Language Concepts for Interpreting Foundation Language Models
di: Wang, Hengyi, et al.
Pubblicazione: (2024)
di: Wang, Hengyi, et al.
Pubblicazione: (2024)
U-CECE: A Universal Multi-Resolution Framework for Conceptual Counterfactual Explanations
di: Dimitriou, Angeliki, et al.
Pubblicazione: (2026)
di: Dimitriou, Angeliki, et al.
Pubblicazione: (2026)
Spatially Grounded Explanations in Vision Language Models for Document Visual Question Answering
di: Lagos, Maximiliano Hormazábal, et al.
Pubblicazione: (2025)
di: Lagos, Maximiliano Hormazábal, et al.
Pubblicazione: (2025)
Impact of Noisy Supervision in Foundation Model Learning
di: Chen, Hao, et al.
Pubblicazione: (2024)
di: Chen, Hao, et al.
Pubblicazione: (2024)
Spurious Feature Eraser: Stabilizing Test-Time Adaptation for Vision-Language Foundation Model
di: Ma, Huan, et al.
Pubblicazione: (2024)
di: Ma, Huan, et al.
Pubblicazione: (2024)
Few-Shot Segmentation of Historical Maps via Linear Probing of Vision Foundation Models
di: Sterzinger, Rafael, et al.
Pubblicazione: (2025)
di: Sterzinger, Rafael, et al.
Pubblicazione: (2025)
Decipher-MR: A Vision-Language Foundation Model for 3D MRI Representations
di: Yang, Zhijian, et al.
Pubblicazione: (2025)
di: Yang, Zhijian, et al.
Pubblicazione: (2025)
MEGL: Multimodal Explanation-Guided Learning
di: Zhang, Yifei, et al.
Pubblicazione: (2024)
di: Zhang, Yifei, et al.
Pubblicazione: (2024)
How to Benchmark Vision Foundation Models for Semantic Segmentation?
di: Kerssies, Tommie, et al.
Pubblicazione: (2024)
di: Kerssies, Tommie, et al.
Pubblicazione: (2024)
Hyperspectral Adapter for Semantic Segmentation with Vision Foundation Models
di: Hurtado, Juana Valeria, et al.
Pubblicazione: (2025)
di: Hurtado, Juana Valeria, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Causal Decoding for Hallucination-Resistant Multimodal Large Language Models
di: Tan, Shiwei, et al.
Pubblicazione: (2026) -
TVE: Learning Meta-attribution for Transferable Vision Explainer
di: Wang, Guanchu, et al.
Pubblicazione: (2023) -
Multimodal Needle in a Haystack: Benchmarking Long-Context Capability of Multimodal Large Language Models
di: Wang, Hengyi, et al.
Pubblicazione: (2024) -
PointExplainer: Towards Transparent Parkinson's Disease Diagnosis
di: Wang, Xuechao, et al.
Pubblicazione: (2025) -
Distilling Out-of-Distribution Robustness from Vision-Language Foundation Models
di: Zhou, Andy, et al.
Pubblicazione: (2023)