Token Transformation Matters: Towards Faithful Post-hoc Explanation for Vision Transformer
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Wu, Junyi, Duan, Bin, Kang, Weitai, Tang, Hao, Yan, Yan |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2024
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
On the Faithfulness of Vision Transformer Explanations
von: Wu, Junyi, et al.
Veröffentlicht: (2024)
von: Wu, Junyi, et al.
Veröffentlicht: (2024)
Visual Grounding with Attention-Driven Constraint Balancing
von: Kang, Weitai, et al.
Veröffentlicht: (2024)
von: Kang, Weitai, et al.
Veröffentlicht: (2024)
PTQ4DiT: Post-training Quantization for Diffusion Transformers
von: Wu, Junyi, et al.
Veröffentlicht: (2024)
von: Wu, Junyi, et al.
Veröffentlicht: (2024)
Token Transforming: A Unified and Training-Free Token Compression Framework for Vision Transformer Acceleration
von: Zeng, Fanhu, et al.
Veröffentlicht: (2025)
von: Zeng, Fanhu, et al.
Veröffentlicht: (2025)
Visual-Word Tokenizer: Beyond Fixed Sets of Tokens in Vision Transformers
von: Gee, Leonidas, et al.
Veröffentlicht: (2024)
von: Gee, Leonidas, et al.
Veröffentlicht: (2024)
SegVG: Transferring Object Bounding Box to Segmentation for Visual Grounding
von: Kang, Weitai, et al.
Veröffentlicht: (2024)
von: Kang, Weitai, et al.
Veröffentlicht: (2024)
ACTRESS: Active Retraining for Semi-supervised Visual Grounding
von: Kang, Weitai, et al.
Veröffentlicht: (2024)
von: Kang, Weitai, et al.
Veröffentlicht: (2024)
MaskSAM: Towards Auto-prompt SAM with Mask Classification for Volumetric Medical Image Segmentation
von: Xie, Bin, et al.
Veröffentlicht: (2024)
von: Xie, Bin, et al.
Veröffentlicht: (2024)
DORA: Dynamic Online Reinforcement Agent for Token Merging in Vision Transformers
von: He, Kaixuan, et al.
Veröffentlicht: (2026)
von: He, Kaixuan, et al.
Veröffentlicht: (2026)
GIFT: A Framework Towards Global Interpretable Faithful Textual Explanations of Vision Classifiers
von: Zablocki, Éloi, et al.
Veröffentlicht: (2024)
von: Zablocki, Éloi, et al.
Veröffentlicht: (2024)
Accelerating Vision Transformers on Brain Processing Unit
von: Tang, Jinchi, et al.
Veröffentlicht: (2026)
von: Tang, Jinchi, et al.
Veröffentlicht: (2026)
PPT: Token Pruning and Pooling for Efficient Vision Transformers
von: Wu, Xinjian, et al.
Veröffentlicht: (2023)
von: Wu, Xinjian, et al.
Veröffentlicht: (2023)
Vision Transformer with Super Token Sampling
von: Huang, Huaibo, et al.
Veröffentlicht: (2022)
von: Huang, Huaibo, et al.
Veröffentlicht: (2022)
[Re] Improving Interpretation Faithfulness for Vision Transformers
von: Kurek, Izabela, et al.
Veröffentlicht: (2025)
von: Kurek, Izabela, et al.
Veröffentlicht: (2025)
How to Probe: Simple Yet Effective Techniques for Improving Post-hoc Explanations
von: Gairola, Siddhartha, et al.
Veröffentlicht: (2025)
von: Gairola, Siddhartha, et al.
Veröffentlicht: (2025)
SAM-Sode: Towards Faithful Explanations for Tiny Bacteria Detection
von: Tan, Wanying, et al.
Veröffentlicht: (2026)
von: Tan, Wanying, et al.
Veröffentlicht: (2026)
Towards Saner Deep Image Registration
von: Duan, Bin, et al.
Veröffentlicht: (2023)
von: Duan, Bin, et al.
Veröffentlicht: (2023)
Post-hoc Part-prototype Networks
von: Tan, Andong, et al.
Veröffentlicht: (2024)
von: Tan, Andong, et al.
Veröffentlicht: (2024)
Intent3D: 3D Object Detection in RGB-D Scans Based on Human Intention
von: Kang, Weitai, et al.
Veröffentlicht: (2024)
von: Kang, Weitai, et al.
Veröffentlicht: (2024)
VGent: Visual Grounding via Modular Design for Disentangling Reasoning and Prediction
von: Kang, Weitai, et al.
Veröffentlicht: (2025)
von: Kang, Weitai, et al.
Veröffentlicht: (2025)
3DResT: A Strong Baseline for Semi-Supervised 3D Referring Expression Segmentation
von: Chen, Wenxin, et al.
Veröffentlicht: (2025)
von: Chen, Wenxin, et al.
Veröffentlicht: (2025)
AT-SNN: Adaptive Tokens for Vision Transformer on Spiking Neural Network
von: Kang, Donghwa, et al.
Veröffentlicht: (2024)
von: Kang, Donghwa, et al.
Veröffentlicht: (2024)
Vote&Mix: Plug-and-Play Token Reduction for Efficient Vision Transformer
von: Peng, Shuai, et al.
Veröffentlicht: (2024)
von: Peng, Shuai, et al.
Veröffentlicht: (2024)
Dynamic Granularity Matters: Rethinking Vision Transformers Beyond Fixed Patch Splitting
von: Yu, Qiyang, et al.
Veröffentlicht: (2025)
von: Yu, Qiyang, et al.
Veröffentlicht: (2025)
Wavelet-Based Image Tokenizer for Vision Transformers
von: Zhu, Zhenhai, et al.
Veröffentlicht: (2024)
von: Zhu, Zhenhai, et al.
Veröffentlicht: (2024)
Improving Interpretation Faithfulness for Vision Transformers
von: Hu, Lijie, et al.
Veröffentlicht: (2023)
von: Hu, Lijie, et al.
Veröffentlicht: (2023)
Superpixel Tokenization for Vision Transformers: Preserving Semantic Integrity in Visual Tokens
von: Lew, Jaihyun, et al.
Veröffentlicht: (2024)
von: Lew, Jaihyun, et al.
Veröffentlicht: (2024)
Explanation-Driven Counterfactual Testing for Faithfulness in Vision-Language Model Explanations
von: Ding, Sihao, et al.
Veröffentlicht: (2025)
von: Ding, Sihao, et al.
Veröffentlicht: (2025)
Towards Accurate Post-Training Quantization of Vision Transformers via Error Reduction
von: Zhong, Yunshan, et al.
Veröffentlicht: (2024)
von: Zhong, Yunshan, et al.
Veröffentlicht: (2024)
VPNeXt -- Rethinking Dense Decoding for Plain Vision Transformer
von: Tang, Xikai, et al.
Veröffentlicht: (2025)
von: Tang, Xikai, et al.
Veröffentlicht: (2025)
Exploring Token-Level Augmentation in Vision Transformer for Semi-Supervised Semantic Segmentation
von: Zhang, Dengke, et al.
Veröffentlicht: (2025)
von: Zhang, Dengke, et al.
Veröffentlicht: (2025)
There is More to Attention: Statistical Filtering Enhances Explanations in Vision Transformers
von: Ayyar, Meghna P, et al.
Veröffentlicht: (2025)
von: Ayyar, Meghna P, et al.
Veröffentlicht: (2025)
Token Compensator: Altering Inference Cost of Vision Transformer without Re-Tuning
von: Jie, Shibo, et al.
Veröffentlicht: (2024)
von: Jie, Shibo, et al.
Veröffentlicht: (2024)
DopQ-ViT: Towards Distribution-Friendly and Outlier-Aware Post-Training Quantization for Vision Transformers
von: Yang, Lianwei, et al.
Veröffentlicht: (2024)
von: Yang, Lianwei, et al.
Veröffentlicht: (2024)
Language-Guided Transformer Tokenizer for Human Motion Generation
von: Yan, Sheng, et al.
Veröffentlicht: (2026)
von: Yan, Sheng, et al.
Veröffentlicht: (2026)
MPTQ-ViT: Mixed-Precision Post-Training Quantization for Vision Transformer
von: Tai, Yu-Shan, et al.
Veröffentlicht: (2024)
von: Tai, Yu-Shan, et al.
Veröffentlicht: (2024)
Robin3D: Improving 3D Large Language Model via Robust Instruction Tuning
von: Kang, Weitai, et al.
Veröffentlicht: (2024)
von: Kang, Weitai, et al.
Veröffentlicht: (2024)
Other Tokens Matter: Exploring Global and Local Features of Vision Transformers for Object Re-Identification
von: Wang, Yingquan, et al.
Veröffentlicht: (2024)
von: Wang, Yingquan, et al.
Veröffentlicht: (2024)
GiT: Towards Generalist Vision Transformer through Universal Language Interface
von: Wang, Haiyang, et al.
Veröffentlicht: (2024)
von: Wang, Haiyang, et al.
Veröffentlicht: (2024)
Scenes as Tokens: Multi-Scale Normal Distributions Transform Tokenizer for General 3D Vision-Language Understanding
von: Tang, Yutao, et al.
Veröffentlicht: (2025)
von: Tang, Yutao, et al.
Veröffentlicht: (2025)
Ähnliche Einträge
-
On the Faithfulness of Vision Transformer Explanations
von: Wu, Junyi, et al.
Veröffentlicht: (2024) -
Visual Grounding with Attention-Driven Constraint Balancing
von: Kang, Weitai, et al.
Veröffentlicht: (2024) -
PTQ4DiT: Post-training Quantization for Diffusion Transformers
von: Wu, Junyi, et al.
Veröffentlicht: (2024) -
Token Transforming: A Unified and Training-Free Token Compression Framework for Vision Transformer Acceleration
von: Zeng, Fanhu, et al.
Veröffentlicht: (2025) -
Visual-Word Tokenizer: Beyond Fixed Sets of Tokens in Vision Transformers
von: Gee, Leonidas, et al.
Veröffentlicht: (2024)