P-TAME: Explain Any Image Classifier with Trained Perturbations
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Ntrougkas, Mariano V., Mezaris, Vasileios, Patras, Ioannis |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
T-TAME: Trainable Attention Mechanism for Explaining Convolutional Networks and Vision Transformers
par: Ntrougkas, Mariano V., et autres
Publié: (2024)
par: Ntrougkas, Mariano V., et autres
Publié: (2024)
TAME: Attention Mechanism Based Feature Fusion for Generating Explanation Maps of Convolutional Neural Networks
par: Ntrougkas, Mariano, et autres
Publié: (2023)
par: Ntrougkas, Mariano, et autres
Publié: (2023)
VidCtx: Context-aware Video Question Answering with Image Models
par: Goulas, Andreas, et autres
Publié: (2024)
par: Goulas, Andreas, et autres
Publié: (2024)
LLaVA-CKD: Bottom-Up Cascaded Knowledge Distillation for Vision-Language Models
par: Gkalelis, Nikolaos, et autres
Publié: (2026)
par: Gkalelis, Nikolaos, et autres
Publié: (2026)
Improving the Perturbation-Based Explanation of Deepfake Detectors Through the Use of Adversarially-Generated Samples
par: Tsigos, Konstantinos, et autres
Publié: (2025)
par: Tsigos, Konstantinos, et autres
Publié: (2025)
Exploiting LMM-based knowledge for image classification tasks
par: Tzelepi, Maria, et autres
Publié: (2024)
par: Tzelepi, Maria, et autres
Publié: (2024)
An Experimental Study on Generating Plausible Textual Explanations for Video Summarization
par: Eleftheriadis, Thomas, et autres
Publié: (2025)
par: Eleftheriadis, Thomas, et autres
Publié: (2025)
An Integrated Framework for Multi-Granular Explanation of Video Summarization
par: Tsigos, Konstantinos, et autres
Publié: (2024)
par: Tsigos, Konstantinos, et autres
Publié: (2024)
DiffusionAct: Controllable Diffusion Autoencoder for One-shot Face Reenactment
par: Bounareli, Stella, et autres
Publié: (2024)
par: Bounareli, Stella, et autres
Publié: (2024)
SD-VSum: A Method and Dataset for Script-Driven Video Summarization
par: Mylonas, Manolis, et autres
Publié: (2025)
par: Mylonas, Manolis, et autres
Publié: (2025)
Online Anchor-based Training for Image Classification Tasks
par: Tzelepi, Maria, et autres
Publié: (2024)
par: Tzelepi, Maria, et autres
Publié: (2024)
FashionSD-X: Multimodal Fashion Garment Synthesis using Latent Diffusion
par: Singh, Abhishek Kumar, et autres
Publié: (2024)
par: Singh, Abhishek Kumar, et autres
Publié: (2024)
MOAB: Multi-Modal Outer Arithmetic Block For Fusion Of Histopathological Images And Genetic Data For Brain Tumor Grading
par: Alwazzan, Omnia, et autres
Publié: (2024)
par: Alwazzan, Omnia, et autres
Publié: (2024)
A Human-Annotated Video Dataset for Training and Evaluation of 360-Degree Video Summarization Methods
par: Kontostathis, Ioannis, et autres
Publié: (2024)
par: Kontostathis, Ioannis, et autres
Publié: (2024)
Towards Quantitative Evaluation of Explainable AI Methods for Deepfake Detection
par: Tsigos, Konstantinos, et autres
Publié: (2024)
par: Tsigos, Konstantinos, et autres
Publié: (2024)
FairCoT: Enhancing Fairness in Text-to-Image Generation via Chain of Thought Reasoning with Multimodal Large Language Models
par: Sahili, Zahraa Al, et autres
Publié: (2024)
par: Sahili, Zahraa Al, et autres
Publié: (2024)
LAFS: Landmark-based Facial Self-supervised Learning for Face Recognition
par: Sun, Zhonglin, et autres
Publié: (2024)
par: Sun, Zhonglin, et autres
Publié: (2024)
Disturbing Image Detection Using LMM-Elicited Emotion Embeddings
par: Tzelepi, Maria, et autres
Publié: (2024)
par: Tzelepi, Maria, et autres
Publié: (2024)
TSalV360: A Method and Dataset for Text-driven Saliency Detection in 360-Degrees Videos
par: Kontostathis, Ioannis, et autres
Publié: (2025)
par: Kontostathis, Ioannis, et autres
Publié: (2025)
MESA: A Training-Free Multi-Exemplar Deep Framework for Restoring Ancient Inscription Textures
par: Toulatzis, Vasileios, et autres
Publié: (2026)
par: Toulatzis, Vasileios, et autres
Publié: (2026)
LMM-Regularized CLIP Embeddings for Image Classification
par: Tzelepi, Maria, et autres
Publié: (2024)
par: Tzelepi, Maria, et autres
Publié: (2024)
ReWind: Understanding Long Videos with Instructed Learnable Memory
par: Diko, Anxhelo, et autres
Publié: (2024)
par: Diko, Anxhelo, et autres
Publié: (2024)
Improving the Explain-Any-Concept by Introducing Nonlinearity to the Trainable Surrogate Model
par: Zaval, Mounes, et autres
Publié: (2024)
par: Zaval, Mounes, et autres
Publié: (2024)
Explaining 3D Computed Tomography Classifiers with Counterfactuals
par: Cohen, Joseph Paul, et autres
Publié: (2025)
par: Cohen, Joseph Paul, et autres
Publié: (2025)
AnySR: Realizing Image Super-Resolution as Any-Scale, Any-Resource
par: Zhan, Wengyi, et autres
Publié: (2024)
par: Zhan, Wengyi, et autres
Publié: (2024)
Federated Unsupervised Semantic Segmentation
par: Charalampakis, Evangelos, et autres
Publié: (2025)
par: Charalampakis, Evangelos, et autres
Publié: (2025)
B-FPGM: Lightweight Face Detection via Bayesian-Optimized Soft FPGM Pruning
par: Kaparinos, Nikolaos, et autres
Publié: (2025)
par: Kaparinos, Nikolaos, et autres
Publié: (2025)
Improving Multimodal Hateful Meme Detection Exploiting LMM-Generated Knowledge
par: Tzelepi, Maria, et autres
Publié: (2025)
par: Tzelepi, Maria, et autres
Publié: (2025)
SDAKD: Student Discriminator Assisted Knowledge Distillation for Super-Resolution Generative Adversarial Networks
par: Kaparinos, Nikolaos, et autres
Publié: (2025)
par: Kaparinos, Nikolaos, et autres
Publié: (2025)
AnyTrans: Translate AnyText in the Image with Large Scale Models
par: Qian, Zhipeng, et autres
Publié: (2024)
par: Qian, Zhipeng, et autres
Publié: (2024)
MMFusion: Combining Image Forensic Filters for Visual Manipulation Detection and Localization
par: Triaridis, Kostas, et autres
Publié: (2023)
par: Triaridis, Kostas, et autres
Publié: (2023)
Any-to-Any Vision-Language Model for Multimodal X-ray Imaging and Radiological Report Generation
par: Molino, Daniele, et autres
Publié: (2025)
par: Molino, Daniele, et autres
Publié: (2025)
Debate-Enhanced Pseudo Labeling and Frequency-Aware Progressive Debiasing for Weakly-Supervised Camouflaged Object Detection with Scribble Annotations
par: Ge, Jiawei, et autres
Publié: (2025)
par: Ge, Jiawei, et autres
Publié: (2025)
Animate Any Character in Any World
par: Wang, Yitong, et autres
Publié: (2025)
par: Wang, Yitong, et autres
Publié: (2025)
Segment Any Anomaly without Training via Hybrid Prompt Regularization
par: Cao, Yunkang, et autres
Publié: (2023)
par: Cao, Yunkang, et autres
Publié: (2023)
X2SAM: Any Segmentation in Images and Videos
par: Wang, Hao, et autres
Publié: (2026)
par: Wang, Hao, et autres
Publié: (2026)
AnyPattern: Towards In-context Image Copy Detection
par: Wang, Wenhao, et autres
Publié: (2024)
par: Wang, Wenhao, et autres
Publié: (2024)
Video-STaR: Self-Training Enables Video Instruction Tuning with Any Supervision
par: Zohar, Orr, et autres
Publié: (2024)
par: Zohar, Orr, et autres
Publié: (2024)
Sens-VisualNews: A Benchmark Dataset for Sensational Image Detection
par: Goulas, Andreas, et autres
Publié: (2026)
par: Goulas, Andreas, et autres
Publié: (2026)
AnyTSR: Any-Scale Thermal Super-Resolution for UAV
par: Li, Mengyuan, et autres
Publié: (2025)
par: Li, Mengyuan, et autres
Publié: (2025)
Documents similaires
-
T-TAME: Trainable Attention Mechanism for Explaining Convolutional Networks and Vision Transformers
par: Ntrougkas, Mariano V., et autres
Publié: (2024) -
TAME: Attention Mechanism Based Feature Fusion for Generating Explanation Maps of Convolutional Neural Networks
par: Ntrougkas, Mariano, et autres
Publié: (2023) -
VidCtx: Context-aware Video Question Answering with Image Models
par: Goulas, Andreas, et autres
Publié: (2024) -
LLaVA-CKD: Bottom-Up Cascaded Knowledge Distillation for Vision-Language Models
par: Gkalelis, Nikolaos, et autres
Publié: (2026) -
Improving the Perturbation-Based Explanation of Deepfake Detectors Through the Use of Adversarially-Generated Samples
par: Tsigos, Konstantinos, et autres
Publié: (2025)