Diffexplainer: Towards Cross-modal Global Explanations with Diffusion Models
Fuente:
arXiv
Salvato in:
| Autori principali: | Pennisi, Matteo, Bellitto, Giovanni, Palazzo, Simone, Shah, Mubarak, Spampinato, Concetto |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
DEXTER: Diffusion-Guided EXplanations with TExtual Reasoning for Vision Models
di: Carnemolla, Simone, et al.
Pubblicazione: (2025)
di: Carnemolla, Simone, et al.
Pubblicazione: (2025)
Wake-Sleep Consolidated Learning
di: Sorrenti, Amelia, et al.
Pubblicazione: (2023)
di: Sorrenti, Amelia, et al.
Pubblicazione: (2023)
Zero-Shot Decentralized Federated Learning
di: Masano, Alessio, et al.
Pubblicazione: (2025)
di: Masano, Alessio, et al.
Pubblicazione: (2025)
SeeingSounds: Learning Audio-to-Visual Alignment via Text
di: Carnemolla, Simone, et al.
Pubblicazione: (2025)
di: Carnemolla, Simone, et al.
Pubblicazione: (2025)
Selective Attention-based Modulation for Continual Learning
di: Bellitto, Giovanni, et al.
Pubblicazione: (2024)
di: Bellitto, Giovanni, et al.
Pubblicazione: (2024)
UNBOX: Unveiling Black-box visual models with Natural-language
di: Carnemolla, Simone, et al.
Pubblicazione: (2026)
di: Carnemolla, Simone, et al.
Pubblicazione: (2026)
MatFuse: Controllable Material Generation with Diffusion Models
di: Vecchio, Giuseppe, et al.
Pubblicazione: (2023)
di: Vecchio, Giuseppe, et al.
Pubblicazione: (2023)
Evidential Federated Learning for Skin Lesion Image Classification
di: Hendrix, Rutger, et al.
Pubblicazione: (2024)
di: Hendrix, Rutger, et al.
Pubblicazione: (2024)
Transformer-based Video Saliency Prediction with High Temporal Dimension Decoding
di: Moradi, Morteza, et al.
Pubblicazione: (2024)
di: Moradi, Morteza, et al.
Pubblicazione: (2024)
PERL: Parameter Efficient Reasoning in CLIP Latent Space
di: Carnemolla, Simone, et al.
Pubblicazione: (2026)
di: Carnemolla, Simone, et al.
Pubblicazione: (2026)
Global-Local Feature Decoding with Adapter-Guided SAMv2 for Salient Object Detection
di: Moradi, Morteza, et al.
Pubblicazione: (2026)
di: Moradi, Morteza, et al.
Pubblicazione: (2026)
Dream2Learn: Structured Generative Dreaming for Continual Learning
di: Calcagno, Salvatore, et al.
Pubblicazione: (2026)
di: Calcagno, Salvatore, et al.
Pubblicazione: (2026)
SalFoM: Dynamic Saliency Prediction with Video Foundation Models
di: Moradi, Morteza, et al.
Pubblicazione: (2024)
di: Moradi, Morteza, et al.
Pubblicazione: (2024)
Surgical Triplet Recognition via Diffusion Model
di: Liu, Daochang, et al.
Pubblicazione: (2024)
di: Liu, Daochang, et al.
Pubblicazione: (2024)
OCCAM: Open-set Causal Concept explAnation and Ontology induction for black-box vision Models
di: Russo, Chiara Maria, et al.
Pubblicazione: (2026)
di: Russo, Chiara Maria, et al.
Pubblicazione: (2026)
FedRewind: Rewinding Continual Model Exchange for Decentralized Federated Learning
di: Palazzo, Luca, et al.
Pubblicazione: (2024)
di: Palazzo, Luca, et al.
Pubblicazione: (2024)
GVD: Guiding Video Diffusion Model for Scalable Video Distillation
di: Li, Kunyang, et al.
Pubblicazione: (2025)
di: Li, Kunyang, et al.
Pubblicazione: (2025)
Pre-Forgettable Models: Prompt Learning as a Native Mechanism for Unlearning
di: Hendrix, Rutger, et al.
Pubblicazione: (2025)
di: Hendrix, Rutger, et al.
Pubblicazione: (2025)
Diffusion Models in Vision: A Survey
di: Croitoru, Florinel-Alin, et al.
Pubblicazione: (2022)
di: Croitoru, Florinel-Alin, et al.
Pubblicazione: (2022)
Weakly-Supervised Spatiotemporal Anomaly Detection
di: Gianchandani, Urvi, et al.
Pubblicazione: (2026)
di: Gianchandani, Urvi, et al.
Pubblicazione: (2026)
Towards Cross-modal Backward-compatible Representation Learning for Vision-Language Models
di: Jang, Young Kyun, et al.
Pubblicazione: (2024)
di: Jang, Young Kyun, et al.
Pubblicazione: (2024)
Curriculum Direct Preference Optimization for Diffusion and Consistency Models
di: Croitoru, Florinel-Alin, et al.
Pubblicazione: (2024)
di: Croitoru, Florinel-Alin, et al.
Pubblicazione: (2024)
C3-Diff: Super-resolving Spatial Transcriptomics via Cross-modal Cross-content Contrastive Diffusion Modelling
di: Wang, Xiaofei, et al.
Pubblicazione: (2025)
di: Wang, Xiaofei, et al.
Pubblicazione: (2025)
Towards a Mechanistic Explanation of Diffusion Model Generalization
di: Niedoba, Matthew, et al.
Pubblicazione: (2024)
di: Niedoba, Matthew, et al.
Pubblicazione: (2024)
AlignMamba: Enhancing Multimodal Mamba with Local and Global Cross-modal Alignment
di: Li, Yan, et al.
Pubblicazione: (2024)
di: Li, Yan, et al.
Pubblicazione: (2024)
Local-to-Global Logical Explanations for Deep Vision Models
di: Vasu, Bhavan, et al.
Pubblicazione: (2026)
di: Vasu, Bhavan, et al.
Pubblicazione: (2026)
Hierarchical Multi-modal Transformer for Cross-modal Long Document Classification
di: Liu, Tengfei, et al.
Pubblicazione: (2024)
di: Liu, Tengfei, et al.
Pubblicazione: (2024)
Safety Without Semantic Disruptions: Editing-free Safe Image Generation via Context-preserving Dual Latent Reconstruction
di: Vice, Jordan, et al.
Pubblicazione: (2024)
di: Vice, Jordan, et al.
Pubblicazione: (2024)
Self-supervised learning for radio-astronomy source classification: a benchmark
di: Cecconello, Thomas, et al.
Pubblicazione: (2024)
di: Cecconello, Thomas, et al.
Pubblicazione: (2024)
Robin3D: Improving 3D Large Language Model via Robust Instruction Tuning
di: Kang, Weitai, et al.
Pubblicazione: (2024)
di: Kang, Weitai, et al.
Pubblicazione: (2024)
Multi-modal Generative AI: Multi-modal LLMs, Diffusions, and the Unification
di: Wang, Xin, et al.
Pubblicazione: (2024)
di: Wang, Xin, et al.
Pubblicazione: (2024)
Fusion-Mamba for Cross-modality Object Detection
di: Dong, Wenhao, et al.
Pubblicazione: (2024)
di: Dong, Wenhao, et al.
Pubblicazione: (2024)
Variational Adapter for Cross-modal Similarity Representation
di: Wei, WenZhang, et al.
Pubblicazione: (2026)
di: Wei, WenZhang, et al.
Pubblicazione: (2026)
Generating Part-Based Global Explanations Via Correspondence
di: Rathore, Kunal, et al.
Pubblicazione: (2025)
di: Rathore, Kunal, et al.
Pubblicazione: (2025)
Towards Scalable Foundation Model for Multi-modal and Hyperspectral Geospatial Data
di: Si, Haozhe, et al.
Pubblicazione: (2025)
di: Si, Haozhe, et al.
Pubblicazione: (2025)
Text-guided 3D Human Motion Generation with Keyframe-based Parallel Skip Transformer
di: Geng, Zichen, et al.
Pubblicazione: (2024)
di: Geng, Zichen, et al.
Pubblicazione: (2024)
DHCP: Detecting Hallucinations by Cross-modal Attention Pattern in Large Vision-Language Models
di: Zhang, Yudong, et al.
Pubblicazione: (2024)
di: Zhang, Yudong, et al.
Pubblicazione: (2024)
ViT-Lens: Towards Omni-modal Representations
di: Lei, Weixian, et al.
Pubblicazione: (2023)
di: Lei, Weixian, et al.
Pubblicazione: (2023)
Cross-modality Guidance-aided Multi-modal Learning with Dual Attention for MRI Brain Tumor Grading
di: Xu, Dunyuan, et al.
Pubblicazione: (2024)
di: Xu, Dunyuan, et al.
Pubblicazione: (2024)
MOCHA: Multi-modal Objects-aware Cross-arcHitecture Alignment
di: Camuffo, Elena, et al.
Pubblicazione: (2025)
di: Camuffo, Elena, et al.
Pubblicazione: (2025)
Documenti analoghi
-
DEXTER: Diffusion-Guided EXplanations with TExtual Reasoning for Vision Models
di: Carnemolla, Simone, et al.
Pubblicazione: (2025) -
Wake-Sleep Consolidated Learning
di: Sorrenti, Amelia, et al.
Pubblicazione: (2023) -
Zero-Shot Decentralized Federated Learning
di: Masano, Alessio, et al.
Pubblicazione: (2025) -
SeeingSounds: Learning Audio-to-Visual Alignment via Text
di: Carnemolla, Simone, et al.
Pubblicazione: (2025) -
Selective Attention-based Modulation for Continual Learning
di: Bellitto, Giovanni, et al.
Pubblicazione: (2024)