DocVCE: Diffusion-based Visual Counterfactual Explanations for Document Image Classification
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Saifullah, Saifullah, Agne, Stefan, Dengel, Andreas, Ahmed, Sheraz |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
DocXplain: A Novel Model-Agnostic Explainability Method for Document Image Classification
par: Saifullah, Saifullah, et autres
Publié: (2024)
par: Saifullah, Saifullah, et autres
Publié: (2024)
Latent Diffusion for Guided Document Table Generation
par: Hamdani, Syed Jawwad Haider, et autres
Publié: (2024)
par: Hamdani, Syed Jawwad Haider, et autres
Publié: (2024)
DP-DocLDM: Differentially Private Document Image Generation using Latent Diffusion Models
par: Saifullah, Saifullah, et autres
Publié: (2025)
par: Saifullah, Saifullah, et autres
Publié: (2025)
WordVIS: A Color Worth A Thousand Words
par: Khan, Umar, et autres
Publié: (2024)
par: Khan, Umar, et autres
Publié: (2024)
Privacy Meets Explainability: A Comprehensive Impact Benchmark
par: Saifullah, Saifullah, et autres
Publié: (2022)
par: Saifullah, Saifullah, et autres
Publié: (2022)
LD-ViCE: Latent Diffusion Model for Video Counterfactual Explanations
par: Varshney, Payal, et autres
Publié: (2025)
par: Varshney, Payal, et autres
Publié: (2025)
StylusAI: Stylistic Adaptation for Robust German Handwritten Text Generation
par: Riaz, Nauman, et autres
Publié: (2024)
par: Riaz, Nauman, et autres
Publié: (2024)
Discovering Concept Directions from Diffusion-based Counterfactuals via Latent Clustering
par: Varshney, Payal, et autres
Publié: (2025)
par: Varshney, Payal, et autres
Publié: (2025)
From Visual Explanations to Counterfactual Explanations with Latent Diffusion
par: Luu, Tung, et autres
Publié: (2025)
par: Luu, Tung, et autres
Publié: (2025)
VCE: Safe Autoregressive Image Generation via Visual Contrast Exploitation
par: Han, Feng, et autres
Publié: (2025)
par: Han, Feng, et autres
Publié: (2025)
ForestVO: Enhancing Visual Odometry in Forest Environments through ForestGlue
par: Pritchard, Thomas, et autres
Publié: (2025)
par: Pritchard, Thomas, et autres
Publié: (2025)
Counterfactual Explanations for Medical Image Classification and Regression using Diffusion Autoencoder
par: Atad, Matan, et autres
Publié: (2024)
par: Atad, Matan, et autres
Publié: (2024)
DocVXQA: Context-Aware Visual Explanations for Document Question Answering
par: Souibgui, Mohamed Ali, et autres
Publié: (2025)
par: Souibgui, Mohamed Ali, et autres
Publié: (2025)
Optimizing Gastrointestinal Diagnostics: A CNN-Based Model for VCE Image Classification
par: Ahlawat, Vaneeta, et autres
Publié: (2024)
par: Ahlawat, Vaneeta, et autres
Publié: (2024)
A Multimodal Approach For Endoscopic VCE Image Classification Using BiomedCLIP-PubMedBERT
par: Ganapathy, Nagarajan, et autres
Publié: (2024)
par: Ganapathy, Nagarajan, et autres
Publié: (2024)
Faithful Counterfactual Visual Explanations (FCVE)
par: Khan, Bismillah, et autres
Publié: (2025)
par: Khan, Bismillah, et autres
Publié: (2025)
MaskDiME: Adaptive Masked Diffusion for Precise and Efficient Visual Counterfactual Explanations
par: Guo, Changlu, et autres
Publié: (2026)
par: Guo, Changlu, et autres
Publié: (2026)
Comparative Analysis of Image Enhancement Techniques for Brain Tumor Segmentation: Contrast, Histogram, and Hybrid Approaches
par: Saifullah, Shoffan, et autres
Publié: (2024)
par: Saifullah, Shoffan, et autres
Publié: (2024)
SynthDoc: Bilingual Documents Synthesis for Visual Document Understanding
par: Ding, Chuanghao, et autres
Publié: (2024)
par: Ding, Chuanghao, et autres
Publié: (2024)
DeCoDEx: Confounder Detector Guidance for Improved Diffusion-based Counterfactual Explanations
par: Fathi, Nima, et autres
Publié: (2024)
par: Fathi, Nima, et autres
Publié: (2024)
Counterfactual Visual Explanation via Causally-Guided Adversarial Steering
par: Qiao, Yiran, et autres
Publié: (2025)
par: Qiao, Yiran, et autres
Publié: (2025)
DocShaDiffusion: Diffusion Model in Latent Space for Document Image Shadow Removal
par: Liu, Wenjie, et autres
Publié: (2025)
par: Liu, Wenjie, et autres
Publié: (2025)
EMF: Event Meta Formers for Event-based Real-time Traffic Object Detection
par: Khan, Muhammad Ahmed Ullah, et autres
Publié: (2025)
par: Khan, Muhammad Ahmed Ullah, et autres
Publié: (2025)
GlobalDoc: A Cross-Modal Vision-Language Framework for Real-World Document Image Retrieval and Classification
par: Bakkali, Souhail, et autres
Publié: (2023)
par: Bakkali, Souhail, et autres
Publié: (2023)
PSO-UNet: Particle Swarm-Optimized U-Net Framework for Precise Multimodal Brain Tumor Segmentation
par: Saifullah, Shoffan, et autres
Publié: (2025)
par: Saifullah, Shoffan, et autres
Publié: (2025)
DocKylin: A Large Multimodal Model for Visual Document Understanding with Efficient Visual Slimming
par: Zhang, Jiaxin, et autres
Publié: (2024)
par: Zhang, Jiaxin, et autres
Publié: (2024)
SpotDiffusion: A Fast Approach For Seamless Panorama Generation Over Time
par: Frolov, Stanislav, et autres
Publié: (2024)
par: Frolov, Stanislav, et autres
Publié: (2024)
Uni-DocDiff: A Unified Document Restoration Model Based on Diffusion
par: Zhao, Fangmin, et autres
Publié: (2025)
par: Zhao, Fangmin, et autres
Publié: (2025)
Rethinking Visual Counterfactual Explanations Through Region Constraint
par: Sobieski, Bartlomiej, et autres
Publié: (2024)
par: Sobieski, Bartlomiej, et autres
Publié: (2024)
MMLongBench-Doc: Benchmarking Long-context Document Understanding with Visualizations
par: Ma, Yubo, et autres
Publié: (2024)
par: Ma, Yubo, et autres
Publié: (2024)
Multi-Label Scene Classification in Remote Sensing Benefits from Image Super-Resolution
par: Mudraje, Ashitha, et autres
Publié: (2025)
par: Mudraje, Ashitha, et autres
Publié: (2025)
MosaicDoc: A Large-Scale Bilingual Benchmark for Visually Rich Document Understanding
par: Chen, Ketong, et autres
Publié: (2025)
par: Chen, Ketong, et autres
Publié: (2025)
MeDocVL: A Visual Language Model for Medical Document Understanding and Parsing
par: Wang, Wenjie, et autres
Publié: (2026)
par: Wang, Wenjie, et autres
Publié: (2026)
Counterfactual Stress Testing for Image Classification Models
par: Stammel, Moritz, et autres
Publié: (2026)
par: Stammel, Moritz, et autres
Publié: (2026)
V-CECE: Visual Counterfactual Explanations via Conceptual Edits
par: Spanos, Nikolaos, et autres
Publié: (2025)
par: Spanos, Nikolaos, et autres
Publié: (2025)
CogDoc: Towards Unified thinking in Documents
par: Xu, Qixin, et autres
Publié: (2025)
par: Xu, Qixin, et autres
Publié: (2025)
Diffusion-based Iterative Counterfactual Explanations for Fetal Ultrasound Image Quality Assessment
par: Pegios, Paraskevas, et autres
Publié: (2024)
par: Pegios, Paraskevas, et autres
Publié: (2024)
DeQA-Doc: Adapting DeQA-Score to Document Image Quality Assessment
par: Gao, Junjie, et autres
Publié: (2025)
par: Gao, Junjie, et autres
Publié: (2025)
DocRes: A Generalist Model Toward Unifying Document Image Restoration Tasks
par: Zhang, Jiaxin, et autres
Publié: (2024)
par: Zhang, Jiaxin, et autres
Publié: (2024)
Spherical Dense Text-to-Image Synthesis
par: Winter, Timon, et autres
Publié: (2025)
par: Winter, Timon, et autres
Publié: (2025)
Documents similaires
-
DocXplain: A Novel Model-Agnostic Explainability Method for Document Image Classification
par: Saifullah, Saifullah, et autres
Publié: (2024) -
Latent Diffusion for Guided Document Table Generation
par: Hamdani, Syed Jawwad Haider, et autres
Publié: (2024) -
DP-DocLDM: Differentially Private Document Image Generation using Latent Diffusion Models
par: Saifullah, Saifullah, et autres
Publié: (2025) -
WordVIS: A Color Worth A Thousand Words
par: Khan, Umar, et autres
Publié: (2024) -
Privacy Meets Explainability: A Comprehensive Impact Benchmark
par: Saifullah, Saifullah, et autres
Publié: (2022)