Conterfactual Generative Zero-Shot Semantic Segmentation
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Shen, Feihong, Liu, Jun, Hu, Ping |
|---|---|
| Format: | Preprint |
| Publié: |
2021
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Deep Learning From Routine Histology Improves Risk Stratification for Biochemical Recurrence in Prostate Cancer
par: Grisi, Clément, et autres
Publié: (2026)
par: Grisi, Clément, et autres
Publié: (2026)
Detection of Intracranial Hemorrhage for Trauma Patients
par: Sanner, Antoine P., et autres
Publié: (2024)
par: Sanner, Antoine P., et autres
Publié: (2024)
GIIM: Graph-based Learning of Inter- and Intra-view Dependencies for Multi-view Medical Image Diagnosis
par: Sam, Tran Bao, et autres
Publié: (2026)
par: Sam, Tran Bao, et autres
Publié: (2026)
Attend, Distill, Detect: Attention-aware Entropy Distillation for Anomaly Detection
par: Jena, Sushovan, et autres
Publié: (2024)
par: Jena, Sushovan, et autres
Publié: (2024)
HuMoCon: Concept Discovery for Human Motion Understanding
par: Fang, Qihang, et autres
Publié: (2025)
par: Fang, Qihang, et autres
Publié: (2025)
DOD-SA: Infrared-Visible Decoupled Object Detection with Single-Modality Annotations
par: Jin, Hang, et autres
Publié: (2025)
par: Jin, Hang, et autres
Publié: (2025)
The SAGES Critical View of Safety Challenge: A Global Benchmark for AI-Assisted Surgical Quality Assessment
par: Alapatt, Deepak, et autres
Publié: (2025)
par: Alapatt, Deepak, et autres
Publié: (2025)
Banana Ripeness Level Classification using a Simple CNN Model Trained with Real and Synthetic Datasets
par: Chuquimarca, Luis, et autres
Publié: (2025)
par: Chuquimarca, Luis, et autres
Publié: (2025)
Harmony: A Joint Self-Supervised and Weakly-Supervised Framework for Learning General Purpose Visual Representations
par: Baharoon, Mohammed, et autres
Publié: (2024)
par: Baharoon, Mohammed, et autres
Publié: (2024)
CADE 2.5 - ZeResFDG: Frequency-Decoupled, Rescaled and Zero-Projected Guidance for SD/SDXL Latent Diffusion Models
par: Rychkovskiy, Denis
Publié: (2025)
par: Rychkovskiy, Denis
Publié: (2025)
Voxel Scene Graph for Intracranial Hemorrhage
par: Sanner, Antoine P., et autres
Publié: (2024)
par: Sanner, Antoine P., et autres
Publié: (2024)
A Deep Learning-Based Ensemble System for Automated Shoulder Fracture Detection in Clinical Radiographs
par: M, Hemanth Kumar, et autres
Publié: (2025)
par: M, Hemanth Kumar, et autres
Publié: (2025)
A Lightweight Multi-Module Fusion Approach for Korean Character Recognition
par: Park, Inho Jake, et autres
Publié: (2025)
par: Park, Inho Jake, et autres
Publié: (2025)
SAFformer:Improving Spiking Transformer via Active Predictive Filtering
par: Xie, Zequan, et autres
Publié: (2026)
par: Xie, Zequan, et autres
Publié: (2026)
JVLGS: Joint Vision-Language Gas Leak Segmentation
par: Zhao, Xinlong, et autres
Publié: (2025)
par: Zhao, Xinlong, et autres
Publié: (2025)
NFIG: Multi-Scale Autoregressive Image Generation via Frequency Ordering
par: Huang, Zhihao, et autres
Publié: (2025)
par: Huang, Zhihao, et autres
Publié: (2025)
LRVS-Fashion: Extending Visual Search with Referring Instructions
par: Lepage, Simon, et autres
Publié: (2023)
par: Lepage, Simon, et autres
Publié: (2023)
E Pluribus Unum Interpretable Convolutional Neural Networks
par: Dimas, George, et autres
Publié: (2022)
par: Dimas, George, et autres
Publié: (2022)
ClustViT: Clustering-based Token Merging for Semantic Segmentation
par: Montello, Fabio, et autres
Publié: (2025)
par: Montello, Fabio, et autres
Publié: (2025)
MB-DSMIL-CL-PL: Scalable Weakly Supervised Ovarian Cancer Subtype Classification and Localisation Using Contrastive and Prototype Learning with Frozen Patch Features
par: Jenkins, Marcus, et autres
Publié: (2026)
par: Jenkins, Marcus, et autres
Publié: (2026)
Beyond RGB: Leveraging Vision Transformers for Thermal Weapon Segmentation
par: Kambhatla, Akhila, et autres
Publié: (2025)
par: Kambhatla, Akhila, et autres
Publié: (2025)
Zero-Shot Multi-Criteria Visual Quality Inspection for Semi-Controlled Industrial Environments via Real-Time 3D Digital Twin Simulation
par: Araya-Martinez, Jose Moises, et autres
Publié: (2025)
par: Araya-Martinez, Jose Moises, et autres
Publié: (2025)
Training for X-Ray Vision: Amodal Segmentation, Amodal Content Completion, and View-Invariant Object Representation from Multi-Camera Video
par: Moore, Alexander, et autres
Publié: (2025)
par: Moore, Alexander, et autres
Publié: (2025)
Perception-Consistency Multimodal Large Language Models Reasoning via Caption-Regularized Policy Optimization
par: Tu, Songjun, et autres
Publié: (2025)
par: Tu, Songjun, et autres
Publié: (2025)
Exploring the Capabilities of Large Language Model Encoders for Image-Text Retrieval in Chest X-rays
par: Ko, Hanbin, et autres
Publié: (2025)
par: Ko, Hanbin, et autres
Publié: (2025)
A Nerf-Based Color Consistency Method for Remote Sensing Images
par: Zuo, Zongcheng, et autres
Publié: (2024)
par: Zuo, Zongcheng, et autres
Publié: (2024)
JigsawHSI: a network for Hyperspectral Image classification
par: Moraga, Jaime
Publié: (2022)
par: Moraga, Jaime
Publié: (2022)
Point, Detect, Count: Multi-Task Medical Image Understanding with Instruction-Tuned Vision-Language Models
par: Gautam, Sushant, et autres
Publié: (2025)
par: Gautam, Sushant, et autres
Publié: (2025)
Fairness Without Labels: Pseudo-Balancing for Bias Mitigation in Face Gender Classification
par: Dong, Haohua, et autres
Publié: (2025)
par: Dong, Haohua, et autres
Publié: (2025)
Parameter-efficient fine-tuning (PEFT) of Vision Foundation Models for Atypical Mitotic Figure Classification
par: Ramchandani, Lavish, et autres
Publié: (2025)
par: Ramchandani, Lavish, et autres
Publié: (2025)
CaLoRAify: Calorie Estimation with Visual-Text Pairing and LoRA-Driven Visual Language Models
par: Yao, Dongyu, et autres
Publié: (2024)
par: Yao, Dongyu, et autres
Publié: (2024)
Fixed-Threshold Evaluation of a Hybrid CNN-ViT for AI-Generated Image Detection Across Photos and Art
par: Khan, Md Ashik, et autres
Publié: (2025)
par: Khan, Md Ashik, et autres
Publié: (2025)
PlaneSAM: Multimodal Plane Instance Segmentation Using the Segment Anything Model
par: Deng, Zhongchen, et autres
Publié: (2024)
par: Deng, Zhongchen, et autres
Publié: (2024)
Advancing Brain Tumor Segmentation via Attention-based 3D U-Net Architecture and Digital Image Processing
par: Gad, Eyad, et autres
Publié: (2025)
par: Gad, Eyad, et autres
Publié: (2025)
ShapBPT: Image Feature Attributions Using Data-Aware Binary Partition Trees
par: Rashid, Muhammad, et autres
Publié: (2026)
par: Rashid, Muhammad, et autres
Publié: (2026)
ArmFormer: Lightweight Transformer Architecture for Real-Time Multi-Class Weapon Segmentation and Classification
par: Kambhatla, Akhila, et autres
Publié: (2025)
par: Kambhatla, Akhila, et autres
Publié: (2025)
SAG-ViT: A Scale-Aware, High-Fidelity Patching Approach with Graph Attention for Vision Transformers
par: Venkatraman, Shravan, et autres
Publié: (2024)
par: Venkatraman, Shravan, et autres
Publié: (2024)
Towards Onboard Continuous Change Detection for Floods
par: Kyselica, Daniel, et autres
Publié: (2026)
par: Kyselica, Daniel, et autres
Publié: (2026)
EventFlow: Real-Time Neuromorphic Event-Driven Classification of Two-Phase Boiling Flow Regimes
par: Chang, Sanghyeon, et autres
Publié: (2025)
par: Chang, Sanghyeon, et autres
Publié: (2025)
Sat-JEPA-Diff: Bridging Self-Supervised Learning and Generative Diffusion for Remote Sensing
par: Komurcu, Kursat, et autres
Publié: (2026)
par: Komurcu, Kursat, et autres
Publié: (2026)
Documents similaires
-
Deep Learning From Routine Histology Improves Risk Stratification for Biochemical Recurrence in Prostate Cancer
par: Grisi, Clément, et autres
Publié: (2026) -
Detection of Intracranial Hemorrhage for Trauma Patients
par: Sanner, Antoine P., et autres
Publié: (2024) -
GIIM: Graph-based Learning of Inter- and Intra-view Dependencies for Multi-view Medical Image Diagnosis
par: Sam, Tran Bao, et autres
Publié: (2026) -
Attend, Distill, Detect: Attention-aware Entropy Distillation for Anomaly Detection
par: Jena, Sushovan, et autres
Publié: (2024) -
HuMoCon: Concept Discovery for Human Motion Understanding
par: Fang, Qihang, et autres
Publié: (2025)