CIV-DG: Conditional Instrumental Variables for Domain Generalization in Medical Imaging
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Bai, Shaojin, Su, Yuting, Nie, Weizhi |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Scene Aware Person Image Generation through Global Contextual Conditioning
par: Roy, Prasun, et autres
Publié: (2022)
par: Roy, Prasun, et autres
Publié: (2022)
GSE: Evaluating Sticker Visual Semantic Similarity via a General Sticker Encoder
par: Chee, Heng Er Metilda, et autres
Publié: (2025)
par: Chee, Heng Er Metilda, et autres
Publié: (2025)
AdaptaGen: Domain-Specific Image Generation through Hierarchical Semantic Optimization Framework
par: Zhang, Suoxiang, et autres
Publié: (2025)
par: Zhang, Suoxiang, et autres
Publié: (2025)
G-Refine: A General Quality Refiner for Text-to-Image Generation
par: Li, Chunyi, et autres
Publié: (2024)
par: Li, Chunyi, et autres
Publié: (2024)
T2IW: Joint Text to Image & Watermark Generation
par: Liu, An-An, et autres
Publié: (2023)
par: Liu, An-An, et autres
Publié: (2023)
STanH : Parametric Quantization for Variable Rate Learned Image Compression
par: Presta, Alberto, et autres
Publié: (2024)
par: Presta, Alberto, et autres
Publié: (2024)
Cross-Modal and Uni-Modal Soft-Label Alignment for Image-Text Retrieval
par: Huang, Hailang, et autres
Publié: (2024)
par: Huang, Hailang, et autres
Publié: (2024)
SafePaint: Anti-forensic Image Inpainting with Domain Adaptation
par: Chen, Dunyun, et autres
Publié: (2024)
par: Chen, Dunyun, et autres
Publié: (2024)
Dual Causal Inference: Integrating Backdoor Adjustment and Instrumental Variable Learning for Medical VQA
par: Xu, Zibo, et autres
Publié: (2026)
par: Xu, Zibo, et autres
Publié: (2026)
Identifying Surgical Instruments in Laparoscopy Using Deep Learning Instance Segmentation
par: Kletz, Sabrina, et autres
Publié: (2025)
par: Kletz, Sabrina, et autres
Publié: (2025)
Copy-Move Forgery Detection and Question Answering for Remote Sensing Image
par: Zhang, Ze, et autres
Publié: (2024)
par: Zhang, Ze, et autres
Publié: (2024)
Fine-grained Textual Inversion Network for Zero-Shot Composed Image Retrieval
par: Lin, Haoqiang, et autres
Publié: (2025)
par: Lin, Haoqiang, et autres
Publié: (2025)
DIP: Diffusion Learning of Inconsistency Pattern for General DeepFake Detection
par: Nie, Fan, et autres
Publié: (2024)
par: Nie, Fan, et autres
Publié: (2024)
Tora3: Trajectory-Guided Audio-Video Generation with Physical Coherence
par: Liao, Junchao, et autres
Publié: (2026)
par: Liao, Junchao, et autres
Publié: (2026)
KAN-Based Fusion of Dual-Domain for Audio-Driven Facial Landmarks Generation
par: Vo-Thanh, Hoang-Son, et autres
Publié: (2024)
par: Vo-Thanh, Hoang-Son, et autres
Publié: (2024)
SFFNet: Synergistic Feature Fusion Network With Dual-Domain Edge Enhancement for UAV Image Object Detection
par: Zhang, Wenfeng, et autres
Publié: (2026)
par: Zhang, Wenfeng, et autres
Publié: (2026)
HiDream-O1-Image: A Natively Unified Image Generative Foundation Model with Pixel-level Unified Transformer
par: Cai, Qi, et autres
Publié: (2026)
par: Cai, Qi, et autres
Publié: (2026)
Semantically Consistent Person Image Generation
par: Roy, Prasun, et autres
Publié: (2023)
par: Roy, Prasun, et autres
Publié: (2023)
Alfie: Democratising RGBA Image Generation With No $$$
par: Quattrini, Fabio, et autres
Publié: (2024)
par: Quattrini, Fabio, et autres
Publié: (2024)
HuMo: Human-Centric Video Generation via Collaborative Multi-Modal Conditioning
par: Chen, Liyang, et autres
Publié: (2025)
par: Chen, Liyang, et autres
Publié: (2025)
Enhancing Generalization in Medical Visual Question Answering Tasks via Gradient-Guided Model Perturbation
par: Liu, Gang, et autres
Publié: (2024)
par: Liu, Gang, et autres
Publié: (2024)
Med-Banana-50K: A Cross-modality Large-Scale Dataset for Text-guided Medical Image Editing
par: Chen, Zhihui, et autres
Publié: (2025)
par: Chen, Zhihui, et autres
Publié: (2025)
Visual Semantic Description Generation with MLLMs for Image-Text Matching
par: Chen, Junyu, et autres
Publié: (2025)
par: Chen, Junyu, et autres
Publié: (2025)
Bringing Textual Prompt to AI-Generated Image Quality Assessment
par: Qu, Bowen, et autres
Publié: (2024)
par: Qu, Bowen, et autres
Publié: (2024)
AeroLite: Tag-Guided Lightweight Generation of Aerial Image Captions
par: Zi, Xing, et autres
Publié: (2025)
par: Zi, Xing, et autres
Publié: (2025)
MotionPro: A Precise Motion Controller for Image-to-Video Generation
par: Zhang, Zhongwei, et autres
Publié: (2025)
par: Zhang, Zhongwei, et autres
Publié: (2025)
LAPIG: Language Guided Projector Image Generation with Surface Adaptation and Stylization
par: Deng, Yuchen, et autres
Publié: (2025)
par: Deng, Yuchen, et autres
Publié: (2025)
Image is All You Need to Empower Large-scale Diffusion Models for In-Domain Generation
par: Cao, Pu, et autres
Publié: (2023)
par: Cao, Pu, et autres
Publié: (2023)
Proxy-Tuning: Tailoring Multimodal Autoregressive Models for Subject-Driven Image Generation
par: Wu, Yi, et autres
Publié: (2025)
par: Wu, Yi, et autres
Publié: (2025)
Revolutionizing Text-to-Image Retrieval as Autoregressive Token-to-Voken Generation
par: Li, Yongqi, et autres
Publié: (2024)
par: Li, Yongqi, et autres
Publié: (2024)
Visual Grounding with Multi-modal Conditional Adaptation
par: Yao, Ruilin, et autres
Publié: (2024)
par: Yao, Ruilin, et autres
Publié: (2024)
Automatic Prompt Generation and Grounding Object Detection for Zero-Shot Image Anomaly Detection
par: Cheung, Tsun-Hin, et autres
Publié: (2024)
par: Cheung, Tsun-Hin, et autres
Publié: (2024)
Hand1000: Generating Realistic Hands from Text with Only 1,000 Images
par: Zhang, Haozhuo, et autres
Publié: (2024)
par: Zhang, Haozhuo, et autres
Publié: (2024)
Multimodal Large Language Model is a Human-Aligned Annotator for Text-to-Image Generation
par: Wu, Xun, et autres
Publié: (2024)
par: Wu, Xun, et autres
Publié: (2024)
DIVE: Inverting Conditional Diffusion Models for Discriminative Tasks
par: Li, Yinqi, et autres
Publié: (2025)
par: Li, Yinqi, et autres
Publié: (2025)
PolySmart @ TRECVid 2024 Medical Video Question Answering
par: Wu, Jiaxin, et autres
Publié: (2024)
par: Wu, Jiaxin, et autres
Publié: (2024)
Identity-Preserving Text-to-Video Generation via Training-Free Prompt, Image, and Guidance Enhancement
par: Gao, Jiayi, et autres
Publié: (2025)
par: Gao, Jiayi, et autres
Publié: (2025)
MVPbev: Multi-view Perspective Image Generation from BEV with Test-time Controllability and Generalizability
par: Liu, Buyu, et autres
Publié: (2024)
par: Liu, Buyu, et autres
Publié: (2024)
Synthetic Perception: Can Generated Images Unlock Latent Visual Prior for Text-Centric Reasoning?
par: Huang, Yuesheng, et autres
Publié: (2025)
par: Huang, Yuesheng, et autres
Publié: (2025)
Boosting Diffusion Models with Moving Average Sampling in Frequency Domain
par: Qian, Yurui, et autres
Publié: (2024)
par: Qian, Yurui, et autres
Publié: (2024)
Documents similaires
-
Scene Aware Person Image Generation through Global Contextual Conditioning
par: Roy, Prasun, et autres
Publié: (2022) -
GSE: Evaluating Sticker Visual Semantic Similarity via a General Sticker Encoder
par: Chee, Heng Er Metilda, et autres
Publié: (2025) -
AdaptaGen: Domain-Specific Image Generation through Hierarchical Semantic Optimization Framework
par: Zhang, Suoxiang, et autres
Publié: (2025) -
G-Refine: A General Quality Refiner for Text-to-Image Generation
par: Li, Chunyi, et autres
Publié: (2024) -
T2IW: Joint Text to Image & Watermark Generation
par: Liu, An-An, et autres
Publié: (2023)