Bias-constrained multimodal intelligence for equitable and reliable clinical AI
Fuente:
arXiv
Saved in:
| Main Authors: | Li, Cheng, Huang, Weijian, Liu, Jiarun, Yang, Hao, Yang, Qi, Wu, Song, Li, Ye, Zheng, Hairong, Wang, Shanshan |
|---|---|
| Format: | Preprint |
| Published: |
2026
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Enhancing the vision-language foundation model with key semantic knowledge-emphasized report refinement
by: Huang, Weijian, et al.
Published: (2024)
by: Huang, Weijian, et al.
Published: (2024)
Enhancing Representation in Radiography-Reports Foundation Model: A Granular Alignment Algorithm Using Masked Contrastive Learning
by: Huang, Weijian, et al.
Published: (2023)
by: Huang, Weijian, et al.
Published: (2023)
Enhancing Representation in Medical Vision-Language Foundation Models via Multi-Scale Information Extraction Techniques
by: Huang, Weijian, et al.
Published: (2024)
by: Huang, Weijian, et al.
Published: (2024)
Multimodal self-supervised learning for lesion localization
by: Yang, Hao, et al.
Published: (2024)
by: Yang, Hao, et al.
Published: (2024)
MLIP: Medical Language-Image Pre-training with Masked Local Representation Learning
by: Liu, Jiarun, et al.
Published: (2024)
by: Liu, Jiarun, et al.
Published: (2024)
A multi-modal vision-language model for generalizable annotation-free pathology localization
by: Yang, Hao, et al.
Published: (2024)
by: Yang, Hao, et al.
Published: (2024)
Optimized Vessel Segmentation: A Structure-Agnostic Approach with Small Vessel Enhancement and Morphological Correction
by: Song, Dongning, et al.
Published: (2024)
by: Song, Dongning, et al.
Published: (2024)
BioVFM-21M: Benchmarking and Scaling Self-Supervised Vision Foundation Models for Biomedical Image Analysis
by: Liu, Jiarun, et al.
Published: (2025)
by: Liu, Jiarun, et al.
Published: (2025)
Visual-Language Model Knowledge Distillation Method for Image Quality Assessment
by: Hou, Yongkang, et al.
Published: (2025)
by: Hou, Yongkang, et al.
Published: (2025)
Hierarchical Fusion and Joint Aggregation: A Multi-Level Feature Representation Method for AIGC Image Quality Assessment
by: Meng, Linghe, et al.
Published: (2025)
by: Meng, Linghe, et al.
Published: (2025)
A Diffusion-Driven Temporal Super-Resolution and Spatial Consistency Enhancement Framework for 4D MRI imaging
by: Zhou, Xuanru, et al.
Published: (2025)
by: Zhou, Xuanru, et al.
Published: (2025)
Generative Artificial Intelligence in Medical Imaging: Foundations, Progress, and Clinical Translation
by: Zhou, Xuanru, et al.
Published: (2025)
by: Zhou, Xuanru, et al.
Published: (2025)
Reduce the Artifacts Bias for More Generalizable AI-Generated Image Detection
by: Li, Yiheng, et al.
Published: (2026)
by: Li, Yiheng, et al.
Published: (2026)
MediConfusion: Can you trust your AI radiologist? Probing the reliability of multimodal medical foundation models
by: Sepehri, Mohammad Shahab, et al.
Published: (2024)
by: Sepehri, Mohammad Shahab, et al.
Published: (2024)
Swin-UMamba: Mamba-based UNet with ImageNet-based pretraining
by: Liu, Jiarun, et al.
Published: (2024)
by: Liu, Jiarun, et al.
Published: (2024)
SamRobNODDI: Q-Space Sampling-Augmented Continuous Representation Learning for Robust and Generalized NODDI
by: Xiao, Taohui, et al.
Published: (2024)
by: Xiao, Taohui, et al.
Published: (2024)
When Images Speak Louder: Mitigating Language Bias-induced Hallucinations in VLMs through Cross-Modal Guidance
by: Cao, Jinjin, et al.
Published: (2025)
by: Cao, Jinjin, et al.
Published: (2025)
Cross-Sequence Semi-Supervised Learning for Multi-Parametric MRI-Based Visual Pathway Delineation
by: Diakite, Alou, et al.
Published: (2025)
by: Diakite, Alou, et al.
Published: (2025)
Image Segmentation via Variational Model Based Tailored UNet: A Deep Variational Framework
by: Qi, Kaili, et al.
Published: (2025)
by: Qi, Kaili, et al.
Published: (2025)
MEDiC: Multi-objective Exploration of Distillation from CLIP
by: Georgiou, Konstantinos, et al.
Published: (2026)
by: Georgiou, Konstantinos, et al.
Published: (2026)
GS-RoadPatching: Inpainting Gaussians via 3D Searching and Placing for Driving Scenes
by: Chen, Guo, et al.
Published: (2025)
by: Chen, Guo, et al.
Published: (2025)
DyFADet: Dynamic Feature Aggregation for Temporal Action Detection
by: Yang, Le, et al.
Published: (2024)
by: Yang, Le, et al.
Published: (2024)
Simultaneous q-Space Sampling Optimization and Reconstruction for Fast and High-fidelity Diffusion Magnetic Resonance Imaging
by: Yang, Jing, et al.
Published: (2024)
by: Yang, Jing, et al.
Published: (2024)
Schedule On the Fly: Diffusion Time Prediction for Faster and Better Image Generation
by: Ye, Zilyu, et al.
Published: (2024)
by: Ye, Zilyu, et al.
Published: (2024)
Imagine the Unseen: Occluded Pedestrian Detection via Adversarial Feature Completion
by: Zhang, Shanshan, et al.
Published: (2024)
by: Zhang, Shanshan, et al.
Published: (2024)
PAST: A multimodal single-cell foundation model for histopathology and spatial transcriptomics in cancer
by: Yang, Changchun, et al.
Published: (2025)
by: Yang, Changchun, et al.
Published: (2025)
Minimize Quantization Output Error with Bias Compensation
by: Gong, Cheng, et al.
Published: (2024)
by: Gong, Cheng, et al.
Published: (2024)
Computer vision tasks for intelligent aerospace missions: An overview
by: Chen, Huilin, et al.
Published: (2024)
by: Chen, Huilin, et al.
Published: (2024)
RGE-GS: Reward-Guided Expansive Driving Scene Reconstruction via Diffusion Priors
by: Du, Sicong, et al.
Published: (2025)
by: Du, Sicong, et al.
Published: (2025)
DDaTR: Dynamic Difference-aware Temporal Residual Network for Longitudinal Radiology Report Generation
by: Song, Shanshan, et al.
Published: (2025)
by: Song, Shanshan, et al.
Published: (2025)
Advancing Textual Prompt Learning with Anchored Attributes
by: Li, Zheng, et al.
Published: (2024)
by: Li, Zheng, et al.
Published: (2024)
Personalize Anything for Free with Diffusion Transformer
by: Feng, Haoran, et al.
Published: (2025)
by: Feng, Haoran, et al.
Published: (2025)
FujiView: Multimodal Late-Fusion for Predicting Scenic Visibility
by: Bible, Bryceton, et al.
Published: (2026)
by: Bible, Bryceton, et al.
Published: (2026)
Mitigating Prior Shape Bias in Point Clouds via Differentiable Center Learning
by: Li, Zhe, et al.
Published: (2024)
by: Li, Zhe, et al.
Published: (2024)
Animalbooth: multimodal feature enhancement for animal subject personalization
by: Liu, Chen, et al.
Published: (2025)
by: Liu, Chen, et al.
Published: (2025)
Zone Evaluation: Revealing Spatial Bias in Object Detection
by: Zheng, Zhaohui, et al.
Published: (2023)
by: Zheng, Zhaohui, et al.
Published: (2023)
A multimodal gesture recognition dataset for desktop human-computer interaction
by: Wang, Qi, et al.
Published: (2024)
by: Wang, Qi, et al.
Published: (2024)
An Empirical Study and Analysis of Text-to-Image Generation Using Large Language Model-Powered Textual Representation
by: Tan, Zhiyu, et al.
Published: (2024)
by: Tan, Zhiyu, et al.
Published: (2024)
ApET: Approximation-Error Guided Token Compression for Efficient VLMs
by: Ma, Qiankun, et al.
Published: (2026)
by: Ma, Qiankun, et al.
Published: (2026)
BusterX: MLLM-Powered AI-Generated Video Forgery Detection and Explanation
by: Wen, Haiquan, et al.
Published: (2025)
by: Wen, Haiquan, et al.
Published: (2025)
Similar Items
-
Enhancing the vision-language foundation model with key semantic knowledge-emphasized report refinement
by: Huang, Weijian, et al.
Published: (2024) -
Enhancing Representation in Radiography-Reports Foundation Model: A Granular Alignment Algorithm Using Masked Contrastive Learning
by: Huang, Weijian, et al.
Published: (2023) -
Enhancing Representation in Medical Vision-Language Foundation Models via Multi-Scale Information Extraction Techniques
by: Huang, Weijian, et al.
Published: (2024) -
Multimodal self-supervised learning for lesion localization
by: Yang, Hao, et al.
Published: (2024) -
MLIP: Medical Language-Image Pre-training with Masked Local Representation Learning
by: Liu, Jiarun, et al.
Published: (2024)