M-IDoL: Information Decomposition for Modality-Specific and Diverse Representation Learning in Medical Foundation Model
Fuente:
arXiv
Salvato in:
| Autori principali: | Liu, Yihang, Yang, Longzhen, Yang, Jiaxiong, Wen, Ying, He, Lianghua, Shen, Heng Tao |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Self-Supervised Anatomical Consistency Learning for Vision-Grounded Medical Report Generation
di: Yang, Longzhen, et al.
Pubblicazione: (2025)
di: Yang, Longzhen, et al.
Pubblicazione: (2025)
AFiRe: Anatomy-Driven Self-Supervised Learning for Fine-Grained Representation in Radiographic Images
di: Liu, Yihang, et al.
Pubblicazione: (2025)
di: Liu, Yihang, et al.
Pubblicazione: (2025)
EntropyPrune: Matrix Entropy Guided Visual Token Pruning for Multimodal Large Language Models
di: Wang, Yahong, et al.
Pubblicazione: (2026)
di: Wang, Yahong, et al.
Pubblicazione: (2026)
Visual Neural Decoding via Improved Visual-EEG Semantic Consistency
di: Chen, Hongzhou, et al.
Pubblicazione: (2024)
di: Chen, Hongzhou, et al.
Pubblicazione: (2024)
When Token Pruning is Worse than Random: Understanding Visual Token Information in VLLMs
di: Wang, Yahong, et al.
Pubblicazione: (2025)
di: Wang, Yahong, et al.
Pubblicazione: (2025)
LEAD: Learning Decomposition for Source-free Universal Domain Adaptation
di: Qu, Sanqing, et al.
Pubblicazione: (2024)
di: Qu, Sanqing, et al.
Pubblicazione: (2024)
Learning Emergent Modular Representations in Multi-modality Medical Vision Foundation Models
di: He, Yuting, et al.
Pubblicazione: (2026)
di: He, Yuting, et al.
Pubblicazione: (2026)
DiveUp: Learning Feature Upsampling from Diverse Vision Foundation Models
di: Liu, Xiaoqiong, et al.
Pubblicazione: (2026)
di: Liu, Xiaoqiong, et al.
Pubblicazione: (2026)
Image Translation-Based Unsupervised Cross-Modality Domain Adaptation for Medical Image Segmentation
di: Yang, Tao, et al.
Pubblicazione: (2025)
di: Yang, Tao, et al.
Pubblicazione: (2025)
DiverseDiT: Towards Diverse Representation Learning in Diffusion Transformers
di: Yang, Mengping, et al.
Pubblicazione: (2026)
di: Yang, Mengping, et al.
Pubblicazione: (2026)
Multimodal Skeleton-Based Action Representation Learning via Decomposition and Composition
di: Wang, Hongsong, et al.
Pubblicazione: (2025)
di: Wang, Hongsong, et al.
Pubblicazione: (2025)
Low-Rank Knowledge Decomposition for Medical Foundation Models
di: Zhou, Yuhang, et al.
Pubblicazione: (2024)
di: Zhou, Yuhang, et al.
Pubblicazione: (2024)
Improving Medical Visual Representation Learning with Pathological-level Cross-Modal Alignment and Correlation Exploration
di: Wang, Jun, et al.
Pubblicazione: (2025)
di: Wang, Jun, et al.
Pubblicazione: (2025)
Hierarchical Salient Patch Identification for Interpretable Fundus Disease Localization
di: Peng, Yitao, et al.
Pubblicazione: (2024)
di: Peng, Yitao, et al.
Pubblicazione: (2024)
ProtoSolo: Interpretable Image Classification via Single-Prototype Activation
di: Peng, Yitao, et al.
Pubblicazione: (2025)
di: Peng, Yitao, et al.
Pubblicazione: (2025)
Modality-Agnostic Structural Image Representation Learning for Deformable Multi-Modality Medical Image Registration
di: Mok, Tony C. W., et al.
Pubblicazione: (2024)
di: Mok, Tony C. W., et al.
Pubblicazione: (2024)
Enhancing Representation in Medical Vision-Language Foundation Models via Multi-Scale Information Extraction Techniques
di: Huang, Weijian, et al.
Pubblicazione: (2024)
di: Huang, Weijian, et al.
Pubblicazione: (2024)
Generalizable and Explainable Deep Learning for Medical Image Computing: An Overview
di: Chaddad, Ahmad, et al.
Pubblicazione: (2025)
di: Chaddad, Ahmad, et al.
Pubblicazione: (2025)
Exploring Kernel Transformations for Implicit Neural Representations
di: Zheng, Sheng, et al.
Pubblicazione: (2025)
di: Zheng, Sheng, et al.
Pubblicazione: (2025)
Perceive and Calibrate: Analyzing and Enhancing Robustness of Medical Multi-Modal Large Language Models
di: XU, Dunyuan, et al.
Pubblicazione: (2025)
di: XU, Dunyuan, et al.
Pubblicazione: (2025)
LoRKD: Low-Rank Knowledge Decomposition for Medical Foundation Models
di: Li, Haolin, et al.
Pubblicazione: (2024)
di: Li, Haolin, et al.
Pubblicazione: (2024)
Progressive Representation Learning for Multimodal Sentiment Analysis with Incomplete Modalities
di: Bao, Jindi, et al.
Pubblicazione: (2026)
di: Bao, Jindi, et al.
Pubblicazione: (2026)
BiMediX2: Bio-Medical EXpert LMM for Diverse Medical Modalities
di: Mullappilly, Sahal Shaji, et al.
Pubblicazione: (2024)
di: Mullappilly, Sahal Shaji, et al.
Pubblicazione: (2024)
Representation Space Constrained Learning with Modality Decoupling for Multimodal Object Detection
di: Shao, YiKang, et al.
Pubblicazione: (2025)
di: Shao, YiKang, et al.
Pubblicazione: (2025)
Homeomorphism Prior for False Positive and Negative Problem in Medical Image Dense Contrastive Representation Learning
di: He, Yuting, et al.
Pubblicazione: (2025)
di: He, Yuting, et al.
Pubblicazione: (2025)
HarmoCLIP: Harmonizing Global and Regional Representations in Contrastive Vision-Language Models
di: Zeng, Haoxi, et al.
Pubblicazione: (2025)
di: Zeng, Haoxi, et al.
Pubblicazione: (2025)
MIRROR: Multi-Modal Pathological Self-Supervised Representation Learning via Modality Alignment and Retention
di: Wang, Tianyi, et al.
Pubblicazione: (2025)
di: Wang, Tianyi, et al.
Pubblicazione: (2025)
Gaussian2Scene: 3D Scene Representation Learning via Self-supervised Learning with 3D Gaussian Splatting
di: Liu, Keyi, et al.
Pubblicazione: (2025)
di: Liu, Keyi, et al.
Pubblicazione: (2025)
Decoupling Feature Representations of Ego and Other Modalities for Incomplete Multi-modal Brain Tumor Segmentation
di: Yang, Kaixiang, et al.
Pubblicazione: (2024)
di: Yang, Kaixiang, et al.
Pubblicazione: (2024)
Improving Representation of High-frequency Components for Medical Visual Foundation Models
di: Chu, Yuetan, et al.
Pubblicazione: (2024)
di: Chu, Yuetan, et al.
Pubblicazione: (2024)
Towards a Transparent and Interpretable AI Model for Medical Image Classifications
di: Wen, Binbin, et al.
Pubblicazione: (2025)
di: Wen, Binbin, et al.
Pubblicazione: (2025)
Calibrated Multimodal Representation Learning with Missing Modalities
di: Liu, Xiaohao, et al.
Pubblicazione: (2025)
di: Liu, Xiaohao, et al.
Pubblicazione: (2025)
Multivariate Gaussian Representation Learning for Medical Action Evaluation
di: Yang, Luming, et al.
Pubblicazione: (2025)
di: Yang, Luming, et al.
Pubblicazione: (2025)
Multi-Modal Mamba Modeling for Survival Prediction (M4Survive): Adapting Joint Foundation Model Representations
di: Lee, Ho Hin, et al.
Pubblicazione: (2025)
di: Lee, Ho Hin, et al.
Pubblicazione: (2025)
ClinKD: Cross-Modal Clinical Knowledge Distiller For Multi-Task Medical Images
di: Ge, Hongyu, et al.
Pubblicazione: (2025)
di: Ge, Hongyu, et al.
Pubblicazione: (2025)
Asynchronous Multimodal Video Sequence Fusion via Learning Modality-Exclusive and -Agnostic Representations
di: Yang, Dingkang, et al.
Pubblicazione: (2024)
di: Yang, Dingkang, et al.
Pubblicazione: (2024)
MUST: Modality-Specific Representation-Aware Transformer for Diffusion-Enhanced Survival Prediction with Missing Modality
di: Kim, Kyungwon, et al.
Pubblicazione: (2026)
di: Kim, Kyungwon, et al.
Pubblicazione: (2026)
A Spectrum Evaluation Benchmark for Medical Multi-Modal Large Language Models
di: Liu, Jie, et al.
Pubblicazione: (2024)
di: Liu, Jie, et al.
Pubblicazione: (2024)
Federated CLIP for Resource-Efficient Heterogeneous Medical Image Classification
di: Wu, Yihang, et al.
Pubblicazione: (2025)
di: Wu, Yihang, et al.
Pubblicazione: (2025)
M-SpecGene: Generalized Foundation Model for RGBT Multispectral Vision
di: Zhou, Kailai, et al.
Pubblicazione: (2025)
di: Zhou, Kailai, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Self-Supervised Anatomical Consistency Learning for Vision-Grounded Medical Report Generation
di: Yang, Longzhen, et al.
Pubblicazione: (2025) -
AFiRe: Anatomy-Driven Self-Supervised Learning for Fine-Grained Representation in Radiographic Images
di: Liu, Yihang, et al.
Pubblicazione: (2025) -
EntropyPrune: Matrix Entropy Guided Visual Token Pruning for Multimodal Large Language Models
di: Wang, Yahong, et al.
Pubblicazione: (2026) -
Visual Neural Decoding via Improved Visual-EEG Semantic Consistency
di: Chen, Hongzhou, et al.
Pubblicazione: (2024) -
When Token Pruning is Worse than Random: Understanding Visual Token Information in VLLMs
di: Wang, Yahong, et al.
Pubblicazione: (2025)