TIP: Tabular-Image Pre-training for Multimodal Classification with Incomplete Data
Fuente:
arXiv
Salvato in:
| Autori principali: | Du, Siyi, Zheng, Shaoming, Wang, Yinsong, Bai, Wenjia, O'Regan, Declan P., Qin, Chen |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Inference-Time Dynamic Modality Selection for Incomplete Multimodal Classification
di: Du, Siyi, et al.
Pubblicazione: (2026)
di: Du, Siyi, et al.
Pubblicazione: (2026)
STiL: Semi-supervised Tabular-Image Learning for Comprehensive Task-Relevant Information Exploration in Multimodal Classification
di: Du, Siyi, et al.
Pubblicazione: (2025)
di: Du, Siyi, et al.
Pubblicazione: (2025)
SGSR: Structure-Guided Multi-Contrast MRI Super-Resolution via Spatio-Frequency Co-Query Attention
di: Zheng, Shaoming, et al.
Pubblicazione: (2024)
di: Zheng, Shaoming, et al.
Pubblicazione: (2024)
CAR: Contrast-Agnostic Deformable Medical Image Registration with Contrast-Invariant Latent Regularization
di: Wang, Yinsong, et al.
Pubblicazione: (2024)
di: Wang, Yinsong, et al.
Pubblicazione: (2024)
Adaptive Conditional Contrast-Agnostic Deformable Image Registration with Uncertainty Estimation
di: Wang, Yinsong, et al.
Pubblicazione: (2026)
di: Wang, Yinsong, et al.
Pubblicazione: (2026)
Utilizing Synthetic Data for Medical Vision-Language Pre-training: Bypassing the Need for Real Images
di: Liu, Che, et al.
Pubblicazione: (2023)
di: Liu, Che, et al.
Pubblicazione: (2023)
Incorporating Pre-training Data Matters in Unsupervised Domain Adaptation
di: Xu, Yinsong, et al.
Pubblicazione: (2023)
di: Xu, Yinsong, et al.
Pubblicazione: (2023)
Multimodal Conditional MeshGAN for Personalized Aneurysm Growth Prediction
di: Chen, Long, et al.
Pubblicazione: (2025)
di: Chen, Long, et al.
Pubblicazione: (2025)
MCM: Mamba-based Cardiac Motion Tracking using Sequential Images in MRI
di: Yin, Jiahui, et al.
Pubblicazione: (2025)
di: Yin, Jiahui, et al.
Pubblicazione: (2025)
Multimodal Medical Image Classification via Synergistic Learning Pre-training
di: Lin, Qinghua, et al.
Pubblicazione: (2025)
di: Lin, Qinghua, et al.
Pubblicazione: (2025)
IMITATE: Clinical Prior Guided Hierarchical Vision-Language Pre-training
di: Liu, Che, et al.
Pubblicazione: (2023)
di: Liu, Che, et al.
Pubblicazione: (2023)
Universal Image Restoration Pre-training via Degradation Classification
di: Hu, JiaKui, et al.
Pubblicazione: (2025)
di: Hu, JiaKui, et al.
Pubblicazione: (2025)
Should VLMs be Pre-trained with Image Data?
di: Keh, Sedrick, et al.
Pubblicazione: (2025)
di: Keh, Sedrick, et al.
Pubblicazione: (2025)
Progressive Local Alignment for Medical Multimodal Pre-training
di: Yan, Huimin, et al.
Pubblicazione: (2025)
di: Yan, Huimin, et al.
Pubblicazione: (2025)
Code and Pixels: Multi-Modal Contrastive Pre-training for Enhanced Tabular Data Analysis
di: Roy, Kankana, et al.
Pubblicazione: (2025)
di: Roy, Kankana, et al.
Pubblicazione: (2025)
Universal Image Restoration Pre-training via Masked Degradation Classification
di: Hu, JiaKui, et al.
Pubblicazione: (2025)
di: Hu, JiaKui, et al.
Pubblicazione: (2025)
Synthetic Data Augmentation using Pre-trained Diffusion Models for Long-tailed Food Image Classification
di: Koh, GaYeon, et al.
Pubblicazione: (2025)
di: Koh, GaYeon, et al.
Pubblicazione: (2025)
G2D: From Global to Dense Radiography Representation Learning via Vision-Language Pre-training
di: Liu, Che, et al.
Pubblicazione: (2023)
di: Liu, Che, et al.
Pubblicazione: (2023)
A Closer Look at Benchmarking Self-Supervised Pre-training with Image Classification
di: Marks, Markus, et al.
Pubblicazione: (2024)
di: Marks, Markus, et al.
Pubblicazione: (2024)
Accelerating Pre-training of Multimodal LLMs via Chain-of-Sight
di: Huang, Ziyuan, et al.
Pubblicazione: (2024)
di: Huang, Ziyuan, et al.
Pubblicazione: (2024)
MM-Conv: A Multi-modal Conversational Dataset for Virtual Humans
di: Deichler, Anna, et al.
Pubblicazione: (2024)
di: Deichler, Anna, et al.
Pubblicazione: (2024)
Comparative Performance of Finetuned ImageNet Pre-trained Models for Electronic Component Classification
di: Shao, Yidi, et al.
Pubblicazione: (2025)
di: Shao, Yidi, et al.
Pubblicazione: (2025)
Bayesian Exploration of Pre-trained Models for Low-shot Image Classification
di: Miao, Yibo, et al.
Pubblicazione: (2024)
di: Miao, Yibo, et al.
Pubblicazione: (2024)
DreamLIP: Language-Image Pre-training with Long Captions
di: Zheng, Kecheng, et al.
Pubblicazione: (2024)
di: Zheng, Kecheng, et al.
Pubblicazione: (2024)
Towards Data-Efficient Video Pre-training with Frozen Image Foundation Models
di: Orlova, Svetlana, et al.
Pubblicazione: (2026)
di: Orlova, Svetlana, et al.
Pubblicazione: (2026)
Black-box Membership Inference Attacks on the Pre-training Data of Image-generation Models
di: Qi, Tao, et al.
Pubblicazione: (2026)
di: Qi, Tao, et al.
Pubblicazione: (2026)
Interpretable Multimodal Cancer Prototyping with Whole Slide Images and Incompletely Paired Genomics
di: Zhang, Yupei, et al.
Pubblicazione: (2025)
di: Zhang, Yupei, et al.
Pubblicazione: (2025)
Revisit Large-Scale Image-Caption Data in Pre-training Multimodal Foundation Models
di: Lai, Zhengfeng, et al.
Pubblicazione: (2024)
di: Lai, Zhengfeng, et al.
Pubblicazione: (2024)
LoTLIP: Improving Language-Image Pre-training for Long Text Understanding
di: Wu, Wei, et al.
Pubblicazione: (2024)
di: Wu, Wei, et al.
Pubblicazione: (2024)
TIP-Editor: An Accurate 3D Editor Following Both Text-Prompts And Image-Prompts
di: Zhuang, Jingyu, et al.
Pubblicazione: (2024)
di: Zhuang, Jingyu, et al.
Pubblicazione: (2024)
Learning a Model-Driven Variational Network for Deformable Image Registration
di: Jia, Xi, et al.
Pubblicazione: (2021)
di: Jia, Xi, et al.
Pubblicazione: (2021)
CFCML: A Coarse-to-Fine Crossmodal Learning Framework For Disease Diagnosis Using Multimodal Images and Tabular Data
di: Liu, Tianling, et al.
Pubblicazione: (2026)
di: Liu, Tianling, et al.
Pubblicazione: (2026)
Event Camera Data Dense Pre-training
di: Yang, Yan, et al.
Pubblicazione: (2023)
di: Yang, Yan, et al.
Pubblicazione: (2023)
TIP-I2V: A Million-Scale Real Text and Image Prompt Dataset for Image-to-Video Generation
di: Wang, Wenhao, et al.
Pubblicazione: (2024)
di: Wang, Wenhao, et al.
Pubblicazione: (2024)
UniQA: Unified Vision-Language Pre-training for Image Quality and Aesthetic Assessment
di: Zhou, Hantao, et al.
Pubblicazione: (2024)
di: Zhou, Hantao, et al.
Pubblicazione: (2024)
CoMP: Continual Multimodal Pre-training for Vision Foundation Models
di: Chen, Yitong, et al.
Pubblicazione: (2025)
di: Chen, Yitong, et al.
Pubblicazione: (2025)
SGMA: Semantic-Guided Modality-Aware Segmentation for Remote Sensing with Incomplete Multimodal Data
di: Wen, Lekang, et al.
Pubblicazione: (2026)
di: Wen, Lekang, et al.
Pubblicazione: (2026)
RET-CLIP: A Retinal Image Foundation Model Pre-trained with Clinical Diagnostic Reports
di: Du, Jiawei, et al.
Pubblicazione: (2024)
di: Du, Jiawei, et al.
Pubblicazione: (2024)
Scalable Pre-training of Large Autoregressive Image Models
di: El-Nouby, Alaaeldin, et al.
Pubblicazione: (2024)
di: El-Nouby, Alaaeldin, et al.
Pubblicazione: (2024)
I-Max: Maximize the Resolution Potential of Pre-trained Rectified Flow Transformers with Projected Flow
di: Du, Ruoyi, et al.
Pubblicazione: (2024)
di: Du, Ruoyi, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Inference-Time Dynamic Modality Selection for Incomplete Multimodal Classification
di: Du, Siyi, et al.
Pubblicazione: (2026) -
STiL: Semi-supervised Tabular-Image Learning for Comprehensive Task-Relevant Information Exploration in Multimodal Classification
di: Du, Siyi, et al.
Pubblicazione: (2025) -
SGSR: Structure-Guided Multi-Contrast MRI Super-Resolution via Spatio-Frequency Co-Query Attention
di: Zheng, Shaoming, et al.
Pubblicazione: (2024) -
CAR: Contrast-Agnostic Deformable Medical Image Registration with Contrast-Invariant Latent Regularization
di: Wang, Yinsong, et al.
Pubblicazione: (2024) -
Adaptive Conditional Contrast-Agnostic Deformable Image Registration with Uncertainty Estimation
di: Wang, Yinsong, et al.
Pubblicazione: (2026)