CLIMD: A Curriculum Learning Framework for Imbalanced Multimodal Diagnosis
Fuente:
arXiv
Saved in:
| Main Authors: | Han, Kai, Lyu, Chongwen, Ma, Lele, Qian, Chengxuan, Ma, Siqi, Pang, Zheng, Chen, Jun, Liu, Zhe |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
DynCIM: Dynamic Curriculum for Imbalanced Multimodal Learning
by: Qian, Chengxuan, et al.
Published: (2025)
by: Qian, Chengxuan, et al.
Published: (2025)
Frequency Domain Unlocks New Perspectives for Abdominal Medical Image Segmentation
by: Han, Kai, et al.
Published: (2025)
by: Han, Kai, et al.
Published: (2025)
Adaptive Label Correction for Robust Medical Image Segmentation with Noisy Labels
by: Qian, Chengxuan, et al.
Published: (2025)
by: Qian, Chengxuan, et al.
Published: (2025)
LiMT: A Multi-task Liver Image Benchmark Dataset
by: Liu, Zhe, et al.
Published: (2025)
by: Liu, Zhe, et al.
Published: (2025)
Learning When to Look: A Disentangled Curriculum for Strategic Perception in Multimodal Reasoning
by: Yang, Siqi, et al.
Published: (2025)
by: Yang, Siqi, et al.
Published: (2025)
DecAlign: Hierarchical Cross-Modal Alignment for Decoupled Multimodal Representation Learning
by: Qian, Chengxuan, et al.
Published: (2025)
by: Qian, Chengxuan, et al.
Published: (2025)
Improving Multimodal Learning via Imbalanced Learning
by: Wei, Shicai, et al.
Published: (2025)
by: Wei, Shicai, et al.
Published: (2025)
ProductWebGen: Benchmarking Multimodal Product Webpage Generation
by: Liu, Zhihong, et al.
Published: (2026)
by: Liu, Zhihong, et al.
Published: (2026)
CFCML: A Coarse-to-Fine Crossmodal Learning Framework For Disease Diagnosis Using Multimodal Images and Tabular Data
by: Liu, Tianling, et al.
Published: (2026)
by: Liu, Tianling, et al.
Published: (2026)
BALM: A Model-Agnostic Framework for Balanced Multimodal Learning under Imbalanced Missing Rates
by: Nguyen, Phuong-Anh, et al.
Published: (2026)
by: Nguyen, Phuong-Anh, et al.
Published: (2026)
Video-Only ToM: Enhancing Theory of Mind in Multimodal Large Language Models
by: Liu, Siqi, et al.
Published: (2026)
by: Liu, Siqi, et al.
Published: (2026)
TrojVLM: Backdoor Attack Against Vision Language Models
by: Lyu, Weimin, et al.
Published: (2024)
by: Lyu, Weimin, et al.
Published: (2024)
Bi-CRCL: Bidirectional Conservative-Radical Complementary Learning with Pre-trained Foundation Models for Class-incremental Medical Image Analysis
by: Wu, Xinyao, et al.
Published: (2026)
by: Wu, Xinyao, et al.
Published: (2026)
VanGogh: A Unified Multimodal Diffusion-based Framework for Video Colorization
by: Fang, Zixun, et al.
Published: (2025)
by: Fang, Zixun, et al.
Published: (2025)
Perceptual-Evidence Anchored Reinforced Learning for Multimodal Reasoning
by: Zhang, Chi, et al.
Published: (2025)
by: Zhang, Chi, et al.
Published: (2025)
U-Face: An Efficient and Generalizable Framework for Unsupervised Facial Attribute Editing via Subspace Learning
by: Liu, Bo, et al.
Published: (2026)
by: Liu, Bo, et al.
Published: (2026)
Compositional Attribute Imbalance in Vision Datasets
by: Chen, Jiayi, et al.
Published: (2025)
by: Chen, Jiayi, et al.
Published: (2025)
PanoWan: Lifting Diffusion Video Generation Models to 360° with Latitude/Longitude-aware Mechanisms
by: Xia, Yifei, et al.
Published: (2025)
by: Xia, Yifei, et al.
Published: (2025)
MID: A Self-supervised Multimodal Iterative Denoising Framework
by: Nie, Chang, et al.
Published: (2025)
by: Nie, Chang, et al.
Published: (2025)
See It, Say It, Sorted: An Iterative Training-Free Framework for Visually-Grounded Multimodal Reasoning in LVLMs
by: Zhang, Yongchang, et al.
Published: (2026)
by: Zhang, Yongchang, et al.
Published: (2026)
Rethinking Out-of-Distribution Detection on Imbalanced Data Distribution
by: Liu, Kai, et al.
Published: (2024)
by: Liu, Kai, et al.
Published: (2024)
AnomalyAgent: Training-Free Agentic Models for Zero-/Few-Shot Anomaly Detection
by: Zhang, Yi, et al.
Published: (2026)
by: Zhang, Yi, et al.
Published: (2026)
MGPC: Multimodal Network for Generalizable Point Cloud Completion With Modality Dropout and Progressive Decoding
by: Liu, Jiangyuan, et al.
Published: (2026)
by: Liu, Jiangyuan, et al.
Published: (2026)
A Multimodal Benchmark Dataset and Model for Crop Disease Diagnosis
by: Liu, Xiang, et al.
Published: (2025)
by: Liu, Xiang, et al.
Published: (2025)
REMM:Rotation-Equivariant Framework for End-to-End Multimodal Image Matching
by: Nie, Han, et al.
Published: (2024)
by: Nie, Han, et al.
Published: (2024)
Stain-aware Domain Alignment for Imbalance Blood Cell Classification
by: Li, Yongcheng, et al.
Published: (2024)
by: Li, Yongcheng, et al.
Published: (2024)
SpaAct: Spatially-Activated Transition Learning with Curriculum Adaptation for Vision-Language Navigation
by: Li, Pengna, et al.
Published: (2026)
by: Li, Pengna, et al.
Published: (2026)
Learning Adaptive Node Selection with External Attention for Human Interaction Recognition
by: Pang, Chen, et al.
Published: (2025)
by: Pang, Chen, et al.
Published: (2025)
Subspace Prototype Guidance for Mitigating Class Imbalance in Point Cloud Semantic Segmentation
by: Han, Jiawei, et al.
Published: (2024)
by: Han, Jiawei, et al.
Published: (2024)
Reducing CT Metal Artifacts by Learning Latent Space Alignment with Gemstone Spectral Imaging Data
by: Han, Wencheng, et al.
Published: (2025)
by: Han, Wencheng, et al.
Published: (2025)
Dynamic Uncertainty Learning with Noisy Correspondence for Text-Based Person Search
by: Xie, Zequn, et al.
Published: (2025)
by: Xie, Zequn, et al.
Published: (2025)
Curriculum Dataset Distillation
by: Ma, Zhiheng, et al.
Published: (2024)
by: Ma, Zhiheng, et al.
Published: (2024)
A Classifier-Free Incremental Learning Framework for Scalable Medical Image Segmentation
by: Chen, Xiaoyang, et al.
Published: (2024)
by: Chen, Xiaoyang, et al.
Published: (2024)
Multimodal Continual Learning with MLLMs from Multi-scenario Perspectives
by: Jiang, Kai, et al.
Published: (2025)
by: Jiang, Kai, et al.
Published: (2025)
Dissecting Embodied Abilities in Multimodal Language Models through Skill-level Evaluation and Diagnosis
by: Qi, Yu, et al.
Published: (2025)
by: Qi, Yu, et al.
Published: (2025)
Improving Data Augmentation for Robust Visual Question Answering with Effective Curriculum Learning
by: Zheng, Yuhang, et al.
Published: (2024)
by: Zheng, Yuhang, et al.
Published: (2024)
LCGC: Learning from Consistency Gradient Conflicting for Class-Imbalanced Semi-Supervised Debiasing
by: Xing, Weiwei, et al.
Published: (2025)
by: Xing, Weiwei, et al.
Published: (2025)
Semi-Supervised Multimodal Multi-Instance Learning for Aortic Stenosis Diagnosis
by: Huang, Zhe, et al.
Published: (2024)
by: Huang, Zhe, et al.
Published: (2024)
Boosting the Generalization and Reasoning of Vision Language Models with Curriculum Reinforcement Learning
by: Deng, Huilin, et al.
Published: (2025)
by: Deng, Huilin, et al.
Published: (2025)
Defense against Unauthorized Distillation in Image Restoration via Feature Space Perturbation
by: Hu, Han, et al.
Published: (2025)
by: Hu, Han, et al.
Published: (2025)
Similar Items
-
DynCIM: Dynamic Curriculum for Imbalanced Multimodal Learning
by: Qian, Chengxuan, et al.
Published: (2025) -
Frequency Domain Unlocks New Perspectives for Abdominal Medical Image Segmentation
by: Han, Kai, et al.
Published: (2025) -
Adaptive Label Correction for Robust Medical Image Segmentation with Noisy Labels
by: Qian, Chengxuan, et al.
Published: (2025) -
LiMT: A Multi-task Liver Image Benchmark Dataset
by: Liu, Zhe, et al.
Published: (2025) -
Learning When to Look: A Disentangled Curriculum for Strategic Perception in Multimodal Reasoning
by: Yang, Siqi, et al.
Published: (2025)