MIRROR: Multi-Modal Pathological Self-Supervised Representation Learning via Modality Alignment and Retention
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Wang, Tianyi, Fan, Jianan, Zhang, Dingxin, Liu, Dongnan, Xia, Yong, Huang, Heng, Cai, Weidong |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
ASAP: Advancing Semantic Alignment Promotes Multi-Modal Manipulation Detecting and Grounding
par: Zhang, Zhenxing, et autres
Publié: (2024)
par: Zhang, Zhenxing, et autres
Publié: (2024)
MM-MovieDubber: Towards Multi-Modal Learning for Multi-Modal Movie Dubbing
par: Zheng, Junjie, et autres
Publié: (2025)
par: Zheng, Junjie, et autres
Publié: (2025)
Cross-Modal and Uni-Modal Soft-Label Alignment for Image-Text Retrieval
par: Huang, Hailang, et autres
Publié: (2024)
par: Huang, Hailang, et autres
Publié: (2024)
Overcome Modal Bias in Multi-modal Federated Learning via Balanced Modality Selection
par: Fan, Yunfeng, et autres
Publié: (2023)
par: Fan, Yunfeng, et autres
Publié: (2023)
Dance Any Beat: Blending Beats with Visuals in Dance Video Generation
par: Wang, Xuanchen, et autres
Publié: (2024)
par: Wang, Xuanchen, et autres
Publié: (2024)
Teacher-Guided Pseudo Supervision and Cross-Modal Alignment for Audio-Visual Video Parsing
par: Chen, Yaru, et autres
Publié: (2025)
par: Chen, Yaru, et autres
Publié: (2025)
Calibrated Multimodal Representation Learning with Missing Modalities
par: Liu, Xiaohao, et autres
Publié: (2025)
par: Liu, Xiaohao, et autres
Publié: (2025)
EAR: Enhancing Uni-Modal Representations for Weakly Supervised Audio-Visual Video Parsing
par: Li, Huilai, et autres
Publié: (2026)
par: Li, Huilai, et autres
Publié: (2026)
Multi-Modal Image Fusion via Intervention-Stable Feature Learning
par: Wang, Xue, et autres
Publié: (2026)
par: Wang, Xue, et autres
Publié: (2026)
Balanced Multi-modal Federated Learning via Cross-Modal Infiltration
par: Fan, Yunfeng, et autres
Publié: (2023)
par: Fan, Yunfeng, et autres
Publié: (2023)
Signal: Selective Interaction and Global-local Alignment for Multi-Modal Object Re-Identification
par: Liu, Yangyang, et autres
Publié: (2025)
par: Liu, Yangyang, et autres
Publié: (2025)
Cross Modal Fine-Grained Alignment via Granularity-Aware and Region-Uncertain Modeling
par: Liu, Jiale, et autres
Publié: (2025)
par: Liu, Jiale, et autres
Publié: (2025)
Towards Unbiased Cross-Modal Representation Learning for Food Image-to-Recipe Retrieval
par: Wang, Qing, et autres
Publié: (2025)
par: Wang, Qing, et autres
Publié: (2025)
MM-Point: Multi-View Information-Enhanced Multi-Modal Self-Supervised 3D Point Cloud Understanding
par: Yu, Hai-Tao, et autres
Publié: (2024)
par: Yu, Hai-Tao, et autres
Publié: (2024)
SpikeMba: Multi-Modal Spiking Saliency Mamba for Temporal Video Grounding
par: Li, Wenrui, et autres
Publié: (2024)
par: Li, Wenrui, et autres
Publié: (2024)
Elevating Skeleton-Based Action Recognition with Efficient Multi-Modality Self-Supervision
par: Wei, Yiping, et autres
Publié: (2023)
par: Wei, Yiping, et autres
Publié: (2023)
Gradient-Guided Modality Decoupling for Missing-Modality Robustness
par: Wang, Hao, et autres
Publié: (2024)
par: Wang, Hao, et autres
Publié: (2024)
Quantifying and Enhancing Multi-modal Robustness with Modality Preference
par: Yang, Zequn, et autres
Publié: (2024)
par: Yang, Zequn, et autres
Publié: (2024)
Find the Cliffhanger: Multi-Modal Trailerness in Soap Operas
par: Bretti, Carlo, et autres
Publié: (2024)
par: Bretti, Carlo, et autres
Publié: (2024)
HuMo: Human-Centric Video Generation via Collaborative Multi-Modal Conditioning
par: Chen, Liyang, et autres
Publié: (2025)
par: Chen, Liyang, et autres
Publié: (2025)
Robust Self-Paced Hashing for Cross-Modal Retrieval with Noisy Labels
par: Pu, Ruitao, et autres
Publié: (2025)
par: Pu, Ruitao, et autres
Publié: (2025)
GTPBD-MM: A Global Terraced Parcel and Boundary Dataset with Multi-Modality
par: Zhang, Zhiwei, et autres
Publié: (2026)
par: Zhang, Zhiwei, et autres
Publié: (2026)
Hypergraph Tversky-Aware Domain Incremental Learning for Brain Tumor Segmentation with Missing Modalities
par: Wang, Junze, et autres
Publié: (2025)
par: Wang, Junze, et autres
Publié: (2025)
Anisotropic Modality Align
par: Yu, Xiaomin, et autres
Publié: (2026)
par: Yu, Xiaomin, et autres
Publié: (2026)
Robust Modality-incomplete Anomaly Detection: A Modality-instructive Framework with Benchmark
par: Miao, Bingchen, et autres
Publié: (2024)
par: Miao, Bingchen, et autres
Publié: (2024)
CL2CM: Improving Cross-Lingual Cross-Modal Retrieval via Cross-Lingual Knowledge Transfer
par: Wang, Yabing, et autres
Publié: (2023)
par: Wang, Yabing, et autres
Publié: (2023)
Truth in the Few: High-Value Data Selection for Efficient Multi-Modal Reasoning
par: Li, Shenshen, et autres
Publié: (2025)
par: Li, Shenshen, et autres
Publié: (2025)
Art2Mus: Artwork-to-Music Generation via Visual Conditioning and Large-Scale Cross-Modal Alignment
par: Rinaldi, Ivan, et autres
Publié: (2026)
par: Rinaldi, Ivan, et autres
Publié: (2026)
Interactive Spatial-Frequency Fusion Mamba for Multi-Modal Image Fusion
par: Zhu, Yixin, et autres
Publié: (2026)
par: Zhu, Yixin, et autres
Publié: (2026)
DiTCtrl: Exploring Attention Control in Multi-Modal Diffusion Transformer for Tuning-Free Multi-Prompt Longer Video Generation
par: Cai, Minghong, et autres
Publié: (2024)
par: Cai, Minghong, et autres
Publié: (2024)
Multi-Modal Cross-Domain Alignment Network for Video Moment Retrieval
par: Fang, Xiang, et autres
Publié: (2022)
par: Fang, Xiang, et autres
Publié: (2022)
An Empirical Comparison of Video Frame Sampling Methods for Multi-Modal RAG Retrieval
par: Kandhare, Mahesh, et autres
Publié: (2024)
par: Kandhare, Mahesh, et autres
Publié: (2024)
Towards Universal Modal Tracking with Online Dense Temporal Token Learning
par: Zheng, Yaozong, et autres
Publié: (2025)
par: Zheng, Yaozong, et autres
Publié: (2025)
MambaPro: Multi-Modal Object Re-Identification with Mamba Aggregation and Synergistic Prompt
par: Wang, Yuhao, et autres
Publié: (2024)
par: Wang, Yuhao, et autres
Publié: (2024)
SkeFi: Cross-Modal Knowledge Transfer for Wireless Skeleton-Based Action Recognition
par: Huang, Shunyu, et autres
Publié: (2026)
par: Huang, Shunyu, et autres
Publié: (2026)
Large-scale Multi-Modal Pre-trained Models: A Comprehensive Survey
par: Wang, Xiao, et autres
Publié: (2023)
par: Wang, Xiao, et autres
Publié: (2023)
ROGLE: Robust Global-Local Alignment with Automated Region Supervision for Text-Based Person Search
par: Xie, Zequn, et autres
Publié: (2026)
par: Xie, Zequn, et autres
Publié: (2026)
SM3Det: A Unified Model for Multi-Modal Remote Sensing Object Detection
par: Li, Yuxuan, et autres
Publié: (2024)
par: Li, Yuxuan, et autres
Publié: (2024)
HeGraphAdapter: Tuning Multi-Modal Vision-Language Models with Heterogeneous Graph Adapter
par: Zhao, Yumiao, et autres
Publié: (2024)
par: Zhao, Yumiao, et autres
Publié: (2024)
M3FAS: An Accurate and Robust MultiModal Mobile Face Anti-Spoofing System
par: Kong, Chenqi, et autres
Publié: (2023)
par: Kong, Chenqi, et autres
Publié: (2023)
Documents similaires
-
ASAP: Advancing Semantic Alignment Promotes Multi-Modal Manipulation Detecting and Grounding
par: Zhang, Zhenxing, et autres
Publié: (2024) -
MM-MovieDubber: Towards Multi-Modal Learning for Multi-Modal Movie Dubbing
par: Zheng, Junjie, et autres
Publié: (2025) -
Cross-Modal and Uni-Modal Soft-Label Alignment for Image-Text Retrieval
par: Huang, Hailang, et autres
Publié: (2024) -
Overcome Modal Bias in Multi-modal Federated Learning via Balanced Modality Selection
par: Fan, Yunfeng, et autres
Publié: (2023) -
Dance Any Beat: Blending Beats with Visuals in Dance Video Generation
par: Wang, Xuanchen, et autres
Publié: (2024)