Cross-Modal Distillation For Widely Differing Modalities
Fuente:
arXiv
Saved in:
| Main Authors: | Zhao, Cairong, Jin, Yufeng, Song, Zifan, Chen, Haonan, Miao, Duoqian, Hu, Guosheng |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Trade in Minutes! Rationality-Driven Agentic System for Quantitative Financial Trading
by: Song, Zifan, et al.
Published: (2025)
by: Song, Zifan, et al.
Published: (2025)
Credit Where It is Due: Cross-Modality Connectivity Drives Precise Reinforcement Learning for MLLM Reasoning
by: Jiao, Zhengbo, et al.
Published: (2026)
by: Jiao, Zhengbo, et al.
Published: (2026)
Multimodal Federated Learning with Missing Modality via Prototype Mask and Contrast
by: Bao, Guangyin, et al.
Published: (2023)
by: Bao, Guangyin, et al.
Published: (2023)
CANDLE: A Cross-Modal Agentic Knowledge Distillation Framework for Interpretable Sarcopenia Diagnosis
by: Jin, Yuqi, et al.
Published: (2025)
by: Jin, Yuqi, et al.
Published: (2025)
Same Content, Different Answers: Cross-Modal Inconsistency in MLLMs
by: van Sprang, Angela, et al.
Published: (2025)
by: van Sprang, Angela, et al.
Published: (2025)
Enhancing Multimodal Sentiment Analysis for Missing Modality through Self-Distillation and Unified Modality Cross-Attention
by: Weng, Yuzhe, et al.
Published: (2024)
by: Weng, Yuzhe, et al.
Published: (2024)
Bridging Modality Gap for Visual Grounding with Effecitve Cross-modal Distillation
by: Wang, Jiaxi, et al.
Published: (2023)
by: Wang, Jiaxi, et al.
Published: (2023)
Cross-Modal Knowledge Distillation for Speech Large Language Models
by: Wang, Enzhi, et al.
Published: (2025)
by: Wang, Enzhi, et al.
Published: (2025)
Distilling Cross-Modal Knowledge via Feature Disentanglement
by: Liu, Junhong, et al.
Published: (2025)
by: Liu, Junhong, et al.
Published: (2025)
CCSD: Cross-Modal Compositional Self-Distillation for Robust Brain Tumor Segmentation with Missing Modalities
by: Xie, Dongqing, et al.
Published: (2025)
by: Xie, Dongqing, et al.
Published: (2025)
X-OPD: Cross-Modal On-Policy Distillation for Capability Alignment in Speech LLMs
by: Cao, Di, et al.
Published: (2026)
by: Cao, Di, et al.
Published: (2026)
Cap2Sum: Learning to Summarize Videos by Generating Captions
by: Zhao, Cairong, et al.
Published: (2024)
by: Zhao, Cairong, et al.
Published: (2024)
LLMs Meet Cross-Modal Time Series Analytics: Overview and Directions
by: Liu, Chenxi, et al.
Published: (2025)
by: Liu, Chenxi, et al.
Published: (2025)
Multimodal Contrastive Learning via Uni-Modal Coding and Cross-Modal Prediction for Multimodal Sentiment Analysis
by: Lin, Ronghao, et al.
Published: (2022)
by: Lin, Ronghao, et al.
Published: (2022)
Modality Selection and Skill Segmentation via Cross-Modality Attention
by: Jiang, Jiawei, et al.
Published: (2025)
by: Jiang, Jiawei, et al.
Published: (2025)
Multi-Modal Manipulation via Multi-Modal Policy Consensus
by: Chen, Haonan, et al.
Published: (2025)
by: Chen, Haonan, et al.
Published: (2025)
Align-KD: Distilling Cross-Modal Alignment Knowledge for Mobile Vision-Language Model
by: Feng, Qianhan, et al.
Published: (2024)
by: Feng, Qianhan, et al.
Published: (2024)
A Survey on Music Generation from Single-Modal, Cross-Modal, and Multi-Modal Perspectives
by: Li, Shuyu, et al.
Published: (2025)
by: Li, Shuyu, et al.
Published: (2025)
A Pattern to Align Them All: Integrating Different Modalities to Define Multi-Modal Entities
by: Apriceno, Gianluca, et al.
Published: (2024)
by: Apriceno, Gianluca, et al.
Published: (2024)
Multi-Modal Experience Inspired AI Creation
by: Cao, Qian, et al.
Published: (2022)
by: Cao, Qian, et al.
Published: (2022)
Cross-Modal Attention Network with Dual Graph Learning in Multimodal Recommendation
by: Dai, Ji, et al.
Published: (2026)
by: Dai, Ji, et al.
Published: (2026)
Cross-Modal Representational Knowledge Distillation for Enhanced Spike-Informed LFP Modeling
by: Erturk, Eray, et al.
Published: (2025)
by: Erturk, Eray, et al.
Published: (2025)
Federated Cross-Modal Retrieval with Missing Modalities via Semantic Routing and Adapter Personalization
by: Zhou, Hefeng, et al.
Published: (2026)
by: Zhou, Hefeng, et al.
Published: (2026)
Modulating Cross-Modal Convergence with Single-Stimulus, Intra-Modal Dispersion
by: Hosseini, Eghbal A., et al.
Published: (2026)
by: Hosseini, Eghbal A., et al.
Published: (2026)
Cross-modal Identity Mapping: Minimizing Information Loss in Modality Conversion via Reinforcement Learning
by: Jia, Haonan, et al.
Published: (2026)
by: Jia, Haonan, et al.
Published: (2026)
MAD: Modality-Adaptive Decoding for Mitigating Cross-Modal Hallucinations in Multimodal Large Language Models
by: Chung, Sangyun, et al.
Published: (2026)
by: Chung, Sangyun, et al.
Published: (2026)
MEEL: Multi-Modal Event Evolution Learning
by: Tao, Zhengwei, et al.
Published: (2024)
by: Tao, Zhengwei, et al.
Published: (2024)
LCMF: Lightweight Cross-Modality Mambaformer for Embodied Robotics VQA
by: Kang, Zeyi, et al.
Published: (2025)
by: Kang, Zeyi, et al.
Published: (2025)
Depth-Guided Self-Supervised Human Keypoint Detection via Cross-Modal Distillation
by: Anand, Aman, et al.
Published: (2024)
by: Anand, Aman, et al.
Published: (2024)
ModalityMirror: Improving Audio Classification in Modality Heterogeneity Federated Learning with Multimodal Distillation
by: Feng, Tiantian, et al.
Published: (2024)
by: Feng, Tiantian, et al.
Published: (2024)
Temporal Cross-Modal Knowledge-Distillation-Based Transfer-Learning for Gas Turbine Vibration Fault Detection
by: Nejad, Ali Bagheri, et al.
Published: (2026)
by: Nejad, Ali Bagheri, et al.
Published: (2026)
Cross-Modal Memory Compression for Efficient Multi-Agent Debate
by: Wu, Jing, et al.
Published: (2026)
by: Wu, Jing, et al.
Published: (2026)
COMODO: Cross-Modal Video-to-IMU Distillation for Efficient Egocentric Human Activity Recognition
by: Chen, Baiyu, et al.
Published: (2025)
by: Chen, Baiyu, et al.
Published: (2025)
Lightweight Cross-Modal Representation Learning
by: Faye, Bilal, et al.
Published: (2024)
by: Faye, Bilal, et al.
Published: (2024)
Vision-Language Meets the Skeleton: Progressively Distillation with Cross-Modal Knowledge for 3D Action Representation Learning
by: Chen, Yang, et al.
Published: (2024)
by: Chen, Yang, et al.
Published: (2024)
COSMOS: Cross-Modality Self-Distillation for Vision Language Pre-training
by: Kim, Sanghwan, et al.
Published: (2024)
by: Kim, Sanghwan, et al.
Published: (2024)
Modality-Dependent Memory Mechanisms in Cross-Modal Neuromorphic Computing
by: Blessing, Effiong, et al.
Published: (2025)
by: Blessing, Effiong, et al.
Published: (2025)
Hyperbolic Distillation: Geometry-Guided Cross-Modal Transfer for Robust 3D Object Detection
by: Ning, Kanglin, et al.
Published: (2026)
by: Ning, Kanglin, et al.
Published: (2026)
CoMoTo: Unpaired Cross-Modal Lesion Distillation Improves Breast Lesion Detection in Tomosynthesis
by: Alberb, Muhammad, et al.
Published: (2024)
by: Alberb, Muhammad, et al.
Published: (2024)
SynGR: Unleashing the Potential of Cross-Modal Synergy for Generative Recommendation
by: Chen, Wei, et al.
Published: (2026)
by: Chen, Wei, et al.
Published: (2026)
Similar Items
-
Trade in Minutes! Rationality-Driven Agentic System for Quantitative Financial Trading
by: Song, Zifan, et al.
Published: (2025) -
Credit Where It is Due: Cross-Modality Connectivity Drives Precise Reinforcement Learning for MLLM Reasoning
by: Jiao, Zhengbo, et al.
Published: (2026) -
Multimodal Federated Learning with Missing Modality via Prototype Mask and Contrast
by: Bao, Guangyin, et al.
Published: (2023) -
CANDLE: A Cross-Modal Agentic Knowledge Distillation Framework for Interpretable Sarcopenia Diagnosis
by: Jin, Yuqi, et al.
Published: (2025) -
Same Content, Different Answers: Cross-Modal Inconsistency in MLLMs
by: van Sprang, Angela, et al.
Published: (2025)