Source-Free Cross-Modal Knowledge Transfer by Unleashing the Potential of Task-Irrelevant Data
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Zhu, Jinjing, Chen, Yucheng, Wang, Lin |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2024
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Towards Dynamic and Small Objects Refinement for Unsupervised Domain Adaptative Nighttime Semantic Segmentation
von: Pan, Jingyi, et al.
Veröffentlicht: (2023)
von: Pan, Jingyi, et al.
Veröffentlicht: (2023)
MoKus: Leveraging Cross-Modal Knowledge Transfer for Knowledge-Aware Concept Customization
von: Zhu, Chenyang, et al.
Veröffentlicht: (2026)
von: Zhu, Chenyang, et al.
Veröffentlicht: (2026)
Multimodal Pathway: Improve Transformers with Irrelevant Data from Other Modalities
von: Zhang, Yiyuan, et al.
Veröffentlicht: (2024)
von: Zhang, Yiyuan, et al.
Veröffentlicht: (2024)
Unleashing Foundation Vision Models: Adaptive Transfer for Diverse Data-Limited Scientific Domains
von: Li, Qiankun, et al.
Veröffentlicht: (2025)
von: Li, Qiankun, et al.
Veröffentlicht: (2025)
Align-KD: Distilling Cross-Modal Alignment Knowledge for Mobile Vision-Language Model
von: Feng, Qianhan, et al.
Veröffentlicht: (2024)
von: Feng, Qianhan, et al.
Veröffentlicht: (2024)
Unleash the Potential of CLIP for Video Highlight Detection
von: Han, Donghoon, et al.
Veröffentlicht: (2024)
von: Han, Donghoon, et al.
Veröffentlicht: (2024)
CLIP the Divergence: Language-guided Unsupervised Domain Adaptation
von: Zhu, Jinjing, et al.
Veröffentlicht: (2024)
von: Zhu, Jinjing, et al.
Veröffentlicht: (2024)
Multi-Prompt with Depth Partitioned Cross-Modal Learning
von: Tian, Yingjie, et al.
Veröffentlicht: (2023)
von: Tian, Yingjie, et al.
Veröffentlicht: (2023)
Distilling Cross-Modal Knowledge via Feature Disentanglement
von: Liu, Junhong, et al.
Veröffentlicht: (2025)
von: Liu, Junhong, et al.
Veröffentlicht: (2025)
PanMatch: Unleashing the Potential of Large Vision Models for Unified Matching Models
von: Zhang, Yongjian, et al.
Veröffentlicht: (2025)
von: Zhang, Yongjian, et al.
Veröffentlicht: (2025)
Cross-Modal Safety Mechanism Transfer in Large Vision-Language Models
von: Xu, Shicheng, et al.
Veröffentlicht: (2024)
von: Xu, Shicheng, et al.
Veröffentlicht: (2024)
Learning to Project for Cross-Task Knowledge Distillation
von: Auty, Dylan, et al.
Veröffentlicht: (2024)
von: Auty, Dylan, et al.
Veröffentlicht: (2024)
Cross-Modal Transferable Image-to-Video Attack on Video Quality Metrics
von: Gotin, Georgii, et al.
Veröffentlicht: (2025)
von: Gotin, Georgii, et al.
Veröffentlicht: (2025)
Mind the Discriminability Trap in Source-Free Cross-domain Few-shot Learning
von: Zhang, Zhenyu, et al.
Veröffentlicht: (2026)
von: Zhang, Zhenyu, et al.
Veröffentlicht: (2026)
PIP: Detecting Adversarial Examples in Large Vision-Language Models via Attention Patterns of Irrelevant Probe Questions
von: Zhang, Yudong, et al.
Veröffentlicht: (2024)
von: Zhang, Yudong, et al.
Veröffentlicht: (2024)
Connect, Collapse, Corrupt: Learning Cross-Modal Tasks with Uni-Modal Data
von: Zhang, Yuhui, et al.
Veröffentlicht: (2024)
von: Zhang, Yuhui, et al.
Veröffentlicht: (2024)
MQuant: Unleashing the Inference Potential of Multimodal Large Language Models via Full Static Quantization
von: Yu, JiangYong, et al.
Veröffentlicht: (2025)
von: Yu, JiangYong, et al.
Veröffentlicht: (2025)
Training-Free Dual Hyperbolic Adapters for Better Cross-Modal Reasoning
von: Zhang, Yi, et al.
Veröffentlicht: (2025)
von: Zhang, Yi, et al.
Veröffentlicht: (2025)
Transferability-Guided Cross-Domain Cross-Task Transfer Learning
von: Tan, Yang, et al.
Veröffentlicht: (2022)
von: Tan, Yang, et al.
Veröffentlicht: (2022)
Hyperbolic Distillation: Geometry-Guided Cross-Modal Transfer for Robust 3D Object Detection
von: Ning, Kanglin, et al.
Veröffentlicht: (2026)
von: Ning, Kanglin, et al.
Veröffentlicht: (2026)
Unleashing Hierarchical Reasoning: An LLM-Driven Framework for Training-Free Referring Video Object Segmentation
von: Zhao, Bingrui, et al.
Veröffentlicht: (2025)
von: Zhao, Bingrui, et al.
Veröffentlicht: (2025)
Temporal Restoration and Spatial Rewiring for Source-Free Multivariate Time Series Domain Adaptation
von: Gong, Peiliang, et al.
Veröffentlicht: (2025)
von: Gong, Peiliang, et al.
Veröffentlicht: (2025)
Curriculum Group Policy Optimization: Adaptive Sampling for Unleashing the Potential of Text-to-Image Generation
von: Li, Baoteng, et al.
Veröffentlicht: (2026)
von: Li, Baoteng, et al.
Veröffentlicht: (2026)
MedUnifier: Unifying Vision-and-Language Pre-training on Medical Data with Vision Generation Task using Discrete Visual Representations
von: Zhang, Ziyang, et al.
Veröffentlicht: (2025)
von: Zhang, Ziyang, et al.
Veröffentlicht: (2025)
Enhancing Multimodal Unified Representations for Cross Modal Generalization
von: Huang, Hai, et al.
Veröffentlicht: (2024)
von: Huang, Hai, et al.
Veröffentlicht: (2024)
MAP: Unleashing Hybrid Mamba-Transformer Vision Backbone's Potential with Masked Autoregressive Pretraining
von: Liu, Yunze, et al.
Veröffentlicht: (2024)
von: Liu, Yunze, et al.
Veröffentlicht: (2024)
OmniPT: Unleashing the Potential of Large Vision Language Models for Pedestrian Tracking and Understanding
von: Fu, Teng, et al.
Veröffentlicht: (2025)
von: Fu, Teng, et al.
Veröffentlicht: (2025)
Cross-Modal Attention Calibration for LVLM Hallucination Mitigation
von: Li, Jiaming, et al.
Veröffentlicht: (2025)
von: Li, Jiaming, et al.
Veröffentlicht: (2025)
Beyond CLIP: Knowledge-Enhanced Multimodal Transformers for Cross-Modal Alignment in Diabetic Retinopathy Diagnosis
von: Samanta, Argha Kamal, et al.
Veröffentlicht: (2025)
von: Samanta, Argha Kamal, et al.
Veröffentlicht: (2025)
K-MaT: Knowledge-Anchored Manifold Transport for Cross-Modal Prompt Learning in Medical Imaging
von: Zeng, Jiajun, et al.
Veröffentlicht: (2026)
von: Zeng, Jiajun, et al.
Veröffentlicht: (2026)
CMHANet: A Cross-Modal Hybrid Attention Network for Point Cloud Registration
von: Zhang, Dongxu, et al.
Veröffentlicht: (2026)
von: Zhang, Dongxu, et al.
Veröffentlicht: (2026)
Map-Free Visual Relocalization Enhanced by Instance Knowledge and Depth Knowledge
von: Xiao, Mingyu, et al.
Veröffentlicht: (2024)
von: Xiao, Mingyu, et al.
Veröffentlicht: (2024)
Cross-Source Supervision for Bone Infection Segmentation in Dual-Modality PET-CT
von: Yang, Zonglin, et al.
Veröffentlicht: (2026)
von: Yang, Zonglin, et al.
Veröffentlicht: (2026)
Relevant Irrelevance: Generating Alterfactual Explanations for Image Classifiers
von: Mertes, Silvan, et al.
Veröffentlicht: (2024)
von: Mertes, Silvan, et al.
Veröffentlicht: (2024)
AttAnchor: Guiding Cross-Modal Token Alignment in VLMs with Attention Anchors
von: Zhang, Junyang, et al.
Veröffentlicht: (2025)
von: Zhang, Junyang, et al.
Veröffentlicht: (2025)
AGCD: Agent-Guided Cross-Modal Decoding for Weather Forecasting
von: Wu, Jing, et al.
Veröffentlicht: (2026)
von: Wu, Jing, et al.
Veröffentlicht: (2026)
Online,Target-Free LiDAR-Camera Extrinsic Calibration via Cross-Modal Mask Matching
von: Huang, Zhiwei, et al.
Veröffentlicht: (2024)
von: Huang, Zhiwei, et al.
Veröffentlicht: (2024)
Reviving In-domain Fine-tuning Methods for Source-Free Cross-domain Few-shot Learning
von: Zhao, Yaze, et al.
Veröffentlicht: (2026)
von: Zhao, Yaze, et al.
Veröffentlicht: (2026)
Federated Cross-Modal Retrieval with Missing Modalities via Semantic Routing and Adapter Personalization
von: Zhou, Hefeng, et al.
Veröffentlicht: (2026)
von: Zhou, Hefeng, et al.
Veröffentlicht: (2026)
Beyond Cross-Modal Alignment: Measuring and Leveraging Modality Gap in Vision-Language Models
von: Yan, Hanqi, et al.
Veröffentlicht: (2025)
von: Yan, Hanqi, et al.
Veröffentlicht: (2025)
Ähnliche Einträge
-
Towards Dynamic and Small Objects Refinement for Unsupervised Domain Adaptative Nighttime Semantic Segmentation
von: Pan, Jingyi, et al.
Veröffentlicht: (2023) -
MoKus: Leveraging Cross-Modal Knowledge Transfer for Knowledge-Aware Concept Customization
von: Zhu, Chenyang, et al.
Veröffentlicht: (2026) -
Multimodal Pathway: Improve Transformers with Irrelevant Data from Other Modalities
von: Zhang, Yiyuan, et al.
Veröffentlicht: (2024) -
Unleashing Foundation Vision Models: Adaptive Transfer for Diverse Data-Limited Scientific Domains
von: Li, Qiankun, et al.
Veröffentlicht: (2025) -
Align-KD: Distilling Cross-Modal Alignment Knowledge for Mobile Vision-Language Model
von: Feng, Qianhan, et al.
Veröffentlicht: (2024)