Variational Adapter for Cross-modal Similarity Representation
Fuente:
arXiv
Salvato in:
| Autori principali: | Wei, WenZhang, Gui, Zhipeng, Peng, Dehua, Ye, Tiandi, Wu, Huayi |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
AdaIR: Exploiting Underlying Similarities of Image Restoration Tasks with Adapters
di: Chen, Hao-Wei, et al.
Pubblicazione: (2024)
di: Chen, Hao-Wei, et al.
Pubblicazione: (2024)
SeLIP: Similarity Enhanced Contrastive Language Image Pretraining for Multi-modal Head MRI
di: Liu, Zhiyang, et al.
Pubblicazione: (2025)
di: Liu, Zhiyang, et al.
Pubblicazione: (2025)
Federated Cross-Modal Retrieval with Missing Modalities via Semantic Routing and Adapter Personalization
di: Zhou, Hefeng, et al.
Pubblicazione: (2026)
di: Zhou, Hefeng, et al.
Pubblicazione: (2026)
IDEA: Image Description Enhanced CLIP-Adapter
di: Ye, Zhipeng, et al.
Pubblicazione: (2025)
di: Ye, Zhipeng, et al.
Pubblicazione: (2025)
Unsupervised Domain Adaptation via Similarity-based Prototypes for Cross-Modality Segmentation
di: Ye, Ziyu, et al.
Pubblicazione: (2025)
di: Ye, Ziyu, et al.
Pubblicazione: (2025)
Att-Adapter: A Robust and Precise Domain-Specific Multi-Attributes T2I Diffusion Adapter via Conditional Variational Autoencoder
di: Cho, Wonwoong, et al.
Pubblicazione: (2025)
di: Cho, Wonwoong, et al.
Pubblicazione: (2025)
Towards Cross-modal Backward-compatible Representation Learning for Vision-Language Models
di: Jang, Young Kyun, et al.
Pubblicazione: (2024)
di: Jang, Young Kyun, et al.
Pubblicazione: (2024)
Representation Learning for Compressed Video Action Recognition via Attentive Cross-modal Interaction with Motion Enhancement
di: Li, Bing, et al.
Pubblicazione: (2022)
di: Li, Bing, et al.
Pubblicazione: (2022)
Cross-Modal Adapter for Vision-Language Retrieval
di: Jiang, Haojun, et al.
Pubblicazione: (2022)
di: Jiang, Haojun, et al.
Pubblicazione: (2022)
GaussianCross: Cross-modal Self-supervised 3D Representation Learning via Gaussian Splatting
di: Yao, Lei, et al.
Pubblicazione: (2025)
di: Yao, Lei, et al.
Pubblicazione: (2025)
Character-Adapter: Prompt-Guided Region Control for High-Fidelity Character Customization
di: Ma, Yuhang, et al.
Pubblicazione: (2024)
di: Ma, Yuhang, et al.
Pubblicazione: (2024)
Focus on Focus: Focus-oriented Representation Learning and Multi-view Cross-modal Alignment for Glioma Grading
di: Pan, Li, et al.
Pubblicazione: (2024)
di: Pan, Li, et al.
Pubblicazione: (2024)
Watch Wider and Think Deeper: Collaborative Cross-modal Chain-of-Thought for Complex Visual Reasoning
di: Lu, Wenting, et al.
Pubblicazione: (2026)
di: Lu, Wenting, et al.
Pubblicazione: (2026)
Training-Free Dual Hyperbolic Adapters for Better Cross-Modal Reasoning
di: Zhang, Yi, et al.
Pubblicazione: (2025)
di: Zhang, Yi, et al.
Pubblicazione: (2025)
Fusion-Mamba for Cross-modality Object Detection
di: Dong, Wenhao, et al.
Pubblicazione: (2024)
di: Dong, Wenhao, et al.
Pubblicazione: (2024)
ViT-Lens: Towards Omni-modal Representations
di: Lei, Weixian, et al.
Pubblicazione: (2023)
di: Lei, Weixian, et al.
Pubblicazione: (2023)
Conv-Adapter: Exploring Parameter Efficient Transfer Learning for ConvNets
di: Chen, Hao, et al.
Pubblicazione: (2022)
di: Chen, Hao, et al.
Pubblicazione: (2022)
Masked Contrastive Reconstruction for Cross-modal Medical Image-Report Retrieval
di: Wei, Zeqiang, et al.
Pubblicazione: (2023)
di: Wei, Zeqiang, et al.
Pubblicazione: (2023)
Hierarchical Multi-modal Transformer for Cross-modal Long Document Classification
di: Liu, Tengfei, et al.
Pubblicazione: (2024)
di: Liu, Tengfei, et al.
Pubblicazione: (2024)
Spectral Discrepancy and Cross-modal Semantic Consistency Learning for Object Detection in Hyperspectral Image
di: He, Xiao, et al.
Pubblicazione: (2025)
di: He, Xiao, et al.
Pubblicazione: (2025)
Bridging Modality Gap for Visual Grounding with Effecitve Cross-modal Distillation
di: Wang, Jiaxi, et al.
Pubblicazione: (2023)
di: Wang, Jiaxi, et al.
Pubblicazione: (2023)
Back into Plato's Cave: Examining Cross-modal Representational Convergence at Scale
di: Koepke, A. Sophia, et al.
Pubblicazione: (2026)
di: Koepke, A. Sophia, et al.
Pubblicazione: (2026)
Awesome Multi-modal Object Tracking
di: Zhang, Chunhui, et al.
Pubblicazione: (2024)
di: Zhang, Chunhui, et al.
Pubblicazione: (2024)
Ex-Omni: Enabling 3D Facial Animation Generation for Omni-modal Large Language Models
di: Zhang, Haoyu, et al.
Pubblicazione: (2026)
di: Zhang, Haoyu, et al.
Pubblicazione: (2026)
Leveraging Cross-Modal Neighbor Representation for Improved CLIP Classification
di: Yi, Chao, et al.
Pubblicazione: (2024)
di: Yi, Chao, et al.
Pubblicazione: (2024)
CellPainTR: Generalizable Representation Learning for Cross-Dataset Cell Painting Analysis
di: Caruzzo, Cedric, et al.
Pubblicazione: (2025)
di: Caruzzo, Cedric, et al.
Pubblicazione: (2025)
Memory-based Cross-modal Semantic Alignment Network for Radiology Report Generation
di: Tao, Yitian, et al.
Pubblicazione: (2024)
di: Tao, Yitian, et al.
Pubblicazione: (2024)
ViewSAM: Learning View-aware Cross-modal Semantics for Weakly Supervised Cross-view Referring Multi-Object Tracking
di: Ge, Jiawei, et al.
Pubblicazione: (2026)
di: Ge, Jiawei, et al.
Pubblicazione: (2026)
DM-Adapter: Domain-Aware Mixture-of-Adapters for Text-Based Person Retrieval
di: Liu, Yating, et al.
Pubblicazione: (2025)
di: Liu, Yating, et al.
Pubblicazione: (2025)
Cross-modality Guidance-aided Multi-modal Learning with Dual Attention for MRI Brain Tumor Grading
di: Xu, Dunyuan, et al.
Pubblicazione: (2024)
di: Xu, Dunyuan, et al.
Pubblicazione: (2024)
Case-Enhanced Vision Transformer: Improving Explanations of Image Similarity with a ViT-based Similarity Metric
di: Zhao, Ziwei, et al.
Pubblicazione: (2024)
di: Zhao, Ziwei, et al.
Pubblicazione: (2024)
Comparing Computational Pathology Foundation Models using Representational Similarity Analysis
di: Mishra, Vaibhav, et al.
Pubblicazione: (2025)
di: Mishra, Vaibhav, et al.
Pubblicazione: (2025)
Diffexplainer: Towards Cross-modal Global Explanations with Diffusion Models
di: Pennisi, Matteo, et al.
Pubblicazione: (2024)
di: Pennisi, Matteo, et al.
Pubblicazione: (2024)
Integrating Text and Image Pre-training for Multi-modal Algorithmic Reasoning
di: Zhang, Zijian, et al.
Pubblicazione: (2024)
di: Zhang, Zijian, et al.
Pubblicazione: (2024)
Complementarity-driven Representation Learning for Multi-modal Knowledge Graph Completion
di: Li, Lijian
Pubblicazione: (2025)
di: Li, Lijian
Pubblicazione: (2025)
Learning Multi-modal Representations by Watching Hundreds of Surgical Video Lectures
di: Yuan, Kun, et al.
Pubblicazione: (2023)
di: Yuan, Kun, et al.
Pubblicazione: (2023)
Multi-modal Relation Distillation for Unified 3D Representation Learning
di: Wang, Huiqun, et al.
Pubblicazione: (2024)
di: Wang, Huiqun, et al.
Pubblicazione: (2024)
Self-Explainable Affordance Learning with Embodied Caption
di: Zhang, Zhipeng, et al.
Pubblicazione: (2024)
di: Zhang, Zhipeng, et al.
Pubblicazione: (2024)
e5-omni: Explicit Cross-modal Alignment for Omni-modal Embeddings
di: Chen, Haonan, et al.
Pubblicazione: (2026)
di: Chen, Haonan, et al.
Pubblicazione: (2026)
DHCP: Detecting Hallucinations by Cross-modal Attention Pattern in Large Vision-Language Models
di: Zhang, Yudong, et al.
Pubblicazione: (2024)
di: Zhang, Yudong, et al.
Pubblicazione: (2024)
Documenti analoghi
-
AdaIR: Exploiting Underlying Similarities of Image Restoration Tasks with Adapters
di: Chen, Hao-Wei, et al.
Pubblicazione: (2024) -
SeLIP: Similarity Enhanced Contrastive Language Image Pretraining for Multi-modal Head MRI
di: Liu, Zhiyang, et al.
Pubblicazione: (2025) -
Federated Cross-Modal Retrieval with Missing Modalities via Semantic Routing and Adapter Personalization
di: Zhou, Hefeng, et al.
Pubblicazione: (2026) -
IDEA: Image Description Enhanced CLIP-Adapter
di: Ye, Zhipeng, et al.
Pubblicazione: (2025) -
Unsupervised Domain Adaptation via Similarity-based Prototypes for Cross-Modality Segmentation
di: Ye, Ziyu, et al.
Pubblicazione: (2025)