Efficient Domain Adaptation of Multimodal Embeddings using Constrastive Learning
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Margaritis, Georgios, Petridis, Periklis, Bertsimas, Dimitris J. |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Holistic Artificial Intelligence in Medicine; improved performance and explainability
par: Petridis, Periklis, et autres
Publié: (2025)
par: Petridis, Periklis, et autres
Publié: (2025)
Efficient Stitchable Task Adaptation
par: He, Haoyu, et autres
Publié: (2023)
par: He, Haoyu, et autres
Publié: (2023)
Few-shot Adaptation to Distribution Shifts By Mixing Source and Target Embeddings
par: Xue, Yihao, et autres
Publié: (2023)
par: Xue, Yihao, et autres
Publié: (2023)
MoDoMoDo: Multi-Domain Data Mixtures for Multimodal LLM Reinforcement Learning
par: Liang, Yiqing, et autres
Publié: (2025)
par: Liang, Yiqing, et autres
Publié: (2025)
Detection and Localization of Subdural Hematoma Using Deep Learning on Computed Tomography
par: Stoumpou, Vasiliki, et autres
Publié: (2025)
par: Stoumpou, Vasiliki, et autres
Publié: (2025)
On Domain-Adaptive Post-Training for Multimodal Large Language Models
par: Cheng, Daixuan, et autres
Publié: (2024)
par: Cheng, Daixuan, et autres
Publié: (2024)
LiME: Lightweight Mixture of Experts for Efficient Multimodal Multi-task Learning
par: Kowsher, Md, et autres
Publié: (2026)
par: Kowsher, Md, et autres
Publié: (2026)
Global Optimization: A Machine Learning Approach
par: Bertsimas, Dimitris, et autres
Publié: (2023)
par: Bertsimas, Dimitris, et autres
Publié: (2023)
MASSV: Multimodal Adaptation and Self-Data Distillation for Speculative Decoding of Vision-Language Models
par: Ganesan, Mugilan, et autres
Publié: (2025)
par: Ganesan, Mugilan, et autres
Publié: (2025)
CROME: Cross-Modal Adapters for Efficient Multimodal LLM
par: Ebrahimi, Sayna, et autres
Publié: (2024)
par: Ebrahimi, Sayna, et autres
Publié: (2024)
Domain Adaptation with a Single Vision-Language Embedding
par: Fahes, Mohammad, et autres
Publié: (2024)
par: Fahes, Mohammad, et autres
Publié: (2024)
ATR-Bench: A Federated Learning Benchmark for Adaptation, Trust, and Reasoning
par: Ashraf, Tajamul, et autres
Publié: (2025)
par: Ashraf, Tajamul, et autres
Publié: (2025)
Hyperbolic Multimodal Representation Learning for Biological Taxonomies
par: Gong, ZeMing, et autres
Publié: (2025)
par: Gong, ZeMing, et autres
Publié: (2025)
Adaptive Data Augmentation with Multi-armed Bandit: Sample-Efficient Embedding Calibration for Implicit Pattern Recognition
par: Tang, Minxue, et autres
Publié: (2026)
par: Tang, Minxue, et autres
Publié: (2026)
Classifier-guided Gradient Modulation for Enhanced Multimodal Learning
par: Guo, Zirun, et autres
Publié: (2024)
par: Guo, Zirun, et autres
Publié: (2024)
Auto-GDA: Automatic Domain Adaptation for Efficient Grounding Verification in Retrieval-Augmented Generation
par: Leemann, Tobias, et autres
Publié: (2024)
par: Leemann, Tobias, et autres
Publié: (2024)
Improving Multimodal Large Language Models Using Continual Learning
par: Srivastava, Shikhar, et autres
Publié: (2024)
par: Srivastava, Shikhar, et autres
Publié: (2024)
Advanced Multimodal Deep Learning Architecture for Image-Text Matching
par: Wang, Jinyin, et autres
Publié: (2024)
par: Wang, Jinyin, et autres
Publié: (2024)
Phrase-Instance Alignment for Generalized Referring Segmentation
par: Nguyen, E-Ro, et autres
Publié: (2024)
par: Nguyen, E-Ro, et autres
Publié: (2024)
ChEX: Interactive Localization and Region Description in Chest X-rays
par: Müller, Philip, et autres
Publié: (2024)
par: Müller, Philip, et autres
Publié: (2024)
Ovis: Structural Embedding Alignment for Multimodal Large Language Model
par: Lu, Shiyin, et autres
Publié: (2024)
par: Lu, Shiyin, et autres
Publié: (2024)
MulTaBench: Benchmarking Multimodal Tabular Learning with Text and Image
par: Arazi, Alan, et autres
Publié: (2026)
par: Arazi, Alan, et autres
Publié: (2026)
Context-Aware Multimodal Pretraining
par: Roth, Karsten, et autres
Publié: (2024)
par: Roth, Karsten, et autres
Publié: (2024)
Contextual Knowledge Pursuit for Faithful Visual Synthesis
par: Luo, Jinqi, et autres
Publié: (2023)
par: Luo, Jinqi, et autres
Publié: (2023)
Out-of-Distribution Detection with Attention Head Masking for Multimodal Document Classification
par: Constantinou, Christos, et autres
Publié: (2024)
par: Constantinou, Christos, et autres
Publié: (2024)
Robust Multimodal Learning with Missing Modalities via Parameter-Efficient Adaptation
par: Reza, Md Kaykobad, et autres
Publié: (2023)
par: Reza, Md Kaykobad, et autres
Publié: (2023)
MuJo: Multimodal Joint Feature Space Learning for Human Activity Recognition
par: Fritsch, Stefan Gerd, et autres
Publié: (2024)
par: Fritsch, Stefan Gerd, et autres
Publié: (2024)
Boomda: Balanced Multi-objective Optimization for Multimodal Domain Adaptation
par: Sun, Jun, et autres
Publié: (2025)
par: Sun, Jun, et autres
Publié: (2025)
Fusing Domain-Specific Content from Large Language Models into Knowledge Graphs for Enhanced Zero Shot Object State Classification
par: Gouidis, Filippos, et autres
Publié: (2024)
par: Gouidis, Filippos, et autres
Publié: (2024)
Multimodal Language Models Cannot Spot Spatial Inconsistencies
par: Khangaonkar, Om, et autres
Publié: (2026)
par: Khangaonkar, Om, et autres
Publié: (2026)
Implicit Multimodal Alignment: On the Generalization of Frozen LLMs to Multimodal Inputs
par: Shukor, Mustafa, et autres
Publié: (2024)
par: Shukor, Mustafa, et autres
Publié: (2024)
Robust Adaptation of Large Multimodal Models for Retrieval Augmented Hateful Meme Detection
par: Mei, Jingbiao, et autres
Publié: (2025)
par: Mei, Jingbiao, et autres
Publié: (2025)
Talk Less, Interact Better: Evaluating In-context Conversational Adaptation in Multimodal LLMs
par: Hua, Yilun, et autres
Publié: (2024)
par: Hua, Yilun, et autres
Publié: (2024)
GRASP: A Rehearsal Policy for Efficient Online Continual Learning
par: Harun, Md Yousuf, et autres
Publié: (2023)
par: Harun, Md Yousuf, et autres
Publié: (2023)
Embedding Geometries of Contrastive Language-Image Pre-Training
par: Chou, Jason Chuan-Chih, et autres
Publié: (2024)
par: Chou, Jason Chuan-Chih, et autres
Publié: (2024)
Semantic Token Reweighting for Interpretable and Controllable Text Embeddings in CLIP
par: Kim, Eunji, et autres
Publié: (2024)
par: Kim, Eunji, et autres
Publié: (2024)
Including Facial Expressions in Contextual Embeddings for Sign Language Generation
par: Viegas, Carla, et autres
Publié: (2022)
par: Viegas, Carla, et autres
Publié: (2022)
MM-Embed: Universal Multimodal Retrieval with Multimodal LLMs
par: Lin, Sheng-Chieh, et autres
Publié: (2024)
par: Lin, Sheng-Chieh, et autres
Publié: (2024)
DeLoRA: Decoupling Angles and Strength in Low-rank Adaptation
par: Bini, Massimo, et autres
Publié: (2025)
par: Bini, Massimo, et autres
Publié: (2025)
Monkey Jump : MoE-Style PEFT for Efficient Multi-Task Learning
par: Prottasha, Nusrat Jahan, et autres
Publié: (2026)
par: Prottasha, Nusrat Jahan, et autres
Publié: (2026)
Documents similaires
-
Holistic Artificial Intelligence in Medicine; improved performance and explainability
par: Petridis, Periklis, et autres
Publié: (2025) -
Efficient Stitchable Task Adaptation
par: He, Haoyu, et autres
Publié: (2023) -
Few-shot Adaptation to Distribution Shifts By Mixing Source and Target Embeddings
par: Xue, Yihao, et autres
Publié: (2023) -
MoDoMoDo: Multi-Domain Data Mixtures for Multimodal LLM Reinforcement Learning
par: Liang, Yiqing, et autres
Publié: (2025) -
Detection and Localization of Subdural Hematoma Using Deep Learning on Computed Tomography
par: Stoumpou, Vasiliki, et autres
Publié: (2025)