FedMVP: Federated Multimodal Visual Prompt Tuning for Vision-Language Models
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Singha, Mainak, Roy, Subhankar, Mehrotra, Sarthak, Jha, Ankit, Abdar, Moloud, Banerjee, Biplab, Ricci, Elisa |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Unknown Prompt, the only Lacuna: Unveiling CLIP's Potential for Open Domain Generalization
par: Singha, Mainak, et autres
Publié: (2024)
par: Singha, Mainak, et autres
Publié: (2024)
CLIPoint3D: Language-Grounded Few-Shot Unsupervised 3D Point Cloud Domain Adaptation
par: Singha, Mainak, et autres
Publié: (2026)
par: Singha, Mainak, et autres
Publié: (2026)
AD-CLIP: Adapting Domains in Prompt Space Using CLIP
par: Singha, Mainak, et autres
Publié: (2023)
par: Singha, Mainak, et autres
Publié: (2023)
Elevating All Zero-Shot Sketch-Based Image Retrieval Through Multimodal Prompt Learning
par: Singha, Mainak, et autres
Publié: (2024)
par: Singha, Mainak, et autres
Publié: (2024)
GraphVL: Graph-Enhanced Semantic Modeling via Vision-Language Models for Generalized Class Discovery
par: Solanki, Bhupendra, et autres
Publié: (2024)
par: Solanki, Bhupendra, et autres
Publié: (2024)
BioVLM: Routing Prompts, Not Parameters, for Cross-Modality Generalization in Biomedical VLMs
par: Singha, Mainak, et autres
Publié: (2026)
par: Singha, Mainak, et autres
Publié: (2026)
CDAD-Net: Bridging Domain Gaps in Generalized Category Discovery
par: Rongali, Sai Bhargav, et autres
Publié: (2024)
par: Rongali, Sai Bhargav, et autres
Publié: (2024)
How (Mis)calibrated is Your Federated CLIP and What To Do About It?
par: Singha, Mainak, et autres
Publié: (2025)
par: Singha, Mainak, et autres
Publié: (2025)
FOCUS: Bridging Fine-Grained Recognition and Open-World Discovery across Domains
par: Rathore, Vaibhav, et autres
Publié: (2026)
par: Rathore, Vaibhav, et autres
Publié: (2026)
MMLGNet: Cross-Modal Alignment of Remote Sensing Data using CLIP
par: Chaudhary, Aditya, et autres
Publié: (2026)
par: Chaudhary, Aditya, et autres
Publié: (2026)
bi-modal textual prompt learning for vision-language models in remote sensing
par: Kashyap, Pankhi, et autres
Publié: (2026)
par: Kashyap, Pankhi, et autres
Publié: (2026)
COSMo: CLIP Talks on Open-Set Multi-Target Domain Adaptation
par: Monga, Munish, et autres
Publié: (2024)
par: Monga, Munish, et autres
Publié: (2024)
OSLoPrompt: Bridging Low-Supervision Challenges and Open-Set Domain Generalization in CLIP
par: C, Mohamad Hassan N, et autres
Publié: (2025)
par: C, Mohamad Hassan N, et autres
Publié: (2025)
Reconstruction Guided Few-shot Network For Remote Sensing Image Classification
par: Jaiswal, Mohit, et autres
Publié: (2026)
par: Jaiswal, Mohit, et autres
Publié: (2026)
SDHSI-Net: Learning Better Representations for Hyperspectral Images via Self-Distillation
par: Singh, Prachet Dev, et autres
Publié: (2026)
par: Singh, Prachet Dev, et autres
Publié: (2026)
In the Era of Prompt Learning with Vision-Language Models
par: Jha, Ankit
Publié: (2024)
par: Jha, Ankit
Publié: (2024)
REJEPA: A Novel Joint-Embedding Predictive Architecture for Efficient Remote Sensing Image Retrieval
par: Choudhury, Shabnam, et autres
Publié: (2025)
par: Choudhury, Shabnam, et autres
Publié: (2025)
FedAPT: Federated Adversarial Prompt Tuning for Vision-Language Models
par: Zhai, Kun, et autres
Publié: (2025)
par: Zhai, Kun, et autres
Publié: (2025)
ProactiveBench: Benchmarking Proactiveness in Multimodal Large Language Models
par: De Min, Thomas, et autres
Publié: (2026)
par: De Min, Thomas, et autres
Publié: (2026)
Democratizing Fine-grained Visual Recognition with Large Language Models
par: Liu, Mingxuan, et autres
Publié: (2024)
par: Liu, Mingxuan, et autres
Publié: (2024)
When Domain Generalization meets Generalized Category Discovery: An Adaptive Task-Arithmetic Driven Approach
par: Rathore, Vaibhav, et autres
Publié: (2025)
par: Rathore, Vaibhav, et autres
Publié: (2025)
BayTTA: Uncertainty-aware medical image classification with optimized test-time augmentation using Bayesian model averaging
par: Sherkatghanad, Zeinab, et autres
Publié: (2024)
par: Sherkatghanad, Zeinab, et autres
Publié: (2024)
Debiasing CLIP: Interpreting and Correcting Bias in Attention Heads
par: Yeo, Wei Jie, et autres
Publié: (2025)
par: Yeo, Wei Jie, et autres
Publié: (2025)
GroundedSurg: A Multi-Procedure Benchmark for Language-Conditioned Surgical Tool Segmentation
par: Ashraf, Tajamul, et autres
Publié: (2026)
par: Ashraf, Tajamul, et autres
Publié: (2026)
Organizing Unstructured Image Collections using Natural Language
par: Liu, Mingxuan, et autres
Publié: (2024)
par: Liu, Mingxuan, et autres
Publié: (2024)
FedVLMBench: Benchmarking Federated Fine-Tuning of Vision-Language Models
par: Zheng, Weiying, et autres
Publié: (2025)
par: Zheng, Weiying, et autres
Publié: (2025)
ATR-Bench: A Federated Learning Benchmark for Adaptation, Trust, and Reasoning
par: Ashraf, Tajamul, et autres
Publié: (2025)
par: Ashraf, Tajamul, et autres
Publié: (2025)
Scaling Vision-and-Language Navigation With Offline RL
par: Bundele, Valay, et autres
Publié: (2024)
par: Bundele, Valay, et autres
Publié: (2024)
Large-scale Pre-trained Models are Surprisingly Strong in Incremental Novel Class Discovery
par: Liu, Mingxuan, et autres
Publié: (2023)
par: Liu, Mingxuan, et autres
Publié: (2023)
LT-Soups: Bridging Head and Tail Classes via Subsampled Model Soups
par: Aminbeidokhti, Masih, et autres
Publié: (2025)
par: Aminbeidokhti, Masih, et autres
Publié: (2025)
Unlearning Personal Data from a Single Image
par: De Min, Thomas, et autres
Publié: (2024)
par: De Min, Thomas, et autres
Publié: (2024)
FedDEAP: Adaptive Dual-Prompt Tuning for Multi-Domain Federated Learning
par: Zheng, Yubin, et autres
Publié: (2025)
par: Zheng, Yubin, et autres
Publié: (2025)
QTrack: Query-Driven Reasoning for Multi-modal MOT
par: Ashraf, Tajamul, et autres
Publié: (2026)
par: Ashraf, Tajamul, et autres
Publié: (2026)
GeoMeld: Toward Semantically Grounded Foundation Models for Remote Sensing
par: Hasan, Maram, et autres
Publié: (2026)
par: Hasan, Maram, et autres
Publié: (2026)
Less is more: Summarizing Patch Tokens for efficient Multi-Label Class-Incremental Learning
par: De Min, Thomas, et autres
Publié: (2024)
par: De Min, Thomas, et autres
Publié: (2024)
FedHPL: Efficient Heterogeneous Federated Learning with Prompt Tuning and Logit Distillation
par: Ma, Yuting, et autres
Publié: (2024)
par: Ma, Yuting, et autres
Publié: (2024)
Not Only Text: Exploring Compositionality of Visual Representations in Vision-Language Models
par: Berasi, Davide, et autres
Publié: (2025)
par: Berasi, Davide, et autres
Publié: (2025)
SelfPrompt: Confidence-Aware Semi-Supervised Tuning for Robust Vision-Language Model Adaptation
par: Roy, Shuvendu, et autres
Publié: (2025)
par: Roy, Shuvendu, et autres
Publié: (2025)
Ensembling Pruned Attention Heads For Uncertainty-Aware Efficient Transformers
par: Gabetni, Firas, et autres
Publié: (2025)
par: Gabetni, Firas, et autres
Publié: (2025)
pFedMMA: Personalized Federated Fine-Tuning with Multi-Modal Adapter for Vision-Language Models
par: Ghiasvand, Sajjad, et autres
Publié: (2025)
par: Ghiasvand, Sajjad, et autres
Publié: (2025)
Documents similaires
-
Unknown Prompt, the only Lacuna: Unveiling CLIP's Potential for Open Domain Generalization
par: Singha, Mainak, et autres
Publié: (2024) -
CLIPoint3D: Language-Grounded Few-Shot Unsupervised 3D Point Cloud Domain Adaptation
par: Singha, Mainak, et autres
Publié: (2026) -
AD-CLIP: Adapting Domains in Prompt Space Using CLIP
par: Singha, Mainak, et autres
Publié: (2023) -
Elevating All Zero-Shot Sketch-Based Image Retrieval Through Multimodal Prompt Learning
par: Singha, Mainak, et autres
Publié: (2024) -
GraphVL: Graph-Enhanced Semantic Modeling via Vision-Language Models for Generalized Class Discovery
par: Solanki, Bhupendra, et autres
Publié: (2024)