Elevating All Zero-Shot Sketch-Based Image Retrieval Through Multimodal Prompt Learning
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Singha, Mainak, Jha, Ankit, Gupta, Divyam, Singla, Pranav, Banerjee, Biplab |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
AD-CLIP: Adapting Domains in Prompt Space Using CLIP
par: Singha, Mainak, et autres
Publié: (2023)
par: Singha, Mainak, et autres
Publié: (2023)
OSLoPrompt: Bridging Low-Supervision Challenges and Open-Set Domain Generalization in CLIP
par: C, Mohamad Hassan N, et autres
Publié: (2025)
par: C, Mohamad Hassan N, et autres
Publié: (2025)
BioVLM: Routing Prompts, Not Parameters, for Cross-Modality Generalization in Biomedical VLMs
par: Singha, Mainak, et autres
Publié: (2026)
par: Singha, Mainak, et autres
Publié: (2026)
FedMVP: Federated Multimodal Visual Prompt Tuning for Vision-Language Models
par: Singha, Mainak, et autres
Publié: (2025)
par: Singha, Mainak, et autres
Publié: (2025)
Unknown Prompt, the only Lacuna: Unveiling CLIP's Potential for Open Domain Generalization
par: Singha, Mainak, et autres
Publié: (2024)
par: Singha, Mainak, et autres
Publié: (2024)
SDHSI-Net: Learning Better Representations for Hyperspectral Images via Self-Distillation
par: Singh, Prachet Dev, et autres
Publié: (2026)
par: Singh, Prachet Dev, et autres
Publié: (2026)
GraphVL: Graph-Enhanced Semantic Modeling via Vision-Language Models for Generalized Class Discovery
par: Solanki, Bhupendra, et autres
Publié: (2024)
par: Solanki, Bhupendra, et autres
Publié: (2024)
MMLGNet: Cross-Modal Alignment of Remote Sensing Data using CLIP
par: Chaudhary, Aditya, et autres
Publié: (2026)
par: Chaudhary, Aditya, et autres
Publié: (2026)
bi-modal textual prompt learning for vision-language models in remote sensing
par: Kashyap, Pankhi, et autres
Publié: (2026)
par: Kashyap, Pankhi, et autres
Publié: (2026)
Reconstruction Guided Few-shot Network For Remote Sensing Image Classification
par: Jaiswal, Mohit, et autres
Publié: (2026)
par: Jaiswal, Mohit, et autres
Publié: (2026)
COSMo: CLIP Talks on Open-Set Multi-Target Domain Adaptation
par: Monga, Munish, et autres
Publié: (2024)
par: Monga, Munish, et autres
Publié: (2024)
HIDISC: A Hyperbolic Framework for Domain Generalization with Generalized Category Discovery
par: Rathore, Vaibhav, et autres
Publié: (2025)
par: Rathore, Vaibhav, et autres
Publié: (2025)
CDAD-Net: Bridging Domain Gaps in Generalized Category Discovery
par: Rongali, Sai Bhargav, et autres
Publié: (2024)
par: Rongali, Sai Bhargav, et autres
Publié: (2024)
CLIPoint3D: Language-Grounded Few-Shot Unsupervised 3D Point Cloud Domain Adaptation
par: Singha, Mainak, et autres
Publié: (2026)
par: Singha, Mainak, et autres
Publié: (2026)
FOCUS: Bridging Fine-Grained Recognition and Open-World Discovery across Domains
par: Rathore, Vaibhav, et autres
Publié: (2026)
par: Rathore, Vaibhav, et autres
Publié: (2026)
In the Era of Prompt Learning with Vision-Language Models
par: Jha, Ankit
Publié: (2024)
par: Jha, Ankit
Publié: (2024)
Dual-Modal Prompting for Sketch-Based Image Retrieval
par: Gao, Liying, et autres
Publié: (2024)
par: Gao, Liying, et autres
Publié: (2024)
Diff-SBSR: Learning Multimodal Feature-Enhanced Diffusion Models for Zero-Shot Sketch-Based 3D Shape Retrieval
par: Cheng, Hang, et autres
Publié: (2026)
par: Cheng, Hang, et autres
Publié: (2026)
Relation-Aware Meta-Learning for Zero-shot Sketch-Based Image Retrieval
par: Liu, Yang, et autres
Publié: (2024)
par: Liu, Yang, et autres
Publié: (2024)
Modality-Aware Representation Learning for Zero-shot Sketch-based Image Retrieval
par: Lyou, Eunyi, et autres
Publié: (2024)
par: Lyou, Eunyi, et autres
Publié: (2024)
How to Handle Sketch-Abstraction in Sketch-Based Image Retrieval?
par: Koley, Subhadeep, et autres
Publié: (2024)
par: Koley, Subhadeep, et autres
Publié: (2024)
CR-JEPA: Cross-Modal Joint-Embedding Predictive Learning for Remote Sensing Image Retrieval
par: Hossain, Md Aminur, et autres
Publié: (2026)
par: Hossain, Md Aminur, et autres
Publié: (2026)
Scaling Prompt Instructed Zero Shot Composed Image Retrieval with Image-Only Data
par: Duan, Yiqun, et autres
Publié: (2025)
par: Duan, Yiqun, et autres
Publié: (2025)
Zero Shot Composed Image Retrieval
par: Kakarla, Santhosh, et autres
Publié: (2025)
par: Kakarla, Santhosh, et autres
Publié: (2025)
Generating customized prompts for Zero-Shot Rare Event Medical Image Classification using LLM
par: Kamboj, Payal, et autres
Publié: (2025)
par: Kamboj, Payal, et autres
Publié: (2025)
Multimodal Reasoning Agent for Zero-Shot Composed Image Retrieval
par: Tu, Rong-Cheng, et autres
Publié: (2025)
par: Tu, Rong-Cheng, et autres
Publié: (2025)
REJEPA: A Novel Joint-Embedding Predictive Architecture for Efficient Remote Sensing Image Retrieval
par: Choudhury, Shabnam, et autres
Publié: (2025)
par: Choudhury, Shabnam, et autres
Publié: (2025)
Freeview Sketching: View-Aware Fine-Grained Sketch-Based Image Retrieval
par: Sain, Aneeshan, et autres
Publié: (2024)
par: Sain, Aneeshan, et autres
Publié: (2024)
Prompt-Based Continual Compositional Zero-Shot Learning
par: Maryam, Sauda, et autres
Publié: (2025)
par: Maryam, Sauda, et autres
Publié: (2025)
Dynamic Multi-level Weighted Alignment Network for Zero-shot Sketch-based Image Retrieval
par: Su, Hanwen, et autres
Publié: (2025)
par: Su, Hanwen, et autres
Publié: (2025)
Local-Global Context-Aware and Structure-Preserving Image Super-Resolution
par: Palit, Sanchar, et autres
Publié: (2025)
par: Palit, Sanchar, et autres
Publié: (2025)
Label-Efficient Hyperspectral Image Classification via Spectral FiLM Modulation of Low-Level Pretrained Diffusion Features
par: Hu, Yuzhen, et autres
Publié: (2025)
par: Hu, Yuzhen, et autres
Publié: (2025)
Bayesian Prompt Flow Learning for Zero-Shot Anomaly Detection
par: Qu, Zhen, et autres
Publié: (2025)
par: Qu, Zhen, et autres
Publié: (2025)
Prompting Language-Informed Distribution for Compositional Zero-Shot Learning
par: Bao, Wentao, et autres
Publié: (2023)
par: Bao, Wentao, et autres
Publié: (2023)
Attend and Enrich: Enhanced Visual Prompt for Zero-Shot Learning
par: Liu, Man, et autres
Publié: (2024)
par: Liu, Man, et autres
Publié: (2024)
Visual and Semantic Prompt Collaboration for Generalized Zero-Shot Learning
par: Jiang, Huajie, et autres
Publié: (2025)
par: Jiang, Huajie, et autres
Publié: (2025)
Foundation Models and Adaptive Feature Selection: A Synergistic Approach to Video Question Answering
par: Rongali, Sai Bhargav, et autres
Publié: (2024)
par: Rongali, Sai Bhargav, et autres
Publié: (2024)
Back To The Drawing Board: Rethinking Scene-Level Sketch-Based Image Retrieval
par: Demić, Emil, et autres
Publié: (2025)
par: Demić, Emil, et autres
Publié: (2025)
Revised Regularization for Efficient Continual Learning through Correlation-Based Parameter Update in Bayesian Neural Networks
par: Palit, Sanchar, et autres
Publié: (2024)
par: Palit, Sanchar, et autres
Publié: (2024)
PDV: Prompt Directional Vectors for Zero-shot Composed Image Retrieval
par: Tursun, Osman, et autres
Publié: (2025)
par: Tursun, Osman, et autres
Publié: (2025)
Documents similaires
-
AD-CLIP: Adapting Domains in Prompt Space Using CLIP
par: Singha, Mainak, et autres
Publié: (2023) -
OSLoPrompt: Bridging Low-Supervision Challenges and Open-Set Domain Generalization in CLIP
par: C, Mohamad Hassan N, et autres
Publié: (2025) -
BioVLM: Routing Prompts, Not Parameters, for Cross-Modality Generalization in Biomedical VLMs
par: Singha, Mainak, et autres
Publié: (2026) -
FedMVP: Federated Multimodal Visual Prompt Tuning for Vision-Language Models
par: Singha, Mainak, et autres
Publié: (2025) -
Unknown Prompt, the only Lacuna: Unveiling CLIP's Potential for Open Domain Generalization
par: Singha, Mainak, et autres
Publié: (2024)