Low-rank Prompt Interaction for Continual Vision-Language Retrieval
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Yan, Weicai, Wang, Ye, Lin, Wang, Guo, Zirun, Zhao, Zhou, Jin, Tao |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Efficient Prompting for Continual Adaptation to Missing Modalities
par: Guo, Zirun, et autres
Publié: (2025)
par: Guo, Zirun, et autres
Publié: (2025)
Diff-Prompt: Diffusion-Driven Prompt Generator with Mask Supervision
par: Yan, Weicai, et autres
Publié: (2025)
par: Yan, Weicai, et autres
Publié: (2025)
Multimodal Prompt Learning with Missing Modalities for Sentiment Analysis and Emotion Recognition
par: Guo, Zirun, et autres
Publié: (2024)
par: Guo, Zirun, et autres
Publié: (2024)
ConceptGuard: Continual Personalized Text-to-Image Generation with Forgetting and Confusion Mitigation
par: Guo, Zirun, et autres
Publié: (2025)
par: Guo, Zirun, et autres
Publié: (2025)
A Wander Through the Multimodal Landscape: Efficient Transfer Learning via Low-rank Sequence Multimodal Adapter
par: Guo, Zirun, et autres
Publié: (2024)
par: Guo, Zirun, et autres
Publié: (2024)
Smoothing the Shift: Towards Stable Test-Time Adaptation under Complex Multimodal Noises
par: Guo, Zirun, et autres
Publié: (2025)
par: Guo, Zirun, et autres
Publié: (2025)
Classifier-guided Gradient Modulation for Enhanced Multimodal Learning
par: Guo, Zirun, et autres
Publié: (2024)
par: Guo, Zirun, et autres
Publié: (2024)
Thinking with Programming Vision: Towards a Unified View for Thinking with Images
par: Guo, Zirun, et autres
Publié: (2025)
par: Guo, Zirun, et autres
Publié: (2025)
Decoupling Stability and Plasticity for Multi-Modal Test-Time Adaptation
par: He, Yongbo, et autres
Publié: (2026)
par: He, Yongbo, et autres
Publié: (2026)
Text-Guided Multi-Scale Frequency Representation Adaptation
par: Yan, Weicai, et autres
Publié: (2026)
par: Yan, Weicai, et autres
Publié: (2026)
Observe-R1: Unlocking Reasoning Abilities of MLLMs with Dynamic Progressive Reinforcement Learning
par: Guo, Zirun, et autres
Publié: (2025)
par: Guo, Zirun, et autres
Publié: (2025)
Iterative Low-rank Network for Hyperspectral Image Denoising
par: Ye, Jin, et autres
Publié: (2025)
par: Ye, Jin, et autres
Publié: (2025)
LLM-I: LLMs are Naturally Interleaved Multimodal Creators
par: Guo, Zirun, et autres
Publié: (2025)
par: Guo, Zirun, et autres
Publié: (2025)
APO: Enhancing Reasoning Ability of MLLMs via Asymmetric Policy Optimization
par: Hong, Minjie, et autres
Publié: (2025)
par: Hong, Minjie, et autres
Publié: (2025)
HiSplat: Hierarchical 3D Gaussian Splatting for Generalizable Sparse-View Reconstruction
par: Tang, Shengji, et autres
Publié: (2024)
par: Tang, Shengji, et autres
Publié: (2024)
iGSP:Implicit Gradient Subspace Projection for Efficient Continual Learning of Vision-Language Models
par: Cui, Xuezhi, et autres
Publié: (2026)
par: Cui, Xuezhi, et autres
Publié: (2026)
Dual Prompt Learning for Adapting Vision-Language Models to Downstream Image-Text Retrieval
par: Wang, Yifan, et autres
Publié: (2025)
par: Wang, Yifan, et autres
Publié: (2025)
Beyond Low-Rank: Low-Rank Sparse Prompting via Spiking Neural Network and Prompt Factorization
par: Zhao, Yumiao, et autres
Publié: (2026)
par: Zhao, Yumiao, et autres
Publié: (2026)
LoR-VP: Low-Rank Visual Prompting for Efficient Vision Model Adaptation
par: Jin, Can, et autres
Publié: (2025)
par: Jin, Can, et autres
Publié: (2025)
Transitive Vision-Language Prompt Learning for Domain Generalization
par: Wang, Liyuan, et autres
Publié: (2024)
par: Wang, Liyuan, et autres
Publié: (2024)
Raw Data Matters: Enhancing Prompt Tuning by Internal Augmentation on Vision-Language Models
par: Li, Haoyang, et autres
Publié: (2025)
par: Li, Haoyang, et autres
Publié: (2025)
Model-agnostic Adversarial Attack and Defense for Vision-Language-Action Models
par: Xu, Haochuan, et autres
Publié: (2025)
par: Xu, Haochuan, et autres
Publié: (2025)
Progressive Vision-Language Prompt for Multi-Organ Multi-Class Cell Semantic Segmentation with Single Branch
par: Zhang, Qing, et autres
Publié: (2024)
par: Zhang, Qing, et autres
Publié: (2024)
Unsupervised Pre-training with Language-Vision Prompts for Low-Data Instance Segmentation
par: Zhang, Dingwen, et autres
Publié: (2024)
par: Zhang, Dingwen, et autres
Publié: (2024)
Effectively Enhancing Vision Language Large Models by Prompt Augmentation and Caption Utilization
par: Zhao, Minyi, et autres
Publié: (2024)
par: Zhao, Minyi, et autres
Publié: (2024)
FVG-PT: Adaptive Foreground View-Guided Prompt Tuning for Vision-Language Models
par: Li, Haoyang, et autres
Publié: (2026)
par: Li, Haoyang, et autres
Publié: (2026)
Low-Rank Continual Pyramid Vision Transformer: Incrementally Segment Whole-Body Organs in CT with Light-Weighted Adaptation
par: Zhu, Vince, et autres
Publié: (2024)
par: Zhu, Vince, et autres
Publié: (2024)
Cluster-Aware Neural Collapse Prompt Tuning for Long-Tailed Generalization of Vision-Language Models
par: Guo, Boyang, et autres
Publié: (2026)
par: Guo, Boyang, et autres
Publié: (2026)
Adversarial Prompt Distillation for Vision-Language Models
par: Luo, Lin, et autres
Publié: (2024)
par: Luo, Lin, et autres
Publié: (2024)
IAP: Improving Continual Learning of Vision-Language Models via Instance-Aware Prompting
par: Fu, Hao, et autres
Publié: (2025)
par: Fu, Hao, et autres
Publié: (2025)
Continual Retinal Vision-Language Pre-training upon Incremental Imaging Modalities
par: Yao, Yuang, et autres
Publié: (2025)
par: Yao, Yuang, et autres
Publié: (2025)
Modeling Variants of Prompts for Vision-Language Models
par: Li, Ao, et autres
Publié: (2025)
par: Li, Ao, et autres
Publié: (2025)
DynaSurfGS: Dynamic Surface Reconstruction with Planar-based Gaussian Splatting
par: Cai, Weiwei, et autres
Publié: (2024)
par: Cai, Weiwei, et autres
Publié: (2024)
LORS: Low-rank Residual Structure for Parameter-Efficient Network Stacking
par: Li, Jialin, et autres
Publié: (2024)
par: Li, Jialin, et autres
Publié: (2024)
Proact-VL: A Proactive VideoLLM for Real-Time AI Companions
par: Yan, Weicai, et autres
Publié: (2026)
par: Yan, Weicai, et autres
Publié: (2026)
DPC: Dual-Prompt Collaboration for Tuning Vision-Language Models
par: Li, Haoyang, et autres
Publié: (2025)
par: Li, Haoyang, et autres
Publié: (2025)
VPTracker: Global Vision-Language Tracking via Visual Prompt
par: Wang, Jingchao, et autres
Publié: (2025)
par: Wang, Jingchao, et autres
Publié: (2025)
IntLoRA: Integral Low-rank Adaptation of Quantized Diffusion Models
par: Guo, Hang, et autres
Publié: (2024)
par: Guo, Hang, et autres
Publié: (2024)
Cluster-Aware Prompt Ensemble Learning for Few-Shot Vision-Language Model Adaptation
par: Chen, Zhi, et autres
Publié: (2025)
par: Chen, Zhi, et autres
Publié: (2025)
StreetSurfGS: Scalable Urban Street Surface Reconstruction with Planar-based Gaussian Splatting
par: Cui, Xiao, et autres
Publié: (2024)
par: Cui, Xiao, et autres
Publié: (2024)
Documents similaires
-
Efficient Prompting for Continual Adaptation to Missing Modalities
par: Guo, Zirun, et autres
Publié: (2025) -
Diff-Prompt: Diffusion-Driven Prompt Generator with Mask Supervision
par: Yan, Weicai, et autres
Publié: (2025) -
Multimodal Prompt Learning with Missing Modalities for Sentiment Analysis and Emotion Recognition
par: Guo, Zirun, et autres
Publié: (2024) -
ConceptGuard: Continual Personalized Text-to-Image Generation with Forgetting and Confusion Mitigation
par: Guo, Zirun, et autres
Publié: (2025) -
A Wander Through the Multimodal Landscape: Efficient Transfer Learning via Low-rank Sequence Multimodal Adapter
par: Guo, Zirun, et autres
Publié: (2024)