Exploring Task-Level Optimal Prompts for Visual In-Context Learning
Fuente:
arXiv
Salvato in:
| Autori principali: | Zhu, Yan, Ma, Huan, Zhang, Changqing |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Visual Prompt Selection for In-Context Learning Segmentation
di: Suo, Wei, et al.
Pubblicazione: (2024)
di: Suo, Wei, et al.
Pubblicazione: (2024)
Progressive Homeostatic and Plastic Prompt Tuning for Audio-Visual Multi-Task Incremental Learning
di: Yin, Jiong, et al.
Pubblicazione: (2025)
di: Yin, Jiong, et al.
Pubblicazione: (2025)
Retrieval-Augmented Prompt for OOD Detection
di: Han, Ruisong, et al.
Pubblicazione: (2025)
di: Han, Ruisong, et al.
Pubblicazione: (2025)
ROCKET-1: Mastering Open-World Interaction with Visual-Temporal Context Prompting
di: Cai, Shaofei, et al.
Pubblicazione: (2024)
di: Cai, Shaofei, et al.
Pubblicazione: (2024)
Exploring Visual Prompting: Robustness Inheritance and Beyond
di: Li, Qi, et al.
Pubblicazione: (2025)
di: Li, Qi, et al.
Pubblicazione: (2025)
OLIVE: Object Level In-Context Visual Embeddings
di: Ossowski, Timothy, et al.
Pubblicazione: (2024)
di: Ossowski, Timothy, et al.
Pubblicazione: (2024)
True Multimodal In-Context Learning Needs Attention to the Visual Context
di: Chen, Shuo, et al.
Pubblicazione: (2025)
di: Chen, Shuo, et al.
Pubblicazione: (2025)
Exploring the Transferability of Visual Prompting for Multimodal Large Language Models
di: Zhang, Yichi, et al.
Pubblicazione: (2024)
di: Zhang, Yichi, et al.
Pubblicazione: (2024)
Generalizable Object Re-Identification via Visual In-Context Prompting
di: Huang, Zhizhong, et al.
Pubblicazione: (2025)
di: Huang, Zhizhong, et al.
Pubblicazione: (2025)
T2T-VICL: Unlocking the Boundaries of Cross-Task Visual In-Context Learning via Implicit Text-Driven VLMs
di: Xia, Shao-Jun, et al.
Pubblicazione: (2025)
di: Xia, Shao-Jun, et al.
Pubblicazione: (2025)
Visual Prompt Tuning in Null Space for Continual Learning
di: Lu, Yue, et al.
Pubblicazione: (2024)
di: Lu, Yue, et al.
Pubblicazione: (2024)
Mixture-of-Visual-Thoughts: Exploring Context-Adaptive Reasoning Mode Selection for General Visual Reasoning
di: Li, Zejun, et al.
Pubblicazione: (2025)
di: Li, Zejun, et al.
Pubblicazione: (2025)
Embedded Visual Prompt Tuning
di: Zu, Wenqiang, et al.
Pubblicazione: (2024)
di: Zu, Wenqiang, et al.
Pubblicazione: (2024)
Progressive Language-guided Visual Learning for Multi-Task Visual Grounding
di: Wang, Jingchao, et al.
Pubblicazione: (2025)
di: Wang, Jingchao, et al.
Pubblicazione: (2025)
PromptDx: Differentiable Prompt Tuning for Multimodal In-Context Alzheimer's Diagnosis
di: Zhong, Lujia, et al.
Pubblicazione: (2026)
di: Zhong, Lujia, et al.
Pubblicazione: (2026)
Understanding Cross Task Generalization in Handwriting-Based Alzheimer's Screening via Vision Language Adaptation
di: Gong, Changqing, et al.
Pubblicazione: (2025)
di: Gong, Changqing, et al.
Pubblicazione: (2025)
Multi-Level Bidirectional Biomimetic Learning for EEG-Based Visual Decoding
di: Liu, Jingtao, et al.
Pubblicazione: (2026)
di: Liu, Jingtao, et al.
Pubblicazione: (2026)
HumanEval-V: Benchmarking High-Level Visual Reasoning with Complex Diagrams in Coding Tasks
di: Zhang, Fengji, et al.
Pubblicazione: (2024)
di: Zhang, Fengji, et al.
Pubblicazione: (2024)
ID-like Prompt Learning for Few-Shot Out-of-Distribution Detection
di: Bai, Yichen, et al.
Pubblicazione: (2023)
di: Bai, Yichen, et al.
Pubblicazione: (2023)
Robust Driving QA through Metadata-Grounded Context and Task-Specific Prompts
di: Yu, Seungjun, et al.
Pubblicazione: (2025)
di: Yu, Seungjun, et al.
Pubblicazione: (2025)
P4Q: Learning to Prompt for Quantization in Visual-language Models
di: Sun, Huixin, et al.
Pubblicazione: (2024)
di: Sun, Huixin, et al.
Pubblicazione: (2024)
HCVP: Leveraging Hierarchical Contrastive Visual Prompt for Domain Generalization
di: Zhou, Guanglin, et al.
Pubblicazione: (2024)
di: Zhou, Guanglin, et al.
Pubblicazione: (2024)
Spurious Feature Eraser: Stabilizing Test-Time Adaptation for Vision-Language Foundation Model
di: Ma, Huan, et al.
Pubblicazione: (2024)
di: Ma, Huan, et al.
Pubblicazione: (2024)
Ref-Adv: Exploring MLLM Visual Reasoning in Referring Expression Tasks
di: Dong, Qihua, et al.
Pubblicazione: (2026)
di: Dong, Qihua, et al.
Pubblicazione: (2026)
Task-Specific Adaptation of Segmentation Foundation Model via Prompt Learning
di: Kim, Hyung-Il, et al.
Pubblicazione: (2024)
di: Kim, Hyung-Il, et al.
Pubblicazione: (2024)
Retrieving Counterfactuals Improves Visual In-Context Learning
di: Xiong, Guangzhi, et al.
Pubblicazione: (2026)
di: Xiong, Guangzhi, et al.
Pubblicazione: (2026)
Aquila-plus: Prompt-Driven Visual-Language Models for Pixel-Level Remote Sensing Image Understanding
di: Lu, Kaixuan
Pubblicazione: (2024)
di: Lu, Kaixuan
Pubblicazione: (2024)
Visual Instance-aware Prompt Tuning
di: Xiao, Xi, et al.
Pubblicazione: (2025)
di: Xiao, Xi, et al.
Pubblicazione: (2025)
Object-level Visual Prompts for Compositional Image Generation
di: Parmar, Gaurav, et al.
Pubblicazione: (2025)
di: Parmar, Gaurav, et al.
Pubblicazione: (2025)
Merging Context Clustering with Visual State Space Models for Medical Image Segmentation
di: Zhu, Yun, et al.
Pubblicazione: (2025)
di: Zhu, Yun, et al.
Pubblicazione: (2025)
Region-Level Context-Aware Multimodal Understanding
di: Wei, Hongliang, et al.
Pubblicazione: (2025)
di: Wei, Hongliang, et al.
Pubblicazione: (2025)
Prompt-Aware Adapter: Towards Learning Adaptive Visual Tokens for Multimodal Large Language Models
di: Zhang, Yue, et al.
Pubblicazione: (2024)
di: Zhang, Yue, et al.
Pubblicazione: (2024)
Visual Grounding for Object-Level Generalization in Reinforcement Learning
di: Jiang, Haobin, et al.
Pubblicazione: (2024)
di: Jiang, Haobin, et al.
Pubblicazione: (2024)
Visual Fourier Prompt Tuning
di: Zeng, Runjia, et al.
Pubblicazione: (2024)
di: Zeng, Runjia, et al.
Pubblicazione: (2024)
Prompt Tuning with Soft Context Sharing for Vision-Language Models
di: Ding, Kun, et al.
Pubblicazione: (2022)
di: Ding, Kun, et al.
Pubblicazione: (2022)
Visual Position Prompt for MLLM based Visual Grounding
di: Tang, Wei, et al.
Pubblicazione: (2025)
di: Tang, Wei, et al.
Pubblicazione: (2025)
RewardMap: Tackling Sparse Rewards in Fine-grained Visual Reasoning via Multi-Stage Reinforcement Learning
di: Feng, Sicheng, et al.
Pubblicazione: (2025)
di: Feng, Sicheng, et al.
Pubblicazione: (2025)
High-Quality Pseudo-Label Generation Based on Visual Prompt Assisted Cloud Model Update
di: Xu, Xinrun, et al.
Pubblicazione: (2025)
di: Xu, Xinrun, et al.
Pubblicazione: (2025)
Decouple before Align: Visual Disentanglement Enhances Prompt Tuning
di: Zhang, Fei, et al.
Pubblicazione: (2025)
di: Zhang, Fei, et al.
Pubblicazione: (2025)
From Trial to Triumph: Advancing Long Video Understanding via Visual Context Sample Scaling and Self-reward Alignment
di: Suo, Yucheng, et al.
Pubblicazione: (2025)
di: Suo, Yucheng, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Visual Prompt Selection for In-Context Learning Segmentation
di: Suo, Wei, et al.
Pubblicazione: (2024) -
Progressive Homeostatic and Plastic Prompt Tuning for Audio-Visual Multi-Task Incremental Learning
di: Yin, Jiong, et al.
Pubblicazione: (2025) -
Retrieval-Augmented Prompt for OOD Detection
di: Han, Ruisong, et al.
Pubblicazione: (2025) -
ROCKET-1: Mastering Open-World Interaction with Visual-Temporal Context Prompting
di: Cai, Shaofei, et al.
Pubblicazione: (2024) -
Exploring Visual Prompting: Robustness Inheritance and Beyond
di: Li, Qi, et al.
Pubblicazione: (2025)