LION: Implicit Vision Prompt Tuning
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Wang, Haixin, Chang, Jianlong, Luo, Xiao, Sun, Jinan, Lin, Zhouchen, Tian, Qi |
|---|---|
| Format: | Preprint |
| Publié: |
2023
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Parameter-efficient Tuning of Large-scale Multimodal Foundation Model
par: Wang, Haixin, et autres
Publié: (2023)
par: Wang, Haixin, et autres
Publié: (2023)
Visual Tuning
par: Yu, Bruce X. B., et autres
Publié: (2023)
par: Yu, Bruce X. B., et autres
Publié: (2023)
A Survey on Video Temporal Grounding with Multimodal Large Language Model
par: Wu, Jianlong, et autres
Publié: (2025)
par: Wu, Jianlong, et autres
Publié: (2025)
MegaSR: Mining Customized Semantics and Expressive Guidance for Real-World Image Super-Resolution
par: Li, Xinrui, et autres
Publié: (2025)
par: Li, Xinrui, et autres
Publié: (2025)
Expectation-Maximization Attention Networks for Semantic Segmentation
par: Li, Xia, et autres
Publié: (2019)
par: Li, Xia, et autres
Publié: (2019)
AntifakePrompt: Prompt-Tuned Vision-Language Models are Fake Image Detectors
par: Chang, You-Ming, et autres
Publié: (2023)
par: Chang, You-Ming, et autres
Publié: (2023)
PromptFix: You Prompt and We Fix the Photo
par: Yu, Yongsheng, et autres
Publié: (2024)
par: Yu, Yongsheng, et autres
Publié: (2024)
SemPT: Semantic Prompt Tuning for Vision-Language Models
par: Shi, Xiao, et autres
Publié: (2025)
par: Shi, Xiao, et autres
Publié: (2025)
LION: Linear Group RNN for 3D Object Detection in Point Clouds
par: Liu, Zhe, et autres
Publié: (2024)
par: Liu, Zhe, et autres
Publié: (2024)
ArGue: Attribute-Guided Prompt Tuning for Vision-Language Models
par: Tian, Xinyu, et autres
Publié: (2023)
par: Tian, Xinyu, et autres
Publié: (2023)
UniLION: Towards Unified Autonomous Driving Model with Linear Group RNNs
par: Liu, Zhe, et autres
Publié: (2025)
par: Liu, Zhe, et autres
Publié: (2025)
Intrinsic Gradient Suppression for Label-Noise Prompt Tuning in Vision-Language Models
par: Li, Jiayu, et autres
Publié: (2026)
par: Li, Jiayu, et autres
Publié: (2026)
Learning Position-Aware Implicit Neural Network for Real-World Face Inpainting
par: Zhao, Bo, et autres
Publié: (2024)
par: Zhao, Bo, et autres
Publié: (2024)
LION-FS: Fast & Slow Video-Language Thinker as Online Video Assistant
par: Li, Wei, et autres
Publié: (2025)
par: Li, Wei, et autres
Publié: (2025)
MLAE: Masked LoRA Experts for Visual Parameter-Efficient Fine-Tuning
par: Wang, Junjie, et autres
Publié: (2024)
par: Wang, Junjie, et autres
Publié: (2024)
Visual Variational Autoencoder Prompt Tuning
par: Xiao, Xi, et autres
Publié: (2025)
par: Xiao, Xi, et autres
Publié: (2025)
Generalizable Prompt Tuning for Vision-Language Models
par: Zhang, Qian
Publié: (2024)
par: Zhang, Qian
Publié: (2024)
AOEPT: Breaking the Implicit Modality-Reduction Bottleneck in Modality-Missing Prompt Tuning
par: Lang, Jian, et autres
Publié: (2026)
par: Lang, Jian, et autres
Publié: (2026)
FVG-PT: Adaptive Foreground View-Guided Prompt Tuning for Vision-Language Models
par: Li, Haoyang, et autres
Publié: (2026)
par: Li, Haoyang, et autres
Publié: (2026)
Efficient Test-Time Prompt Tuning for Vision-Language Models
par: Zhu, Yuhan, et autres
Publié: (2024)
par: Zhu, Yuhan, et autres
Publié: (2024)
Robust Prompt Tuning for Vision-Language Models with Mild Semantic Noise
par: Gao, Yansheng, et autres
Publié: (2025)
par: Gao, Yansheng, et autres
Publié: (2025)
Reasoning to Align: Implicit Reasoning in Diffusion Transformers for Video Editing
par: Li, Yan, et autres
Publié: (2026)
par: Li, Yan, et autres
Publié: (2026)
Towards Calibrating Prompt Tuning of Vision-Language Models
par: Sharifdeen, Ashshak, et autres
Publié: (2026)
par: Sharifdeen, Ashshak, et autres
Publié: (2026)
DA-VPT: Semantic-Guided Visual Prompt Tuning for Vision Transformers
par: Ren, Li, et autres
Publié: (2025)
par: Ren, Li, et autres
Publié: (2025)
Adapting Vision-Language Models to Open Classes via Test-Time Prompt Tuning
par: Gao, Zhengqing, et autres
Publié: (2024)
par: Gao, Zhengqing, et autres
Publié: (2024)
Adversarial Prompt Tuning for Vision-Language Models
par: Zhang, Jiaming, et autres
Publié: (2023)
par: Zhang, Jiaming, et autres
Publié: (2023)
DPC: Dual-Prompt Collaboration for Tuning Vision-Language Models
par: Li, Haoyang, et autres
Publié: (2025)
par: Li, Haoyang, et autres
Publié: (2025)
Implicit Neural Representation Facilitates Unified Universal Vision Encoding
par: Gwilliam, Matthew, et autres
Publié: (2026)
par: Gwilliam, Matthew, et autres
Publié: (2026)
Bootstrap Fine-Grained Vision-Language Alignment for Unified Zero-Shot Anomaly Localization
par: Deng, Hanqiu, et autres
Publié: (2023)
par: Deng, Hanqiu, et autres
Publié: (2023)
TuneVLSeg: Prompt Tuning Benchmark for Vision-Language Segmentation Models
par: Adhikari, Rabin, et autres
Publié: (2024)
par: Adhikari, Rabin, et autres
Publié: (2024)
OpenDance: Multimodal Controllable 3D Dance Generation with Large-scale Internet Data
par: Zhang, Jinlu, et autres
Publié: (2025)
par: Zhang, Jinlu, et autres
Publié: (2025)
Debiased Fine-Tuning for Vision-language Models by Prompt Regularization
par: Zhu, Beier, et autres
Publié: (2023)
par: Zhu, Beier, et autres
Publié: (2023)
Debiased Prompt Tuning in Vision-Language Model without Annotations
par: Jiang, Chaoquan, et autres
Publié: (2025)
par: Jiang, Chaoquan, et autres
Publié: (2025)
Weak Distribution Detectors Lead to Stronger Generalizability of Vision-Language Prompt Tuning
par: Ding, Kun, et autres
Publié: (2024)
par: Ding, Kun, et autres
Publié: (2024)
MePT: Multi-Representation Guided Prompt Tuning for Vision-Language Model
par: Wang, Xinyang, et autres
Publié: (2024)
par: Wang, Xinyang, et autres
Publié: (2024)
Cluster-Aware Neural Collapse Prompt Tuning for Long-Tailed Generalization of Vision-Language Models
par: Guo, Boyang, et autres
Publié: (2026)
par: Guo, Boyang, et autres
Publié: (2026)
Raw Data Matters: Enhancing Prompt Tuning by Internal Augmentation on Vision-Language Models
par: Li, Haoyang, et autres
Publié: (2025)
par: Li, Haoyang, et autres
Publié: (2025)
TAPT: Test-Time Adversarial Prompt Tuning for Robust Inference in Vision-Language Models
par: Wang, Xin, et autres
Publié: (2024)
par: Wang, Xin, et autres
Publié: (2024)
Facing the Elephant in the Room: Visual Prompt Tuning or Full Finetuning?
par: Han, Cheng, et autres
Publié: (2024)
par: Han, Cheng, et autres
Publié: (2024)
MoAPT: Mixture of Adversarial Prompt Tuning for Vision-Language Models
par: Zhao, Shiji, et autres
Publié: (2025)
par: Zhao, Shiji, et autres
Publié: (2025)
Documents similaires
-
Parameter-efficient Tuning of Large-scale Multimodal Foundation Model
par: Wang, Haixin, et autres
Publié: (2023) -
Visual Tuning
par: Yu, Bruce X. B., et autres
Publié: (2023) -
A Survey on Video Temporal Grounding with Multimodal Large Language Model
par: Wu, Jianlong, et autres
Publié: (2025) -
MegaSR: Mining Customized Semantics and Expressive Guidance for Real-World Image Super-Resolution
par: Li, Xinrui, et autres
Publié: (2025) -
Expectation-Maximization Attention Networks for Semantic Segmentation
par: Li, Xia, et autres
Publié: (2019)