AVION: Aerial Vision-Language Instruction from Offline Teacher to Prompt-Tuned Network
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Hu, Yu, Gu, Jianyang, Liu, Hao, Cao, Yue, Hamari, Jozsef, Liu, Zheng, Zardadi, Mohsen |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2026
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
On the Evaluation and Refinement of Vision-Language Instruction Tuning Datasets
von: Liao, Ning, et al.
Veröffentlicht: (2023)
von: Liao, Ning, et al.
Veröffentlicht: (2023)
Continual LLaVA: Continual Instruction Tuning in Large Vision-Language Models
von: Cao, Meng, et al.
Veröffentlicht: (2024)
von: Cao, Meng, et al.
Veröffentlicht: (2024)
MePT: Multi-Representation Guided Prompt Tuning for Vision-Language Model
von: Wang, Xinyang, et al.
Veröffentlicht: (2024)
von: Wang, Xinyang, et al.
Veröffentlicht: (2024)
Biomed-DPT: Dual Modality Prompt Tuning for Biomedical Vision-Language Models
von: Peng, Wei, et al.
Veröffentlicht: (2025)
von: Peng, Wei, et al.
Veröffentlicht: (2025)
Debiased Prompt Tuning in Vision-Language Model without Annotations
von: Jiang, Chaoquan, et al.
Veröffentlicht: (2025)
von: Jiang, Chaoquan, et al.
Veröffentlicht: (2025)
Prompt Tuning with Soft Context Sharing for Vision-Language Models
von: Ding, Kun, et al.
Veröffentlicht: (2022)
von: Ding, Kun, et al.
Veröffentlicht: (2022)
Robust Prompt Tuning for Vision-Language Models with Mild Semantic Noise
von: Gao, Yansheng, et al.
Veröffentlicht: (2025)
von: Gao, Yansheng, et al.
Veröffentlicht: (2025)
AntifakePrompt: Prompt-Tuned Vision-Language Models are Fake Image Detectors
von: Chang, You-Ming, et al.
Veröffentlicht: (2023)
von: Chang, You-Ming, et al.
Veröffentlicht: (2023)
Reflective Instruction Tuning: Mitigating Hallucinations in Large Vision-Language Models
von: Zhang, Jinrui, et al.
Veröffentlicht: (2024)
von: Zhang, Jinrui, et al.
Veröffentlicht: (2024)
DAP: Domain-aware Prompt Learning for Vision-and-Language Navigation
von: Liu, Ting, et al.
Veröffentlicht: (2023)
von: Liu, Ting, et al.
Veröffentlicht: (2023)
Efficient Prompt Tuning of Large Vision-Language Model for Fine-Grained Ship Classification
von: Lan, Long, et al.
Veröffentlicht: (2024)
von: Lan, Long, et al.
Veröffentlicht: (2024)
Adversarial Prompt Tuning for Vision-Language Models
von: Zhang, Jiaming, et al.
Veröffentlicht: (2023)
von: Zhang, Jiaming, et al.
Veröffentlicht: (2023)
Tuning Vision-Language Models with Candidate Labels by Prompt Alignment
von: Zhang, Zhifang, et al.
Veröffentlicht: (2024)
von: Zhang, Zhifang, et al.
Veröffentlicht: (2024)
Generalizable Prompt Tuning for Vision-Language Models
von: Zhang, Qian
Veröffentlicht: (2024)
von: Zhang, Qian
Veröffentlicht: (2024)
FedAPT: Federated Adversarial Prompt Tuning for Vision-Language Models
von: Zhai, Kun, et al.
Veröffentlicht: (2025)
von: Zhai, Kun, et al.
Veröffentlicht: (2025)
MoAPT: Mixture of Adversarial Prompt Tuning for Vision-Language Models
von: Zhao, Shiji, et al.
Veröffentlicht: (2025)
von: Zhao, Shiji, et al.
Veröffentlicht: (2025)
Instruction-Free Tuning of Large Vision Language Models for Medical Instruction Following
von: Kang, Myeongkyun, et al.
Veröffentlicht: (2026)
von: Kang, Myeongkyun, et al.
Veröffentlicht: (2026)
Towards Calibrating Prompt Tuning of Vision-Language Models
von: Sharifdeen, Ashshak, et al.
Veröffentlicht: (2026)
von: Sharifdeen, Ashshak, et al.
Veröffentlicht: (2026)
Adapting Vision-Language Models to Open Classes via Test-Time Prompt Tuning
von: Gao, Zhengqing, et al.
Veröffentlicht: (2024)
von: Gao, Zhengqing, et al.
Veröffentlicht: (2024)
Patch-Prompt Aligned Bayesian Prompt Tuning for Vision-Language Models
von: Liu, Xinyang, et al.
Veröffentlicht: (2023)
von: Liu, Xinyang, et al.
Veröffentlicht: (2023)
LookasideVLN: Direction-Aware Aerial Vision-and-Language Navigation
von: Ning, Yuwei, et al.
Veröffentlicht: (2026)
von: Ning, Yuwei, et al.
Veröffentlicht: (2026)
ModalPrompt: Towards Efficient Multimodal Continual Instruction Tuning with Dual-Modality Guided Prompt
von: Zeng, Fanhu, et al.
Veröffentlicht: (2024)
von: Zeng, Fanhu, et al.
Veröffentlicht: (2024)
Refer to Any Segmentation Mask Group With Vision-Language Prompts
von: Cao, Shengcao, et al.
Veröffentlicht: (2025)
von: Cao, Shengcao, et al.
Veröffentlicht: (2025)
Modeling Variants of Prompts for Vision-Language Models
von: Li, Ao, et al.
Veröffentlicht: (2025)
von: Li, Ao, et al.
Veröffentlicht: (2025)
INST-IT: Boosting Instance Understanding via Explicit Visual Prompt Instruction Tuning
von: Peng, Wujian, et al.
Veröffentlicht: (2024)
von: Peng, Wujian, et al.
Veröffentlicht: (2024)
Weak Distribution Detectors Lead to Stronger Generalizability of Vision-Language Prompt Tuning
von: Ding, Kun, et al.
Veröffentlicht: (2024)
von: Ding, Kun, et al.
Veröffentlicht: (2024)
Top-Down Compression: Revisit Efficient Vision Token Projection for Visual Instruction Tuning
von: li, Bonan, et al.
Veröffentlicht: (2025)
von: li, Bonan, et al.
Veröffentlicht: (2025)
An Image Is Worth 1000 Lies: Adversarial Transferability across Prompts on Vision-Language Models
von: Luo, Haochen, et al.
Veröffentlicht: (2024)
von: Luo, Haochen, et al.
Veröffentlicht: (2024)
Efficient Test-Time Prompt Tuning for Vision-Language Models
von: Zhu, Yuhan, et al.
Veröffentlicht: (2024)
von: Zhu, Yuhan, et al.
Veröffentlicht: (2024)
SemPT: Semantic Prompt Tuning for Vision-Language Models
von: Shi, Xiao, et al.
Veröffentlicht: (2025)
von: Shi, Xiao, et al.
Veröffentlicht: (2025)
NAP-Tuning: Neural Augmented Prompt Tuning for Adversarially Robust Vision-Language Models
von: Zhang, Jiaming, et al.
Veröffentlicht: (2025)
von: Zhang, Jiaming, et al.
Veröffentlicht: (2025)
InstructVLA: Vision-Language-Action Instruction Tuning from Understanding to Manipulation
von: Yang, Shuai, et al.
Veröffentlicht: (2025)
von: Yang, Shuai, et al.
Veröffentlicht: (2025)
LLM-empowered Dynamic Prompt Routing for Vision-Language Models Tuning under Long-Tailed Distributions
von: Jia, Yongju, et al.
Veröffentlicht: (2025)
von: Jia, Yongju, et al.
Veröffentlicht: (2025)
TuneVLSeg: Prompt Tuning Benchmark for Vision-Language Segmentation Models
von: Adhikari, Rabin, et al.
Veröffentlicht: (2024)
von: Adhikari, Rabin, et al.
Veröffentlicht: (2024)
TextRefiner: Internal Visual Feature as Efficient Refiner for Vision-Language Models Prompt Tuning
von: Xie, Jingjing, et al.
Veröffentlicht: (2024)
von: Xie, Jingjing, et al.
Veröffentlicht: (2024)
MMInstruct: A High-Quality Multi-Modal Instruction Tuning Dataset with Extensive Diversity
von: Liu, Yangzhou, et al.
Veröffentlicht: (2024)
von: Liu, Yangzhou, et al.
Veröffentlicht: (2024)
Hierarchical Cross-modal Prompt Learning for Vision-Language Models
von: Zheng, Hao, et al.
Veröffentlicht: (2025)
von: Zheng, Hao, et al.
Veröffentlicht: (2025)
Mixture of Cluster-conditional LoRA Experts for Vision-language Instruction Tuning
von: Gou, Yunhao, et al.
Veröffentlicht: (2023)
von: Gou, Yunhao, et al.
Veröffentlicht: (2023)
TAME: Test-Time Adversarial Prompt Tuning via Mixture-of-Experts for Vision-Language Models
von: Wang, Xin, et al.
Veröffentlicht: (2026)
von: Wang, Xin, et al.
Veröffentlicht: (2026)
DPC: Dual-Prompt Collaboration for Tuning Vision-Language Models
von: Li, Haoyang, et al.
Veröffentlicht: (2025)
von: Li, Haoyang, et al.
Veröffentlicht: (2025)
Ähnliche Einträge
-
On the Evaluation and Refinement of Vision-Language Instruction Tuning Datasets
von: Liao, Ning, et al.
Veröffentlicht: (2023) -
Continual LLaVA: Continual Instruction Tuning in Large Vision-Language Models
von: Cao, Meng, et al.
Veröffentlicht: (2024) -
MePT: Multi-Representation Guided Prompt Tuning for Vision-Language Model
von: Wang, Xinyang, et al.
Veröffentlicht: (2024) -
Biomed-DPT: Dual Modality Prompt Tuning for Biomedical Vision-Language Models
von: Peng, Wei, et al.
Veröffentlicht: (2025) -
Debiased Prompt Tuning in Vision-Language Model without Annotations
von: Jiang, Chaoquan, et al.
Veröffentlicht: (2025)