AVION: Aerial Vision-Language Instruction from Offline Teacher to Prompt-Tuned Network
Fuente:
arXiv
Guardado en:
| Autores principales: | Hu, Yu, Gu, Jianyang, Liu, Hao, Cao, Yue, Hamari, Jozsef, Liu, Zheng, Zardadi, Mohsen |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
On the Evaluation and Refinement of Vision-Language Instruction Tuning Datasets
por: Liao, Ning, et al.
Publicado: (2023)
por: Liao, Ning, et al.
Publicado: (2023)
Continual LLaVA: Continual Instruction Tuning in Large Vision-Language Models
por: Cao, Meng, et al.
Publicado: (2024)
por: Cao, Meng, et al.
Publicado: (2024)
MePT: Multi-Representation Guided Prompt Tuning for Vision-Language Model
por: Wang, Xinyang, et al.
Publicado: (2024)
por: Wang, Xinyang, et al.
Publicado: (2024)
Biomed-DPT: Dual Modality Prompt Tuning for Biomedical Vision-Language Models
por: Peng, Wei, et al.
Publicado: (2025)
por: Peng, Wei, et al.
Publicado: (2025)
Debiased Prompt Tuning in Vision-Language Model without Annotations
por: Jiang, Chaoquan, et al.
Publicado: (2025)
por: Jiang, Chaoquan, et al.
Publicado: (2025)
Prompt Tuning with Soft Context Sharing for Vision-Language Models
por: Ding, Kun, et al.
Publicado: (2022)
por: Ding, Kun, et al.
Publicado: (2022)
Robust Prompt Tuning for Vision-Language Models with Mild Semantic Noise
por: Gao, Yansheng, et al.
Publicado: (2025)
por: Gao, Yansheng, et al.
Publicado: (2025)
AntifakePrompt: Prompt-Tuned Vision-Language Models are Fake Image Detectors
por: Chang, You-Ming, et al.
Publicado: (2023)
por: Chang, You-Ming, et al.
Publicado: (2023)
Reflective Instruction Tuning: Mitigating Hallucinations in Large Vision-Language Models
por: Zhang, Jinrui, et al.
Publicado: (2024)
por: Zhang, Jinrui, et al.
Publicado: (2024)
DAP: Domain-aware Prompt Learning for Vision-and-Language Navigation
por: Liu, Ting, et al.
Publicado: (2023)
por: Liu, Ting, et al.
Publicado: (2023)
Efficient Prompt Tuning of Large Vision-Language Model for Fine-Grained Ship Classification
por: Lan, Long, et al.
Publicado: (2024)
por: Lan, Long, et al.
Publicado: (2024)
Adversarial Prompt Tuning for Vision-Language Models
por: Zhang, Jiaming, et al.
Publicado: (2023)
por: Zhang, Jiaming, et al.
Publicado: (2023)
Tuning Vision-Language Models with Candidate Labels by Prompt Alignment
por: Zhang, Zhifang, et al.
Publicado: (2024)
por: Zhang, Zhifang, et al.
Publicado: (2024)
Generalizable Prompt Tuning for Vision-Language Models
por: Zhang, Qian
Publicado: (2024)
por: Zhang, Qian
Publicado: (2024)
FedAPT: Federated Adversarial Prompt Tuning for Vision-Language Models
por: Zhai, Kun, et al.
Publicado: (2025)
por: Zhai, Kun, et al.
Publicado: (2025)
MoAPT: Mixture of Adversarial Prompt Tuning for Vision-Language Models
por: Zhao, Shiji, et al.
Publicado: (2025)
por: Zhao, Shiji, et al.
Publicado: (2025)
Instruction-Free Tuning of Large Vision Language Models for Medical Instruction Following
por: Kang, Myeongkyun, et al.
Publicado: (2026)
por: Kang, Myeongkyun, et al.
Publicado: (2026)
Towards Calibrating Prompt Tuning of Vision-Language Models
por: Sharifdeen, Ashshak, et al.
Publicado: (2026)
por: Sharifdeen, Ashshak, et al.
Publicado: (2026)
Adapting Vision-Language Models to Open Classes via Test-Time Prompt Tuning
por: Gao, Zhengqing, et al.
Publicado: (2024)
por: Gao, Zhengqing, et al.
Publicado: (2024)
Patch-Prompt Aligned Bayesian Prompt Tuning for Vision-Language Models
por: Liu, Xinyang, et al.
Publicado: (2023)
por: Liu, Xinyang, et al.
Publicado: (2023)
LookasideVLN: Direction-Aware Aerial Vision-and-Language Navigation
por: Ning, Yuwei, et al.
Publicado: (2026)
por: Ning, Yuwei, et al.
Publicado: (2026)
ModalPrompt: Towards Efficient Multimodal Continual Instruction Tuning with Dual-Modality Guided Prompt
por: Zeng, Fanhu, et al.
Publicado: (2024)
por: Zeng, Fanhu, et al.
Publicado: (2024)
Refer to Any Segmentation Mask Group With Vision-Language Prompts
por: Cao, Shengcao, et al.
Publicado: (2025)
por: Cao, Shengcao, et al.
Publicado: (2025)
Modeling Variants of Prompts for Vision-Language Models
por: Li, Ao, et al.
Publicado: (2025)
por: Li, Ao, et al.
Publicado: (2025)
INST-IT: Boosting Instance Understanding via Explicit Visual Prompt Instruction Tuning
por: Peng, Wujian, et al.
Publicado: (2024)
por: Peng, Wujian, et al.
Publicado: (2024)
Weak Distribution Detectors Lead to Stronger Generalizability of Vision-Language Prompt Tuning
por: Ding, Kun, et al.
Publicado: (2024)
por: Ding, Kun, et al.
Publicado: (2024)
Top-Down Compression: Revisit Efficient Vision Token Projection for Visual Instruction Tuning
por: li, Bonan, et al.
Publicado: (2025)
por: li, Bonan, et al.
Publicado: (2025)
An Image Is Worth 1000 Lies: Adversarial Transferability across Prompts on Vision-Language Models
por: Luo, Haochen, et al.
Publicado: (2024)
por: Luo, Haochen, et al.
Publicado: (2024)
Efficient Test-Time Prompt Tuning for Vision-Language Models
por: Zhu, Yuhan, et al.
Publicado: (2024)
por: Zhu, Yuhan, et al.
Publicado: (2024)
SemPT: Semantic Prompt Tuning for Vision-Language Models
por: Shi, Xiao, et al.
Publicado: (2025)
por: Shi, Xiao, et al.
Publicado: (2025)
NAP-Tuning: Neural Augmented Prompt Tuning for Adversarially Robust Vision-Language Models
por: Zhang, Jiaming, et al.
Publicado: (2025)
por: Zhang, Jiaming, et al.
Publicado: (2025)
InstructVLA: Vision-Language-Action Instruction Tuning from Understanding to Manipulation
por: Yang, Shuai, et al.
Publicado: (2025)
por: Yang, Shuai, et al.
Publicado: (2025)
LLM-empowered Dynamic Prompt Routing for Vision-Language Models Tuning under Long-Tailed Distributions
por: Jia, Yongju, et al.
Publicado: (2025)
por: Jia, Yongju, et al.
Publicado: (2025)
TuneVLSeg: Prompt Tuning Benchmark for Vision-Language Segmentation Models
por: Adhikari, Rabin, et al.
Publicado: (2024)
por: Adhikari, Rabin, et al.
Publicado: (2024)
TextRefiner: Internal Visual Feature as Efficient Refiner for Vision-Language Models Prompt Tuning
por: Xie, Jingjing, et al.
Publicado: (2024)
por: Xie, Jingjing, et al.
Publicado: (2024)
MMInstruct: A High-Quality Multi-Modal Instruction Tuning Dataset with Extensive Diversity
por: Liu, Yangzhou, et al.
Publicado: (2024)
por: Liu, Yangzhou, et al.
Publicado: (2024)
Hierarchical Cross-modal Prompt Learning for Vision-Language Models
por: Zheng, Hao, et al.
Publicado: (2025)
por: Zheng, Hao, et al.
Publicado: (2025)
Mixture of Cluster-conditional LoRA Experts for Vision-language Instruction Tuning
por: Gou, Yunhao, et al.
Publicado: (2023)
por: Gou, Yunhao, et al.
Publicado: (2023)
TAME: Test-Time Adversarial Prompt Tuning via Mixture-of-Experts for Vision-Language Models
por: Wang, Xin, et al.
Publicado: (2026)
por: Wang, Xin, et al.
Publicado: (2026)
DPC: Dual-Prompt Collaboration for Tuning Vision-Language Models
por: Li, Haoyang, et al.
Publicado: (2025)
por: Li, Haoyang, et al.
Publicado: (2025)
Ejemplares similares
-
On the Evaluation and Refinement of Vision-Language Instruction Tuning Datasets
por: Liao, Ning, et al.
Publicado: (2023) -
Continual LLaVA: Continual Instruction Tuning in Large Vision-Language Models
por: Cao, Meng, et al.
Publicado: (2024) -
MePT: Multi-Representation Guided Prompt Tuning for Vision-Language Model
por: Wang, Xinyang, et al.
Publicado: (2024) -
Biomed-DPT: Dual Modality Prompt Tuning for Biomedical Vision-Language Models
por: Peng, Wei, et al.
Publicado: (2025) -
Debiased Prompt Tuning in Vision-Language Model without Annotations
por: Jiang, Chaoquan, et al.
Publicado: (2025)