From Generalist to Specialist: Adapting Vision Language Models via Task-Specific Visual Instruction Tuning
Fuente:
arXiv
Saved in:
| Main Authors: | Bai, Yang, Zhou, Yang, Zhou, Jun, Goh, Rick Siow Mong, Ting, Daniel Shu Wei, Liu, Yong |
|---|---|
| Format: | Preprint |
| Published: |
2024
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
MaskedCLIP: Bridging the Masked and CLIP Space for Semi-Supervised Medical Vision-Language Pre-training
by: Zhu, Lei, et al.
Published: (2025)
by: Zhu, Lei, et al.
Published: (2025)
Aligning Medical Conversational AI through Online Reinforcement Learning with Information-Theoretic Rewards
by: Verma, Tanvi, et al.
Published: (2026)
by: Verma, Tanvi, et al.
Published: (2026)
AdvMIM: Adversarial Masked Image Modeling for Semi-Supervised Medical Image Segmentation
by: Zhu, Lei, et al.
Published: (2025)
by: Zhu, Lei, et al.
Published: (2025)
BenchX: A Unified Benchmark Framework for Medical Vision-Language Pretraining on Chest X-Rays
by: Zhou, Yang, et al.
Published: (2024)
by: Zhou, Yang, et al.
Published: (2024)
How Interpretable are Reasoning Explanations from Prompting Large Language Models?
by: Yeo, Wei Jie, et al.
Published: (2024)
by: Yeo, Wei Jie, et al.
Published: (2024)
UrFound: Towards Universal Retinal Foundation Models via Knowledge-Guided Masked Modeling
by: Yu, Kai, et al.
Published: (2024)
by: Yu, Kai, et al.
Published: (2024)
Look Back for More: Harnessing Historical Sequential Updates for Personalized Federated Adapter Tuning
by: Peng, Danni, et al.
Published: (2025)
by: Peng, Danni, et al.
Published: (2025)
BriDe Arbitrager: Enhancing Arbitrage in Ethereum 2.0 via Bribery-enabled Delayed Block Production
by: Yang, Hulin, et al.
Published: (2024)
by: Yang, Hulin, et al.
Published: (2024)
AiRacleX: Automated Detection of Price Oracle Manipulations via LLM-Driven Knowledge Mining and Prompt Generation
by: Gao, Bo, et al.
Published: (2025)
by: Gao, Bo, et al.
Published: (2025)
An Aggregation-Free Federated Learning for Tackling Data Heterogeneity
by: Wang, Yuan, et al.
Published: (2024)
by: Wang, Yuan, et al.
Published: (2024)
Atomic Smart Contract Interoperability with High Efficiency via Cross-Chain Integrated Execution
by: Yin, Chaoyue, et al.
Published: (2025)
by: Yin, Chaoyue, et al.
Published: (2025)
Structured Semantic Cloaking for Jailbreak Attacks on Large Language Models
by: Sun, Xiaobing, et al.
Published: (2026)
by: Sun, Xiaobing, et al.
Published: (2026)
CPT: Consistent Proxy Tuning for Black-box Optimization
by: He, Yuanyang, et al.
Published: (2024)
by: He, Yuanyang, et al.
Published: (2024)
Improving Learning of New Diseases through Knowledge-Enhanced Initialization for Federated Adapter Tuning
by: Peng, Danni, et al.
Published: (2025)
by: Peng, Danni, et al.
Published: (2025)
Partially Supervised Unpaired Multi-Modal Learning for Label-Efficient Medical Image Segmentation
by: Zhu, Lei, et al.
Published: (2025)
by: Zhu, Lei, et al.
Published: (2025)
Secure and Explainable Fraud Detection in Finance via Hierarchical Multi-source Dataset Distillation
by: Qian, Yiming, et al.
Published: (2025)
by: Qian, Yiming, et al.
Published: (2025)
Enhancing Community Vision Screening -- AI Driven Retinal Photography for Early Disease Detection and Patient Trust
by: Lei, Xiaofeng, et al.
Published: (2024)
by: Lei, Xiaofeng, et al.
Published: (2024)
Semi-rPPG: Semi-Supervised Remote Physiological Measurement with Curriculum Pseudo-Labeling
by: Wu, Bingjie, et al.
Published: (2025)
by: Wu, Bingjie, et al.
Published: (2025)
Enabling Energy-Efficient Deployment of Large Language Models on Memristor Crossbar: A Synergy of Large and Small
by: Wang, Zhehui, et al.
Published: (2024)
by: Wang, Zhehui, et al.
Published: (2024)
From Generalist to Specialist: Exploring CWE-Specific Vulnerability Detection
by: Atiiq, Syafiq Al, et al.
Published: (2024)
by: Atiiq, Syafiq Al, et al.
Published: (2024)
Table-Lookup MAC: Scalable Processing of Quantised Neural Networks in FPGA Soft Logic
by: Gerlinghoff, Daniel, et al.
Published: (2024)
by: Gerlinghoff, Daniel, et al.
Published: (2024)
Generalist versus Specialist Vision Foundation Models for Ocular Disease and Oculomics
by: Zhou, Yukun, et al.
Published: (2025)
by: Zhou, Yukun, et al.
Published: (2025)
Learning A Low-Level Vision Generalist via Visual Task Prompt
by: Chen, Xiangyu, et al.
Published: (2024)
by: Chen, Xiangyu, et al.
Published: (2024)
From Generalist to Specialist: A Survey of Large Language Models for Chemistry
by: Han, Yang, et al.
Published: (2024)
by: Han, Yang, et al.
Published: (2024)
Reliable segmentation of multiple lesions from medical images
by: Meng Wang, et al.
Published: (2024)
by: Meng Wang, et al.
Published: (2024)
DPxFin: Adaptive Differential Privacy for Anti-Money Laundering Detection via Reputation-Weighted Federated Learning
by: Kanagavelu, Renuga, et al.
Published: (2026)
by: Kanagavelu, Renuga, et al.
Published: (2026)
From Generalist to Specialist Representation
by: Zheng, Yujia, et al.
Published: (2026)
by: Zheng, Yujia, et al.
Published: (2026)
Learning Prompt with Distribution-Based Feature Replay for Few-Shot Class-Incremental Learning
by: Huang, Zitong, et al.
Published: (2024)
by: Huang, Zitong, et al.
Published: (2024)
Text to Image for Multi-Label Image Recognition with Joint Prompt-Adapter Learning
by: Feng, Chun-Mei, et al.
Published: (2025)
by: Feng, Chun-Mei, et al.
Published: (2025)
Optimizing Neural Networks with Learnable Non-Linear Activation Functions via Lookup-Based FPGA Acceleration
by: Yin, Mengyuan, et al.
Published: (2025)
by: Yin, Mengyuan, et al.
Published: (2025)
PathoTune: Adapting Visual Foundation Model to Pathological Specialists
by: Lu, Jiaxuan, et al.
Published: (2024)
by: Lu, Jiaxuan, et al.
Published: (2024)
Class Balance Matters to Active Class-Incremental Learning
by: Huang, Zitong, et al.
Published: (2024)
by: Huang, Zitong, et al.
Published: (2024)
Federated Uncertainty-Aware Aggregation for Fundus Diabetic Retinopathy Staging
by: Wang, Meng, et al.
Published: (2023)
by: Wang, Meng, et al.
Published: (2023)
AdaptVision: Efficient Vision-Language Models via Adaptive Visual Acquisition
by: Lin, Zichuan, et al.
Published: (2025)
by: Lin, Zichuan, et al.
Published: (2025)
Contrasting the Relative Importance of Microbial Generalists and Specialists in Maintaining Assembly Processes and Community Stability
by: Xiaohong Niu, et al.
Published: (2025)
by: Xiaohong Niu, et al.
Published: (2025)
BiomedGPT: A Generalist Vision-Language Foundation Model for Diverse Biomedical Tasks
by: Zhang, Kai, et al.
Published: (2023)
by: Zhang, Kai, et al.
Published: (2023)
Is Quantum Optimization Ready? An Effort Towards Neural Network Compression using Adiabatic Quantum Computing
by: Wang, Zhehui, et al.
Published: (2025)
by: Wang, Zhehui, et al.
Published: (2025)
A New Perspective to Boost Performance Fairness for Medical Federated Learning
by: Yan, Yunlu, et al.
Published: (2024)
by: Yan, Yunlu, et al.
Published: (2024)
SkyEyeGPT: Unifying Remote Sensing Vision-Language Tasks via Instruction Tuning with Large Language Model
by: Zhan, Yang, et al.
Published: (2024)
by: Zhan, Yang, et al.
Published: (2024)
History-Aware and Dynamic Client Contribution in Federated Learning
by: Ghosh, Bishwamittra, et al.
Published: (2024)
by: Ghosh, Bishwamittra, et al.
Published: (2024)
Similar Items
-
MaskedCLIP: Bridging the Masked and CLIP Space for Semi-Supervised Medical Vision-Language Pre-training
by: Zhu, Lei, et al.
Published: (2025) -
Aligning Medical Conversational AI through Online Reinforcement Learning with Information-Theoretic Rewards
by: Verma, Tanvi, et al.
Published: (2026) -
AdvMIM: Adversarial Masked Image Modeling for Semi-Supervised Medical Image Segmentation
by: Zhu, Lei, et al.
Published: (2025) -
BenchX: A Unified Benchmark Framework for Medical Vision-Language Pretraining on Chest X-Rays
by: Zhou, Yang, et al.
Published: (2024) -
How Interpretable are Reasoning Explanations from Prompting Large Language Models?
by: Yeo, Wei Jie, et al.
Published: (2024)