M$^2$PT: Multimodal Prompt Tuning for Zero-shot Instruction Learning
Fuente:
arXiv
Salvato in:
| Autori principali: | Wang, Taowen, Liu, Yiyang, Liang, James Chenhao, zhao, junhan, Cui, Yiming, Mao, Yuning, Nie, Shaoliang, Liu, Jiahao, Feng, Fuli, Xu, Zenglin, Han, Cheng, Huang, Lifu, Wang, Qifan, Liu, Dongfang |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Re-Imagining Multimodal Instruction Tuning: A Representation View
di: Liu, Yiyang, et al.
Pubblicazione: (2025)
di: Liu, Yiyang, et al.
Pubblicazione: (2025)
Facing the Elephant in the Room: Visual Prompt Tuning or Full Finetuning?
di: Han, Cheng, et al.
Pubblicazione: (2024)
di: Han, Cheng, et al.
Pubblicazione: (2024)
EAVE: Efficient Product Attribute Value Extraction via Lightweight Sparse-layer Interaction
di: Yang, Li, et al.
Pubblicazione: (2024)
di: Yang, Li, et al.
Pubblicazione: (2024)
All You Need is One: Capsule Prompt Tuning with a Single Vector
di: Liu, Yiyang, et al.
Pubblicazione: (2025)
di: Liu, Yiyang, et al.
Pubblicazione: (2025)
Visual Fourier Prompt Tuning
di: Zeng, Runjia, et al.
Pubblicazione: (2024)
di: Zeng, Runjia, et al.
Pubblicazione: (2024)
On-the-Fly VLA Adaptation via Test-Time Reinforcement Learning
di: Liu, Changyu, et al.
Pubblicazione: (2026)
di: Liu, Changyu, et al.
Pubblicazione: (2026)
Multimodal Instruction Tuning with Conditional Mixture of LoRA
di: Shen, Ying, et al.
Pubblicazione: (2024)
di: Shen, Ying, et al.
Pubblicazione: (2024)
Error-driven Data-efficient Large Multimodal Model Tuning
di: Yao, Barry Menglong, et al.
Pubblicazione: (2024)
di: Yao, Barry Menglong, et al.
Pubblicazione: (2024)
FewFedPIT: Towards Privacy-preserving and Few-shot Federated Instruction Tuning
di: Zhang, Zhuo, et al.
Pubblicazione: (2024)
di: Zhang, Zhuo, et al.
Pubblicazione: (2024)
MEPT: Mixture of Expert Prompt Tuning as a Manifold Mapper
di: Zeng, Runjia, et al.
Pubblicazione: (2025)
di: Zeng, Runjia, et al.
Pubblicazione: (2025)
Dr. Zero: Self-Evolving Search Agents without Training Data
di: Yue, Zhenrui, et al.
Pubblicazione: (2026)
di: Yue, Zhenrui, et al.
Pubblicazione: (2026)
Unveiling User Satisfaction and Creator Productivity Trade-Offs in Recommendation Platforms
di: Yao, Fan, et al.
Pubblicazione: (2024)
di: Yao, Fan, et al.
Pubblicazione: (2024)
Exploring the Adversarial Vulnerabilities of Vision-Language-Action Models in Robotics
di: Wang, Taowen, et al.
Pubblicazione: (2024)
di: Wang, Taowen, et al.
Pubblicazione: (2024)
TokenSeek: Memory Efficient Fine Tuning via Instance-Aware Token Ditching
di: Zeng, Runjia, et al.
Pubblicazione: (2026)
di: Zeng, Runjia, et al.
Pubblicazione: (2026)
Diversity-driven Data Selection for Language Model Tuning through Sparse Autoencoder
di: Yang, Xianjun, et al.
Pubblicazione: (2025)
di: Yang, Xianjun, et al.
Pubblicazione: (2025)
Probabilistic Token Alignment for Large Language Model Fusion
di: Zeng, Runjia, et al.
Pubblicazione: (2025)
di: Zeng, Runjia, et al.
Pubblicazione: (2025)
StablePT: Towards Stable Prompting for Few-shot Learning via Input Separation
di: Liu, Xiaoming, et al.
Pubblicazione: (2024)
di: Liu, Xiaoming, et al.
Pubblicazione: (2024)
A-SelecT: Automatic Timestep Selection for Diffusion Transformer Representation Learning
di: Liu, Changyu, et al.
Pubblicazione: (2026)
di: Liu, Changyu, et al.
Pubblicazione: (2026)
Multimodal Instruction Tuning with Hybrid State Space Models
di: Zhou, Jianing, et al.
Pubblicazione: (2024)
di: Zhou, Jianing, et al.
Pubblicazione: (2024)
Vision-aware Multimodal Prompt Tuning for Uploadable Multi-source Few-shot Domain Adaptation
di: Liu, Kuanghong, et al.
Pubblicazione: (2025)
di: Liu, Kuanghong, et al.
Pubblicazione: (2025)
Zeus: Zero-shot LLM Instruction for Union Segmentation in Multimodal Medical Imaging
di: Dai, Siyuan, et al.
Pubblicazione: (2025)
di: Dai, Siyuan, et al.
Pubblicazione: (2025)
Vision-Flan: Scaling Human-Labeled Tasks in Visual Instruction Tuning
di: Xu, Zhiyang, et al.
Pubblicazione: (2024)
di: Xu, Zhiyang, et al.
Pubblicazione: (2024)
Inertial Confinement Fusion Forecasting via Large Language Models
di: Chen, Mingkai, et al.
Pubblicazione: (2024)
di: Chen, Mingkai, et al.
Pubblicazione: (2024)
Target-driven Attack for Large Language Models
di: Zhang, Chong, et al.
Pubblicazione: (2024)
di: Zhang, Chong, et al.
Pubblicazione: (2024)
A karyosystematic study of the genus Bombina from China (Amphibia: Discoglossidae)
di: Liu, Wan-zhao
Pubblicazione: (1993)
di: Liu, Wan-zhao
Pubblicazione: (1993)
Advocating for the Silent: Enhancing Federated Generalization for Non-Participating Clients
di: Wu, Zheshun, et al.
Pubblicazione: (2023)
di: Wu, Zheshun, et al.
Pubblicazione: (2023)
MePT: Multi-Representation Guided Prompt Tuning for Vision-Language Model
di: Wang, Xinyang, et al.
Pubblicazione: (2024)
di: Wang, Xinyang, et al.
Pubblicazione: (2024)
Generation-driven Contrastive Self-training for Zero-shot Text Classification with Instruction-following LLM
di: Zhang, Ruohong, et al.
Pubblicazione: (2023)
di: Zhang, Ruohong, et al.
Pubblicazione: (2023)
Zero-shot Image Editing with Reference Imitation
di: Chen, Xi, et al.
Pubblicazione: (2024)
di: Chen, Xi, et al.
Pubblicazione: (2024)
SelectIT: Selective Instruction Tuning for LLMs via Uncertainty-Aware Self-Reflection
di: Liu, Liangxin, et al.
Pubblicazione: (2024)
di: Liu, Liangxin, et al.
Pubblicazione: (2024)
ADePT: Adaptive Decomposed Prompt Tuning for Parameter-Efficient Fine-tuning
di: Tang, Pengwei, et al.
Pubblicazione: (2025)
di: Tang, Pengwei, et al.
Pubblicazione: (2025)
StrLoRA: Towards Streaming Continual Visual Instruction Tuning for MLLMs
di: Che, Chang, et al.
Pubblicazione: (2026)
di: Che, Chang, et al.
Pubblicazione: (2026)
Objective Shaping with Hard Negatives: Windowed Partial AUC Optimization for RL-based LLM Recommenders
di: Shi, Wentao, et al.
Pubblicazione: (2026)
di: Shi, Wentao, et al.
Pubblicazione: (2026)
ModalPrompt: Towards Efficient Multimodal Continual Instruction Tuning with Dual-Modality Guided Prompt
di: Zeng, Fanhu, et al.
Pubblicazione: (2024)
di: Zeng, Fanhu, et al.
Pubblicazione: (2024)
Q-Tuning: Queue-based Prompt Tuning for Lifelong Few-shot Language Learning
di: Guo, Yanhui, et al.
Pubblicazione: (2024)
di: Guo, Yanhui, et al.
Pubblicazione: (2024)
Revisiting Chain-of-Thought Prompting: Zero-shot Can Be Stronger than Few-shot
di: Cheng, Xiang, et al.
Pubblicazione: (2025)
di: Cheng, Xiang, et al.
Pubblicazione: (2025)
NVCiM-PT: An NVCiM-assisted Prompt Tuning Framework for Edge LLMs
di: Qin, Ruiyang, et al.
Pubblicazione: (2024)
di: Qin, Ruiyang, et al.
Pubblicazione: (2024)
DePT: Decoupled Prompt Tuning
di: Zhang, Ji, et al.
Pubblicazione: (2023)
di: Zhang, Ji, et al.
Pubblicazione: (2023)
AMELI: Enhancing Multimodal Entity Linking with Fine-Grained Attributes
di: Yao, Barry Menglong, et al.
Pubblicazione: (2023)
di: Yao, Barry Menglong, et al.
Pubblicazione: (2023)
Assistant-Guided Mitigation of Teacher Preference Bias in LLM-as-a-Judge
di: Liu, Zhuo, et al.
Pubblicazione: (2025)
di: Liu, Zhuo, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Re-Imagining Multimodal Instruction Tuning: A Representation View
di: Liu, Yiyang, et al.
Pubblicazione: (2025) -
Facing the Elephant in the Room: Visual Prompt Tuning or Full Finetuning?
di: Han, Cheng, et al.
Pubblicazione: (2024) -
EAVE: Efficient Product Attribute Value Extraction via Lightweight Sparse-layer Interaction
di: Yang, Li, et al.
Pubblicazione: (2024) -
All You Need is One: Capsule Prompt Tuning with a Single Vector
di: Liu, Yiyang, et al.
Pubblicazione: (2025) -
Visual Fourier Prompt Tuning
di: Zeng, Runjia, et al.
Pubblicazione: (2024)