MLAN: Language-Based Instruction Tuning Preserves and Transfers Knowledge in Multimodal Language Models
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Tu, Jianhong, Ni, Zhuohao, Crispino, Nicholas, Yu, Zihao, Bendersky, Michael, Gunel, Beliz, Jia, Ruoxi, Liu, Xin, Lyu, Lingjuan, Song, Dawn, Wang, Chenguang |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Predicting Task Performance with Context-aware Scaling Laws
par: Montgomery, Kyle, et autres
Publié: (2025)
par: Montgomery, Kyle, et autres
Publié: (2025)
Peer-Preservation in Frontier Models
par: Potter, Yujin, et autres
Publié: (2026)
par: Potter, Yujin, et autres
Publié: (2026)
Benchmarking Zero-Shot Robustness of Multimodal Foundation Models: A Pilot Study
par: Wang, Chenguang, et autres
Publié: (2024)
par: Wang, Chenguang, et autres
Publié: (2024)
Agent Instructs Large Language Models to be General Zero-Shot Reasoners
par: Crispino, Nicholas, et autres
Publié: (2023)
par: Crispino, Nicholas, et autres
Publié: (2023)
RepIt: Steering Language Models with Concept-Specific Refusal Vectors
par: Siu, Vincent, et autres
Publié: (2025)
par: Siu, Vincent, et autres
Publié: (2025)
PRISM: Efficient Long-Range Reasoning With Short-Context LLMs
par: Jayalath, Dulhan, et autres
Publié: (2024)
par: Jayalath, Dulhan, et autres
Publié: (2024)
COSMIC: Generalized Refusal Direction Identification in LLM Activations
par: Siu, Vincent, et autres
Publié: (2025)
par: Siu, Vincent, et autres
Publié: (2025)
Re-Tuning: Overcoming the Compositionality Limits of Large Language Models with Recursive Tuning
par: Pasewark, Eric, et autres
Publié: (2024)
par: Pasewark, Eric, et autres
Publié: (2024)
BEEAR: Embedding-based Adversarial Removal of Safety Backdoors in Instruction-tuned Language Models
par: Zeng, Yi, et autres
Publié: (2024)
par: Zeng, Yi, et autres
Publié: (2024)
SUMIE: A Synthetic Benchmark for Incremental Entity Summarization
par: Hwang, Eunjeong, et autres
Publié: (2024)
par: Hwang, Eunjeong, et autres
Publié: (2024)
ExpVG: Investigating the Design Space of Visual Grounding in Multimodal Large Language Model
par: Kang, Weitai, et autres
Publié: (2025)
par: Kang, Weitai, et autres
Publié: (2025)
CASPR: Automated Evaluation Metric for Contrastive Summarization
par: Ananthamurugan, Nirupan, et autres
Publié: (2024)
par: Ananthamurugan, Nirupan, et autres
Publié: (2024)
Transición con rostro humano a la era del robot
par: Gustavo Beliz
Publié: (2018)
par: Gustavo Beliz
Publié: (2018)
When Alignment Fails: Multimodal Adversarial Attacks on Vision-Language-Action Models
par: Yan, Yuping, et autres
Publié: (2025)
par: Yan, Yuping, et autres
Publié: (2025)
LLM CHESS: Benchmarking Reasoning and Instruction-Following in LLMs through Chess
par: Kolasani, Sai, et autres
Publié: (2025)
par: Kolasani, Sai, et autres
Publié: (2025)
Training-Free Mitigation of Language Reasoning Degradation After Multimodal Instruction Tuning
par: Ratzlaff, Neale, et autres
Publié: (2024)
par: Ratzlaff, Neale, et autres
Publié: (2024)
Seeing Further on the Shoulders of Giants: Knowledge Inheritance for Vision Foundation Models
par: Huang, Jiabo, et autres
Publié: (2025)
par: Huang, Jiabo, et autres
Publié: (2025)
OutSafe-Bench: A Benchmark for Multimodal Offensive Content Detection in Large Language Models
par: Yan, Yuping, et autres
Publié: (2025)
par: Yan, Yuping, et autres
Publié: (2025)
SteeringSafety: A Systematic Safety Evaluation Framework of Representation Steering in LLMs
par: Siu, Vincent, et autres
Publié: (2025)
par: Siu, Vincent, et autres
Publié: (2025)
GIFT: Guided Fine-Tuning and Transfer for Enhancing Instruction-Tuned Language Models
par: Ruan, Zhiwen, et autres
Publié: (2026)
par: Ruan, Zhiwen, et autres
Publié: (2026)
MEIT: Multimodal Electrocardiogram Instruction Tuning on Large Language Models for Report Generation
par: Wan, Zhongwei, et autres
Publié: (2024)
par: Wan, Zhongwei, et autres
Publié: (2024)
FLoRA: Federated Fine-Tuning Large Language Models with Heterogeneous Low-Rank Adaptations
par: Wang, Ziyao, et autres
Publié: (2024)
par: Wang, Ziyao, et autres
Publié: (2024)
Towards Robust Instruction Tuning on Multimodal Large Language Models
par: Han, Wei, et autres
Publié: (2024)
par: Han, Wei, et autres
Publié: (2024)
Multimodal Reranking for Knowledge-Intensive Visual Question Answering
par: Wen, Haoyang, et autres
Publié: (2024)
par: Wen, Haoyang, et autres
Publié: (2024)
IAPT: Instruction-Aware Prompt Tuning for Large Language Models
par: Zhu, Wei, et autres
Publié: (2024)
par: Zhu, Wei, et autres
Publié: (2024)
STRUM-LLM: Attributed and Structured Contrastive Summarization
par: Gunel, Beliz, et autres
Publié: (2024)
par: Gunel, Beliz, et autres
Publié: (2024)
Parameter Efficient Multimodal Instruction Tuning for Romanian Vision Language Models
par: Dima, George-Andrei, et autres
Publié: (2025)
par: Dima, George-Andrei, et autres
Publié: (2025)
FedWon: Triumphing Multi-domain Federated Learning Without Normalization
par: Zhuang, Weiming, et autres
Publié: (2023)
par: Zhuang, Weiming, et autres
Publié: (2023)
Empirical Recipes for Efficient and Compact Vision-Language Models
par: Huang, Jiabo, et autres
Publié: (2026)
par: Huang, Jiabo, et autres
Publié: (2026)
Hierarchical Contextual Manifold Alignment for Structuring Latent Representations in Large Language Models
par: Dong, Meiquan, et autres
Publié: (2025)
par: Dong, Meiquan, et autres
Publié: (2025)
Just Enough Shifts: Mitigating Over-Refusal in Aligned Language Models with Targeted Representation Fine-Tuning
par: Dabas, Mahavir, et autres
Publié: (2025)
par: Dabas, Mahavir, et autres
Publié: (2025)
LIFEBench: Evaluating Length Instruction Following in Large Language Models
par: Zhang, Wei, et autres
Publié: (2025)
par: Zhang, Wei, et autres
Publié: (2025)
RigorLLM: Resilient Guardrails for Large Language Models against Undesired Content
par: Yuan, Zhuowen, et autres
Publié: (2024)
par: Yuan, Zhuowen, et autres
Publié: (2024)
PAT: Privacy-Preserving Adversarial Transfer for Accurate, Robust and Privacy-Preserving EEG Decoding
par: Chen, Xiaoqing, et autres
Publié: (2024)
par: Chen, Xiaoqing, et autres
Publié: (2024)
Enhancing Incremental Summarization with Structured Representations
par: Hwang, EunJeong, et autres
Publié: (2024)
par: Hwang, EunJeong, et autres
Publié: (2024)
Scaling Up Biomedical Vision-Language Models: Fine-Tuning, Instruction Tuning, and Multi-Modal Learning
par: Peng, Cheng, et autres
Publié: (2025)
par: Peng, Cheng, et autres
Publié: (2025)
Understanding and Preserving Safety in Fine-Tuned LLMs
par: Zhang, Jiawen, et autres
Publié: (2026)
par: Zhang, Jiawen, et autres
Publié: (2026)
Data Shapley in One Training Run
par: Wang, Jiachen T., et autres
Publié: (2024)
par: Wang, Jiachen T., et autres
Publié: (2024)
Building Sustainable and Trustworthy Indigenous Knowledge Preservation Ecosystem
par: Bi, Siguo, et autres
Publié: (2025)
par: Bi, Siguo, et autres
Publié: (2025)
Multimodal Spatial Language Maps for Robot Navigation and Manipulation
par: Huang, Chenguang, et autres
Publié: (2025)
par: Huang, Chenguang, et autres
Publié: (2025)
Documents similaires
-
Predicting Task Performance with Context-aware Scaling Laws
par: Montgomery, Kyle, et autres
Publié: (2025) -
Peer-Preservation in Frontier Models
par: Potter, Yujin, et autres
Publié: (2026) -
Benchmarking Zero-Shot Robustness of Multimodal Foundation Models: A Pilot Study
par: Wang, Chenguang, et autres
Publié: (2024) -
Agent Instructs Large Language Models to be General Zero-Shot Reasoners
par: Crispino, Nicholas, et autres
Publié: (2023) -
RepIt: Steering Language Models with Concept-Specific Refusal Vectors
par: Siu, Vincent, et autres
Publié: (2025)