AdaMMS: Model Merging for Heterogeneous Multimodal Large Language Models with Unsupervised Coefficient Optimization
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Du, Yiyang, Wang, Xiaochen, Chen, Chi, Ye, Jiabo, Wang, Yiru, Li, Peng, Yan, Ming, Zhang, Ji, Huang, Fei, Sui, Zhifang, Sun, Maosong, Liu, Yang |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2025
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Model Composition for Multimodal Large Language Models
von: Chen, Chi, et al.
Veröffentlicht: (2024)
von: Chen, Chi, et al.
Veröffentlicht: (2024)
FSM: A Finite State Machine Based Zero-Shot Prompting Paradigm for Multi-Hop Question Answering
von: Wang, Xiaochen, et al.
Veröffentlicht: (2024)
von: Wang, Xiaochen, et al.
Veröffentlicht: (2024)
AdaMerging: Adaptive Model Merging for Multi-Task Learning
von: Yang, Enneng, et al.
Veröffentlicht: (2023)
von: Yang, Enneng, et al.
Veröffentlicht: (2023)
SG-FSM: A Self-Guiding Zero-Shot Prompting Paradigm for Multi-Hop Question Answering Based on Finite State Machine
von: Wang, Xiaochen, et al.
Veröffentlicht: (2024)
von: Wang, Xiaochen, et al.
Veröffentlicht: (2024)
Exploring Activation Patterns of Parameters in Language Models
von: Wang, Yudong, et al.
Veröffentlicht: (2024)
von: Wang, Yudong, et al.
Veröffentlicht: (2024)
mPLUG-Owl: Modularization Empowers Large Language Models with Multimodality
von: Ye, Qinghao, et al.
Veröffentlicht: (2023)
von: Ye, Qinghao, et al.
Veröffentlicht: (2023)
mPLUG-PaperOwl: Scientific Diagram Analysis with the Multimodal Large Language Model
von: Hu, Anwen, et al.
Veröffentlicht: (2023)
von: Hu, Anwen, et al.
Veröffentlicht: (2023)
AdaMergeX: Cross-Lingual Transfer with Large Language Models via Adaptive Adapter Merging
von: Zhao, Yiran, et al.
Veröffentlicht: (2024)
von: Zhao, Yiran, et al.
Veröffentlicht: (2024)
Can Large Multimodal Models Uncover Deep Semantics Behind Images?
von: Yang, Yixin, et al.
Veröffentlicht: (2024)
von: Yang, Yixin, et al.
Veröffentlicht: (2024)
Language Models Encode the Value of Numbers Linearly
von: Zhu, Fangwei, et al.
Veröffentlicht: (2024)
von: Zhu, Fangwei, et al.
Veröffentlicht: (2024)
NAN: A Training-Free Solution to Coefficient Estimation in Model Merging
von: Si, Chongjie, et al.
Veröffentlicht: (2025)
von: Si, Chongjie, et al.
Veröffentlicht: (2025)
Online MMS Allocation for Chores
von: Song, Jiaxin, et al.
Veröffentlicht: (2025)
von: Song, Jiaxin, et al.
Veröffentlicht: (2025)
Model Assembly Learning with Heterogeneous Layer Weight Merging
von: Zhang, Yi-Kai, et al.
Veröffentlicht: (2025)
von: Zhang, Yi-Kai, et al.
Veröffentlicht: (2025)
Beyond Single Frames: Can LMMs Comprehend Temporal and Contextual Narratives in Image Sequences?
von: Wang, Xiaochen, et al.
Veröffentlicht: (2025)
von: Wang, Xiaochen, et al.
Veröffentlicht: (2025)
Reducing Hallucinations in Entity Abstract Summarization with Facts-Template Decomposition
von: Zhu, Fangwei, et al.
Veröffentlicht: (2024)
von: Zhu, Fangwei, et al.
Veröffentlicht: (2024)
Browse and Concentrate: Comprehending Multimodal Content via prior-LLM Context Fusion
von: Wang, Ziyue, et al.
Veröffentlicht: (2024)
von: Wang, Ziyue, et al.
Veröffentlicht: (2024)
CoLT: Reasoning with Chain of Latent Tool Calls
von: Zhu, Fangwei, et al.
Veröffentlicht: (2026)
von: Zhu, Fangwei, et al.
Veröffentlicht: (2026)
PeriodicLoRA: Breaking the Low-Rank Bottleneck in LoRA Optimization
von: Meng, Xiangdi, et al.
Veröffentlicht: (2024)
von: Meng, Xiangdi, et al.
Veröffentlicht: (2024)
AdaRank: Adaptive Rank Pruning for Enhanced Model Merging
von: Lee, Chanhyuk, et al.
Veröffentlicht: (2025)
von: Lee, Chanhyuk, et al.
Veröffentlicht: (2025)
PivotMerge: Bridging Heterogeneous Multimodal Pre-training via Post-Alignment Model Merging
von: Shao, Zibo, et al.
Veröffentlicht: (2026)
von: Shao, Zibo, et al.
Veröffentlicht: (2026)
SAP-Bench: Benchmarking Multimodal Large Language Models in Surgical Action Planning
von: Xu, Mengya, et al.
Veröffentlicht: (2025)
von: Xu, Mengya, et al.
Veröffentlicht: (2025)
Chain-of-Thought Tokens are Computer Program Variables
von: Zhu, Fangwei, et al.
Veröffentlicht: (2025)
von: Zhu, Fangwei, et al.
Veröffentlicht: (2025)
Mobile-Agent: Autonomous Multi-Modal Mobile Device Agent with Visual Perception
von: Wang, Junyang, et al.
Veröffentlicht: (2024)
von: Wang, Junyang, et al.
Veröffentlicht: (2024)
Checkpoint Merging via Bayesian Optimization in LLM Pretraining
von: Liu, Deyuan, et al.
Veröffentlicht: (2024)
von: Liu, Deyuan, et al.
Veröffentlicht: (2024)
mPLUG-Owl3: Towards Long Image-Sequence Understanding in Multi-Modal Large Language Models
von: Ye, Jiabo, et al.
Veröffentlicht: (2024)
von: Ye, Jiabo, et al.
Veröffentlicht: (2024)
MergeME: Model Merging Techniques for Homogeneous and Heterogeneous MoEs
von: Zhou, Yuhang, et al.
Veröffentlicht: (2025)
von: Zhou, Yuhang, et al.
Veröffentlicht: (2025)
Not All Demonstration Examples are Equally Beneficial: Reweighting Demonstration Examples for In-Context Learning
von: Yang, Zhe, et al.
Veröffentlicht: (2023)
von: Yang, Zhe, et al.
Veröffentlicht: (2023)
Towards Better RL Training Data Utilization via Second-Order Rollout
von: Yang, Zhe, et al.
Veröffentlicht: (2026)
von: Yang, Zhe, et al.
Veröffentlicht: (2026)
Dynamic Fisher-weighted Model Merging via Bayesian Optimization
von: Lee, Sanwoo, et al.
Veröffentlicht: (2025)
von: Lee, Sanwoo, et al.
Veröffentlicht: (2025)
Advanced Multimodal Deep Learning Architecture for Image-Text Matching
von: Wang, Jinyin, et al.
Veröffentlicht: (2024)
von: Wang, Jinyin, et al.
Veröffentlicht: (2024)
Chip-Tuning: Classify Before Language Models Say
von: Zhu, Fangwei, et al.
Veröffentlicht: (2024)
von: Zhu, Fangwei, et al.
Veröffentlicht: (2024)
Plug-and-Play Training Framework for Preference Optimization
von: Ma, Jingyuan, et al.
Veröffentlicht: (2024)
von: Ma, Jingyuan, et al.
Veröffentlicht: (2024)
Transport and Merge: Cross-Architecture Merging for Large Language Models
von: Cui, Chenhang, et al.
Veröffentlicht: (2026)
von: Cui, Chenhang, et al.
Veröffentlicht: (2026)
Defending Multimodal Backdoored Models by Repulsive Visual Prompt Tuning
von: Zhang, Zhifang, et al.
Veröffentlicht: (2024)
von: Zhang, Zhifang, et al.
Veröffentlicht: (2024)
SymDPO: Boosting In-Context Learning of Large Multimodal Models with Symbol Demonstration Direct Preference Optimization
von: Jia, Hongrui, et al.
Veröffentlicht: (2024)
von: Jia, Hongrui, et al.
Veröffentlicht: (2024)
Towards Harmonized Uncertainty Estimation for Large Language Models
von: Li, Rui, et al.
Veröffentlicht: (2025)
von: Li, Rui, et al.
Veröffentlicht: (2025)
CODIS: Benchmarking Context-Dependent Visual Comprehension for Multimodal Large Language Models
von: Luo, Fuwen, et al.
Veröffentlicht: (2024)
von: Luo, Fuwen, et al.
Veröffentlicht: (2024)
From Mathematical Reasoning to Code: Generalization of Process Reward Models in Test-Time Scaling
von: Chen, Zhengyu, et al.
Veröffentlicht: (2025)
von: Chen, Zhengyu, et al.
Veröffentlicht: (2025)
HoliTom: Holistic Token Merging for Fast Video Large Language Models
von: Shao, Kele, et al.
Veröffentlicht: (2025)
von: Shao, Kele, et al.
Veröffentlicht: (2025)
Existence of MMS Allocations with Mixed Manna
von: Hsu, Kevin
Veröffentlicht: (2024)
von: Hsu, Kevin
Veröffentlicht: (2024)
Ähnliche Einträge
-
Model Composition for Multimodal Large Language Models
von: Chen, Chi, et al.
Veröffentlicht: (2024) -
FSM: A Finite State Machine Based Zero-Shot Prompting Paradigm for Multi-Hop Question Answering
von: Wang, Xiaochen, et al.
Veröffentlicht: (2024) -
AdaMerging: Adaptive Model Merging for Multi-Task Learning
von: Yang, Enneng, et al.
Veröffentlicht: (2023) -
SG-FSM: A Self-Guiding Zero-Shot Prompting Paradigm for Multi-Hop Question Answering Based on Finite State Machine
von: Wang, Xiaochen, et al.
Veröffentlicht: (2024) -
Exploring Activation Patterns of Parameters in Language Models
von: Wang, Yudong, et al.
Veröffentlicht: (2024)