FusionBench: A Unified Library and Comprehensive Benchmark for Deep Model Fusion
Fuente:
arXiv
Salvato in:
| Autori principali: | Tang, Anke, Shen, Li, Luo, Yong, Yang, Enneng, Hu, Han, Zhang, Lefei, Du, Bo, Tao, Dacheng |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
SMILE: Zero-Shot Sparse Mixture of Low-Rank Experts Construction From Pre-Trained Foundation Models
di: Tang, Anke, et al.
Pubblicazione: (2024)
di: Tang, Anke, et al.
Pubblicazione: (2024)
Merging Models on the Fly Without Retraining: A Sequential Approach to Scalable Continual Model Merging
di: Tang, Anke, et al.
Pubblicazione: (2025)
di: Tang, Anke, et al.
Pubblicazione: (2025)
Towards Efficient Pareto Set Approximation via Mixture of Experts Based Model Fusion
di: Tang, Anke, et al.
Pubblicazione: (2024)
di: Tang, Anke, et al.
Pubblicazione: (2024)
Efficient and Effective Weight-Ensembling Mixture of Experts for Multi-Task Model Merging
di: Shen, Li, et al.
Pubblicazione: (2024)
di: Shen, Li, et al.
Pubblicazione: (2024)
Parameter Efficient Multi-task Model Fusion with Partial Linearization
di: Tang, Anke, et al.
Pubblicazione: (2023)
di: Tang, Anke, et al.
Pubblicazione: (2023)
Efficient Prompt Tuning by Multi-Space Projection and Prompt Fusion
di: Lan, Pengxiang, et al.
Pubblicazione: (2024)
di: Lan, Pengxiang, et al.
Pubblicazione: (2024)
CtrlAttack: A Unified Attack on World-Model Control in Diffusion Models
di: Xu, Shuhan, et al.
Pubblicazione: (2026)
di: Xu, Shuhan, et al.
Pubblicazione: (2026)
OOP: Object-Oriented Programming Evaluation Benchmark for Large Language Models
di: Wang, Shuai, et al.
Pubblicazione: (2024)
di: Wang, Shuai, et al.
Pubblicazione: (2024)
Model Merging in LLMs, MLLMs, and Beyond: Methods, Theories, Applications and Opportunities
di: Yang, Enneng, et al.
Pubblicazione: (2024)
di: Yang, Enneng, et al.
Pubblicazione: (2024)
JustLogic: A Comprehensive Benchmark for Evaluating Deductive Reasoning in Large Language Models
di: Chen, Michael K., et al.
Pubblicazione: (2025)
di: Chen, Michael K., et al.
Pubblicazione: (2025)
Learning from models beyond fine-tuning
di: Zheng, Hongling, et al.
Pubblicazione: (2023)
di: Zheng, Hongling, et al.
Pubblicazione: (2023)
TAD-Bench: A Comprehensive Benchmark for Embedding-Based Text Anomaly Detection
di: Cao, Yang, et al.
Pubblicazione: (2025)
di: Cao, Yang, et al.
Pubblicazione: (2025)
MolLangBench: A Comprehensive Benchmark for Language-Prompted Molecular Structure Recognition, Editing, and Generation
di: Cai, Feiyang, et al.
Pubblicazione: (2025)
di: Cai, Feiyang, et al.
Pubblicazione: (2025)
UrbanPlanBench: A Comprehensive Urban Planning Benchmark for Evaluating Large Language Models
di: Zheng, Yu, et al.
Pubblicazione: (2025)
di: Zheng, Yu, et al.
Pubblicazione: (2025)
Merging Multi-Task Models via Weight-Ensembling Mixture of Experts
di: Tang, Anke, et al.
Pubblicazione: (2024)
di: Tang, Anke, et al.
Pubblicazione: (2024)
Unifying Model and Layer Fusion for Speech Foundation Models
di: Shih, Yi-Jen, et al.
Pubblicazione: (2025)
di: Shih, Yi-Jen, et al.
Pubblicazione: (2025)
RPC-Bench: A Fine-grained Benchmark for Research Paper Comprehension
di: Chen, Yelin, et al.
Pubblicazione: (2026)
di: Chen, Yelin, et al.
Pubblicazione: (2026)
Sparse is Enough in Fine-tuning Pre-trained Large Language Models
di: Song, Weixi, et al.
Pubblicazione: (2023)
di: Song, Weixi, et al.
Pubblicazione: (2023)
NarraBench: A Comprehensive Framework for Narrative Benchmarking
di: Hamilton, Sil, et al.
Pubblicazione: (2025)
di: Hamilton, Sil, et al.
Pubblicazione: (2025)
WritingBench: A Comprehensive Benchmark for Generative Writing
di: Wu, Yuning, et al.
Pubblicazione: (2025)
di: Wu, Yuning, et al.
Pubblicazione: (2025)
Segment First or Comprehend First? Explore the Limit of Unsupervised Word Segmentation with Large Language Models
di: Zhang, Zihong, et al.
Pubblicazione: (2025)
di: Zhang, Zihong, et al.
Pubblicazione: (2025)
OptMerge: Unifying Multimodal LLM Capabilities and Modalities via Model Merging
di: Wei, Yongxian, et al.
Pubblicazione: (2025)
di: Wei, Yongxian, et al.
Pubblicazione: (2025)
SpeechParaling-Bench: A Comprehensive Benchmark for Paralinguistic-Aware Speech Generation
di: Liu, Ruohan, et al.
Pubblicazione: (2026)
di: Liu, Ruohan, et al.
Pubblicazione: (2026)
MASLegalBench: Benchmarking Multi-Agent Systems in Deductive Legal Reasoning
di: Jing, Huihao, et al.
Pubblicazione: (2025)
di: Jing, Huihao, et al.
Pubblicazione: (2025)
JailBench: A Comprehensive Chinese Security Assessment Benchmark for Large Language Models
di: Liu, Shuyi, et al.
Pubblicazione: (2025)
di: Liu, Shuyi, et al.
Pubblicazione: (2025)
OphthBench: A Comprehensive Benchmark for Evaluating Large Language Models in Chinese Ophthalmology
di: Zhou, Chengfeng, et al.
Pubblicazione: (2025)
di: Zhou, Chengfeng, et al.
Pubblicazione: (2025)
WXImpactBench: A Disruptive Weather Impact Understanding Benchmark for Evaluating Large Language Models
di: Yu, Yongan, et al.
Pubblicazione: (2025)
di: Yu, Yongan, et al.
Pubblicazione: (2025)
SALAD-Bench: A Hierarchical and Comprehensive Safety Benchmark for Large Language Models
di: Li, Lijun, et al.
Pubblicazione: (2024)
di: Li, Lijun, et al.
Pubblicazione: (2024)
LLMC: Benchmarking Large Language Model Quantization with a Versatile Compression Toolkit
di: Gong, Ruihao, et al.
Pubblicazione: (2024)
di: Gong, Ruihao, et al.
Pubblicazione: (2024)
Tokenization, Fusion and Decoupling: Bridging the Granularity Mismatch Between Large Language Models and Knowledge Graphs
di: Su, Siyue, et al.
Pubblicazione: (2026)
di: Su, Siyue, et al.
Pubblicazione: (2026)
LongBench Pro: A More Realistic and Comprehensive Bilingual Long-Context Evaluation Benchmark
di: Chen, Ziyang, et al.
Pubblicazione: (2026)
di: Chen, Ziyang, et al.
Pubblicazione: (2026)
Unified Multi-Task Learning & Model Fusion for Efficient Language Model Guardrailing
di: Neill, James O', et al.
Pubblicazione: (2025)
di: Neill, James O', et al.
Pubblicazione: (2025)
MCSD: An Efficient Language Model with Diverse Fusion
di: Yang, Hua, et al.
Pubblicazione: (2024)
di: Yang, Hua, et al.
Pubblicazione: (2024)
Model Hemorrhage and the Robustness Limits of Large Language Models
di: Ma, Ziyang, et al.
Pubblicazione: (2025)
di: Ma, Ziyang, et al.
Pubblicazione: (2025)
ELBA-Bench: An Efficient Learning Backdoor Attacks Benchmark for Large Language Models
di: Liu, Xuxu, et al.
Pubblicazione: (2025)
di: Liu, Xuxu, et al.
Pubblicazione: (2025)
SproutBench: A Benchmark for Safe and Ethical Large Language Models for Youth
di: Xing, Wenpeng, et al.
Pubblicazione: (2025)
di: Xing, Wenpeng, et al.
Pubblicazione: (2025)
Mobile-Bench-v2: A More Realistic and Comprehensive Benchmark for VLM-based Mobile Agents
di: Xu, Weikai, et al.
Pubblicazione: (2025)
di: Xu, Weikai, et al.
Pubblicazione: (2025)
PanCanBench: A Comprehensive Benchmark for Evaluating Large Language Models in Pancreatic Oncology
di: Zhao, Yimin, et al.
Pubblicazione: (2026)
di: Zhao, Yimin, et al.
Pubblicazione: (2026)
MedBench: A Comprehensive, Standardized, and Reliable Benchmarking System for Evaluating Chinese Medical Large Language Models
di: Liu, Mianxin, et al.
Pubblicazione: (2024)
di: Liu, Mianxin, et al.
Pubblicazione: (2024)
MedRepBench: A Comprehensive Benchmark for Medical Report Interpretation
di: Shang, Fangxin, et al.
Pubblicazione: (2025)
di: Shang, Fangxin, et al.
Pubblicazione: (2025)
Documenti analoghi
-
SMILE: Zero-Shot Sparse Mixture of Low-Rank Experts Construction From Pre-Trained Foundation Models
di: Tang, Anke, et al.
Pubblicazione: (2024) -
Merging Models on the Fly Without Retraining: A Sequential Approach to Scalable Continual Model Merging
di: Tang, Anke, et al.
Pubblicazione: (2025) -
Towards Efficient Pareto Set Approximation via Mixture of Experts Based Model Fusion
di: Tang, Anke, et al.
Pubblicazione: (2024) -
Efficient and Effective Weight-Ensembling Mixture of Experts for Multi-Task Model Merging
di: Shen, Li, et al.
Pubblicazione: (2024) -
Parameter Efficient Multi-task Model Fusion with Partial Linearization
di: Tang, Anke, et al.
Pubblicazione: (2023)