ProFuser: Progressive Fusion of Large Language Models
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Shi, Tianyuan, Wan, Fanqi, Huang, Canbin, Quan, Xiaojun, Li, Chenliang, Yan, Ming, Zhang, Ji, Huang, Minhua, Kai, Wu |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2024
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Lookahead Routing for Large Language Models
von: Huang, Canbin, et al.
Veröffentlicht: (2025)
von: Huang, Canbin, et al.
Veröffentlicht: (2025)
FuseChat-3.0: Preference Optimization Meets Heterogeneous Model Fusion
von: Yang, Ziyi, et al.
Veröffentlicht: (2025)
von: Yang, Ziyi, et al.
Veröffentlicht: (2025)
Mutual-Taught for Co-adapting Policy and Reward Models
von: Shi, Tianyuan, et al.
Veröffentlicht: (2025)
von: Shi, Tianyuan, et al.
Veröffentlicht: (2025)
Knowledge Fusion of Large Language Models
von: Wan, Fanqi, et al.
Veröffentlicht: (2024)
von: Wan, Fanqi, et al.
Veröffentlicht: (2024)
Weighted-Reward Preference Optimization for Implicit Model Fusion
von: Yang, Ziyi, et al.
Veröffentlicht: (2024)
von: Yang, Ziyi, et al.
Veröffentlicht: (2024)
FuseRL: Dense Preference Optimization for Heterogeneous Model Fusion
von: Zhong, Longguang, et al.
Veröffentlicht: (2025)
von: Zhong, Longguang, et al.
Veröffentlicht: (2025)
SPELL: Self-Play Reinforcement Learning for Evolving Long-Context Language Models
von: Yang, Ziyi, et al.
Veröffentlicht: (2025)
von: Yang, Ziyi, et al.
Veröffentlicht: (2025)
ProactiveEval: A Unified Evaluation Framework for Proactive Dialogue Agents
von: Liu, Tianjian, et al.
Veröffentlicht: (2025)
von: Liu, Tianjian, et al.
Veröffentlicht: (2025)
Small LLMs Are Weak Tool Learners: A Multi-LLM Agent
von: Shen, Weizhou, et al.
Veröffentlicht: (2024)
von: Shen, Weizhou, et al.
Veröffentlicht: (2024)
FuseChat: Knowledge Fusion of Chat Models
von: Wan, Fanqi, et al.
Veröffentlicht: (2024)
von: Wan, Fanqi, et al.
Veröffentlicht: (2024)
BlockPruner: Fine-grained Pruning for Large Language Models
von: Zhong, Longguang, et al.
Veröffentlicht: (2024)
von: Zhong, Longguang, et al.
Veröffentlicht: (2024)
Knowledge Distillation of Black-Box Large Language Models
von: Chen, Hongzhan, et al.
Veröffentlicht: (2024)
von: Chen, Hongzhan, et al.
Veröffentlicht: (2024)
Knowledge Fusion of Chat LLMs: A Preliminary Technical Report
von: Wan, Fanqi, et al.
Veröffentlicht: (2024)
von: Wan, Fanqi, et al.
Veröffentlicht: (2024)
QwenLong-L1: Towards Long-Context Large Reasoning Models with Reinforcement Learning
von: Wan, Fanqi, et al.
Veröffentlicht: (2025)
von: Wan, Fanqi, et al.
Veröffentlicht: (2025)
Probabilistic Token Alignment for Large Language Model Fusion
von: Zeng, Runjia, et al.
Veröffentlicht: (2025)
von: Zeng, Runjia, et al.
Veröffentlicht: (2025)
Advantage-Guided Distillation for Preference Alignment in Small Language Models
von: Gao, Shiping, et al.
Veröffentlicht: (2025)
von: Gao, Shiping, et al.
Veröffentlicht: (2025)
Knowledge Verification to Nip Hallucination in the Bud
von: Wan, Fanqi, et al.
Veröffentlicht: (2024)
von: Wan, Fanqi, et al.
Veröffentlicht: (2024)
Enhancing Large Language Models in Coding Through Multi-Perspective Self-Consistency
von: Huang, Baizhou, et al.
Veröffentlicht: (2023)
von: Huang, Baizhou, et al.
Veröffentlicht: (2023)
CorpusQA: A 10 Million Token Benchmark for Corpus-Level Analysis and Reasoning
von: Lu, Zhiyuan, et al.
Veröffentlicht: (2026)
von: Lu, Zhiyuan, et al.
Veröffentlicht: (2026)
Progtuning: Progressive Fine-tuning Framework for Transformer-based Language Models
von: Ji, Xiaoshuang, et al.
Veröffentlicht: (2025)
von: Ji, Xiaoshuang, et al.
Veröffentlicht: (2025)
Cool-Fusion: Fuse Large Language Models without Training
von: Liu, Cong, et al.
Veröffentlicht: (2024)
von: Liu, Cong, et al.
Veröffentlicht: (2024)
PaCoST: Paired Confidence Significance Testing for Benchmark Contamination Detection in Large Language Models
von: Zhang, Huixuan, et al.
Veröffentlicht: (2024)
von: Zhang, Huixuan, et al.
Veröffentlicht: (2024)
Exploring and Evaluating Multimodal Knowledge Reasoning Consistency of Multimodal Large Language Models
von: Jia, Boyu, et al.
Veröffentlicht: (2025)
von: Jia, Boyu, et al.
Veröffentlicht: (2025)
Turn-taking and Backchannel Prediction with Acoustic and Large Language Model Fusion
von: Wang, Jinhan, et al.
Veröffentlicht: (2024)
von: Wang, Jinhan, et al.
Veröffentlicht: (2024)
Large Language Models for Predictive Analysis: How Far Are They?
von: Chen, Qin, et al.
Veröffentlicht: (2025)
von: Chen, Qin, et al.
Veröffentlicht: (2025)
DSGram: Dynamic Weighting Sub-Metrics for Grammatical Error Correction in the Era of Large Language Models
von: Xie, Jinxiang, et al.
Veröffentlicht: (2024)
von: Xie, Jinxiang, et al.
Veröffentlicht: (2024)
Analyzing Cognitive Differences Among Large Language Models through the Lens of Social Worldview
von: Li, Jiatao, et al.
Veröffentlicht: (2025)
von: Li, Jiatao, et al.
Veröffentlicht: (2025)
SoLoPO: Unlocking Long-Context Capabilities in LLMs via Short-to-Long Preference Optimization
von: Sun, Huashan, et al.
Veröffentlicht: (2025)
von: Sun, Huashan, et al.
Veröffentlicht: (2025)
Evaluating the Translation Performance of Large Language Models Based on Euas-20
von: Huang, Yan, et al.
Veröffentlicht: (2024)
von: Huang, Yan, et al.
Veröffentlicht: (2024)
Framework for Progressive Knowledge Fusion in Large Language Models Through Structured Conceptual Redundancy Analysis
von: Sakau, Joseph, et al.
Veröffentlicht: (2025)
von: Sakau, Joseph, et al.
Veröffentlicht: (2025)
Self-Evolution Fine-Tuning for Policy Optimization
von: Chen, Ruijun, et al.
Veröffentlicht: (2024)
von: Chen, Ruijun, et al.
Veröffentlicht: (2024)
Towards Efficient Large Language Models for Scientific Text: A Review
von: To, Huy Quoc, et al.
Veröffentlicht: (2024)
von: To, Huy Quoc, et al.
Veröffentlicht: (2024)
A Survey of Large Language Models in Medicine: Progress, Application, and Challenge
von: Zhou, Hongjian, et al.
Veröffentlicht: (2023)
von: Zhou, Hongjian, et al.
Veröffentlicht: (2023)
Credal Transformer: A Principled Approach for Quantifying and Mitigating Hallucinations in Large Language Models
von: Ji, Shihao, et al.
Veröffentlicht: (2025)
von: Ji, Shihao, et al.
Veröffentlicht: (2025)
Large Language Model Unlearning
von: Yao, Yuanshun, et al.
Veröffentlicht: (2023)
von: Yao, Yuanshun, et al.
Veröffentlicht: (2023)
WritingBench: A Comprehensive Benchmark for Generative Writing
von: Wu, Yuning, et al.
Veröffentlicht: (2025)
von: Wu, Yuning, et al.
Veröffentlicht: (2025)
Detoxification of Large Language Models through Output-layer Fusion with a Calibration Model
von: Tian, Yuanhe, et al.
Veröffentlicht: (2025)
von: Tian, Yuanhe, et al.
Veröffentlicht: (2025)
code_transformed: The Influence of Large Language Models on Code
von: Xu, Yuliang, et al.
Veröffentlicht: (2025)
von: Xu, Yuliang, et al.
Veröffentlicht: (2025)
Selecting Large Language Model to Fine-tune via Rectified Scaling Law
von: Lin, Haowei, et al.
Veröffentlicht: (2024)
von: Lin, Haowei, et al.
Veröffentlicht: (2024)
From General to Specific: Tailoring Large Language Models for Personalized Healthcare
von: Shi, Ruize, et al.
Veröffentlicht: (2024)
von: Shi, Ruize, et al.
Veröffentlicht: (2024)
Ähnliche Einträge
-
Lookahead Routing for Large Language Models
von: Huang, Canbin, et al.
Veröffentlicht: (2025) -
FuseChat-3.0: Preference Optimization Meets Heterogeneous Model Fusion
von: Yang, Ziyi, et al.
Veröffentlicht: (2025) -
Mutual-Taught for Co-adapting Policy and Reward Models
von: Shi, Tianyuan, et al.
Veröffentlicht: (2025) -
Knowledge Fusion of Large Language Models
von: Wan, Fanqi, et al.
Veröffentlicht: (2024) -
Weighted-Reward Preference Optimization for Implicit Model Fusion
von: Yang, Ziyi, et al.
Veröffentlicht: (2024)