Knowledge Fusion of Large Language Models
Fuente:
arXiv
Salvato in:
| Autori principali: | Wan, Fanqi, Huang, Xinting, Cai, Deng, Quan, Xiaojun, Bi, Wei, Shi, Shuming |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Knowledge Verification to Nip Hallucination in the Bud
di: Wan, Fanqi, et al.
Pubblicazione: (2024)
di: Wan, Fanqi, et al.
Pubblicazione: (2024)
Knowledge Fusion of Chat LLMs: A Preliminary Technical Report
di: Wan, Fanqi, et al.
Pubblicazione: (2024)
di: Wan, Fanqi, et al.
Pubblicazione: (2024)
FuseChat: Knowledge Fusion of Chat Models
di: Wan, Fanqi, et al.
Pubblicazione: (2024)
di: Wan, Fanqi, et al.
Pubblicazione: (2024)
Inferflow: an Efficient and Highly Configurable Inference Engine for Large Language Models
di: Shi, Shuming, et al.
Pubblicazione: (2024)
di: Shi, Shuming, et al.
Pubblicazione: (2024)
Weighted-Reward Preference Optimization for Implicit Model Fusion
di: Yang, Ziyi, et al.
Pubblicazione: (2024)
di: Yang, Ziyi, et al.
Pubblicazione: (2024)
ProFuser: Progressive Fusion of Large Language Models
di: Shi, Tianyuan, et al.
Pubblicazione: (2024)
di: Shi, Tianyuan, et al.
Pubblicazione: (2024)
BlockPruner: Fine-grained Pruning for Large Language Models
di: Zhong, Longguang, et al.
Pubblicazione: (2024)
di: Zhong, Longguang, et al.
Pubblicazione: (2024)
FuseRL: Dense Preference Optimization for Heterogeneous Model Fusion
di: Zhong, Longguang, et al.
Pubblicazione: (2025)
di: Zhong, Longguang, et al.
Pubblicazione: (2025)
FuseChat-3.0: Preference Optimization Meets Heterogeneous Model Fusion
di: Yang, Ziyi, et al.
Pubblicazione: (2025)
di: Yang, Ziyi, et al.
Pubblicazione: (2025)
Advantage-Guided Distillation for Preference Alignment in Small Language Models
di: Gao, Shiping, et al.
Pubblicazione: (2025)
di: Gao, Shiping, et al.
Pubblicazione: (2025)
CORM: Cache Optimization with Recent Message for Large Language Model Inference
di: Dai, Jincheng, et al.
Pubblicazione: (2024)
di: Dai, Jincheng, et al.
Pubblicazione: (2024)
Not All Preference Pairs Are Created Equal: A Recipe for Annotation-Efficient Iterative Preference Learning
di: Yang, Sen, et al.
Pubblicazione: (2024)
di: Yang, Sen, et al.
Pubblicazione: (2024)
Alleviating Hallucinations of Large Language Models through Induced Hallucinations
di: Zhang, Yue, et al.
Pubblicazione: (2023)
di: Zhang, Yue, et al.
Pubblicazione: (2023)
ProactiveEval: A Unified Evaluation Framework for Proactive Dialogue Agents
di: Liu, Tianjian, et al.
Pubblicazione: (2025)
di: Liu, Tianjian, et al.
Pubblicazione: (2025)
SPELL: Self-Play Reinforcement Learning for Evolving Long-Context Language Models
di: Yang, Ziyi, et al.
Pubblicazione: (2025)
di: Yang, Ziyi, et al.
Pubblicazione: (2025)
StrategyLLM: Large Language Models as Strategy Generators, Executors, Optimizers, and Evaluators for Problem Solving
di: Gao, Chang, et al.
Pubblicazione: (2023)
di: Gao, Chang, et al.
Pubblicazione: (2023)
Self-Evolution Fine-Tuning for Policy Optimization
di: Chen, Ruijun, et al.
Pubblicazione: (2024)
di: Chen, Ruijun, et al.
Pubblicazione: (2024)
Lookahead Routing for Large Language Models
di: Huang, Canbin, et al.
Pubblicazione: (2025)
di: Huang, Canbin, et al.
Pubblicazione: (2025)
Siren's Song in the AI Ocean: A Survey on Hallucination in Large Language Models
di: Zhang, Yue, et al.
Pubblicazione: (2023)
di: Zhang, Yue, et al.
Pubblicazione: (2023)
DoG-Instruct: Towards Premium Instruction-Tuning Data via Text-Grounded Instruction Wrapping
di: Chen, Yongrui, et al.
Pubblicazione: (2023)
di: Chen, Yongrui, et al.
Pubblicazione: (2023)
Cool-Fusion: Fuse Large Language Models without Training
di: Liu, Cong, et al.
Pubblicazione: (2024)
di: Liu, Cong, et al.
Pubblicazione: (2024)
Reasons to Reject? Aligning Language Models with Judgments
di: Xu, Weiwen, et al.
Pubblicazione: (2023)
di: Xu, Weiwen, et al.
Pubblicazione: (2023)
A Frustratingly Simple Decoding Method for Neural Text Generation
di: Yang, Haoran, et al.
Pubblicazione: (2023)
di: Yang, Haoran, et al.
Pubblicazione: (2023)
Benchmarking Knowledge Boundary for Large Language Models: A Different Perspective on Model Evaluation
di: Yin, Xunjian, et al.
Pubblicazione: (2024)
di: Yin, Xunjian, et al.
Pubblicazione: (2024)
BBA: Bi-Modal Behavioral Alignment for Reasoning with Large Vision-Language Models
di: Zhao, Xueliang, et al.
Pubblicazione: (2024)
di: Zhao, Xueliang, et al.
Pubblicazione: (2024)
Knowledge Distillation of Black-Box Large Language Models
di: Chen, Hongzhan, et al.
Pubblicazione: (2024)
di: Chen, Hongzhan, et al.
Pubblicazione: (2024)
Evaluating, Understanding, and Improving Constrained Text Generation for Large Language Models
di: Chen, Xiang, et al.
Pubblicazione: (2023)
di: Chen, Xiang, et al.
Pubblicazione: (2023)
Exploring and Evaluating Multimodal Knowledge Reasoning Consistency of Multimodal Large Language Models
di: Jia, Boyu, et al.
Pubblicazione: (2025)
di: Jia, Boyu, et al.
Pubblicazione: (2025)
Retrieval is Accurate Generation
di: Cao, Bowen, et al.
Pubblicazione: (2024)
di: Cao, Bowen, et al.
Pubblicazione: (2024)
Quantity Matters: Towards Assessing and Mitigating Number Hallucination in Large Vision-Language Models
di: Zhang, Huixuan, et al.
Pubblicazione: (2024)
di: Zhang, Huixuan, et al.
Pubblicazione: (2024)
Probabilistic Token Alignment for Large Language Model Fusion
di: Zeng, Runjia, et al.
Pubblicazione: (2025)
di: Zeng, Runjia, et al.
Pubblicazione: (2025)
Stable Knowledge Editing in Large Language Models
di: Wei, Zihao, et al.
Pubblicazione: (2024)
di: Wei, Zihao, et al.
Pubblicazione: (2024)
Q-Sparse: All Large Language Models can be Fully Sparsely-Activated
di: Wang, Hongyu, et al.
Pubblicazione: (2024)
di: Wang, Hongyu, et al.
Pubblicazione: (2024)
LoKI: Low-damage Knowledge Implanting of Large Language Models
di: Wang, Runyu, et al.
Pubblicazione: (2025)
di: Wang, Runyu, et al.
Pubblicazione: (2025)
Evaluating Self-Generated Documents for Enhancing Retrieval-Augmented Generation with Large Language Models
di: Li, Jiatao, et al.
Pubblicazione: (2024)
di: Li, Jiatao, et al.
Pubblicazione: (2024)
Analyzing Cognitive Differences Among Large Language Models through the Lens of Social Worldview
di: Li, Jiatao, et al.
Pubblicazione: (2025)
di: Li, Jiatao, et al.
Pubblicazione: (2025)
PaCoST: Paired Confidence Significance Testing for Benchmark Contamination Detection in Large Language Models
di: Zhang, Huixuan, et al.
Pubblicazione: (2024)
di: Zhang, Huixuan, et al.
Pubblicazione: (2024)
Large Language Models Are Cross-Lingual Knowledge-Free Reasoners
di: Hu, Peng, et al.
Pubblicazione: (2024)
di: Hu, Peng, et al.
Pubblicazione: (2024)
The Rise of Parameter Specialization for Knowledge Storage in Large Language Models
di: Hong, Yihuai, et al.
Pubblicazione: (2025)
di: Hong, Yihuai, et al.
Pubblicazione: (2025)
Evaluating the External and Parametric Knowledge Fusion of Large Language Models
di: Zhang, Hao, et al.
Pubblicazione: (2024)
di: Zhang, Hao, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Knowledge Verification to Nip Hallucination in the Bud
di: Wan, Fanqi, et al.
Pubblicazione: (2024) -
Knowledge Fusion of Chat LLMs: A Preliminary Technical Report
di: Wan, Fanqi, et al.
Pubblicazione: (2024) -
FuseChat: Knowledge Fusion of Chat Models
di: Wan, Fanqi, et al.
Pubblicazione: (2024) -
Inferflow: an Efficient and Highly Configurable Inference Engine for Large Language Models
di: Shi, Shuming, et al.
Pubblicazione: (2024) -
Weighted-Reward Preference Optimization for Implicit Model Fusion
di: Yang, Ziyi, et al.
Pubblicazione: (2024)