SpecFuse: Ensembling Large Language Models via Next-Segment Prediction
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Lv, Bo, Liu, Nayu, Tang, Chen, Liu, Xin, Yu, Yue, Luo, Ping |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
SpecExit: Accelerating Large Reasoning Model via Speculative Exit
par: Yang, Rubing, et autres
Publié: (2025)
par: Yang, Rubing, et autres
Publié: (2025)
Determine-Then-Ensemble: Necessity of Top-k Union for Large Language Model Ensembling
par: Yao, Yuxuan, et autres
Publié: (2024)
par: Yao, Yuxuan, et autres
Publié: (2024)
Mastering Text, Code and Math Simultaneously via Fusing Highly Specialized Language Models
par: Ding, Ning, et autres
Publié: (2024)
par: Ding, Ning, et autres
Publié: (2024)
GRAPHMOE: Amplifying Cognitive Depth of Mixture-of-Experts Network via Introducing Self-Rethinking Mechanism
par: Lv, Bo, et autres
Publié: (2025)
par: Lv, Bo, et autres
Publié: (2025)
ACT-MNMT Auto-Constriction Turning for Multilingual Neural Machine Translation
par: Dai, Shaojie, et autres
Publié: (2024)
par: Dai, Shaojie, et autres
Publié: (2024)
FR-Spec: Accelerating Large-Vocabulary Language Models via Frequency-Ranked Speculative Sampling
par: Zhao, Weilin, et autres
Publié: (2025)
par: Zhao, Weilin, et autres
Publié: (2025)
DiffuSpec: Unlocking Diffusion Language Models for Speculative Decoding
par: Li, Guanghao, et autres
Publié: (2025)
par: Li, Guanghao, et autres
Publié: (2025)
Collaborative Stance Detection via Small-Large Language Model Consistency Verification
par: Yan, Yu, et autres
Publié: (2025)
par: Yan, Yu, et autres
Publié: (2025)
AdaFuse: Adaptive Ensemble Decoding with Test-Time Scaling for LLMs
par: Cui, Chengming, et autres
Publié: (2026)
par: Cui, Chengming, et autres
Publié: (2026)
ES-Mem: Event Segmentation-Based Memory for Long-Term Dialogue Agents
par: Zou, Huhai, et autres
Publié: (2026)
par: Zou, Huhai, et autres
Publié: (2026)
Expediting and Elevating Large Language Model Reasoning via Hidden Chain-of-Thought Decoding
par: Liu, Tianqiao, et autres
Publié: (2024)
par: Liu, Tianqiao, et autres
Publié: (2024)
NextLocLLM: Location Semantics Modeling and Coordinate-Based Next Location Prediction with LLMs
par: Liu, Shuai, et autres
Publié: (2024)
par: Liu, Shuai, et autres
Publié: (2024)
Next Concept Prediction in Discrete Latent Space Leads to Stronger Language Models
par: Liu, Yuliang, et autres
Publié: (2026)
par: Liu, Yuliang, et autres
Publié: (2026)
Large Language Models Are Still Misled by Simple Bias Ensembles
par: Sun, Zhouhao, et autres
Publié: (2025)
par: Sun, Zhouhao, et autres
Publié: (2025)
Multi-Programming Language Ensemble for Code Generation in Large Language Model
par: Xue, Tengfei, et autres
Publié: (2024)
par: Xue, Tengfei, et autres
Publié: (2024)
A Law of Next-Token Prediction in Large Language Models
par: He, Hangfeng, et autres
Publié: (2024)
par: He, Hangfeng, et autres
Publié: (2024)
How to inject knowledge efficiently? Knowledge Infusion Scaling Law for Pre-training Large Language Models
par: Lv, Kangtao, et autres
Publié: (2025)
par: Lv, Kangtao, et autres
Publié: (2025)
Tuning Language Models by Mixture-of-Depths Ensemble
par: Luo, Haoyan, et autres
Publié: (2024)
par: Luo, Haoyan, et autres
Publié: (2024)
KALE: Enhancing Knowledge Manipulation in Large Language Models via Knowledge-aware Learning
par: Lv, Qitan, et autres
Publié: (2026)
par: Lv, Qitan, et autres
Publié: (2026)
Integrating Chemistry Knowledge in Large Language Models via Prompt Engineering
par: Liu, Hongxuan, et autres
Publié: (2024)
par: Liu, Hongxuan, et autres
Publié: (2024)
SentenceVAE: Enable Next-sentence Prediction for Large Language Models with Faster Speed, Higher Accuracy and Longer Context
par: An, Hongjun, et autres
Publié: (2024)
par: An, Hongjun, et autres
Publié: (2024)
Dissecting Failure Dynamics in Large Language Model Reasoning
par: Zhu, Wei, et autres
Publié: (2026)
par: Zhu, Wei, et autres
Publié: (2026)
FocusMed: A Large Language Model-based Framework for Enhancing Medical Question Summarization with Focus Identification
par: Liu, Chao, et autres
Publié: (2025)
par: Liu, Chao, et autres
Publié: (2025)
M-Ped: Multi-Prompt Ensemble Decoding for Large Language Models
par: Guo, Jiaxin, et autres
Publié: (2024)
par: Guo, Jiaxin, et autres
Publié: (2024)
DiffAgent: Fast and Accurate Text-to-Image API Selection with Large Language Model
par: Zhao, Lirui, et autres
Publié: (2024)
par: Zhao, Lirui, et autres
Publié: (2024)
ConfSpec: Efficient Step-Level Speculative Reasoning via Confidence-Gated Verification
par: Liu, Siran, et autres
Publié: (2026)
par: Liu, Siran, et autres
Publié: (2026)
Enhancing Large Language Models for Mobility Analytics with Semantic Location Tokenization
par: Chen, Yile, et autres
Publié: (2025)
par: Chen, Yile, et autres
Publié: (2025)
ELPO: Ensemble Learning Based Prompt Optimization for Large Language Models
par: Zhang, Qing, et autres
Publié: (2025)
par: Zhang, Qing, et autres
Publié: (2025)
Conversational Disease Diagnosis via External Planner-Controlled Large Language Models
par: Sun, Zhoujian, et autres
Publié: (2024)
par: Sun, Zhoujian, et autres
Publié: (2024)
Purifying Large Language Models by Ensembling a Small Language Model
par: Li, Tianlin, et autres
Publié: (2024)
par: Li, Tianlin, et autres
Publié: (2024)
Stress-Testing Model Specs Reveals Character Differences among Language Models
par: Zhang, Jifan, et autres
Publié: (2025)
par: Zhang, Jifan, et autres
Publié: (2025)
Segment First or Comprehend First? Explore the Limit of Unsupervised Word Segmentation with Large Language Models
par: Zhang, Zihong, et autres
Publié: (2025)
par: Zhang, Zihong, et autres
Publié: (2025)
A Comparative Study of Demonstration Selection for Practical Large Language Models-based Next POI Prediction
par: Nishida, Ryo, et autres
Publié: (2026)
par: Nishida, Ryo, et autres
Publié: (2026)
DynaSpec: Context-aware Dynamic Speculative Sampling for Large-Vocabulary Language Models
par: Zhang, Jinbin, et autres
Publié: (2025)
par: Zhang, Jinbin, et autres
Publié: (2025)
Fusing Bidirectional Chains of Thought and Reward Mechanisms A Method for Enhancing Question-Answering Capabilities of Large Language Models for Chinese Intangible Cultural Heritage
par: Liu, Ruilin, et autres
Publié: (2025)
par: Liu, Ruilin, et autres
Publié: (2025)
Collaborative Performance Prediction for Large Language Models
par: Zhang, Qiyuan, et autres
Publié: (2024)
par: Zhang, Qiyuan, et autres
Publié: (2024)
Beyond Next Token Prediction: Patch-Level Training for Large Language Models
par: Shao, Chenze, et autres
Publié: (2024)
par: Shao, Chenze, et autres
Publié: (2024)
Chimera: A Lossless Decoding Method for Accelerating Large Language Models Inference by Fusing all Tokens
par: Zeng, Ziqian, et autres
Publié: (2024)
par: Zeng, Ziqian, et autres
Publié: (2024)
Progressively Label Enhancement for Large Language Model Alignment
par: Liu, Biao, et autres
Publié: (2024)
par: Liu, Biao, et autres
Publié: (2024)
Scoring, Reasoning, and Selecting the Best! Ensembling Large Language Models via a Peer-Review Process
par: Chen, Zhijun, et autres
Publié: (2025)
par: Chen, Zhijun, et autres
Publié: (2025)
Documents similaires
-
SpecExit: Accelerating Large Reasoning Model via Speculative Exit
par: Yang, Rubing, et autres
Publié: (2025) -
Determine-Then-Ensemble: Necessity of Top-k Union for Large Language Model Ensembling
par: Yao, Yuxuan, et autres
Publié: (2024) -
Mastering Text, Code and Math Simultaneously via Fusing Highly Specialized Language Models
par: Ding, Ning, et autres
Publié: (2024) -
GRAPHMOE: Amplifying Cognitive Depth of Mixture-of-Experts Network via Introducing Self-Rethinking Mechanism
par: Lv, Bo, et autres
Publié: (2025) -
ACT-MNMT Auto-Constriction Turning for Multilingual Neural Machine Translation
par: Dai, Shaojie, et autres
Publié: (2024)