EpiCoDe: Boosting Model Performance Beyond Training with Extrapolation and Contrastive Decoding
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Tao, Mingxu, Hu, Jie, Yang, Mingchuan, Liu, Yunhuai, Zhao, Dongyan, Feng, Yansong |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Chain-of-Discussion: A Multi-Model Framework for Complex Evidence-Based Question Answering
par: Tao, Mingxu, et autres
Publié: (2024)
par: Tao, Mingxu, et autres
Publié: (2024)
Probing Multimodal Large Language Models for Global and Local Semantic Representations
par: Tao, Mingxu, et autres
Publié: (2024)
par: Tao, Mingxu, et autres
Publié: (2024)
Unlocking the Potential of Model Merging for Low-Resource Languages
par: Tao, Mingxu, et autres
Publié: (2024)
par: Tao, Mingxu, et autres
Publié: (2024)
Can Perplexity Reflect Large Language Model's Ability in Long Text Understanding?
par: Hu, Yutong, et autres
Publié: (2024)
par: Hu, Yutong, et autres
Publié: (2024)
MiLiC-Eval: Benchmarking Multilingual LLMs for China's Minority Languages
par: Zhang, Chen, et autres
Publié: (2025)
par: Zhang, Chen, et autres
Publié: (2025)
Efficient Temporal Extrapolation of Multimodal Large Language Models with Temporal Grounding Bridge
par: Wang, Yuxuan, et autres
Publié: (2024)
par: Wang, Yuxuan, et autres
Publié: (2024)
MC$^2$: Towards Transparent and Culturally-Aware NLP for Minority Languages in China
par: Zhang, Chen, et autres
Publié: (2023)
par: Zhang, Chen, et autres
Publié: (2023)
Explaining and Improving Contrastive Decoding by Extrapolating the Probabilities of a Huge and Hypothetical LM
par: Chang, Haw-Shiuan, et autres
Publié: (2024)
par: Chang, Haw-Shiuan, et autres
Publié: (2024)
ROSE Doesn't Do That: Boosting the Safety of Instruction-Tuned Large Language Models with Reverse Prompt Contrastive Decoding
par: Zhong, Qihuang, et autres
Publié: (2024)
par: Zhong, Qihuang, et autres
Publié: (2024)
DeCoRe: Decoding by Contrasting Retrieval Heads to Mitigate Hallucinations
par: Gema, Aryo Pradipta, et autres
Publié: (2024)
par: Gema, Aryo Pradipta, et autres
Publié: (2024)
EpiCoder: Encompassing Diversity and Complexity in Code Generation
par: Wang, Yaoxiang, et autres
Publié: (2025)
par: Wang, Yaoxiang, et autres
Publié: (2025)
PilotRL: Training Language Model Agents via Global Planning-Guided Progressive Reinforcement Learning
par: Lu, Keer, et autres
Publié: (2025)
par: Lu, Keer, et autres
Publié: (2025)
Entropy Guided Extrapolative Decoding to Improve Factuality in Large Language Models
par: Das, Souvik, et autres
Publié: (2024)
par: Das, Souvik, et autres
Publié: (2024)
Only One Relation Possible? Modeling the Ambiguity in Event Temporal Relation Extraction
par: Hu, Yutong, et autres
Publié: (2024)
par: Hu, Yutong, et autres
Publié: (2024)
DiNeR: a Large Realistic Dataset for Evaluating Compositional Generalization
par: Hu, Chengang, et autres
Publié: (2024)
par: Hu, Chengang, et autres
Publié: (2024)
Parallel Decoding via Hidden Transfer for Lossless Large Language Model Acceleration
par: Wu, Pengfei, et autres
Publié: (2024)
par: Wu, Pengfei, et autres
Publié: (2024)
Graph-Structured Speculative Decoding
par: Gong, Zhuocheng, et autres
Publié: (2024)
par: Gong, Zhuocheng, et autres
Publié: (2024)
Harder Tasks Need More Experts: Dynamic Routing in MoE Models
par: Huang, Quzhe, et autres
Publié: (2024)
par: Huang, Quzhe, et autres
Publié: (2024)
Enhancing Clinical Text Classification via Fine-Tuned DRAGON Longformer Models
par: Yang, Mingchuan, et autres
Publié: (2025)
par: Yang, Mingchuan, et autres
Publié: (2025)
Length Extrapolation of Transformers: A Survey from the Perspective of Positional Encoding
par: Zhao, Liang, et autres
Publié: (2023)
par: Zhao, Liang, et autres
Publié: (2023)
Beyond Confidence: Adaptive and Coherent Decoding for Diffusion Language Models
par: Chen, Kecheng, et autres
Publié: (2025)
par: Chen, Kecheng, et autres
Publié: (2025)
ProTrix: Building Models for Planning and Reasoning over Tables with Sentence Context
par: Wu, Zirui, et autres
Publié: (2024)
par: Wu, Zirui, et autres
Publié: (2024)
Internal and External Knowledge Interactive Refinement Framework for Knowledge-Intensive Question Answering
par: Du, Haowei, et autres
Publié: (2024)
par: Du, Haowei, et autres
Publié: (2024)
In-Context Learning with Reinforcement Learning for Incomplete Utterance Rewriting
par: Du, Haowei, et autres
Publié: (2024)
par: Du, Haowei, et autres
Publié: (2024)
ELLA: Empowering LLMs for Interpretable, Accurate and Informative Legal Advice
par: Hu, Yutong, et autres
Publié: (2024)
par: Hu, Yutong, et autres
Publié: (2024)
ChemATP: A Training-Free Chemical Reasoning Framework for Large Language Models
par: Zhang, Mingxu, et autres
Publié: (2025)
par: Zhang, Mingxu, et autres
Publié: (2025)
PEO: Improving Bi-Factorial Preference Alignment with Post-Training Policy Extrapolation
par: Liu, Yuxuan
Publié: (2025)
par: Liu, Yuxuan
Publié: (2025)
What Kinds of Tokens Benefit from Distant Text? An Analysis on Long Context Language Modeling
par: Hu, Yutong, et autres
Publié: (2024)
par: Hu, Yutong, et autres
Publié: (2024)
EpiK-Eval: Evaluation for Language Models as Epistemic Models
par: Prato, Gabriele, et autres
Publié: (2023)
par: Prato, Gabriele, et autres
Publié: (2023)
EpiQAL: Benchmarking Large Language Models in Epidemiological Question Answering and Reasoning
par: Wei, Mingyang, et autres
Publié: (2026)
par: Wei, Mingyang, et autres
Publié: (2026)
EpiScreen: Early Epilepsy Detection from Electronic Health Records with Large Language Models
par: Zhou, Shuang, et autres
Publié: (2026)
par: Zhou, Shuang, et autres
Publié: (2026)
Exploring Performance Contrasts in TableQA: Step-by-Step Reasoning Boosts Bigger Language Models, Limits Smaller Language Models
par: Yang, Haoyan, et autres
Publié: (2024)
par: Yang, Haoyan, et autres
Publié: (2024)
Softplus Attention with Re-weighting Boosts Length Extrapolation in Large Language Models
par: Gao, Bo, et autres
Publié: (2025)
par: Gao, Bo, et autres
Publié: (2025)
Extrapolation Merging: Keep Improving With Extrapolation and Merging
par: Lin, Yiguan, et autres
Publié: (2025)
par: Lin, Yiguan, et autres
Publié: (2025)
Exploring Mathematical Extrapolation of Large Language Models with Synthetic Data
par: Li, Haolong, et autres
Publié: (2024)
par: Li, Haolong, et autres
Publié: (2024)
Speculative Decoding and Beyond: An In-Depth Survey of Techniques
par: Hu, Yunhai, et autres
Publié: (2025)
par: Hu, Yunhai, et autres
Publié: (2025)
Speculative Contrastive Decoding
par: Yuan, Hongyi, et autres
Publié: (2023)
par: Yuan, Hongyi, et autres
Publié: (2023)
Teaching Large Language Models an Unseen Language on the Fly
par: Zhang, Chen, et autres
Publié: (2024)
par: Zhang, Chen, et autres
Publié: (2024)
Steer Model beyond Assistant: Controlling System Prompt Strength via Contrastive Decoding
par: Dong, Yijiang River, et autres
Publié: (2026)
par: Dong, Yijiang River, et autres
Publié: (2026)
Effective Length Extrapolation via Dimension-Wise Positional Embeddings Manipulation
par: Lu, Yi, et autres
Publié: (2025)
par: Lu, Yi, et autres
Publié: (2025)
Documents similaires
-
Chain-of-Discussion: A Multi-Model Framework for Complex Evidence-Based Question Answering
par: Tao, Mingxu, et autres
Publié: (2024) -
Probing Multimodal Large Language Models for Global and Local Semantic Representations
par: Tao, Mingxu, et autres
Publié: (2024) -
Unlocking the Potential of Model Merging for Low-Resource Languages
par: Tao, Mingxu, et autres
Publié: (2024) -
Can Perplexity Reflect Large Language Model's Ability in Long Text Understanding?
par: Hu, Yutong, et autres
Publié: (2024) -
MiLiC-Eval: Benchmarking Multilingual LLMs for China's Minority Languages
par: Zhang, Chen, et autres
Publié: (2025)