PEDAL: Enhancing Greedy Decoding with Large Language Models using Diverse Exemplars
Fuente:
arXiv
Guardado en:
| Autor principal: | Prabhu, Sumanth |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Adapting Decoder-Based Language Models for Diverse Encoder Downstream Tasks
por: Suganthan, Paul, et al.
Publicado: (2025)
por: Suganthan, Paul, et al.
Publicado: (2025)
Accelerating Direct Preference Optimization with Prefix Sharing
por: Wang, Franklin, et al.
Publicado: (2024)
por: Wang, Franklin, et al.
Publicado: (2024)
Decoding Uncertainty: The Impact of Decoding Strategies for Uncertainty Estimation in Large Language Models
por: Hashimoto, Wataru, et al.
Publicado: (2025)
por: Hashimoto, Wataru, et al.
Publicado: (2025)
Recurrent Drafter for Fast Speculative Decoding in Large Language Models
por: Cheng, Yunfei, et al.
Publicado: (2024)
por: Cheng, Yunfei, et al.
Publicado: (2024)
FlashDecoding++: Faster Large Language Model Inference on GPUs
por: Hong, Ke, et al.
Publicado: (2023)
por: Hong, Ke, et al.
Publicado: (2023)
Decoding Rarity: Large Language Models in the Diagnosis of Rare Diseases
por: Carbonari, Valentina, et al.
Publicado: (2025)
por: Carbonari, Valentina, et al.
Publicado: (2025)
CharED: Character-wise Ensemble Decoding for Large Language Models
por: Gu, Kevin, et al.
Publicado: (2024)
por: Gu, Kevin, et al.
Publicado: (2024)
On Speculative Decoding for Multimodal Large Language Models
por: Gagrani, Mukul, et al.
Publicado: (2024)
por: Gagrani, Mukul, et al.
Publicado: (2024)
From Decoding to Meta-Generation: Inference-time Algorithms for Large Language Models
por: Welleck, Sean, et al.
Publicado: (2024)
por: Welleck, Sean, et al.
Publicado: (2024)
Machine Translation with Large Language Models: Decoder Only vs. Encoder-Decoder
por: M., Abhinav P., et al.
Publicado: (2024)
por: M., Abhinav P., et al.
Publicado: (2024)
MULTIVERSE: Exposing Large Language Model Alignment Problems in Diverse Worlds
por: Jin, Xiaolong, et al.
Publicado: (2024)
por: Jin, Xiaolong, et al.
Publicado: (2024)
Modifying Large Language Model Post-Training for Diverse Creative Writing
por: Chung, John Joon Young, et al.
Publicado: (2025)
por: Chung, John Joon Young, et al.
Publicado: (2025)
A Natural Language Processing Approach to Support Biomedical Data Harmonization: Leveraging Large Language Models
por: Li, Zexu, et al.
Publicado: (2024)
por: Li, Zexu, et al.
Publicado: (2024)
Lossless Acceleration of Large Language Model via Adaptive N-gram Parallel Decoding
por: Ou, Jie, et al.
Publicado: (2024)
por: Ou, Jie, et al.
Publicado: (2024)
Geometry-Aware Decoding with Wasserstein-Regularized Truncation and Mass Penalties for Large Language Models
por: Davoodi, Arash Gholami, et al.
Publicado: (2026)
por: Davoodi, Arash Gholami, et al.
Publicado: (2026)
TraceDet: Hallucination Detection from the Decoding Trace of Diffusion Large Language Models
por: Chang, Shenxu, et al.
Publicado: (2025)
por: Chang, Shenxu, et al.
Publicado: (2025)
Entropic-Time Inference: Self-Organizing Large Language Model Decoding Beyond Attention
por: Kiruluta, Andrew
Publicado: (2026)
por: Kiruluta, Andrew
Publicado: (2026)
Confidence-Modulated Speculative Decoding for Large Language Models
por: Sen, Jaydip, et al.
Publicado: (2025)
por: Sen, Jaydip, et al.
Publicado: (2025)
Crafting Large Language Models for Enhanced Interpretability
por: Sun, Chung-En, et al.
Publicado: (2024)
por: Sun, Chung-En, et al.
Publicado: (2024)
Beyond Quality: Unlocking Diversity in Ad Headline Generation with Large Language Models
por: Wang, Chang, et al.
Publicado: (2025)
por: Wang, Chang, et al.
Publicado: (2025)
DACTYL: Diverse Adversarial Corpus of Texts Yielded from Large Language Models
por: Thorat, Shantanu, et al.
Publicado: (2025)
por: Thorat, Shantanu, et al.
Publicado: (2025)
NGPU-LM: GPU-Accelerated N-Gram Language Model for Context-Biasing in Greedy ASR Decoding
por: Bataev, Vladimir, et al.
Publicado: (2025)
por: Bataev, Vladimir, et al.
Publicado: (2025)
Dynamic Attention-Guided Context Decoding for Mitigating Context Faithfulness Hallucinations in Large Language Models
por: Huang, Yanwen, et al.
Publicado: (2025)
por: Huang, Yanwen, et al.
Publicado: (2025)
Fast Large Language Model Collaborative Decoding via Speculation
por: Fu, Jiale, et al.
Publicado: (2025)
por: Fu, Jiale, et al.
Publicado: (2025)
The Structure of Relation Decoding Linear Operators in Large Language Models
por: Christ, Miranda Anna, et al.
Publicado: (2025)
por: Christ, Miranda Anna, et al.
Publicado: (2025)
Greedy Information Projection for LLM Data Selection
por: Dong, Victor Ye, et al.
Publicado: (2026)
por: Dong, Victor Ye, et al.
Publicado: (2026)
Learning to Decode Collaboratively with Multiple Language Models
por: Shen, Shannon Zejiang, et al.
Publicado: (2024)
por: Shen, Shannon Zejiang, et al.
Publicado: (2024)
Stability-Weighted Decoding for Diffusion Language Models
por: Wu, Yue, et al.
Publicado: (2026)
por: Wu, Yue, et al.
Publicado: (2026)
User Embedding Model for Personalized Language Prompting
por: Doddapaneni, Sumanth, et al.
Publicado: (2024)
por: Doddapaneni, Sumanth, et al.
Publicado: (2024)
DTS: Enhancing Large Reasoning Models via Decoding Tree Sketching
por: Xu, Zicheng, et al.
Publicado: (2025)
por: Xu, Zicheng, et al.
Publicado: (2025)
Entity Matching using Large Language Models
por: Peeters, Ralph, et al.
Publicado: (2023)
por: Peeters, Ralph, et al.
Publicado: (2023)
Diversity-oriented Data Augmentation with Large Language Models
por: Wang, Zaitian, et al.
Publicado: (2025)
por: Wang, Zaitian, et al.
Publicado: (2025)
The Role of Diversity in In-Context Learning for Large Language Models
por: Xiao, Wenyang, et al.
Publicado: (2025)
por: Xiao, Wenyang, et al.
Publicado: (2025)
Enhancing Authorship Attribution through Embedding Fusion: A Novel Approach with Masked and Encoder-Decoder Language Models
por: Kaushik, Arjun Ramesh, et al.
Publicado: (2024)
por: Kaushik, Arjun Ramesh, et al.
Publicado: (2024)
Exploring Embedding Priors in Prompt-Tuning for Improved Interpretability and Control
por: Sedov, Sergey, et al.
Publicado: (2024)
por: Sedov, Sergey, et al.
Publicado: (2024)
A Sober Look at Progress in Language Model Reasoning: Pitfalls and Paths to Reproducibility
por: Hochlehnert, Andreas, et al.
Publicado: (2025)
por: Hochlehnert, Andreas, et al.
Publicado: (2025)
TURNA: A Turkish Encoder-Decoder Language Model for Enhanced Understanding and Generation
por: Uludoğan, Gökçe, et al.
Publicado: (2024)
por: Uludoğan, Gökçe, et al.
Publicado: (2024)
Optimizing Multi-Task Learning for Enhanced Performance in Large Language Models
por: Qi, Zhen, et al.
Publicado: (2024)
por: Qi, Zhen, et al.
Publicado: (2024)
Question-Aware Knowledge Graph Prompting for Enhancing Large Language Models
por: Liu, Haochen, et al.
Publicado: (2025)
por: Liu, Haochen, et al.
Publicado: (2025)
SLED: Self Logits Evolution Decoding for Improving Factuality in Large Language Models
por: Zhang, Jianyi, et al.
Publicado: (2024)
por: Zhang, Jianyi, et al.
Publicado: (2024)
Ejemplares similares
-
Adapting Decoder-Based Language Models for Diverse Encoder Downstream Tasks
por: Suganthan, Paul, et al.
Publicado: (2025) -
Accelerating Direct Preference Optimization with Prefix Sharing
por: Wang, Franklin, et al.
Publicado: (2024) -
Decoding Uncertainty: The Impact of Decoding Strategies for Uncertainty Estimation in Large Language Models
por: Hashimoto, Wataru, et al.
Publicado: (2025) -
Recurrent Drafter for Fast Speculative Decoding in Large Language Models
por: Cheng, Yunfei, et al.
Publicado: (2024) -
FlashDecoding++: Faster Large Language Model Inference on GPUs
por: Hong, Ke, et al.
Publicado: (2023)