PLD+: Accelerating LLM inference by leveraging Language Model Artifacts
Fuente:
arXiv
Saved in:
| Main Authors: | Somasundaram, Shwetha, Phukan, Anirudh, Saxena, Apoorv |
|---|---|
| Format: | Preprint |
| Published: |
2024
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
ContextFocus: Activation Steering for Contextual Faithfulness in Large Language Models
by: Anand, Nikhil, et al.
Published: (2026)
by: Anand, Nikhil, et al.
Published: (2026)
Peering into the Mind of Language Models: An Approach for Attribution in Contextual Question Answering
by: Phukan, Anirudh, et al.
Published: (2024)
by: Phukan, Anirudh, et al.
Published: (2024)
PostDoc: Generating Poster from a Long Multimodal Document Using Deep Submodular Optimization
by: Jaisankar, Vijay, et al.
Published: (2024)
by: Jaisankar, Vijay, et al.
Published: (2024)
How Do Language Models Compose Functions?
by: Khandelwal, Apoorv, et al.
Published: (2025)
by: Khandelwal, Apoorv, et al.
Published: (2025)
Enhancing Presentation Slide Generation by LLMs with a Multi-Staged End-to-End Approach
by: Bandyopadhyay, Sambaran, et al.
Published: (2024)
by: Bandyopadhyay, Sambaran, et al.
Published: (2024)
Towards Optimizing the Costs of LLM Usage
by: Shekhar, Shivanshu, et al.
Published: (2024)
by: Shekhar, Shivanshu, et al.
Published: (2024)
Beyond Logit Lens: Contextual Embeddings for Robust Hallucination Detection & Grounding in VLMs
by: Phukan, Anirudh, et al.
Published: (2024)
by: Phukan, Anirudh, et al.
Published: (2024)
RCStat: A Statistical Framework for using Relative Contextualization in Transformers
by: Mahapatra, Debabrata, et al.
Published: (2025)
by: Mahapatra, Debabrata, et al.
Published: (2025)
FlashEVA: Accelerating LLM inference via Efficient Attention
by: Kostelec, Juan Gabriel, et al.
Published: (2025)
by: Kostelec, Juan Gabriel, et al.
Published: (2025)
When PCOS Meets Eating Disorders: An Explainable AI Approach to Detecting the Hidden Triple Burden
by: Prasad, Apoorv, et al.
Published: (2026)
by: Prasad, Apoorv, et al.
Published: (2026)
Aggregation Artifacts in Subjective Tasks Collapse Large Language Models' Posteriors
by: Chochlakis, Georgios, et al.
Published: (2024)
by: Chochlakis, Georgios, et al.
Published: (2024)
Evaluating Consistency and Reasoning Capabilities of Large Language Models
by: Saxena, Yash, et al.
Published: (2024)
by: Saxena, Yash, et al.
Published: (2024)
Two-dimensional early exit optimisation of LLM inference
by: Hůla, Jan, et al.
Published: (2026)
by: Hůla, Jan, et al.
Published: (2026)
ASTRO: Teaching Language Models to Reason by Reflecting and Backtracking In-Context
by: Kim, Joongwon, et al.
Published: (2025)
by: Kim, Joongwon, et al.
Published: (2025)
DALDALL: Data Augmentation for Lexical and Semantic Diverse in Legal Domain by leveraging LLM-Persona
by: Choi, Janghyeok, et al.
Published: (2026)
by: Choi, Janghyeok, et al.
Published: (2026)
Accelerating Multilingual Language Model for Excessively Tokenized Languages
by: Hong, Jimin, et al.
Published: (2024)
by: Hong, Jimin, et al.
Published: (2024)
Real-world validation of a multimodal LLM-powered pipeline for High-Accuracy Clinical Trial Patient Matching leveraging EHR data
by: Callies, Anatole, et al.
Published: (2025)
by: Callies, Anatole, et al.
Published: (2025)
Semantic Containment as a Fundamental Property of Emergent Misalignment
by: Saxena, Rohan
Published: (2026)
by: Saxena, Rohan
Published: (2026)
A Graph Talks, But Who's Listening? Rethinking Evaluations for Graph-Language Models
by: Petkar, Soham, et al.
Published: (2025)
by: Petkar, Soham, et al.
Published: (2025)
dLLM-Cache: Accelerating Diffusion Large Language Models with Adaptive Caching
by: Liu, Zhiyuan, et al.
Published: (2025)
by: Liu, Zhiyuan, et al.
Published: (2025)
SepLLM: Accelerate Large Language Models by Compressing One Segment into One Separator
by: Chen, Guoxuan, et al.
Published: (2024)
by: Chen, Guoxuan, et al.
Published: (2024)
Finding Culture-Sensitive Neurons in Vision-Language Models
by: Zhao, Xiutian, et al.
Published: (2025)
by: Zhao, Xiutian, et al.
Published: (2025)
Accelerating Large Language Model Reasoning via Speculative Search
by: Wang, Zhihai, et al.
Published: (2025)
by: Wang, Zhihai, et al.
Published: (2025)
Understanding and Analyzing Model Robustness and Knowledge-Transfer in Multilingual Neural Machine Translation using TX-Ray
by: Saxena, Vageesh, et al.
Published: (2024)
by: Saxena, Vageesh, et al.
Published: (2024)
A Comprehensive Survey of Accelerated Generation Techniques in Large Language Models
by: Khoshnoodi, Mahsa, et al.
Published: (2024)
by: Khoshnoodi, Mahsa, et al.
Published: (2024)
Self-Selected Attention Span for Accelerating Large Language Model Inference
by: Jin, Tian, et al.
Published: (2024)
by: Jin, Tian, et al.
Published: (2024)
Safer or Luckier? LLMs as Safety Evaluators Are Not Robust to Artifacts
by: Chen, Hongyu, et al.
Published: (2025)
by: Chen, Hongyu, et al.
Published: (2025)
HindiLLM: Large Language Model for Hindi
by: Chouhan, Sanjay, et al.
Published: (2024)
by: Chouhan, Sanjay, et al.
Published: (2024)
LLaVA-Gemma: Accelerating Multimodal Foundation Models with a Compact Language Model
by: Hinck, Musashi, et al.
Published: (2024)
by: Hinck, Musashi, et al.
Published: (2024)
Analyzing and Mitigating Negation Artifacts using Data Augmentation for Improving ELECTRA-Small Model Accuracy
by: Noghabaei, Mojtaba
Published: (2025)
by: Noghabaei, Mojtaba
Published: (2025)
MovieSum: An Abstractive Summarization Dataset for Movie Screenplays
by: Saxena, Rohit, et al.
Published: (2024)
by: Saxena, Rohit, et al.
Published: (2024)
Quantum Transformer: Accelerating model inference via quantum linear algebra
by: Guo, Naixu, et al.
Published: (2024)
by: Guo, Naixu, et al.
Published: (2024)
Search or Accelerate: Confidence-Switched Position Beam Search for Diffusion Language Models
by: Cao, Mingyu, et al.
Published: (2026)
by: Cao, Mingyu, et al.
Published: (2026)
Empowering Dysarthric Speech: Leveraging Advanced LLMs for Accurate Speech Correction and Multimodal Emotion Analysis
by: Attaluri, Kaushal, et al.
Published: (2024)
by: Attaluri, Kaushal, et al.
Published: (2024)
Political-LLM: Large Language Models in Political Science
by: Li, Lincan, et al.
Published: (2024)
by: Li, Lincan, et al.
Published: (2024)
LLM for Everyone: Representing the Underrepresented in Large Language Models
by: Cahyawijaya, Samuel
Published: (2024)
by: Cahyawijaya, Samuel
Published: (2024)
ChemLLM: A Chemical Large Language Model
by: Zhang, Di, et al.
Published: (2024)
by: Zhang, Di, et al.
Published: (2024)
MiniLLM: On-Policy Distillation of Large Language Models
by: Gu, Yuxian, et al.
Published: (2023)
by: Gu, Yuxian, et al.
Published: (2023)
BriLLM: Brain-inspired Large Language Model
by: Zhao, Hai, et al.
Published: (2025)
by: Zhao, Hai, et al.
Published: (2025)
MERaLiON-AudioLLM: Bridging Audio and Language with Large Language Models
by: He, Yingxu, et al.
Published: (2024)
by: He, Yingxu, et al.
Published: (2024)
Similar Items
-
ContextFocus: Activation Steering for Contextual Faithfulness in Large Language Models
by: Anand, Nikhil, et al.
Published: (2026) -
Peering into the Mind of Language Models: An Approach for Attribution in Contextual Question Answering
by: Phukan, Anirudh, et al.
Published: (2024) -
PostDoc: Generating Poster from a Long Multimodal Document Using Deep Submodular Optimization
by: Jaisankar, Vijay, et al.
Published: (2024) -
How Do Language Models Compose Functions?
by: Khandelwal, Apoorv, et al.
Published: (2025) -
Enhancing Presentation Slide Generation by LLMs with a Multi-Staged End-to-End Approach
by: Bandyopadhyay, Sambaran, et al.
Published: (2024)