Learning Adaptive LLM Decoding
Fuente:
arXiv
Salvato in:
| Autori principali: | Su, Chloe H., Ye, Zhe, Tenka, Samuel, Yang, Aidan, Kong, Soonho, Ghai, Udaya |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Intent-aligned Formal Specification Synthesis via Traceable Refinement
di: Ye, Zhe, et al.
Pubblicazione: (2026)
di: Ye, Zhe, et al.
Pubblicazione: (2026)
Sample-Optimal Agnostic Boosting with Unlabeled Data
di: Ghai, Udaya, et al.
Pubblicazione: (2025)
di: Ghai, Udaya, et al.
Pubblicazione: (2025)
Sample-Efficient Agnostic Boosting
di: Ghai, Udaya, et al.
Pubblicazione: (2024)
di: Ghai, Udaya, et al.
Pubblicazione: (2024)
The Bicameral Model: Bidirectional Hidden-State Coupling Between Parallel Language Models
di: Flamant, Cedric, et al.
Pubblicazione: (2026)
di: Flamant, Cedric, et al.
Pubblicazione: (2026)
Replicable Bandits with UCB based Exploration
di: Deb, Rohan, et al.
Pubblicazione: (2026)
di: Deb, Rohan, et al.
Pubblicazione: (2026)
Outbound Modeling for Inventory Management
di: Savorgnan, Riccardo, et al.
Pubblicazione: (2025)
di: Savorgnan, Riccardo, et al.
Pubblicazione: (2025)
Mind the Gap: Examining the Self-Improvement Capabilities of Large Language Models
di: Song, Yuda, et al.
Pubblicazione: (2024)
di: Song, Yuda, et al.
Pubblicazione: (2024)
Neural Coordination and Capacity Control for Inventory Management
di: Eisenach, Carson, et al.
Pubblicazione: (2024)
di: Eisenach, Carson, et al.
Pubblicazione: (2024)
Adaptive Policy Learning Under Unknown Network Interference
di: Gleich, Aidan, et al.
Pubblicazione: (2026)
di: Gleich, Aidan, et al.
Pubblicazione: (2026)
Residual Learning and Context Encoding for Adaptive Offline-to-Online Reinforcement Learning
di: Nakhaei, Mohammadreza, et al.
Pubblicazione: (2024)
di: Nakhaei, Mohammadreza, et al.
Pubblicazione: (2024)
How Does Critical Batch Size Scale in Pre-training?
di: Zhang, Hanlin, et al.
Pubblicazione: (2024)
di: Zhang, Hanlin, et al.
Pubblicazione: (2024)
Teaching LLMs Program Semantics via Symbolic Execution Traces
di: Bayer, Jonas, et al.
Pubblicazione: (2026)
di: Bayer, Jonas, et al.
Pubblicazione: (2026)
Interactive Diabetes Risk Prediction Using Explainable Machine Learning: A Dash-Based Approach with SHAP, LIME, and Comorbidity Insights
di: Allani, Udaya
Pubblicazione: (2025)
di: Allani, Udaya
Pubblicazione: (2025)
MADQRL: Distributed Quantum Reinforcement Learning Framework for Multi-Agent Environments
di: Sawaika, Abhishek, et al.
Pubblicazione: (2026)
di: Sawaika, Abhishek, et al.
Pubblicazione: (2026)
An Interpretable Latency Model for Speculative Decoding in LLM Serving
di: Kong, Linghao, et al.
Pubblicazione: (2026)
di: Kong, Linghao, et al.
Pubblicazione: (2026)
DuetServe: Harmonizing Prefill and Decode for LLM Serving via Adaptive GPU Multiplexing
di: Gao, Lei, et al.
Pubblicazione: (2025)
di: Gao, Lei, et al.
Pubblicazione: (2025)
Few-Shot Concept Unlearning with Low Rank Adaptation
di: Shreyas, Udaya, et al.
Pubblicazione: (2025)
di: Shreyas, Udaya, et al.
Pubblicazione: (2025)
Adaptive Budget Allocation in LLM-Augmented Surveys
di: Ye, Zikun, et al.
Pubblicazione: (2026)
di: Ye, Zikun, et al.
Pubblicazione: (2026)
Stroke Prediction using Clinical and Social Features in Machine Learning
di: Chadha, Aidan
Pubblicazione: (2024)
di: Chadha, Aidan
Pubblicazione: (2024)
Learning from Similar Linear Representations: Adaptivity, Minimaxity, and Robustness
di: Tian, Ye, et al.
Pubblicazione: (2023)
di: Tian, Ye, et al.
Pubblicazione: (2023)
Lean Refactor: Multi-Objective Controllable Proof Optimization via Agentic Strategy Search
di: Lu, Jialin, et al.
Pubblicazione: (2026)
di: Lu, Jialin, et al.
Pubblicazione: (2026)
Tokenized Bandit for LLM Decoding and Alignment
di: Shin, Suho, et al.
Pubblicazione: (2025)
di: Shin, Suho, et al.
Pubblicazione: (2025)
LLM Serving Optimization with Variable Prefill and Decode Lengths
di: Wang, Meixuan, et al.
Pubblicazione: (2025)
di: Wang, Meixuan, et al.
Pubblicazione: (2025)
Enhancing LLM-Based Test Generation by Eliminating Covered Code
di: Xu, WeiZhe, et al.
Pubblicazione: (2026)
di: Xu, WeiZhe, et al.
Pubblicazione: (2026)
Entropy Regularized Task Representation Learning for Offline Meta-Reinforcement Learning
di: Nakhaei, Mohammadreza, et al.
Pubblicazione: (2024)
di: Nakhaei, Mohammadreza, et al.
Pubblicazione: (2024)
AGFT: An Adaptive GPU Frequency Tuner for Real-Time LLM Inference Optimization
di: Ye, Zicong, et al.
Pubblicazione: (2025)
di: Ye, Zicong, et al.
Pubblicazione: (2025)
Predictive Pipelined Decoding: A Compute-Latency Trade-off for Exact LLM Decoding
di: Yang, Seongjun, et al.
Pubblicazione: (2023)
di: Yang, Seongjun, et al.
Pubblicazione: (2023)
FFN-SkipLLM: A Hidden Gem for Autoregressive Decoding with Adaptive Feed Forward Skipping
di: Jaiswal, Ajay, et al.
Pubblicazione: (2024)
di: Jaiswal, Ajay, et al.
Pubblicazione: (2024)
ElfCore: A 28nm Neural Processor Enabling Dynamic Structured Sparse Training and Online Self-Supervised Learning with Activity-Dependent Weight Update
di: Su, Zhe, et al.
Pubblicazione: (2025)
di: Su, Zhe, et al.
Pubblicazione: (2025)
BRIDGE: Building Representations In Domain Guided Program Synthesis
di: George, Robert Joseph, et al.
Pubblicazione: (2025)
di: George, Robert Joseph, et al.
Pubblicazione: (2025)
Unsupervised Adaptive Deep Learning Method For BCI Motor Imagery Decoding
di: Ouahidi, Yassine El, et al.
Pubblicazione: (2024)
di: Ouahidi, Yassine El, et al.
Pubblicazione: (2024)
AdaDetectGPT: Adaptive Detection of LLM-Generated Text with Statistical Guarantees
di: Zhou, Hongyi, et al.
Pubblicazione: (2025)
di: Zhou, Hongyi, et al.
Pubblicazione: (2025)
Towards a General Time Series Anomaly Detector with Adaptive Bottlenecks and Dual Adversarial Decoders
di: Shentu, Qichao, et al.
Pubblicazione: (2024)
di: Shentu, Qichao, et al.
Pubblicazione: (2024)
TeLLMe: An Energy-Efficient Ternary LLM Accelerator for Prefilling and Decoding on Edge FPGAs
di: Qiao, Ye, et al.
Pubblicazione: (2025)
di: Qiao, Ye, et al.
Pubblicazione: (2025)
Computable Model-Independent Bounds for Adversarial Quantum Machine Learning
di: Li, Bacui, et al.
Pubblicazione: (2024)
di: Li, Bacui, et al.
Pubblicazione: (2024)
OmniDraft: A Cross-vocabulary, Online Adaptive Drafter for On-device Speculative Decoding
di: Ramakrishnan, Ramchalam Kinattinkara, et al.
Pubblicazione: (2025)
di: Ramakrishnan, Ramchalam Kinattinkara, et al.
Pubblicazione: (2025)
TidalDecode: Fast and Accurate LLM Decoding with Position Persistent Sparse Attention
di: Yang, Lijie, et al.
Pubblicazione: (2024)
di: Yang, Lijie, et al.
Pubblicazione: (2024)
SPIRe: Boosting LLM Inference Throughput with Speculative Decoding
di: Neelam, Sanjit, et al.
Pubblicazione: (2025)
di: Neelam, Sanjit, et al.
Pubblicazione: (2025)
Adaptive Resolving Methods for Reinforcement Learning with Function Approximations
di: Jiang, Jiashuo, et al.
Pubblicazione: (2025)
di: Jiang, Jiashuo, et al.
Pubblicazione: (2025)
TS-DP: Reinforcement Speculative Decoding For Temporal Adaptive Diffusion Policy Acceleration
di: Li, Ye, et al.
Pubblicazione: (2025)
di: Li, Ye, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Intent-aligned Formal Specification Synthesis via Traceable Refinement
di: Ye, Zhe, et al.
Pubblicazione: (2026) -
Sample-Optimal Agnostic Boosting with Unlabeled Data
di: Ghai, Udaya, et al.
Pubblicazione: (2025) -
Sample-Efficient Agnostic Boosting
di: Ghai, Udaya, et al.
Pubblicazione: (2024) -
The Bicameral Model: Bidirectional Hidden-State Coupling Between Parallel Language Models
di: Flamant, Cedric, et al.
Pubblicazione: (2026) -
Replicable Bandits with UCB based Exploration
di: Deb, Rohan, et al.
Pubblicazione: (2026)