Search Results - decoding (algorithm OR Algorithmssssics)
Search alternatives:
- decoding »
- algorithm »
-
1181
SWIFT: On-the-Fly Self-Speculative Decoding for LLM Inference Acceleration
Published 2024Fuente: arXivTipo de material: PreprintAcceso al recurso -
1182
EEG-based 90-Degree Turn Intention Detection for Brain-Computer Interface
Published 2024Fuente: arXivTipo de material: PreprintAcceso al recurso -
1183
DySpec: Faster Speculative Decoding with Dynamic Token Tree Structure
Published 2024Fuente: arXivTipo de material: PreprintAcceso al recurso -
1184
High Rate Multivariate Polynomial Evaluation Codes
Published 2024Fuente: arXivTipo de material: PreprintAcceso al recurso -
1185
Two are better than one: Context window extension with multi-grained self-injection
Published 2024Fuente: arXivTipo de material: PreprintAcceso al recurso -
1186
CrackUDA: Incremental Unsupervised Domain Adaptation for Improved Crack Segmentation in Civil Structures
Published 2024Fuente: arXivTipo de material: PreprintAcceso al recurso -
1187
Remote State Estimation over Unreliable Channels with Unreliable Feedback: Strategies and Limits
Published 2025Fuente: arXivTipo de material: PreprintAcceso al recurso -
1188
Constrained Auto-Regressive Decoding Constrains Generative Retrieval
Published 2025Fuente: arXivTipo de material: PreprintAcceso al recurso -
1189
AutoJudge: Judge Decoding Without Manual Annotation
Published 2025Fuente: arXivTipo de material: PreprintAcceso al recurso -
1190
Traversal Verification for Speculative Tree Decoding
Published 2025Fuente: arXivTipo de material: PreprintAcceso al recurso -
1191
ToDRE: Effective Visual Token Pruning via Token Diversity and Task Relevance
Published 2025Fuente: arXivTipo de material: PreprintAcceso al recurso -
1192
ARECHO: Autoregressive Evaluation via Chain-Based Hypothesis Optimization for Speech Multi-Metric Estimation
Published 2025Fuente: arXivTipo de material: PreprintAcceso al recurso -
1193
Scaling Speculative Decoding with Lookahead Reasoning
Published 2025Fuente: arXivTipo de material: PreprintAcceso al recurso -
1194
Infinite Sampling: Efficient and Stable Grouped RL Training for Large Language Models
Published 2025Fuente: arXivTipo de material: PreprintAcceso al recurso -
1195
Bridging Logic and Learning: Decoding Temporal Logic Embeddings via Transformers
Published 2025Fuente: arXivTipo de material: PreprintAcceso al recurso -
1196
Dream-Coder 7B: An Open Diffusion Language Model for Code
Published 2025Fuente: arXivTipo de material: PreprintAcceso al recurso -
1197
minPIC: Towards Optimal Power Allocation in Multi-User Interference Channels
Published 2025Fuente: arXivTipo de material: PreprintAcceso al recurso -
1198
Meta-Policy Reflexion: Reusable Reflective Memory and Rule Admissibility for Resource-Efficient LLM Agent
Published 2025Fuente: arXivTipo de material: PreprintAcceso al recurso -
1199
OpenViGA: Video Generation for Automotive Driving Scenes by Streamlining and Fine-Tuning Open Source Models with Public Data
Published 2025Fuente: arXivTipo de material: PreprintAcceso al recurso -
1200
Correcting quantum errors using a classical code and one additional qubit
Published 2025Fuente: arXivTipo de material: PreprintAcceso al recurso