Résultats de la recherche - decoding (algorithmics OR (algorithmics OR (algorithm OR Algorithmsssicsicsic)))
Recherches alternatives:
- decoding »
- algorithmics »
- algorithm »
-
1201
CommVQ: Commutative Vector Quantization for KV Cache Compression
Publié 2025Fuente: arXivTipo de material: PreprintAcceso al recurso -
1202
Diffusion LLMs Can Do Faster-Than-AR Inference via Discrete Diffusion Forcing
Publié 2025Fuente: arXivTipo de material: PreprintAcceso al recurso -
1203
Verifiable Quantum Advantage via Optimized DQI Circuits
Publié 2025Fuente: arXivTipo de material: PreprintAcceso al recurso -
1204
RAS: A Bit-Exact rANS Accelerator For High-Performance Neural Lossless Compression
Publié 2025Fuente: arXivTipo de material: PreprintAcceso al recurso -
1205
Language Drift in Multilingual Retrieval-Augmented Generation: Characterization and Decoding-Time Mitigation
Publié 2025Fuente: arXivTipo de material: PreprintAcceso al recurso -
1206
Compiler-First State Space Duality and Portable $O(1)$ Autoregressive Caching for Inference
Publié 2026Fuente: arXivTipo de material: PreprintAcceso al recurso -
1207
Generative Retrieval Overcomes Limitations of Dense Retrieval but Struggles with Identifier Ambiguity
Publié 2026Fuente: arXivTipo de material: PreprintAcceso al recurso -
1208
Sampling for Quality: Training-Free Reward-Guided LLM Decoding via Sequential Monte Carlo
Publié 2026Fuente: arXivTipo de material: PreprintAcceso al recurso -
1209
Generative Retrieval via Term Set Generation
Publié 2023Fuente: arXivTipo de material: PreprintAcceso al recurso -
1210
Architecture and protocols for all-photonic quantum repeaters
Publié 2023Fuente: arXivTipo de material: PreprintAcceso al recurso -
1211
Quality-Aware Dynamic Resolution Adaptation Framework for Adaptive Video Streaming
Publié 2024Fuente: arXivTipo de material: PreprintAcceso al recurso -
1212
Light-weight Retinal Layer Segmentation with Global Reasoning
Publié 2024Fuente: arXivTipo de material: PreprintAcceso al recurso -
1213
Smoothing Linear Codes by Rényi Divergence and Applications to Security Reduction
Publié 2024Fuente: arXivTipo de material: PreprintAcceso al recurso -
1214
LoRA-Switch: Boosting the Efficiency of Dynamic LLM Adapters via System-Algorithm Co-design
Publié 2024Fuente: arXivTipo de material: PreprintAcceso al recurso -
1215
CritiPrefill: A Segment-wise Criticality-based Approach for Prefilling Acceleration in LLMs
Publié 2024Fuente: arXivTipo de material: PreprintAcceso al recurso -
1216
Single Sparse Graph Enhanced Expectation Propagation Algorithm Design for Uplink MIMO-SCMA
Publié 2025Fuente: arXivTipo de material: PreprintAcceso al recurso -
1217
ESC-MVQ: End-to-End Semantic Communication With Multi-Codebook Vector Quantization
Publié 2025Fuente: arXivTipo de material: PreprintAcceso al recurso -
1218
TableCenterNet: A one-stage network for table structure recognition
Publié 2025Fuente: arXivTipo de material: PreprintAcceso al recurso -
1219
TSCL:Multi-party loss Balancing scheme for deep learning Image steganography based on Curriculum learning
Publié 2025Fuente: arXivTipo de material: PreprintAcceso al recurso -
1220
Guiding Evolutionary AutoEncoder Training with Activation-Based Pruning Operators
Publié 2025Fuente: arXivTipo de material: PreprintAcceso al recurso