Suchergebnisse - decoding (algorithmics OR (algorithmics OR (algorithm OR Algorithmsssssssssic)))
Andere Suchmöglichkeiten:
- decoding »
- algorithmics »
- algorithm »
-
1201
CommVQ: Commutative Vector Quantization for KV Cache Compression
Veröffentlicht 2025Fuente: arXivTipo de material: PreprintAcceso al recurso -
1202
Diffusion LLMs Can Do Faster-Than-AR Inference via Discrete Diffusion Forcing
Veröffentlicht 2025Fuente: arXivTipo de material: PreprintAcceso al recurso -
1203
Verifiable Quantum Advantage via Optimized DQI Circuits
Veröffentlicht 2025Fuente: arXivTipo de material: PreprintAcceso al recurso -
1204
RAS: A Bit-Exact rANS Accelerator For High-Performance Neural Lossless Compression
Veröffentlicht 2025Fuente: arXivTipo de material: PreprintAcceso al recurso -
1205
Language Drift in Multilingual Retrieval-Augmented Generation: Characterization and Decoding-Time Mitigation
Veröffentlicht 2025Fuente: arXivTipo de material: PreprintAcceso al recurso -
1206
Compiler-First State Space Duality and Portable $O(1)$ Autoregressive Caching for Inference
Veröffentlicht 2026Fuente: arXivTipo de material: PreprintAcceso al recurso -
1207
Generative Retrieval Overcomes Limitations of Dense Retrieval but Struggles with Identifier Ambiguity
Veröffentlicht 2026Fuente: arXivTipo de material: PreprintAcceso al recurso -
1208
Sampling for Quality: Training-Free Reward-Guided LLM Decoding via Sequential Monte Carlo
Veröffentlicht 2026Fuente: arXivTipo de material: PreprintAcceso al recurso -
1209
Generative Retrieval via Term Set Generation
Veröffentlicht 2023Fuente: arXivTipo de material: PreprintAcceso al recurso -
1210
Architecture and protocols for all-photonic quantum repeaters
Veröffentlicht 2023Fuente: arXivTipo de material: PreprintAcceso al recurso -
1211
Quality-Aware Dynamic Resolution Adaptation Framework for Adaptive Video Streaming
Veröffentlicht 2024Fuente: arXivTipo de material: PreprintAcceso al recurso -
1212
Light-weight Retinal Layer Segmentation with Global Reasoning
Veröffentlicht 2024Fuente: arXivTipo de material: PreprintAcceso al recurso -
1213
Smoothing Linear Codes by Rényi Divergence and Applications to Security Reduction
Veröffentlicht 2024Fuente: arXivTipo de material: PreprintAcceso al recurso -
1214
LoRA-Switch: Boosting the Efficiency of Dynamic LLM Adapters via System-Algorithm Co-design
Veröffentlicht 2024Fuente: arXivTipo de material: PreprintAcceso al recurso -
1215
CritiPrefill: A Segment-wise Criticality-based Approach for Prefilling Acceleration in LLMs
Veröffentlicht 2024Fuente: arXivTipo de material: PreprintAcceso al recurso -
1216
Single Sparse Graph Enhanced Expectation Propagation Algorithm Design for Uplink MIMO-SCMA
Veröffentlicht 2025Fuente: arXivTipo de material: PreprintAcceso al recurso -
1217
ESC-MVQ: End-to-End Semantic Communication With Multi-Codebook Vector Quantization
Veröffentlicht 2025Fuente: arXivTipo de material: PreprintAcceso al recurso -
1218
TableCenterNet: A one-stage network for table structure recognition
Veröffentlicht 2025Fuente: arXivTipo de material: PreprintAcceso al recurso -
1219
TSCL:Multi-party loss Balancing scheme for deep learning Image steganography based on Curriculum learning
Veröffentlicht 2025Fuente: arXivTipo de material: PreprintAcceso al recurso -
1220
Guiding Evolutionary AutoEncoder Training with Activation-Based Pruning Operators
Veröffentlicht 2025Fuente: arXivTipo de material: PreprintAcceso al recurso