Cross-Family Speculative Decoding for Polish Language Models on Apple~Silicon: An Empirical Evaluation of Bielik~11B with UAG-Extended MLX-LM
Fuente:
arXiv
Guardado en:
| Autor principal: | Fonal, Krzysztof |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Bielik 7B v0.1: A Polish Language Model -- Development, Insights, and Evaluation
por: Ociepa, Krzysztof, et al.
Publicado: (2024)
por: Ociepa, Krzysztof, et al.
Publicado: (2024)
Benchmarking On-Device Machine Learning on Apple Silicon with MLX
por: Ajayi, Oluwaseun A., et al.
Publicado: (2025)
por: Ajayi, Oluwaseun A., et al.
Publicado: (2025)
Advancing Polish Language Modeling through Tokenizer Optimization in the Bielik v3 7B and 11B Series
por: Ociepa, Krzysztof, et al.
Publicado: (2026)
por: Ociepa, Krzysztof, et al.
Publicado: (2026)
Bielik-Minitron-7B: Compressing Large Language Models via Structured Pruning and Knowledge Distillation for the Polish Language
por: Kinas, Remigiusz, et al.
Publicado: (2026)
por: Kinas, Remigiusz, et al.
Publicado: (2026)
Bielik 11B v3: Multilingual Large Language Model for European Languages
por: Ociepa, Krzysztof, et al.
Publicado: (2025)
por: Ociepa, Krzysztof, et al.
Publicado: (2025)
Bielik Guard: Efficient Polish Language Safety Classifiers for LLM Content Moderation
por: Wróbel, Krzysztof, et al.
Publicado: (2026)
por: Wróbel, Krzysztof, et al.
Publicado: (2026)
Bielik 11B v2 Technical Report
por: Ociepa, Krzysztof, et al.
Publicado: (2025)
por: Ociepa, Krzysztof, et al.
Publicado: (2025)
Bielik-Q2-Sharp: A Comparative Study of Extreme 2-bit Quantization Methods for a Polish 11B Language Model
por: Prejzner, Jakub
Publicado: (2026)
por: Prejzner, Jakub
Publicado: (2026)
Bielik v3 Small: Technical Report
por: Ociepa, Krzysztof, et al.
Publicado: (2025)
por: Ociepa, Krzysztof, et al.
Publicado: (2025)
mlx-snn: Spiking Neural Networks on Apple Silicon via MLX
por: Qin, Jiahao
Publicado: (2026)
por: Qin, Jiahao
Publicado: (2026)
Dynamic Speculation Lookahead Accelerates Speculative Decoding of Large Language Models
por: Mamou, Jonathan, et al.
Publicado: (2024)
por: Mamou, Jonathan, et al.
Publicado: (2024)
Cross-Attention Speculative Decoding
por: Zhong, Wei, et al.
Publicado: (2025)
por: Zhong, Wei, et al.
Publicado: (2025)
SlimSpec: Low-Rank Draft LM-Head for Accelerated Speculative Decoding
por: Plaksin, Anton, et al.
Publicado: (2026)
por: Plaksin, Anton, et al.
Publicado: (2026)
Self Speculative Decoding for Diffusion Large Language Models
por: Gao, Yifeng, et al.
Publicado: (2025)
por: Gao, Yifeng, et al.
Publicado: (2025)
Dataset of Yul Contracts to Support Solidity Compiler Research
por: Fonal, Krzysztof
Publicado: (2025)
por: Fonal, Krzysztof
Publicado: (2025)
3-Model Speculative Decoding
por: Byun, Sanghyun, et al.
Publicado: (2025)
por: Byun, Sanghyun, et al.
Publicado: (2025)
Speculative Decoding Across Languages
por: Paudel, Nirajan, et al.
Publicado: (2026)
por: Paudel, Nirajan, et al.
Publicado: (2026)
Speculative Decoding with a Speculative Vocabulary
por: Williams, Miles, et al.
Publicado: (2026)
por: Williams, Miles, et al.
Publicado: (2026)
Decoding Speculative Decoding
por: Yan, Minghao, et al.
Publicado: (2024)
por: Yan, Minghao, et al.
Publicado: (2024)
On Speculative Decoding for Multimodal Large Language Models
por: Gagrani, Mukul, et al.
Publicado: (2024)
por: Gagrani, Mukul, et al.
Publicado: (2024)
Making Bielik LLM Reason (Better): A Field Report
por: Trybus, Adam, et al.
Publicado: (2026)
por: Trybus, Adam, et al.
Publicado: (2026)
PLLuM: A Family of Polish Large Language Models
por: Kocoń, Jan, et al.
Publicado: (2025)
por: Kocoń, Jan, et al.
Publicado: (2025)
AdaSD: Adaptive Speculative Decoding for Efficient Language Model Inference
por: Lu, Kuan-Wei, et al.
Publicado: (2025)
por: Lu, Kuan-Wei, et al.
Publicado: (2025)
Speculative Contrastive Decoding
por: Yuan, Hongyi, et al.
Publicado: (2023)
por: Yuan, Hongyi, et al.
Publicado: (2023)
DiffuSpec: Unlocking Diffusion Language Models for Speculative Decoding
por: Li, Guanghao, et al.
Publicado: (2025)
por: Li, Guanghao, et al.
Publicado: (2025)
Recurrent Drafter for Fast Speculative Decoding in Large Language Models
por: Cheng, Yunfei, et al.
Publicado: (2024)
por: Cheng, Yunfei, et al.
Publicado: (2024)
Speculate, then Collaborate: Fusing Knowledge of Language Models during Decoding
por: Wang, Ziyao, et al.
Publicado: (2025)
por: Wang, Ziyao, et al.
Publicado: (2025)
Factorization-Error-Free Discrete Diffusion Language Model via Speculative Decoding
por: Fang, Xun, et al.
Publicado: (2026)
por: Fang, Xun, et al.
Publicado: (2026)
Accelerating Mobile Language Model via Speculative Decoding and NPU-Coordinated Execution
por: Chen, Zhiyang, et al.
Publicado: (2025)
por: Chen, Zhiyang, et al.
Publicado: (2025)
Confidence-Modulated Speculative Decoding for Large Language Models
por: Sen, Jaydip, et al.
Publicado: (2025)
por: Sen, Jaydip, et al.
Publicado: (2025)
Cross-Family Speculative Prefill: Training-Free Long-Context Compression with Small Draft Models
por: Upasani, Shubhangi, et al.
Publicado: (2026)
por: Upasani, Shubhangi, et al.
Publicado: (2026)
CD4LM: Consistency Distillation and aDaptive Decoding for Diffusion Language Models
por: Liang, Yihao, et al.
Publicado: (2026)
por: Liang, Yihao, et al.
Publicado: (2026)
Multi-Candidate Speculative Decoding
por: Yang, Sen, et al.
Publicado: (2024)
por: Yang, Sen, et al.
Publicado: (2024)
Graph-Structured Speculative Decoding
por: Gong, Zhuocheng, et al.
Publicado: (2024)
por: Gong, Zhuocheng, et al.
Publicado: (2024)
Flash Interpretability: Decoding Specialised Feature Neurons in Large Language Models with the LM-Head
por: Davies, Harry J
Publicado: (2025)
por: Davies, Harry J
Publicado: (2025)
Speculative Verification: Exploiting Information Gain to Refine Speculative Decoding
por: Kim, Sungkyun, et al.
Publicado: (2025)
por: Kim, Sungkyun, et al.
Publicado: (2025)
MzansiText and MzansiLM: An Open Corpus and Decoder-Only Language Model for South African Languages
por: Lombard, Anri, et al.
Publicado: (2026)
por: Lombard, Anri, et al.
Publicado: (2026)
A Multi-Model Adaptation of Speculative Decoding for Classification
por: Roy, Somnath, et al.
Publicado: (2025)
por: Roy, Somnath, et al.
Publicado: (2025)
Draft & Verify: Lossless Large Language Model Acceleration via Self-Speculative Decoding
por: Zhang, Jun, et al.
Publicado: (2023)
por: Zhang, Jun, et al.
Publicado: (2023)
EMS-SD: Efficient Multi-sample Speculative Decoding for Accelerating Large Language Models
por: Ni, Yunsheng, et al.
Publicado: (2024)
por: Ni, Yunsheng, et al.
Publicado: (2024)
Ejemplares similares
-
Bielik 7B v0.1: A Polish Language Model -- Development, Insights, and Evaluation
por: Ociepa, Krzysztof, et al.
Publicado: (2024) -
Benchmarking On-Device Machine Learning on Apple Silicon with MLX
por: Ajayi, Oluwaseun A., et al.
Publicado: (2025) -
Advancing Polish Language Modeling through Tokenizer Optimization in the Bielik v3 7B and 11B Series
por: Ociepa, Krzysztof, et al.
Publicado: (2026) -
Bielik-Minitron-7B: Compressing Large Language Models via Structured Pruning and Knowledge Distillation for the Polish Language
por: Kinas, Remigiusz, et al.
Publicado: (2026) -
Bielik 11B v3: Multilingual Large Language Model for European Languages
por: Ociepa, Krzysztof, et al.
Publicado: (2025)