Single-Thread JPEG Decoder Benchmarks Mis-Evaluate ML Data Loaders
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Iglovikov, Vladimir, Kosarevsky, Dmitry |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Need for Speed: A Comprehensive Benchmark of JPEG Decoders in Python
par: Iglovikov, Vladimir
Publié: (2025)
par: Iglovikov, Vladimir
Publié: (2025)
U-TOE: Universal TinyML On-board Evaluation Toolkit for Low-Power IoT
par: Huang, Zhaolan, et autres
Publié: (2023)
par: Huang, Zhaolan, et autres
Publié: (2023)
Accelerating Sparse Ternary GEMM for Quantized ML on Apple Silicon
par: Lipshitz, Baraq, et autres
Publié: (2025)
par: Lipshitz, Baraq, et autres
Publié: (2025)
KernelBenchX: A Comprehensive Benchmark for Evaluating LLM-Generated GPU Kernels
par: Wang, Han, et autres
Publié: (2026)
par: Wang, Han, et autres
Publié: (2026)
Hardware-efficient tractable probabilistic inference for TinyML Neurosymbolic AI applications
par: Leslin, Jelin, et autres
Publié: (2025)
par: Leslin, Jelin, et autres
Publié: (2025)
Steering Pretrained Drafters during Speculative Decoding
par: Berdoz, Frédéric, et autres
Publié: (2025)
par: Berdoz, Frédéric, et autres
Publié: (2025)
An Interpretable Latency Model for Speculative Decoding in LLM Serving
par: Kong, Linghao, et autres
Publié: (2026)
par: Kong, Linghao, et autres
Publié: (2026)
msf-CNN: Patch-based Multi-Stage Fusion with Convolutional Neural Networks for TinyML
par: Huang, Zhaolan, et autres
Publié: (2025)
par: Huang, Zhaolan, et autres
Publié: (2025)
Ensuring Reliability of Curated EHR-Derived Data: The Validation of Accuracy for LLM/ML-Extracted Information and Data (VALID) Framework
par: Estevez, Melissa, et autres
Publié: (2025)
par: Estevez, Melissa, et autres
Publié: (2025)
SynthEval: A Framework for Detailed Utility and Privacy Evaluation of Tabular Synthetic Data
par: Lautrup, Anton Danholt, et autres
Publié: (2024)
par: Lautrup, Anton Danholt, et autres
Publié: (2024)
Benchmarking GPUs on SVBRDF Extractor Model
par: Kandel, Narayan, et autres
Publié: (2023)
par: Kandel, Narayan, et autres
Publié: (2023)
The Next 700 ML-Enabled Compiler Optimizations
par: VenkataKeerthy, S., et autres
Publié: (2023)
par: VenkataKeerthy, S., et autres
Publié: (2023)
CEBench: A Benchmarking Toolkit for the Cost-Effectiveness of LLM Pipelines
par: Sun, Wenbo, et autres
Publié: (2024)
par: Sun, Wenbo, et autres
Publié: (2024)
Understanding the Performance Horizon of the Latest ML Workloads with NonGEMM Workloads
par: Karami, Rachid, et autres
Publié: (2024)
par: Karami, Rachid, et autres
Publié: (2024)
Greener Deep Reinforcement Learning: Analysis of Energy and Carbon Efficiency Across Atari Benchmarks
par: Gardner, Jason, et autres
Publié: (2025)
par: Gardner, Jason, et autres
Publié: (2025)
Towards Computational Performance Engineering for Unsupervised Concept Drift Detection -- Complexities, Benchmarking, Performance Analysis
par: Werner, Elias, et autres
Publié: (2023)
par: Werner, Elias, et autres
Publié: (2023)
Concorde: Fast and Accurate CPU Performance Modeling with Compositional Analytical-ML Fusion
par: Nasr-Esfahany, Arash, et autres
Publié: (2025)
par: Nasr-Esfahany, Arash, et autres
Publié: (2025)
MoE-Inference-Bench: Performance Evaluation of Mixture of Expert Large Language and Vision Models
par: Chitty-Venkata, Krishna Teja, et autres
Publié: (2025)
par: Chitty-Venkata, Krishna Teja, et autres
Publié: (2025)
Large-Scale Data Parallelization of Product Quantization and Inverted Indexing Using Dask
par: Abraham, Ashley N., et autres
Publié: (2026)
par: Abraham, Ashley N., et autres
Publié: (2026)
Plug-and-Play Performance Estimation for LLM Services without Relying on Labeled Data
par: Wang, Can, et autres
Publié: (2024)
par: Wang, Can, et autres
Publié: (2024)
Prefill vs. Decode Bottlenecks: SRAM-Frequency Tradeoffs and the Memory-Bandwidth Ceiling
par: Atmer, Hannah, et autres
Publié: (2025)
par: Atmer, Hannah, et autres
Publié: (2025)
Development and Comparative Evaluation of Three Artificial Intelligence Models (NLP, LLM, JEPA) for Predicting Triage in Emergency Departments: A 7-Month Retrospective Proof-of-Concept
par: Lansiaux, Edouard, et autres
Publié: (2025)
par: Lansiaux, Edouard, et autres
Publié: (2025)
Enabling more efficient and cost-effective AI/ML systems with Collective Mind, virtualized MLOps, MLPerf, Collective Knowledge Playground and reproducible optimization tournaments
par: Fursin, Grigori
Publié: (2024)
par: Fursin, Grigori
Publié: (2024)
VDTuner: Automated Performance Tuning for Vector Data Management Systems
par: Yang, Tiannuo, et autres
Publié: (2024)
par: Yang, Tiannuo, et autres
Publié: (2024)
Efficient Solving of Large Single Input Superstate Decomposable Markovian Decision Process
par: Mahjoub, Youssef Ait El, et autres
Publié: (2025)
par: Mahjoub, Youssef Ait El, et autres
Publié: (2025)
Evaluating the Efficacy of Foundational Models: Advancing Benchmarking Practices to Enhance Fine-Tuning Decision-Making
par: Amujo, Oluyemi Enoch, et autres
Publié: (2024)
par: Amujo, Oluyemi Enoch, et autres
Publié: (2024)
LLM Swiss Round: Aggregating Multi-Benchmark Performance via Competitive Swiss-System Dynamics
par: Liu, Jiashuo, et autres
Publié: (2025)
par: Liu, Jiashuo, et autres
Publié: (2025)
Catastrophic Cyber Capabilities Benchmark (3CB): Robustly Evaluating LLM Agent Cyber Offense Capabilities
par: Anurin, Andrey, et autres
Publié: (2024)
par: Anurin, Andrey, et autres
Publié: (2024)
Accelerating Diffusion LLMs via Adaptive Parallel Decoding
par: Israel, Daniel, et autres
Publié: (2025)
par: Israel, Daniel, et autres
Publié: (2025)
Ariel-ML: Computing Parallelization with Embedded Rust for Neural Networks on Heterogeneous Multi-core Microcontrollers
par: Huang, Zhaolan, et autres
Publié: (2025)
par: Huang, Zhaolan, et autres
Publié: (2025)
ModeSwitch-LLM: A Lightweight Phase-Aware Controller for Cross-Mode LLM Inference on a Single GPU
par: Sunesh, Aman, et autres
Publié: (2026)
par: Sunesh, Aman, et autres
Publié: (2026)
Machine Learning Methods for Evaluating Public Crisis: Meta-Analysis
par: Okpala, Izunna, et autres
Publié: (2023)
par: Okpala, Izunna, et autres
Publié: (2023)
Systematic Evaluation of Optimization Techniques for Long-Context Language Models
par: Ahmed, Ammar, et autres
Publié: (2025)
par: Ahmed, Ammar, et autres
Publié: (2025)
KIVI: A Tuning-Free Asymmetric 2bit Quantization for KV Cache
par: Liu, Zirui, et autres
Publié: (2024)
par: Liu, Zirui, et autres
Publié: (2024)
Toward A Formalized Approach for Spike Sorting Algorithms and Hardware Evaluation
par: Zhang, Tim, et autres
Publié: (2022)
par: Zhang, Tim, et autres
Publié: (2022)
GPU-Accelerated INT8 Quantization for KV Cache Compression in Large Language Models
par: Taneja, Maanas, et autres
Publié: (2026)
par: Taneja, Maanas, et autres
Publié: (2026)
MarginGate: Sparse Margin-Triggered Verification for Batch-Invariant LLM Inference
par: Chu, Kexin, et autres
Publié: (2026)
par: Chu, Kexin, et autres
Publié: (2026)
Reducing Compute Waste in LLMs through Kernel-Level DVFS
par: Spaan, Jeffrey, et autres
Publié: (2026)
par: Spaan, Jeffrey, et autres
Publié: (2026)
GreenServ: Energy-Efficient Context-Aware Dynamic Routing for Multi-Model LLM Inference
par: Ziller, Thomas, et autres
Publié: (2026)
par: Ziller, Thomas, et autres
Publié: (2026)
Approximating Uniform Random Rotations by Two-Block Structured Hadamard Rotations in High Dimensions
par: Zilca, Tomer, et autres
Publié: (2026)
par: Zilca, Tomer, et autres
Publié: (2026)
Documents similaires
-
Need for Speed: A Comprehensive Benchmark of JPEG Decoders in Python
par: Iglovikov, Vladimir
Publié: (2025) -
U-TOE: Universal TinyML On-board Evaluation Toolkit for Low-Power IoT
par: Huang, Zhaolan, et autres
Publié: (2023) -
Accelerating Sparse Ternary GEMM for Quantized ML on Apple Silicon
par: Lipshitz, Baraq, et autres
Publié: (2025) -
KernelBenchX: A Comprehensive Benchmark for Evaluating LLM-Generated GPU Kernels
par: Wang, Han, et autres
Publié: (2026) -
Hardware-efficient tractable probabilistic inference for TinyML Neurosymbolic AI applications
par: Leslin, Jelin, et autres
Publié: (2025)