pSTL-Bench: A Micro-Benchmark Suite for Assessing Scalability of C++ Parallel STL Implementations
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Laso, Ruben, Krupitza, Diego, Hunold, Sascha |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Comparing Parallel Functional Array Languages: Programming and Performance
par: van Balen, David, et autres
Publié: (2025)
par: van Balen, David, et autres
Publié: (2025)
pPython Performance Study
par: Byun, Chansup, et autres
Publié: (2023)
par: Byun, Chansup, et autres
Publié: (2023)
TAPA: A Scalable Task-Parallel Dataflow Programming Framework for Modern FPGAs with Co-Optimization of HLS and Physical Design
par: Guo, Licheng, et autres
Publié: (2022)
par: Guo, Licheng, et autres
Publié: (2022)
Developing a Modular Compiler for a Subset of a C-like Language
par: Dutta, Debasish, et autres
Publié: (2025)
par: Dutta, Debasish, et autres
Publié: (2025)
CoNST: Code Generator for Sparse Tensor Networks
par: Raje, Saurabh, et autres
Publié: (2024)
par: Raje, Saurabh, et autres
Publié: (2024)
Simplicity Scales
par: Sampson, Andrew, et autres
Publié: (2026)
par: Sampson, Andrew, et autres
Publié: (2026)
LEGO: A Layout Expression Language for Code Generation of Hierarchical Mapping
par: Tavakkoli, Amir Mohammad, et autres
Publié: (2025)
par: Tavakkoli, Amir Mohammad, et autres
Publié: (2025)
Scheduling Languages: A Past, Present, and Future Taxonomy
par: Hall, Mary, et autres
Publié: (2024)
par: Hall, Mary, et autres
Publié: (2024)
Iterating Pointers: Enabling Static Analysis for Loop-based Pointers
par: Lepori, Andrea, et autres
Publié: (2025)
par: Lepori, Andrea, et autres
Publié: (2025)
Towards a Linear-Algebraic Hypervisor
par: Considine, Breandan
Publié: (2026)
par: Considine, Breandan
Publié: (2026)
Massimult: A Novel Parallel CPU Architecture Based on Combinator Reduction
par: Nicklisch-Franken, Jurgen, et autres
Publié: (2024)
par: Nicklisch-Franken, Jurgen, et autres
Publié: (2024)
AI-NativeBench: An Open-Source White-Box Agentic Benchmark Suite for AI-Native Systems
par: Wang, Zirui, et autres
Publié: (2026)
par: Wang, Zirui, et autres
Publié: (2026)
SProBench: Stream Processing Benchmark for High Performance Computing Infrastructure
par: Kulkarni, Apurv Deepak, et autres
Publié: (2025)
par: Kulkarni, Apurv Deepak, et autres
Publié: (2025)
Toward Scalable Docker-Based Emulations of Blockchain Networks for Research and Development
par: Pennino, Diego, et autres
Publié: (2024)
par: Pennino, Diego, et autres
Publié: (2024)
On Orchestrating Parallel Broadcasts for Distributed Ledgers
par: Sheng, Peiyao, et autres
Publié: (2024)
par: Sheng, Peiyao, et autres
Publié: (2024)
OMPILOT: Harnessing Transformer Models for Auto Parallelization to Shared Memory Computing Paradigms
par: Bhattacharjee, Arijit, et autres
Publié: (2025)
par: Bhattacharjee, Arijit, et autres
Publié: (2025)
Automated Programmatic Performance Analysis of Parallel Programs
par: Cankur, Onur, et autres
Publié: (2024)
par: Cankur, Onur, et autres
Publié: (2024)
Agentic Auto-Scheduling: An Experimental Study of LLM-Guided Loop Optimization
par: Merouani, Massinissa, et autres
Publié: (2025)
par: Merouani, Massinissa, et autres
Publié: (2025)
LOOPRAG: Enhancing Loop Transformation Optimization with Retrieval-Augmented Large Language Models
par: Zhi, Yijie, et autres
Publié: (2025)
par: Zhi, Yijie, et autres
Publié: (2025)
Linear Layouts: Robust Code Generation of Efficient Tensor Computation Using $\mathbb{F}_2$
par: Zhou, Keren, et autres
Publié: (2025)
par: Zhou, Keren, et autres
Publié: (2025)
Optimal Parallel Scheduling under Concave Speedup Functions
par: Li, Chengzhang, et autres
Publié: (2025)
par: Li, Chengzhang, et autres
Publié: (2025)
Recorder: Comprehensive Parallel I/O Tracing and Analysis
par: Wang, Chen, et autres
Publié: (2025)
par: Wang, Chen, et autres
Publié: (2025)
ParaLog: Consistent Host-side Logging for Parallel Checkpoints
par: Chien, Steven W. D., et autres
Publié: (2024)
par: Chien, Steven W. D., et autres
Publié: (2024)
Cache Blocking of Distributed-Memory Parallel Matrix Power Kernels
par: Lacey, Dane C., et autres
Publié: (2024)
par: Lacey, Dane C., et autres
Publié: (2024)
Fine-Grained Energy Prediction For Parallellized LLM Inference With PIE-P
par: Dutt, Anurag, et autres
Publié: (2025)
par: Dutt, Anurag, et autres
Publié: (2025)
Automated Calibration of Parallel and Distributed Computing Simulators: A Case Study
par: McDonald, Jesse, et autres
Publié: (2024)
par: McDonald, Jesse, et autres
Publié: (2024)
Scalable GPU Performance Variability Analysis framework
par: Lahiry, Ankur, et autres
Publié: (2025)
par: Lahiry, Ankur, et autres
Publié: (2025)
NPB-Rust: NAS Parallel Benchmarks in Rust
par: Martins, Eduardo M., et autres
Publié: (2025)
par: Martins, Eduardo M., et autres
Publié: (2025)
Fault-Tolerant Hybrid-Parallel Training at Scale with Reliable and Efficient In-memory Checkpointing
par: Wang, Yuxin, et autres
Publié: (2023)
par: Wang, Yuxin, et autres
Publié: (2023)
mLR: Scalable Laminography Reconstruction based on Memoization
par: Ma, Bin, et autres
Publié: (2025)
par: Ma, Bin, et autres
Publié: (2025)
Matryoshka: Optimization of Dynamic Diverse Quantum Chemistry Systems via Elastic Parallelism Transformation
par: Wang, Tuowei, et autres
Publié: (2024)
par: Wang, Tuowei, et autres
Publié: (2024)
CARAT: Client-Side Adaptive RPC and Cache Co-Tuning for Parallel File Systems
par: Rashid, Md Hasanur, et autres
Publié: (2026)
par: Rashid, Md Hasanur, et autres
Publié: (2026)
HeteGen: Heterogeneous Parallel Inference for Large Language Models on Resource-Constrained Devices
par: Zhao, Xuanlei, et autres
Publié: (2024)
par: Zhao, Xuanlei, et autres
Publié: (2024)
AcceleratedKernels.jl: Cross-Architecture Parallel Algorithms from a Unified, Transpiled Codebase
par: Nicusan, Andrei-Leonard, et autres
Publié: (2025)
par: Nicusan, Andrei-Leonard, et autres
Publié: (2025)
Scalable Systems and Software Architectures for High-Performance Computing on cloud platforms
par: Ramesh, Risshab Srinivas
Publié: (2024)
par: Ramesh, Risshab Srinivas
Publié: (2024)
Towards a Scalable and Efficient PGAS-based Distributed OpenMP
par: Shan, Baodi, et autres
Publié: (2024)
par: Shan, Baodi, et autres
Publié: (2024)
Parallel I/O Characterization and Optimization on Large-Scale HPC Systems: A 360-Degree Survey
par: Ather, Hammad, et autres
Publié: (2024)
par: Ather, Hammad, et autres
Publié: (2024)
Hardware-Agnostic and Insightful Efficiency Metrics for Accelerated Systems: Definition and Implementation within TALP
par: Rahimi, Ghazal, et autres
Publié: (2026)
par: Rahimi, Ghazal, et autres
Publié: (2026)
DIAL: Decentralized I/O AutoTuning via Learned Client-side Local Metrics for Parallel File System
par: Rashid, Md Hasanur, et autres
Publié: (2026)
par: Rashid, Md Hasanur, et autres
Publié: (2026)
DataStates-LLM: Scalable Checkpointing for Transformer Models Using Composable State Providers
par: Maurya, Avinash, et autres
Publié: (2026)
par: Maurya, Avinash, et autres
Publié: (2026)
Documents similaires
-
Comparing Parallel Functional Array Languages: Programming and Performance
par: van Balen, David, et autres
Publié: (2025) -
pPython Performance Study
par: Byun, Chansup, et autres
Publié: (2023) -
TAPA: A Scalable Task-Parallel Dataflow Programming Framework for Modern FPGAs with Co-Optimization of HLS and Physical Design
par: Guo, Licheng, et autres
Publié: (2022) -
Developing a Modular Compiler for a Subset of a C-like Language
par: Dutta, Debasish, et autres
Publié: (2025) -
CoNST: Code Generator for Sparse Tensor Networks
par: Raje, Saurabh, et autres
Publié: (2024)