A Test for FLOPs as a Discriminant for Linear Algebra Algorithms
Fuente:
arXiv
Salvato in:
| Autori principali: | Sankaran, Aravind, Bientinesi, Paolo |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2022
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Ranking with Ties based on Noisy Performance Data
di: Sankaran, Aravind, et al.
Pubblicazione: (2024)
di: Sankaran, Aravind, et al.
Pubblicazione: (2024)
pyGinkgo: A Sparse Linear Algebra Operator Framework for Python
di: Tuteja, Keshvi, et al.
Pubblicazione: (2025)
di: Tuteja, Keshvi, et al.
Pubblicazione: (2025)
Inspection of I/O Operations from System Call Traces using Directly-Follows-Graph
di: Sankaran, Aravind, et al.
Pubblicazione: (2024)
di: Sankaran, Aravind, et al.
Pubblicazione: (2024)
Towards a Higher Roofline for Matrix-Vector Multiplication in Matrix-Free HOSFEM
di: Cao, Zijian, et al.
Pubblicazione: (2025)
di: Cao, Zijian, et al.
Pubblicazione: (2025)
RAO-SS: A Prototype of Run-time Auto-tuning Facility for Sparse Direct Solvers
di: Katagiri, Takahiro, et al.
Pubblicazione: (2024)
di: Katagiri, Takahiro, et al.
Pubblicazione: (2024)
Faster Base64 Encoding and Decoding Using AVX2 Instructions
di: Muła, Wojciech, et al.
Pubblicazione: (2017)
di: Muła, Wojciech, et al.
Pubblicazione: (2017)
Tensor Algebra Processing Primitives (TAPP): Towards a Standard for Tensor Operations
di: Brandejs, Jan, et al.
Pubblicazione: (2026)
di: Brandejs, Jan, et al.
Pubblicazione: (2026)
rcpptimer: Rcpp Tic-Toc Timer with OpenMP Support
di: Berrisch, Jonathan
Pubblicazione: (2025)
di: Berrisch, Jonathan
Pubblicazione: (2025)
A Communication Avoiding and Reducing Algorithm for Symmetric Eigenproblem for Very Small Matrices
di: Katagiri, Takahiro, et al.
Pubblicazione: (2024)
di: Katagiri, Takahiro, et al.
Pubblicazione: (2024)
Annotation-guided AoS-to-SoA conversions and GPU offloading with data views in C++
di: Radtke, Pawel K., et al.
Pubblicazione: (2025)
di: Radtke, Pawel K., et al.
Pubblicazione: (2025)
Building an Accelerated OpenFOAM Proof-of-Concept Application using Modern C++
di: Malenza, Giulio, et al.
Pubblicazione: (2025)
di: Malenza, Giulio, et al.
Pubblicazione: (2025)
DGEMM without FP64 Arithmetic - Using FP64 Emulation and FP8 Tensor Cores with Ozaki Scheme
di: Mukunoki, Daichi
Pubblicazione: (2025)
di: Mukunoki, Daichi
Pubblicazione: (2025)
Hierarchical Recursive Precision for Accelerating Symmetric Linear Solves on MXUs
di: Carrica, Vicki, et al.
Pubblicazione: (2026)
di: Carrica, Vicki, et al.
Pubblicazione: (2026)
Performant Automatic BLAS Offloading on Unified Memory Architecture with OpenMP First-Touch Style Data Movement
di: Li, Junjie
Pubblicazione: (2024)
di: Li, Junjie
Pubblicazione: (2024)
Xabclib:A Fully Auto-tuned Sparse Iterative Solver
di: Katagiri, Takahiro, et al.
Pubblicazione: (2024)
di: Katagiri, Takahiro, et al.
Pubblicazione: (2024)
Beating vDSP: A 138 GFLOPS Radix-8 Stockham FFT on Apple Silicon via Two-Tier Register-Threadgroup Memory Decomposition
di: Bergach, Mohamed Amine
Pubblicazione: (2026)
di: Bergach, Mohamed Amine
Pubblicazione: (2026)
Enabling mixed-precision with the help of tools: A Nekbone case study
di: Chen, Yanxiang, et al.
Pubblicazione: (2024)
di: Chen, Yanxiang, et al.
Pubblicazione: (2024)
Black-Scholes Option Pricing on Intel CPUs and GPUs: Implementation on SYCL and Optimization Techniques
di: Panova, Elena, et al.
Pubblicazione: (2022)
di: Panova, Elena, et al.
Pubblicazione: (2022)
Automated MPI-X code generation for scalable finite-difference solvers
di: Bisbas, George, et al.
Pubblicazione: (2023)
di: Bisbas, George, et al.
Pubblicazione: (2023)
On the energy efficiency of sparse matrix computations on multi-GPU clusters
di: Bernaschi, Massimo, et al.
Pubblicazione: (2025)
di: Bernaschi, Massimo, et al.
Pubblicazione: (2025)
NApy: Efficient Statistics in Python for Large-Scale Heterogeneous Data with Enhanced Support for Missing Data
di: Woller, Fabian, et al.
Pubblicazione: (2025)
di: Woller, Fabian, et al.
Pubblicazione: (2025)
Performance measurements of modern Fortran MPI applications with Score-P
di: Corbin, Gregor
Pubblicazione: (2025)
di: Corbin, Gregor
Pubblicazione: (2025)
Accelerating High-Order Finite Element Simulations at Extreme Scale with FP64 Tensor Cores
di: Tu, Jiqun, et al.
Pubblicazione: (2026)
di: Tu, Jiqun, et al.
Pubblicazione: (2026)
Toward Capturing Genetic Epistasis From Multivariate Genome-Wide Association Studies Using Mixed-Precision Kernel Ridge Regression
di: Ltaief, Hatem, et al.
Pubblicazione: (2024)
di: Ltaief, Hatem, et al.
Pubblicazione: (2024)
Improving the Graph Challenge Reference Implementation
di: Voloshchuk, Inna, et al.
Pubblicazione: (2026)
di: Voloshchuk, Inna, et al.
Pubblicazione: (2026)
Interface for Sparse Linear Algebra Operations
di: Abdelfattah, Ahmad, et al.
Pubblicazione: (2024)
di: Abdelfattah, Ahmad, et al.
Pubblicazione: (2024)
Compilation of Generalized Matrix Chains with Symbolic Sizes
di: López, Francisco, et al.
Pubblicazione: (2025)
di: López, Francisco, et al.
Pubblicazione: (2025)
Performance of Genetic Algorithms in the Context of Software Model Refactoring
di: Cortellessa, Vittorio, et al.
Pubblicazione: (2023)
di: Cortellessa, Vittorio, et al.
Pubblicazione: (2023)
GoldbachGPU: An Open Source GPU-Accelerated Framework for Verification of Goldbach's Conjecture
di: Llorente-Saguer, Isaac
Pubblicazione: (2026)
di: Llorente-Saguer, Isaac
Pubblicazione: (2026)
Anonymized Network Sensing Graph Challenge
di: Jananthan, Hayden, et al.
Pubblicazione: (2024)
di: Jananthan, Hayden, et al.
Pubblicazione: (2024)
Testing the Unknown: A Framework for OpenMP Testing via Random Program Generation
di: Laguna, Ignacio, et al.
Pubblicazione: (2024)
di: Laguna, Ignacio, et al.
Pubblicazione: (2024)
Acceleration of Tensor-Product Operations with Tensor Cores
di: Cui, Cu
Pubblicazione: (2024)
di: Cui, Cu
Pubblicazione: (2024)
Enabling mixed-precision in spectral element codes
di: Chen, Yanxiang, et al.
Pubblicazione: (2025)
di: Chen, Yanxiang, et al.
Pubblicazione: (2025)
Risk-Aware Batch Testing for Performance Regression Detection
di: Sayedsalehi, Ali, et al.
Pubblicazione: (2026)
di: Sayedsalehi, Ali, et al.
Pubblicazione: (2026)
Easy Acceleration with Distributed Arrays
di: Kepner, Jeremy, et al.
Pubblicazione: (2025)
di: Kepner, Jeremy, et al.
Pubblicazione: (2025)
DeepGD: A Multi-Objective Black-Box Test Selection Approach for Deep Neural Networks
di: Aghababaeyan, Zohreh, et al.
Pubblicazione: (2023)
di: Aghababaeyan, Zohreh, et al.
Pubblicazione: (2023)
Input-Gen: Guided Generation of Stateful Inputs for Testing, Tuning, and Training
di: Ivanov, Ivan R., et al.
Pubblicazione: (2024)
di: Ivanov, Ivan R., et al.
Pubblicazione: (2024)
Scalable Software as a Service Architecture
di: Dedase, Ardy
Pubblicazione: (2024)
di: Dedase, Ardy
Pubblicazione: (2024)
The Software Landscape for the Density Matrix Renormalization Group
di: Sehlstedt, Per, et al.
Pubblicazione: (2025)
di: Sehlstedt, Per, et al.
Pubblicazione: (2025)
Estimating the Energy Footprint of Software Systems: a Primer
di: Castor, Fernando
Pubblicazione: (2024)
di: Castor, Fernando
Pubblicazione: (2024)
Documenti analoghi
-
Ranking with Ties based on Noisy Performance Data
di: Sankaran, Aravind, et al.
Pubblicazione: (2024) -
pyGinkgo: A Sparse Linear Algebra Operator Framework for Python
di: Tuteja, Keshvi, et al.
Pubblicazione: (2025) -
Inspection of I/O Operations from System Call Traces using Directly-Follows-Graph
di: Sankaran, Aravind, et al.
Pubblicazione: (2024) -
Towards a Higher Roofline for Matrix-Vector Multiplication in Matrix-Free HOSFEM
di: Cao, Zijian, et al.
Pubblicazione: (2025) -
RAO-SS: A Prototype of Run-time Auto-tuning Facility for Sparse Direct Solvers
di: Katagiri, Takahiro, et al.
Pubblicazione: (2024)