ML-Based Optimum Sub-system Size Heuristic for the GPU Implementation of the Tridiagonal Partition Method
Fuente:
arXiv
Enregistré dans:
| Auteur principal: | Veneva, Milena |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
ML-Based Optimum Number of CUDA Streams for the GPU Implementation of the Tridiagonal Partition Method
par: Veneva, Milena, et autres
Publié: (2025)
par: Veneva, Milena, et autres
Publié: (2025)
Floating Point Compression of Hierarchical Matrix Formats and its Impact on Matrix-Vector Multiplication
par: Kriemann, Ronald
Publié: (2024)
par: Kriemann, Ronald
Publié: (2024)
Mixed-Precision Performance Portability of FFT-Based GPU-Accelerated Algorithms for Block-Triangular Toeplitz Matrices
par: Venkat, Sreeram, et autres
Publié: (2025)
par: Venkat, Sreeram, et autres
Publié: (2025)
Parallel Gauss-Jordan Elimination and System Reduction for Efficient Circuit Simulation
par: Noveski, Filip, et autres
Publié: (2026)
par: Noveski, Filip, et autres
Publié: (2026)
Racing to Idle: Energy Efficiency of Matrix Multiplication on Heterogeneous CPU and GPU Architectures
par: Ansari, Mufakir Qamar, et autres
Publié: (2025)
par: Ansari, Mufakir Qamar, et autres
Publié: (2025)
Parallelization Strategies for the Randomized Kaczmarz Algorithm on Large-Scale Dense Systems
par: Ferreira, Inês, et autres
Publié: (2024)
par: Ferreira, Inês, et autres
Publié: (2024)
Adaptive time step selection for Spectral Deferred Correction
par: Saupe, Thomas, et autres
Publié: (2024)
par: Saupe, Thomas, et autres
Publié: (2024)
Resilience Against Soft Faults through Adaptivity in Spectral Deferred Correction
par: Saupe, Thomas, et autres
Publié: (2024)
par: Saupe, Thomas, et autres
Publié: (2024)
CLAIRE: Scalable GPU-Accelerated Algorithms for Diffeomorphic Image Registration in 3D
par: Mang, Andreas
Publié: (2024)
par: Mang, Andreas
Publié: (2024)
A Task Parallel Orthonormalization Multigrid Method For Multiphase Elliptic Problems
par: Toprak, Teoman, et autres
Publié: (2025)
par: Toprak, Teoman, et autres
Publié: (2025)
Accelerating Matrix Multiplication: A Performance Comparison Between Multi-Core CPU and GPU
par: Ansari, Mufakir Qamar, et autres
Publié: (2025)
par: Ansari, Mufakir Qamar, et autres
Publié: (2025)
The Performance of Low-Synchronization Variants of Reorthogonalized Block Classical Gram--Schmidt
par: Carson, Erin, et autres
Publié: (2025)
par: Carson, Erin, et autres
Publié: (2025)
nuGPR: GPU-Accelerated Gaussian Process Regression with Iterative Algorithms and Low-Rank Approximations
par: Zhao, Ziqi, et autres
Publié: (2025)
par: Zhao, Ziqi, et autres
Publié: (2025)
High-performance matrix-free unfitted finite element operator evaluation
par: Bergbauer, Maximilian, et autres
Publié: (2024)
par: Bergbauer, Maximilian, et autres
Publié: (2024)
Matrix-Free Evaluation of High-Order Shifted Boundary Finite Element Operators
par: Wichrowski, Michał
Publié: (2025)
par: Wichrowski, Michał
Publié: (2025)
Scalable Mean-Variance Portfolio Optimization via Subspace Embeddings and GPU-Friendly Nesterov-Accelerated Projected Gradient
par: Niu, Yi-Shuai, et autres
Publié: (2026)
par: Niu, Yi-Shuai, et autres
Publié: (2026)
RandNet-Parareal: a time-parallel PDE solver using Random Neural Networks
par: Gattiglio, Guglielmo, et autres
Publié: (2024)
par: Gattiglio, Guglielmo, et autres
Publié: (2024)
Symbolic Algorithm for Solving SLAEs with Multi-Diagonal Coefficient Matrices
par: Veneva, Milena
Publié: (2024)
par: Veneva, Milena
Publié: (2024)
M2L Translation Operators for Kernel Independent Fast Multipole Methods on Modern Architectures
par: Kailasa, Srinath, et autres
Publié: (2024)
par: Kailasa, Srinath, et autres
Publié: (2024)
A multigrid reduction framework for domains with symmetries
par: Alsalti-Baldellou, Àdel, et autres
Publié: (2024)
par: Alsalti-Baldellou, Àdel, et autres
Publié: (2024)
Code Generation for Near-Roofline Finite Element Actions on GPUs from Symbolic Variational Forms
par: Kulkarni, Kaushik, et autres
Publié: (2025)
par: Kulkarni, Kaushik, et autres
Publié: (2025)
Iterative Methods in GPU-Resident Linear Solvers for Nonlinear Constrained Optimization
par: Świrydowicz, Kasia, et autres
Publié: (2024)
par: Świrydowicz, Kasia, et autres
Publié: (2024)
Subspace-constrained randomized coordinate descent for linear systems with good low-rank matrix approximations
par: Lok, Jackie, et autres
Publié: (2025)
par: Lok, Jackie, et autres
Publié: (2025)
A Proximal-Gradient Method for Constrained Optimization
par: Dai, Yutong, et autres
Publié: (2024)
par: Dai, Yutong, et autres
Publié: (2024)
A multigrid method for CutFEM and its implementation on GPU
par: Cui, Cu, et autres
Publié: (2025)
par: Cui, Cu, et autres
Publié: (2025)
Accelerated primal dual fixed point algorithm
par: Zhu, Ya-Nan
Publié: (2025)
par: Zhu, Ya-Nan
Publié: (2025)
A Proximal-Gradient Method for Solving Regularized Optimization Problems with General Constraints
par: Curtis, Frank E., et autres
Publié: (2025)
par: Curtis, Frank E., et autres
Publié: (2025)
Nearest Neighbors GParareal: Improving Scalability of Gaussian Processes for Parallel-in-Time Solvers
par: Gattiglio, Guglielmo, et autres
Publié: (2024)
par: Gattiglio, Guglielmo, et autres
Publié: (2024)
Parallel performance of shared memory parallel spectral deferred corrections
par: Freese, Philip, et autres
Publié: (2024)
par: Freese, Philip, et autres
Publié: (2024)
Scaling the memory wall using mixed-precision -- HPG-MxP on an exascale machine
par: Kashi, Aditya, et autres
Publié: (2025)
par: Kashi, Aditya, et autres
Publié: (2025)
Parallel-in-time Multilevel Krylov Methods: A Prototype
par: Erlangga, Yogi A.
Publié: (2023)
par: Erlangga, Yogi A.
Publié: (2023)
Prob-GParareal: A Probabilistic Numerical Parallel-in-Time Solver for Differential Equations
par: Gattiglio, Guglielmo, et autres
Publié: (2025)
par: Gattiglio, Guglielmo, et autres
Publié: (2025)
Scalable Multilevel Monte Carlo Methods Exploiting Parallel Redistribution on Coarse Levels
par: Fairbanks, Hillary R., et autres
Publié: (2024)
par: Fairbanks, Hillary R., et autres
Publié: (2024)
Small errors in random zeroth-order optimization are imaginary
par: Jongeneel, Wouter, et autres
Publié: (2021)
par: Jongeneel, Wouter, et autres
Publié: (2021)
Parametrization and convergence of a primal-dual block-coordinate approach to linearly-constrained nonsmooth optimization
par: Bilenne, Olivier
Publié: (2024)
par: Bilenne, Olivier
Publié: (2024)
On the Relationships among GPU-Accelerated First-Order Methods for Solving Linear Programming
par: Chen, Kaihuang, et autres
Publié: (2025)
par: Chen, Kaihuang, et autres
Publié: (2025)
Low-Memory Numerical Certification
par: Breiding, Paul, et autres
Publié: (2026)
par: Breiding, Paul, et autres
Publié: (2026)
Scalable Dual Coordinate Descent for Kernel Methods
par: Shao, Zishan, et autres
Publié: (2024)
par: Shao, Zishan, et autres
Publié: (2024)
A Parareal Algorithm with Low-Rank Coarse Solvers
par: Gander, Martin J., et autres
Publié: (2025)
par: Gander, Martin J., et autres
Publié: (2025)
Optimization in Theory and Practice
par: Wright, Stephen J.
Publié: (2025)
par: Wright, Stephen J.
Publié: (2025)
Documents similaires
-
ML-Based Optimum Number of CUDA Streams for the GPU Implementation of the Tridiagonal Partition Method
par: Veneva, Milena, et autres
Publié: (2025) -
Floating Point Compression of Hierarchical Matrix Formats and its Impact on Matrix-Vector Multiplication
par: Kriemann, Ronald
Publié: (2024) -
Mixed-Precision Performance Portability of FFT-Based GPU-Accelerated Algorithms for Block-Triangular Toeplitz Matrices
par: Venkat, Sreeram, et autres
Publié: (2025) -
Parallel Gauss-Jordan Elimination and System Reduction for Efficient Circuit Simulation
par: Noveski, Filip, et autres
Publié: (2026) -
Racing to Idle: Energy Efficiency of Matrix Multiplication on Heterogeneous CPU and GPU Architectures
par: Ansari, Mufakir Qamar, et autres
Publié: (2025)