GPU-Resident Gaussian Process Regression Leveraging Asynchronous Tasks with HPX
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Möllmann, Henrik, Pflüger, Dirk, Strack, Alexander |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
A HPX Communication Benchmark: Distributed FFT using Collectives
par: Strack, Alexander, et autres
Publié: (2025)
par: Strack, Alexander, et autres
Publié: (2025)
GPRat: Gaussian Process Regression with Asynchronous Tasks
par: Helmann, Maksim, et autres
Publié: (2025)
par: Helmann, Maksim, et autres
Publié: (2025)
Is RISC-V Ready for Machine Learning? Portable Gaussian Processes Using Asynchronous Tasks
par: Strack, Alexander, et autres
Publié: (2026)
par: Strack, Alexander, et autres
Publié: (2026)
Radiation Hydrodynamics at Scale: Comparing MPI and Asynchronous Many-Task Runtimes with FleCSI
par: Strack, Alexander, et autres
Publié: (2026)
par: Strack, Alexander, et autres
Publié: (2026)
Parallel FFTW on RISC-V: A Comparative Study including OpenMP, MPI, and HPX
par: Strack, Alexander, et autres
Publié: (2025)
par: Strack, Alexander, et autres
Publié: (2025)
Experiences Porting Distributed Applications to Asynchronous Tasks: A Multidimensional FFT Case-study
par: Strack, Alexander, et autres
Publié: (2024)
par: Strack, Alexander, et autres
Publié: (2024)
Asynchronous-Many-Task Systems: Challenges and Opportunities -- Scaling an AMR Astrophysics Code on Exascale machines using Kokkos and HPX
par: Daiß, Gregor, et autres
Publié: (2024)
par: Daiß, Gregor, et autres
Publié: (2024)
Comparing the Performance of Heterogeneous Conjugate Gradient and Cholesky Solvers on Various Hardware Using SYCL
par: Thüring, Tim, et autres
Publié: (2026)
par: Thüring, Tim, et autres
Publié: (2026)
From Prompts to Performance: Evaluating LLMs for Task-based Parallel Code Generation
par: Bantel, Linus, et autres
Publié: (2026)
par: Bantel, Linus, et autres
Publié: (2026)
Understanding the Communication Needs of Asynchronous Many-Task Systems -- A Case Study of HPX+LCI
par: Yan, Jiakun, et autres
Publié: (2025)
par: Yan, Jiakun, et autres
Publié: (2025)
An Initial Evaluation of Distributed Graph Algorithms using NWGraph and HPX
par: Mohammadiporshokooh, Karame, et autres
Publié: (2026)
par: Mohammadiporshokooh, Karame, et autres
Publié: (2026)
HPX -- An open source C++ Standard Library for Parallelism and Concurrency
par: Heller, Thomas, et autres
Publié: (2023)
par: Heller, Thomas, et autres
Publié: (2023)
Closing a Source Complexity Gap between Chapel and HPX
par: Atre, Shreyas, et autres
Publié: (2025)
par: Atre, Shreyas, et autres
Publié: (2025)
GTaP: A GPU-Resident Fork-Join Task-Parallel Runtime with a Pragma-Based Interface
par: Maeda, Yuki, et autres
Publié: (2026)
par: Maeda, Yuki, et autres
Publié: (2026)
VDCores: Resource Decoupled Programming and Execution for Asynchronous GPU
par: He, Zijian, et autres
Publié: (2026)
par: He, Zijian, et autres
Publié: (2026)
AGILE: Lightweight and Efficient Asynchronous GPU-SSD Integration
par: Yang, Zhuoping, et autres
Publié: (2025)
par: Yang, Zhuoping, et autres
Publié: (2025)
Exploring Performance-Productivity Trade-offs in AMT Runtimes: A Task Bench Study of Itoyori, ItoyoriFBC, HPX, and MPI
par: Lahnor, Torben R., et autres
Publié: (2026)
par: Lahnor, Torben R., et autres
Publié: (2026)
GPU-Accelerated Modified Bessel Function of the Second Kind for Gaussian Processes
par: Geng, Zipei, et autres
Publié: (2025)
par: Geng, Zipei, et autres
Publié: (2025)
Overcoming Latency-bound Limitations of Distributed Graph Algorithms using the HPX Runtime System
par: Mohammadiporshokooh, Karame, et autres
Publié: (2026)
par: Mohammadiporshokooh, Karame, et autres
Publié: (2026)
Preparing for HPC on RISC-V: Examining Vectorization and Distributed Performance of an Astrophyiscs Application with HPX and Kokkos
par: Diehl, Patrick, et autres
Publié: (2024)
par: Diehl, Patrick, et autres
Publié: (2024)
AsyncSparse: Accelerating Sparse Matrix-Matrix Multiplication on Asynchronous GPU Architectures
par: Liu, Jie, et autres
Publié: (2026)
par: Liu, Jie, et autres
Publié: (2026)
APEX: Asynchronous Parallel CPU-GPU Execution for Online LLM Inference on Constrained GPUs
par: Fan, Jiakun, et autres
Publié: (2025)
par: Fan, Jiakun, et autres
Publié: (2025)
HPX with Spack and Singularity Containers: Evaluating Overheads for HPX/Kokkos using an astrophysics application
par: Diehl, Patrick, et autres
Publié: (2024)
par: Diehl, Patrick, et autres
Publié: (2024)
A New Execution Model and Executor for Adaptively Optimizing the Performance of Parallel Algorithms Using HPX Runtime System
par: Mohammadiporshokooh, Karame, et autres
Publié: (2025)
par: Mohammadiporshokooh, Karame, et autres
Publié: (2025)
Leveraging Mathematical Reasoning of LLMs for Efficient GPU Thread Mapping
par: Maureira, Jose, et autres
Publié: (2026)
par: Maureira, Jose, et autres
Publié: (2026)
GPU-Accelerated Vecchia Approximations of Gaussian Processes for Geospatial Data using Batched Matrix Computations
par: Pan, Qilong, et autres
Publié: (2024)
par: Pan, Qilong, et autres
Publié: (2024)
Contemplating a Lightweight Communication Interface for Asynchronous Many-Task Systems
par: Yan, Jiakun, et autres
Publié: (2025)
par: Yan, Jiakun, et autres
Publié: (2025)
Benchmarking the Parallel 1D Heat Equation Solver in Chapel, Charm++, C++, HPX, Go, Julia, Python, Rust, Swift, and Java
par: Diehl, Patrick, et autres
Publié: (2023)
par: Diehl, Patrick, et autres
Publié: (2023)
An Asynchronous Many-Task Algorithm for Unstructured $S_{N}$ Transport on Shared Memory Systems
par: Elwood, Alex, et autres
Publié: (2025)
par: Elwood, Alex, et autres
Publié: (2025)
GCAPS: GPU Context-Aware Preemptive Priority-based Scheduling for Real-Time Tasks
par: Wang, Yidi, et autres
Publié: (2024)
par: Wang, Yidi, et autres
Publié: (2024)
Optimizing Allreduce Operations for Modern Heterogeneous Architectures with Multiple Processes per GPU
par: Adams, Michael, et autres
Publié: (2025)
par: Adams, Michael, et autres
Publié: (2025)
Taking GPU Programming Models to Task for Performance Portability
par: Davis, Joshua H., et autres
Publié: (2024)
par: Davis, Joshua H., et autres
Publié: (2024)
ACGraph: An Efficient Asynchronous Out-of-Core Graph Processing Framework
par: Chen, Dechuang, et autres
Publié: (2025)
par: Chen, Dechuang, et autres
Publié: (2025)
GPU Sharing with Triples Mode
par: Byun, Chansup, et autres
Publié: (2024)
par: Byun, Chansup, et autres
Publié: (2024)
Asynchronous Checkpoint for Eventually Consistent Databases
par: Ravishankar, Raaghav, et autres
Publié: (2025)
par: Ravishankar, Raaghav, et autres
Publié: (2025)
Asynchronous Latency and Fast Atomic Snapshot
par: Bezerra, João Paulo, et autres
Publié: (2024)
par: Bezerra, João Paulo, et autres
Publié: (2024)
Byzantine Consensus in the Random Asynchronous Model
par: Danezis, George, et autres
Publié: (2025)
par: Danezis, George, et autres
Publié: (2025)
SIVF: GPU-Resident IVF Index for Streaming Vector Search
par: Zhao, Dongfang
Publié: (2026)
par: Zhao, Dongfang
Publié: (2026)
Improving GPU Multi-Tenancy Through Dynamic Multi-Instance GPU Reconfiguration
par: Wang, Tianyu, et autres
Publié: (2024)
par: Wang, Tianyu, et autres
Publié: (2024)
Lemonshark: Asynchronous DAG-BFT With Early Finality
par: Hu, Michael Yiqing, et autres
Publié: (2026)
par: Hu, Michael Yiqing, et autres
Publié: (2026)
Documents similaires
-
A HPX Communication Benchmark: Distributed FFT using Collectives
par: Strack, Alexander, et autres
Publié: (2025) -
GPRat: Gaussian Process Regression with Asynchronous Tasks
par: Helmann, Maksim, et autres
Publié: (2025) -
Is RISC-V Ready for Machine Learning? Portable Gaussian Processes Using Asynchronous Tasks
par: Strack, Alexander, et autres
Publié: (2026) -
Radiation Hydrodynamics at Scale: Comparing MPI and Asynchronous Many-Task Runtimes with FleCSI
par: Strack, Alexander, et autres
Publié: (2026) -
Parallel FFTW on RISC-V: A Comparative Study including OpenMP, MPI, and HPX
par: Strack, Alexander, et autres
Publié: (2025)