Enregistré dans:
| Auteurs principaux: | Wang, Weidong, Zhu, Haoran |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | https://arxiv.org/abs/2405.03215 |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
DiOMP-Offloading: Toward Portable Distributed Heterogeneous OpenMP
par: Shan, Baodi, et autres
Publié: (2025)
par: Shan, Baodi, et autres
Publié: (2025)
OMP4Py: a pure Python implementation of OpenMP
par: Piñeiro, César, et autres
Publié: (2024)
par: Piñeiro, César, et autres
Publié: (2024)
Parallel Paradigms in Modern HPC: A Comparative Analysis of MPI, OpenMP, and CUDA
par: ALHafez, Nizar, et autres
Publié: (2025)
par: ALHafez, Nizar, et autres
Publié: (2025)
LLOR: Automated Repair of OpenMP Programs
par: Bora, Utpal, et autres
Publié: (2024)
par: Bora, Utpal, et autres
Publié: (2024)
Static Generation of Efficient OpenMP Offload Data Mappings
par: Marzen, Luke, et autres
Publié: (2024)
par: Marzen, Luke, et autres
Publié: (2024)
Developing an Interactive OpenMP Programming Book with Large Language Models
par: Yi, Xinyao, et autres
Publié: (2024)
par: Yi, Xinyao, et autres
Publié: (2024)
Towards a Scalable and Efficient PGAS-based Distributed OpenMP
par: Shan, Baodi, et autres
Publié: (2024)
par: Shan, Baodi, et autres
Publié: (2024)
Distributed OpenMP Offloading of OpenMC on Intel GPU MAX Accelerators
par: Fridman, Yehonatan, et autres
Publié: (2024)
par: Fridman, Yehonatan, et autres
Publié: (2024)
Implementing OpenMP for Zig to enable its use in HPC context
par: Kacs, David, et autres
Publié: (2024)
par: Kacs, David, et autres
Publié: (2024)
High-Performance Parallel Optimization of the Fish School Behaviour on the Setonix Platform Using OpenMP
par: Wang, Haitian, et autres
Publié: (2025)
par: Wang, Haitian, et autres
Publié: (2025)
Auto-Tuning for OpenMP Dynamic Scheduling applied to Full Waveform Inversion
par: da Silva, Felipe H. S., et autres
Publié: (2024)
par: da Silva, Felipe H. S., et autres
Publié: (2024)
Dynamic Detection of Inefficient Data Mapping Patterns in Heterogeneous OpenMP Applications
par: Marzen, Luke, et autres
Publié: (2026)
par: Marzen, Luke, et autres
Publié: (2026)
Multithreaded Fine-Grained Asynchronous BSP for Integer Sorting with LCI and OpenMP
par: Cheng, Minyu, et autres
Publié: (2026)
par: Cheng, Minyu, et autres
Publié: (2026)
Parallel FFTW on RISC-V: A Comparative Study including OpenMP, MPI, and HPX
par: Strack, Alexander, et autres
Publié: (2025)
par: Strack, Alexander, et autres
Publié: (2025)
Detrimental task execution patterns in mainstream OpenMP runtimes
par: Tuft, Adam S., et autres
Publié: (2024)
par: Tuft, Adam S., et autres
Publié: (2024)
An MLIR pipeline for offloading Fortran to FPGAs via OpenMP
par: Rodriguez-Canal, Gabriel, et autres
Publié: (2025)
par: Rodriguez-Canal, Gabriel, et autres
Publié: (2025)
A Formal Semantics of C with OpenMP Parallelism (Extended Version)
par: Du, Ke, et autres
Publié: (2026)
par: Du, Ke, et autres
Publié: (2026)
Enhanced OpenMP Algorithm to Compute All-Pairs Shortest Path on x86 Architectures
par: Calderón, Sergio, et autres
Publié: (2024)
par: Calderón, Sergio, et autres
Publié: (2024)
Porting HPC Applications to AMD Instinct$^\text{TM}$ MI300A Using Unified Memory and OpenMP
par: Tandon, Suyash, et autres
Publié: (2024)
par: Tandon, Suyash, et autres
Publié: (2024)
Pragma driven shared memory parallelism in Zig by supporting OpenMP loop directives
par: Kacs, David, et autres
Publié: (2024)
par: Kacs, David, et autres
Publié: (2024)
Enabling performance portability of data-parallel OpenMP applications on asymmetric multicore processors
par: Saez, Juan Carlos, et autres
Publié: (2024)
par: Saez, Juan Carlos, et autres
Publié: (2024)
Optimizing the Weather Research and Forecasting Model with OpenMP Offload and Codee
par: Chayanon, et autres
Publié: (2024)
par: Chayanon, et autres
Publié: (2024)
Scaling Sample-Based Quantum Diagonalization on GPU-Accelerated Systems using OpenMP Offload
par: Walkup, Robert, et autres
Publié: (2026)
par: Walkup, Robert, et autres
Publié: (2026)
OMPGPT: A Generative Pre-trained Transformer Model for OpenMP
par: Chen, Le, et autres
Publié: (2024)
par: Chen, Le, et autres
Publié: (2024)
Accelerating Particle-in-Cell Monte Carlo Simulations with MPI, OpenMP/OpenACC and Asynchronous Multi-GPU Programming
par: Williams, Jeremy J., et autres
Publié: (2024)
par: Williams, Jeremy J., et autres
Publié: (2024)
A Comparative Study of OpenMP Scheduling Algorithm Selection Strategies
par: Korndörfer, Jonas H. Müller, et autres
Publié: (2025)
par: Korndörfer, Jonas H. Müller, et autres
Publié: (2025)
LLM-HPC++: Evaluating LLM-Generated Modern C++ and MPI+OpenMP Codes for Scalable Mandelbrot Set Computation
par: Diehl, Patrick, et autres
Publié: (2025)
par: Diehl, Patrick, et autres
Publié: (2025)
DNA sequence alignment: An assignment for OpenMP, MPI, and CUDA/OpenCL
par: Gonzalez-Escribano, Arturo, et autres
Publié: (2024)
par: Gonzalez-Escribano, Arturo, et autres
Publié: (2024)
MP-SL: Multihop Parallel Split Learning
par: Tirana, Joana, et autres
Publié: (2024)
par: Tirana, Joana, et autres
Publié: (2024)
LB4OMP: A Dynamic Load Balancing Library for Multithreaded Applications
par: Korndörfer, Jonas H. Müller, et autres
Publié: (2021)
par: Korndörfer, Jonas H. Müller, et autres
Publié: (2021)
Integrating High Performance In-Memory Data Streaming and In-Situ Visualization in Hybrid MPI+OpenMP PIC MC Simulations Towards Exascale
par: Williams, Jeremy J., et autres
Publié: (2025)
par: Williams, Jeremy J., et autres
Publié: (2025)
Performant Automatic BLAS Offloading on Unified Memory Architecture with OpenMP First-Touch Style Data Movement
par: Li, Junjie
Publié: (2024)
par: Li, Junjie
Publié: (2024)
LoongTrain: Efficient Training of Long-Sequence LLMs with Head-Context Parallelism
par: Gu, Diandian, et autres
Publié: (2024)
par: Gu, Diandian, et autres
Publié: (2024)
HAP: Hybrid Adaptive Parallelism for Efficient Mixture-of-Experts Inference
par: Lin, Haoran, et autres
Publié: (2025)
par: Lin, Haoran, et autres
Publié: (2025)
StarTrail: Concentric Ring Sequence Parallelism for Efficient Near-Infinite-Context Transformer Model Training
par: Liu, Ziming, et autres
Publié: (2024)
par: Liu, Ziming, et autres
Publié: (2024)
Automated Programmatic Performance Analysis of Parallel Programs
par: Cankur, Onur, et autres
Publié: (2024)
par: Cankur, Onur, et autres
Publié: (2024)
GPU Acceleration and Portability of the TRIMEG Code for Gyrokinetic Plasma Simulations using OpenMP
par: Daneri, Giorgio
Publié: (2026)
par: Daneri, Giorgio
Publié: (2026)
SiPipe: Bridging the CPU-GPU Utilization Gap for Efficient Pipeline-Parallel LLM Inference
par: He, Yongchao, et autres
Publié: (2025)
par: He, Yongchao, et autres
Publié: (2025)
NanoCP: Request-Level Dynamic Context Parallelism for Data-Expert Parallel Decoding
par: Chen, Jiefei, et autres
Publié: (2026)
par: Chen, Jiefei, et autres
Publié: (2026)
HARP: Orchestrating Automated Parallel Training on Heterogeneous GPU Clusters
par: Liang, Antian, et autres
Publié: (2025)
par: Liang, Antian, et autres
Publié: (2025)
Documents similaires
-
DiOMP-Offloading: Toward Portable Distributed Heterogeneous OpenMP
par: Shan, Baodi, et autres
Publié: (2025) -
OMP4Py: a pure Python implementation of OpenMP
par: Piñeiro, César, et autres
Publié: (2024) -
Parallel Paradigms in Modern HPC: A Comparative Analysis of MPI, OpenMP, and CUDA
par: ALHafez, Nizar, et autres
Publié: (2025) -
LLOR: Automated Repair of OpenMP Programs
par: Bora, Utpal, et autres
Publié: (2024) -
Static Generation of Efficient OpenMP Offload Data Mappings
par: Marzen, Luke, et autres
Publié: (2024)