OMP-Engineer: Bridging Syntax Analysis and In-Context Learning for Efficient Automated OpenMP Parallelization
Fuente:
arXiv
Guardado en:
| Autores principales: | Wang, Weidong, Zhu, Haoran |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
DiOMP-Offloading: Toward Portable Distributed Heterogeneous OpenMP
por: Shan, Baodi, et al.
Publicado: (2025)
por: Shan, Baodi, et al.
Publicado: (2025)
OMP4Py: a pure Python implementation of OpenMP
por: Piñeiro, César, et al.
Publicado: (2024)
por: Piñeiro, César, et al.
Publicado: (2024)
Parallel Paradigms in Modern HPC: A Comparative Analysis of MPI, OpenMP, and CUDA
por: ALHafez, Nizar, et al.
Publicado: (2025)
por: ALHafez, Nizar, et al.
Publicado: (2025)
Static Generation of Efficient OpenMP Offload Data Mappings
por: Marzen, Luke, et al.
Publicado: (2024)
por: Marzen, Luke, et al.
Publicado: (2024)
LLOR: Automated Repair of OpenMP Programs
por: Bora, Utpal, et al.
Publicado: (2024)
por: Bora, Utpal, et al.
Publicado: (2024)
Developing an Interactive OpenMP Programming Book with Large Language Models
por: Yi, Xinyao, et al.
Publicado: (2024)
por: Yi, Xinyao, et al.
Publicado: (2024)
Towards a Scalable and Efficient PGAS-based Distributed OpenMP
por: Shan, Baodi, et al.
Publicado: (2024)
por: Shan, Baodi, et al.
Publicado: (2024)
Distributed OpenMP Offloading of OpenMC on Intel GPU MAX Accelerators
por: Fridman, Yehonatan, et al.
Publicado: (2024)
por: Fridman, Yehonatan, et al.
Publicado: (2024)
Implementing OpenMP for Zig to enable its use in HPC context
por: Kacs, David, et al.
Publicado: (2024)
por: Kacs, David, et al.
Publicado: (2024)
High-Performance Parallel Optimization of the Fish School Behaviour on the Setonix Platform Using OpenMP
por: Wang, Haitian, et al.
Publicado: (2025)
por: Wang, Haitian, et al.
Publicado: (2025)
Auto-Tuning for OpenMP Dynamic Scheduling applied to Full Waveform Inversion
por: da Silva, Felipe H. S., et al.
Publicado: (2024)
por: da Silva, Felipe H. S., et al.
Publicado: (2024)
Dynamic Detection of Inefficient Data Mapping Patterns in Heterogeneous OpenMP Applications
por: Marzen, Luke, et al.
Publicado: (2026)
por: Marzen, Luke, et al.
Publicado: (2026)
Multithreaded Fine-Grained Asynchronous BSP for Integer Sorting with LCI and OpenMP
por: Cheng, Minyu, et al.
Publicado: (2026)
por: Cheng, Minyu, et al.
Publicado: (2026)
Parallel FFTW on RISC-V: A Comparative Study including OpenMP, MPI, and HPX
por: Strack, Alexander, et al.
Publicado: (2025)
por: Strack, Alexander, et al.
Publicado: (2025)
Enhanced OpenMP Algorithm to Compute All-Pairs Shortest Path on x86 Architectures
por: Calderón, Sergio, et al.
Publicado: (2024)
por: Calderón, Sergio, et al.
Publicado: (2024)
Detrimental task execution patterns in mainstream OpenMP runtimes
por: Tuft, Adam S., et al.
Publicado: (2024)
por: Tuft, Adam S., et al.
Publicado: (2024)
An MLIR pipeline for offloading Fortran to FPGAs via OpenMP
por: Rodriguez-Canal, Gabriel, et al.
Publicado: (2025)
por: Rodriguez-Canal, Gabriel, et al.
Publicado: (2025)
A Formal Semantics of C with OpenMP Parallelism (Extended Version)
por: Du, Ke, et al.
Publicado: (2026)
por: Du, Ke, et al.
Publicado: (2026)
Porting HPC Applications to AMD Instinct$^\text{TM}$ MI300A Using Unified Memory and OpenMP
por: Tandon, Suyash, et al.
Publicado: (2024)
por: Tandon, Suyash, et al.
Publicado: (2024)
Pragma driven shared memory parallelism in Zig by supporting OpenMP loop directives
por: Kacs, David, et al.
Publicado: (2024)
por: Kacs, David, et al.
Publicado: (2024)
Enabling performance portability of data-parallel OpenMP applications on asymmetric multicore processors
por: Saez, Juan Carlos, et al.
Publicado: (2024)
por: Saez, Juan Carlos, et al.
Publicado: (2024)
Optimizing the Weather Research and Forecasting Model with OpenMP Offload and Codee
por: Chayanon, et al.
Publicado: (2024)
por: Chayanon, et al.
Publicado: (2024)
Scaling Sample-Based Quantum Diagonalization on GPU-Accelerated Systems using OpenMP Offload
por: Walkup, Robert, et al.
Publicado: (2026)
por: Walkup, Robert, et al.
Publicado: (2026)
OMPGPT: A Generative Pre-trained Transformer Model for OpenMP
por: Chen, Le, et al.
Publicado: (2024)
por: Chen, Le, et al.
Publicado: (2024)
Accelerating Particle-in-Cell Monte Carlo Simulations with MPI, OpenMP/OpenACC and Asynchronous Multi-GPU Programming
por: Williams, Jeremy J., et al.
Publicado: (2024)
por: Williams, Jeremy J., et al.
Publicado: (2024)
LLM-HPC++: Evaluating LLM-Generated Modern C++ and MPI+OpenMP Codes for Scalable Mandelbrot Set Computation
por: Diehl, Patrick, et al.
Publicado: (2025)
por: Diehl, Patrick, et al.
Publicado: (2025)
A Comparative Study of OpenMP Scheduling Algorithm Selection Strategies
por: Korndörfer, Jonas H. Müller, et al.
Publicado: (2025)
por: Korndörfer, Jonas H. Müller, et al.
Publicado: (2025)
DNA sequence alignment: An assignment for OpenMP, MPI, and CUDA/OpenCL
por: Gonzalez-Escribano, Arturo, et al.
Publicado: (2024)
por: Gonzalez-Escribano, Arturo, et al.
Publicado: (2024)
LB4OMP: A Dynamic Load Balancing Library for Multithreaded Applications
por: Korndörfer, Jonas H. Müller, et al.
Publicado: (2021)
por: Korndörfer, Jonas H. Müller, et al.
Publicado: (2021)
MP-SL: Multihop Parallel Split Learning
por: Tirana, Joana, et al.
Publicado: (2024)
por: Tirana, Joana, et al.
Publicado: (2024)
Integrating High Performance In-Memory Data Streaming and In-Situ Visualization in Hybrid MPI+OpenMP PIC MC Simulations Towards Exascale
por: Williams, Jeremy J., et al.
Publicado: (2025)
por: Williams, Jeremy J., et al.
Publicado: (2025)
LoongTrain: Efficient Training of Long-Sequence LLMs with Head-Context Parallelism
por: Gu, Diandian, et al.
Publicado: (2024)
por: Gu, Diandian, et al.
Publicado: (2024)
StarTrail: Concentric Ring Sequence Parallelism for Efficient Near-Infinite-Context Transformer Model Training
por: Liu, Ziming, et al.
Publicado: (2024)
por: Liu, Ziming, et al.
Publicado: (2024)
SiPipe: Bridging the CPU-GPU Utilization Gap for Efficient Pipeline-Parallel LLM Inference
por: He, Yongchao, et al.
Publicado: (2025)
por: He, Yongchao, et al.
Publicado: (2025)
HAP: Hybrid Adaptive Parallelism for Efficient Mixture-of-Experts Inference
por: Lin, Haoran, et al.
Publicado: (2025)
por: Lin, Haoran, et al.
Publicado: (2025)
Automated Programmatic Performance Analysis of Parallel Programs
por: Cankur, Onur, et al.
Publicado: (2024)
por: Cankur, Onur, et al.
Publicado: (2024)
NanoCP: Request-Level Dynamic Context Parallelism for Data-Expert Parallel Decoding
por: Chen, Jiefei, et al.
Publicado: (2026)
por: Chen, Jiefei, et al.
Publicado: (2026)
Performant Automatic BLAS Offloading on Unified Memory Architecture with OpenMP First-Touch Style Data Movement
por: Li, Junjie
Publicado: (2024)
por: Li, Junjie
Publicado: (2024)
HARP: Orchestrating Automated Parallel Training on Heterogeneous GPU Clusters
por: Liang, Antian, et al.
Publicado: (2025)
por: Liang, Antian, et al.
Publicado: (2025)
JanusPipe: Efficient Pipeline Parallel Training for Machine Learning Interatomic Potentials
por: Wang, Hongyu, et al.
Publicado: (2026)
por: Wang, Hongyu, et al.
Publicado: (2026)
Ejemplares similares
-
DiOMP-Offloading: Toward Portable Distributed Heterogeneous OpenMP
por: Shan, Baodi, et al.
Publicado: (2025) -
OMP4Py: a pure Python implementation of OpenMP
por: Piñeiro, César, et al.
Publicado: (2024) -
Parallel Paradigms in Modern HPC: A Comparative Analysis of MPI, OpenMP, and CUDA
por: ALHafez, Nizar, et al.
Publicado: (2025) -
Static Generation of Efficient OpenMP Offload Data Mappings
por: Marzen, Luke, et al.
Publicado: (2024) -
LLOR: Automated Repair of OpenMP Programs
por: Bora, Utpal, et al.
Publicado: (2024)