Cyclic Data Streaming on GPUs for Short Range Stencils Applied to Molecular Dynamics
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Rose, Martin, Homes, Simon, Ramsperger, Lukas, Gracia, Jose, Niethammer, Christoph, Vrabec, Jadran |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Preliminary report: Initial evaluation of StdPar implementations on AMD GPUs for HPC
par: Lin, Wei-Chen, et autres
Publié: (2024)
par: Lin, Wei-Chen, et autres
Publié: (2024)
How to Rent GPUs on a Budget
par: Li, Zhouzi, et autres
Publié: (2024)
par: Li, Zhouzi, et autres
Publié: (2024)
GROMACS Unplugged: How Power Capping and Frequency Shapes Performance on GPUs
par: Afzal, Ayesha, et autres
Publié: (2025)
par: Afzal, Ayesha, et autres
Publié: (2025)
A Comprehensive Analysis of Process Energy Consumption on Multi-Socket Systems with GPUs
par: León-Vega, Luis G., et autres
Publié: (2024)
par: León-Vega, Luis G., et autres
Publié: (2024)
Bringing Auto-tuning to HIP: Analysis of Tuning Impact and Difficulty on AMD and Nvidia GPUs
par: Lurati, Milo, et autres
Publié: (2024)
par: Lurati, Milo, et autres
Publié: (2024)
Alya towards Exascale: Optimal OpenACC Performance of the Navier-Stokes Finite Element Assembly on GPUs
par: Owen, Herbert, et autres
Publié: (2024)
par: Owen, Herbert, et autres
Publié: (2024)
An Adaptive Distributed Stencil Abstraction for GPUs
par: Bhosale, Aditya, et autres
Publié: (2025)
par: Bhosale, Aditya, et autres
Publié: (2025)
Performance Optimization in Stream Processing Systems: Experiment-Driven Configuration Tuning for Kafka Streams
par: Chen, David, et autres
Publié: (2026)
par: Chen, David, et autres
Publié: (2026)
Towards Stream-Based Monitoring for EVM Networks
par: Onica, Emanuel, et autres
Publié: (2025)
par: Onica, Emanuel, et autres
Publié: (2025)
A Comparison of the Performance of the Molecular Dynamics Simulation Package GROMACS Implemented in the SYCL and CUDA Programming Models
par: Apanasevich, L., et autres
Publié: (2024)
par: Apanasevich, L., et autres
Publié: (2024)
SProBench: Stream Processing Benchmark for High Performance Computing Infrastructure
par: Kulkarni, Apurv Deepak, et autres
Publié: (2025)
par: Kulkarni, Apurv Deepak, et autres
Publié: (2025)
FluxSieve: Unifying Streaming and Analytical Data Planes for Scalable Cloud Observability
par: Vogel, Adriano, et autres
Publié: (2026)
par: Vogel, Adriano, et autres
Publié: (2026)
Fusing Depthwise and Pointwise Convolutions for Efficient Inference on GPUs
par: Qararyah, Fareed, et autres
Publié: (2024)
par: Qararyah, Fareed, et autres
Publié: (2024)
Portable High-Performance Kernel Generation for a Computational Fluid Dynamics Code with DaCe
par: Andersson, Måns I., et autres
Publié: (2025)
par: Andersson, Måns I., et autres
Publié: (2025)
Towards High-Performance and Portable Molecular Docking on CPUs through Vectorization
par: Accordi, Gianmarco, et autres
Publié: (2025)
par: Accordi, Gianmarco, et autres
Publié: (2025)
Confidential Computing on NVIDIA Hopper GPUs: A Performance Benchmark Study
par: Zhu, Jianwei, et autres
Publié: (2024)
par: Zhu, Jianwei, et autres
Publié: (2024)
AcceleratedKernels.jl: Cross-Architecture Parallel Algorithms from a Unified, Transpiled Codebase
par: Nicusan, Andrei-Leonard, et autres
Publié: (2025)
par: Nicusan, Andrei-Leonard, et autres
Publié: (2025)
Black-Scholes Option Pricing on Intel CPUs and GPUs: Implementation on SYCL and Optimization Techniques
par: Panova, Elena, et autres
Publié: (2022)
par: Panova, Elena, et autres
Publié: (2022)
Modeling and Characterizing Service Interference in Dynamic Infrastructures
par: Medel, VÍctor, et autres
Publié: (2024)
par: Medel, VÍctor, et autres
Publié: (2024)
Disaggregated Design for GPU-Based Volumetric Data Structures
par: Meneghin, Massimiliano, et autres
Publié: (2025)
par: Meneghin, Massimiliano, et autres
Publié: (2025)
Beyond Thread States: Diagnosing Performance Degradation with eBPF and Thread Dynamics
par: Landau, Diogo, et autres
Publié: (2026)
par: Landau, Diogo, et autres
Publié: (2026)
Modeling the Effect of Data Redundancy on Speedup in MLFMA Near-Field Computation
par: Sadeghi, Morteza
Publié: (2025)
par: Sadeghi, Morteza
Publié: (2025)
Data-Driven Analysis to Understand GPU Hardware Resource Usage of Optimizations
par: Islam, Tanzima Z., et autres
Publié: (2024)
par: Islam, Tanzima Z., et autres
Publié: (2024)
Matryoshka: Optimization of Dynamic Diverse Quantum Chemistry Systems via Elastic Parallelism Transformation
par: Wang, Tuowei, et autres
Publié: (2024)
par: Wang, Tuowei, et autres
Publié: (2024)
DataStates-LLM: Scalable Checkpointing for Transformer Models Using Composable State Providers
par: Maurya, Avinash, et autres
Publié: (2026)
par: Maurya, Avinash, et autres
Publié: (2026)
An Auto-tuning Method for Run-time Data Transformation for Sparse Matrix-Vector Multiplication
par: Katagiri, Takahiro, et autres
Publié: (2024)
par: Katagiri, Takahiro, et autres
Publié: (2024)
Towards a Peer-to-Peer Data Distribution Layer for Efficient and Collaborative Resource Optimization of Distributed Dataflow Applications
par: Scheinert, Dominik, et autres
Publié: (2023)
par: Scheinert, Dominik, et autres
Publié: (2023)
PlantD: Performance, Latency ANalysis, and Testing for Data Pipelines -- An Open Source Measurement, Testing, and Simulation Framework
par: Bogart, Christopher, et autres
Publié: (2025)
par: Bogart, Christopher, et autres
Publié: (2025)
InkStream: Real-time GNN Inference on Streaming Graphs via Incremental Update
par: Wu, Dan, et autres
Publié: (2023)
par: Wu, Dan, et autres
Publié: (2023)
Integrating High Performance In-Memory Data Streaming and In-Situ Visualization in Hybrid MPI+OpenMP PIC MC Simulations Towards Exascale
par: Williams, Jeremy J., et autres
Publié: (2025)
par: Williams, Jeremy J., et autres
Publié: (2025)
DiFuseR: A Distributed Sketch-based Influence Maximization Algorithm for GPUs
par: Göktürk, Gökhan, et autres
Publié: (2024)
par: Göktürk, Gökhan, et autres
Publié: (2024)
Visual Insights into Agentic Optimization of Pervasive Stream Processing Services
par: Sedlak, Boris, et autres
Publié: (2026)
par: Sedlak, Boris, et autres
Publié: (2026)
High-level Stream Processing: A Complementary Analysis of Fault Recovery
par: Vogel, Adriano, et autres
Publié: (2024)
par: Vogel, Adriano, et autres
Publié: (2024)
ZKProphet: Understanding Performance of Zero-Knowledge Proofs on GPUs
par: Verma, Tarunesh, et autres
Publié: (2025)
par: Verma, Tarunesh, et autres
Publié: (2025)
Extracting Practical, Actionable Energy Insights from Supercomputer Telemetry and Logs
par: Cornelius, Melanie, et autres
Publié: (2025)
par: Cornelius, Melanie, et autres
Publié: (2025)
Scaling Large-scale GNN Training to Thousands of Processors on CPU-based Supercomputers
par: Zhuang, Chen, et autres
Publié: (2024)
par: Zhuang, Chen, et autres
Publié: (2024)
Profiling and optimization of multi-card GPU machine learning jobs
par: Lawenda, Marcin, et autres
Publié: (2025)
par: Lawenda, Marcin, et autres
Publié: (2025)
Optimal Parallel Scheduling under Concave Speedup Functions
par: Li, Chengzhang, et autres
Publié: (2025)
par: Li, Chengzhang, et autres
Publié: (2025)
WebAssembly and Unikernels: A Comparative Study for Serverless at the Edge
par: Besozzi, Valerio, et autres
Publié: (2025)
par: Besozzi, Valerio, et autres
Publié: (2025)
Efficient GPU-Centered Singular Value Decomposition Using the Divide-and-Conquer Method
par: Liu, Shifang, et autres
Publié: (2025)
par: Liu, Shifang, et autres
Publié: (2025)
Documents similaires
-
Preliminary report: Initial evaluation of StdPar implementations on AMD GPUs for HPC
par: Lin, Wei-Chen, et autres
Publié: (2024) -
How to Rent GPUs on a Budget
par: Li, Zhouzi, et autres
Publié: (2024) -
GROMACS Unplugged: How Power Capping and Frequency Shapes Performance on GPUs
par: Afzal, Ayesha, et autres
Publié: (2025) -
A Comprehensive Analysis of Process Energy Consumption on Multi-Socket Systems with GPUs
par: León-Vega, Luis G., et autres
Publié: (2024) -
Bringing Auto-tuning to HIP: Analysis of Tuning Impact and Difficulty on AMD and Nvidia GPUs
par: Lurati, Milo, et autres
Publié: (2024)