Salvato in:
| Autori principali: | Xue, Weicheng, Roy, Christohper John |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2023
|
| Soggetti: | |
| Accesso online: | https://arxiv.org/abs/2306.14011 |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Characterizing Machine Learning Force Fields as Emerging Molecular Dynamics Workloads on Graphics Processing Units
di: De Alwis, Udari, et al.
Pubblicazione: (2026)
di: De Alwis, Udari, et al.
Pubblicazione: (2026)
Integrating ytopt and libEnsemble to Autotune OpenMC
di: Wu, Xingfu, et al.
Pubblicazione: (2024)
di: Wu, Xingfu, et al.
Pubblicazione: (2024)
Portable High-Performance Kernel Generation for a Computational Fluid Dynamics Code with DaCe
di: Andersson, Måns I., et al.
Pubblicazione: (2025)
di: Andersson, Måns I., et al.
Pubblicazione: (2025)
HPC Application Parameter Autotuning on Edge Devices: A Bandit Learning Approach
di: Hossain, Abrar, et al.
Pubblicazione: (2025)
di: Hossain, Abrar, et al.
Pubblicazione: (2025)
Understanding the Impact of Synchronous, Asynchronous, and Hybrid In-Situ Techniques in Computational Fluid Dynamics Applications
di: Ju, Yi, et al.
Pubblicazione: (2024)
di: Ju, Yi, et al.
Pubblicazione: (2024)
Accelerating Machine Learning Queries with Linear Algebra Query Processing
di: Sun, Wenbo, et al.
Pubblicazione: (2023)
di: Sun, Wenbo, et al.
Pubblicazione: (2023)
Optimizing Near Field Computation in the MLFMA Algorithm with Data Redundancy and Performance Modeling on a Single GPU
di: Sadeghi, Morteza, et al.
Pubblicazione: (2024)
di: Sadeghi, Morteza, et al.
Pubblicazione: (2024)
SProBench: Stream Processing Benchmark for High Performance Computing Infrastructure
di: Kulkarni, Apurv Deepak, et al.
Pubblicazione: (2025)
di: Kulkarni, Apurv Deepak, et al.
Pubblicazione: (2025)
An Autotuning-based Optimization Framework for Mixed-kernel SVM Classifications in Smart Pixel Datasets and Heterojunction Transistors
di: Wu, Xingfu, et al.
Pubblicazione: (2024)
di: Wu, Xingfu, et al.
Pubblicazione: (2024)
A Precision Emulation Approach to the GPU Acceleration of Ab Initio Electronic Structure Calculations
di: Liu, Hang, et al.
Pubblicazione: (2026)
di: Liu, Hang, et al.
Pubblicazione: (2026)
Performance Implications of Multi-Chiplet Neural Processing Units on Autonomous Driving Perception
di: Odema, Mohanad, et al.
Pubblicazione: (2024)
di: Odema, Mohanad, et al.
Pubblicazione: (2024)
Enhanced Scalability in Assessing Quantum Integer Factorization Performance
di: Lee, Junseo
Pubblicazione: (2023)
di: Lee, Junseo
Pubblicazione: (2023)
SLO-Guard: Crash-Aware, Budget-Consistent Autotuning for SLO-Constrained LLM Serving
di: Lysenstøen, Christian
Pubblicazione: (2026)
di: Lysenstøen, Christian
Pubblicazione: (2026)
Accelerating Particle-in-Cell Monte Carlo Simulations with MPI, OpenMP/OpenACC and Asynchronous Multi-GPU Programming
di: Williams, Jeremy J., et al.
Pubblicazione: (2024)
di: Williams, Jeremy J., et al.
Pubblicazione: (2024)
A Machine Learning accelerated geophysical fluid solver
di: Bai, Yang
Pubblicazione: (2026)
di: Bai, Yang
Pubblicazione: (2026)
Towards Universal Performance Modeling for Machine Learning Training on Multi-GPU Platforms
di: Lin, Zhongyi, et al.
Pubblicazione: (2024)
di: Lin, Zhongyi, et al.
Pubblicazione: (2024)
Non-Asymptotic Performance Analysis of DOA Estimation Based on Real-Valued Root-MUSIC
di: Liu, Junyang, et al.
Pubblicazione: (2025)
di: Liu, Junyang, et al.
Pubblicazione: (2025)
Advanced Scheduling Strategies for Distributed Quantum Computing Jobs
di: Ni, Gongyu, et al.
Pubblicazione: (2026)
di: Ni, Gongyu, et al.
Pubblicazione: (2026)
Accelerating the Tesseract Decoder for Quantum Error Correction
di: Grbic, Dragana, et al.
Pubblicazione: (2026)
di: Grbic, Dragana, et al.
Pubblicazione: (2026)
Multi-GPU Hybrid Particle-in-Cell Monte Carlo Simulations for Exascale Computing Systems
di: Williams, Jeremy J., et al.
Pubblicazione: (2026)
di: Williams, Jeremy J., et al.
Pubblicazione: (2026)
A Data-driven ML Approach for Maximizing Performance in LLM-Adapter Serving
di: Agullo, Ferran, et al.
Pubblicazione: (2025)
di: Agullo, Ferran, et al.
Pubblicazione: (2025)
TINA: Acceleration of Non-NN Signal Processing Algorithms Using NN Accelerators
di: Boerkamp, Christiaan, et al.
Pubblicazione: (2024)
di: Boerkamp, Christiaan, et al.
Pubblicazione: (2024)
Characterizing the Performance of the Implicit Massively Parallel Particle-in-Cell iPIC3D Code
di: Williams, Jeremy J., et al.
Pubblicazione: (2024)
di: Williams, Jeremy J., et al.
Pubblicazione: (2024)
GPU-Accelerated Parallel Selected Inversion for Structured Matrices Using sTiles
di: Fattah, Esmail Abdul, et al.
Pubblicazione: (2025)
di: Fattah, Esmail Abdul, et al.
Pubblicazione: (2025)
Scalable Systems and Software Architectures for High-Performance Computing on cloud platforms
di: Ramesh, Risshab Srinivas
Pubblicazione: (2024)
di: Ramesh, Risshab Srinivas
Pubblicazione: (2024)
Integrating High Performance In-Memory Data Streaming and In-Situ Visualization in Hybrid MPI+OpenMP PIC MC Simulations Towards Exascale
di: Williams, Jeremy J., et al.
Pubblicazione: (2025)
di: Williams, Jeremy J., et al.
Pubblicazione: (2025)
Phantora: Maximizing Code Reuse in Simulation-based Machine Learning System Performance Estimation
di: Qin, Jianxing, et al.
Pubblicazione: (2025)
di: Qin, Jianxing, et al.
Pubblicazione: (2025)
Cost-Performance Evaluation of General Compute Instances: AWS, Azure, GCP, and OCI
di: Tharwani, Jay, et al.
Pubblicazione: (2024)
di: Tharwani, Jay, et al.
Pubblicazione: (2024)
Solving Combinatorial Optimization Problems on a Photonic Quantum Computer
di: Slysz, Mateusz, et al.
Pubblicazione: (2024)
di: Slysz, Mateusz, et al.
Pubblicazione: (2024)
Performance Optimization in Stream Processing Systems: Experiment-Driven Configuration Tuning for Kafka Streams
di: Chen, David, et al.
Pubblicazione: (2026)
di: Chen, David, et al.
Pubblicazione: (2026)
Enhancing Traffic Sign Recognition On The Performance Based On Yolov8
di: Ibrahim, Baba, et al.
Pubblicazione: (2025)
di: Ibrahim, Baba, et al.
Pubblicazione: (2025)
Performance of Confidential Computing GPUs
di: Ibarra, Antonio Martínez, et al.
Pubblicazione: (2025)
di: Ibarra, Antonio Martínez, et al.
Pubblicazione: (2025)
Scheduling in Quantum Satellite Networks: Fairness and Performance Optimization
di: Dikshit, Ashutosh Jayant, et al.
Pubblicazione: (2025)
di: Dikshit, Ashutosh Jayant, et al.
Pubblicazione: (2025)
Efficient Transpilation of OpenQASM 3.0 Dynamic Circuits to CUDA-Q: Performance and Expressiveness Advantages
di: Kulkarni, Vinooth, et al.
Pubblicazione: (2026)
di: Kulkarni, Vinooth, et al.
Pubblicazione: (2026)
Surrogate Modeling for Scalable Evaluation of Distributed Computing Systems for HEP Applications
di: Schmid, Larissa, et al.
Pubblicazione: (2025)
di: Schmid, Larissa, et al.
Pubblicazione: (2025)
Performance and Power: Systematic Evaluation of AI Workloads on Accelerators with CARAML
di: John, Chelsea Maria, et al.
Pubblicazione: (2024)
di: John, Chelsea Maria, et al.
Pubblicazione: (2024)
Deciphering boundary layer dynamics in high-Rayleigh-number convection using 3360 GPUs and a high-scaling in-situ workflow
di: Bode, Mathis, et al.
Pubblicazione: (2025)
di: Bode, Mathis, et al.
Pubblicazione: (2025)
Towards Run Time Estimation of the Gaussian Chemistry Code for SEAGrid Science Gateway
di: Beltre, Angel, et al.
Pubblicazione: (2019)
di: Beltre, Angel, et al.
Pubblicazione: (2019)
nekCRF: A next generation high-order reactive low Mach flow solver for direct numerical simulations
di: Kerkemeier, Stefan, et al.
Pubblicazione: (2024)
di: Kerkemeier, Stefan, et al.
Pubblicazione: (2024)
Enhancing Performance Insight at Scale: A Heterogeneous Framework for Exascale Diagnostics
di: Grbic, Dragana
Pubblicazione: (2026)
di: Grbic, Dragana
Pubblicazione: (2026)
Documenti analoghi
-
Characterizing Machine Learning Force Fields as Emerging Molecular Dynamics Workloads on Graphics Processing Units
di: De Alwis, Udari, et al.
Pubblicazione: (2026) -
Integrating ytopt and libEnsemble to Autotune OpenMC
di: Wu, Xingfu, et al.
Pubblicazione: (2024) -
Portable High-Performance Kernel Generation for a Computational Fluid Dynamics Code with DaCe
di: Andersson, Måns I., et al.
Pubblicazione: (2025) -
HPC Application Parameter Autotuning on Edge Devices: A Bandit Learning Approach
di: Hossain, Abrar, et al.
Pubblicazione: (2025) -
Understanding the Impact of Synchronous, Asynchronous, and Hybrid In-Situ Techniques in Computational Fluid Dynamics Applications
di: Ju, Yi, et al.
Pubblicazione: (2024)