Accelerating mesh-based Monte Carlo simulations using contemporary graphics ray-tracing hardware
Fuente:
arXiv
Salvato in:
| Autori principali: | Yan, Shijie, Dwyer, Douglas, Kaeli, David R., Fang, Qianqian |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Accelerating Gaussian beam tracing method with dynamic parallelism on graphics processing units
di: Sheng, Zhang, et al.
Pubblicazione: (2025)
di: Sheng, Zhang, et al.
Pubblicazione: (2025)
A Granularity Characterization of Task Scheduling Effectiveness
di: Anvari, Sana Taghipour, et al.
Pubblicazione: (2026)
di: Anvari, Sana Taghipour, et al.
Pubblicazione: (2026)
Acceleration of Parallel Tempering for Markov Chain Monte Carlo methods
di: Ramos, Aingeru, et al.
Pubblicazione: (2025)
di: Ramos, Aingeru, et al.
Pubblicazione: (2025)
Federated prediction for scalable and privacy-preserved knowledge-based planning in radiotherapy
di: Chen, Jingyun, et al.
Pubblicazione: (2025)
di: Chen, Jingyun, et al.
Pubblicazione: (2025)
cuVegas: Accelerate Multidimensional Monte Carlo Integration through a Parallelized CUDA-based Implementation of the VEGAS Enhanced Algorithm
di: Tolotti, Emiliano, et al.
Pubblicazione: (2024)
di: Tolotti, Emiliano, et al.
Pubblicazione: (2024)
DaggerFFT: A Distributed FFT Framework Using Task Scheduling in Julia
di: Anvari, Sana Taghipour, et al.
Pubblicazione: (2026)
di: Anvari, Sana Taghipour, et al.
Pubblicazione: (2026)
Light Virtualization: a proof-of-concept for hardware-based virtualization
di: Ciraolo, Francesco, et al.
Pubblicazione: (2025)
di: Ciraolo, Francesco, et al.
Pubblicazione: (2025)
Enabling an OpenStack-based cloud on top of RISC-V hardware
di: Marrón, Diego, et al.
Pubblicazione: (2024)
di: Marrón, Diego, et al.
Pubblicazione: (2024)
Towards General Neural Surrogate Solvers with Specialized Neural Accelerators
di: Mao, Chenkai, et al.
Pubblicazione: (2024)
di: Mao, Chenkai, et al.
Pubblicazione: (2024)
Accelerating high-order continuum kinetic plasma simulations using multiple GPUs
di: Ho, Andrew, et al.
Pubblicazione: (2024)
di: Ho, Andrew, et al.
Pubblicazione: (2024)
Unlocking Real-Time Fluorescence Lifetime Imaging: Multi-Pixel Parallelism for FPGA-Accelerated Processing
di: Erbas, Ismail, et al.
Pubblicazione: (2024)
di: Erbas, Ismail, et al.
Pubblicazione: (2024)
BouquetFL: Emulating diverse participant hardware in Federated Learning
di: Geimer, Arno
Pubblicazione: (2026)
di: Geimer, Arno
Pubblicazione: (2026)
Leveraging HPC Profiling & Tracing Tools to Understand the Performance of Particle-in-Cell Monte Carlo Simulations
di: Williams, Jeremy J., et al.
Pubblicazione: (2023)
di: Williams, Jeremy J., et al.
Pubblicazione: (2023)
DUMBO: Making durable read-only transactions fly on hardware transactional memory
di: Barreto, João, et al.
Pubblicazione: (2024)
di: Barreto, João, et al.
Pubblicazione: (2024)
Performance Portable Monte Carlo Particle Transport on Intel, NVIDIA, and AMD GPUs
di: Tramm, John, et al.
Pubblicazione: (2024)
di: Tramm, John, et al.
Pubblicazione: (2024)
Revolutionizing MRI Data Processing Using FSL: Preliminary Findings with the Fugaku Supercomputer
di: Lyu, Tianxiang, et al.
Pubblicazione: (2024)
di: Lyu, Tianxiang, et al.
Pubblicazione: (2024)
GPU Acceleration of Monte Carlo Tallies on Unstructured Meshes in OpenMC with PUMI-Tally
di: Hasan, Fuad, et al.
Pubblicazione: (2025)
di: Hasan, Fuad, et al.
Pubblicazione: (2025)
Efficient and scalable atmospheric dynamics simulations using non-conforming meshes
di: Orlando, Giuseppe, et al.
Pubblicazione: (2024)
di: Orlando, Giuseppe, et al.
Pubblicazione: (2024)
Parallel Collaborative ADMM Privacy Computing and Adaptive GPU Acceleration for Distributed Edge Networks
di: Xia, Mengchun, et al.
Pubblicazione: (2026)
di: Xia, Mengchun, et al.
Pubblicazione: (2026)
Exploiting ray tracing technology through OptiX to compute particle interactions with cutoff in a 3D environment on GPU
di: David, Algis, et al.
Pubblicazione: (2024)
di: David, Algis, et al.
Pubblicazione: (2024)
DGRAG: Distributed Graph-based Retrieval-Augmented Generation in Edge-Cloud Systems
di: Zhou, Wenqing, et al.
Pubblicazione: (2025)
di: Zhou, Wenqing, et al.
Pubblicazione: (2025)
LAAFD: LLM-based Agents for Accelerated FPGA Design
di: Moraru, Maxim, et al.
Pubblicazione: (2026)
di: Moraru, Maxim, et al.
Pubblicazione: (2026)
A large-scale distributed parallel discrete event simulation engines based on Warped2 for Wargaming simulation
di: Jia, Xiaoning, et al.
Pubblicazione: (2025)
di: Jia, Xiaoning, et al.
Pubblicazione: (2025)
GPU-Accelerated Selected Basis Diagonalization with Thrust for SQD-based Algorithms
di: Doi, Jun, et al.
Pubblicazione: (2026)
di: Doi, Jun, et al.
Pubblicazione: (2026)
Multi-GPU Acceleration of PALABOS Fluid Solver using C++ Standard Parallelism
di: Latt, Jonas, et al.
Pubblicazione: (2025)
di: Latt, Jonas, et al.
Pubblicazione: (2025)
PilotANN: Memory-Bounded GPU Acceleration for Vector Search
di: Gui, Yuntao, et al.
Pubblicazione: (2025)
di: Gui, Yuntao, et al.
Pubblicazione: (2025)
Parallel simulation and adaptive mesh refinement for 3D elastostatic contact mechanics problems between deformable bodies
di: Epalle, Alexandre, et al.
Pubblicazione: (2025)
di: Epalle, Alexandre, et al.
Pubblicazione: (2025)
AcceLLM: Accelerating LLM Inference using Redundancy for Load Balancing and Data Locality
di: Bournias, Ilias, et al.
Pubblicazione: (2024)
di: Bournias, Ilias, et al.
Pubblicazione: (2024)
Accelerating Particle-in-Cell Monte Carlo Simulations with MPI, OpenMP/OpenACC and Asynchronous Multi-GPU Programming
di: Williams, Jeremy J., et al.
Pubblicazione: (2024)
di: Williams, Jeremy J., et al.
Pubblicazione: (2024)
PALM: A Efficient Performance Simulator for Tiled Accelerators with Large-scale Model Training
di: Fang, Jiahao, et al.
Pubblicazione: (2024)
di: Fang, Jiahao, et al.
Pubblicazione: (2024)
Conditional Prior-based Non-stationary Channel Estimation Using Accelerated Diffusion Models
di: Mohsin, Muhammad Ahmed, et al.
Pubblicazione: (2025)
di: Mohsin, Muhammad Ahmed, et al.
Pubblicazione: (2025)
LIME:Accelerating Collaborative Lossless LLM Inference on Memory-Constrained Edge Devices
di: Sun, Mingyu, et al.
Pubblicazione: (2025)
di: Sun, Mingyu, et al.
Pubblicazione: (2025)
Deadlock-free routing for Full-mesh networks without using Virtual Channels
di: Cano, Alejandro, et al.
Pubblicazione: (2025)
di: Cano, Alejandro, et al.
Pubblicazione: (2025)
AcOrch: Accelerating Sampling-based GNN Training under CPU-NPU Heterogeneous Environments
di: Chen, Kefu, et al.
Pubblicazione: (2026)
di: Chen, Kefu, et al.
Pubblicazione: (2026)
SP-MoE: Speculative Decoding and Prefetching for Accelerating MoE-based Model Inference
di: Chen, Liangkun, et al.
Pubblicazione: (2025)
di: Chen, Liangkun, et al.
Pubblicazione: (2025)
Accelerating Mixed-Precision Out-of-Core Cholesky Factorization with Static Task Scheduling
di: Ren, Jie, et al.
Pubblicazione: (2024)
di: Ren, Jie, et al.
Pubblicazione: (2024)
Distance-based certification for leader election in meshed graphs and local recognition of their subclasses
di: Chalopin, Jérémie, et al.
Pubblicazione: (2026)
di: Chalopin, Jérémie, et al.
Pubblicazione: (2026)
GPU-Accelerated Modified Bessel Function of the Second Kind for Gaussian Processes
di: Geng, Zipei, et al.
Pubblicazione: (2025)
di: Geng, Zipei, et al.
Pubblicazione: (2025)
To Offload or Not To Offload: Model-driven Comparison of Edge-native and On-device Processing In the Era of Accelerators
di: Ng, Nathan, et al.
Pubblicazione: (2025)
di: Ng, Nathan, et al.
Pubblicazione: (2025)
Generating representative macrobenchmark microservice systems from distributed traces with Palette
di: Anand, Vaastav, et al.
Pubblicazione: (2025)
di: Anand, Vaastav, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Accelerating Gaussian beam tracing method with dynamic parallelism on graphics processing units
di: Sheng, Zhang, et al.
Pubblicazione: (2025) -
A Granularity Characterization of Task Scheduling Effectiveness
di: Anvari, Sana Taghipour, et al.
Pubblicazione: (2026) -
Acceleration of Parallel Tempering for Markov Chain Monte Carlo methods
di: Ramos, Aingeru, et al.
Pubblicazione: (2025) -
Federated prediction for scalable and privacy-preserved knowledge-based planning in radiotherapy
di: Chen, Jingyun, et al.
Pubblicazione: (2025) -
cuVegas: Accelerate Multidimensional Monte Carlo Integration through a Parallelized CUDA-based Implementation of the VEGAS Enhanced Algorithm
di: Tolotti, Emiliano, et al.
Pubblicazione: (2024)