Flexible Multi-Dimensional FFTs for Plane Wave Density Functional Theory Codes
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Popovici, Doru Thom, del Ben, Mauro, Marques, Osni, Canning, Andrew |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
GPU acceleration of non-equilibrium Green's function calculation using OpenACC and CUDA FORTRAN
par: Yin, Jia, et autres
Publié: (2025)
par: Yin, Jia, et autres
Publié: (2025)
Population Protocols Revisited: Parity and Beyond
par: Gąsieniec, Leszek, et autres
Publié: (2025)
par: Gąsieniec, Leszek, et autres
Publié: (2025)
OPTIMUM-DERAM: Highly Consistent, Scalable, and Secure Multi-Object Memory using RLNC
par: Nicolaou, Nicolas, et autres
Publié: (2026)
par: Nicolaou, Nicolas, et autres
Publié: (2026)
Acc-SpMM: Accelerating General-purpose Sparse Matrix-Matrix Multiplication with GPU Tensor Cores
par: Zhao, Haisha, et autres
Publié: (2025)
par: Zhao, Haisha, et autres
Publié: (2025)
Context Adaptive Cooperation
par: Albouy, Timothé, et autres
Publié: (2023)
par: Albouy, Timothé, et autres
Publié: (2023)
Floating Point Compression of Hierarchical Matrix Formats and its Impact on Matrix-Vector Multiplication
par: Kriemann, Ronald
Publié: (2024)
par: Kriemann, Ronald
Publié: (2024)
A Morton-Type Space-Filling Curve for Pyramid Subdivision and Hybrid Adaptive Mesh Refinement
par: Knapp, David, et autres
Publié: (2026)
par: Knapp, David, et autres
Publié: (2026)
Algorithms for Parallel Shared-Memory Sparse Matrix-Vector Multiplication on Unstructured Matrices
par: Bergmans, Kobe, et autres
Publié: (2025)
par: Bergmans, Kobe, et autres
Publié: (2025)
Dynamic Approximate Maximum Matching in the Distributed Vertex Partition Model
par: Robinson, Peter, et autres
Publié: (2025)
par: Robinson, Peter, et autres
Publié: (2025)
Dynamic Memory Management on GPUs with SYCL
par: Standish, Russell K.
Publié: (2025)
par: Standish, Russell K.
Publié: (2025)
Data Scheduling Algorithm for Scalable and Efficient IoT Sensing in Cloud Computing
par: Mohammad, Noor Islam S.
Publié: (2025)
par: Mohammad, Noor Islam S.
Publié: (2025)
Distributed Tomographic Reconstruction with Quantization
par: Miao, Runxuan, et autres
Publié: (2024)
par: Miao, Runxuan, et autres
Publié: (2024)
A Closeness Centrality-based Circuit Partitioner for Quantum Simulations
par: Popovici, Doru Thom, et autres
Publié: (2025)
par: Popovici, Doru Thom, et autres
Publié: (2025)
A Simple Communication Scheme for Distributed Fast Multipole Methods
par: Kailasa, Srinath
Publié: (2026)
par: Kailasa, Srinath
Publié: (2026)
FlashSpread: IO-Aware GPU Simulation of Non-Markovian Epidemic Dynamics via Kernel Fusion
par: Shakeri, Heman, et autres
Publié: (2026)
par: Shakeri, Heman, et autres
Publié: (2026)
Exploiting nested task-parallelism in the $\mathcal{H}-LU$ factorization
par: Carratalá-Sáez, Rocío, et autres
Publié: (2019)
par: Carratalá-Sáez, Rocío, et autres
Publié: (2019)
Serial Parallel Reliability Redundancy Allocation Optimization for Energy Efficient and Fault Tolerant Cloud Computing
par: Krishna, Gutha Jaya
Publié: (2024)
par: Krishna, Gutha Jaya
Publié: (2024)
Machine Learning-Driven Predictive Resource Management in Complex Science Workflows
par: Chowdhury, Tasnuva, et autres
Publié: (2025)
par: Chowdhury, Tasnuva, et autres
Publié: (2025)
Massively Parallel Genetic Optimization through Asynchronous Propagation of Populations
par: Taubert, Oskar, et autres
Publié: (2023)
par: Taubert, Oskar, et autres
Publié: (2023)
Cascaded Prediction and Asynchronous Execution of Iterative Algorithms on Heterogeneous Platforms
par: Gao, Jianhua, et autres
Publié: (2024)
par: Gao, Jianhua, et autres
Publié: (2024)
GPU-Accelerated Algorithms for Process Mapping
par: Samoldekin, Petr, et autres
Publié: (2025)
par: Samoldekin, Petr, et autres
Publié: (2025)
CRDT-Based Game State Synchronization in Peer-to-Peer VR
par: Dantas, Abel, et autres
Publié: (2025)
par: Dantas, Abel, et autres
Publié: (2025)
A parallel wakeup problem and multi-room light switch strategies
par: Haslegrave, John, et autres
Publié: (2026)
par: Haslegrave, John, et autres
Publié: (2026)
Efficient Multi-Processor Scheduling in Increasingly Realistic Models
par: Papp, Pál András, et autres
Publié: (2024)
par: Papp, Pál András, et autres
Publié: (2024)
Real-time chaotic video encryption based on multithreaded parallel confusion and diffusion
par: Jiang, Dong, et autres
Publié: (2023)
par: Jiang, Dong, et autres
Publié: (2023)
LLM4FaaS: No-Code Application Development using LLMs and FaaS
par: Wang, Minghe, et autres
Publié: (2025)
par: Wang, Minghe, et autres
Publié: (2025)
Metronome: Differentiated Delay Scheduling for Serverless Functions
par: Chen, Zhuangbin, et autres
Publié: (2025)
par: Chen, Zhuangbin, et autres
Publié: (2025)
gFaaS: Enabling Generic Functions in Serverless Computing
par: Chadha, Mohak, et autres
Publié: (2024)
par: Chadha, Mohak, et autres
Publié: (2024)
SeBS-Flow: Benchmarking Serverless Cloud Function Workflows
par: Schmid, Larissa, et autres
Publié: (2024)
par: Schmid, Larissa, et autres
Publié: (2024)
LLM-HPC++: Evaluating LLM-Generated Modern C++ and MPI+OpenMP Codes for Scalable Mandelbrot Set Computation
par: Diehl, Patrick, et autres
Publié: (2025)
par: Diehl, Patrick, et autres
Publié: (2025)
SPES: Towards Optimizing Performance-Resource Trade-Off for Serverless Functions
par: Lee, Cheryl, et autres
Publié: (2024)
par: Lee, Cheryl, et autres
Publié: (2024)
A Unifying Framework to Enable Artificial Intelligence in High Performance Computing Workflows
par: Domke, Jens, et autres
Publié: (2025)
par: Domke, Jens, et autres
Publié: (2025)
Analysing cycloids using linear algebra
par: Valk, Rüdiger
Publié: (2024)
par: Valk, Rüdiger
Publié: (2024)
Supercharging Federated Learning with Flower and NVIDIA FLARE
par: Roth, Holger R., et autres
Publié: (2024)
par: Roth, Holger R., et autres
Publié: (2024)
CompressedScaffnew: The First Theoretical Double Acceleration of Communication from Local Training and Compression in Distributed Optimization
par: Condat, Laurent, et autres
Publié: (2022)
par: Condat, Laurent, et autres
Publié: (2022)
D&A: Resource Optimisation in Personalised PageRank Computations Using Multi-Core Machines
par: Yow, Kai Siong, et autres
Publié: (2024)
par: Yow, Kai Siong, et autres
Publié: (2024)
Melding the Serverless Control Plane with the Conventional Cluster Manager for Speed and Resource Efficiency
par: Kondrashov, Leonid, et autres
Publié: (2025)
par: Kondrashov, Leonid, et autres
Publié: (2025)
Accelerated Spatio-Temporal Bayesian Modeling for Multivariate Gaussian Processes
par: Gaedke-Merzhäuser, Lisa, et autres
Publié: (2025)
par: Gaedke-Merzhäuser, Lisa, et autres
Publié: (2025)
Communication-Efficient, 2D Parallel Stochastic Gradient Descent for Distributed-Memory Optimization
par: Devarakonda, Aditya, et autres
Publié: (2025)
par: Devarakonda, Aditya, et autres
Publié: (2025)
Two parallel dynamic lexicographic algorithms for factorization sets in numerical semigroups
par: Barron, Thomas
Publié: (2024)
par: Barron, Thomas
Publié: (2024)
Documents similaires
-
GPU acceleration of non-equilibrium Green's function calculation using OpenACC and CUDA FORTRAN
par: Yin, Jia, et autres
Publié: (2025) -
Population Protocols Revisited: Parity and Beyond
par: Gąsieniec, Leszek, et autres
Publié: (2025) -
OPTIMUM-DERAM: Highly Consistent, Scalable, and Secure Multi-Object Memory using RLNC
par: Nicolaou, Nicolas, et autres
Publié: (2026) -
Acc-SpMM: Accelerating General-purpose Sparse Matrix-Matrix Multiplication with GPU Tensor Cores
par: Zhao, Haisha, et autres
Publié: (2025) -
Context Adaptive Cooperation
par: Albouy, Timothé, et autres
Publié: (2023)