Fast Algorithms for Scheduling Many-body Correlation Functions on Accelerators
Fuente:
arXiv
Salvato in:
| Autori principali: | Selvitopi, Oguz, Ozturk, Emin, Chen, Jie, Sadayappan, Ponnuswamy, Edwards, Robert G., Buluç, Aydın |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
RDMA-Based Algorithms for Sparse Matrix Multiplication on GPUs
di: Brock, Benjamin, et al.
Pubblicazione: (2023)
di: Brock, Benjamin, et al.
Pubblicazione: (2023)
A sparsity-aware distributed-memory algorithm for sparse-sparse matrix multiplication
di: Hong, Yuxi, et al.
Pubblicazione: (2024)
di: Hong, Yuxi, et al.
Pubblicazione: (2024)
BCL: A Cross-Platform Distributed Container Library
di: Brock, Benjamin, et al.
Pubblicazione: (2018)
di: Brock, Benjamin, et al.
Pubblicazione: (2018)
Improving SpGEMM Performance Through Matrix Reordering and Cluster-wise Computation
di: Islam, Abdullah Al Raqibul, et al.
Pubblicazione: (2025)
di: Islam, Abdullah Al Raqibul, et al.
Pubblicazione: (2025)
The Ubiquitous Sparse Matrix-Matrix Products
di: Buluç, Aydın
Pubblicazione: (2025)
di: Buluç, Aydın
Pubblicazione: (2025)
Distributed Matrix-Based Sampling for Graph Neural Network Training
di: Tripathy, Alok, et al.
Pubblicazione: (2023)
di: Tripathy, Alok, et al.
Pubblicazione: (2023)
Parallelizing the Approximate Minimum Degree Ordering Algorithm: Strategies and Evaluation
di: Chang, Yen-Hsiang, et al.
Pubblicazione: (2025)
di: Chang, Yen-Hsiang, et al.
Pubblicazione: (2025)
Distributed-Memory Parallel Algorithms for Fixed-Radius Near Neighbor Graph Construction
di: Raulet, Gabriel, et al.
Pubblicazione: (2025)
di: Raulet, Gabriel, et al.
Pubblicazione: (2025)
Accelerating Mixed-Precision Out-of-Core Cholesky Factorization with Static Task Scheduling
di: Ren, Jie, et al.
Pubblicazione: (2024)
di: Ren, Jie, et al.
Pubblicazione: (2024)
Fast multiplication of random dense matrices with fixed sparse matrices
di: Liang, Tianyu, et al.
Pubblicazione: (2023)
di: Liang, Tianyu, et al.
Pubblicazione: (2023)
Fast Transaction Scheduling in Blockchain Sharding
di: Adhikari, Ramesh, et al.
Pubblicazione: (2024)
di: Adhikari, Ramesh, et al.
Pubblicazione: (2024)
ASA -- The Adaptive Scheduling Algorithm
di: Souza, Abel, et al.
Pubblicazione: (2024)
di: Souza, Abel, et al.
Pubblicazione: (2024)
CPMA: An Efficient Batch-Parallel Compressed Set Without Pointers
di: Wheatman, Brian, et al.
Pubblicazione: (2023)
di: Wheatman, Brian, et al.
Pubblicazione: (2023)
Hyperion: Hierarchical Scheduling for Parallel LLM Acceleration in Multi-tier Networks
di: Ma, Mulei, et al.
Pubblicazione: (2025)
di: Ma, Mulei, et al.
Pubblicazione: (2025)
Parameterized Task Graph Scheduling Algorithm for Comparing Algorithmic Components
di: Coleman, Jared, et al.
Pubblicazione: (2024)
di: Coleman, Jared, et al.
Pubblicazione: (2024)
Raptor: Distributed Scheduling for Serverless Functions
di: Exton, Kevin, et al.
Pubblicazione: (2024)
di: Exton, Kevin, et al.
Pubblicazione: (2024)
Affinity-aware Serverless Function Scheduling
di: De Palma, Giuseppe, et al.
Pubblicazione: (2024)
di: De Palma, Giuseppe, et al.
Pubblicazione: (2024)
On the Complexity of Reachability Properties in Serverless Function Scheduling
di: De Palma, Giuseppe, et al.
Pubblicazione: (2024)
di: De Palma, Giuseppe, et al.
Pubblicazione: (2024)
Co-designing a Programmable RISC-V Accelerator for MPC-based Energy and Thermal Management of Many-Core HPC Processors
di: Ottaviano, Alessandro, et al.
Pubblicazione: (2025)
di: Ottaviano, Alessandro, et al.
Pubblicazione: (2025)
PISA: An Adversarial Approach To Comparing Task Graph Scheduling Algorithms
di: Coleman, Jared, et al.
Pubblicazione: (2024)
di: Coleman, Jared, et al.
Pubblicazione: (2024)
An Asynchronous Many-Task Algorithm for Unstructured $S_{N}$ Transport on Shared Memory Systems
di: Elwood, Alex, et al.
Pubblicazione: (2025)
di: Elwood, Alex, et al.
Pubblicazione: (2025)
Is Sparse Matrix Reordering Effective for Sparse Matrix-Vector Multiplication?
di: Asudeh, Omid, et al.
Pubblicazione: (2025)
di: Asudeh, Omid, et al.
Pubblicazione: (2025)
Many Hands Make Light Work: Accelerating Edge Inference via Multi-Client Collaborative Caching
di: Liang, Wenyi, et al.
Pubblicazione: (2024)
di: Liang, Wenyi, et al.
Pubblicazione: (2024)
Parallel GPU-Accelerated Randomized Construction of Approximate Cholesky Preconditioners
di: Liang, Tianyu, et al.
Pubblicazione: (2025)
di: Liang, Tianyu, et al.
Pubblicazione: (2025)
FastGraph: Optimized GPU-Enabled Algorithms for Fast Graph Building and Message Passing
di: Agarwal, Aarush, et al.
Pubblicazione: (2025)
di: Agarwal, Aarush, et al.
Pubblicazione: (2025)
EcoLife: Carbon-Aware Serverless Function Scheduling for Sustainable Computing
di: Jiang, Yankai, et al.
Pubblicazione: (2024)
di: Jiang, Yankai, et al.
Pubblicazione: (2024)
A Reinforcement Learning-Driven Task Scheduling Algorithm for Multi-Tenant Distributed Systems
di: Zhang, Xiaopei, et al.
Pubblicazione: (2025)
di: Zhang, Xiaopei, et al.
Pubblicazione: (2025)
An Analytical Overview Of Virtual Machine Load Balancing Scheduling Algorithms with their Comparative Case Study
di: Vaidya, Priyank, et al.
Pubblicazione: (2025)
di: Vaidya, Priyank, et al.
Pubblicazione: (2025)
DreamDDP: Accelerating Data Parallel Distributed LLM Training with Layer-wise Scheduled Partial Synchronization
di: Tang, Zhenheng, et al.
Pubblicazione: (2025)
di: Tang, Zhenheng, et al.
Pubblicazione: (2025)
GPU-Accelerated Modified Bessel Function of the Second Kind for Gaussian Processes
di: Geng, Zipei, et al.
Pubblicazione: (2025)
di: Geng, Zipei, et al.
Pubblicazione: (2025)
Hestia: Hyperthread-Level Scheduling for Cloud Microservices with Interference-Aware Attention
di: Yang, Dingyu, et al.
Pubblicazione: (2026)
di: Yang, Dingyu, et al.
Pubblicazione: (2026)
Carbon-Aware Mapping and Scheduling for Deadline-Constrained Workflows
di: Schweisgut, Dominik, et al.
Pubblicazione: (2026)
di: Schweisgut, Dominik, et al.
Pubblicazione: (2026)
DECICE: AI-Driven Scheduling and Digital Twin Integration for the Cloud-HPC-Edge Compute Continuum
di: Sharma, Aasish Kumar, et al.
Pubblicazione: (2026)
di: Sharma, Aasish Kumar, et al.
Pubblicazione: (2026)
Carbon-Aware Workflow Scheduling with Fixed Mapping and Deadline Constraint
di: Schweisgut, Dominik, et al.
Pubblicazione: (2025)
di: Schweisgut, Dominik, et al.
Pubblicazione: (2025)
HyperDrive: Scheduling Serverless Functions in the Edge-Cloud-Space 3D Continuum
di: Pusztai, Thomas, et al.
Pubblicazione: (2024)
di: Pusztai, Thomas, et al.
Pubblicazione: (2024)
GPU-Accelerated Selected Basis Diagonalization with Thrust for SQD-based Algorithms
di: Doi, Jun, et al.
Pubblicazione: (2026)
di: Doi, Jun, et al.
Pubblicazione: (2026)
Accelerating Particle-Mesh Algorithms with FPGAs and OmpSs@OpenCL
di: Guidotti, Nicolas Lee
Pubblicazione: (2025)
di: Guidotti, Nicolas Lee
Pubblicazione: (2025)
GPU-Accelerated Batch-Dynamic Subgraph Matching
di: Qiu, Linshan, et al.
Pubblicazione: (2024)
di: Qiu, Linshan, et al.
Pubblicazione: (2024)
AGAThA: Fast and Efficient GPU Acceleration of Guided Sequence Alignment for Long Read Mapping
di: Park, Seongyeon, et al.
Pubblicazione: (2024)
di: Park, Seongyeon, et al.
Pubblicazione: (2024)
LLMSched: Uncertainty-Aware Workload Scheduling for Compound LLM Applications
di: Zhu, Botao, et al.
Pubblicazione: (2025)
di: Zhu, Botao, et al.
Pubblicazione: (2025)
Documenti analoghi
-
RDMA-Based Algorithms for Sparse Matrix Multiplication on GPUs
di: Brock, Benjamin, et al.
Pubblicazione: (2023) -
A sparsity-aware distributed-memory algorithm for sparse-sparse matrix multiplication
di: Hong, Yuxi, et al.
Pubblicazione: (2024) -
BCL: A Cross-Platform Distributed Container Library
di: Brock, Benjamin, et al.
Pubblicazione: (2018) -
Improving SpGEMM Performance Through Matrix Reordering and Cluster-wise Computation
di: Islam, Abdullah Al Raqibul, et al.
Pubblicazione: (2025) -
The Ubiquitous Sparse Matrix-Matrix Products
di: Buluç, Aydın
Pubblicazione: (2025)