Faster Vertex Cover Algorithms on GPUs with Component-Aware Parallel Branching
Fuente:
arXiv
Salvato in:
| Autori principali: | Amro, Hussein, Fakhri, Basel, Mouawad, Amer E., Hajj, Izzat El |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Parallelizing Maximal Clique Enumeration on GPUs
di: Almasri, Mohammad, et al.
Pubblicazione: (2022)
di: Almasri, Mohammad, et al.
Pubblicazione: (2022)
Algorithms for Parallel Shared-Memory Sparse Matrix-Vector Multiplication on Unstructured Matrices
di: Bergmans, Kobe, et al.
Pubblicazione: (2025)
di: Bergmans, Kobe, et al.
Pubblicazione: (2025)
PruneX: A Hierarchical Communication-Efficient System for Distributed CNN Training with Structured Pruning
di: Olama, Alireza, et al.
Pubblicazione: (2025)
di: Olama, Alireza, et al.
Pubblicazione: (2025)
FTuner: A Fast Dynamic Shape Tensors Program Auto-Tuner for Deep Learning Compilers
di: Mu, Pengyu, et al.
Pubblicazione: (2024)
di: Mu, Pengyu, et al.
Pubblicazione: (2024)
Analysing cycloids using linear algebra
di: Valk, Rüdiger
Pubblicazione: (2024)
di: Valk, Rüdiger
Pubblicazione: (2024)
RDMA-Based Algorithms for Sparse Matrix Multiplication on GPUs
di: Brock, Benjamin, et al.
Pubblicazione: (2023)
di: Brock, Benjamin, et al.
Pubblicazione: (2023)
Faster Parallel Triangular Maximally Filtered Graphs and Hierarchical Clustering
di: Raphael, Steven, et al.
Pubblicazione: (2024)
di: Raphael, Steven, et al.
Pubblicazione: (2024)
APEX: Asynchronous Parallel CPU-GPU Execution for Online LLM Inference on Constrained GPUs
di: Fan, Jiakun, et al.
Pubblicazione: (2025)
di: Fan, Jiakun, et al.
Pubblicazione: (2025)
Time-optimal Asynchronous Minimal Vertex Covering by Myopic Robots
di: Jana, Saswata, et al.
Pubblicazione: (2025)
di: Jana, Saswata, et al.
Pubblicazione: (2025)
Dynamic Memory Management on GPUs with SYCL
di: Standish, Russell K.
Pubblicazione: (2025)
di: Standish, Russell K.
Pubblicazione: (2025)
NEMO: Faster Parallel Execution for Highly Contended Blockchain Workloads (Full version)
di: Ezard, François, et al.
Pubblicazione: (2025)
di: Ezard, François, et al.
Pubblicazione: (2025)
SpecBranch: Speculative Decoding via Hybrid Drafting and Rollback-Aware Branch Parallelism
di: Shen, Yuhao, et al.
Pubblicazione: (2025)
di: Shen, Yuhao, et al.
Pubblicazione: (2025)
pdGRASS: A Fast Parallel Density-Aware Algorithm for Graph Spectral Sparsification
di: Zhao, Tiancheng, et al.
Pubblicazione: (2025)
di: Zhao, Tiancheng, et al.
Pubblicazione: (2025)
ALPHA-PIM: Analysis of Linear Algebraic Processing for High-Performance Graph Applications on a Real Processing-In-Memory System
di: Barkhordar, Marzieh, et al.
Pubblicazione: (2026)
di: Barkhordar, Marzieh, et al.
Pubblicazione: (2026)
Big Data Intelligence Using Distributed Deep Neural Networks
di: Ongati, Felix, et al.
Pubblicazione: (2019)
di: Ongati, Felix, et al.
Pubblicazione: (2019)
An Online Fragmentation-Aware Scheduler for Managing GPU-Sharing Workloads on Multi-Instance GPUs
di: Ting, Hsu-Tzu, et al.
Pubblicazione: (2025)
di: Ting, Hsu-Tzu, et al.
Pubblicazione: (2025)
Dynamic Approximate Maximum Matching in the Distributed Vertex Partition Model
di: Robinson, Peter, et al.
Pubblicazione: (2025)
di: Robinson, Peter, et al.
Pubblicazione: (2025)
Efficient Pre-Training of LLMs via Topology-Aware Communication Alignment on More Than 9600 GPUs
di: He, Guoliang, et al.
Pubblicazione: (2025)
di: He, Guoliang, et al.
Pubblicazione: (2025)
Parameterized Task Graph Scheduling Algorithm for Comparing Algorithmic Components
di: Coleman, Jared, et al.
Pubblicazione: (2024)
di: Coleman, Jared, et al.
Pubblicazione: (2024)
Opara: Exploiting Operator Parallelism for Expediting DNN Inference on GPUs
di: Chen, Aodong, et al.
Pubblicazione: (2023)
di: Chen, Aodong, et al.
Pubblicazione: (2023)
Scaling State-Space Models on Multiple GPUs with Tensor Parallelism
di: Dutt, Anurag, et al.
Pubblicazione: (2026)
di: Dutt, Anurag, et al.
Pubblicazione: (2026)
Parallelizing Large-Scale Tensor Network Contraction on Multiple GPUs
di: Pan, Feng, et al.
Pubblicazione: (2026)
di: Pan, Feng, et al.
Pubblicazione: (2026)
LuWu: An End-to-End In-Network Out-of-Core Optimizer for 100B-Scale Model-in-Network Data-Parallel Training on Distributed GPUs
di: Sun, Mo, et al.
Pubblicazione: (2024)
di: Sun, Mo, et al.
Pubblicazione: (2024)
An Adaptive Distributed Stencil Abstraction for GPUs
di: Bhosale, Aditya, et al.
Pubblicazione: (2025)
di: Bhosale, Aditya, et al.
Pubblicazione: (2025)
Accelerating Maximal Biclique Enumeration on GPUs
di: Hsieh, Chou-Ying, et al.
Pubblicazione: (2024)
di: Hsieh, Chou-Ying, et al.
Pubblicazione: (2024)
Optimizing sDTW for AMD GPUs
di: Latta-Lin, Daniel, et al.
Pubblicazione: (2024)
di: Latta-Lin, Daniel, et al.
Pubblicazione: (2024)
Faster Parallel Batch-Dynamic Algorithms for Low Out-Degree Orientation
di: Blelloch, Guy, et al.
Pubblicazione: (2026)
di: Blelloch, Guy, et al.
Pubblicazione: (2026)
CB-SpMV:A Data Aggregating and Balance Algorithm for Cache-Friendly Block-Based SpMV on GPUs
di: Cong, Xing, et al.
Pubblicazione: (2026)
di: Cong, Xing, et al.
Pubblicazione: (2026)
Serving Compound Inference Systems on Datacenter GPUs
di: Devata, Sriram, et al.
Pubblicazione: (2026)
di: Devata, Sriram, et al.
Pubblicazione: (2026)
Fast Kronecker Matrix-Matrix Multiplication on GPUs
di: Jangda, Abhinav, et al.
Pubblicazione: (2024)
di: Jangda, Abhinav, et al.
Pubblicazione: (2024)
Optimal Workload Placement on Multi-Instance GPUs
di: Turkkan, Bekir, et al.
Pubblicazione: (2024)
di: Turkkan, Bekir, et al.
Pubblicazione: (2024)
Parallel Spawning Strategies for Dynamic-Aware MPI Applications
di: Martín-Álvarez, Iker, et al.
Pubblicazione: (2025)
di: Martín-Álvarez, Iker, et al.
Pubblicazione: (2025)
On The Performance of Prefix-Sum Parallel Kalman Filters and Smoothers on GPUs
di: Särkkä, Simo, et al.
Pubblicazione: (2025)
di: Särkkä, Simo, et al.
Pubblicazione: (2025)
High-Performance Parallelization of Dijkstra's Algorithm Using MPI and CUDA
di: Song, Boyang
Pubblicazione: (2025)
di: Song, Boyang
Pubblicazione: (2025)
Straggler Tolerant and Resilient DL Training on Homogeneous GPUs
di: Zhang, Zeyu, et al.
Pubblicazione: (2025)
di: Zhang, Zeyu, et al.
Pubblicazione: (2025)
Accurate Computation of the Logarithm of Modified Bessel Functions on GPUs
di: Plesner, Andreas, et al.
Pubblicazione: (2024)
di: Plesner, Andreas, et al.
Pubblicazione: (2024)
Astra: Efficient and Money-saving Automatic Parallel Strategies Search on Heterogeneous GPUs
di: Wang, Peiran, et al.
Pubblicazione: (2025)
di: Wang, Peiran, et al.
Pubblicazione: (2025)
Scaled Block Vecchia Approximation for High-Dimensional Gaussian Process Emulation on GPUs
di: Pan, Qilong, et al.
Pubblicazione: (2025)
di: Pan, Qilong, et al.
Pubblicazione: (2025)
Managing Multi Instance GPUs for High Throughput and Energy Savings
di: Saraha, Abhijeet, et al.
Pubblicazione: (2025)
di: Saraha, Abhijeet, et al.
Pubblicazione: (2025)
Analytical Performance Estimation during Code Generation on Modern GPUs
di: Ernst, Dominik, et al.
Pubblicazione: (2022)
di: Ernst, Dominik, et al.
Pubblicazione: (2022)
Documenti analoghi
-
Parallelizing Maximal Clique Enumeration on GPUs
di: Almasri, Mohammad, et al.
Pubblicazione: (2022) -
Algorithms for Parallel Shared-Memory Sparse Matrix-Vector Multiplication on Unstructured Matrices
di: Bergmans, Kobe, et al.
Pubblicazione: (2025) -
PruneX: A Hierarchical Communication-Efficient System for Distributed CNN Training with Structured Pruning
di: Olama, Alireza, et al.
Pubblicazione: (2025) -
FTuner: A Fast Dynamic Shape Tensors Program Auto-Tuner for Deep Learning Compilers
di: Mu, Pengyu, et al.
Pubblicazione: (2024) -
Analysing cycloids using linear algebra
di: Valk, Rüdiger
Pubblicazione: (2024)