GPU-Accelerated Batch-Dynamic Subgraph Matching
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Qiu, Linshan, Chen, Lu, Jie, Hailiang, Ke, Xiangyu, Gao, Yunjun, Liu, Yang, Zhang, Zetao |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Accelerating Biclique Counting on GPU
par: Qiu, Linshan, et autres
Publié: (2024)
par: Qiu, Linshan, et autres
Publié: (2024)
HC-SpMM: Accelerating Sparse Matrix-Matrix Multiplication for Graphs with Hybrid GPU Cores
par: Li, Zhonggen, et autres
Publié: (2024)
par: Li, Zhonggen, et autres
Publié: (2024)
Efficient Graph Embedding at Scale: Optimizing CPU-GPU-SSD Integration
par: Li, Zhonggen, et autres
Publié: (2025)
par: Li, Zhonggen, et autres
Publié: (2025)
AsyncSparse: Accelerating Sparse Matrix-Matrix Multiplication on Asynchronous GPU Architectures
par: Liu, Jie, et autres
Publié: (2026)
par: Liu, Jie, et autres
Publié: (2026)
A Practical GPU-Accelerated Implementation of Orthogonal Matching Pursuit
par: Lubonja, Ariel, et autres
Publié: (2024)
par: Lubonja, Ariel, et autres
Publié: (2024)
GPU-Accelerated Vecchia Approximations of Gaussian Processes for Geospatial Data using Batched Matrix Computations
par: Pan, Qilong, et autres
Publié: (2024)
par: Pan, Qilong, et autres
Publié: (2024)
Scalable Graph Indexing using GPUs for Approximate Nearest Neighbor Search
par: Li, Zhonggen, et autres
Publié: (2025)
par: Li, Zhonggen, et autres
Publié: (2025)
GPZ: GPU-Accelerated Lossy Compressor for Particle Data
par: Li, Ruoyu, et autres
Publié: (2025)
par: Li, Ruoyu, et autres
Publié: (2025)
XMiner: Efficient Directed Subgraph Matching with Pattern Reduction
par: Yuan, Pingpeng, et autres
Publié: (2024)
par: Yuan, Pingpeng, et autres
Publié: (2024)
gZCCL: Compression-Accelerated Collective Communication Framework for GPU Clusters
par: Huang, Jiajun, et autres
Publié: (2023)
par: Huang, Jiajun, et autres
Publié: (2023)
GPU Accelerated Sparse Cholesky Factorization
par: Karsavuran, M. Ozan, et autres
Publié: (2024)
par: Karsavuran, M. Ozan, et autres
Publié: (2024)
PICO: Accelerating All k-Core Paradigms on GPU
par: Zhao, Chen, et autres
Publié: (2024)
par: Zhao, Chen, et autres
Publié: (2024)
PilotANN: Memory-Bounded GPU Acceleration for Vector Search
par: Gui, Yuntao, et autres
Publié: (2025)
par: Gui, Yuntao, et autres
Publié: (2025)
A Preliminary Study on Accelerating Simulation Optimization with GPU Implementation
par: He, Jinghai, et autres
Publié: (2024)
par: He, Jinghai, et autres
Publié: (2024)
HarmonyBatch: Batching multi-SLO DNN Inference with Heterogeneous Serverless Functions
par: Chen, Jiabin, et autres
Publié: (2024)
par: Chen, Jiabin, et autres
Publié: (2024)
CRIUgpu: Transparent Checkpointing of GPU-Accelerated Workloads
par: Stoyanov, Radostin, et autres
Publié: (2025)
par: Stoyanov, Radostin, et autres
Publié: (2025)
Accelerating Intra-Node GPU-to-GPU Communication Through Multi-Path Transfers with CUDA Graphs
par: Sojoodi, Amirhossein, et autres
Publié: (2026)
par: Sojoodi, Amirhossein, et autres
Publié: (2026)
Improving GPU Multi-Tenancy Through Dynamic Multi-Instance GPU Reconfiguration
par: Wang, Tianyu, et autres
Publié: (2024)
par: Wang, Tianyu, et autres
Publié: (2024)
Accelerating Sparse MTTKRP for Small Tensor Decomposition on GPU
par: Wijeratne, Sasindu, et autres
Publié: (2025)
par: Wijeratne, Sasindu, et autres
Publié: (2025)
Efficient Accelerated Graph Edit Distance Computation on GPU
par: Dabah, Adel, et autres
Publié: (2026)
par: Dabah, Adel, et autres
Publié: (2026)
Enabling Efficient Batch Serving for LMaaS via Generation Length Prediction
par: Cheng, Ke, et autres
Publié: (2024)
par: Cheng, Ke, et autres
Publié: (2024)
Accelerating Drug Discovery in AutoDock-GPU with Tensor Cores
par: Schieffer, Gabin, et autres
Publié: (2024)
par: Schieffer, Gabin, et autres
Publié: (2024)
GPU-Accelerated Distributed QAOA on Large-scale HPC Ecosystems
par: Xu, Zhihao, et autres
Publié: (2025)
par: Xu, Zhihao, et autres
Publié: (2025)
GPU Acceleration for Faster Evolutionary Spatial Cyclic Game Systems
par: Sinadjan, Louie
Publié: (2025)
par: Sinadjan, Louie
Publié: (2025)
SOLANET: Distributed Neighbor Graph Construction on GPU-Accelerated Systems
par: Iwabuchi, Keita, et autres
Publié: (2026)
par: Iwabuchi, Keita, et autres
Publié: (2026)
Boosting LLM Serving through Spatial-Temporal GPU Resource Sharing
par: Lin, Zejia, et autres
Publié: (2025)
par: Lin, Zejia, et autres
Publié: (2025)
Dataflow-Oriented Classification and Performance Analysis of GPU-Accelerated Homomorphic Encryption
par: Nozaki, Ai, et autres
Publié: (2026)
par: Nozaki, Ai, et autres
Publié: (2026)
A GPU Accelerated Temporal Window-Based Random Walk Sampler
par: Salehin, Md Ashfaq, et autres
Publié: (2026)
par: Salehin, Md Ashfaq, et autres
Publié: (2026)
GPU-Accelerated Modified Bessel Function of the Second Kind for Gaussian Processes
par: Geng, Zipei, et autres
Publié: (2025)
par: Geng, Zipei, et autres
Publié: (2025)
GPU-Accelerated Selected Basis Diagonalization with Thrust for SQD-based Algorithms
par: Doi, Jun, et autres
Publié: (2026)
par: Doi, Jun, et autres
Publié: (2026)
DIMS: Distributed Index for Similarity Search in Metric Spaces
par: Zhu, Yifan, et autres
Publié: (2024)
par: Zhu, Yifan, et autres
Publié: (2024)
AlignedServe: Orchestrating Prefix-aware Batching to Build a High-throughput and Computing-efficient LLM Serving System
par: Bai, Fengyao, et autres
Publié: (2026)
par: Bai, Fengyao, et autres
Publié: (2026)
Distributed OpenMP Offloading of OpenMC on Intel GPU MAX Accelerators
par: Fridman, Yehonatan, et autres
Publié: (2024)
par: Fridman, Yehonatan, et autres
Publié: (2024)
AQUA: Network-Accelerated Memory Offloading for LLMs in Scale-Up GPU Domains
par: Kumar, Abhishek Vijaya, et autres
Publié: (2024)
par: Kumar, Abhishek Vijaya, et autres
Publié: (2024)
Multi-GPU Acceleration of PALABOS Fluid Solver using C++ Standard Parallelism
par: Latt, Jonas, et autres
Publié: (2025)
par: Latt, Jonas, et autres
Publié: (2025)
City-Scale Visibility Graph Analysis via GPU-Accelerated HyperBall
par: Hodge, Alex, et autres
Publié: (2026)
par: Hodge, Alex, et autres
Publié: (2026)
Parallel Collaborative ADMM Privacy Computing and Adaptive GPU Acceleration for Distributed Edge Networks
par: Xia, Mengchun, et autres
Publié: (2026)
par: Xia, Mengchun, et autres
Publié: (2026)
DuaLip-GPU Technical Report
par: Dexter, Gregory, et autres
Publié: (2026)
par: Dexter, Gregory, et autres
Publié: (2026)
Mind the Memory Gap: Unveiling GPU Bottlenecks in Large-Batch LLM Inference
par: Recasens, Pol G., et autres
Publié: (2025)
par: Recasens, Pol G., et autres
Publié: (2025)
SparDL: Distributed Deep Learning Training with Efficient Sparse Communication
par: Zhao, Minjun, et autres
Publié: (2023)
par: Zhao, Minjun, et autres
Publié: (2023)
Documents similaires
-
Accelerating Biclique Counting on GPU
par: Qiu, Linshan, et autres
Publié: (2024) -
HC-SpMM: Accelerating Sparse Matrix-Matrix Multiplication for Graphs with Hybrid GPU Cores
par: Li, Zhonggen, et autres
Publié: (2024) -
Efficient Graph Embedding at Scale: Optimizing CPU-GPU-SSD Integration
par: Li, Zhonggen, et autres
Publié: (2025) -
AsyncSparse: Accelerating Sparse Matrix-Matrix Multiplication on Asynchronous GPU Architectures
par: Liu, Jie, et autres
Publié: (2026) -
A Practical GPU-Accelerated Implementation of Orthogonal Matching Pursuit
par: Lubonja, Ariel, et autres
Publié: (2024)