pdGRASS: A Fast Parallel Density-Aware Algorithm for Graph Spectral Sparsification
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Zhao, Tiancheng, Yin, Zekun, An, Huihai, Yang, Xiaoyu, Jin, Zhou, Shen, Jiasi, Xu, Helen |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
FastGraph: Optimized GPU-Enabled Algorithms for Fast Graph Building and Message Passing
par: Agarwal, Aarush, et autres
Publié: (2025)
par: Agarwal, Aarush, et autres
Publié: (2025)
HAP: Hybrid Adaptive Parallelism for Efficient Mixture-of-Experts Inference
par: Lin, Haoran, et autres
Publié: (2025)
par: Lin, Haoran, et autres
Publié: (2025)
FastSet: Parallel Claim Settlement
par: Chen, Xiaohong, et autres
Publié: (2025)
par: Chen, Xiaohong, et autres
Publié: (2025)
CaPGNN: Optimizing Parallel Graph Neural Network Training with Joint Caching and Resource-Aware Graph Partitioning
par: Song, Xianfeng, et autres
Publié: (2025)
par: Song, Xianfeng, et autres
Publié: (2025)
Ghidorah: Fast LLM Inference on Edge with Speculative Decoding and Hetero-Core Parallelism
par: Wei, Jinhui, et autres
Publié: (2025)
par: Wei, Jinhui, et autres
Publié: (2025)
Shoal++: High Throughput DAG BFT Can Be Fast!
par: Arun, Balaji, et autres
Publié: (2024)
par: Arun, Balaji, et autres
Publié: (2024)
Resource-Aware Aggregation and Sparsification in Heterogeneous Ensemble Federated Learning
par: Ryum, Keumseo, et autres
Publié: (2025)
par: Ryum, Keumseo, et autres
Publié: (2025)
GRNND: A GPU-Parallel Relative NN-Descent Algorithm for Efficient Approximate Nearest Neighbor Graph Construction
par: Li, Xiang, et autres
Publié: (2025)
par: Li, Xiang, et autres
Publié: (2025)
ZeroPP: Unleashing Exceptional Parallelism Efficiency through Tensor-Parallelism-Free Methodology
par: Tang, Ding, et autres
Publié: (2024)
par: Tang, Ding, et autres
Publié: (2024)
Zeppelin: Balancing Variable-length Workloads in Data Parallel Large Model Training
par: Chen, Chang, et autres
Publié: (2025)
par: Chen, Chang, et autres
Publié: (2025)
SparseServe: Unlocking Parallelism for Dynamic Sparse Attention in Long-Context LLM Serving
par: Zhou, Qihui, et autres
Publié: (2025)
par: Zhou, Qihui, et autres
Publié: (2025)
Deferred Objects to Enhance Smart Contract Programming with Optimistic Parallel Execution
par: Mitenkov, George, et autres
Publié: (2024)
par: Mitenkov, George, et autres
Publié: (2024)
Mask-Encoded Sparsification: Mitigating Biased Gradients in Communication-Efficient Split Learning
par: Zhou, Wenxuan, et autres
Publié: (2024)
par: Zhou, Wenxuan, et autres
Publié: (2024)
A Survey of Distributed Graph Algorithms on Massive Graphs
par: Meng, Lingkai, et autres
Publié: (2024)
par: Meng, Lingkai, et autres
Publié: (2024)
Parallel Spawning Strategies for Dynamic-Aware MPI Applications
par: Martín-Álvarez, Iker, et autres
Publié: (2025)
par: Martín-Álvarez, Iker, et autres
Publié: (2025)
Utilizing Graph Sparsification for Pre-processing in Maxcut QUBO Solver
par: Suppakitpaisarn, Vorapong, et autres
Publié: (2024)
par: Suppakitpaisarn, Vorapong, et autres
Publié: (2024)
High-Performance Parallelization of Dijkstra's Algorithm Using MPI and CUDA
par: Song, Boyang
Publié: (2025)
par: Song, Boyang
Publié: (2025)
Fast Iterative Graph Computing with Updated Neighbor States
par: Zhou, Yijie, et autres
Publié: (2024)
par: Zhou, Yijie, et autres
Publié: (2024)
Parallel Order-Based Core Maintenance in Dynamic Graphs
par: Guo, Bin, et autres
Publié: (2022)
par: Guo, Bin, et autres
Publié: (2022)
cuFastTuckerPlus: A Stochastic Parallel Sparse FastTucker Decomposition Using GPU Tensor Cores
par: Li, Zixuan, et autres
Publié: (2024)
par: Li, Zixuan, et autres
Publié: (2024)
Amoeba: Runtime Tensor Parallel Transformation for LLM Inference Services
par: Chen, Haoyu, et autres
Publié: (2025)
par: Chen, Haoyu, et autres
Publié: (2025)
MixServe: An Automatic Distributed Serving System for MoE Models with Hybrid Parallelism Based on Fused Communication Algorithm
par: Zhou, Bowen, et autres
Publié: (2026)
par: Zhou, Bowen, et autres
Publié: (2026)
Edge-Parallel Graph Encoder Embedding
par: Lubonja, Ariel, et autres
Publié: (2024)
par: Lubonja, Ariel, et autres
Publié: (2024)
FPTC: A Fast Parallel Transform-based Codec for Efficient Asymmetric Signal Compression
par: Mechels, Ben, et autres
Publié: (2026)
par: Mechels, Ben, et autres
Publié: (2026)
Efficient Task Graph Scheduling for Parallel QR Factorization in SLSQP
par: Chatterjee, Soumyajit, et autres
Publié: (2025)
par: Chatterjee, Soumyajit, et autres
Publié: (2025)
Distributed And Parallel Low-Diameter Decompositions for Arbitrary and Restricted Graphs
par: Dou, Jinfeng, et autres
Publié: (2024)
par: Dou, Jinfeng, et autres
Publié: (2024)
Faster Parallel Triangular Maximally Filtered Graphs and Hierarchical Clustering
par: Raphael, Steven, et autres
Publié: (2024)
par: Raphael, Steven, et autres
Publié: (2024)
Fast and Space-Efficient Parallel Algorithms for Influence Maximization
par: Wang, Letong, et autres
Publié: (2023)
par: Wang, Letong, et autres
Publié: (2023)
Comparative Analysis of Distributed Caching Algorithms: Performance Metrics and Implementation Considerations
par: Mayer, Helen, et autres
Publié: (2025)
par: Mayer, Helen, et autres
Publié: (2025)
ElasWave: An Elastic-Native System for Scalable Hybrid-Parallel Training
par: Kang, Xueze, et autres
Publié: (2025)
par: Kang, Xueze, et autres
Publié: (2025)
Parallel GPU-Enabled Algorithms for SpGEMM on Arbitrary Semirings with Hybrid Communication
par: McFarland, Thomas, et autres
Publié: (2025)
par: McFarland, Thomas, et autres
Publié: (2025)
Faster Vertex Cover Algorithms on GPUs with Component-Aware Parallel Branching
par: Amro, Hussein, et autres
Publié: (2025)
par: Amro, Hussein, et autres
Publié: (2025)
A Parallel and Distributed Rust Library for Core Decomposition on Large Graphs
par: Rucci, Davide, et autres
Publié: (2025)
par: Rucci, Davide, et autres
Publié: (2025)
Scene-Aware Latency Estimation for Microservices via Multi-Scale Graph Fusion
par: Sun, Zhichao, et autres
Publié: (2026)
par: Sun, Zhichao, et autres
Publié: (2026)
APEX: An Extensible and Dynamism-Aware Simulator for Automated Parallel Execution in LLM Serving
par: Lin, Yi-Chien, et autres
Publié: (2024)
par: Lin, Yi-Chien, et autres
Publié: (2024)
Parallel Track Transformers: Enabling Fast GPU Inference with Reduced Synchronization
par: Wang, Chong, et autres
Publié: (2026)
par: Wang, Chong, et autres
Publié: (2026)
How Fast Can Graph Computations Go on Fine-grained Parallel Architectures
par: Wang, Yuqing, et autres
Publié: (2025)
par: Wang, Yuqing, et autres
Publié: (2025)
Parameterized Task Graph Scheduling Algorithm for Comparing Algorithmic Components
par: Coleman, Jared, et autres
Publié: (2024)
par: Coleman, Jared, et autres
Publié: (2024)
Distributed-Memory Parallel Algorithms for Sparse Matrix and Sparse Tall-and-Skinny Matrix Multiplication
par: Ranawaka, Isuru, et autres
Publié: (2024)
par: Ranawaka, Isuru, et autres
Publié: (2024)
FLYING SERVING: On-the-Fly Parallelism Switching for Large Language Model Serving
par: Gao, Shouwei, et autres
Publié: (2026)
par: Gao, Shouwei, et autres
Publié: (2026)
Documents similaires
-
FastGraph: Optimized GPU-Enabled Algorithms for Fast Graph Building and Message Passing
par: Agarwal, Aarush, et autres
Publié: (2025) -
HAP: Hybrid Adaptive Parallelism for Efficient Mixture-of-Experts Inference
par: Lin, Haoran, et autres
Publié: (2025) -
FastSet: Parallel Claim Settlement
par: Chen, Xiaohong, et autres
Publié: (2025) -
CaPGNN: Optimizing Parallel Graph Neural Network Training with Joint Caching and Resource-Aware Graph Partitioning
par: Song, Xianfeng, et autres
Publié: (2025) -
Ghidorah: Fast LLM Inference on Edge with Speculative Decoding and Hetero-Core Parallelism
par: Wei, Jinhui, et autres
Publié: (2025)