Fast Sparse Matrix Permutation for Mesh-Based Direct Solvers
Fuente:
arXiv
Salvato in:
| Autori principali: | Zarebavami, Behrooz, Mahmoud, Ahmed H., Dodik, Ana, Yuan, Changcheng, Porumbescu, Serban D., Owens, John D., Dehnavi, Maryam Mehri, Solomon, Justin |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
GALE: Leveraging Heterogeneous Systems for Efficient Unstructured Mesh Data Analysis
di: Liu, Guoxi, et al.
Pubblicazione: (2025)
di: Liu, Guoxi, et al.
Pubblicazione: (2025)
HPC-based Solvers of Minimisation Problems for Signal Processing
di: Cammarasana, Simone, et al.
Pubblicazione: (2023)
di: Cammarasana, Simone, et al.
Pubblicazione: (2023)
A Framework for Fine-Grained Synchronization of Dependent GPU Kernels
di: Jangda, Abhinav, et al.
Pubblicazione: (2023)
di: Jangda, Abhinav, et al.
Pubblicazione: (2023)
RAFI -- A Ray/Work Forwarding Infrastructure for Data Parallel Multi-Node/Multi-GPU Computing
di: Wald, Ingo, et al.
Pubblicazione: (2026)
di: Wald, Ingo, et al.
Pubblicazione: (2026)
Capsule: Efficient Player Isolation for Datacenters
di: Du, Zhouheng, et al.
Pubblicazione: (2025)
di: Du, Zhouheng, et al.
Pubblicazione: (2025)
MSz: An Efficient Parallel Algorithm for Correcting Morse-Smale Segmentations in Error-Bounded Lossy Compressors
di: Li, Yuxiao, et al.
Pubblicazione: (2024)
di: Li, Yuxiao, et al.
Pubblicazione: (2024)
GPU Volume Rendering with Hierarchical Compression Using VDB
di: Zellmann, Stefan, et al.
Pubblicazione: (2025)
di: Zellmann, Stefan, et al.
Pubblicazione: (2025)
Barrier-Augmented Lagrangian for GPU-based Elastodynamic Contact
di: Guo, Dewen, et al.
Pubblicazione: (2024)
di: Guo, Dewen, et al.
Pubblicazione: (2024)
An efficient GPU approach for designing 3D cultural heritage information systems
di: López, Luis, et al.
Pubblicazione: (2025)
di: López, Luis, et al.
Pubblicazione: (2025)
Exploiting ray tracing technology through OptiX to compute particle interactions with cutoff in a 3D environment on GPU
di: David, Algis, et al.
Pubblicazione: (2024)
di: David, Algis, et al.
Pubblicazione: (2024)
DiffPhD: A Unified Differentiable Solver for Projective Heterogeneous Materials in Elastodynamics with Contact-Rich GPU-Acceleration
di: Lai, Shih-Yu, et al.
Pubblicazione: (2026)
di: Lai, Shih-Yu, et al.
Pubblicazione: (2026)
Hierarchical Transformer Preconditioning for Interactive Physics Simulation
di: Osborne, Carl, et al.
Pubblicazione: (2026)
di: Osborne, Carl, et al.
Pubblicazione: (2026)
Arkade: k-Nearest Neighbor Search With Non-Euclidean Distances using GPU Ray Tracing
di: Mandarapu, Durga, et al.
Pubblicazione: (2023)
di: Mandarapu, Durga, et al.
Pubblicazione: (2023)
Iskra: A System for Inverse Geometry Processing
di: Dodik, Ana, et al.
Pubblicazione: (2026)
di: Dodik, Ana, et al.
Pubblicazione: (2026)
Prompt-Aware Scheduling for Efficient Text-to-Image Inferencing System
di: Agarwal, Shubham, et al.
Pubblicazione: (2025)
di: Agarwal, Shubham, et al.
Pubblicazione: (2025)
Distributed Simulation of Large Multi-body Systems
di: Kale, Manas, et al.
Pubblicazione: (2024)
di: Kale, Manas, et al.
Pubblicazione: (2024)
Accelerating HDC-CNN Hybrid Models Using Custom Instructions on RISC-V GPUs
di: Matsumi, Wakuto, et al.
Pubblicazione: (2025)
di: Matsumi, Wakuto, et al.
Pubblicazione: (2025)
Paris: A Decentralized Trained Open-Weight Diffusion Model
di: Jiang, Zhiying, et al.
Pubblicazione: (2025)
di: Jiang, Zhiying, et al.
Pubblicazione: (2025)
Stimpack: An Adaptive Rendering Optimization System for Scalable Cloud Gaming
di: Heo, Jin, et al.
Pubblicazione: (2024)
di: Heo, Jin, et al.
Pubblicazione: (2024)
STRIELAD -- A Scalable Toolkit for Real-time Interactive Exploration of Large Atmospheric Datasets
di: Schneegans, Simon, et al.
Pubblicazione: (2025)
di: Schneegans, Simon, et al.
Pubblicazione: (2025)
DaVE -- A Curated Database of Visualization Examples
di: Koenen, Jens, et al.
Pubblicazione: (2024)
di: Koenen, Jens, et al.
Pubblicazione: (2024)
Adaptive Algebraic Reuse of Reordering in Cholesky Factorization with Dynamic Sparsity Pattern
di: Zarebavani, Behrooz, et al.
Pubblicazione: (2024)
di: Zarebavani, Behrooz, et al.
Pubblicazione: (2024)
Parallel Ray Tracing of Black Hole Images Using the Schwarzschild Metric
di: Naddell, Liam, et al.
Pubblicazione: (2025)
di: Naddell, Liam, et al.
Pubblicazione: (2025)
Towards Real-Time Neural Volumetric Rendering on Mobile Devices: A Measurement Study
di: Wang, Zhe, et al.
Pubblicazione: (2024)
di: Wang, Zhe, et al.
Pubblicazione: (2024)
NeRF-XL: Scaling NeRFs with Multiple GPUs
di: Li, Ruilong, et al.
Pubblicazione: (2024)
di: Li, Ruilong, et al.
Pubblicazione: (2024)
A3FR: Agile 3D Gaussian Splatting with Incremental Gaze Tracked Foveated Rendering in Virtual Reality
di: Xin, Shuo, et al.
Pubblicazione: (2025)
di: Xin, Shuo, et al.
Pubblicazione: (2025)
Distributed-memory Algorithms for Sparse Matrix Permutation, Extraction, and Assignment
di: Hassani, Elaheh, et al.
Pubblicazione: (2025)
di: Hassani, Elaheh, et al.
Pubblicazione: (2025)
SDSL-Solver: Scalable Distributed Sparse Linear Solvers for Large-Scale Interior Point Methods
di: Yang, Shaofeng, et al.
Pubblicazione: (2026)
di: Yang, Shaofeng, et al.
Pubblicazione: (2026)
AsyncSparse: Accelerating Sparse Matrix-Matrix Multiplication on Asynchronous GPU Architectures
di: Liu, Jie, et al.
Pubblicazione: (2026)
di: Liu, Jie, et al.
Pubblicazione: (2026)
Ocean: Fast Estimation-Based Sparse General Matrix-Matrix Multiplication on GPU
di: Li, Yifan, et al.
Pubblicazione: (2026)
di: Li, Yifan, et al.
Pubblicazione: (2026)
AIvaluateXR: An Evaluation Framework for on-Device AI in XR with Benchmarking Results
di: Khan, Dawar, et al.
Pubblicazione: (2025)
di: Khan, Dawar, et al.
Pubblicazione: (2025)
Distributed-Memory Parallel Algorithms for Sparse Matrix and Sparse Tall-and-Skinny Matrix Multiplication
di: Ranawaka, Isuru, et al.
Pubblicazione: (2024)
di: Ranawaka, Isuru, et al.
Pubblicazione: (2024)
Fast Kronecker Matrix-Matrix Multiplication on GPUs
di: Jangda, Abhinav, et al.
Pubblicazione: (2024)
di: Jangda, Abhinav, et al.
Pubblicazione: (2024)
Is Sparse Matrix Reordering Effective for Sparse Matrix-Vector Multiplication?
di: Asudeh, Omid, et al.
Pubblicazione: (2025)
di: Asudeh, Omid, et al.
Pubblicazione: (2025)
Locality-Aware Automatic Differentiation on the GPU for Mesh-Based Computations
di: Mahmoud, Ahmed H., et al.
Pubblicazione: (2025)
di: Mahmoud, Ahmed H., et al.
Pubblicazione: (2025)
Sparsity-Aware Roofline Models for Sparse Matrix-Matrix Multiplication
di: Qian, Matthew, et al.
Pubblicazione: (2026)
di: Qian, Matthew, et al.
Pubblicazione: (2026)
Tangent Blow-Ups for Processing Non-Manifold Geometry
di: Petrov, Alice, et al.
Pubblicazione: (2026)
di: Petrov, Alice, et al.
Pubblicazione: (2026)
Accelerating Sparse Matrix-Matrix Multiplication on GPUs with Processing Near HBMs
di: Li, Shiju, et al.
Pubblicazione: (2025)
di: Li, Shiju, et al.
Pubblicazione: (2025)
MAGNUS: Generating Data Locality to Accelerate Sparse Matrix-Matrix Multiplication on CPUs
di: Wolfson-Pou, Jordi, et al.
Pubblicazione: (2025)
di: Wolfson-Pou, Jordi, et al.
Pubblicazione: (2025)
Improving Locality in Sparse and Dense Matrix Multiplications
di: Dezfuli, Mohammad Mahdi Salehi, et al.
Pubblicazione: (2024)
di: Dezfuli, Mohammad Mahdi Salehi, et al.
Pubblicazione: (2024)
Documenti analoghi
-
GALE: Leveraging Heterogeneous Systems for Efficient Unstructured Mesh Data Analysis
di: Liu, Guoxi, et al.
Pubblicazione: (2025) -
HPC-based Solvers of Minimisation Problems for Signal Processing
di: Cammarasana, Simone, et al.
Pubblicazione: (2023) -
A Framework for Fine-Grained Synchronization of Dependent GPU Kernels
di: Jangda, Abhinav, et al.
Pubblicazione: (2023) -
RAFI -- A Ray/Work Forwarding Infrastructure for Data Parallel Multi-Node/Multi-GPU Computing
di: Wald, Ingo, et al.
Pubblicazione: (2026) -
Capsule: Efficient Player Isolation for Datacenters
di: Du, Zhouheng, et al.
Pubblicazione: (2025)