Serinv: A Scalable Library for the Selected Inversion of Block-Tridiagonal with Arrowhead Matrices
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Maillou, Vincent, Gaedke-Merzhaeuser, Lisa, Ziogas, Alexandros Nikolaos, Schenk, Olaf, Luisier, Mathieu |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Parallel Quadratic Selected Inversion in Quantum Transport Simulation
par: Maillou, Vincent, et autres
Publié: (2026)
par: Maillou, Vincent, et autres
Publié: (2026)
ADELIA: Automatic Differentiation for Efficient Laplace Inference Approximations
par: Boudaoud, Afif, et autres
Publié: (2026)
par: Boudaoud, Afif, et autres
Publié: (2026)
Accelerated Spatio-Temporal Bayesian Modeling for Multivariate Gaussian Processes
par: Gaedke-Merzhäuser, Lisa, et autres
Publié: (2025)
par: Gaedke-Merzhäuser, Lisa, et autres
Publié: (2025)
Staging Blocked Evaluation over Structured Sparse Matrices
par: Das, Pratyush, et autres
Publié: (2024)
par: Das, Pratyush, et autres
Publié: (2024)
Efficient and scalable atmospheric dynamics simulations using non-conforming meshes
par: Orlando, Giuseppe, et autres
Publié: (2024)
par: Orlando, Giuseppe, et autres
Publié: (2024)
Improving the scalability of a high-order atmospheric dynamics solver based on the deal.II library
par: Orlando, Giuseppe, et autres
Publié: (2025)
par: Orlando, Giuseppe, et autres
Publié: (2025)
A High Performance GPU CountSketch Implementation and Its Application to Multisketching and Least Squares Problems
par: Higgins, Andrew J., et autres
Publié: (2025)
par: Higgins, Andrew J., et autres
Publié: (2025)
Cache Blocking of Distributed-Memory Parallel Matrix Power Kernels
par: Lacey, Dane C., et autres
Publié: (2024)
par: Lacey, Dane C., et autres
Publié: (2024)
Scalable GPU Performance Variability Analysis framework
par: Lahiry, Ankur, et autres
Publié: (2025)
par: Lahiry, Ankur, et autres
Publié: (2025)
mLR: Scalable Laminography Reconstruction based on Memoization
par: Ma, Bin, et autres
Publié: (2025)
par: Ma, Bin, et autres
Publié: (2025)
Toward Scalable Docker-Based Emulations of Blockchain Networks for Research and Development
par: Pennino, Diego, et autres
Publié: (2024)
par: Pennino, Diego, et autres
Publié: (2024)
Scalable Systems and Software Architectures for High-Performance Computing on cloud platforms
par: Ramesh, Risshab Srinivas
Publié: (2024)
par: Ramesh, Risshab Srinivas
Publié: (2024)
Towards a Scalable and Efficient PGAS-based Distributed OpenMP
par: Shan, Baodi, et autres
Publié: (2024)
par: Shan, Baodi, et autres
Publié: (2024)
Distributed Equivariant Graph Neural Networks for Large-Scale Electronic Structure Prediction
par: Kaniselvan, Manasa, et autres
Publié: (2025)
par: Kaniselvan, Manasa, et autres
Publié: (2025)
Efficient Hardware Accelerator Based on Medium Granularity Dataflow for SpTRSV
par: Chen, Qian, et autres
Publié: (2024)
par: Chen, Qian, et autres
Publié: (2024)
DataStates-LLM: Scalable Checkpointing for Transformer Models Using Composable State Providers
par: Maurya, Avinash, et autres
Publié: (2026)
par: Maurya, Avinash, et autres
Publié: (2026)
Fast and Scalable Mixed Precision Euclidean Distance Calculations Using GPU Tensor Cores
par: Curless, Brian, et autres
Publié: (2025)
par: Curless, Brian, et autres
Publié: (2025)
Ab-initio Quantum Transport with the GW Approximation, 42,240 Atoms, and Sustained Exascale Performance
par: Vetsch, Nicolas, et autres
Publié: (2025)
par: Vetsch, Nicolas, et autres
Publié: (2025)
Stabl: Blockchain Fault Tolerance
par: Gramoli, Vincent, et autres
Publié: (2024)
par: Gramoli, Vincent, et autres
Publié: (2024)
Comparing Parallel Functional Array Languages: Programming and Performance
par: van Balen, David, et autres
Publié: (2025)
par: van Balen, David, et autres
Publié: (2025)
FluxSieve: Unifying Streaming and Analytical Data Planes for Scalable Cloud Observability
par: Vogel, Adriano, et autres
Publié: (2026)
par: Vogel, Adriano, et autres
Publié: (2026)
A Communication Avoiding and Reducing Algorithm for Symmetric Eigenproblem for Very Small Matrices
par: Katagiri, Takahiro, et autres
Publié: (2024)
par: Katagiri, Takahiro, et autres
Publié: (2024)
Extracting Practical, Actionable Energy Insights from Supercomputer Telemetry and Logs
par: Cornelius, Melanie, et autres
Publié: (2025)
par: Cornelius, Melanie, et autres
Publié: (2025)
Scaling Large-scale GNN Training to Thousands of Processors on CPU-based Supercomputers
par: Zhuang, Chen, et autres
Publié: (2024)
par: Zhuang, Chen, et autres
Publié: (2024)
Profiling and optimization of multi-card GPU machine learning jobs
par: Lawenda, Marcin, et autres
Publié: (2025)
par: Lawenda, Marcin, et autres
Publié: (2025)
Optimal Parallel Scheduling under Concave Speedup Functions
par: Li, Chengzhang, et autres
Publié: (2025)
par: Li, Chengzhang, et autres
Publié: (2025)
WebAssembly and Unikernels: A Comparative Study for Serverless at the Edge
par: Besozzi, Valerio, et autres
Publié: (2025)
par: Besozzi, Valerio, et autres
Publié: (2025)
Efficient GPU-Centered Singular Value Decomposition Using the Divide-and-Conquer Method
par: Liu, Shifang, et autres
Publié: (2025)
par: Liu, Shifang, et autres
Publié: (2025)
Resource Management Schemes for Cloud-Native Platforms with Computing Containers of Docker and Kubernetes
par: Mao, Ying, et autres
Publié: (2020)
par: Mao, Ying, et autres
Publié: (2020)
Cloud Performance Decomposition for Long-Term Performance Engineering: A Case Study
par: Debnath, Shimul, et autres
Publié: (2026)
par: Debnath, Shimul, et autres
Publié: (2026)
Collaborative Processing for Multi-Tenant Inference on Memory-Constrained Edge TPUs
par: Ng, Nathan, et autres
Publié: (2026)
par: Ng, Nathan, et autres
Publié: (2026)
Preliminary report: Initial evaluation of StdPar implementations on AMD GPUs for HPC
par: Lin, Wei-Chen, et autres
Publié: (2024)
par: Lin, Wei-Chen, et autres
Publié: (2024)
Serving Chain-structured Jobs with Large Memory Footprints with Application to Large Foundation Model Serving
par: Sun, Tingyang, et autres
Publié: (2026)
par: Sun, Tingyang, et autres
Publié: (2026)
Reducing Tail Latencies Through Environment- and Neighbour-aware Thread Management
par: Jeffery, Andrew, et autres
Publié: (2024)
par: Jeffery, Andrew, et autres
Publié: (2024)
Dissecting the software-based measurement of CPU energy consumption: a comparative analysis
par: Raffin, Guillaume, et autres
Publié: (2024)
par: Raffin, Guillaume, et autres
Publié: (2024)
Bridding OT and PaaS in Edge-to-Cloud Continuum
par: Barrios, Carlos J, et autres
Publié: (2025)
par: Barrios, Carlos J, et autres
Publié: (2025)
RAPID-LLM: Resilience-Aware Performance analysis of Infrastructure for Distributed LLM Training and Inference
par: Karfakis, George, et autres
Publié: (2025)
par: Karfakis, George, et autres
Publié: (2025)
Minos: Systematically Classifying Performance and Power Characteristics of GPU Workloads on HPC Clusters
par: Jain, Rutwik, et autres
Publié: (2026)
par: Jain, Rutwik, et autres
Publié: (2026)
Hardware-Agnostic and Insightful Efficiency Metrics for Accelerated Systems: Definition and Implementation within TALP
par: Rahimi, Ghazal, et autres
Publié: (2026)
par: Rahimi, Ghazal, et autres
Publié: (2026)
Node Compass: Multilevel Tracing and Debugging of Request Executions in JavaScript-Based Web-Servers
par: Kabamba, Herve Mbikayi, et autres
Publié: (2023)
par: Kabamba, Herve Mbikayi, et autres
Publié: (2023)
Documents similaires
-
Parallel Quadratic Selected Inversion in Quantum Transport Simulation
par: Maillou, Vincent, et autres
Publié: (2026) -
ADELIA: Automatic Differentiation for Efficient Laplace Inference Approximations
par: Boudaoud, Afif, et autres
Publié: (2026) -
Accelerated Spatio-Temporal Bayesian Modeling for Multivariate Gaussian Processes
par: Gaedke-Merzhäuser, Lisa, et autres
Publié: (2025) -
Staging Blocked Evaluation over Structured Sparse Matrices
par: Das, Pratyush, et autres
Publié: (2024) -
Efficient and scalable atmospheric dynamics simulations using non-conforming meshes
par: Orlando, Giuseppe, et autres
Publié: (2024)