A Hybrid Direct-Iterative Method for Solving KKT Linear Systems
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Regev, Shaked, Chiang, Nai-Yuan, Darve, Eric, Petra, Cosmin G., Saunders, Michael A., Świrydowicz, Kasia, Peleš, Slaven |
|---|---|
| Format: | Preprint |
| Publié: |
2021
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Iterative Methods in GPU-Resident Linear Solvers for Nonlinear Constrained Optimization
par: Świrydowicz, Kasia, et autres
Publié: (2024)
par: Świrydowicz, Kasia, et autres
Publié: (2024)
A Fast Relax-and-Round Approach to Unit Commitment for Data Center Own Generation
par: Regev, Shaked, et autres
Publié: (2025)
par: Regev, Shaked, et autres
Publié: (2025)
Mixed-Precision Performance Portability of FFT-Based GPU-Accelerated Algorithms for Block-Triangular Toeplitz Matrices
par: Venkat, Sreeram, et autres
Publié: (2025)
par: Venkat, Sreeram, et autres
Publié: (2025)
Multistep schemes for solving backward stochastic differential equations on GPU
par: Kapllani, Lorenc, et autres
Publié: (2019)
par: Kapllani, Lorenc, et autres
Publié: (2019)
Distributed Tomographic Reconstruction with Quantization
par: Miao, Runxuan, et autres
Publié: (2024)
par: Miao, Runxuan, et autres
Publié: (2024)
ML-Based Optimum Number of CUDA Streams for the GPU Implementation of the Tridiagonal Partition Method
par: Veneva, Milena, et autres
Publié: (2025)
par: Veneva, Milena, et autres
Publié: (2025)
ML-Based Optimum Sub-system Size Heuristic for the GPU Implementation of the Tridiagonal Partition Method
par: Veneva, Milena
Publié: (2025)
par: Veneva, Milena
Publié: (2025)
Analysing cycloids using linear algebra
par: Valk, Rüdiger
Publié: (2024)
par: Valk, Rüdiger
Publié: (2024)
Faster Vertex Cover Algorithms on GPUs with Component-Aware Parallel Branching
par: Amro, Hussein, et autres
Publié: (2025)
par: Amro, Hussein, et autres
Publié: (2025)
Big Data Intelligence Using Distributed Deep Neural Networks
par: Ongati, Felix, et autres
Publié: (2019)
par: Ongati, Felix, et autres
Publié: (2019)
The Role of A-priori Information in Networks of Rational Agents
par: Afek, Yehuda, et autres
Publié: (2019)
par: Afek, Yehuda, et autres
Publié: (2019)
Floating Point Compression of Hierarchical Matrix Formats and its Impact on Matrix-Vector Multiplication
par: Kriemann, Ronald
Publié: (2024)
par: Kriemann, Ronald
Publié: (2024)
MaRDIFlow: A CSE workflow framework for abstracting meta-data from FAIR computational experiments
par: Veluvali, Pavan L., et autres
Publié: (2024)
par: Veluvali, Pavan L., et autres
Publié: (2024)
GPU acceleration of non-equilibrium Green's function calculation using OpenACC and CUDA FORTRAN
par: Yin, Jia, et autres
Publié: (2025)
par: Yin, Jia, et autres
Publié: (2025)
OPTIMUM-DERAM: Highly Consistent, Scalable, and Secure Multi-Object Memory using RLNC
par: Nicolaou, Nicolas, et autres
Publié: (2026)
par: Nicolaou, Nicolas, et autres
Publié: (2026)
Acc-SpMM: Accelerating General-purpose Sparse Matrix-Matrix Multiplication with GPU Tensor Cores
par: Zhao, Haisha, et autres
Publié: (2025)
par: Zhao, Haisha, et autres
Publié: (2025)
Context Adaptive Cooperation
par: Albouy, Timothé, et autres
Publié: (2023)
par: Albouy, Timothé, et autres
Publié: (2023)
AEG: A Baremetal Framework for AI Acceleration via Direct Hardware Access in Heterogeneous Accelerators
par: Jiang, Hua, et autres
Publié: (2026)
par: Jiang, Hua, et autres
Publié: (2026)
MERBIT: A GPU-Based SpMV Method for Iterative Workloads
par: Zhang, Qi, et autres
Publié: (2026)
par: Zhang, Qi, et autres
Publié: (2026)
A Morton-Type Space-Filling Curve for Pyramid Subdivision and Hybrid Adaptive Mesh Refinement
par: Knapp, David, et autres
Publié: (2026)
par: Knapp, David, et autres
Publié: (2026)
Exploiting nested task-parallelism in the $\mathcal{H}-LU$ factorization
par: Carratalá-Sáez, Rocío, et autres
Publié: (2019)
par: Carratalá-Sáez, Rocío, et autres
Publié: (2019)
(Almost) Perfect Discrete Iterative Load Balancing
par: Berenbrink, Petra, et autres
Publié: (2025)
par: Berenbrink, Petra, et autres
Publié: (2025)
Cascaded Prediction and Asynchronous Execution of Iterative Algorithms on Heterogeneous Platforms
par: Gao, Jianhua, et autres
Publié: (2024)
par: Gao, Jianhua, et autres
Publié: (2024)
Linear Complexity $\mathcal{H}^2$ Direct Solver for Fine-Grained Parallel Architectures
par: Boukaram, Wajih, et autres
Publié: (2025)
par: Boukaram, Wajih, et autres
Publié: (2025)
Population Protocols Revisited: Parity and Beyond
par: Gąsieniec, Leszek, et autres
Publié: (2025)
par: Gąsieniec, Leszek, et autres
Publié: (2025)
Lossy Data Compression By Adaptive Mesh Coarsening
par: Böing, N., et autres
Publié: (2024)
par: Böing, N., et autres
Publié: (2024)
A new Dune grid for scalable dynamic adaptivity based on the p4est software library
par: Burstedde, Carsten, et autres
Publié: (2025)
par: Burstedde, Carsten, et autres
Publié: (2025)
The High Cost of Keeping Warm: Characterizing Overhead in Serverless Autoscaling Policies
par: Kondrashov, Leonid, et autres
Publié: (2025)
par: Kondrashov, Leonid, et autres
Publié: (2025)
Melding the Serverless Control Plane with the Conventional Cluster Manager for Speed and Resource Efficiency
par: Kondrashov, Leonid, et autres
Publié: (2025)
par: Kondrashov, Leonid, et autres
Publié: (2025)
TPFL: A Trustworthy Personalized Federated Learning Framework via Subjective Logic
par: Chen, Jinqian, et autres
Publié: (2024)
par: Chen, Jinqian, et autres
Publié: (2024)
Enhancing Cluster Resilience: LLM-agent Based Autonomous Intelligent Cluster Diagnosis System and Evaluation Framework
par: Shi, Honghao, et autres
Publié: (2024)
par: Shi, Honghao, et autres
Publié: (2024)
Communication-Efficient Diffusion Strategy for Performance Improvement of Federated Learning with Non-IID Data
par: Ahn, Seyoung, et autres
Publié: (2022)
par: Ahn, Seyoung, et autres
Publié: (2022)
Method for determining the acceleration of a parallel specialised computer system based on Amdahl's law
par: Filipchenko, Aleksandr S.
Publié: (2024)
par: Filipchenko, Aleksandr S.
Publié: (2024)
Massively Parallel Algorithms for Approximate Shortest Paths
par: Dory, Michal, et autres
Publié: (2024)
par: Dory, Michal, et autres
Publié: (2024)
On the Bit Complexity of Iterated Memory
par: Toyos-Marfurt, Guillermo, et autres
Publié: (2024)
par: Toyos-Marfurt, Guillermo, et autres
Publié: (2024)
Precision-Aware Iterative Algorithms Based on Group-Shared Exponents of Floating-Point Numbers
par: Gao, Jianhua, et autres
Publié: (2024)
par: Gao, Jianhua, et autres
Publié: (2024)
Modeling and Simulation of Traffic on I-485 via Linear Systems and Iterative Methods
par: Kealoha, Dominic, et autres
Publié: (2024)
par: Kealoha, Dominic, et autres
Publié: (2024)
RandNet-Parareal: a time-parallel PDE solver using Random Neural Networks
par: Gattiglio, Guglielmo, et autres
Publié: (2024)
par: Gattiglio, Guglielmo, et autres
Publié: (2024)
SDSL-Solver: Scalable Distributed Sparse Linear Solvers for Large-Scale Interior Point Methods
par: Yang, Shaofeng, et autres
Publié: (2026)
par: Yang, Shaofeng, et autres
Publié: (2026)
Decentralized Semantic Federated Learning for Real-Time Public Safety Tasks: Challenges, Methods, and Directions
par: Li, Baosheng, et autres
Publié: (2025)
par: Li, Baosheng, et autres
Publié: (2025)
Documents similaires
-
Iterative Methods in GPU-Resident Linear Solvers for Nonlinear Constrained Optimization
par: Świrydowicz, Kasia, et autres
Publié: (2024) -
A Fast Relax-and-Round Approach to Unit Commitment for Data Center Own Generation
par: Regev, Shaked, et autres
Publié: (2025) -
Mixed-Precision Performance Portability of FFT-Based GPU-Accelerated Algorithms for Block-Triangular Toeplitz Matrices
par: Venkat, Sreeram, et autres
Publié: (2025) -
Multistep schemes for solving backward stochastic differential equations on GPU
par: Kapllani, Lorenc, et autres
Publié: (2019) -
Distributed Tomographic Reconstruction with Quantization
par: Miao, Runxuan, et autres
Publié: (2024)