Bandicoot: A Templated C++ Library for GPU Linear Algebra
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Curtin, Ryan R., Edel, Marcus, Sanderson, Conrad |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Fast GPU Linear Algebra via Compile Time Expression Fusion
par: Curtin, Ryan R., et autres
Publié: (2026)
par: Curtin, Ryan R., et autres
Publié: (2026)
Armadillo: An Efficient Framework for Numerical Linear Algebra
par: Sanderson, Conrad, et autres
Publié: (2025)
par: Sanderson, Conrad, et autres
Publié: (2025)
Trilinos: Enabling Scientific Computing Across Diverse Hardware Architectures at Scale
par: Mayr, Matthias, et autres
Publié: (2025)
par: Mayr, Matthias, et autres
Publié: (2025)
Canonicalization of Batched Einstein Summations for Tuning Retrieval
par: Kulkarni, Kaushik, et autres
Publié: (2026)
par: Kulkarni, Kaushik, et autres
Publié: (2026)
Assembly of FETI dual operator using CUDA
par: Homola, Jakub, et autres
Publié: (2025)
par: Homola, Jakub, et autres
Publié: (2025)
The ensmallen library for flexible numerical optimization
par: Curtin, Ryan R., et autres
Publié: (2021)
par: Curtin, Ryan R., et autres
Publié: (2021)
Accurate complex Jacobi rotations
par: Novaković, Vedran
Publié: (2023)
par: Novaković, Vedran
Publié: (2023)
Direct Low-Dose CT Image Reconstruction on GPU using Out-Of-Core: Precision and Quality Study
par: Chillarón, M., et autres
Publié: (2024)
par: Chillarón, M., et autres
Publié: (2024)
BurTorch: Revisiting Training from First Principles by Coupling Autodiff, Math Optimization, and Systems
par: Burlachenko, Konstantin, et autres
Publié: (2025)
par: Burlachenko, Konstantin, et autres
Publié: (2025)
Mathematical modeling of the mechanical behavior of three-layer plates with a tetrachiral honeycomb core
par: Mazaev, A. V.
Publié: (2023)
par: Mazaev, A. V.
Publié: (2023)
Stencil Computations on AMD and Nvidia Graphics Processors: Performance and Tuning Strategies
par: Pekkilä, Johannes, et autres
Publié: (2024)
par: Pekkilä, Johannes, et autres
Publié: (2024)
Mixed Precision FGMRES-Based Iterative Refinement for Weighted Least Squares
par: Carson, Erin, et autres
Publié: (2024)
par: Carson, Erin, et autres
Publié: (2024)
RANDSMAPs: Random-Feature/multi-Scale Neural Decoders with Mass Preservation
par: Patsatzis, Dimitrios G., et autres
Publié: (2026)
par: Patsatzis, Dimitrios G., et autres
Publié: (2026)
Fast Gaussian process inference by exact Matérn kernel decomposition
par: Langrené, Nicolas, et autres
Publié: (2025)
par: Langrené, Nicolas, et autres
Publié: (2025)
Distributed and heterogeneous tensor-vector contraction algorithms for high performance computing
par: Martinez-Ferrer, Pedro J., et autres
Publié: (2025)
par: Martinez-Ferrer, Pedro J., et autres
Publié: (2025)
Tensor-based Model Reduction and Identification for Generalized Memory Polynomial
par: Wang, Yuchao, et autres
Publié: (2025)
par: Wang, Yuchao, et autres
Publié: (2025)
Jump Restore Light Transport
par: Holl, Sascha, et autres
Publié: (2024)
par: Holl, Sascha, et autres
Publié: (2024)
Arithmetical enhancements of the Kogbetliantz method for the SVD of order two
par: Novaković, Vedran
Publié: (2024)
par: Novaković, Vedran
Publié: (2024)
Randomized-Accelerated FEAST: A Hybrid Approach for Large-Scale Eigenvalue Problems
par: Nadiger, Ayush
Publié: (2025)
par: Nadiger, Ayush
Publié: (2025)
Faster Forward Sensitivities: Reduced stochastic hedge ratios from pathwise algorithmic differentiation
par: Fries, Christian P
Publié: (2026)
par: Fries, Christian P
Publié: (2026)
Fast Evaluation of Truncated Neumann Series by Low-Product Radix Kernels
par: Sao, Piyush
Publié: (2026)
par: Sao, Piyush
Publié: (2026)
Incremental Hierarchical Tucker Decomposition
par: Aksoy, Doruk, et autres
Publié: (2024)
par: Aksoy, Doruk, et autres
Publié: (2024)
Recursive vectorized computation of the vector $p$-norm
par: Novaković, Vedran
Publié: (2025)
par: Novaković, Vedran
Publié: (2025)
Symbolic Algorithm for Solving SLAEs with Multi-Diagonal Coefficient Matrices
par: Veneva, Milena
Publié: (2024)
par: Veneva, Milena
Publié: (2024)
Parallelization and scalability analysis of inverse factorization using the Chunks and Tasks programming model
par: Artemov, Anton G., et autres
Publié: (2019)
par: Artemov, Anton G., et autres
Publié: (2019)
Sensor Placement for Tsunami Early Warning via Large-Scale Bayesian Optimal Experimental Design
par: Venkat, Sreeram, et autres
Publié: (2026)
par: Venkat, Sreeram, et autres
Publié: (2026)
Efficient simulation of mixed boundary value problems and conformal mappings
par: Han, Qiansheng, et autres
Publié: (2023)
par: Han, Qiansheng, et autres
Publié: (2023)
Minimizing the Arithmetic and Communication Complexity of Jacobi's Method for Eigenvalues and Singular Values: Part One -- Serial Algorithms
par: Demmel, James, et autres
Publié: (2025)
par: Demmel, James, et autres
Publié: (2025)
Entrywise Approximation for Matrix Inversion and Linear Systems
par: Ghadiri, Mehrdad, et autres
Publié: (2025)
par: Ghadiri, Mehrdad, et autres
Publié: (2025)
Tensor-based compression of the sea temperature data
par: Kosolapov, Ilya, et autres
Publié: (2025)
par: Kosolapov, Ilya, et autres
Publié: (2025)
Matrix Factorizations with Uniformly Random Pivoting
par: Detherage, Isabel, et autres
Publié: (2025)
par: Detherage, Isabel, et autres
Publié: (2025)
A Task Parallel Orthonormalization Multigrid Method For Multiphase Elliptic Problems
par: Toprak, Teoman, et autres
Publié: (2025)
par: Toprak, Teoman, et autres
Publié: (2025)
A natural language framework for non-conforming hybrid polytopal methods in Gridap.jl
par: Manyer, Jordi, et autres
Publié: (2026)
par: Manyer, Jordi, et autres
Publié: (2026)
Scalable s-step Preconditioned Conjugate Gradient with Chebyshev Basis and Gauss-Seidel Gram Solve
par: D'Ambra, Pasqua, et autres
Publié: (2026)
par: D'Ambra, Pasqua, et autres
Publié: (2026)
Speeding up an unsteady flow simulation by adaptive BDDC and Krylov subspace recycling
par: Hanek, Martin, et autres
Publié: (2024)
par: Hanek, Martin, et autres
Publié: (2024)
When can a neural operator replace a coarse solve? Architectural principles for two-level preconditioning
par: Melchers, Hugo, et autres
Publié: (2026)
par: Melchers, Hugo, et autres
Publié: (2026)
Enabling Local Neural Operators to perform Equation-Free System-Level Analysis
par: Fabiani, Gianluca, et autres
Publié: (2025)
par: Fabiani, Gianluca, et autres
Publié: (2025)
Modeling and analysis methods for early detection of leakage points in gas transmission systems
par: Aliyev, Ilgar
Publié: (2025)
par: Aliyev, Ilgar
Publié: (2025)
Scalable Preconditioners for the Pseudo-4D DFN Lithium-ion Battery Model
par: Roy, Thomas, et autres
Publié: (2026)
par: Roy, Thomas, et autres
Publié: (2026)
Implementation techniques for multigrid solvers for high-order Discontinuous Galerkin methods
par: Baccas, Sean, et autres
Publié: (2025)
par: Baccas, Sean, et autres
Publié: (2025)
Documents similaires
-
Fast GPU Linear Algebra via Compile Time Expression Fusion
par: Curtin, Ryan R., et autres
Publié: (2026) -
Armadillo: An Efficient Framework for Numerical Linear Algebra
par: Sanderson, Conrad, et autres
Publié: (2025) -
Trilinos: Enabling Scientific Computing Across Diverse Hardware Architectures at Scale
par: Mayr, Matthias, et autres
Publié: (2025) -
Canonicalization of Batched Einstein Summations for Tuning Retrieval
par: Kulkarni, Kaushik, et autres
Publié: (2026) -
Assembly of FETI dual operator using CUDA
par: Homola, Jakub, et autres
Publié: (2025)