Xabclib:A Fully Auto-tuned Sparse Iterative Solver
Fuente:
arXiv
Salvato in:
| Autori principali: | Katagiri, Takahiro, Sakurai, Takao, Igai, Mitsuyoshi, Itoh, Shoji, Ohshima, Satoshi, Kuroda, Hisayasu, Naono, Ken, Nakajima, Kengo |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
RAO-SS: A Prototype of Run-time Auto-tuning Facility for Sparse Direct Solvers
di: Katagiri, Takahiro, et al.
Pubblicazione: (2024)
di: Katagiri, Takahiro, et al.
Pubblicazione: (2024)
ppOpen-AT: A Directive-base Auto-tuning Language
di: Katagiri, Takahiro
Pubblicazione: (2024)
di: Katagiri, Takahiro
Pubblicazione: (2024)
An Auto-tuning Method for Run-time Data Transformation for Sparse Matrix-Vector Multiplication
di: Katagiri, Takahiro, et al.
Pubblicazione: (2024)
di: Katagiri, Takahiro, et al.
Pubblicazione: (2024)
Adaptation of XAI to Auto-tuning for Numerical Libraries
di: Aoki, Shota, et al.
Pubblicazione: (2024)
di: Aoki, Shota, et al.
Pubblicazione: (2024)
Performance Evaluation of CMOS Annealing with Support Vector Machine
di: Fukuhara, Ryoga, et al.
Pubblicazione: (2024)
di: Fukuhara, Ryoga, et al.
Pubblicazione: (2024)
Towards Generalized Parameter Tuning in Coherent Ising Machines: A Portfolio-Based Approach
di: Hanyu, Tatsuro, et al.
Pubblicazione: (2025)
di: Hanyu, Tatsuro, et al.
Pubblicazione: (2025)
MLKAPS: Machine Learning and Adaptive Sampling for HPC Kernel Auto-tuning
di: Jam, Mathys, et al.
Pubblicazione: (2025)
di: Jam, Mathys, et al.
Pubblicazione: (2025)
A Communication Avoiding and Reducing Algorithm for Symmetric Eigenproblem for Very Small Matrices
di: Katagiri, Takahiro, et al.
Pubblicazione: (2024)
di: Katagiri, Takahiro, et al.
Pubblicazione: (2024)
A Technical Survey of Sparse Linear Solvers in Electronic Design Automation
di: Rai, Nityanand
Pubblicazione: (2025)
di: Rai, Nityanand
Pubblicazione: (2025)
iSpLib: A Library for Accelerating Graph Neural Networks using Auto-tuned Sparse Operations
di: Anik, Md Saidul Hoque, et al.
Pubblicazione: (2024)
di: Anik, Md Saidul Hoque, et al.
Pubblicazione: (2024)
WaveTune: Wave-aware Bilinear Modeling for Efficient GPU Kernel Auto-tuning
di: Zhang, Kaixuan, et al.
Pubblicazione: (2026)
di: Zhang, Kaixuan, et al.
Pubblicazione: (2026)
AutoKernel: Autonomous GPU Kernel Optimization via Iterative Agent-Driven Search
di: Jaber, Jaber, et al.
Pubblicazione: (2026)
di: Jaber, Jaber, et al.
Pubblicazione: (2026)
Bringing Auto-tuning to HIP: Analysis of Tuning Impact and Difficulty on AMD and Nvidia GPUs
di: Lurati, Milo, et al.
Pubblicazione: (2024)
di: Lurati, Milo, et al.
Pubblicazione: (2024)
AutoSAGE: Input-Aware CUDA Scheduling for Sparse GNN Aggregation (SpMM/SDDMM) and CSR Attention
di: Stankovic, Aleksandar
Pubblicazione: (2025)
di: Stankovic, Aleksandar
Pubblicazione: (2025)
Learning-Augmented Performance Model for Tensor Product Factorization in High-Order FEM
di: Ren, Xuanzhengbo, et al.
Pubblicazione: (2026)
di: Ren, Xuanzhengbo, et al.
Pubblicazione: (2026)
Effects of the Auto-Correlation of Delays on the Age of Information: A Gaussian Process Framework
di: Inoie, Atsushi, et al.
Pubblicazione: (2025)
di: Inoie, Atsushi, et al.
Pubblicazione: (2025)
Fast Entropy Decoding for Sparse MVM on GPUs
di: Schätzle, Emil, et al.
Pubblicazione: (2026)
di: Schätzle, Emil, et al.
Pubblicazione: (2026)
SHIRO: Near-Optimal Communication Strategies for Distributed Sparse Matrix Multiplication
di: Zhuang, Chen, et al.
Pubblicazione: (2025)
di: Zhuang, Chen, et al.
Pubblicazione: (2025)
Explainable Port Mapping Inference with Sparse Performance Counters for AMD's Zen Architectures
di: Ritter, Fabian, et al.
Pubblicazione: (2024)
di: Ritter, Fabian, et al.
Pubblicazione: (2024)
SparseInfer: Training-free Prediction of Activation Sparsity for Fast LLM Inference
di: Shin, Jiho, et al.
Pubblicazione: (2024)
di: Shin, Jiho, et al.
Pubblicazione: (2024)
Iterative Layer Pruning for Efficient Translation Inference
di: Moslem, Yasmin, et al.
Pubblicazione: (2025)
di: Moslem, Yasmin, et al.
Pubblicazione: (2025)
SparseX: Efficient Segment-Level KV Cache Sharing for Interleaved LLM Serving
di: Zhang, Quqing, et al.
Pubblicazione: (2026)
di: Zhang, Quqing, et al.
Pubblicazione: (2026)
GPU Acceleration of Sparse Fully Homomorphic Encrypted DNNs
di: D'Agata, Lara, et al.
Pubblicazione: (2026)
di: D'Agata, Lara, et al.
Pubblicazione: (2026)
Performance Characterization of AutoNUMA Memory Tiering on Graph Analytics
di: Moura, Diego, et al.
Pubblicazione: (2022)
di: Moura, Diego, et al.
Pubblicazione: (2022)
Optimization of a Radiofrequency Ablation FEM Application Using Parallel Sparse Solvers
di: Miletto, Marcelo Cogo, et al.
Pubblicazione: (2024)
di: Miletto, Marcelo Cogo, et al.
Pubblicazione: (2024)
cuTeSpMM: Accelerating Sparse-Dense Matrix Multiplication using GPU Tensor Cores
di: Xiang, Lizhi, et al.
Pubblicazione: (2025)
di: Xiang, Lizhi, et al.
Pubblicazione: (2025)
Cheddar: A Swift Fully Homomorphic Encryption Library Designed for GPU Architectures
di: Choi, Wonseok, et al.
Pubblicazione: (2024)
di: Choi, Wonseok, et al.
Pubblicazione: (2024)
Virtual-Memory Powersort
di: Moltmann, Finn, et al.
Pubblicazione: (2026)
di: Moltmann, Finn, et al.
Pubblicazione: (2026)
H2EAL: Hybrid-Bonding Architecture with Hybrid Sparse Attention for Efficient Long-Context LLM Inference
di: Fu, Zizhuo, et al.
Pubblicazione: (2025)
di: Fu, Zizhuo, et al.
Pubblicazione: (2025)
Is Sparse Matrix Reordering Effective for Sparse Matrix-Vector Multiplication?
di: Asudeh, Omid, et al.
Pubblicazione: (2025)
di: Asudeh, Omid, et al.
Pubblicazione: (2025)
HPL-MxP Benchmark: Mixed-Precision Algorithms, Iterative Refinement, and Scalable Data Generation
di: Dongarra, Jack, et al.
Pubblicazione: (2025)
di: Dongarra, Jack, et al.
Pubblicazione: (2025)
Insum: Sparse GPU Kernels Simplified and Optimized with Indirect Einsums
di: Won, Jaeyeon, et al.
Pubblicazione: (2025)
di: Won, Jaeyeon, et al.
Pubblicazione: (2025)
Accelerating Sparse Ternary GEMM for Quantized ML on Apple Silicon
di: Lipshitz, Baraq, et al.
Pubblicazione: (2025)
di: Lipshitz, Baraq, et al.
Pubblicazione: (2025)
Evaluation of Quantum and Hybrid Solvers for Combinatorial Optimization
di: Bertuzzi, Amedeo, et al.
Pubblicazione: (2024)
di: Bertuzzi, Amedeo, et al.
Pubblicazione: (2024)
DistZO2: High-Throughput and Memory-Efficient Zeroth-Order Fine-tuning LLMs with Distributed Parallel Computing
di: Wang, Liangyu, et al.
Pubblicazione: (2025)
di: Wang, Liangyu, et al.
Pubblicazione: (2025)
Comparing the Performance of Heterogeneous Conjugate Gradient and Cholesky Solvers on Various Hardware Using SYCL
di: Thüring, Tim, et al.
Pubblicazione: (2026)
di: Thüring, Tim, et al.
Pubblicazione: (2026)
sTiles: An Accelerated Computational Framework for Sparse Factorizations of Structured Matrices
di: Fattah, Esmail Abdul, et al.
Pubblicazione: (2025)
di: Fattah, Esmail Abdul, et al.
Pubblicazione: (2025)
MarginGate: Sparse Margin-Triggered Verification for Batch-Invariant LLM Inference
di: Chu, Kexin, et al.
Pubblicazione: (2026)
di: Chu, Kexin, et al.
Pubblicazione: (2026)
Block Sparse Flash Attention
di: Ohayon, Daniel, et al.
Pubblicazione: (2025)
di: Ohayon, Daniel, et al.
Pubblicazione: (2025)
Towards Portability at Scale: A Cross-Architecture Performance Evaluation of a GPU-enabled Shallow Water Solver
di: Villalobos, Johansell, et al.
Pubblicazione: (2025)
di: Villalobos, Johansell, et al.
Pubblicazione: (2025)
Documenti analoghi
-
RAO-SS: A Prototype of Run-time Auto-tuning Facility for Sparse Direct Solvers
di: Katagiri, Takahiro, et al.
Pubblicazione: (2024) -
ppOpen-AT: A Directive-base Auto-tuning Language
di: Katagiri, Takahiro
Pubblicazione: (2024) -
An Auto-tuning Method for Run-time Data Transformation for Sparse Matrix-Vector Multiplication
di: Katagiri, Takahiro, et al.
Pubblicazione: (2024) -
Adaptation of XAI to Auto-tuning for Numerical Libraries
di: Aoki, Shota, et al.
Pubblicazione: (2024) -
Performance Evaluation of CMOS Annealing with Support Vector Machine
di: Fukuhara, Ryoga, et al.
Pubblicazione: (2024)