ppOpen-AT: A Directive-base Auto-tuning Language
Fuente:
arXiv
Enregistré dans:
| Auteur principal: | Katagiri, Takahiro |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
RAO-SS: A Prototype of Run-time Auto-tuning Facility for Sparse Direct Solvers
par: Katagiri, Takahiro, et autres
Publié: (2024)
par: Katagiri, Takahiro, et autres
Publié: (2024)
An Auto-tuning Method for Run-time Data Transformation for Sparse Matrix-Vector Multiplication
par: Katagiri, Takahiro, et autres
Publié: (2024)
par: Katagiri, Takahiro, et autres
Publié: (2024)
Xabclib:A Fully Auto-tuned Sparse Iterative Solver
par: Katagiri, Takahiro, et autres
Publié: (2024)
par: Katagiri, Takahiro, et autres
Publié: (2024)
Performance Evaluation of CMOS Annealing with Support Vector Machine
par: Fukuhara, Ryoga, et autres
Publié: (2024)
par: Fukuhara, Ryoga, et autres
Publié: (2024)
Towards Generalized Parameter Tuning in Coherent Ising Machines: A Portfolio-Based Approach
par: Hanyu, Tatsuro, et autres
Publié: (2025)
par: Hanyu, Tatsuro, et autres
Publié: (2025)
A Communication Avoiding and Reducing Algorithm for Symmetric Eigenproblem for Very Small Matrices
par: Katagiri, Takahiro, et autres
Publié: (2024)
par: Katagiri, Takahiro, et autres
Publié: (2024)
MLKAPS: Machine Learning and Adaptive Sampling for HPC Kernel Auto-tuning
par: Jam, Mathys, et autres
Publié: (2025)
par: Jam, Mathys, et autres
Publié: (2025)
WaveTune: Wave-aware Bilinear Modeling for Efficient GPU Kernel Auto-tuning
par: Zhang, Kaixuan, et autres
Publié: (2026)
par: Zhang, Kaixuan, et autres
Publié: (2026)
Bringing Auto-tuning to HIP: Analysis of Tuning Impact and Difficulty on AMD and Nvidia GPUs
par: Lurati, Milo, et autres
Publié: (2024)
par: Lurati, Milo, et autres
Publié: (2024)
Learning-Augmented Performance Model for Tensor Product Factorization in High-Order FEM
par: Ren, Xuanzhengbo, et autres
Publié: (2026)
par: Ren, Xuanzhengbo, et autres
Publié: (2026)
Effects of the Auto-Correlation of Delays on the Age of Information: A Gaussian Process Framework
par: Inoie, Atsushi, et autres
Publié: (2025)
par: Inoie, Atsushi, et autres
Publié: (2025)
iSpLib: A Library for Accelerating Graph Neural Networks using Auto-tuned Sparse Operations
par: Anik, Md Saidul Hoque, et autres
Publié: (2024)
par: Anik, Md Saidul Hoque, et autres
Publié: (2024)
A Microbenchmark Framework for Performance Evaluation of OpenMP Target Offloading
par: Atif, Mohammad, et autres
Publié: (2025)
par: Atif, Mohammad, et autres
Publié: (2025)
Performance Characterization of AutoNUMA Memory Tiering on Graph Analytics
par: Moura, Diego, et autres
Publié: (2022)
par: Moura, Diego, et autres
Publié: (2022)
Integrating ytopt and libEnsemble to Autotune OpenMC
par: Wu, Xingfu, et autres
Publié: (2024)
par: Wu, Xingfu, et autres
Publié: (2024)
AutoKernel: Autonomous GPU Kernel Optimization via Iterative Agent-Driven Search
par: Jaber, Jaber, et autres
Publié: (2026)
par: Jaber, Jaber, et autres
Publié: (2026)
Integration of a systolic array based hardware accelerator into a DNN operator auto-tuning framework
par: Peccia, F. N., et autres
Publié: (2022)
par: Peccia, F. N., et autres
Publié: (2022)
Deploying Open-Source Large Language Models: A performance Analysis
par: Bendi-Ouis, Yannis, et autres
Publié: (2024)
par: Bendi-Ouis, Yannis, et autres
Publié: (2024)
AutoSAGE: Input-Aware CUDA Scheduling for Sparse GNN Aggregation (SpMM/SDDMM) and CSR Attention
par: Stankovic, Aleksandar
Publié: (2025)
par: Stankovic, Aleksandar
Publié: (2025)
Assessing the Performance of OpenTitan as Cryptographic Accelerator in Secure Open-Hardware System-on-Chips
par: Parisi, Emanuele, et autres
Publié: (2024)
par: Parisi, Emanuele, et autres
Publié: (2024)
DistZO2: High-Throughput and Memory-Efficient Zeroth-Order Fine-tuning LLMs with Distributed Parallel Computing
par: Wang, Liangyu, et autres
Publié: (2025)
par: Wang, Liangyu, et autres
Publié: (2025)
Profiling Large Language Model Inference on Apple Silicon: A Quantization Perspective
par: Benazir, Afsara, et autres
Publié: (2025)
par: Benazir, Afsara, et autres
Publié: (2025)
CAPSim: A Fast CPU Performance Simulator Using Attention-based Predictor
par: Xu, Buqing, et autres
Publié: (2025)
par: Xu, Buqing, et autres
Publié: (2025)
Towards a Scalable and Efficient PGAS-based Distributed OpenMP
par: Shan, Baodi, et autres
Publié: (2024)
par: Shan, Baodi, et autres
Publié: (2024)
Optimizing Cloud-native Services with SAGA: A Service Affinity Graph-based Approach
par: Dinh-Tuan, Hai, et autres
Publié: (2025)
par: Dinh-Tuan, Hai, et autres
Publié: (2025)
AutoLALA: Automatic Loop Algebraic Locality Analysis for AI and HPC Kernels
par: Zhu, Yifan, et autres
Publié: (2026)
par: Zhu, Yifan, et autres
Publié: (2026)
AI Application Benchmarking: Power-Aware Performance Analysis for Vision and Language Models
par: Mayr, Martin, et autres
Publié: (2026)
par: Mayr, Martin, et autres
Publié: (2026)
Impact of Generative AI (Large Language Models) on the PRA model construction and maintenance, observations
par: Rychkov, Valentin, et autres
Publié: (2024)
par: Rychkov, Valentin, et autres
Publié: (2024)
Automated PMC-based Power Modeling Methodology for Modern Mobile GPUs
par: Dash, Pranab, et autres
Publié: (2024)
par: Dash, Pranab, et autres
Publié: (2024)
Understanding and Benchmarking Artificial Intelligence: OpenAI's o3 Is Not AGI
par: Pfister, Rolf, et autres
Publié: (2025)
par: Pfister, Rolf, et autres
Publié: (2025)
Tuning Fast Memory Size based on Modeling of Page Migration for Tiered Memory
par: Chen, Shangye, et autres
Publié: (2024)
par: Chen, Shangye, et autres
Publié: (2024)
Beamforming-based Achievable Rate Maximization in ISAC System for Multi-UAV Networking
par: Zhou, Shengcai, et autres
Publié: (2025)
par: Zhou, Shengcai, et autres
Publié: (2025)
DRIM-ANN: An Approximate Nearest Neighbor Search Engine based on Commercial DRAM-PIMs
par: Chen, Mingkai, et autres
Publié: (2024)
par: Chen, Mingkai, et autres
Publié: (2024)
An Empirical Study on Method-Level Performance Evolution in Open-Source Java Projects
par: Shahedi, Kaveh, et autres
Publié: (2025)
par: Shahedi, Kaveh, et autres
Publié: (2025)
OSCAR-P and aMLLibrary: Profiling and Predicting the Performance of FaaS-based Applications in Computing Continua
par: Sala, Roberto, et autres
Publié: (2024)
par: Sala, Roberto, et autres
Publié: (2024)
Benchmark-based Study of CPU/GPU Power-Related Features through JAX and TensorFlow
par: Tchakoute, Roblex Nana, et autres
Publié: (2025)
par: Tchakoute, Roblex Nana, et autres
Publié: (2025)
AdaGradSelect: An adaptive gradient-guided layer selection method for efficient fine-tuning of SLMs
par: Kumar, Anshul, et autres
Publié: (2025)
par: Kumar, Anshul, et autres
Publié: (2025)
Inspection of I/O Operations from System Call Traces using Directly-Follows-Graph
par: Sankaran, Aravind, et autres
Publié: (2024)
par: Sankaran, Aravind, et autres
Publié: (2024)
Tuning the Tuner: Introducing Hyperparameter Optimization for Auto-Tuning
par: Willemsen, Floris-Jan, et autres
Publié: (2025)
par: Willemsen, Floris-Jan, et autres
Publié: (2025)
From Concept to Reality: 5G Positioning with Open-Source Implementation of UL-TDoA in OpenAirInterface
par: Malik, Adeel, et autres
Publié: (2024)
par: Malik, Adeel, et autres
Publié: (2024)
Documents similaires
-
RAO-SS: A Prototype of Run-time Auto-tuning Facility for Sparse Direct Solvers
par: Katagiri, Takahiro, et autres
Publié: (2024) -
An Auto-tuning Method for Run-time Data Transformation for Sparse Matrix-Vector Multiplication
par: Katagiri, Takahiro, et autres
Publié: (2024) -
Xabclib:A Fully Auto-tuned Sparse Iterative Solver
par: Katagiri, Takahiro, et autres
Publié: (2024) -
Performance Evaluation of CMOS Annealing with Support Vector Machine
par: Fukuhara, Ryoga, et autres
Publié: (2024) -
Towards Generalized Parameter Tuning in Coherent Ising Machines: A Portfolio-Based Approach
par: Hanyu, Tatsuro, et autres
Publié: (2025)