SENSEi: Input-Sensitive Compilation for Accelerating GNNs
Fuente:
arXiv
Salvato in:
| Autori principali: | Lenadora, Damitha, Sathia, Vimarsh, Gerogiannis, Gerasimos, Yesil, Serif, Torrellas, Josep, Mendis, Charith |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2023
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
COGNATE: Acceleration of Sparse Tensor Programs on Emerging Hardware using Transfer Learning
di: Sudusinghe, Chamika, et al.
Pubblicazione: (2025)
di: Sudusinghe, Chamika, et al.
Pubblicazione: (2025)
FLuRKA: Fast and accurate unified Low-Rank & Kernel Attention
di: Gupta, Ahan, et al.
Pubblicazione: (2023)
di: Gupta, Ahan, et al.
Pubblicazione: (2023)
Flashlight: PyTorch Compiler Extensions to Accelerate Attention Variants
di: You, Bozhi, et al.
Pubblicazione: (2025)
di: You, Bozhi, et al.
Pubblicazione: (2025)
oneDNN Graph Compiler: A Hybrid Approach for High-Performance Deep Learning Compilation
di: Li, Jianhui, et al.
Pubblicazione: (2023)
di: Li, Jianhui, et al.
Pubblicazione: (2023)
Efficient Graph Knowledge Distillation from GNNs to Kolmogorov--Arnold Networks via Self-Attention Dynamic Sampling
di: Cui, Can, et al.
Pubblicazione: (2025)
di: Cui, Can, et al.
Pubblicazione: (2025)
Automating Energy-Efficient GPU Kernel Generation: A Fast Search-Based Compilation Approach
di: Zhang, Yijia, et al.
Pubblicazione: (2024)
di: Zhang, Yijia, et al.
Pubblicazione: (2024)
The Next 700 ML-Enabled Compiler Optimizations
di: VenkataKeerthy, S., et al.
Pubblicazione: (2023)
di: VenkataKeerthy, S., et al.
Pubblicazione: (2023)
Priority Sampling of Large Language Models for Compilers
di: Grubisic, Dejan, et al.
Pubblicazione: (2024)
di: Grubisic, Dejan, et al.
Pubblicazione: (2024)
AutoSAGE: Input-Aware CUDA Scheduling for Sparse GNN Aggregation (SpMM/SDDMM) and CSR Attention
di: Stankovic, Aleksandar
Pubblicazione: (2025)
di: Stankovic, Aleksandar
Pubblicazione: (2025)
Accelerating Sparse Ternary GEMM for Quantized ML on Apple Silicon
di: Lipshitz, Baraq, et al.
Pubblicazione: (2025)
di: Lipshitz, Baraq, et al.
Pubblicazione: (2025)
PARD: Accelerating LLM Inference with Low-Cost PARallel Draft Model Adaptation
di: An, Zihao, et al.
Pubblicazione: (2025)
di: An, Zihao, et al.
Pubblicazione: (2025)
GPU-Accelerated INT8 Quantization for KV Cache Compression in Large Language Models
di: Taneja, Maanas, et al.
Pubblicazione: (2026)
di: Taneja, Maanas, et al.
Pubblicazione: (2026)
V-Seek: Accelerating LLM Reasoning on Open-hardware Server-class RISC-V Platforms
di: Rodrigo, Javier J. Poveda, et al.
Pubblicazione: (2025)
di: Rodrigo, Javier J. Poveda, et al.
Pubblicazione: (2025)
LOOPerSet: A Large-Scale Dataset for Data-Driven Polyhedral Compiler Optimization
di: Merouani, Massinissa, et al.
Pubblicazione: (2025)
di: Merouani, Massinissa, et al.
Pubblicazione: (2025)
COMET: Neural Cost Model Explanation Framework
di: Chaudhary, Isha, et al.
Pubblicazione: (2023)
di: Chaudhary, Isha, et al.
Pubblicazione: (2023)
SAfEPaTh: A System-Level Approach for Efficient Power and Thermal Estimation of Convolutional Neural Network Accelerator
di: Chen, Yukai, et al.
Pubblicazione: (2024)
di: Chen, Yukai, et al.
Pubblicazione: (2024)
DECA: A Near-Core LLM Decompression Accelerator Grounded on a 3D Roofline Model
di: Gerogiannis, Gerasimos, et al.
Pubblicazione: (2025)
di: Gerogiannis, Gerasimos, et al.
Pubblicazione: (2025)
Efficient Solving of Large Single Input Superstate Decomposable Markovian Decision Process
di: Mahjoub, Youssef Ait El, et al.
Pubblicazione: (2025)
di: Mahjoub, Youssef Ait El, et al.
Pubblicazione: (2025)
ECCO: Evidence-Driven Causal Reasoning for Compiler Optimization
di: Pan, Haolin, et al.
Pubblicazione: (2026)
di: Pan, Haolin, et al.
Pubblicazione: (2026)
EXAQ: Exponent Aware Quantization For LLMs Acceleration
di: Shkolnik, Moran, et al.
Pubblicazione: (2024)
di: Shkolnik, Moran, et al.
Pubblicazione: (2024)
Library Liberation: Competitive Performance Matmul Through Compiler-composed Nanokernels
di: Thangamani, Arun, et al.
Pubblicazione: (2025)
di: Thangamani, Arun, et al.
Pubblicazione: (2025)
VecTrans: Enhancing Compiler Auto-Vectorization through LLM-Assisted Code Transformations
di: Zheng, Zhongchun, et al.
Pubblicazione: (2025)
di: Zheng, Zhongchun, et al.
Pubblicazione: (2025)
cedar: Optimized and Unified Machine Learning Input Data Pipelines
di: Zhao, Mark, et al.
Pubblicazione: (2024)
di: Zhao, Mark, et al.
Pubblicazione: (2024)
PoTAcc: A Pipeline for End-to-End Acceleration of Power-of-Two Quantized DNNs
di: Saha, Rappy, et al.
Pubblicazione: (2026)
di: Saha, Rappy, et al.
Pubblicazione: (2026)
ALISA: Accelerating Large Language Model Inference via Sparsity-Aware KV Caching
di: Zhao, Youpeng, et al.
Pubblicazione: (2024)
di: Zhao, Youpeng, et al.
Pubblicazione: (2024)
AutoSP: Unlocking Long-Context LLM Training Via Compiler-Based Sequence Parallelism
di: Gupta, Ahan, et al.
Pubblicazione: (2026)
di: Gupta, Ahan, et al.
Pubblicazione: (2026)
GreedySnake: Accelerating SSD-Offloaded LLM Training with Efficient Scheduling and Optimizer Step Overlapping
di: Yin, Yishu, et al.
Pubblicazione: (2025)
di: Yin, Yishu, et al.
Pubblicazione: (2025)
GPU Cluster Scheduling for Network-Sensitive Deep Learning
di: Sharma, Aakash, et al.
Pubblicazione: (2024)
di: Sharma, Aakash, et al.
Pubblicazione: (2024)
LiveTune: Dynamic Parameter Tuning for Feedback-Driven Optimization
di: Shabgahi, Soheil Zibakhsh, et al.
Pubblicazione: (2023)
di: Shabgahi, Soheil Zibakhsh, et al.
Pubblicazione: (2023)
BanditQ: Fair Bandits with Guaranteed Rewards
di: Sinha, Abhishek
Pubblicazione: (2023)
di: Sinha, Abhishek
Pubblicazione: (2023)
Towards Computational Performance Engineering for Unsupervised Concept Drift Detection -- Complexities, Benchmarking, Performance Analysis
di: Werner, Elias, et al.
Pubblicazione: (2023)
di: Werner, Elias, et al.
Pubblicazione: (2023)
Benchmarking GPUs on SVBRDF Extractor Model
di: Kandel, Narayan, et al.
Pubblicazione: (2023)
di: Kandel, Narayan, et al.
Pubblicazione: (2023)
U-TOE: Universal TinyML On-board Evaluation Toolkit for Low-Power IoT
di: Huang, Zhaolan, et al.
Pubblicazione: (2023)
di: Huang, Zhaolan, et al.
Pubblicazione: (2023)
Conformer-Based Speech Recognition On Extreme Edge-Computing Devices
di: Xu, Mingbin, et al.
Pubblicazione: (2023)
di: Xu, Mingbin, et al.
Pubblicazione: (2023)
A Scalable k-Medoids Clustering via Whale Optimization Algorithm
di: Chenan, Huang, et al.
Pubblicazione: (2024)
di: Chenan, Huang, et al.
Pubblicazione: (2024)
CPINN-ABPI: Physics-Informed Neural Networks for Accurate Power Estimation in MPSoCs
di: Elshamy, Mohamed R., et al.
Pubblicazione: (2025)
di: Elshamy, Mohamed R., et al.
Pubblicazione: (2025)
DistZO2: High-Throughput and Memory-Efficient Zeroth-Order Fine-tuning LLMs with Distributed Parallel Computing
di: Wang, Liangyu, et al.
Pubblicazione: (2025)
di: Wang, Liangyu, et al.
Pubblicazione: (2025)
MarginGate: Sparse Margin-Triggered Verification for Batch-Invariant LLM Inference
di: Chu, Kexin, et al.
Pubblicazione: (2026)
di: Chu, Kexin, et al.
Pubblicazione: (2026)
Parallel Implementations Assessment of a Spatial-Spectral Classifier for Hyperspectral Clinical Applications
di: Lazcano, Raquel, et al.
Pubblicazione: (2024)
di: Lazcano, Raquel, et al.
Pubblicazione: (2024)
A Structure-Aware Framework for Learning Device Placements on Computation Graphs
di: Duan, Shukai, et al.
Pubblicazione: (2024)
di: Duan, Shukai, et al.
Pubblicazione: (2024)
Documenti analoghi
-
COGNATE: Acceleration of Sparse Tensor Programs on Emerging Hardware using Transfer Learning
di: Sudusinghe, Chamika, et al.
Pubblicazione: (2025) -
FLuRKA: Fast and accurate unified Low-Rank & Kernel Attention
di: Gupta, Ahan, et al.
Pubblicazione: (2023) -
Flashlight: PyTorch Compiler Extensions to Accelerate Attention Variants
di: You, Bozhi, et al.
Pubblicazione: (2025) -
oneDNN Graph Compiler: A Hybrid Approach for High-Performance Deep Learning Compilation
di: Li, Jianhui, et al.
Pubblicazione: (2023) -
Efficient Graph Knowledge Distillation from GNNs to Kolmogorov--Arnold Networks via Self-Attention Dynamic Sampling
di: Cui, Can, et al.
Pubblicazione: (2025)