Survey on Characterizing and Understanding GNNs from a Computer Architecture Perspective
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Wu, Meng, Yan, Mingyu, Li, Wenming, Ye, Xiaochun, Fan, Dongrui, Xie, Yuan |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Characterizing and Understanding HGNN Training on GPUs
par: Han, Dengke, et autres
Publié: (2024)
par: Han, Dengke, et autres
Publié: (2024)
Accelerating Mini-batch HGNN Training by Reducing CUDA Kernels
par: Wu, Meng, et autres
Publié: (2024)
par: Wu, Meng, et autres
Publié: (2024)
ADE-HGNN: Accelerating HGNNs through Attention Disparity Exploitation
par: Han, Dengke, et autres
Publié: (2024)
par: Han, Dengke, et autres
Publié: (2024)
TLV-HGNN: Thinking Like a Vertex for Memory-efficient HGNN Inference
par: Han, Dengke, et autres
Publié: (2025)
par: Han, Dengke, et autres
Publié: (2025)
Multilayer Dataflow: Orchestrate Butterfly Sparsity to Accelerate Attention Computation
par: Wu, Haibin, et autres
Publié: (2024)
par: Wu, Haibin, et autres
Publié: (2024)
StreamDCIM: A Tile-based Streaming Digital CIM Accelerator with Mixed-stationary Cross-forwarding Dataflow for Multimodal Transformer
par: Qin, Shantian, et autres
Publié: (2025)
par: Qin, Shantian, et autres
Publié: (2025)
MetaDSE: A Few-shot Meta-learning Framework for Cross-workload CPU Design Space Exploration
par: Xue, Runzhen, et autres
Publié: (2025)
par: Xue, Runzhen, et autres
Publié: (2025)
GDR-HGNN: A Heterogeneous Graph Neural Networks Accelerator Frontend with Graph Decoupling and Recoupling
par: Xue, Runzhen, et autres
Publié: (2024)
par: Xue, Runzhen, et autres
Publié: (2024)
Accelerating GNN Training through Locality-aware Dropout and Merge
par: Sun, Gongjian, et autres
Publié: (2025)
par: Sun, Gongjian, et autres
Publié: (2025)
HiHGNN: Accelerating HGNNs through Parallelism and Data Reusability Exploitation
par: Xue, Runzhen, et autres
Publié: (2023)
par: Xue, Runzhen, et autres
Publié: (2023)
SiHGNN: Leveraging Properties of Semantic Graphs for Efficient HGNN Acceleration
par: Xue, Runzhen, et autres
Publié: (2024)
par: Xue, Runzhen, et autres
Publié: (2024)
A Systematic Characterization of LLM Inference on GPUs
par: Wang, Haonan, et autres
Publié: (2025)
par: Wang, Haonan, et autres
Publié: (2025)
AHASD: Asynchronous Heterogeneous Architecture for LLM Adaptive Drafting Speculative Decoding on Mobile Devices
par: Zirui, Ma, et autres
Publié: (2026)
par: Zirui, Ma, et autres
Publié: (2026)
Multi-objective Optimization in CPU Design Space Exploration: Attention is All You Need
par: Xue, Runzhen, et autres
Publié: (2024)
par: Xue, Runzhen, et autres
Publié: (2024)
A Survey of Neural Network Variational Monte Carlo from a Computing Workload Characterization Perspective
par: Xiao, Zhengze, et autres
Publié: (2026)
par: Xiao, Zhengze, et autres
Publié: (2026)
Understanding Simulated Architecture via gem5 Call-Stack Profiling
par: Söderström, Johan, et autres
Publié: (2026)
par: Söderström, Johan, et autres
Publié: (2026)
A System Architecture for Low Latency Multiprogramming Quantum Computing
par: Zhao, Yilun, et autres
Publié: (2026)
par: Zhao, Yilun, et autres
Publié: (2026)
SoMa: Identifying, Exploring, and Understanding the DRAM Communication Scheduling Space for DNN Accelerators
par: Cai, Jingwei, et autres
Publié: (2025)
par: Cai, Jingwei, et autres
Publié: (2025)
The Survey of Chiplet-based Integrated Architecture: An EDA perspective
par: Chen, Shixin, et autres
Publié: (2024)
par: Chen, Shixin, et autres
Publié: (2024)
In-Memory Computing Architecture for Efficient Hardware Security
par: Ajmi, Hala, et autres
Publié: (2024)
par: Ajmi, Hala, et autres
Publié: (2024)
CREATE: Cross-Layer Resilience Characterization and Optimization for Efficient yet Reliable Embodied AI Systems
par: Xie, Tong, et autres
Publié: (2026)
par: Xie, Tong, et autres
Publié: (2026)
FirePower: Towards a Foundation with Generalizable Knowledge for Architecture-Level Power Modeling
par: Zhang, Qijun, et autres
Publié: (2024)
par: Zhang, Qijun, et autres
Publié: (2024)
Energy-Oriented Computing Architecture Simulator for SNN Training
par: Ma, Yunhao, et autres
Publié: (2025)
par: Ma, Yunhao, et autres
Publié: (2025)
FusionCIM: Accelerating LLM Inference with Fusion-Driven Computing-in-Memory Architecture
par: Xuan, Zihao, et autres
Publié: (2026)
par: Xuan, Zihao, et autres
Publié: (2026)
Shift-Left Techniques in Electronic Design Automation: A Survey
par: Wu, Xinyue, et autres
Publié: (2025)
par: Wu, Xinyue, et autres
Publié: (2025)
Large Processor Chip Model
par: Chang, Kaiyan, et autres
Publié: (2025)
par: Chang, Kaiyan, et autres
Publié: (2025)
Benchmarking and Dissecting the Nvidia Hopper GPU Architecture
par: Luo, Weile, et autres
Publié: (2024)
par: Luo, Weile, et autres
Publié: (2024)
Evolution, Challenges, and Optimization in Computer Architecture: The Role of Reconfigurable Systems
par: Ederhion, Jefferson, et autres
Publié: (2024)
par: Ederhion, Jefferson, et autres
Publié: (2024)
The Z1: Architecture and Algorithms of Konrad Zuse's First Computer
par: Rojas, Raul
Publié: (2014)
par: Rojas, Raul
Publié: (2014)
Toward Reproducible and Standardized Computer Architecture Simulation with gem5
par: Pai, Kunal, et autres
Publié: (2025)
par: Pai, Kunal, et autres
Publié: (2025)
Trimma: Trimming Metadata Storage and Latency for Hybrid Memory Systems
par: Li, Yiwei, et autres
Publié: (2024)
par: Li, Yiwei, et autres
Publié: (2024)
Field-Programmable Gate Array Architecture for Deep Learning: Survey & Future Directions
par: Boutros, Andrew, et autres
Publié: (2024)
par: Boutros, Andrew, et autres
Publié: (2024)
AutoPower: Automated Few-Shot Architecture-Level Power Modeling by Power Group Decoupling
par: Zhang, Qijun, et autres
Publié: (2025)
par: Zhang, Qijun, et autres
Publié: (2025)
LIMCA: LLM for Automating Analog In-Memory Computing Architecture Design Exploration
par: Vungarala, Deepak, et autres
Publié: (2025)
par: Vungarala, Deepak, et autres
Publié: (2025)
Overmind NSA: A Unified Neuro-Symbolic Computing Architecture with Approximate Nonlinear Activations and Preemptive Memory Bypass
par: Wang, Weilun, et autres
Publié: (2026)
par: Wang, Weilun, et autres
Publié: (2026)
Aging Aware Adaptive Voltage Scaling for Reliable and Efficient AI Accelerators
par: Xie, Tong, et autres
Publié: (2026)
par: Xie, Tong, et autres
Publié: (2026)
M100: An Orchestrated Dataflow Architecture Powering General AI Computing
par: Xie, Yan, et autres
Publié: (2026)
par: Xie, Yan, et autres
Publié: (2026)
Scalable and RISC-V Programmable Near-Memory Computing Architectures for Edge Nodes
par: Caon, Michele, et autres
Publié: (2024)
par: Caon, Michele, et autres
Publié: (2024)
ReadyPower: A Reliable, Interpretable, and Handy Architectural Power Model Based on Analytical Framework
par: Zhang, Qijun, et autres
Publié: (2025)
par: Zhang, Qijun, et autres
Publié: (2025)
A Data-Driven Dynamic Execution Orchestration Architecture
par: Bai, Zhenyu, et autres
Publié: (2026)
par: Bai, Zhenyu, et autres
Publié: (2026)
Documents similaires
-
Characterizing and Understanding HGNN Training on GPUs
par: Han, Dengke, et autres
Publié: (2024) -
Accelerating Mini-batch HGNN Training by Reducing CUDA Kernels
par: Wu, Meng, et autres
Publié: (2024) -
ADE-HGNN: Accelerating HGNNs through Attention Disparity Exploitation
par: Han, Dengke, et autres
Publié: (2024) -
TLV-HGNN: Thinking Like a Vertex for Memory-efficient HGNN Inference
par: Han, Dengke, et autres
Publié: (2025) -
Multilayer Dataflow: Orchestrate Butterfly Sparsity to Accelerate Attention Computation
par: Wu, Haibin, et autres
Publié: (2024)