SpaDA: A Spatial Dataflow Architecture Programming Language
Fuente:
arXiv
Salvato in:
| Autori principali: | Gianinazzi, Lukas, Ben-Nun, Tal, Hoefler, Torsten |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Breaking (Global) Barriers in Parallel Stochastic Optimization with Wait-Avoiding Group Averaging
di: Li, Shigang, et al.
Pubblicazione: (2020)
di: Li, Shigang, et al.
Pubblicazione: (2020)
HierarchicalKV: A GPU Hash Table with Cache Semantics for Continuous Online Embedding Storage
di: Rong, Haidong, et al.
Pubblicazione: (2026)
di: Rong, Haidong, et al.
Pubblicazione: (2026)
Inside VOLT: Designing an Open-Source GPU Compiler
di: Jeong, Shinnung, et al.
Pubblicazione: (2025)
di: Jeong, Shinnung, et al.
Pubblicazione: (2025)
Stream parallel skeleton optimization
di: Aldinucci, Marco, et al.
Pubblicazione: (2024)
di: Aldinucci, Marco, et al.
Pubblicazione: (2024)
StreamFlow: cross-breeding cloud with HPC
di: Colonnelli, Iacopo, et al.
Pubblicazione: (2020)
di: Colonnelli, Iacopo, et al.
Pubblicazione: (2020)
Scheduler-Driven Job Atomization
di: Konopa, Michal, et al.
Pubblicazione: (2025)
di: Konopa, Michal, et al.
Pubblicazione: (2025)
JASDA: Introducing Job-Aware Scheduling in Scheduler-Driven Job Atomization
di: Konopa, Michal, et al.
Pubblicazione: (2025)
di: Konopa, Michal, et al.
Pubblicazione: (2025)
Optimizing Fine-Grained Parallelism Through Dynamic Load Balancing on Multi-Socket Many-Core Systems
di: Wang, Wenyi, et al.
Pubblicazione: (2025)
di: Wang, Wenyi, et al.
Pubblicazione: (2025)
AutoTSMM: An Auto-tuning Framework for Building High-Performance Tall-and-Skinny Matrix-Matrix Multiplication on CPUs
di: Li, Chendi, et al.
Pubblicazione: (2022)
di: Li, Chendi, et al.
Pubblicazione: (2022)
Enabling Practical Transparent Checkpointing for MPI: A Topological Sort Approach
di: Xu, Yao, et al.
Pubblicazione: (2024)
di: Xu, Yao, et al.
Pubblicazione: (2024)
A C++17 Thread Pool for High-Performance Scientific Computing
di: Shoshany, Barak
Pubblicazione: (2021)
di: Shoshany, Barak
Pubblicazione: (2021)
Scalable Concurrent Queues for GPU
di: Shetty, Pratheek Prakash, et al.
Pubblicazione: (2026)
di: Shetty, Pratheek Prakash, et al.
Pubblicazione: (2026)
Utilizing Sparsity in the GPU-accelerated Assembly of Schur Complement Matrices in Domain Decomposition Methods
di: Homola, Jakub, et al.
Pubblicazione: (2025)
di: Homola, Jakub, et al.
Pubblicazione: (2025)
Deep Recommender Models Inference: Automatic Asymmetric Data Flow Optimization
di: Ruggeri, Giuseppe, et al.
Pubblicazione: (2025)
di: Ruggeri, Giuseppe, et al.
Pubblicazione: (2025)
Unlocking Python's Cores: Hardware Usage and Energy Implications of Removing the GIL
di: Salazar, José Daniel Montoya
Pubblicazione: (2026)
di: Salazar, José Daniel Montoya
Pubblicazione: (2026)
NVLang: Unified Static Typing for Actor-Based Concurrency on the BEAM
di: Guerreiro, Miguel de Oliveira
Pubblicazione: (2025)
di: Guerreiro, Miguel de Oliveira
Pubblicazione: (2025)
Challenging Portability Paradigms: FPGA Acceleration Using SYCL and OpenCL
di: de Castro, Manuel, et al.
Pubblicazione: (2024)
di: de Castro, Manuel, et al.
Pubblicazione: (2024)
Toward a Universal GPU Instruction Set Architecture: A Cross-Vendor Analysis of Hardware-Invariant Computational Primitives in Parallel Processors
di: Abraham, Ojima, et al.
Pubblicazione: (2026)
di: Abraham, Ojima, et al.
Pubblicazione: (2026)
VSS Challenge Problem: Verifying the Correctness of AllReduce Algorithms in the MPICH Implementation of MPI
di: Hovland, Paul D.
Pubblicazione: (2025)
di: Hovland, Paul D.
Pubblicazione: (2025)
NM-SpMM: Accelerating Matrix Multiplication Using N:M Sparsity with GPGPU
di: Ma, Cong, et al.
Pubblicazione: (2025)
di: Ma, Cong, et al.
Pubblicazione: (2025)
HTVM: Efficient Neural Network Deployment On Heterogeneous TinyML Platforms
di: Van Delm, Josse, et al.
Pubblicazione: (2024)
di: Van Delm, Josse, et al.
Pubblicazione: (2024)
Hybrid Quantum-HPC Middleware Systems for Adaptive Resource, Workload and Task Management
di: Mantha, Pradeep, et al.
Pubblicazione: (2026)
di: Mantha, Pradeep, et al.
Pubblicazione: (2026)
VeriFx: Correct Replicated Data Types for the Masses
di: De Porre, Kevin, et al.
Pubblicazione: (2022)
di: De Porre, Kevin, et al.
Pubblicazione: (2022)
Modular GPU Programming with Typed Perspectives
di: Bansal, Manya, et al.
Pubblicazione: (2025)
di: Bansal, Manya, et al.
Pubblicazione: (2025)
DNA sequence alignment: An assignment for OpenMP, MPI, and CUDA/OpenCL
di: Gonzalez-Escribano, Arturo, et al.
Pubblicazione: (2024)
di: Gonzalez-Escribano, Arturo, et al.
Pubblicazione: (2024)
An Evaluation of Massively Parallel Algorithms for DFA Minimization
di: Martens, Jan, et al.
Pubblicazione: (2024)
di: Martens, Jan, et al.
Pubblicazione: (2024)
Sharded Elimination and Combining for Highly-Efficient Concurrent Stacks
di: Singh, Ajay, et al.
Pubblicazione: (2026)
di: Singh, Ajay, et al.
Pubblicazione: (2026)
LAMMPS-KOKKOS: Performance Portable Molecular Dynamics Across Exascale Architectures
di: Johansson, Anders, et al.
Pubblicazione: (2025)
di: Johansson, Anders, et al.
Pubblicazione: (2025)
Categorical Message Passing Language (CaMPL) for programmers
di: Hashimoto, Daniel Kiyoshi, et al.
Pubblicazione: (2026)
di: Hashimoto, Daniel Kiyoshi, et al.
Pubblicazione: (2026)
Addressing tokens dynamic generation, propagation, storage and renewal to secure the GlideinWMS pilot based jobs and system
di: Coimbra, Bruno Moreira, et al.
Pubblicazione: (2025)
di: Coimbra, Bruno Moreira, et al.
Pubblicazione: (2025)
Using Containers to Speed Up Development, to Run Integration Tests and to Teach About Distributed Systems
di: Mambelli, Marco, et al.
Pubblicazione: (2025)
di: Mambelli, Marco, et al.
Pubblicazione: (2025)
PIM-STM: Software Transactional Memory for Processing-In-Memory Systems
di: Lopes, André, et al.
Pubblicazione: (2024)
di: Lopes, André, et al.
Pubblicazione: (2024)
Dynamic Memory Management on GPUs with SYCL
di: Standish, Russell K.
Pubblicazione: (2025)
di: Standish, Russell K.
Pubblicazione: (2025)
Introducing SWIRL: An Intermediate Representation Language for Scientific Workflows
di: Colonnelli, Iacopo, et al.
Pubblicazione: (2024)
di: Colonnelli, Iacopo, et al.
Pubblicazione: (2024)
Construction of a Byzantine Linearizable SWMR Atomic Register from SWSR Atomic Registers
di: Kshemkalyani, Ajay D., et al.
Pubblicazione: (2024)
di: Kshemkalyani, Ajay D., et al.
Pubblicazione: (2024)
Hector: An Efficient Programming and Compilation Framework for Implementing Relational Graph Neural Networks in GPU Architectures
di: Wu, Kun, et al.
Pubblicazione: (2023)
di: Wu, Kun, et al.
Pubblicazione: (2023)
Deploy, Calibrate, Monitor, Heal -- No Human Required: An Autonomous AI SRE Agent for Elasticsearch
di: Mukkolakkal, Muhamed Ramees Cheriya
Pubblicazione: (2026)
di: Mukkolakkal, Muhamed Ramees Cheriya
Pubblicazione: (2026)
Fancy Some Chips for Your TeaStore? Modeling the Control of an Adaptable Discrete System
di: Gallone, Anna, et al.
Pubblicazione: (2025)
di: Gallone, Anna, et al.
Pubblicazione: (2025)
Minimum Cost Loop Nests for Contraction of a Sparse Tensor with a Tensor Network
di: Kanakagiri, Raghavendra, et al.
Pubblicazione: (2023)
di: Kanakagiri, Raghavendra, et al.
Pubblicazione: (2023)
How to Relax Instantly: Elastic Relaxation of Concurrent Data Structures
di: von Geijer, Kåre, et al.
Pubblicazione: (2024)
di: von Geijer, Kåre, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Breaking (Global) Barriers in Parallel Stochastic Optimization with Wait-Avoiding Group Averaging
di: Li, Shigang, et al.
Pubblicazione: (2020) -
HierarchicalKV: A GPU Hash Table with Cache Semantics for Continuous Online Embedding Storage
di: Rong, Haidong, et al.
Pubblicazione: (2026) -
Inside VOLT: Designing an Open-Source GPU Compiler
di: Jeong, Shinnung, et al.
Pubblicazione: (2025) -
Stream parallel skeleton optimization
di: Aldinucci, Marco, et al.
Pubblicazione: (2024) -
StreamFlow: cross-breeding cloud with HPC
di: Colonnelli, Iacopo, et al.
Pubblicazione: (2020)