Adaptive Multidimensional Quadrature on Multi-GPU Systems
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Tonarelli, Melanie, Riva, Simone, Benedusi, Pietro, Ferrandi, Fabrizio, Krause, Rolf |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Centroid Approximation with Multidimensional Approximate Agreement Protocols
par: Cambus, Melanie, et autres
Publié: (2023)
par: Cambus, Melanie, et autres
Publié: (2023)
Improving GPU Multi-Tenancy Through Dynamic Multi-Instance GPU Reconfiguration
par: Wang, Tianyu, et autres
Publié: (2024)
par: Wang, Tianyu, et autres
Publié: (2024)
Concurrent Scheduling of High-Level Parallel Programs on Multi-GPU Systems
par: Knorr, Fabian, et autres
Publié: (2025)
par: Knorr, Fabian, et autres
Publié: (2025)
Understanding Data Movement in AMD Multi-GPU Systems with Infinity Fabric
par: Schieffer, Gabin, et autres
Publié: (2024)
par: Schieffer, Gabin, et autres
Publié: (2024)
Accelerating Intra-Node GPU-to-GPU Communication Through Multi-Path Transfers with CUDA Graphs
par: Sojoodi, Amirhossein, et autres
Publié: (2026)
par: Sojoodi, Amirhossein, et autres
Publié: (2026)
A Multidimensional Elasticity Framework for Adaptive Data Analytics Management in the Computing Continuum
par: Laso, Sergio, et autres
Publié: (2025)
par: Laso, Sergio, et autres
Publié: (2025)
A Multi-Objective Framework for Optimizing GPU-Enabled VM Placement in Cloud Data Centers with Multi-Instance GPU Technology
par: Siavashi, Ahmad, et autres
Publié: (2025)
par: Siavashi, Ahmad, et autres
Publié: (2025)
Guardian: Safe GPU Sharing in Multi-Tenant Environments
par: Pavlidakis, Manos, et autres
Publié: (2024)
par: Pavlidakis, Manos, et autres
Publié: (2024)
Towards Affordable, Adaptive and Automatic GNN Training on CPU-GPU Heterogeneous Platforms
par: Qiao, Tong, et autres
Publié: (2025)
par: Qiao, Tong, et autres
Publié: (2025)
PathWeaver: A High-Throughput Multi-GPU System for Graph-Based Approximate Nearest Neighbor Search
par: Kim, Sukjin, et autres
Publié: (2025)
par: Kim, Sukjin, et autres
Publié: (2025)
Parallel Collaborative ADMM Privacy Computing and Adaptive GPU Acceleration for Distributed Edge Networks
par: Xia, Mengchun, et autres
Publié: (2026)
par: Xia, Mengchun, et autres
Publié: (2026)
GPU Acceleration for Faster Evolutionary Spatial Cyclic Game Systems
par: Sinadjan, Louie
Publié: (2025)
par: Sinadjan, Louie
Publié: (2025)
Fused Breadth-First Probabilistic Traversals on Distributed GPU Systems
par: Neff, Reece, et autres
Publié: (2023)
par: Neff, Reece, et autres
Publié: (2023)
SOLANET: Distributed Neighbor Graph Construction on GPU-Accelerated Systems
par: Iwabuchi, Keita, et autres
Publié: (2026)
par: Iwabuchi, Keita, et autres
Publié: (2026)
Characterizing Production GPU Workloads using System-wide Telemetry Data
par: Cankur, Onur, et autres
Publié: (2025)
par: Cankur, Onur, et autres
Publié: (2025)
HarMoEny: Efficient Multi-GPU Inference of MoE Models
par: Doucet, Zachary, et autres
Publié: (2025)
par: Doucet, Zachary, et autres
Publié: (2025)
Multi-GPU Acceleration of PALABOS Fluid Solver using C++ Standard Parallelism
par: Latt, Jonas, et autres
Publié: (2025)
par: Latt, Jonas, et autres
Publié: (2025)
Multi-core & GPU-based Balanced Butterfly Counting in Signed Bipartite Graphs
par: Kiran, Mekala, et autres
Publié: (2026)
par: Kiran, Mekala, et autres
Publié: (2026)
An Online Fragmentation-Aware Scheduler for Managing GPU-Sharing Workloads on Multi-Instance GPUs
par: Ting, Hsu-Tzu, et autres
Publié: (2025)
par: Ting, Hsu-Tzu, et autres
Publié: (2025)
Frenzy: A Memory-Aware Serverless LLM Training System for Heterogeneous GPU Clusters
par: Chang, Zihan, et autres
Publié: (2024)
par: Chang, Zihan, et autres
Publié: (2024)
Accelerating Biclique Counting on GPU
par: Qiu, Linshan, et autres
Publié: (2024)
par: Qiu, Linshan, et autres
Publié: (2024)
GPU Sharing with Triples Mode
par: Byun, Chansup, et autres
Publié: (2024)
par: Byun, Chansup, et autres
Publié: (2024)
Neutron particle transport 3D method of characteristic Multi GPU platform Parallel Computing
par: Zhou, Faguo, et autres
Publié: (2025)
par: Zhou, Faguo, et autres
Publié: (2025)
Scheduling Deep Learning Jobs in Multi-Tenant GPU Clusters via Wise Resource Sharing
par: Luo, Yizhou, et autres
Publié: (2024)
par: Luo, Yizhou, et autres
Publié: (2024)
Large Scale Multi-GPU Based Parallel Traffic Simulation for Accelerated Traffic Assignment and Propagation
par: Jiang, Xuan, et autres
Publié: (2024)
par: Jiang, Xuan, et autres
Publié: (2024)
ParvaGPU: Efficient Spatial GPU Sharing for Large-Scale DNN Inference in Cloud Environments
par: Lee, Munkyu, et autres
Publié: (2024)
par: Lee, Munkyu, et autres
Publié: (2024)
On the Partitioning of GPU Power among Multi-Instances
par: Vamja, Tirth, et autres
Publié: (2025)
par: Vamja, Tirth, et autres
Publié: (2025)
Efficient CPU-GPU Collaborative Inference for MoE-based LLMs on Memory-Limited Systems
par: Huang, En-Ming, et autres
Publié: (2025)
par: Huang, En-Ming, et autres
Publié: (2025)
GICC: A High-Performance Runtime for GPU-Initiated Communication and Coordination in Modern HPC Systems
par: Shan, Baodi, et autres
Publié: (2026)
par: Shan, Baodi, et autres
Publié: (2026)
Harnessing Integrated CPU-GPU System Memory for HPC: a first look into Grace Hopper
par: Schieffer, Gabin, et autres
Publié: (2024)
par: Schieffer, Gabin, et autres
Publié: (2024)
Mell: Memory-Efficient Large Language Model Serving via Multi-GPU KV Cache Management
par: Qianli, Liu, et autres
Publié: (2025)
par: Qianli, Liu, et autres
Publié: (2025)
Syncopate: Efficient Multi-GPU AI Kernels via Automatic Chunk-Centric Compute-Communication Overlap
par: Qiang, Xinwei, et autres
Publié: (2026)
par: Qiang, Xinwei, et autres
Publié: (2026)
Predictable LLM Serving on GPU Clusters
par: Darzi, Erfan, et autres
Publié: (2025)
par: Darzi, Erfan, et autres
Publié: (2025)
DuaLip-GPU Technical Report
par: Dexter, Gregory, et autres
Publié: (2026)
par: Dexter, Gregory, et autres
Publié: (2026)
Incidence Constraints in Hypergraph Partitioning on GPU
par: Ronzani, Marco, et autres
Publié: (2026)
par: Ronzani, Marco, et autres
Publié: (2026)
GPU Accelerated Sparse Cholesky Factorization
par: Karsavuran, M. Ozan, et autres
Publié: (2024)
par: Karsavuran, M. Ozan, et autres
Publié: (2024)
Heat: Satellite's meat is GPU's poison
par: Yuan, Zhehu, et autres
Publié: (2024)
par: Yuan, Zhehu, et autres
Publié: (2024)
HAS-GPU: Efficient Hybrid Auto-scaling with Fine-grained GPU Allocation for SLO-aware Serverless Inferences
par: Gu, Jianfeng, et autres
Publié: (2025)
par: Gu, Jianfeng, et autres
Publié: (2025)
D-PDLP: Scaling PDLP to Distributed Multi-GPU Systems
par: Li, Hongpei, et autres
Publié: (2026)
par: Li, Hongpei, et autres
Publié: (2026)
Optimizing Bloom Filters for Modern GPU Architectures
par: Jünger, Daniel, et autres
Publié: (2025)
par: Jünger, Daniel, et autres
Publié: (2025)
Documents similaires
-
Centroid Approximation with Multidimensional Approximate Agreement Protocols
par: Cambus, Melanie, et autres
Publié: (2023) -
Improving GPU Multi-Tenancy Through Dynamic Multi-Instance GPU Reconfiguration
par: Wang, Tianyu, et autres
Publié: (2024) -
Concurrent Scheduling of High-Level Parallel Programs on Multi-GPU Systems
par: Knorr, Fabian, et autres
Publié: (2025) -
Understanding Data Movement in AMD Multi-GPU Systems with Infinity Fabric
par: Schieffer, Gabin, et autres
Publié: (2024) -
Accelerating Intra-Node GPU-to-GPU Communication Through Multi-Path Transfers with CUDA Graphs
par: Sojoodi, Amirhossein, et autres
Publié: (2026)