Optimizing the Variant Calling Pipeline Execution on Human Genomes Using GPU-Enabled Machines
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Kumar, Ajay, Rao, Praveen, Sanders, Peter |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Heimdall++: Optimizing GPU Utilization and Pipeline Parallelism for Efficient Single-Pulse Detection
par: Xia, Bingzheng, et autres
Publié: (2025)
par: Xia, Bingzheng, et autres
Publié: (2025)
VDCores: Resource Decoupled Programming and Execution for Asynchronous GPU
par: He, Zijian, et autres
Publié: (2026)
par: He, Zijian, et autres
Publié: (2026)
A Multi-Objective Framework for Optimizing GPU-Enabled VM Placement in Cloud Data Centers with Multi-Instance GPU Technology
par: Siavashi, Ahmad, et autres
Publié: (2025)
par: Siavashi, Ahmad, et autres
Publié: (2025)
FastGraph: Optimized GPU-Enabled Algorithms for Fast Graph Building and Message Passing
par: Agarwal, Aarush, et autres
Publié: (2025)
par: Agarwal, Aarush, et autres
Publié: (2025)
The Energy Cost of Execution-Idle in GPU Clusters
par: Lei, Yiran, et autres
Publié: (2026)
par: Lei, Yiran, et autres
Publié: (2026)
APEX: Asynchronous Parallel CPU-GPU Execution for Online LLM Inference on Constrained GPUs
par: Fan, Jiakun, et autres
Publié: (2025)
par: Fan, Jiakun, et autres
Publié: (2025)
SOLANET: Distributed Neighbor Graph Construction on GPU-Accelerated Systems
par: Iwabuchi, Keita, et autres
Publié: (2026)
par: Iwabuchi, Keita, et autres
Publié: (2026)
SiPipe: Bridging the CPU-GPU Utilization Gap for Efficient Pipeline-Parallel LLM Inference
par: He, Yongchao, et autres
Publié: (2025)
par: He, Yongchao, et autres
Publié: (2025)
The GA4GH Task Execution API: Enabling Easy Multi Cloud Task Execution
par: Kanitz, Alexander, et autres
Publié: (2024)
par: Kanitz, Alexander, et autres
Publié: (2024)
PPipe: Efficient Video Analytics Serving on Heterogeneous GPU Clusters via Pool-Based Pipeline Parallelism
par: Kong, Z. Jonny, et autres
Publié: (2025)
par: Kong, Z. Jonny, et autres
Publié: (2025)
Optimizing Bloom Filters for Modern GPU Architectures
par: Jünger, Daniel, et autres
Publié: (2025)
par: Jünger, Daniel, et autres
Publié: (2025)
NCCLZ: Compression-Enabled GPU Collectives with Decoupled Quantization and Entropy Coding
par: Wang, Jiamin, et autres
Publié: (2026)
par: Wang, Jiamin, et autres
Publié: (2026)
Efficiently Executing High-throughput Lightweight LLM Inference Applications on Heterogeneous Opportunistic GPU Clusters with Pervasive Context Management
par: Phung, Thanh Son, et autres
Publié: (2025)
par: Phung, Thanh Son, et autres
Publié: (2025)
Parallel GPU-Enabled Algorithms for SpGEMM on Arbitrary Semirings with Hybrid Communication
par: McFarland, Thomas, et autres
Publié: (2025)
par: McFarland, Thomas, et autres
Publié: (2025)
Torpor: GPU-Enabled Serverless Computing for Low-Latency, Resource-Efficient Inference
par: Yu, Minchen, et autres
Publié: (2023)
par: Yu, Minchen, et autres
Publié: (2023)
Optimization Opportunities for Cloud-Based Data Pipeline Infrastructures
par: Jablonski, Johannes, et autres
Publié: (2026)
par: Jablonski, Johannes, et autres
Publié: (2026)
Zorse: Optimizing LLM Training Efficiency on Heterogeneous GPU Clusters
par: Guo, Runsheng Benson, et autres
Publié: (2025)
par: Guo, Runsheng Benson, et autres
Publié: (2025)
A Preliminary Study on Accelerating Simulation Optimization with GPU Implementation
par: He, Jinghai, et autres
Publié: (2024)
par: He, Jinghai, et autres
Publié: (2024)
A New Execution Model and Executor for Adaptively Optimizing the Performance of Parallel Algorithms Using HPX Runtime System
par: Mohammadiporshokooh, Karame, et autres
Publié: (2025)
par: Mohammadiporshokooh, Karame, et autres
Publié: (2025)
Dilu: Enabling GPU Resourcing-on-Demand for Serverless DL Serving via Introspective Elasticity
par: Lv, Cunchi, et autres
Publié: (2025)
par: Lv, Cunchi, et autres
Publié: (2025)
DAK: Direct-Access-Enabled GPU Memory Offloading with Optimal Efficiency for LLM Inference
par: Lin, Shouxu, et autres
Publié: (2026)
par: Lin, Shouxu, et autres
Publié: (2026)
Breaking the Memory Wall: A Study of I/O Patterns and GPU Memory Utilization for Hybrid CPU-GPU Offloaded Optimizers
par: Maurya, Avinash, et autres
Publié: (2024)
par: Maurya, Avinash, et autres
Publié: (2024)
COSMIC: Enabling Full-Stack Co-Design and Optimization of Distributed Machine Learning Systems
par: Raju, Aditi, et autres
Publié: (2025)
par: Raju, Aditi, et autres
Publié: (2025)
Less is More: Optimizing Function Calling for LLM Execution on Edge Devices
par: Paramanayakam, Varatheepan, et autres
Publié: (2024)
par: Paramanayakam, Varatheepan, et autres
Publié: (2024)
The Blockchain Execution Dilemma: Optimizing Revenue XOR Fair Ordering
par: Pugatsov, Artjom, et autres
Publié: (2026)
par: Pugatsov, Artjom, et autres
Publié: (2026)
Efficient Graph Embedding at Scale: Optimizing CPU-GPU-SSD Integration
par: Li, Zhonggen, et autres
Publié: (2025)
par: Li, Zhonggen, et autres
Publié: (2025)
FaaSTube: Optimizing GPU-oriented Data Transfer for Serverless Computing
par: Wu, Hao, et autres
Publié: (2024)
par: Wu, Hao, et autres
Publié: (2024)
ACC Saturator: Automatic Kernel Optimization for Directive-Based GPU Code
par: Matsumura, Kazuaki, et autres
Publié: (2023)
par: Matsumura, Kazuaki, et autres
Publié: (2023)
JanusPipe: Efficient Pipeline Parallel Training for Machine Learning Interatomic Potentials
par: Wang, Hongyu, et autres
Publié: (2026)
par: Wang, Hongyu, et autres
Publié: (2026)
Enabling Elastic Model Serving with MultiWorld
par: Lee, Myungjin, et autres
Publié: (2024)
par: Lee, Myungjin, et autres
Publié: (2024)
ProFaaStinate: Delaying Serverless Function Calls to Optimize Platform Performance
par: Schirmer, Trever, et autres
Publié: (2023)
par: Schirmer, Trever, et autres
Publié: (2023)
Optimizing Allreduce Operations for Modern Heterogeneous Architectures with Multiple Processes per GPU
par: Adams, Michael, et autres
Publié: (2025)
par: Adams, Michael, et autres
Publié: (2025)
ZEUS: An Efficient GPU Optimization Method Integrating PSO, BFGS, and Automatic Differentiation
par: Soos, Dominik, et autres
Publié: (2026)
par: Soos, Dominik, et autres
Publié: (2026)
EinDecomp: Decomposition of Declaratively-Specified Machine Learning and Numerical Computations for Parallel Execution
par: Bourgeois, Daniel, et autres
Publié: (2024)
par: Bourgeois, Daniel, et autres
Publié: (2024)
AQUA: Network-Accelerated Memory Offloading for LLMs in Scale-Up GPU Domains
par: Kumar, Abhishek Vijaya, et autres
Publié: (2024)
par: Kumar, Abhishek Vijaya, et autres
Publié: (2024)
Pipelined Dense Symmetric Eigenvalue Decomposition on Multi-GPU Architectures
par: Wang, Hansheng, et autres
Publié: (2025)
par: Wang, Hansheng, et autres
Publié: (2025)
NCCLbpf: Verified, Composable Policy Execution for GPU Collective Communication
par: Zheng, Yusheng
Publié: (2026)
par: Zheng, Yusheng
Publié: (2026)
GPU Sharing with Triples Mode
par: Byun, Chansup, et autres
Publié: (2024)
par: Byun, Chansup, et autres
Publié: (2024)
gpuPairHMM: High-speed Pair-HMM Forward Algorithm for DNA Variant Calling on GPUs
par: Schmidt, Bertil, et autres
Publié: (2024)
par: Schmidt, Bertil, et autres
Publié: (2024)
DFLOP: A Data-driven Framework for Multimodal LLM Training Pipeline Optimization
par: An, Hyeonjun, et autres
Publié: (2026)
par: An, Hyeonjun, et autres
Publié: (2026)
Documents similaires
-
Heimdall++: Optimizing GPU Utilization and Pipeline Parallelism for Efficient Single-Pulse Detection
par: Xia, Bingzheng, et autres
Publié: (2025) -
VDCores: Resource Decoupled Programming and Execution for Asynchronous GPU
par: He, Zijian, et autres
Publié: (2026) -
A Multi-Objective Framework for Optimizing GPU-Enabled VM Placement in Cloud Data Centers with Multi-Instance GPU Technology
par: Siavashi, Ahmad, et autres
Publié: (2025) -
FastGraph: Optimized GPU-Enabled Algorithms for Fast Graph Building and Message Passing
par: Agarwal, Aarush, et autres
Publié: (2025) -
The Energy Cost of Execution-Idle in GPU Clusters
par: Lei, Yiran, et autres
Publié: (2026)