Comparative Analysis of FPGA and GPU Performance for Machine Learning-Based Track Reconstruction at LHCb
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Giasemis, Fotis I., Lončar, Vladimir, Granado, Bertrand, Gligorov, Vladimir Vava |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Graph Neural Network-Based Track Finding in the LHCb Vertex Detector
par: Correia, Anthony, et autres
Publié: (2024)
par: Correia, Anthony, et autres
Publié: (2024)
Graph Neural Network-Based Pipeline for Track Finding in the Velo at LHCb
par: Correia, Anthony, et autres
Publié: (2024)
par: Correia, Anthony, et autres
Publié: (2024)
Parallel CPU- and GPU-based connected component algorithms for event building for hybrid pixel detectors
par: Čelko, Tomáš, et autres
Publié: (2024)
par: Čelko, Tomáš, et autres
Publié: (2024)
Track reconstruction as a service for collider physics
par: Zhao, Haoran, et autres
Publié: (2025)
par: Zhao, Haoran, et autres
Publié: (2025)
Track Lab: extensible data acquisition software for fast pixel detectors, online analysis and automation
par: Mánek, Petr, et autres
Publié: (2023)
par: Mánek, Petr, et autres
Publié: (2023)
Advancing ATLAS DCS Data Analysis with a Modern Data Platform
par: Canali, Luca, et autres
Publié: (2025)
par: Canali, Luca, et autres
Publié: (2025)
Portable acceleration of CMS computing workflows with coprocessors as a service
par: CMS Collaboration
Publié: (2024)
par: CMS Collaboration
Publié: (2024)
SuperSONIC: Cloud-Native Infrastructure for ML Inferencing
par: Kondratyev, Dmitry, et autres
Publié: (2025)
par: Kondratyev, Dmitry, et autres
Publié: (2025)
Streaming Large-Scale Electron Microscopy Data to a Supercomputing Facility
par: Welborn, Samuel S., et autres
Publié: (2024)
par: Welborn, Samuel S., et autres
Publié: (2024)
Real-Time Analysis of Unstructured Data with Machine Learning on Heterogeneous Architectures
par: Giasemis, Fotis I.
Publié: (2025)
par: Giasemis, Fotis I.
Publié: (2025)
Cost-Performance Analysis: A Comparative Study of CPU-Based Serverless and GPU-Based Training Architectures
par: Barrak, Amine, et autres
Publié: (2025)
par: Barrak, Amine, et autres
Publié: (2025)
votess: A multi-target, GPU-capable, parallel Voronoi tessellator
par: Singh, Samridh Dev, et autres
Publié: (2024)
par: Singh, Samridh Dev, et autres
Publié: (2024)
Scalable FPGA Framework for Real-Time Denoising in High-Throughput Imaging: A DRAM-Optimized Pipeline using High-Level Synthesis
par: Liao, Weichien
Publié: (2025)
par: Liao, Weichien
Publié: (2025)
GPU-Based Parallel Computing Methods for Medical Photoacoustic Image Reconstruction
par: Yi, Xinyao, et autres
Publié: (2024)
par: Yi, Xinyao, et autres
Publié: (2024)
In-Situ High Performance Visualization for Astronomy & Cosmology
par: Tuccari, Nicola, et autres
Publié: (2025)
par: Tuccari, Nicola, et autres
Publié: (2025)
Interactive High-Performance Visualization for Astronomy and Cosmology
par: Sciacca, Eva, et autres
Publié: (2025)
par: Sciacca, Eva, et autres
Publié: (2025)
Running Cloud-native Workloads on HPC with High-Performance Kubernetes
par: Chazapis, Antony, et autres
Publié: (2024)
par: Chazapis, Antony, et autres
Publié: (2024)
Benchmarking with Supernovae: A Performance Study of the FLASH Code
par: Martin, Joshua, et autres
Publié: (2024)
par: Martin, Joshua, et autres
Publié: (2024)
Dataflow-Oriented Classification and Performance Analysis of GPU-Accelerated Homomorphic Encryption
par: Nozaki, Ai, et autres
Publié: (2026)
par: Nozaki, Ai, et autres
Publié: (2026)
FastTrack: GPU-Accelerated Tracking for Visual SLAM
par: Khabiri, Kimia, et autres
Publié: (2025)
par: Khabiri, Kimia, et autres
Publié: (2025)
Scalable GPU Performance Variability Analysis framework
par: Lahiry, Ankur, et autres
Publié: (2025)
par: Lahiry, Ankur, et autres
Publié: (2025)
Accelerated Digital Twin Learning for Edge AI: A Comparison of FPGA and Mobile GPU
par: Xu, Bin, et autres
Publié: (2025)
par: Xu, Bin, et autres
Publié: (2025)
Characterizing Compute-Communication Overlap in GPU-Accelerated Distributed Deep Learning: Performance and Power Implications
par: Lee, Seonho, et autres
Publié: (2025)
par: Lee, Seonho, et autres
Publié: (2025)
Unified schemes for directive-based GPU offloading
par: Miki, Yohei, et autres
Publié: (2024)
par: Miki, Yohei, et autres
Publié: (2024)
Orchestrated Co-scheduling, Resource Partitioning, and Power Capping on CPU-GPU Heterogeneous Systems via Machine Learning
par: Saba, Issa, et autres
Publié: (2024)
par: Saba, Issa, et autres
Publié: (2024)
Evaluation of Programming Models and Performance for Stencil Computation on Current GPU Architectures
par: Shan, Baodi, et autres
Publié: (2024)
par: Shan, Baodi, et autres
Publié: (2024)
Host-Side Telemetry for Performance Diagnosis in Cloud and HPC GPU Infrastructure
par: Darzi, Erfan, et autres
Publié: (2025)
par: Darzi, Erfan, et autres
Publié: (2025)
TX-Digital Twin: Visualizing Supercomputer GPU Performance Data Stream
par: Baskakova, Elena, et autres
Publié: (2026)
par: Baskakova, Elena, et autres
Publié: (2026)
VersaSlot: Efficient Fine-grained FPGA Sharing with Big.Little Slots and Live Migration in FPGA Cluster
par: Gu, Jianfeng, et autres
Publié: (2025)
par: Gu, Jianfeng, et autres
Publié: (2025)
Comparative Analysis of Distributed Caching Algorithms: Performance Metrics and Implementation Considerations
par: Mayer, Helen, et autres
Publié: (2025)
par: Mayer, Helen, et autres
Publié: (2025)
Optimizing the Variant Calling Pipeline Execution on Human Genomes Using GPU-Enabled Machines
par: Kumar, Ajay, et autres
Publié: (2025)
par: Kumar, Ajay, et autres
Publié: (2025)
GPU Under Pressure: Estimating Application's Stress via Telemetry and Performance Counters
par: Esposito, Giuseppe, et autres
Publié: (2025)
par: Esposito, Giuseppe, et autres
Publié: (2025)
A Study of Performance Programming of CPU, GPU accelerated Computers and SIMD Architecture
par: Yi, Xinyao
Publié: (2024)
par: Yi, Xinyao
Publié: (2024)
BandPilot: Towards Performance- and Contention-Aware GPU Dispatching in AI Clusters
par: Zhang, Kunming, et autres
Publié: (2025)
par: Zhang, Kunming, et autres
Publié: (2025)
Performance Characterization of Distributed Deep Learning Strategies: A Quantitative Evaluation of DDP, FSDP, and Parameter Server Architectures on GPU Clusters
par: Ovi, Md Sultanul Islam
Publié: (2025)
par: Ovi, Md Sultanul Islam
Publié: (2025)
Comparative Analysis of Lightweight Kubernetes Distributions for Edge Computing: Performance and Resource Efficiency
par: Yakubov, Diyaz, et autres
Publié: (2025)
par: Yakubov, Diyaz, et autres
Publié: (2025)
High-Performance N-Queens Solver on GPU: Iterative DFS with Zero Bank Conflicts
par: Yao, Guangchao, et autres
Publié: (2025)
par: Yao, Guangchao, et autres
Publié: (2025)
TurboFFT: A High-Performance Fast Fourier Transform with Fault Tolerance on GPU
par: Wu, Shixun, et autres
Publié: (2024)
par: Wu, Shixun, et autres
Publié: (2024)
HPX with Spack and Singularity Containers: Evaluating Overheads for HPX/Kokkos using an astrophysics application
par: Diehl, Patrick, et autres
Publié: (2024)
par: Diehl, Patrick, et autres
Publié: (2024)
Exascale In-situ visualization for Astronomy & Cosmology
par: Tuccari, Nicola, et autres
Publié: (2025)
par: Tuccari, Nicola, et autres
Publié: (2025)
Documents similaires
-
Graph Neural Network-Based Track Finding in the LHCb Vertex Detector
par: Correia, Anthony, et autres
Publié: (2024) -
Graph Neural Network-Based Pipeline for Track Finding in the Velo at LHCb
par: Correia, Anthony, et autres
Publié: (2024) -
Parallel CPU- and GPU-based connected component algorithms for event building for hybrid pixel detectors
par: Čelko, Tomáš, et autres
Publié: (2024) -
Track reconstruction as a service for collider physics
par: Zhao, Haoran, et autres
Publié: (2025) -
Track Lab: extensible data acquisition software for fast pixel detectors, online analysis and automation
par: Mánek, Petr, et autres
Publié: (2023)