Benchmark-based Study of CPU/GPU Power-Related Features through JAX and TensorFlow
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Tchakoute, Roblex Nana, Tadonki, Claude, Dokladal, Petr, Mesri, Youssef |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Energy Concerns with HPC Systems and Applications
par: Nana, Roblex, et autres
Publié: (2023)
par: Nana, Roblex, et autres
Publié: (2023)
Energy-Aware Computing in the Year 2026
par: Tchakoute, Roblex Nana, et autres
Publié: (2026)
par: Tchakoute, Roblex Nana, et autres
Publié: (2026)
Revealing NVIDIA Closed-Source Driver Command Streams for CPU-GPU Runtime Behavior Insight
par: Yan, Yuang, et autres
Publié: (2026)
par: Yan, Yuang, et autres
Publié: (2026)
Accelerating Mobile Inference through Fine-Grained CPU-GPU Co-Execution
par: Li, Zhuojin, et autres
Publié: (2025)
par: Li, Zhuojin, et autres
Publié: (2025)
Edge Deployment of Small Language Models, a comprehensive comparison of CPU, GPU and NPU backends
par: Prieto, Pablo, et autres
Publié: (2025)
par: Prieto, Pablo, et autres
Publié: (2025)
MambaCPU: Enhanced Correlation Mining with State Space Models for CPU Performance Prediction
par: Liu, Xiaoman
Publié: (2024)
par: Liu, Xiaoman
Publié: (2024)
An Efficient Hybrid Sparse Attention with CPU-GPU Parallelism for Long-Context Inference
par: Yao, Feiyu, et autres
Publié: (2026)
par: Yao, Feiyu, et autres
Publié: (2026)
Comparing CPU and GPU compute of PERMANOVA on MI300A
par: Sfiligoi, Igor
Publié: (2025)
par: Sfiligoi, Igor
Publié: (2025)
Dissecting CPU-GPU Unified Physical Memory on AMD MI300A APUs
par: Wahlgren, Jacob, et autres
Publié: (2025)
par: Wahlgren, Jacob, et autres
Publié: (2025)
HybridGen: Efficient LLM Generative Inference via CPU-GPU Hybrid Computing
par: Lin, Mao, et autres
Publié: (2026)
par: Lin, Mao, et autres
Publié: (2026)
Achieving Consistent and Comparable CPU Evaluation
par: Wang, Chenxi, et autres
Publié: (2024)
par: Wang, Chenxi, et autres
Publié: (2024)
CAPSim: A Fast CPU Performance Simulator Using Attention-based Predictor
par: Xu, Buqing, et autres
Publié: (2025)
par: Xu, Buqing, et autres
Publié: (2025)
Confidential LLM Inference: Performance and Cost Across CPU and GPU TEEs
par: Chrapek, Marcin, et autres
Publié: (2025)
par: Chrapek, Marcin, et autres
Publié: (2025)
Towards CPU Performance Prediction: New Challenge Benchmark Dataset and Novel Approach
par: Liu, Xiaoman
Publié: (2024)
par: Liu, Xiaoman
Publié: (2024)
cuTeSpMM: Accelerating Sparse-Dense Matrix Multiplication using GPU Tensor Cores
par: Xiang, Lizhi, et autres
Publié: (2025)
par: Xiang, Lizhi, et autres
Publié: (2025)
Characterizing and Optimizing LLM Inference Workloads on CPU-GPU Coupled Architectures
par: Vellaisamy, Prabhu, et autres
Publié: (2025)
par: Vellaisamy, Prabhu, et autres
Publié: (2025)
xMem: A CPU-Based Approach for Accurate Estimation of GPU Memory in Deep Learning Training Workloads
par: Shi, Jiabo, et autres
Publié: (2025)
par: Shi, Jiabo, et autres
Publié: (2025)
Unleashing the Power of Preemptive Priority-based Scheduling for Real-Time GPU Tasks
par: Wang, Yidi, et autres
Publié: (2024)
par: Wang, Yidi, et autres
Publié: (2024)
SPEC CPU2026: Characterization, Representativeness, and Cross-Suite Comparison
par: Li, Ruihao, et autres
Publié: (2026)
par: Li, Ruihao, et autres
Publié: (2026)
On the Partitioning of GPU Power among Multi-Instances
par: Vamja, Tirth, et autres
Publié: (2025)
par: Vamja, Tirth, et autres
Publié: (2025)
Scaling Large-scale GNN Training to Thousands of Processors on CPU-based Supercomputers
par: Zhuang, Chen, et autres
Publié: (2024)
par: Zhuang, Chen, et autres
Publié: (2024)
Dissecting the software-based measurement of CPU energy consumption: a comparative analysis
par: Raffin, Guillaume, et autres
Publié: (2024)
par: Raffin, Guillaume, et autres
Publié: (2024)
Blink: CPU-Free LLM Inference by Delegating the Serving Stack to GPU and SmartNIC
par: Siavashi, Mohammad, et autres
Publié: (2026)
par: Siavashi, Mohammad, et autres
Publié: (2026)
Fast and Scalable Mixed Precision Euclidean Distance Calculations Using GPU Tensor Cores
par: Curless, Brian, et autres
Publié: (2025)
par: Curless, Brian, et autres
Publié: (2025)
KernelBenchX: A Comprehensive Benchmark for Evaluating LLM-Generated GPU Kernels
par: Wang, Han, et autres
Publié: (2026)
par: Wang, Han, et autres
Publié: (2026)
AI Application Benchmarking: Power-Aware Performance Analysis for Vision and Language Models
par: Mayr, Martin, et autres
Publié: (2026)
par: Mayr, Martin, et autres
Publié: (2026)
AMD MI300X GPU Performance Analysis
par: Ambati, Chandrish, et autres
Publié: (2025)
par: Ambati, Chandrish, et autres
Publié: (2025)
An Empirical Study on Method-Level Performance Evolution in Open-Source Java Projects
par: Shahedi, Kaveh, et autres
Publié: (2025)
par: Shahedi, Kaveh, et autres
Publié: (2025)
Minos: Systematically Classifying Performance and Power Characteristics of GPU Workloads on HPC Clusters
par: Jain, Rutwik, et autres
Publié: (2026)
par: Jain, Rutwik, et autres
Publié: (2026)
Evaluating HPC-Style CPU Performance and Cost in Virtualized Cloud Infrastructures
par: Tharwani, Jay, et autres
Publié: (2025)
par: Tharwani, Jay, et autres
Publié: (2025)
DSO: A GPU Energy Efficiency Optimizer by Fusing Dynamic and Static Information
par: Wang, Qiang, et autres
Publié: (2024)
par: Wang, Qiang, et autres
Publié: (2024)
FlipFlop: A Static Analysis-based Energy Optimization Framework for GPU Kernels
par: Rajput, Saurabhsingh, et autres
Publié: (2026)
par: Rajput, Saurabhsingh, et autres
Publié: (2026)
AGIPC: Adaptive In-Solve Algebraic Coarsening for GPU IPC
par: Wang, Xuan, et autres
Publié: (2026)
par: Wang, Xuan, et autres
Publié: (2026)
Concorde: Fast and Accurate CPU Performance Modeling with Compositional Analytical-ML Fusion
par: Nasr-Esfahany, Arash, et autres
Publié: (2025)
par: Nasr-Esfahany, Arash, et autres
Publié: (2025)
Automated PMC-based Power Modeling Methodology for Modern Mobile GPUs
par: Dash, Pranab, et autres
Publié: (2024)
par: Dash, Pranab, et autres
Publié: (2024)
Performance comparison of medical image classification systems using TensorFlow Keras, PyTorch, and JAX
par: Bećirović, Merjem, et autres
Publié: (2025)
par: Bećirović, Merjem, et autres
Publié: (2025)
A Multi-agent AI System for Deep Learning Model Migration from TensorFlow to JAX
par: Nikolov, Stoyan, et autres
Publié: (2026)
par: Nikolov, Stoyan, et autres
Publié: (2026)
CPU Optimization of a Monocular 3D Biomechanics Pipeline for Low-Resource Deployment
par: Zhang, Yan, et autres
Publié: (2026)
par: Zhang, Yan, et autres
Publié: (2026)
StiffGIPC: Advancing GPU IPC for stiff affine-deformable simulation
par: Huang, Kemeng, et autres
Publié: (2024)
par: Huang, Kemeng, et autres
Publié: (2024)
CPU-Limits kill Performance: Time to rethink Resource Control
par: Shetty, Chirag, et autres
Publié: (2025)
par: Shetty, Chirag, et autres
Publié: (2025)
Documents similaires
-
Energy Concerns with HPC Systems and Applications
par: Nana, Roblex, et autres
Publié: (2023) -
Energy-Aware Computing in the Year 2026
par: Tchakoute, Roblex Nana, et autres
Publié: (2026) -
Revealing NVIDIA Closed-Source Driver Command Streams for CPU-GPU Runtime Behavior Insight
par: Yan, Yuang, et autres
Publié: (2026) -
Accelerating Mobile Inference through Fine-Grained CPU-GPU Co-Execution
par: Li, Zhuojin, et autres
Publié: (2025) -
Edge Deployment of Small Language Models, a comprehensive comparison of CPU, GPU and NPU backends
par: Prieto, Pablo, et autres
Publié: (2025)