Energy efficiency optimization of task-parallel codes on asymmetric architectures
Fuente:
arXiv
Salvato in:
| Autori principali: | Costero, Luis, Igual, Francisco D., Olcoz, Katzalin, Tirado, Francisco |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Leveraging knowledge-as-a-service (KaaS) for QoS-aware resource management in multi-user video transcoding
di: Costero, Luis, et al.
Pubblicazione: (2024)
di: Costero, Luis, et al.
Pubblicazione: (2024)
Improving inference time in multi-TPU systems with profiled model segmentation
di: Villarrubia, Jorge, et al.
Pubblicazione: (2025)
di: Villarrubia, Jorge, et al.
Pubblicazione: (2025)
Balanced segmentation of CNNs for multi-TPU inference
di: Villarrubia, Jorge, et al.
Pubblicazione: (2025)
di: Villarrubia, Jorge, et al.
Pubblicazione: (2025)
A comprehensive evaluation of spatial co-execution on GPUs using MPS and MIG technologies
di: Villarrubia, Jorge, et al.
Pubblicazione: (2026)
di: Villarrubia, Jorge, et al.
Pubblicazione: (2026)
Leveraging Multi-Instance GPUs through moldable task scheduling
di: Villarrubia, Jorge, et al.
Pubblicazione: (2025)
di: Villarrubia, Jorge, et al.
Pubblicazione: (2025)
Static task mapping for heterogeneous systems based on series-parallel decompositions
di: Wilhelm, Martin, et al.
Pubblicazione: (2025)
di: Wilhelm, Martin, et al.
Pubblicazione: (2025)
Matrix representation and GPU-optimized parallel B-spline computing
di: Wu, Jiayu, et al.
Pubblicazione: (2025)
di: Wu, Jiayu, et al.
Pubblicazione: (2025)
Batched DGEMMs for scientific codes running on long vector architectures
di: Banchelli, Fabio, et al.
Pubblicazione: (2025)
di: Banchelli, Fabio, et al.
Pubblicazione: (2025)
A dynamic parallel method for performance optimization on hybrid CPUs
di: Yu, Luo, et al.
Pubblicazione: (2024)
di: Yu, Luo, et al.
Pubblicazione: (2024)
Enabling performance portability of data-parallel OpenMP applications on asymmetric multicore processors
di: Saez, Juan Carlos, et al.
Pubblicazione: (2024)
di: Saez, Juan Carlos, et al.
Pubblicazione: (2024)
Energy efficiency: a Lattice Boltzmann study
di: Turisini, Matteo, et al.
Pubblicazione: (2024)
di: Turisini, Matteo, et al.
Pubblicazione: (2024)
An efficient implementation of parallel simulated annealing algorithm in GPUs
di: Ferreiro, A. M., et al.
Pubblicazione: (2024)
di: Ferreiro, A. M., et al.
Pubblicazione: (2024)
Genetic-based fog colony optimization hybridized with hierarchical clustering and its influence in the placement of fog services
di: Talavera, Francisco, et al.
Pubblicazione: (2022)
di: Talavera, Francisco, et al.
Pubblicazione: (2022)
A parallel parser for regular expressions
di: Borsotti, Angelo, et al.
Pubblicazione: (2025)
di: Borsotti, Angelo, et al.
Pubblicazione: (2025)
Energy-efficient Federated Learning with Dynamic Model Size Allocation
di: Kumar, M S Chaitanya, et al.
Pubblicazione: (2024)
di: Kumar, M S Chaitanya, et al.
Pubblicazione: (2024)
Specx: a C++ task-based runtime system for heterogeneous distributed architectures
di: Cardosi, Paul, et al.
Pubblicazione: (2023)
di: Cardosi, Paul, et al.
Pubblicazione: (2023)
Massively parallel CMA-ES with increasing population
di: Redon, David, et al.
Pubblicazione: (2024)
di: Redon, David, et al.
Pubblicazione: (2024)
Research on the efficiency of data loading and storage in Data Lakehouse architectures for the formation of analytical data systems
di: Borodii, Ivan, et al.
Pubblicazione: (2026)
di: Borodii, Ivan, et al.
Pubblicazione: (2026)
AdaOper: Energy-efficient and Responsive Concurrent DNN Inference on Mobile Devices
di: Lin, Zheng, et al.
Pubblicazione: (2024)
di: Lin, Zheng, et al.
Pubblicazione: (2024)
A common parallel framework for LLP combinatorial problems
di: Alves, David Ribeiro, et al.
Pubblicazione: (2026)
di: Alves, David Ribeiro, et al.
Pubblicazione: (2026)
Toward parallel intelligence: an interdisciplinary solution for complex systems
di: Zhao, Yong, et al.
Pubblicazione: (2023)
di: Zhao, Yong, et al.
Pubblicazione: (2023)
Extension of ACETONE C code generator for multi-core architectures
di: Aït-Aïssa, Yanis, et al.
Pubblicazione: (2026)
di: Aït-Aïssa, Yanis, et al.
Pubblicazione: (2026)
Minimizing speculation overhead in a parallel recognizer for regular texts
di: Borsotti, Angelo, et al.
Pubblicazione: (2024)
di: Borsotti, Angelo, et al.
Pubblicazione: (2024)
Fog enabled distributed training architecture for federated learning
di: Kumar, Aditya, et al.
Pubblicazione: (2024)
di: Kumar, Aditya, et al.
Pubblicazione: (2024)
CloudFormer: An Attention-based Performance Prediction for Public Clouds with Unknown Workload
di: Shahbazinia, Amirhossein, et al.
Pubblicazione: (2025)
di: Shahbazinia, Amirhossein, et al.
Pubblicazione: (2025)
Regent based parallel meshfree LSKUM solver for heterogenous HPC platforms
di: Salil, Sanath, et al.
Pubblicazione: (2024)
di: Salil, Sanath, et al.
Pubblicazione: (2024)
An inherently parallel H2-ULV factorization for solving dense linear systems on GPUs
di: Ma, Qianxiang, et al.
Pubblicazione: (2025)
di: Ma, Qianxiang, et al.
Pubblicazione: (2025)
Ladder-residual: parallelism-aware architecture for accelerating large model inference with communication overlapping
di: Zhang, Muru, et al.
Pubblicazione: (2025)
di: Zhang, Muru, et al.
Pubblicazione: (2025)
A large-scale distributed parallel discrete event simulation engines based on Warped2 for Wargaming simulation
di: Jia, Xiaoning, et al.
Pubblicazione: (2025)
di: Jia, Xiaoning, et al.
Pubblicazione: (2025)
Pipit: Scripting the analysis of parallel execution traces
di: Bhatele, Abhinav, et al.
Pubblicazione: (2023)
di: Bhatele, Abhinav, et al.
Pubblicazione: (2023)
A task-based data-flow methodology for programming heterogeneous systems with multiple accelerator APIs
di: Boné, Aleix, et al.
Pubblicazione: (2026)
di: Boné, Aleix, et al.
Pubblicazione: (2026)
Collaborative UAVs Multi-task Video Processing Optimization Based on Enhanced Distributed Actor-Critic Networks
di: Rong, Ziqi, et al.
Pubblicazione: (2024)
di: Rong, Ziqi, et al.
Pubblicazione: (2024)
Analysis of wireless network access logs for a hierarchical characterization of user mobility
di: Talavera, Francisco, et al.
Pubblicazione: (2026)
di: Talavera, Francisco, et al.
Pubblicazione: (2026)
AdaBridge: Dynamic Data and Computation Reuse for Efficient Multi-task DNN Co-evolution in Edge Systems
di: Wang, Lehao, et al.
Pubblicazione: (2024)
di: Wang, Lehao, et al.
Pubblicazione: (2024)
FedAPTA: Federated Multi-task Learning for Heterogeneous Devices with Adaptive Layer-wise Pruning and Task-aware Aggregation
di: Yu, Zhen, et al.
Pubblicazione: (2025)
di: Yu, Zhen, et al.
Pubblicazione: (2025)
Rafture: Erasure-coded Raft with Post-Dissemination Pruning
di: Kerur, Rithwik, et al.
Pubblicazione: (2026)
di: Kerur, Rithwik, et al.
Pubblicazione: (2026)
Cross-architecture universal feature coding via distribution alignment
di: Gao, Changsheng, et al.
Pubblicazione: (2025)
di: Gao, Changsheng, et al.
Pubblicazione: (2025)
Resource-efficient Parallel Split Learning in Heterogeneous Edge Computing
di: Zhang, Mingjin, et al.
Pubblicazione: (2024)
di: Zhang, Mingjin, et al.
Pubblicazione: (2024)
Space-efficient population protocols for exact majority on general graphs
di: Rybicki, Joel, et al.
Pubblicazione: (2025)
di: Rybicki, Joel, et al.
Pubblicazione: (2025)
An efficient validated asynchronous byzantine agreement protocol using committee
di: Sony, Nasit S
Pubblicazione: (2025)
di: Sony, Nasit S
Pubblicazione: (2025)
Documenti analoghi
-
Leveraging knowledge-as-a-service (KaaS) for QoS-aware resource management in multi-user video transcoding
di: Costero, Luis, et al.
Pubblicazione: (2024) -
Improving inference time in multi-TPU systems with profiled model segmentation
di: Villarrubia, Jorge, et al.
Pubblicazione: (2025) -
Balanced segmentation of CNNs for multi-TPU inference
di: Villarrubia, Jorge, et al.
Pubblicazione: (2025) -
A comprehensive evaluation of spatial co-execution on GPUs using MPS and MIG technologies
di: Villarrubia, Jorge, et al.
Pubblicazione: (2026) -
Leveraging Multi-Instance GPUs through moldable task scheduling
di: Villarrubia, Jorge, et al.
Pubblicazione: (2025)