Code generation and runtime techniques for enabling data-efficient deep learning training on GPUs
Fuente:
arXiv
Salvato in:
| Autore principale: | Wu, Kun |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
SSDTrain: An Activation Offloading Framework to SSDs for Faster Large Language Model Training
di: Wu, Kun, et al.
Pubblicazione: (2024)
di: Wu, Kun, et al.
Pubblicazione: (2024)
D-CODE: Data Colony Optimization for Dynamic Network Efficiency
di: Pandey, Tannu, et al.
Pubblicazione: (2024)
di: Pandey, Tannu, et al.
Pubblicazione: (2024)
Reducing Data Bottlenecks in Distributed, Heterogeneous Neural Networks
di: Lin, Ruhai, et al.
Pubblicazione: (2024)
di: Lin, Ruhai, et al.
Pubblicazione: (2024)
Trackable Agent-based Evolution Models at Wafer Scale
di: Moreno, Matthew Andres, et al.
Pubblicazione: (2024)
di: Moreno, Matthew Andres, et al.
Pubblicazione: (2024)
Trackable Island-model Genetic Algorithms at Wafer Scale
di: Moreno, Matthew Andres, et al.
Pubblicazione: (2024)
di: Moreno, Matthew Andres, et al.
Pubblicazione: (2024)
Sparse Spiking Neural-like Membrane Systems on Graphics Processing Units
di: Hernández-Tello, Javier, et al.
Pubblicazione: (2024)
di: Hernández-Tello, Javier, et al.
Pubblicazione: (2024)
A Frequency-based Parent Selection for Reducing the Effect of Evaluation Time Bias in Asynchronous Parallel Multi-objective Evolutionary Algorithms
di: Harada, Tomohiro
Pubblicazione: (2021)
di: Harada, Tomohiro
Pubblicazione: (2021)
Neuromorphic Simulation of Drosophila Melanogaster Brain Connectome on Loihi 2
di: Wang, Felix, et al.
Pubblicazione: (2025)
di: Wang, Felix, et al.
Pubblicazione: (2025)
A Fresh Approach to Evaluate Performance in Distributed Parallel Genetic Algorithms
di: Harada, Tomohiro, et al.
Pubblicazione: (2021)
di: Harada, Tomohiro, et al.
Pubblicazione: (2021)
Evaluation and Efficiency Comparison of Evolutionary Algorithms for Service Placement Optimization in Fog Architectures
di: Guerrero, Carlos, et al.
Pubblicazione: (2025)
di: Guerrero, Carlos, et al.
Pubblicazione: (2025)
Scalable Construction of Spiking Neural Networks using up to thousands of GPUs
di: Golosio, Bruno, et al.
Pubblicazione: (2025)
di: Golosio, Bruno, et al.
Pubblicazione: (2025)
Neuromorphic hardware for sustainable AI data centers
di: Vogginger, Bernhard, et al.
Pubblicazione: (2024)
di: Vogginger, Bernhard, et al.
Pubblicazione: (2024)
ParEVO: Synthesizing Code for Irregular Data: High-Performance Parallelism through Agentic Evolution
di: Yang, Liu, et al.
Pubblicazione: (2026)
di: Yang, Liu, et al.
Pubblicazione: (2026)
Federated Learning in Chemical Engineering: A Tutorial on a Framework for Privacy-Preserving Collaboration Across Distributed Data Sources
di: Dutta, Siddhant, et al.
Pubblicazione: (2024)
di: Dutta, Siddhant, et al.
Pubblicazione: (2024)
Distributed genetic algorithm for application placement in the compute continuum leveraging infrastructure nodes for optimization
di: Guerrero, Carlos, et al.
Pubblicazione: (2024)
di: Guerrero, Carlos, et al.
Pubblicazione: (2024)
Neuromorphic Computing: A Theoretical Framework for Time, Space, and Energy Scaling
di: Aimone, James B
Pubblicazione: (2025)
di: Aimone, James B
Pubblicazione: (2025)
HiAER-Spike: Hardware-Software Co-Design for Large-Scale Reconfigurable Event-Driven Neuromorphic Computing
di: Frank, Gwenevere, et al.
Pubblicazione: (2025)
di: Frank, Gwenevere, et al.
Pubblicazione: (2025)
phys-MCP: A Control Plane for Heterogeneous Physical Neural Networks
di: Fischer, Stefan, et al.
Pubblicazione: (2026)
di: Fischer, Stefan, et al.
Pubblicazione: (2026)
GAP2WSS: A Genetic Algorithm based on the Pareto Principle for Web Service Selection
di: Khatoonabadi, SayedHassan, et al.
Pubblicazione: (2021)
di: Khatoonabadi, SayedHassan, et al.
Pubblicazione: (2021)
The AI Shadow War: SaaS vs. Edge Computing Architectures
di: Marpu, Rhea Pritham, et al.
Pubblicazione: (2025)
di: Marpu, Rhea Pritham, et al.
Pubblicazione: (2025)
A Reinforced Evolution-Based Approach to Multi-Resource Load Balancing
di: Sliwko, Leszek
Pubblicazione: (2025)
di: Sliwko, Leszek
Pubblicazione: (2025)
Wireless Sensor Networks as Parallel and Distributed Hardware Platform for Artificial Neural Networks
di: Serpen, Gursel
Pubblicazione: (2025)
di: Serpen, Gursel
Pubblicazione: (2025)
NeuroRing: Scaling Spiking Neural Networks via Multi-FPGA Bidirectional Ring Topologies and Stream-Dataflow Architectures
di: Hafiz, Muhammad Ihsan Al, et al.
Pubblicazione: (2026)
di: Hafiz, Muhammad Ihsan Al, et al.
Pubblicazione: (2026)
MAC-DO: An Efficient Output-Stationary GEMM Accelerator for CNNs Using DRAM Technology
di: Jeong, Minki, et al.
Pubblicazione: (2022)
di: Jeong, Minki, et al.
Pubblicazione: (2022)
Asynchronous Evolution of Deep Neural Network Architectures
di: Liang, Jason, et al.
Pubblicazione: (2023)
di: Liang, Jason, et al.
Pubblicazione: (2023)
Man-Made Heuristics Are Dead. Long Live Code Generators!
di: Dwivedula, Rohit, et al.
Pubblicazione: (2025)
di: Dwivedula, Rohit, et al.
Pubblicazione: (2025)
EvoGit: Decentralized Code Evolution via Git-Based Multi-Agent Collaboration
di: Huang, Beichen, et al.
Pubblicazione: (2025)
di: Huang, Beichen, et al.
Pubblicazione: (2025)
OpenRASE: Service Function Chain Emulation
di: Krishnamohan, Theviyanthan, et al.
Pubblicazione: (2025)
di: Krishnamohan, Theviyanthan, et al.
Pubblicazione: (2025)
Towards a Decentralised Application-Centric Orchestration Framework in the Cloud-Edge Continuum
di: Ullah, Amjad, et al.
Pubblicazione: (2025)
di: Ullah, Amjad, et al.
Pubblicazione: (2025)
Zeroing neural dynamics solving time-variant complex conjugate matrix equation $X(τ)F(τ)-A(τ)\overline{X}(τ)=C(τ)$
di: He, Jiakuang, et al.
Pubblicazione: (2024)
di: He, Jiakuang, et al.
Pubblicazione: (2024)
Split Federated Learning Over Heterogeneous Edge Devices: Algorithm and Optimization
di: Sun, Yunrui, et al.
Pubblicazione: (2024)
di: Sun, Yunrui, et al.
Pubblicazione: (2024)
Cyclic Data Parallelism for Efficient Parallelism of Deep Neural Networks
di: Fournier, Louis, et al.
Pubblicazione: (2024)
di: Fournier, Louis, et al.
Pubblicazione: (2024)
NeuraChip: Accelerating GNN Computations with a Hash-based Decoupled Spatial Accelerator
di: Shivdikar, Kaustubh, et al.
Pubblicazione: (2024)
di: Shivdikar, Kaustubh, et al.
Pubblicazione: (2024)
Enhancing Computational Efficiency in Multiscale Systems Using Deep Learning of Coordinates and Flow Maps
di: Hamid, Asif, et al.
Pubblicazione: (2024)
di: Hamid, Asif, et al.
Pubblicazione: (2024)
Comparison of Microservice Call Rate Predictions for Replication in the Cloud
di: Mehran, Narges, et al.
Pubblicazione: (2023)
di: Mehran, Narges, et al.
Pubblicazione: (2023)
Linear Reservoir: A Diagonalization-Based Optimization
di: de Coudenhove, Romain, et al.
Pubblicazione: (2026)
di: de Coudenhove, Romain, et al.
Pubblicazione: (2026)
Online Continual Learning on Intel Loihi 2 via a Co-designed Spiking Neural Network
di: Hajizada, Elvin, et al.
Pubblicazione: (2025)
di: Hajizada, Elvin, et al.
Pubblicazione: (2025)
All-to-all reconfigurability with sparse and higher-order Ising machines
di: Nikhar, Srijan, et al.
Pubblicazione: (2023)
di: Nikhar, Srijan, et al.
Pubblicazione: (2023)
Edge Intelligence with Spiking Neural Networks
di: Deng, Shuiguang, et al.
Pubblicazione: (2025)
di: Deng, Shuiguang, et al.
Pubblicazione: (2025)
When Federated Learning Meets Quantum Computing: Survey and Research Opportunities
di: Mathur, Aakar, et al.
Pubblicazione: (2025)
di: Mathur, Aakar, et al.
Pubblicazione: (2025)
Documenti analoghi
-
SSDTrain: An Activation Offloading Framework to SSDs for Faster Large Language Model Training
di: Wu, Kun, et al.
Pubblicazione: (2024) -
D-CODE: Data Colony Optimization for Dynamic Network Efficiency
di: Pandey, Tannu, et al.
Pubblicazione: (2024) -
Reducing Data Bottlenecks in Distributed, Heterogeneous Neural Networks
di: Lin, Ruhai, et al.
Pubblicazione: (2024) -
Trackable Agent-based Evolution Models at Wafer Scale
di: Moreno, Matthew Andres, et al.
Pubblicazione: (2024) -
Trackable Island-model Genetic Algorithms at Wafer Scale
di: Moreno, Matthew Andres, et al.
Pubblicazione: (2024)