Poor Man's Training on MCUs: A Memory-Efficient Quantized Back-Propagation-Free Approach
Fuente:
arXiv
Salvato in:
| Autori principali: | Zhao, Yequan, Li, Hai, Young, Ian, Zhang, Zheng |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
SSDTrain: An Activation Offloading Framework to SSDs for Faster Large Language Model Training
di: Wu, Kun, et al.
Pubblicazione: (2024)
di: Wu, Kun, et al.
Pubblicazione: (2024)
A Fresh Approach to Evaluate Performance in Distributed Parallel Genetic Algorithms
di: Harada, Tomohiro, et al.
Pubblicazione: (2021)
di: Harada, Tomohiro, et al.
Pubblicazione: (2021)
D-CODE: Data Colony Optimization for Dynamic Network Efficiency
di: Pandey, Tannu, et al.
Pubblicazione: (2024)
di: Pandey, Tannu, et al.
Pubblicazione: (2024)
A Frequency-based Parent Selection for Reducing the Effect of Evaluation Time Bias in Asynchronous Parallel Multi-objective Evolutionary Algorithms
di: Harada, Tomohiro
Pubblicazione: (2021)
di: Harada, Tomohiro
Pubblicazione: (2021)
Code generation and runtime techniques for enabling data-efficient deep learning training on GPUs
di: Wu, Kun
Pubblicazione: (2024)
di: Wu, Kun
Pubblicazione: (2024)
Neuromorphic Simulation of Drosophila Melanogaster Brain Connectome on Loihi 2
di: Wang, Felix, et al.
Pubblicazione: (2025)
di: Wang, Felix, et al.
Pubblicazione: (2025)
Evaluation and Efficiency Comparison of Evolutionary Algorithms for Service Placement Optimization in Fog Architectures
di: Guerrero, Carlos, et al.
Pubblicazione: (2025)
di: Guerrero, Carlos, et al.
Pubblicazione: (2025)
Reducing Data Bottlenecks in Distributed, Heterogeneous Neural Networks
di: Lin, Ruhai, et al.
Pubblicazione: (2024)
di: Lin, Ruhai, et al.
Pubblicazione: (2024)
Trackable Agent-based Evolution Models at Wafer Scale
di: Moreno, Matthew Andres, et al.
Pubblicazione: (2024)
di: Moreno, Matthew Andres, et al.
Pubblicazione: (2024)
Trackable Island-model Genetic Algorithms at Wafer Scale
di: Moreno, Matthew Andres, et al.
Pubblicazione: (2024)
di: Moreno, Matthew Andres, et al.
Pubblicazione: (2024)
Sparse Spiking Neural-like Membrane Systems on Graphics Processing Units
di: Hernández-Tello, Javier, et al.
Pubblicazione: (2024)
di: Hernández-Tello, Javier, et al.
Pubblicazione: (2024)
A Reinforced Evolution-Based Approach to Multi-Resource Load Balancing
di: Sliwko, Leszek
Pubblicazione: (2025)
di: Sliwko, Leszek
Pubblicazione: (2025)
MAC-DO: An Efficient Output-Stationary GEMM Accelerator for CNNs Using DRAM Technology
di: Jeong, Minki, et al.
Pubblicazione: (2022)
di: Jeong, Minki, et al.
Pubblicazione: (2022)
Man-Made Heuristics Are Dead. Long Live Code Generators!
di: Dwivedula, Rohit, et al.
Pubblicazione: (2025)
di: Dwivedula, Rohit, et al.
Pubblicazione: (2025)
Massively Parallel Genetic Optimization through Asynchronous Propagation of Populations
di: Taubert, Oskar, et al.
Pubblicazione: (2023)
di: Taubert, Oskar, et al.
Pubblicazione: (2023)
Neuromorphic Computing: A Theoretical Framework for Time, Space, and Energy Scaling
di: Aimone, James B
Pubblicazione: (2025)
di: Aimone, James B
Pubblicazione: (2025)
HiAER-Spike: Hardware-Software Co-Design for Large-Scale Reconfigurable Event-Driven Neuromorphic Computing
di: Frank, Gwenevere, et al.
Pubblicazione: (2025)
di: Frank, Gwenevere, et al.
Pubblicazione: (2025)
Neuromorphic hardware for sustainable AI data centers
di: Vogginger, Bernhard, et al.
Pubblicazione: (2024)
di: Vogginger, Bernhard, et al.
Pubblicazione: (2024)
Federated Learning in Chemical Engineering: A Tutorial on a Framework for Privacy-Preserving Collaboration Across Distributed Data Sources
di: Dutta, Siddhant, et al.
Pubblicazione: (2024)
di: Dutta, Siddhant, et al.
Pubblicazione: (2024)
phys-MCP: A Control Plane for Heterogeneous Physical Neural Networks
di: Fischer, Stefan, et al.
Pubblicazione: (2026)
di: Fischer, Stefan, et al.
Pubblicazione: (2026)
GAP2WSS: A Genetic Algorithm based on the Pareto Principle for Web Service Selection
di: Khatoonabadi, SayedHassan, et al.
Pubblicazione: (2021)
di: Khatoonabadi, SayedHassan, et al.
Pubblicazione: (2021)
The AI Shadow War: SaaS vs. Edge Computing Architectures
di: Marpu, Rhea Pritham, et al.
Pubblicazione: (2025)
di: Marpu, Rhea Pritham, et al.
Pubblicazione: (2025)
Wireless Sensor Networks as Parallel and Distributed Hardware Platform for Artificial Neural Networks
di: Serpen, Gursel
Pubblicazione: (2025)
di: Serpen, Gursel
Pubblicazione: (2025)
NeuroRing: Scaling Spiking Neural Networks via Multi-FPGA Bidirectional Ring Topologies and Stream-Dataflow Architectures
di: Hafiz, Muhammad Ihsan Al, et al.
Pubblicazione: (2026)
di: Hafiz, Muhammad Ihsan Al, et al.
Pubblicazione: (2026)
Asynchronous Evolution of Deep Neural Network Architectures
di: Liang, Jason, et al.
Pubblicazione: (2023)
di: Liang, Jason, et al.
Pubblicazione: (2023)
Distributed genetic algorithm for application placement in the compute continuum leveraging infrastructure nodes for optimization
di: Guerrero, Carlos, et al.
Pubblicazione: (2024)
di: Guerrero, Carlos, et al.
Pubblicazione: (2024)
Hector: An Efficient Programming and Compilation Framework for Implementing Relational Graph Neural Networks in GPU Architectures
di: Wu, Kun, et al.
Pubblicazione: (2023)
di: Wu, Kun, et al.
Pubblicazione: (2023)
Federated Few-Shot Learning on Neuromorphic Hardware: An Empirical Study Across Physical Edge Nodes
di: Motta, Steven, et al.
Pubblicazione: (2026)
di: Motta, Steven, et al.
Pubblicazione: (2026)
Adaptive Domain Models: Bayesian Evolution, Warm Rotation, and Principled Training for Geometric and Neuromorphic AI
di: Haynes, Houston
Pubblicazione: (2026)
di: Haynes, Houston
Pubblicazione: (2026)
Cyclic Data Parallelism for Efficient Parallelism of Deep Neural Networks
di: Fournier, Louis, et al.
Pubblicazione: (2024)
di: Fournier, Louis, et al.
Pubblicazione: (2024)
ParEVO: Synthesizing Code for Irregular Data: High-Performance Parallelism through Agentic Evolution
di: Yang, Liu, et al.
Pubblicazione: (2026)
di: Yang, Liu, et al.
Pubblicazione: (2026)
OpenRASE: Service Function Chain Emulation
di: Krishnamohan, Theviyanthan, et al.
Pubblicazione: (2025)
di: Krishnamohan, Theviyanthan, et al.
Pubblicazione: (2025)
Towards a Decentralised Application-Centric Orchestration Framework in the Cloud-Edge Continuum
di: Ullah, Amjad, et al.
Pubblicazione: (2025)
di: Ullah, Amjad, et al.
Pubblicazione: (2025)
Edge Intelligence with Spiking Neural Networks
di: Deng, Shuiguang, et al.
Pubblicazione: (2025)
di: Deng, Shuiguang, et al.
Pubblicazione: (2025)
Scalable Construction of Spiking Neural Networks using up to thousands of GPUs
di: Golosio, Bruno, et al.
Pubblicazione: (2025)
di: Golosio, Bruno, et al.
Pubblicazione: (2025)
Hybrid Approach to Parallel Stochastic Gradient Descent
di: Vora, Aakash Sudhirbhai, et al.
Pubblicazione: (2024)
di: Vora, Aakash Sudhirbhai, et al.
Pubblicazione: (2024)
Split Federated Learning Over Heterogeneous Edge Devices: Algorithm and Optimization
di: Sun, Yunrui, et al.
Pubblicazione: (2024)
di: Sun, Yunrui, et al.
Pubblicazione: (2024)
Comparison of Microservice Call Rate Predictions for Replication in the Cloud
di: Mehran, Narges, et al.
Pubblicazione: (2023)
di: Mehran, Narges, et al.
Pubblicazione: (2023)
Linear Reservoir: A Diagonalization-Based Optimization
di: de Coudenhove, Romain, et al.
Pubblicazione: (2026)
di: de Coudenhove, Romain, et al.
Pubblicazione: (2026)
Online Continual Learning on Intel Loihi 2 via a Co-designed Spiking Neural Network
di: Hajizada, Elvin, et al.
Pubblicazione: (2025)
di: Hajizada, Elvin, et al.
Pubblicazione: (2025)
Documenti analoghi
-
SSDTrain: An Activation Offloading Framework to SSDs for Faster Large Language Model Training
di: Wu, Kun, et al.
Pubblicazione: (2024) -
A Fresh Approach to Evaluate Performance in Distributed Parallel Genetic Algorithms
di: Harada, Tomohiro, et al.
Pubblicazione: (2021) -
D-CODE: Data Colony Optimization for Dynamic Network Efficiency
di: Pandey, Tannu, et al.
Pubblicazione: (2024) -
A Frequency-based Parent Selection for Reducing the Effect of Evaluation Time Bias in Asynchronous Parallel Multi-objective Evolutionary Algorithms
di: Harada, Tomohiro
Pubblicazione: (2021) -
Code generation and runtime techniques for enabling data-efficient deep learning training on GPUs
di: Wu, Kun
Pubblicazione: (2024)