Memory-Efficient FPGA Implementation of Stochastic Simulated Annealing
Fuente:
arXiv
Salvato in:
| Autori principali: | Shin, Duckgyu, Onizawa, Naoya, Gross, Warren J., Hanyu, Takahiro |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Energy-Efficient p-Bit-Based Fully-Connected Quantum-Inspired Simulated Annealer with Dual BRAM Architecture
di: Onizawa, Naoya, et al.
Pubblicazione: (2026)
di: Onizawa, Naoya, et al.
Pubblicazione: (2026)
Efficient CMOS Invertible Logic Using Stochastic Computing
di: Smithson, Sean C., et al.
Pubblicazione: (2026)
di: Smithson, Sean C., et al.
Pubblicazione: (2026)
Analog-to-Stochastic Converter Using Magnetic Tunnel Junction Devices for Vision Chips
di: Onizawa, Naoya, et al.
Pubblicazione: (2026)
di: Onizawa, Naoya, et al.
Pubblicazione: (2026)
Efficient FPGA Implementation of Time-Domain Popcount for Low-Complexity Machine Learning
di: Duan, Shengyu, et al.
Pubblicazione: (2025)
di: Duan, Shengyu, et al.
Pubblicazione: (2025)
A Cost-Efficient FPGA Implementation of Tiny Transformer Model using Neural ODE
di: Okubo, Ikumi, et al.
Pubblicazione: (2024)
di: Okubo, Ikumi, et al.
Pubblicazione: (2024)
Stochastic Simulated Quantum Annealing for Fast Solution of Combinatorial Optimization Problems
di: Onizawa, Naoya, et al.
Pubblicazione: (2023)
di: Onizawa, Naoya, et al.
Pubblicazione: (2023)
A Persistent-State Dataflow Accelerator for Memory-Bound Linear Attention Decode on FPGA
di: Gupta, Neelesh, et al.
Pubblicazione: (2026)
di: Gupta, Neelesh, et al.
Pubblicazione: (2026)
An FPGA-Based Reconfigurable Accelerator for Convolution-Transformer Hybrid EfficientViT
di: Shao, Haikuo, et al.
Pubblicazione: (2024)
di: Shao, Haikuo, et al.
Pubblicazione: (2024)
Ultra Memory-Efficient On-FPGA Training of Transformers via Tensor-Compressed Optimization
di: Tian, Jiayi, et al.
Pubblicazione: (2025)
di: Tian, Jiayi, et al.
Pubblicazione: (2025)
An FPGA-Based Accelerator Enabling Efficient Support for CNNs with Arbitrary Kernel Sizes
di: Wang, Miaoxin, et al.
Pubblicazione: (2024)
di: Wang, Miaoxin, et al.
Pubblicazione: (2024)
FPGA Co-Design for Efficient N:M Sparse and Quantized Model Inference
di: Hsieh, Fen-Yu, et al.
Pubblicazione: (2025)
di: Hsieh, Fen-Yu, et al.
Pubblicazione: (2025)
Exploring FPGA designs for MX and beyond
di: Samson, Ebby, et al.
Pubblicazione: (2024)
di: Samson, Ebby, et al.
Pubblicazione: (2024)
Exploiting temporal parallelism for LSTM Autoencoder acceleration on FPGA
di: Leftheriotis, Aimilios, et al.
Pubblicazione: (2026)
di: Leftheriotis, Aimilios, et al.
Pubblicazione: (2026)
Fast Solving Complete 2000-Node Optimization Using Stochastic-Computing Simulated Annealing
di: Katsuki, Kota, et al.
Pubblicazione: (2026)
di: Katsuki, Kota, et al.
Pubblicazione: (2026)
CBM-Dual: A 65-nm Fully Connected Chaotic Boltzmann Machine Processor for Dual Function Simulated Annealing and Reservoir Computing
di: Yoshioka, Kanta, et al.
Pubblicazione: (2026)
di: Yoshioka, Kanta, et al.
Pubblicazione: (2026)
Design Environment of Quantization-Aware Edge AI Hardware for Few-Shot Learning
di: Kanda, R., et al.
Pubblicazione: (2026)
di: Kanda, R., et al.
Pubblicazione: (2026)
An FPGA-Based SoC Architecture with a RISC-V Controller for Energy-Efficient Temporal-Coding Spiking Neural Networks
di: Sekonji, Mohammad Javad, et al.
Pubblicazione: (2026)
di: Sekonji, Mohammad Javad, et al.
Pubblicazione: (2026)
Hardware-Aware Neural Dropout Search for Reliable Uncertainty Prediction on FPGA
di: Zhang, Zehuan, et al.
Pubblicazione: (2024)
di: Zhang, Zehuan, et al.
Pubblicazione: (2024)
Efficient In-Memory Acceleration of Sparse Block Diagonal LLMs
di: de Lima, João Paulo Cardoso, et al.
Pubblicazione: (2025)
di: de Lima, João Paulo Cardoso, et al.
Pubblicazione: (2025)
EPIM: Efficient Processing-In-Memory Accelerators based on Epitome
di: Wang, Chenyu, et al.
Pubblicazione: (2023)
di: Wang, Chenyu, et al.
Pubblicazione: (2023)
FPGA-Enabled Machine Learning Applications in Earth Observation: A Systematic Review
di: Léonard, Cédric, et al.
Pubblicazione: (2025)
di: Léonard, Cédric, et al.
Pubblicazione: (2025)
InstantFT: An FPGA-Based Runtime Subsecond Fine-tuning of CNN Models
di: Sugiura, Keisuke, et al.
Pubblicazione: (2025)
di: Sugiura, Keisuke, et al.
Pubblicazione: (2025)
Effective and Memory-Efficient Alternatives to ECC for Reliable Large-Scale DNNs
di: Ahmadilivani, Mohammad Hasan, et al.
Pubblicazione: (2026)
di: Ahmadilivani, Mohammad Hasan, et al.
Pubblicazione: (2026)
PEFSL: A deployment Pipeline for Embedded Few-Shot Learning on a FPGA SoC
di: Ribeiro, Lucas Grativol, et al.
Pubblicazione: (2024)
di: Ribeiro, Lucas Grativol, et al.
Pubblicazione: (2024)
PolyLUT: Learning Piecewise Polynomials for Ultra-Low Latency FPGA LUT-based Inference
di: Andronic, Marta, et al.
Pubblicazione: (2023)
di: Andronic, Marta, et al.
Pubblicazione: (2023)
Energy-Aware FPGA Implementation of Spiking Neural Network with LIF Neurons
di: Ali, Asmer Hamid, et al.
Pubblicazione: (2024)
di: Ali, Asmer Hamid, et al.
Pubblicazione: (2024)
Token-Picker: Accelerating Attention in Text Generation with Minimized Memory Transfer via Probability Estimation
di: Park, Junyoung, et al.
Pubblicazione: (2024)
di: Park, Junyoung, et al.
Pubblicazione: (2024)
DS-CIM: Digital Stochastic Computing-In-Memory Featuring Accurate OR-Accumulation via Sample Region Remapping for Edge AI Models
di: Shao, Kunming, et al.
Pubblicazione: (2026)
di: Shao, Kunming, et al.
Pubblicazione: (2026)
Evaluating Four FPGA-accelerated Space Use Cases based on Neural Network Algorithms for On-board Inference
di: Antunes, Pedro, et al.
Pubblicazione: (2026)
di: Antunes, Pedro, et al.
Pubblicazione: (2026)
Efficient Implementation of LinearUCB through Algorithmic Improvements and Vector Computing Acceleration for Embedded Learning Systems
di: Angioli, Marco, et al.
Pubblicazione: (2025)
di: Angioli, Marco, et al.
Pubblicazione: (2025)
Fast, Scalable, Energy-Efficient Non-element-wise Matrix Multiplication on FPGA
di: Zhu, Xuqi, et al.
Pubblicazione: (2024)
di: Zhu, Xuqi, et al.
Pubblicazione: (2024)
SHIELD: A Segmented Hierarchical Memory Architecture for Energy-Efficient LLM Inference on Edge NPUs
di: Zhang, Jintao, et al.
Pubblicazione: (2026)
di: Zhang, Jintao, et al.
Pubblicazione: (2026)
Bit-Width-Aware Design Environment for Few-Shot Learning on Edge AI Hardware
di: Kanda, R., et al.
Pubblicazione: (2026)
di: Kanda, R., et al.
Pubblicazione: (2026)
The Feasibility of Implementing Large-Scale Transformers on Multi-FPGA Platforms
di: Gao, Yu, et al.
Pubblicazione: (2024)
di: Gao, Yu, et al.
Pubblicazione: (2024)
Enhanced Convergence in p-bit Based Simulated Annealing with Partial Deactivation for Large-Scale Combinatorial Optimization Problems
di: Onizawa, Naoya, et al.
Pubblicazione: (2026)
di: Onizawa, Naoya, et al.
Pubblicazione: (2026)
LUTMUL: Exceed Conventional FPGA Roofline Limit by LUT-based Efficient Multiplication for Neural Network Inference
di: Xie, Yanyue, et al.
Pubblicazione: (2024)
di: Xie, Yanyue, et al.
Pubblicazione: (2024)
Autoformalizing Memory Specifications with Agents
di: Ernst, Jan Ole, et al.
Pubblicazione: (2026)
di: Ernst, Jan Ole, et al.
Pubblicazione: (2026)
Memory Is All You Need: An Overview of Compute-in-Memory Architectures for Accelerating Large Language Model Inference
di: Wolters, Christopher, et al.
Pubblicazione: (2024)
di: Wolters, Christopher, et al.
Pubblicazione: (2024)
Leveraging Stochastic Depth Training for Adaptive Inference
di: Korol, Guilherme, et al.
Pubblicazione: (2025)
di: Korol, Guilherme, et al.
Pubblicazione: (2025)
Kernel Approximation using Analog In-Memory Computing
di: Büchel, Julian, et al.
Pubblicazione: (2024)
di: Büchel, Julian, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Energy-Efficient p-Bit-Based Fully-Connected Quantum-Inspired Simulated Annealer with Dual BRAM Architecture
di: Onizawa, Naoya, et al.
Pubblicazione: (2026) -
Efficient CMOS Invertible Logic Using Stochastic Computing
di: Smithson, Sean C., et al.
Pubblicazione: (2026) -
Analog-to-Stochastic Converter Using Magnetic Tunnel Junction Devices for Vision Chips
di: Onizawa, Naoya, et al.
Pubblicazione: (2026) -
Efficient FPGA Implementation of Time-Domain Popcount for Low-Complexity Machine Learning
di: Duan, Shengyu, et al.
Pubblicazione: (2025) -
A Cost-Efficient FPGA Implementation of Tiny Transformer Model using Neural ODE
di: Okubo, Ikumi, et al.
Pubblicazione: (2024)