Dynamic Co-Optimization Compiler: Leveraging Multi-Agent Reinforcement Learning for Enhanced DNN Accelerator Performance
Fuente:
arXiv
Salvato in:
| Autori principali: | Fayyazi, Arya, Kamal, Mehdi, Pedram, Massoud |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
NeuroBlend: Towards Low-Power yet Accurate Neural Network-Based Inference Engine Blending Binary and Fixed-Point Convolutions
di: Fayyazi, Arash, et al.
Pubblicazione: (2023)
di: Fayyazi, Arash, et al.
Pubblicazione: (2023)
CHOSEN: Compilation to Hardware Optimization Stack for Efficient Vision Transformer Inference
di: Sadeghi, Mohammad Erfan, et al.
Pubblicazione: (2024)
di: Sadeghi, Mohammad Erfan, et al.
Pubblicazione: (2024)
TimingLLM: A Two-Stage Retrieval-Augmented Framework for Pre-Synthesis Timing Prediction from Verilog
di: Abdollahi, Armin, et al.
Pubblicazione: (2026)
di: Abdollahi, Armin, et al.
Pubblicazione: (2026)
MENAGE: Mixed-Signal Event-Driven Neuromorphic Accelerator for Edge Applications
di: Abdollahi, Armin, et al.
Pubblicazione: (2024)
di: Abdollahi, Armin, et al.
Pubblicazione: (2024)
Mirage: An RNS-Based Photonic Accelerator for DNN Training
di: Demirkiran, Cansu, et al.
Pubblicazione: (2023)
di: Demirkiran, Cansu, et al.
Pubblicazione: (2023)
AdAM: Adaptive Fault-Tolerant Approximate Multiplier for Edge DNN Accelerators
di: Taheri, Mahdi, et al.
Pubblicazione: (2024)
di: Taheri, Mahdi, et al.
Pubblicazione: (2024)
SAFFIRA: a Framework for Assessing the Reliability of Systolic-Array-Based DNN Accelerators
di: Taheri, Mahdi, et al.
Pubblicazione: (2024)
di: Taheri, Mahdi, et al.
Pubblicazione: (2024)
'1'-bit Count-based Sorting Unit to Reduce Link Power in DNN Accelerators
di: Han, Ruichi, et al.
Pubblicazione: (2026)
di: Han, Ruichi, et al.
Pubblicazione: (2026)
NeFT: Negative Feedback Training to Improve Robustness of Compute-In-Memory DNN Accelerators
di: Qin, Yifan, et al.
Pubblicazione: (2023)
di: Qin, Yifan, et al.
Pubblicazione: (2023)
IC-D2S: A Hybrid Ising-Classical-Machines Data-Driven QUBO Solver Method
di: Abdollahi, Armin, et al.
Pubblicazione: (2025)
di: Abdollahi, Armin, et al.
Pubblicazione: (2025)
FACTER: Fairness-Aware Conformal Thresholding and Prompt Engineering for Enabling Fair LLM-Based Recommender Systems
di: Fayyazi, Arya, et al.
Pubblicazione: (2025)
di: Fayyazi, Arya, et al.
Pubblicazione: (2025)
Explainable AI-Guided Efficient Approximate DNN Generation for Multi-Pod Systolic Arrays
di: Siddique, Ayesha, et al.
Pubblicazione: (2025)
di: Siddique, Ayesha, et al.
Pubblicazione: (2025)
CAFEEN: A Cooperative Approach for Energy Efficient NoCs with Multi-Agent Reinforcement Learning
di: Khan, Kamil, et al.
Pubblicazione: (2024)
di: Khan, Kamil, et al.
Pubblicazione: (2024)
Carbon-Efficient 3D DNN Acceleration: Optimizing Performance and Sustainability
di: Panteleaki, Aikaterini Maria, et al.
Pubblicazione: (2025)
di: Panteleaki, Aikaterini Maria, et al.
Pubblicazione: (2025)
MARCO: Hardware-Aware Neural Architecture Search for Edge Devices with Multi-Agent Reinforcement Learning and Conformal Prediction Filtering
di: Fayyazi, Arya, et al.
Pubblicazione: (2025)
di: Fayyazi, Arya, et al.
Pubblicazione: (2025)
HDLFORGE: A Two-Stage Multi-Agent Framework for Efficient Verilog Code Generation with Adaptive Model Escalation
di: Abdollahi, Armin, et al.
Pubblicazione: (2026)
di: Abdollahi, Armin, et al.
Pubblicazione: (2026)
ChipMATE: Multi-Agent Training via Reinforcement Learning for Enhanced RTL Generation
di: Yu, Zhongkai, et al.
Pubblicazione: (2026)
di: Yu, Zhongkai, et al.
Pubblicazione: (2026)
Automated Design and Optimization of Distributed Filtering Circuits via Reinforcement Learning
di: Gao, Peng, et al.
Pubblicazione: (2024)
di: Gao, Peng, et al.
Pubblicazione: (2024)
LEGO: Spatial Accelerator Generation and Optimization for Tensor Applications
di: Lin, Yujun, et al.
Pubblicazione: (2025)
di: Lin, Yujun, et al.
Pubblicazione: (2025)
Hardware/Software Co-Design of RISC-V Extensions for Accelerating Sparse DNNs on FPGAs
di: Sabih, Muhammad, et al.
Pubblicazione: (2025)
di: Sabih, Muhammad, et al.
Pubblicazione: (2025)
AccLLM: Accelerating Long-Context LLM Inference Via Algorithm-Hardware Co-Design
di: Liang, Yanbiao, et al.
Pubblicazione: (2025)
di: Liang, Yanbiao, et al.
Pubblicazione: (2025)
MAx-DNN: Multi-Level Arithmetic Approximation for Energy-Efficient DNN Hardware Accelerators
di: Leon, Vasileios, et al.
Pubblicazione: (2025)
di: Leon, Vasileios, et al.
Pubblicazione: (2025)
Neural Network Acceleration on MPSoC board: Integrating SLAC's SNL, Rogue Software and Auto-SNL
di: Rahali, Hamza Ezzaoui, et al.
Pubblicazione: (2025)
di: Rahali, Hamza Ezzaoui, et al.
Pubblicazione: (2025)
Enabling Physical AI at the Edge: Hardware-Accelerated Recovery of System Dynamics
di: Xu, Bin, et al.
Pubblicazione: (2025)
di: Xu, Bin, et al.
Pubblicazione: (2025)
GNNBuilder: An Automated Framework for Generic Graph Neural Network Accelerator Generation, Simulation, and Optimization
di: Abi-Karam, Stefan, et al.
Pubblicazione: (2023)
di: Abi-Karam, Stefan, et al.
Pubblicazione: (2023)
MC$^2$A: Enabling Algorithm-Hardware Co-Design for Efficient Markov Chain Monte Carlo Acceleration
di: Zhao, Shirui, et al.
Pubblicazione: (2025)
di: Zhao, Shirui, et al.
Pubblicazione: (2025)
eIQ Neutron: Redefining Edge-AI Inference with Integrated NPU and Compiler Innovations
di: Bamberg, Lennart, et al.
Pubblicazione: (2025)
di: Bamberg, Lennart, et al.
Pubblicazione: (2025)
AutoHLS: Learning to Accelerate Design Space Exploration for HLS Designs
di: Ahmed, Md Rubel, et al.
Pubblicazione: (2024)
di: Ahmed, Md Rubel, et al.
Pubblicazione: (2024)
Enabling Unstructured Sparse Acceleration on Structured Sparse Accelerators
di: Jeong, Geonhwa, et al.
Pubblicazione: (2024)
di: Jeong, Geonhwa, et al.
Pubblicazione: (2024)
Agent Factories for High Level Synthesis: How Far Can General-Purpose Coding Agents Go in Hardware Optimization?
di: Bhandwaldar, Abhishek, et al.
Pubblicazione: (2026)
di: Bhandwaldar, Abhishek, et al.
Pubblicazione: (2026)
Retrieval-Guided Reinforcement Learning for Boolean Circuit Minimization
di: Chowdhury, Animesh Basak, et al.
Pubblicazione: (2024)
di: Chowdhury, Animesh Basak, et al.
Pubblicazione: (2024)
QuArch: A Question-Answering Dataset for AI Agents in Computer Architecture
di: Prakash, Shvetank, et al.
Pubblicazione: (2025)
di: Prakash, Shvetank, et al.
Pubblicazione: (2025)
LUT-DLA: Lookup Table as Efficient Extreme Low-Bit Deep Learning Accelerator
di: Li, Guoyu, et al.
Pubblicazione: (2025)
di: Li, Guoyu, et al.
Pubblicazione: (2025)
AIRCHITECT v2: Learning the Hardware Accelerator Design Space through Unified Representations
di: Seo, Jamin, et al.
Pubblicazione: (2025)
di: Seo, Jamin, et al.
Pubblicazione: (2025)
ElasticAI: Creating and Deploying Energy-Efficient Deep Learning Accelerator for Pervasive Computing
di: Qian, Chao, et al.
Pubblicazione: (2024)
di: Qian, Chao, et al.
Pubblicazione: (2024)
FPGA Divide-and-Conquer Placement using Deep Reinforcement Learning
di: Wang, Shang, et al.
Pubblicazione: (2024)
di: Wang, Shang, et al.
Pubblicazione: (2024)
LLM-Enhanced Bayesian Optimization for Efficient Analog Layout Constraint Generation
di: Chen, Guojin, et al.
Pubblicazione: (2024)
di: Chen, Guojin, et al.
Pubblicazione: (2024)
SAIM: Scalable Analog Ising Machine for Solving Quadratic Binary Optimization Problems
di: Razmkhah, Sasan, et al.
Pubblicazione: (2024)
di: Razmkhah, Sasan, et al.
Pubblicazione: (2024)
SwiftRL: Towards Efficient Reinforcement Learning on Real Processing-In-Memory Systems
di: Gogineni, Kailash, et al.
Pubblicazione: (2024)
di: Gogineni, Kailash, et al.
Pubblicazione: (2024)
Leveraging Highly Approximated Multipliers in DNN Inference
di: Zervakis, Georgios, et al.
Pubblicazione: (2024)
di: Zervakis, Georgios, et al.
Pubblicazione: (2024)
Documenti analoghi
-
NeuroBlend: Towards Low-Power yet Accurate Neural Network-Based Inference Engine Blending Binary and Fixed-Point Convolutions
di: Fayyazi, Arash, et al.
Pubblicazione: (2023) -
CHOSEN: Compilation to Hardware Optimization Stack for Efficient Vision Transformer Inference
di: Sadeghi, Mohammad Erfan, et al.
Pubblicazione: (2024) -
TimingLLM: A Two-Stage Retrieval-Augmented Framework for Pre-Synthesis Timing Prediction from Verilog
di: Abdollahi, Armin, et al.
Pubblicazione: (2026) -
MENAGE: Mixed-Signal Event-Driven Neuromorphic Accelerator for Edge Applications
di: Abdollahi, Armin, et al.
Pubblicazione: (2024) -
Mirage: An RNS-Based Photonic Accelerator for DNN Training
di: Demirkiran, Cansu, et al.
Pubblicazione: (2023)