FPGA Divide-and-Conquer Placement using Deep Reinforcement Learning
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Wang, Shang, Mamillapalli, Deepak Ranganatha Sastry, Yang, Tianpei, Taylor, Matthew E. |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2024
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Continuous-Flow Data-Rate-Aware CNN Inference on FPGA
von: Habermann, Tobias, et al.
Veröffentlicht: (2026)
von: Habermann, Tobias, et al.
Veröffentlicht: (2026)
Chiplet Placement Order Exploration Based on Learning to Rank with Graph Representation
von: Deng, Zhihui, et al.
Veröffentlicht: (2024)
von: Deng, Zhihui, et al.
Veröffentlicht: (2024)
Chip Placement with Diffusion Models
von: Lee, Vint, et al.
Veröffentlicht: (2024)
von: Lee, Vint, et al.
Veröffentlicht: (2024)
The False Dawn: Reevaluating Google's Reinforcement Learning for Chip Macro Placement
von: Markov, Igor L.
Veröffentlicht: (2023)
von: Markov, Igor L.
Veröffentlicht: (2023)
TRINE: A Token-Aware, Runtime-Adaptive FPGA Inference Engine for Multimodal AI
von: Oh, Hyunwoo, et al.
Veröffentlicht: (2026)
von: Oh, Hyunwoo, et al.
Veröffentlicht: (2026)
FlowPlace: Flow Matching for Chip Placement
von: Xie, Peng, et al.
Veröffentlicht: (2026)
von: Xie, Peng, et al.
Veröffentlicht: (2026)
TransPlace: Transferable Circuit Global Placement via Graph Neural Network
von: Hou, Yunbo, et al.
Veröffentlicht: (2025)
von: Hou, Yunbo, et al.
Veröffentlicht: (2025)
PolyLUT-Add: FPGA-based LUT Inference with Wide Inputs
von: Lou, Binglei, et al.
Veröffentlicht: (2024)
von: Lou, Binglei, et al.
Veröffentlicht: (2024)
Fast, Scalable, Energy-Efficient Non-element-wise Matrix Multiplication on FPGA
von: Zhu, Xuqi, et al.
Veröffentlicht: (2024)
von: Zhu, Xuqi, et al.
Veröffentlicht: (2024)
fSEAD: a Composable FPGA-based Streaming Ensemble Anomaly Detection Library
von: Lou, Binglei, et al.
Veröffentlicht: (2024)
von: Lou, Binglei, et al.
Veröffentlicht: (2024)
LUT-DLA: Lookup Table as Efficient Extreme Low-Bit Deep Learning Accelerator
von: Li, Guoyu, et al.
Veröffentlicht: (2025)
von: Li, Guoyu, et al.
Veröffentlicht: (2025)
LUTMUL: Exceed Conventional FPGA Roofline Limit by LUT-based Efficient Multiplication for Neural Network Inference
von: Xie, Yanyue, et al.
Veröffentlicht: (2024)
von: Xie, Yanyue, et al.
Veröffentlicht: (2024)
rule4ml: An Open-Source Tool for Resource Utilization and Latency Estimation for ML Models on FPGA
von: Rahimifar, Mohammad Mehdi, et al.
Veröffentlicht: (2024)
von: Rahimifar, Mohammad Mehdi, et al.
Veröffentlicht: (2024)
Automated Design and Optimization of Distributed Filtering Circuits via Reinforcement Learning
von: Gao, Peng, et al.
Veröffentlicht: (2024)
von: Gao, Peng, et al.
Veröffentlicht: (2024)
Ascend HiFloat8 Format for Deep Learning
von: Luo, Yuanyong, et al.
Veröffentlicht: (2024)
von: Luo, Yuanyong, et al.
Veröffentlicht: (2024)
NSFlow: An End-to-End FPGA Framework with Scalable Dataflow Architecture for Neuro-Symbolic AI
von: Yang, Hanchen, et al.
Veröffentlicht: (2025)
von: Yang, Hanchen, et al.
Veröffentlicht: (2025)
Retrieval-Guided Reinforcement Learning for Boolean Circuit Minimization
von: Chowdhury, Animesh Basak, et al.
Veröffentlicht: (2024)
von: Chowdhury, Animesh Basak, et al.
Veröffentlicht: (2024)
Evaluating CUDA Tile for AI Workloads on Hopper and Blackwell GPUs
von: Yadav, Divakar Kumar, et al.
Veröffentlicht: (2026)
von: Yadav, Divakar Kumar, et al.
Veröffentlicht: (2026)
GATMesh: Clock Mesh Timing Analysis using Graph Neural Networks
von: Khan, Muhammad Hadir, et al.
Veröffentlicht: (2025)
von: Khan, Muhammad Hadir, et al.
Veröffentlicht: (2025)
SwiftRL: Towards Efficient Reinforcement Learning on Real Processing-In-Memory Systems
von: Gogineni, Kailash, et al.
Veröffentlicht: (2024)
von: Gogineni, Kailash, et al.
Veröffentlicht: (2024)
Deep Learning-Based Anomaly Detection in Spacecraft Telemetry on Edge Devices
von: Goetze, Christopher, et al.
Veröffentlicht: (2026)
von: Goetze, Christopher, et al.
Veröffentlicht: (2026)
CAFEEN: A Cooperative Approach for Energy Efficient NoCs with Multi-Agent Reinforcement Learning
von: Khan, Kamil, et al.
Veröffentlicht: (2024)
von: Khan, Kamil, et al.
Veröffentlicht: (2024)
Dynamic Co-Optimization Compiler: Leveraging Multi-Agent Reinforcement Learning for Enhanced DNN Accelerator Performance
von: Fayyazi, Arya, et al.
Veröffentlicht: (2024)
von: Fayyazi, Arya, et al.
Veröffentlicht: (2024)
InF-ATPG: Intelligent FFR-Driven ATPG with Advanced Circuit Representation Guided Reinforcement Learning
von: Sun, Bin, et al.
Veröffentlicht: (2025)
von: Sun, Bin, et al.
Veröffentlicht: (2025)
ElasticAI: Creating and Deploying Energy-Efficient Deep Learning Accelerator for Pervasive Computing
von: Qian, Chao, et al.
Veröffentlicht: (2024)
von: Qian, Chao, et al.
Veröffentlicht: (2024)
GraNNite: Enabling High-Performance Execution of Graph Neural Networks on Resource-Constrained Neural Processing Units
von: Das, Arghadip, et al.
Veröffentlicht: (2025)
von: Das, Arghadip, et al.
Veröffentlicht: (2025)
Accelerating LLM Inference with Flexible N:M Sparsity via A Fully Digital Compute-in-Memory Accelerator
von: Ramachandran, Akshat, et al.
Veröffentlicht: (2025)
von: Ramachandran, Akshat, et al.
Veröffentlicht: (2025)
ProTEA: Programmable Transformer Encoder Acceleration on FPGA
von: Kabir, Ehsan, et al.
Veröffentlicht: (2024)
von: Kabir, Ehsan, et al.
Veröffentlicht: (2024)
Non-Overlapping Placement of Macro Cells based on Reinforcement Learning in Chip Design
von: Yu, Tao, et al.
Veröffentlicht: (2024)
von: Yu, Tao, et al.
Veröffentlicht: (2024)
MonoSparse-CAM: Efficient Tree Model Processing via Monotonicity and Sparsity in CAMs
von: Molom-Ochir, Tergel, et al.
Veröffentlicht: (2024)
von: Molom-Ochir, Tergel, et al.
Veröffentlicht: (2024)
FINN-GL: Generalized Mixed-Precision Extensions for FPGA-Accelerated LSTMs
von: Khandelwal, Shashwat, et al.
Veröffentlicht: (2025)
von: Khandelwal, Shashwat, et al.
Veröffentlicht: (2025)
Skip the Benchmark: Generating System-Level High-Level Synthesis Data using Generative Machine Learning
von: Liao, Yuchao, et al.
Veröffentlicht: (2024)
von: Liao, Yuchao, et al.
Veröffentlicht: (2024)
Self-Attention to Operator Learning-based 3D-IC Thermal Simulation
von: Huang, Zhen, et al.
Veröffentlicht: (2025)
von: Huang, Zhen, et al.
Veröffentlicht: (2025)
Understanding the Potential of FPGA-Based Spatial Acceleration for Large Language Model Inference
von: Chen, Hongzheng, et al.
Veröffentlicht: (2023)
von: Chen, Hongzheng, et al.
Veröffentlicht: (2023)
Efficient Calibration for RRAM-based In-Memory Computing using DoRA
von: Dong, Weirong, et al.
Veröffentlicht: (2025)
von: Dong, Weirong, et al.
Veröffentlicht: (2025)
ChipMATE: Multi-Agent Training via Reinforcement Learning for Enhanced RTL Generation
von: Yu, Zhongkai, et al.
Veröffentlicht: (2026)
von: Yu, Zhongkai, et al.
Veröffentlicht: (2026)
Towards Cheaper Inference in Deep Networks with Lower Bit-Width Accumulators
von: Blumenfeld, Yaniv, et al.
Veröffentlicht: (2024)
von: Blumenfeld, Yaniv, et al.
Veröffentlicht: (2024)
RESQ: A Unified Framework for REliability- and Security Enhancement of Quantized Deep Neural Networks
von: Mohammadi, Ali Soltan, et al.
Veröffentlicht: (2026)
von: Mohammadi, Ali Soltan, et al.
Veröffentlicht: (2026)
AutoHLS: Learning to Accelerate Design Space Exploration for HLS Designs
von: Ahmed, Md Rubel, et al.
Veröffentlicht: (2024)
von: Ahmed, Md Rubel, et al.
Veröffentlicht: (2024)
Hierarchical Mixture of Experts: Generalizable Learning for High-Level Synthesis
von: Li, Weikai, et al.
Veröffentlicht: (2024)
von: Li, Weikai, et al.
Veröffentlicht: (2024)
Ähnliche Einträge
-
Continuous-Flow Data-Rate-Aware CNN Inference on FPGA
von: Habermann, Tobias, et al.
Veröffentlicht: (2026) -
Chiplet Placement Order Exploration Based on Learning to Rank with Graph Representation
von: Deng, Zhihui, et al.
Veröffentlicht: (2024) -
Chip Placement with Diffusion Models
von: Lee, Vint, et al.
Veröffentlicht: (2024) -
The False Dawn: Reevaluating Google's Reinforcement Learning for Chip Macro Placement
von: Markov, Igor L.
Veröffentlicht: (2023) -
TRINE: A Token-Aware, Runtime-Adaptive FPGA Inference Engine for Multimodal AI
von: Oh, Hyunwoo, et al.
Veröffentlicht: (2026)