QForce-RL: Quantized FPGA-Optimized Reinforcement Learning Compute Engine
Fuente:
arXiv
Guardado en:
| Autores principales: | Jha, Anushka, Dewangan, Tanushree, Lokhande, Mukul, Vishvakarma, Santosh Kumar |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
CARMEN: CORDIC-Accelerated Resource-Efficient Multi-Precision Inference Engine for Deep Learning
por: Kumar, Sonu, et al.
Publicado: (2026)
por: Kumar, Sonu, et al.
Publicado: (2026)
XR-NPE: High-Throughput Mixed-precision SIMD Neural Processing Engine for Extended Reality Perception Workloads
por: Chaudhari, Tejas, et al.
Publicado: (2025)
por: Chaudhari, Tejas, et al.
Publicado: (2025)
L-SPINE: A Low-Precision SIMD Spiking Neural Compute Engine for Resource-efficient Edge Inference
por: Kumar, Sonu, et al.
Publicado: (2026)
por: Kumar, Sonu, et al.
Publicado: (2026)
CORDIC Is All You Need
por: Kokane, Omkar, et al.
Publicado: (2025)
por: Kokane, Omkar, et al.
Publicado: (2025)
POLARON: Precision-aware On-device Learning and Adaptive Runtime-cONfigurable AI acceleration
por: Lokhande, Mukul, et al.
Publicado: (2025)
por: Lokhande, Mukul, et al.
Publicado: (2025)
SPADE: A SIMD Posit-enabled compute engine for Accelerating DNN Efficiency
por: Kumar, Sonu, et al.
Publicado: (2026)
por: Kumar, Sonu, et al.
Publicado: (2026)
E-ReCON: An Energy- and Resource-Efficient Precision-Configurable Sparse nvCIM Macro for Conventional and Spiking Neural Edge Inference
por: Tenwar, Ankit Kumar, et al.
Publicado: (2026)
por: Tenwar, Ankit Kumar, et al.
Publicado: (2026)
CORVET: A CORDIC-Powered, Resource-Frugal Mixed-Precision Vector Processing Engine for High-Throughput AIoT applications
por: Kumar, Sonu, et al.
Publicado: (2026)
por: Kumar, Sonu, et al.
Publicado: (2026)
EULER-ADAS: Energy-Efficient & SIMD-Unified Logarithmic-Posit Engine for Precision-Reconfigurable Approximate ADAS Acceleration
por: Lokhande, Mukul, et al.
Publicado: (2026)
por: Lokhande, Mukul, et al.
Publicado: (2026)
HYDRA: Hybrid Data Multiplexing and Run-time Layer Configurable DNN Accelerator
por: Kumar, Sonu, et al.
Publicado: (2024)
por: Kumar, Sonu, et al.
Publicado: (2024)
Res-DPU: Resource-shared Digital Processing-in-memory Unit for Edge-AI Workloads
por: Lokhande, Mukul, et al.
Publicado: (2025)
por: Lokhande, Mukul, et al.
Publicado: (2025)
Flex-PE: Flexible and SIMD Multi-Precision Processing Element for AI Workloads
por: Lokhande, Mukul, et al.
Publicado: (2024)
por: Lokhande, Mukul, et al.
Publicado: (2024)
FERMI-ML: A Flexible and Resource-Efficient Memory-In-Situ SRAM Macro for TinyML acceleration
por: Lokhande, Mukul, et al.
Publicado: (2025)
por: Lokhande, Mukul, et al.
Publicado: (2025)
DHFP-PE: Dual-Precision Hybrid Floating Point Processing Element for AI Acceleration
por: Kumar, Shubham, et al.
Publicado: (2026)
por: Kumar, Shubham, et al.
Publicado: (2026)
TREA: Low-precision Time-Multiplexed, Resource-Efficient Edge Accelerator for Object Detection and Classification
por: Sharma, Vijay Pratap, et al.
Publicado: (2026)
por: Sharma, Vijay Pratap, et al.
Publicado: (2026)
Retrospective: A CORDIC Based Configurable Activation Function for NN Applications
por: Kokane, Omkar, et al.
Publicado: (2025)
por: Kokane, Omkar, et al.
Publicado: (2025)
Bhasha-Rupantarika: Algorithm-Hardware Co-design approach for Multilingual Neural Machine Translation
por: Lokhande, Mukul, et al.
Publicado: (2025)
por: Lokhande, Mukul, et al.
Publicado: (2025)
HOAA: Hybrid Overestimating Approximate Adder for Enhanced Performance Processing Engine
por: Kokane, Omkar, et al.
Publicado: (2024)
por: Kokane, Omkar, et al.
Publicado: (2024)
An Efficient Architecture and High-Throughput Implementation of CCSDS-123.0-B-2 Hybrid Entropy Coder Targeting Space-Grade SRAM FPGA Technology
por: Chatziantoniou, Panagiotis, et al.
Publicado: (2022)
por: Chatziantoniou, Panagiotis, et al.
Publicado: (2022)
An FPGA Implementation of Displacement Vector Search for Intra Pattern Copy in JPEG XS
por: Chen, Qiyue, et al.
Publicado: (2026)
por: Chen, Qiyue, et al.
Publicado: (2026)
FSL-HDnn: A 40 nm Few-shot On-Device Learning Accelerator with Integrated Feature Extraction and Hyperdimensional Computing
por: Xu, Weihong, et al.
Publicado: (2025)
por: Xu, Weihong, et al.
Publicado: (2025)
LiFT: Lightweight, FPGA-tailored 3D object detection based on LiDAR data
por: Lis, Konrad, et al.
Publicado: (2025)
por: Lis, Konrad, et al.
Publicado: (2025)
An Energy-Efficient RFET-Based Stochastic Computing Neural Network Accelerator
por: Lu, Sheng, et al.
Publicado: (2025)
por: Lu, Sheng, et al.
Publicado: (2025)
Leveraging Simultaneous Usage of Edge GPU Hardware Engines for Video Face Detection and Recognition
por: Baobaid, Asma, et al.
Publicado: (2025)
por: Baobaid, Asma, et al.
Publicado: (2025)
Bio-RV: Low-Power Resource-Efficient RISC-V Processor for Biomedical Applications
por: Sharma, Vijay Pratap, et al.
Publicado: (2026)
por: Sharma, Vijay Pratap, et al.
Publicado: (2026)
NVM-in-Cache: Repurposing Commodity 6T SRAM Cache into NVM Analog Processing-in-Memory Engine using a Novel Compute-on-Powerline Scheme
por: Chakraborty, Subhradip, et al.
Publicado: (2025)
por: Chakraborty, Subhradip, et al.
Publicado: (2025)
Analog or Digital In-memory Computing? Benchmarking through Quantitative Modeling
por: Sun, Jiacong, et al.
Publicado: (2024)
por: Sun, Jiacong, et al.
Publicado: (2024)
ReLANCE: A Resource-Efficient Low-Latency Cortical Neural Acceleration Engine
por: Kumar, Sonu, et al.
Publicado: (2025)
por: Kumar, Sonu, et al.
Publicado: (2025)
Sub-Millisecond Event-Based Eye Tracking on a Resource-Constrained Microcontroller
por: Giordano, Marco, et al.
Publicado: (2025)
por: Giordano, Marco, et al.
Publicado: (2025)
Pack my weights and run! Minimizing overheads for in-memory computing accelerators
por: Houshmand, Pouya, et al.
Publicado: (2024)
por: Houshmand, Pouya, et al.
Publicado: (2024)
FPCA: Field-Programmable Pixel Convolutional Array for Extreme-Edge Intelligence
por: Yin, Zihan, et al.
Publicado: (2024)
por: Yin, Zihan, et al.
Publicado: (2024)
Modeling the Energy Consumption of the HEVC Software Encoding Process using Processor events
por: Ramasubbu, Geetha, et al.
Publicado: (2024)
por: Ramasubbu, Geetha, et al.
Publicado: (2024)
Opto-Atomic Spatio-Temporal Holographic Correlators for High-Speed 3D CNNs
por: Shen, Xi, et al.
Publicado: (2026)
por: Shen, Xi, et al.
Publicado: (2026)
Technology-Circuit-Algorithm Tri-Design for Processing-in-Pixel-in-Memory (P2M)
por: Kaiser, Md Abdullah-Al, et al.
Publicado: (2023)
por: Kaiser, Md Abdullah-Al, et al.
Publicado: (2023)
Voltage-Controlled Magnetic Tunnel Junction based ADC-less Global Shutter Processing-in-Pixel for Extreme-Edge Intelligence
por: Kaiser, Md Abdullah-Al, et al.
Publicado: (2024)
por: Kaiser, Md Abdullah-Al, et al.
Publicado: (2024)
RAMAN: Resource-efficient ApproxiMate Posit Processing for Algorithm-Hardware Co-desigN
por: Khan, Mohd Faisal, et al.
Publicado: (2025)
por: Khan, Mohd Faisal, et al.
Publicado: (2025)
Optimization of DNN-based HSI Segmentation FPGA-based SoC for ADS: A Practical Approach
por: Gutiérrez-Zaballa, Jon, et al.
Publicado: (2025)
por: Gutiérrez-Zaballa, Jon, et al.
Publicado: (2025)
A 129FPS Full HD Real-Time Accelerator for 3D Gaussian Splatting
por: Chang, Fang-Chi, et al.
Publicado: (2026)
por: Chang, Fang-Chi, et al.
Publicado: (2026)
Evaluation of Hardware-based Video Encoders on Modern GPUs for UHD Live-Streaming
por: Arunruangsirilert, Kasidis, et al.
Publicado: (2025)
por: Arunruangsirilert, Kasidis, et al.
Publicado: (2025)
Evolution of NVENC Efficiency: A Longitudinal Analysis of HQ and UHQ Tuning Efficiency, Latency and Energy Trade-offs
por: Arunruangsirilert, Kasidis, et al.
Publicado: (2026)
por: Arunruangsirilert, Kasidis, et al.
Publicado: (2026)
Ejemplares similares
-
CARMEN: CORDIC-Accelerated Resource-Efficient Multi-Precision Inference Engine for Deep Learning
por: Kumar, Sonu, et al.
Publicado: (2026) -
XR-NPE: High-Throughput Mixed-precision SIMD Neural Processing Engine for Extended Reality Perception Workloads
por: Chaudhari, Tejas, et al.
Publicado: (2025) -
L-SPINE: A Low-Precision SIMD Spiking Neural Compute Engine for Resource-efficient Edge Inference
por: Kumar, Sonu, et al.
Publicado: (2026) -
CORDIC Is All You Need
por: Kokane, Omkar, et al.
Publicado: (2025) -
POLARON: Precision-aware On-device Learning and Adaptive Runtime-cONfigurable AI acceleration
por: Lokhande, Mukul, et al.
Publicado: (2025)