Rapid-INR: Storage Efficient CPU-free DNN Training Using Implicit Neural Representation
Fuente:
arXiv
Guardado en:
| Autores principales: | Chen, Hanqiu, Yang, Hang, Fitzmeyer, Stephen, Hao, Cong |
|---|---|
| Formato: | Preprint |
| Publicado: |
2023
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
MVQ:Towards Efficient DNN Compression and Acceleration with Masked Vector Quantization
por: Li, Shuaiting, et al.
Publicado: (2024)
por: Li, Shuaiting, et al.
Publicado: (2024)
Lite VLA: Efficient Vision-Language-Action Control on CPU-Bound Edge Robots
por: Williams, Justin, et al.
Publicado: (2025)
por: Williams, Justin, et al.
Publicado: (2025)
SpNeRF: Memory Efficient Sparse Volumetric Neural Rendering Accelerator for Edge Devices
por: Zhang, Yipu, et al.
Publicado: (2025)
por: Zhang, Yipu, et al.
Publicado: (2025)
Gen-NeRF: Efficient and Generalizable Neural Radiance Fields via Algorithm-Hardware Co-Design
por: Fu, Yonggan, et al.
Publicado: (2023)
por: Fu, Yonggan, et al.
Publicado: (2023)
ForgeBench: A Machine Learning Benchmark Suite and Auto-Generation Framework for Next-Generation HLS Tools
por: Wanna, Andy, et al.
Publicado: (2025)
por: Wanna, Andy, et al.
Publicado: (2025)
Dedicated Inference Engine and Binary-Weight Neural Networks for Lightweight Instance Segmentation
por: Chen, Tse-Wei, et al.
Publicado: (2025)
por: Chen, Tse-Wei, et al.
Publicado: (2025)
Residual-INR: Communication Efficient On-Device Learning Using Implicit Neural Representation
por: Chen, Hanqiu, et al.
Publicado: (2024)
por: Chen, Hanqiu, et al.
Publicado: (2024)
LoRA-Edge: Tensor-Train-Assisted LoRA for Practical CNN Fine-Tuning on Edge Devices
por: Kwak, Hyunseok, et al.
Publicado: (2025)
por: Kwak, Hyunseok, et al.
Publicado: (2025)
Using GUI Agent for Electronic Design Automation
por: Li, Chunyi, et al.
Publicado: (2025)
por: Li, Chunyi, et al.
Publicado: (2025)
DPU or GPU for Accelerating Neural Networks Inference -- Why not both? Split CNN Inference
por: Oztas, Ali Emre, et al.
Publicado: (2026)
por: Oztas, Ali Emre, et al.
Publicado: (2026)
Efficient stereo matching on embedded GPUs with zero-means cross correlation
por: Chang, Qiong, et al.
Publicado: (2022)
por: Chang, Qiong, et al.
Publicado: (2022)
Vision Transformer Computation and Resilience for Dynamic Inference
por: Sreedhar, Kavya, et al.
Publicado: (2022)
por: Sreedhar, Kavya, et al.
Publicado: (2022)
NeuralFuse: Learning to Recover the Accuracy of Access-Limited Neural Network Inference in Low-Voltage Regimes
por: Sun, Hao-Lun, et al.
Publicado: (2023)
por: Sun, Hao-Lun, et al.
Publicado: (2023)
SPADE: A SIMD Posit-enabled compute engine for Accelerating DNN Efficiency
por: Kumar, Sonu, et al.
Publicado: (2026)
por: Kumar, Sonu, et al.
Publicado: (2026)
Real-Time Semantic Segmentation of Aerial Images Using an Embedded U-Net: A Comparison of CPU, GPU, and FPGA Workflows
por: Posso, Julien, et al.
Publicado: (2025)
por: Posso, Julien, et al.
Publicado: (2025)
CAMO: Correlation-Aware Mask Optimization with Modulated Reinforcement Learning
por: Liang, Xiaoxiao, et al.
Publicado: (2024)
por: Liang, Xiaoxiao, et al.
Publicado: (2024)
TIMERIPPLE: Accelerating vDiTs by Understanding the Spatio-Temporal Correlations in Latent Space
por: Miao, Wenxuan, et al.
Publicado: (2025)
por: Miao, Wenxuan, et al.
Publicado: (2025)
GRTX: Efficient Ray Tracing for 3D Gaussian-Based Rendering
por: Lee, Junseo, et al.
Publicado: (2026)
por: Lee, Junseo, et al.
Publicado: (2026)
Uni-Render: A Unified Accelerator for Real-Time Rendering Across Diverse Neural Renderers
por: Li, Chaojian, et al.
Publicado: (2025)
por: Li, Chaojian, et al.
Publicado: (2025)
Real-Time Spacecraft Pose Estimation Using Mixed-Precision Quantized Neural Network on COTS Reconfigurable MPSoC
por: Posso, Julien, et al.
Publicado: (2024)
por: Posso, Julien, et al.
Publicado: (2024)
AppSign: Multi-level Approximate Computing for Real-Time Traffic Sign Recognition in Autonomous Vehicles
por: Omidian, Fatemeh, et al.
Publicado: (2024)
por: Omidian, Fatemeh, et al.
Publicado: (2024)
Evolving Layer-Specific Scalar Functions for Hardware-Aware Transformer Adaptation
por: Carrigg, Kieran, et al.
Publicado: (2026)
por: Carrigg, Kieran, et al.
Publicado: (2026)
Co-designing a Sub-millisecond Latency Event-based Eye Tracking System with Submanifold Sparse CNN
por: Zhang, Baoheng, et al.
Publicado: (2024)
por: Zhang, Baoheng, et al.
Publicado: (2024)
ORBIS: Output-Guided Token Reduction with Distribution-Aware Matching for Video Diffusion Acceleration
por: Lee, Hangyeol, et al.
Publicado: (2026)
por: Lee, Hangyeol, et al.
Publicado: (2026)
Primitive-Driven Acceleration of Hyperdimensional Computing for Real-Time Image Classification
por: Parikh, Dhruv, et al.
Publicado: (2026)
por: Parikh, Dhruv, et al.
Publicado: (2026)
Vision Transformers on the Edge: A Comprehensive Survey of Model Compression and Acceleration Strategies
por: Saha, Shaibal, et al.
Publicado: (2025)
por: Saha, Shaibal, et al.
Publicado: (2025)
Identifying Unnecessary 3D Gaussians using Clustering for Fast Rendering of 3D Gaussian Splatting
por: Jo, Joongho, et al.
Publicado: (2024)
por: Jo, Joongho, et al.
Publicado: (2024)
Real-Time Object Detection and Classification using YOLO for Edge FPGAs
por: Amin, Rashed Al, et al.
Publicado: (2025)
por: Amin, Rashed Al, et al.
Publicado: (2025)
SteROI-D: System Design and Mapping for Stereo Depth Inference on Regions of Interest
por: Erhardt, Jack, et al.
Publicado: (2025)
por: Erhardt, Jack, et al.
Publicado: (2025)
FG-Attn: Leveraging Fine-Grained Sparsity In Diffusion Transformers
por: Durvasula, Sankeerth, et al.
Publicado: (2025)
por: Durvasula, Sankeerth, et al.
Publicado: (2025)
GS-TG: 3D Gaussian Splatting Accelerator with Tile Grouping for Reducing Redundant Sorting while Preserving Rasterization Efficiency
por: Jo, Joongho, et al.
Publicado: (2025)
por: Jo, Joongho, et al.
Publicado: (2025)
Neo: Real-Time On-Device 3D Gaussian Splatting with Reuse-and-Update Sorting Acceleration
por: Oh, Changhun, et al.
Publicado: (2025)
por: Oh, Changhun, et al.
Publicado: (2025)
A Parameterizable Convolution Accelerator for Embedded Deep Learning Applications
por: Mousouliotis, Panagiotis, et al.
Publicado: (2026)
por: Mousouliotis, Panagiotis, et al.
Publicado: (2026)
BILLNET: A Binarized Conv3D-LSTM Network with Logic-gated residual architecture for hardware-efficient video inference
por: Nguyen, Van Thien, et al.
Publicado: (2025)
por: Nguyen, Van Thien, et al.
Publicado: (2025)
SF-MMCN: Low-Power Sever Flow Multi-Mode Diffusion Model Accelerator
por: Hsu, Huan-Ke, et al.
Publicado: (2024)
por: Hsu, Huan-Ke, et al.
Publicado: (2024)
hARMS: A Hardware Acceleration Architecture for Real-Time Event-Based Optical Flow
por: Stumpp, Daniel C., et al.
Publicado: (2021)
por: Stumpp, Daniel C., et al.
Publicado: (2021)
On-Orbit Real-Time Wildfire Detection Under On-Board Constraints
por: Rötzer, Matthias, et al.
Publicado: (2026)
por: Rötzer, Matthias, et al.
Publicado: (2026)
Accelerating AI and Computer Vision for Satellite Pose Estimation on the Intel Myriad X Embedded SoC
por: Leon, Vasileios, et al.
Publicado: (2024)
por: Leon, Vasileios, et al.
Publicado: (2024)
DPD-NeuralEngine: A 22-nm 6.6-TOPS/W/mm$^2$ Recurrent Neural Network Accelerator for Wideband Power Amplifier Digital Pre-Distortion
por: Li, Ang, et al.
Publicado: (2024)
por: Li, Ang, et al.
Publicado: (2024)
CDM-QTA: Quantized Training Acceleration for Efficient LoRA Fine-Tuning of Diffusion Model
por: Lu, Jinming, et al.
Publicado: (2025)
por: Lu, Jinming, et al.
Publicado: (2025)
Ejemplares similares
-
MVQ:Towards Efficient DNN Compression and Acceleration with Masked Vector Quantization
por: Li, Shuaiting, et al.
Publicado: (2024) -
Lite VLA: Efficient Vision-Language-Action Control on CPU-Bound Edge Robots
por: Williams, Justin, et al.
Publicado: (2025) -
SpNeRF: Memory Efficient Sparse Volumetric Neural Rendering Accelerator for Edge Devices
por: Zhang, Yipu, et al.
Publicado: (2025) -
Gen-NeRF: Efficient and Generalizable Neural Radiance Fields via Algorithm-Hardware Co-Design
por: Fu, Yonggan, et al.
Publicado: (2023) -
ForgeBench: A Machine Learning Benchmark Suite and Auto-Generation Framework for Next-Generation HLS Tools
por: Wanna, Andy, et al.
Publicado: (2025)