In-Storage Domain-Specific Acceleration for Serverless Computing
Fuente:
arXiv
Salvato in:
| Autori principali: | Mahapatra, Rohan, Ghodrati, Soroush, Ahn, Byung Hoon, Kinzer, Sean, Wang, Shu-ting, Xu, Hanyang, Karthikeyan, Lavanya, Sharma, Hardik, Yazdanbakhsh, Amir, Alian, Mohammad, Esmaeilzadeh, Hadi |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2023
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Performance Analysis of DNN Inference/Training with Convolution and non-Convolution Operations
di: Esmaeilzadeh, Hadi, et al.
Pubblicazione: (2023)
di: Esmaeilzadeh, Hadi, et al.
Pubblicazione: (2023)
Beyond Moore's Law: Harnessing the Redshift of Generative AI with Effective Hardware-Software Co-Design
di: Yazdanbakhsh, Amir
Pubblicazione: (2025)
di: Yazdanbakhsh, Amir
Pubblicazione: (2025)
DaCapo: Accelerating Continuous Learning in Autonomous Systems for Video Analytics
di: Kim, Yoonsung, et al.
Pubblicazione: (2024)
di: Kim, Yoonsung, et al.
Pubblicazione: (2024)
Tao: Re-Thinking DL-based Microarchitecture Simulation
di: Pandey, Santosh, et al.
Pubblicazione: (2024)
di: Pandey, Santosh, et al.
Pubblicazione: (2024)
gem5 Co-Pilot: AI Assistant Agent for Architectural Design Space Exploration
di: Fu, Zuoming, et al.
Pubblicazione: (2025)
di: Fu, Zuoming, et al.
Pubblicazione: (2025)
Per-Bank Bandwidth Regulation of Shared Last-Level Cache for Real-Time Systems
di: Sullivan, Connor, et al.
Pubblicazione: (2024)
di: Sullivan, Connor, et al.
Pubblicazione: (2024)
Neo: Real-Time On-Device 3D Gaussian Splatting with Reuse-and-Update Sorting Acceleration
di: Oh, Changhun, et al.
Pubblicazione: (2025)
di: Oh, Changhun, et al.
Pubblicazione: (2025)
A Review on Proprietary Accelerators for Large Language Models
di: Park, Sihyeong, et al.
Pubblicazione: (2025)
di: Park, Sihyeong, et al.
Pubblicazione: (2025)
SDT: Cutting Datacenter Tax Through Simultaneous Data-Delivery Threads
di: Mamandipoor, Amin, et al.
Pubblicazione: (2025)
di: Mamandipoor, Amin, et al.
Pubblicazione: (2025)
Progressive Gradient Flow for Robust N:M Sparsity Training in Transformers
di: Bambhaniya, Abhimanyu Rajeshkumar, et al.
Pubblicazione: (2024)
di: Bambhaniya, Abhimanyu Rajeshkumar, et al.
Pubblicazione: (2024)
An ECC-based Fault Tolerance Approach for DNNs
di: Raji, Mohsen, et al.
Pubblicazione: (2025)
di: Raji, Mohsen, et al.
Pubblicazione: (2025)
SAHM: State-Aware Heterogeneous Multicore for Single-Thread Performance
di: Wadle, Shayne, et al.
Pubblicazione: (2025)
di: Wadle, Shayne, et al.
Pubblicazione: (2025)
Graphitron: A Domain Specific Language for FPGA-based Graph Processing Accelerator Generation
di: Zhang, Xinmiao, et al.
Pubblicazione: (2024)
di: Zhang, Xinmiao, et al.
Pubblicazione: (2024)
Theoretical Analysis of the Efficient-Memory Matrix Storage Method for Quantum Emulation Accelerators with Gate Fusion on FPGAs
di: Le, Tran Xuan Hieu, et al.
Pubblicazione: (2024)
di: Le, Tran Xuan Hieu, et al.
Pubblicazione: (2024)
Leveraging Application-Specific Knowledge for Energy-Efficient Deep Learning Accelerators on Resource-Constrained FPGAs
di: Qian, Chao
Pubblicazione: (2025)
di: Qian, Chao
Pubblicazione: (2025)
Tangram: Accelerating Serverless LLM Loading through GPU Memory Reuse and Affinity
di: Zhu, Wenbin, et al.
Pubblicazione: (2025)
di: Zhu, Wenbin, et al.
Pubblicazione: (2025)
Hardware-Software Co-Design for Accelerating Transformer Inference Leveraging Compute-in-Memory
di: Kim, Dong Eun, et al.
Pubblicazione: (2025)
di: Kim, Dong Eun, et al.
Pubblicazione: (2025)
SCRec: A Scalable Computational Storage System with Statistical Sharding and Tensor-train Decomposition for Recommendation Models
di: Yang, Jinho, et al.
Pubblicazione: (2025)
di: Yang, Jinho, et al.
Pubblicazione: (2025)
CIM-Tuner: Balancing the Compute and Storage Capacity of SRAM-CIM Accelerator via Hardware-mapping Co-exploration
di: Chen, Jinwu, et al.
Pubblicazione: (2026)
di: Chen, Jinwu, et al.
Pubblicazione: (2026)
Mozart: A Chiplet Ecosystem-Accelerator Codesign Framework for Composable Bespoke Application Specific Integrated Circuits
di: Jin, Haoran, et al.
Pubblicazione: (2025)
di: Jin, Haoran, et al.
Pubblicazione: (2025)
CRYPTONITE: Scalable Accelerator Design for Cryptographic Primitives and Algorithms
di: Maheswaran, Karthikeya Sharma, et al.
Pubblicazione: (2025)
di: Maheswaran, Karthikeya Sharma, et al.
Pubblicazione: (2025)
MARS: Processing-In-Memory Acceleration of Raw Signal Genome Analysis Inside the Storage Subsystem
di: Soysal, Melina, et al.
Pubblicazione: (2025)
di: Soysal, Melina, et al.
Pubblicazione: (2025)
LIMINAL: Exploring The Frontiers of LLM Decode Performance
di: Davies, Michael, et al.
Pubblicazione: (2025)
di: Davies, Michael, et al.
Pubblicazione: (2025)
Partially-Precise Computing Paradigm for Efficient Hardware Implementation of Application-Specific Embedded Systems
di: Faryabi, Mohsen, et al.
Pubblicazione: (2024)
di: Faryabi, Mohsen, et al.
Pubblicazione: (2024)
AI Accelerators for Large Language Model Inference: Architecture Analysis and Scaling Strategies
di: Sharma, Amit
Pubblicazione: (2025)
di: Sharma, Amit
Pubblicazione: (2025)
Computer Architecture's AlphaZero Moment: Automated Discovery in an Encircled World
di: Sankaralingam, Karthikeyan
Pubblicazione: (2026)
di: Sankaralingam, Karthikeyan
Pubblicazione: (2026)
SILVIA: Automated Superword-Level Parallelism Exploitation via HLS-Specific LLVM Passes for Compute-Intensive FPGA Accelerators
di: Brignone, Giovanni, et al.
Pubblicazione: (2024)
di: Brignone, Giovanni, et al.
Pubblicazione: (2024)
HyperCroc: End-to-End Open-Source RISC-V MCU with a Plug-In Interface for Domain-Specific Accelerators
di: Sauter, Philippe, et al.
Pubblicazione: (2026)
di: Sauter, Philippe, et al.
Pubblicazione: (2026)
HCiM: ADC-Less Hybrid Analog-Digital Compute in Memory Accelerator for Deep Learning Workloads
di: Negi, Shubham, et al.
Pubblicazione: (2024)
di: Negi, Shubham, et al.
Pubblicazione: (2024)
Analysis of a Memcapacitor-Based for Neural Network Accelerator Framework
di: Singh, Ankur, et al.
Pubblicazione: (2025)
di: Singh, Ankur, et al.
Pubblicazione: (2025)
Pedagogically Motivated and Composable Open-Source RISC-V Processors for Computer Science Education
di: McDougall, Ian, et al.
Pubblicazione: (2025)
di: McDougall, Ian, et al.
Pubblicazione: (2025)
A Host-SSD Collaborative Write Accelerator for LSM-Tree-Based Key-Value Stores
di: Kim, KiHwan, et al.
Pubblicazione: (2024)
di: Kim, KiHwan, et al.
Pubblicazione: (2024)
CiFHER: A Chiplet-Based FHE Accelerator with a Resizable Structure
di: Kim, Sangpyo, et al.
Pubblicazione: (2023)
di: Kim, Sangpyo, et al.
Pubblicazione: (2023)
ASIC-based Compression Accelerators for Storage Systems: Design, Placement, and Profiling Insights
di: Lu, Tao, et al.
Pubblicazione: (2025)
di: Lu, Tao, et al.
Pubblicazione: (2025)
A 46 Gbps 12 pJ/b Sparsity-Adaptive Beamspace Equalizer for mmWave Massive MIMO in 22FDX
di: Mirfarshbafan, Seyed Hadi, et al.
Pubblicazione: (2024)
di: Mirfarshbafan, Seyed Hadi, et al.
Pubblicazione: (2024)
AxLLM: accelerator architecture for large language models with computation reuse capability
di: Ahadi, Soroush, et al.
Pubblicazione: (2025)
di: Ahadi, Soroush, et al.
Pubblicazione: (2025)
Privacy-Preserving Performance Profiling of In-The-Wild GPUs
di: McDougall, Ian, et al.
Pubblicazione: (2025)
di: McDougall, Ian, et al.
Pubblicazione: (2025)
Theodosian: A Deep Dive into Memory-Hierarchy-Centric FHE Acceleration
di: Choi, Wonseok, et al.
Pubblicazione: (2025)
di: Choi, Wonseok, et al.
Pubblicazione: (2025)
IVE: An Accelerator for Single-Server Private Information Retrieval Using Versatile Processing Elements
di: Kim, Sangpyo, et al.
Pubblicazione: (2025)
di: Kim, Sangpyo, et al.
Pubblicazione: (2025)
SPADE: A SIMD Posit-enabled compute engine for Accelerating DNN Efficiency
di: Kumar, Sonu, et al.
Pubblicazione: (2026)
di: Kumar, Sonu, et al.
Pubblicazione: (2026)
Documenti analoghi
-
Performance Analysis of DNN Inference/Training with Convolution and non-Convolution Operations
di: Esmaeilzadeh, Hadi, et al.
Pubblicazione: (2023) -
Beyond Moore's Law: Harnessing the Redshift of Generative AI with Effective Hardware-Software Co-Design
di: Yazdanbakhsh, Amir
Pubblicazione: (2025) -
DaCapo: Accelerating Continuous Learning in Autonomous Systems for Video Analytics
di: Kim, Yoonsung, et al.
Pubblicazione: (2024) -
Tao: Re-Thinking DL-based Microarchitecture Simulation
di: Pandey, Santosh, et al.
Pubblicazione: (2024) -
gem5 Co-Pilot: AI Assistant Agent for Architectural Design Space Exploration
di: Fu, Zuoming, et al.
Pubblicazione: (2025)