Silicon Photonic 2.5D Interposer Networks for Overcoming Communication Bottlenecks in Scale-out Machine Learning Hardware Accelerators
Fuente:
arXiv
Salvato in:
| Autori principali: | Sunny, Febin, Taheri, Ebadollah, Nikdast, Mahdi, Pasricha, Sudeep |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Accelerating Neural Networks for Large Language Models and Graph Processing with Silicon Photonics
di: Afifi, Salma, et al.
Pubblicazione: (2024)
di: Afifi, Salma, et al.
Pubblicazione: (2024)
OPIMA: Optical Processing-In-Memory for Convolutional Neural Network Acceleration
di: Sunny, Febin, et al.
Pubblicazione: (2024)
di: Sunny, Febin, et al.
Pubblicazione: (2024)
PhotoGAN: Generative Adversarial Neural Network Acceleration with Silicon Photonics
di: Suresh, Tharini, et al.
Pubblicazione: (2025)
di: Suresh, Tharini, et al.
Pubblicazione: (2025)
Accelerating Diffusion Models for Generative AI Applications with Silicon Photonics
di: Suresh, Tharini, et al.
Pubblicazione: (2026)
di: Suresh, Tharini, et al.
Pubblicazione: (2026)
Optical Computing for Deep Neural Network Acceleration: Foundations, Recent Developments, and Emerging Directions
di: Pasricha, Sudeep
Pubblicazione: (2024)
di: Pasricha, Sudeep
Pubblicazione: (2024)
Lightator: An Optical Near-Sensor Accelerator with Compressive Acquisition Enabling Versatile Image Processing
di: Morsali, Mehrdad, et al.
Pubblicazione: (2024)
di: Morsali, Mehrdad, et al.
Pubblicazione: (2024)
ARTEMIS: A Mixed Analog-Stochastic In-DRAM Accelerator for Transformer Neural Networks
di: Afifi, Salma, et al.
Pubblicazione: (2024)
di: Afifi, Salma, et al.
Pubblicazione: (2024)
Opto-ViT: Architecting a Near-Sensor Region of Interest-Aware Vision Transformer Accelerator with Silicon Photonics
di: Morsali, Mehrdad, et al.
Pubblicazione: (2025)
di: Morsali, Mehrdad, et al.
Pubblicazione: (2025)
A High-Throughput Hardware Accelerator for Lempel-Ziv 4 Compression Algorithm
di: Chen, Tao, et al.
Pubblicazione: (2024)
di: Chen, Tao, et al.
Pubblicazione: (2024)
SafeLight: Enhancing Security in Optical Convolutional Neural Network Accelerators
di: Afifi, Salma, et al.
Pubblicazione: (2024)
di: Afifi, Salma, et al.
Pubblicazione: (2024)
Neuro-Photonix: Enabling Near-Sensor Neuro-Symbolic AI Computing on Silicon Photonics Substrate
di: Najafi, Deniz, et al.
Pubblicazione: (2024)
di: Najafi, Deniz, et al.
Pubblicazione: (2024)
PhD Thesis Summary: Methods for Reliability Assessment and Enhancement of Deep Neural Network Hardware Accelerators
di: Taheri, Mahdi
Pubblicazione: (2026)
di: Taheri, Mahdi
Pubblicazione: (2026)
Sustainable Transformer Neural Network Acceleration with Stochastic Photonic Computing
di: Afifi, S., et al.
Pubblicazione: (2026)
di: Afifi, S., et al.
Pubblicazione: (2026)
LuxNAS: A Coherent Photonic Neural Network Powered by Neural Architecture Search
di: Shafiee, Amin, et al.
Pubblicazione: (2025)
di: Shafiee, Amin, et al.
Pubblicazione: (2025)
From Natural Language to Silicon: The Representation Bottleneck in LLM Hardware Design
di: Fu, Weimin, et al.
Pubblicazione: (2026)
di: Fu, Weimin, et al.
Pubblicazione: (2026)
Hardware Implementation of Soft Mapper/Demappers in Iterative EP-based Receivers
di: Schilling, Ian Fischer, et al.
Pubblicazione: (2024)
di: Schilling, Ian Fischer, et al.
Pubblicazione: (2024)
Single-Event Upset Analysis of a Systolic Array based Deep Neural Network Accelerator
di: Jonckers, Naïn, et al.
Pubblicazione: (2024)
di: Jonckers, Naïn, et al.
Pubblicazione: (2024)
MCFlash: Bulk Bitwise Processing in 3D NAND with Dynamic Sensing and Multi-level Encoding
di: Rahman, Habib Ur, et al.
Pubblicazione: (2026)
di: Rahman, Habib Ur, et al.
Pubblicazione: (2026)
CAFEEN: A Cooperative Approach for Energy Efficient NoCs with Multi-Agent Reinforcement Learning
di: Khan, Kamil, et al.
Pubblicazione: (2024)
di: Khan, Kamil, et al.
Pubblicazione: (2024)
SparseDPD: A Sparse Neural Network-based Digital Predistortion FPGA Accelerator for RF Power Amplifier Linearization
di: Versluis, Manno, et al.
Pubblicazione: (2025)
di: Versluis, Manno, et al.
Pubblicazione: (2025)
Explainable and Hardware-Efficient Jamming Detection for 5G Networks Using the Convolutional Tsetlin Machine
di: Halenka, Vojtech, et al.
Pubblicazione: (2026)
di: Halenka, Vojtech, et al.
Pubblicazione: (2026)
Overcoming Quadratic Hardware Scaling for a Fully Connected Digital Oscillatory Neural Network
di: Haverkort, Bram, et al.
Pubblicazione: (2025)
di: Haverkort, Bram, et al.
Pubblicazione: (2025)
Current Opinions on Memristor-Accelerated Machine Learning Hardware
di: Jiang, Mingrui, et al.
Pubblicazione: (2025)
di: Jiang, Mingrui, et al.
Pubblicazione: (2025)
CNN-Based Equalization for Communications: Achieving Gigabit Throughput with a Flexible FPGA Hardware Architecture
di: Ney, Jonas, et al.
Pubblicazione: (2024)
di: Ney, Jonas, et al.
Pubblicazione: (2024)
Designing Spatial Architectures for Sparse Attention: STAR Accelerator via Cross-Stage Tiling
di: Wang, Huizheng, et al.
Pubblicazione: (2025)
di: Wang, Huizheng, et al.
Pubblicazione: (2025)
PADE: A Predictor-Free Sparse Attention Accelerator via Unified Execution and Stage Fusion
di: Wang, Huizheng, et al.
Pubblicazione: (2025)
di: Wang, Huizheng, et al.
Pubblicazione: (2025)
Hardware Acceleration of Kolmogorov-Arnold Network (KAN) in Large-Scale Systems
di: Huang, Wei-Hsing, et al.
Pubblicazione: (2025)
di: Huang, Wei-Hsing, et al.
Pubblicazione: (2025)
PICNIC: Silicon Photonic Interconnected Chiplets with Computational Network and In-memory Computing for LLM Inference Acceleration
di: Chong, Yue Jiet, et al.
Pubblicazione: (2025)
di: Chong, Yue Jiet, et al.
Pubblicazione: (2025)
In-Memory Computing Enabled Deep MIMO Detection to Support Ultra-Low-Latency Communications
di: Ding, Tingyu, et al.
Pubblicazione: (2025)
di: Ding, Tingyu, et al.
Pubblicazione: (2025)
A Quantitative Evaluation of Approximate Softmax Functions for Deep Neural Networks
di: Leiva-Valverde, Anthony, et al.
Pubblicazione: (2025)
di: Leiva-Valverde, Anthony, et al.
Pubblicazione: (2025)
Hardware Implementation of Projection-Aggregation Decoders for Reed-Muller Codes
di: Hashemipour-Nazari, Marzieh, et al.
Pubblicazione: (2024)
di: Hashemipour-Nazari, Marzieh, et al.
Pubblicazione: (2024)
A 0.03${mm}^2$ 100-250MHz Charge-Pump or Amplifier-Less Integrating Sub-Sampling PLL for Ultra-low Power Communication and Computing
di: Ray, Yudhajit, et al.
Pubblicazione: (2024)
di: Ray, Yudhajit, et al.
Pubblicazione: (2024)
ONE-SA: Enabling Nonlinear Operations in Systolic Arrays for Efficient and Flexible Neural Network Inference
di: Sun, Ruiqi, et al.
Pubblicazione: (2024)
di: Sun, Ruiqi, et al.
Pubblicazione: (2024)
FieldHAR: A Fully Integrated End-to-end RTL Framework for Human Activity Recognition with Neural Networks from Heterogeneous Sensors
di: Liu, Mengxi, et al.
Pubblicazione: (2023)
di: Liu, Mengxi, et al.
Pubblicazione: (2023)
Designing High-Performance and Thermally Feasible Multi-Chiplet Architectures enabled by Non-bendable Glass Interposer
di: Sharma, Harsh, et al.
Pubblicazione: (2025)
di: Sharma, Harsh, et al.
Pubblicazione: (2025)
Modeling and Optimizing Performance Bottlenecks for Neuromorphic Accelerators
di: Yik, Jason, et al.
Pubblicazione: (2025)
di: Yik, Jason, et al.
Pubblicazione: (2025)
ChipletQuake: On-die Digital Impedance Sensing for Chiplet and Interposer Verification
di: Monfared, Saleh Khalaj, et al.
Pubblicazione: (2025)
di: Monfared, Saleh Khalaj, et al.
Pubblicazione: (2025)
FETTA: Flexible and Efficient Hardware Accelerator for Tensorized Neural Network Training
di: Lu, Jinming, et al.
Pubblicazione: (2025)
di: Lu, Jinming, et al.
Pubblicazione: (2025)
Hardware Acceleration of Kolmogorov-Arnold Network (KAN) for Lightweight Edge Inference
di: Huang, Wei-Hsing, et al.
Pubblicazione: (2024)
di: Huang, Wei-Hsing, et al.
Pubblicazione: (2024)
Practical Timing Closure in FPGA and ASIC Designs: Methods, Challenges, and Case Studies
di: Darvishi, Mostafa
Pubblicazione: (2025)
di: Darvishi, Mostafa
Pubblicazione: (2025)
Documenti analoghi
-
Accelerating Neural Networks for Large Language Models and Graph Processing with Silicon Photonics
di: Afifi, Salma, et al.
Pubblicazione: (2024) -
OPIMA: Optical Processing-In-Memory for Convolutional Neural Network Acceleration
di: Sunny, Febin, et al.
Pubblicazione: (2024) -
PhotoGAN: Generative Adversarial Neural Network Acceleration with Silicon Photonics
di: Suresh, Tharini, et al.
Pubblicazione: (2025) -
Accelerating Diffusion Models for Generative AI Applications with Silicon Photonics
di: Suresh, Tharini, et al.
Pubblicazione: (2026) -
Optical Computing for Deep Neural Network Acceleration: Foundations, Recent Developments, and Emerging Directions
di: Pasricha, Sudeep
Pubblicazione: (2024)