OptINC: Optical In-Network-Computing for Scalable Distributed Learning
Fuente:
arXiv
Salvato in:
| Autori principali: | Fei, Sijie, Zhang, Grace Li, Li, Bing, Schlichtmann, Ulf |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
EncodingNet: A Novel Encoding-based MAC Design for Efficient Neural Network Acceleration
di: Liu, Bo, et al.
Pubblicazione: (2024)
di: Liu, Bo, et al.
Pubblicazione: (2024)
Memory Is All You Need: An Overview of Compute-in-Memory Architectures for Accelerating Large Language Model Inference
di: Wolters, Christopher, et al.
Pubblicazione: (2024)
di: Wolters, Christopher, et al.
Pubblicazione: (2024)
PrefixGPT: Prefix Adder Optimization by a Generative Pre-trained Transformer
di: Ding, Ruogu, et al.
Pubblicazione: (2025)
di: Ding, Ruogu, et al.
Pubblicazione: (2025)
VFocus: Better Verilog Generation from Large Language Model via Focused Reasoning
di: Zhao, Zhuorui, et al.
Pubblicazione: (2025)
di: Zhao, Zhuorui, et al.
Pubblicazione: (2025)
Layer-wise Weight Selection for Power-Efficient Neural Network Acceleration
di: Fang, Jiaxun, et al.
Pubblicazione: (2025)
di: Fang, Jiaxun, et al.
Pubblicazione: (2025)
Classification-Based Automatic HDL Code Generation Using LLMs
di: Sun, Wenhao, et al.
Pubblicazione: (2024)
di: Sun, Wenhao, et al.
Pubblicazione: (2024)
VRank: Enhancing Verilog Code Generation from Large Language Models via Self-Consistency
di: Zhao, Zhuorui, et al.
Pubblicazione: (2025)
di: Zhao, Zhuorui, et al.
Pubblicazione: (2025)
GENIE-ASI: Generative Instruction and Executable Code for Analog Subcircuit Identification
di: Pham, Phuoc, et al.
Pubblicazione: (2025)
di: Pham, Phuoc, et al.
Pubblicazione: (2025)
Optical Computing for Deep Neural Network Acceleration: Foundations, Recent Developments, and Emerging Directions
di: Pasricha, Sudeep
Pubblicazione: (2024)
di: Pasricha, Sudeep
Pubblicazione: (2024)
A Precision-Scalable RISC-V DNN Processor with On-Device Learning Capability at the Extreme Edge
di: Huang, Longwei, et al.
Pubblicazione: (2023)
di: Huang, Longwei, et al.
Pubblicazione: (2023)
Hardware-Software Co-Design of Scalable, Energy-Efficient Analog Recurrent Computations
di: Fyon, Arthur, et al.
Pubblicazione: (2026)
di: Fyon, Arthur, et al.
Pubblicazione: (2026)
ROSA: Robust and Energy-Efficient Microring-Based Optical Neural Networks via Optical Shift-and-Add and Layer-Wise Hybrid Mapping
di: Zhang, Huifan, et al.
Pubblicazione: (2026)
di: Zhang, Huifan, et al.
Pubblicazione: (2026)
Less is More: Hop-Wise Graph Attention for Scalable and Generalizable Learning on Circuits
di: Deng, Chenhui, et al.
Pubblicazione: (2024)
di: Deng, Chenhui, et al.
Pubblicazione: (2024)
BDD2Seq: Enabling Scalable Reversible-Circuit Synthesis via Graph-to-Sequence Learning
di: Miao, Mingkai, et al.
Pubblicazione: (2025)
di: Miao, Mingkai, et al.
Pubblicazione: (2025)
SCRec: A Scalable Computational Storage System with Statistical Sharding and Tensor-train Decomposition for Recommendation Models
di: Yang, Jinho, et al.
Pubblicazione: (2025)
di: Yang, Jinho, et al.
Pubblicazione: (2025)
Explainable Fuzzy Neural Network with Multi-Fidelity Reinforcement Learning for Micro-Architecture Design Space Exploration
di: Fan, Hanwei, et al.
Pubblicazione: (2024)
di: Fan, Hanwei, et al.
Pubblicazione: (2024)
Sustainable Transformer Neural Network Acceleration with Stochastic Photonic Computing
di: Afifi, S., et al.
Pubblicazione: (2026)
di: Afifi, S., et al.
Pubblicazione: (2026)
Accelerating Computer Architecture Simulation through Machine Learning
di: Ali, Wajid, et al.
Pubblicazione: (2024)
di: Ali, Wajid, et al.
Pubblicazione: (2024)
Boolean-aware Boolean Circuit Classification: A Comprehensive Study on Graph Neural Network
di: Ni, Liwei, et al.
Pubblicazione: (2024)
di: Ni, Liwei, et al.
Pubblicazione: (2024)
Large Language Models (LLMs) for Electronic Design Automation (EDA)
di: Xu, Kangwei, et al.
Pubblicazione: (2025)
di: Xu, Kangwei, et al.
Pubblicazione: (2025)
CircuitVAE: Efficient and Scalable Latent Circuit Optimization
di: Song, Jialin, et al.
Pubblicazione: (2024)
di: Song, Jialin, et al.
Pubblicazione: (2024)
GCoD: Graph Convolutional Network Acceleration via Dedicated Algorithm and Accelerator Co-Design
di: You, Haoran, et al.
Pubblicazione: (2021)
di: You, Haoran, et al.
Pubblicazione: (2021)
Reconfigurable Computing Challenge: Real-Time Graph Neural Networks for Online Event Selection in Big Science
di: Neu, Marc, et al.
Pubblicazione: (2026)
di: Neu, Marc, et al.
Pubblicazione: (2026)
AP-DRL: A Synergistic Algorithm-Hardware Framework for Automatic Task Partitioning of Deep Reinforcement Learning on Versal ACAP
di: Li, Enlai, et al.
Pubblicazione: (2026)
di: Li, Enlai, et al.
Pubblicazione: (2026)
A 65nm 8b-Activation 8b-Weight SRAM-Based Charge-Domain Computing-in-Memory Macro Using A Fully-Parallel Analog Adder Network and A Single-ADC Interface
di: Yin, Guodong, et al.
Pubblicazione: (2022)
di: Yin, Guodong, et al.
Pubblicazione: (2022)
Learning Generalizable Program and Architecture Representations for Performance Modeling
di: Li, Lingda, et al.
Pubblicazione: (2023)
di: Li, Lingda, et al.
Pubblicazione: (2023)
SafeCiM: Investigating Resilience of Hybrid Floating-Point Compute-in-Memory Deep Learning Accelerators
di: Bhattacharya, Swastik, et al.
Pubblicazione: (2025)
di: Bhattacharya, Swastik, et al.
Pubblicazione: (2025)
Efficient Implementation of LinearUCB through Algorithmic Improvements and Vector Computing Acceleration for Embedded Learning Systems
di: Angioli, Marco, et al.
Pubblicazione: (2025)
di: Angioli, Marco, et al.
Pubblicazione: (2025)
Automated Design and Optimization of Distributed Filtering Circuits via Reinforcement Learning
di: Gao, Peng, et al.
Pubblicazione: (2024)
di: Gao, Peng, et al.
Pubblicazione: (2024)
DOSA: Differentiable Model-Based One-Loop Search for DNN Accelerators
di: Hong, Charles, et al.
Pubblicazione: (2025)
di: Hong, Charles, et al.
Pubblicazione: (2025)
M100: An Orchestrated Dataflow Architecture Powering General AI Computing
di: Xie, Yan, et al.
Pubblicazione: (2026)
di: Xie, Yan, et al.
Pubblicazione: (2026)
L3: DIMM-PIM Integrated Architecture and Coordination for Scalable Long-Context LLM Inference
di: Liu, Qingyuan, et al.
Pubblicazione: (2025)
di: Liu, Qingyuan, et al.
Pubblicazione: (2025)
FuncGNN: Learning Functional Semantics of Logic Circuits with Graph Neural Networks
di: Zhao, Qiyun
Pubblicazione: (2025)
di: Zhao, Qiyun
Pubblicazione: (2025)
Graph Neural Networks Based Analog Circuit Link Prediction
di: Pan, Guanyuan, et al.
Pubblicazione: (2025)
di: Pan, Guanyuan, et al.
Pubblicazione: (2025)
FRED: Flexible REduction-Distribution Interconnect and Communication Implementation for Wafer-Scale Distributed Training of DNN Models
di: Rashidi, Saeed, et al.
Pubblicazione: (2024)
di: Rashidi, Saeed, et al.
Pubblicazione: (2024)
TCL: Enabling Fast and Efficient Cross-Hardware Tensor Program Optimization via Continual Learning
di: Shen, Chaoyao, et al.
Pubblicazione: (2026)
di: Shen, Chaoyao, et al.
Pubblicazione: (2026)
DeepSeq2: Enhanced Sequential Circuit Learning with Disentangled Representations
di: Khan, Sadaf, et al.
Pubblicazione: (2024)
di: Khan, Sadaf, et al.
Pubblicazione: (2024)
PACiM: A Sparsity-Centric Hybrid Compute-in-Memory Architecture via Probabilistic Approximation
di: Zhang, Wenlun, et al.
Pubblicazione: (2024)
di: Zhang, Wenlun, et al.
Pubblicazione: (2024)
FSL-HDnn: A 5.7 TOPS/W End-to-end Few-shot Learning Classifier Accelerator with Feature Extraction and Hyperdimensional Computing
di: Yang, Haichao, et al.
Pubblicazione: (2024)
di: Yang, Haichao, et al.
Pubblicazione: (2024)
RTLSeek: Boosting the LLM-Based RTL Generation with Multi-Stage Diversity-Oriented Reinforcement Learning
di: Zhang, Xinyu, et al.
Pubblicazione: (2026)
di: Zhang, Xinyu, et al.
Pubblicazione: (2026)
Documenti analoghi
-
EncodingNet: A Novel Encoding-based MAC Design for Efficient Neural Network Acceleration
di: Liu, Bo, et al.
Pubblicazione: (2024) -
Memory Is All You Need: An Overview of Compute-in-Memory Architectures for Accelerating Large Language Model Inference
di: Wolters, Christopher, et al.
Pubblicazione: (2024) -
PrefixGPT: Prefix Adder Optimization by a Generative Pre-trained Transformer
di: Ding, Ruogu, et al.
Pubblicazione: (2025) -
VFocus: Better Verilog Generation from Large Language Model via Focused Reasoning
di: Zhao, Zhuorui, et al.
Pubblicazione: (2025) -
Layer-wise Weight Selection for Power-Efficient Neural Network Acceleration
di: Fang, Jiaxun, et al.
Pubblicazione: (2025)