Predictive Performance of Photonic SRAM-based In-Memory Computing for Tensor Decomposition
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Wijeratne, Sasindu, Sunder, Sugeet, Kaiser, Md Abdullah-Al, Jaiswal, Akhilesh, Mathew, Clynn, Jacob, Ajey P., Prasanna, Viktor |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
System-Level Performance Modeling of Photonic In-Memory Computing
par: Arockiaraj, Jebacyril, et autres
Publié: (2026)
par: Arockiaraj, Jebacyril, et autres
Publié: (2026)
Accelerating Sparse MTTKRP for Small Tensor Decomposition on GPU
par: Wijeratne, Sasindu, et autres
Publié: (2025)
par: Wijeratne, Sasindu, et autres
Publié: (2025)
AMPED: Accelerating MTTKRP for Billion-Scale Sparse Tensor Decomposition on Multiple GPUs
par: Wijeratne, Sasindu, et autres
Publié: (2025)
par: Wijeratne, Sasindu, et autres
Publié: (2025)
Sparse MTTKRP Acceleration for Tensor Decomposition on GPU
par: Wijeratne, Sasindu, et autres
Publié: (2024)
par: Wijeratne, Sasindu, et autres
Publié: (2024)
Design of Energy-Efficient Cross-coupled Differential Photonic-SRAM (pSRAM) Bitcell for High-Speed On-Chip Photonic Memory and Compute Systems
par: Kaiser, Md Abdullah-Al, et autres
Publié: (2025)
par: Kaiser, Md Abdullah-Al, et autres
Publié: (2025)
X-pSRAM: A Photonic SRAM with Embedded XOR Logic for Ultra-Fast In-Memory Computing
par: Kaiser, Md Abdullah-Al, et autres
Publié: (2025)
par: Kaiser, Md Abdullah-Al, et autres
Publié: (2025)
A Mixed-Signal Photonic SRAM-based High-Speed Energy-Efficient Photonic Tensor Core with Novel Electro-Optic ADC
par: Kaiser, Md Abdullah-Al, et autres
Publié: (2025)
par: Kaiser, Md Abdullah-Al, et autres
Publié: (2025)
PRISM: Processing-In-Memory Sparse MTTKRP for Tensor Decomposition Acceleration
par: Pacheco, Daniel, et autres
Publié: (2026)
par: Pacheco, Daniel, et autres
Publié: (2026)
ScalableHD: Scalable and High-Throughput Hyperdimensional Computing Inference on Multi-Core CPUs
par: Parikh, Dhruv, et autres
Publié: (2025)
par: Parikh, Dhruv, et autres
Publié: (2025)
Accelerating Dynamic Image Graph Construction on FPGA for Vision GNNs
par: Ramachandran, Anvitha, et autres
Publié: (2025)
par: Ramachandran, Anvitha, et autres
Publié: (2025)
A Unified CPU-GPU Protocol for GNN Training
par: Lin, Yi-Chien, et autres
Publié: (2024)
par: Lin, Yi-Chien, et autres
Publié: (2024)
Benchmarking the Performance of Large Language Models on the Cerebras Wafer Scale Engine
par: Zhang, Zuoning, et autres
Publié: (2024)
par: Zhang, Zuoning, et autres
Publié: (2024)
Federated Learning Using Coupled Tensor Train Decomposition
par: Zhang, Xiangtao, et autres
Publié: (2024)
par: Zhang, Xiangtao, et autres
Publié: (2024)
Minimizing Communication for Parallel Symmetric Tensor Times Same Vector Computation
par: Daas, Hussam Al, et autres
Publié: (2025)
par: Daas, Hussam Al, et autres
Publié: (2025)
CkIO: Parallel File Input for Over-Decomposed Task-Based Systems
par: Jacob, Mathew, et autres
Publié: (2024)
par: Jacob, Mathew, et autres
Publié: (2024)
Improving SpGEMM Performance Through Matrix Reordering and Cluster-wise Computation
par: Islam, Abdullah Al Raqibul, et autres
Publié: (2025)
par: Islam, Abdullah Al Raqibul, et autres
Publié: (2025)
Do We Need Tensor Cores for Stencil Computations?
par: Gu, Qiqi, et autres
Publié: (2026)
par: Gu, Qiqi, et autres
Publié: (2026)
Exploring the Viability of Unikernels for ARM-powered Edge Computing
par: Kaiser, Shahidullah, et autres
Publié: (2024)
par: Kaiser, Shahidullah, et autres
Publié: (2024)
ARGO: An Auto-Tuning Runtime System for Scalable GNN Training on Multi-Core Processor
par: Lin, Yi-Chien, et autres
Publié: (2024)
par: Lin, Yi-Chien, et autres
Publié: (2024)
High Performance Unstructured SpMM Computation Using Tensor Cores
par: Okanovic, Patrik, et autres
Publié: (2024)
par: Okanovic, Patrik, et autres
Publié: (2024)
cuFastTuckerPlus: A Stochastic Parallel Sparse FastTucker Decomposition Using GPU Tensor Cores
par: Li, Zixuan, et autres
Publié: (2024)
par: Li, Zixuan, et autres
Publié: (2024)
Advancing Anomaly Detection in Computational Workflows with Active Learning
par: Raghavan, Krishnan, et autres
Publié: (2024)
par: Raghavan, Krishnan, et autres
Publié: (2024)
Can Tensor Cores Benefit Memory-Bound Kernels? (No!)
par: Zhang, Lingqi, et autres
Publié: (2025)
par: Zhang, Lingqi, et autres
Publié: (2025)
SPIDER: Unleashing Sparse Tensor Cores for Stencil Computation via Strided Swapping
par: GU, Qiqi, et autres
Publié: (2025)
par: GU, Qiqi, et autres
Publié: (2025)
Fixing Non-blocking Data Structures for Better Compatibility with Memory Reclamation Schemes
par: Arovi, Md Amit Hasan, et autres
Publié: (2025)
par: Arovi, Md Amit Hasan, et autres
Publié: (2025)
Flow-Bench: A Dataset for Computational Workflow Anomaly Detection
par: Papadimitriou, George, et autres
Publié: (2023)
par: Papadimitriou, George, et autres
Publié: (2023)
EinDecomp: Decomposition of Declaratively-Specified Machine Learning and Numerical Computations for Parallel Execution
par: Bourgeois, Daniel, et autres
Publié: (2024)
par: Bourgeois, Daniel, et autres
Publié: (2024)
Context-Driven Performance Modeling for Causal Inference Operators on Neural Processing Units
par: Gupta, Neelesh, et autres
Publié: (2025)
par: Gupta, Neelesh, et autres
Publié: (2025)
RIMMS: Runtime Integrated Memory Management System for Heterogeneous Computing
par: Gener, Serhan, et autres
Publié: (2025)
par: Gener, Serhan, et autres
Publié: (2025)
Disaggregated Memory with SmartNIC Offloading: a Case Study on Graph Processing
par: Wahlgren, Jacob, et autres
Publié: (2024)
par: Wahlgren, Jacob, et autres
Publié: (2024)
Multi-level Memory-Centric Profiling on ARM Processors with ARM SPE
par: Miksits, Samuel, et autres
Publié: (2024)
par: Miksits, Samuel, et autres
Publié: (2024)
Computation-Bandwidth-Memory Trade-offs: A Unified Paradigm for AI Infrastructure
par: Fan, Yuankai, et autres
Publié: (2025)
par: Fan, Yuankai, et autres
Publié: (2025)
Picasso: Memory-Efficient Graph Coloring Using Palettes With Applications in Quantum Computing
par: Ferdous, S M, et autres
Publié: (2024)
par: Ferdous, S M, et autres
Publié: (2024)
Harnessing Integrated CPU-GPU System Memory for HPC: a first look into Grace Hopper
par: Schieffer, Gabin, et autres
Publié: (2024)
par: Schieffer, Gabin, et autres
Publié: (2024)
Synergistic Tensor and Pipeline Parallelism
par: Qi, Mengshi, et autres
Publié: (2025)
par: Qi, Mengshi, et autres
Publié: (2025)
CheckMate: LLM-Powered Approximate Intermittent Computing
par: Sayyid-Ali, Abdur-Rahman Ibrahim, et autres
Publié: (2024)
par: Sayyid-Ali, Abdur-Rahman Ibrahim, et autres
Publié: (2024)
Distributed-Memory Parallel Algorithms for Sparse Matrix and Sparse Tall-and-Skinny Matrix Multiplication
par: Ranawaka, Isuru, et autres
Publié: (2024)
par: Ranawaka, Isuru, et autres
Publié: (2024)
Memory-Centric Computing: Solving Computing's Memory Problem
par: Mutlu, Onur, et autres
Publié: (2025)
par: Mutlu, Onur, et autres
Publié: (2025)
SuperSFL: Resource-Heterogeneous Federated Split Learning with Weight-Sharing Super-Networks
par: Asif, Abdullah Al, et autres
Publié: (2026)
par: Asif, Abdullah Al, et autres
Publié: (2026)
CAT: Cellular Automata on Tensor cores
par: Navarro, Cristóbal A., et autres
Publié: (2024)
par: Navarro, Cristóbal A., et autres
Publié: (2024)
Documents similaires
-
System-Level Performance Modeling of Photonic In-Memory Computing
par: Arockiaraj, Jebacyril, et autres
Publié: (2026) -
Accelerating Sparse MTTKRP for Small Tensor Decomposition on GPU
par: Wijeratne, Sasindu, et autres
Publié: (2025) -
AMPED: Accelerating MTTKRP for Billion-Scale Sparse Tensor Decomposition on Multiple GPUs
par: Wijeratne, Sasindu, et autres
Publié: (2025) -
Sparse MTTKRP Acceleration for Tensor Decomposition on GPU
par: Wijeratne, Sasindu, et autres
Publié: (2024) -
Design of Energy-Efficient Cross-coupled Differential Photonic-SRAM (pSRAM) Bitcell for High-Speed On-Chip Photonic Memory and Compute Systems
par: Kaiser, Md Abdullah-Al, et autres
Publié: (2025)