Factor Machine: Mixed-signal Architecture for Fine-Grained Graph-Based Computing
Fuente:
arXiv
Salvato in:
| Autore principale: | Dudek, Piotr |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Ten-Four: An Open-Source Fused Dot Product Unit for Mixed-Precision GPGPU Tensor Cores
di: Rout, Nikhil, et al.
Pubblicazione: (2025)
di: Rout, Nikhil, et al.
Pubblicazione: (2025)
FlexiBit: Fully Flexible Precision Bit-parallel Accelerator Architecture for Arbitrary Mixed Precision AI
di: Tahmasebi, Faraz, et al.
Pubblicazione: (2024)
di: Tahmasebi, Faraz, et al.
Pubblicazione: (2024)
Lincoln AI Computing Survey (LAICS) and Trends
di: Reuther, Albert, et al.
Pubblicazione: (2025)
di: Reuther, Albert, et al.
Pubblicazione: (2025)
Dataflow & Tiling Strategies in Edge-AI FPGA Accelerators: A Comprehensive Literature Review
di: Li, Richie
Pubblicazione: (2025)
di: Li, Richie
Pubblicazione: (2025)
D-com: Accelerating Iterative Processing to Enable Low-rank Decomposition of Activations
di: Tahmasebi, Faraz, et al.
Pubblicazione: (2025)
di: Tahmasebi, Faraz, et al.
Pubblicazione: (2025)
TokenStack: A Heterogeneous HBM-PIM Architecture and Runtime for Efficient LLM Inference
di: Li, Zhuoran, et al.
Pubblicazione: (2026)
di: Li, Zhuoran, et al.
Pubblicazione: (2026)
Toward a Universal GPU Instruction Set Architecture: A Cross-Vendor Analysis of Hardware-Invariant Computational Primitives in Parallel Processors
di: Abraham, Ojima, et al.
Pubblicazione: (2026)
di: Abraham, Ojima, et al.
Pubblicazione: (2026)
A Per-Access Upper Bound for Shared-Resource Interference in Direct-Mapped Multicore Architectures
di: Pedroni, Felipe T.
Pubblicazione: (2026)
di: Pedroni, Felipe T.
Pubblicazione: (2026)
Design and Implementation of an FPGA-Based Hardware Accelerator for Transformer
di: Li, Richie, et al.
Pubblicazione: (2025)
di: Li, Richie, et al.
Pubblicazione: (2025)
Lean Attention: Hardware-Aware Scalable Attention Mechanism for the Decode-Phase of Transformers
di: Sanovar, Rya, et al.
Pubblicazione: (2024)
di: Sanovar, Rya, et al.
Pubblicazione: (2024)
A Comparative Analysis of ARM and x86-64 Laptop-Class Processors: Architecture, Assembly-Level Performance, and Energy Efficiency
di: Özyılmaz, Mustafa Mert
Pubblicazione: (2026)
di: Özyılmaz, Mustafa Mert
Pubblicazione: (2026)
Not All Thoughts Need HBM: Semantics-Aware Memory Hierarchy for LLM Reasoning
di: Yuan, Aojie, et al.
Pubblicazione: (2026)
di: Yuan, Aojie, et al.
Pubblicazione: (2026)
GDEV-AI: A Generalized Evaluation of Deep Learning Inference Scaling and Architectural Saturation
di: Palaniappan, Kathiravan
Pubblicazione: (2026)
di: Palaniappan, Kathiravan
Pubblicazione: (2026)
Accelerating Precise End-to-End Simulation: Latency-Sensitive Many-core System Modeling
di: Li, Yinrong, et al.
Pubblicazione: (2026)
di: Li, Yinrong, et al.
Pubblicazione: (2026)
Rotary GPU: Exploring Local Execution Paths for Large Mixture-of-Experts Models Under Limited GPU Memory
di: Jo, Myeong Jun
Pubblicazione: (2026)
di: Jo, Myeong Jun
Pubblicazione: (2026)
Fast and Fusiest: An Optimal Fusion-Aware Mapper for Accelerator Design
di: Andrulis, Tanner, et al.
Pubblicazione: (2026)
di: Andrulis, Tanner, et al.
Pubblicazione: (2026)
The Turbo-Charged Mapper: Fast and Optimal Mapping for Energy-efficient and Low-latency Accelerator Design
di: Gilbert, Michael, et al.
Pubblicazione: (2026)
di: Gilbert, Michael, et al.
Pubblicazione: (2026)
CLIPGen: A Chiplet Link IP Modeling and Generation Framework for 2.5D Architecture Exploration
di: Zhu, Zhengping, et al.
Pubblicazione: (2026)
di: Zhu, Zhengping, et al.
Pubblicazione: (2026)
AMC: Access to Miss Correlation Prefetcher for Evolving Graph Analytics
di: Singh, Abhishek, et al.
Pubblicazione: (2024)
di: Singh, Abhishek, et al.
Pubblicazione: (2024)
RV-IM100: Quantifying ISA Extension, Datapath Width, and Pipeline Depth Trade-offs in RISC-V Microarchitectures
di: Kang, Hyunwoo
Pubblicazione: (2026)
di: Kang, Hyunwoo
Pubblicazione: (2026)
FREESS: A Web-Based Educational Simulator for a RISC-V-Inspired Superscalar Processor with Tomasulo-Style Dynamic Scheduling
di: Giorgi, Roberto, et al.
Pubblicazione: (2026)
di: Giorgi, Roberto, et al.
Pubblicazione: (2026)
ArchAgent: Agentic AI-driven Computer Architecture Discovery
di: Gupta, Raghav, et al.
Pubblicazione: (2026)
di: Gupta, Raghav, et al.
Pubblicazione: (2026)
T3: Transparent Tracking & Triggering for Fine-grained Overlap of Compute & Collectives
di: Pati, Suchita, et al.
Pubblicazione: (2024)
di: Pati, Suchita, et al.
Pubblicazione: (2024)
DEEP-GAP: Deep-learning Evaluation of Execution Parallelism in GPU Architectural Performance
di: Palaniappan, Kathiravan
Pubblicazione: (2026)
di: Palaniappan, Kathiravan
Pubblicazione: (2026)
Wattchmen: Watching the Wattchers -- High Fidelity, Flexible GPU Energy Modeling
di: Tran, Brandon, et al.
Pubblicazione: (2026)
di: Tran, Brandon, et al.
Pubblicazione: (2026)
Guess-Verify-Refine: Data-Aware Top-K for Sparse-Attention Decoding on Blackwell via Temporal Correlation
di: Cheng, Long, et al.
Pubblicazione: (2026)
di: Cheng, Long, et al.
Pubblicazione: (2026)
Improving Injection-Throttling Mechanisms for Congestion Control for Data-center and Supercomputer Interconnects
di: Olmedilla, Cristina, et al.
Pubblicazione: (2025)
di: Olmedilla, Cristina, et al.
Pubblicazione: (2025)
TriADA: Massively Parallel Trilinear Matrix-by-Tensor Multiply-Add Algorithm and Device Architecture for the Acceleration of 3D Discrete Transformations
di: Sedukhin, Stanislav, et al.
Pubblicazione: (2025)
di: Sedukhin, Stanislav, et al.
Pubblicazione: (2025)
CEO-DC: Driving Decarbonization in HPC Data Centers with Actionable Insights
di: Álvarez, Rubén Rodríguez, et al.
Pubblicazione: (2025)
di: Álvarez, Rubén Rodríguez, et al.
Pubblicazione: (2025)
Coordinated Reinforcement Learning Prefetching Architecture for Multicore Systems
di: Siddiqui, Mohammed Humaid, et al.
Pubblicazione: (2025)
di: Siddiqui, Mohammed Humaid, et al.
Pubblicazione: (2025)
Kratos: An FPGA Benchmark for Unrolled DNNs with Fine-Grained Sparsity and Mixed Precision
di: Dai, Xilai, et al.
Pubblicazione: (2024)
di: Dai, Xilai, et al.
Pubblicazione: (2024)
Glass-Box Analysis for Computer Systems: Transparency Index, Shapley Attribution, and Markov Models of Branch Prediction
di: Alpay, Faruk, et al.
Pubblicazione: (2025)
di: Alpay, Faruk, et al.
Pubblicazione: (2025)
Ember: A Compiler for Efficient Embedding Operations on Decoupled Access-Execute Architectures
di: Siracusa, Marco, et al.
Pubblicazione: (2025)
di: Siracusa, Marco, et al.
Pubblicazione: (2025)
LUT Tensor Core: A Software-Hardware Co-Design for LUT-Based Low-Bit LLM Inference
di: Mo, Zhiwen, et al.
Pubblicazione: (2024)
di: Mo, Zhiwen, et al.
Pubblicazione: (2024)
A Flexible Instruction Set Architecture for Efficient GEMMs
di: Santana, Alexandre de Limas, et al.
Pubblicazione: (2025)
di: Santana, Alexandre de Limas, et al.
Pubblicazione: (2025)
VolTune: A Fine-Grained Runtime Voltage Control Architecture for FPGA Systems
di: Ahmed, Akram Ben, et al.
Pubblicazione: (2026)
di: Ahmed, Akram Ben, et al.
Pubblicazione: (2026)
A Compilation Framework for Quantum Circuits with Mid-Circuit Measurement Error Awareness
di: Zhong, Ming, et al.
Pubblicazione: (2025)
di: Zhong, Ming, et al.
Pubblicazione: (2025)
Sectored DRAM: A Practical Energy-Efficient and High-Performance Fine-Grained DRAM Architecture
di: Olgun, Ataberk, et al.
Pubblicazione: (2022)
di: Olgun, Ataberk, et al.
Pubblicazione: (2022)
Piccolo: Large-Scale Graph Processing with Fine-Grained In-Memory Scatter-Gather
di: Shin, Changmin, et al.
Pubblicazione: (2025)
di: Shin, Changmin, et al.
Pubblicazione: (2025)
Exploring the Design Space for Message-Driven Systems for Dynamic Graph Processing using CCA
di: Chandio, Bibrak Qamar, et al.
Pubblicazione: (2024)
di: Chandio, Bibrak Qamar, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Ten-Four: An Open-Source Fused Dot Product Unit for Mixed-Precision GPGPU Tensor Cores
di: Rout, Nikhil, et al.
Pubblicazione: (2025) -
FlexiBit: Fully Flexible Precision Bit-parallel Accelerator Architecture for Arbitrary Mixed Precision AI
di: Tahmasebi, Faraz, et al.
Pubblicazione: (2024) -
Lincoln AI Computing Survey (LAICS) and Trends
di: Reuther, Albert, et al.
Pubblicazione: (2025) -
Dataflow & Tiling Strategies in Edge-AI FPGA Accelerators: A Comprehensive Literature Review
di: Li, Richie
Pubblicazione: (2025) -
D-com: Accelerating Iterative Processing to Enable Low-rank Decomposition of Activations
di: Tahmasebi, Faraz, et al.
Pubblicazione: (2025)