Salvato in:
| Autori principali: | Adnan, Muhammad, Maboud, Yassaman Ebrahimzadeh, Mahajan, Divya, Nair, Prashant J. |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2021
|
| Soggetti: | |
| Accesso online: | https://arxiv.org/abs/2103.00686 |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Heterogeneous Acceleration Pipeline for Recommendation System Training
di: Adnan, Muhammad, et al.
Pubblicazione: (2022)
di: Adnan, Muhammad, et al.
Pubblicazione: (2022)
Accelerating Recommender Model Training by Dynamically Skipping Stale Embeddings
di: Maboud, Yassaman Ebrahimzadeh, et al.
Pubblicazione: (2024)
di: Maboud, Yassaman Ebrahimzadeh, et al.
Pubblicazione: (2024)
Chameleon: A MatMul-Free Temporal Convolutional Network Accelerator for End-to-End Few-Shot and Continual Learning from Sequential Data
di: Blanken, Douwe den, et al.
Pubblicazione: (2025)
di: Blanken, Douwe den, et al.
Pubblicazione: (2025)
Hourglass Sorting: A novel parallel sorting algorithm and its implementation
di: Bascones, Daniel, et al.
Pubblicazione: (2025)
di: Bascones, Daniel, et al.
Pubblicazione: (2025)
CXL-ClusterSim: Modeling CXL-based Disaggregated Memory Cluster for Pooling and Sharing using gem5 and SST
di: Goswami, Kaustav, et al.
Pubblicazione: (2026)
di: Goswami, Kaustav, et al.
Pubblicazione: (2026)
parti-gem5: gem5's Timing Mode Parallelised
di: Cubero-Cascante, José, et al.
Pubblicazione: (2023)
di: Cubero-Cascante, José, et al.
Pubblicazione: (2023)
FPGA-Accelerated RISC-V ISA Extensions for Efficient Neural Network Inference on Edge Devices
di: Parameshwara, Arya, et al.
Pubblicazione: (2025)
di: Parameshwara, Arya, et al.
Pubblicazione: (2025)
Workload-Aware Hardware Accelerator Mining for Distributed Deep Learning Training
di: Adnan, Muhammad, et al.
Pubblicazione: (2024)
di: Adnan, Muhammad, et al.
Pubblicazione: (2024)
Widening the Role of Group Recommender Systems with CAJO
di: Ricci, Francesco, et al.
Pubblicazione: (2025)
di: Ricci, Francesco, et al.
Pubblicazione: (2025)
OpenEye: A Scalable Open-Source Hardware Accelerator for DNNs
di: Lebold, Denis, et al.
Pubblicazione: (2026)
di: Lebold, Denis, et al.
Pubblicazione: (2026)
ChipCraftBrain: Validation-First RTL Generation via Multi-Agent Orchestration
di: Eryilmaz, Cagri
Pubblicazione: (2026)
di: Eryilmaz, Cagri
Pubblicazione: (2026)
T-Norm Operators for EU AI Act Compliance Classification: An Empirical Comparison of Lukasiewicz, Product, and Gödel Semantics in a Neuro-Symbolic Reasoning System
di: Laabs, Adam
Pubblicazione: (2026)
di: Laabs, Adam
Pubblicazione: (2026)
Is Finer Better? The Limits of Microscaling Formats in Large Language Models
di: Fasoli, Andrea, et al.
Pubblicazione: (2026)
di: Fasoli, Andrea, et al.
Pubblicazione: (2026)
CORE: Constraint-Aware One-Step Reinforcement Learning for Simulation-Guided Neural Network Accelerator Design
di: Xiao, Yifeng, et al.
Pubblicazione: (2025)
di: Xiao, Yifeng, et al.
Pubblicazione: (2025)
Augmenting Replay in World Models for Continual Reinforcement Learning
di: Yang, Luke, et al.
Pubblicazione: (2024)
di: Yang, Luke, et al.
Pubblicazione: (2024)
Photonic AI: A Hybrid Diffractive Holographic Neural System for Passive Optical Real-Time Image Classification
di: Hiremath, Prakul Sunil
Pubblicazione: (2026)
di: Hiremath, Prakul Sunil
Pubblicazione: (2026)
Deep Learning-Based Early-Stage IR-Drop Estimation via CNN Surrogate Modeling
di: Bhadana, Ritesh
Pubblicazione: (2026)
di: Bhadana, Ritesh
Pubblicazione: (2026)
Exploring LLM-based Verilog Code Generation with Data-Efficient Fine-Tuning and Testbench Automation
di: Chen, Mu-Chi, et al.
Pubblicazione: (2026)
di: Chen, Mu-Chi, et al.
Pubblicazione: (2026)
Expanding continual few-shot learning benchmarks to include recognition of specific instances
di: Kowadlo, Gideon, et al.
Pubblicazione: (2022)
di: Kowadlo, Gideon, et al.
Pubblicazione: (2022)
5G Traffic Prediction with Time Series Analysis
di: Nayak, Nikhil, et al.
Pubblicazione: (2021)
di: Nayak, Nikhil, et al.
Pubblicazione: (2021)
Biological Intuition on Digital Hardware: An RTL Implementation of Poisson-Encoded SNNs for Static Image Classification
di: Das, Debabrata, et al.
Pubblicazione: (2026)
di: Das, Debabrata, et al.
Pubblicazione: (2026)
Keyformer: KV Cache Reduction through Key Tokens Selection for Efficient Generative Inference
di: Adnan, Muhammad, et al.
Pubblicazione: (2024)
di: Adnan, Muhammad, et al.
Pubblicazione: (2024)
SoK: Where's the "up"?! A Comprehensive (bottom-up) Study on the Security of Arm Cortex-M Systems
di: Tan, Xi, et al.
Pubblicazione: (2024)
di: Tan, Xi, et al.
Pubblicazione: (2024)
SiliconMind-V1: Multi-Agent Distillation and Debug-Reasoning Workflows for Verilog Code Generation
di: Chen, Mu-Chi, et al.
Pubblicazione: (2026)
di: Chen, Mu-Chi, et al.
Pubblicazione: (2026)
Machine Learning for Energy-Performance-aware Scheduling
di: Hu, Zheyuan, et al.
Pubblicazione: (2026)
di: Hu, Zheyuan, et al.
Pubblicazione: (2026)
NotSoTiny: A Large, Living Benchmark for RTL Code Generation
di: Ghorab, Razine Moundir, et al.
Pubblicazione: (2025)
di: Ghorab, Razine Moundir, et al.
Pubblicazione: (2025)
TuRTLe: A Unified Evaluation of LLMs for RTL Generation
di: Garcia-Gasulla, Dario, et al.
Pubblicazione: (2025)
di: Garcia-Gasulla, Dario, et al.
Pubblicazione: (2025)
Nonvolatile Charge-Domain Attention with HZO Ferroelectric Capacitors: A Simulation-Based Device-to-System Evaluation
di: Abouagour, Faris
Pubblicazione: (2026)
di: Abouagour, Faris
Pubblicazione: (2026)
Bridging SFT and DPO for Diffusion Model Alignment with Self-Sampling Preference Optimization
di: Zhang, Daoan, et al.
Pubblicazione: (2024)
di: Zhang, Daoan, et al.
Pubblicazione: (2024)
CPU Simulation with Ranked Set Sampling and Repeated Subsampling
di: Ekman, Magnus
Pubblicazione: (2026)
di: Ekman, Magnus
Pubblicazione: (2026)
CPU Simulation Using Two-Phase Stratified Sampling
di: Ekman, Magnus
Pubblicazione: (2026)
di: Ekman, Magnus
Pubblicazione: (2026)
Binary Image-Based Intrusion Detection for Operational Technology Networks: Extending the SPHBI Methodology from IoT to Modbus TCP
di: Omar, Aamir
Pubblicazione: (2026)
di: Omar, Aamir
Pubblicazione: (2026)
Systolic Arrays and Structured Pruning Co-design for Efficient Transformers in Edge Systems
di: Palacios, Pedro, et al.
Pubblicazione: (2024)
di: Palacios, Pedro, et al.
Pubblicazione: (2024)
FREESS: A Web-Based Educational Simulator for a RISC-V-Inspired Superscalar Processor with Tomasulo-Style Dynamic Scheduling
di: Giorgi, Roberto, et al.
Pubblicazione: (2026)
di: Giorgi, Roberto, et al.
Pubblicazione: (2026)
GainSight: A Unified Framework for Data Lifetime Profiling and Heterogeneous Memory Composition
di: Li, Peijing, et al.
Pubblicazione: (2025)
di: Li, Peijing, et al.
Pubblicazione: (2025)
A flexible framework for early power and timing comparison of time-multiplexed CGRA kernel executions
di: Aspros, Maxime Henri, et al.
Pubblicazione: (2025)
di: Aspros, Maxime Henri, et al.
Pubblicazione: (2025)
Deep learning in a bilateral brain with hemispheric specialization
di: Rajagopalan, Chandramouli, et al.
Pubblicazione: (2022)
di: Rajagopalan, Chandramouli, et al.
Pubblicazione: (2022)
Efficient Telecom Specific LLM: TSLAM-Mini with QLoRA and Digital Twin Data
di: Ethiraj, Vignesh, et al.
Pubblicazione: (2025)
di: Ethiraj, Vignesh, et al.
Pubblicazione: (2025)
Sonar Image Datasets: A Comprehensive Survey of Resources, Challenges, and Applications
di: Gomes, Larissa S., et al.
Pubblicazione: (2025)
di: Gomes, Larissa S., et al.
Pubblicazione: (2025)
The Monte Carlo Method and New Device and Architectural Techniques for Accelerating It
di: Petangoda, Janith, et al.
Pubblicazione: (2025)
di: Petangoda, Janith, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Heterogeneous Acceleration Pipeline for Recommendation System Training
di: Adnan, Muhammad, et al.
Pubblicazione: (2022) -
Accelerating Recommender Model Training by Dynamically Skipping Stale Embeddings
di: Maboud, Yassaman Ebrahimzadeh, et al.
Pubblicazione: (2024) -
Chameleon: A MatMul-Free Temporal Convolutional Network Accelerator for End-to-End Few-Shot and Continual Learning from Sequential Data
di: Blanken, Douwe den, et al.
Pubblicazione: (2025) -
Hourglass Sorting: A novel parallel sorting algorithm and its implementation
di: Bascones, Daniel, et al.
Pubblicazione: (2025) -
CXL-ClusterSim: Modeling CXL-based Disaggregated Memory Cluster for Pooling and Sharing using gem5 and SST
di: Goswami, Kaustav, et al.
Pubblicazione: (2026)