Enregistré dans:
| Auteurs principaux: | Wu, Hongbang, Chen, Xuesi, Jadhav, Shubham, Lal, Amit, Pentecost, Lillian, Gupta, Udit |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | https://arxiv.org/abs/2602.05018 |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
CarbonClarity: Understanding and Addressing Uncertainty in Embodied Carbon for Sustainable Computing
par: Chen, Xuesi, et autres
Publié: (2025)
par: Chen, Xuesi, et autres
Publié: (2025)
A Reconfigurable Time-Domain In-Memory Computing Macro using FeFET-Based CAM with Multilevel Delay Calibration in 28 nm CMOS
par: Mattar, Jeries, et autres
Publié: (2025)
par: Mattar, Jeries, et autres
Publié: (2025)
Towards Understanding Systems Trade-offs in Retrieval-Augmented Generation Model Inference
par: Shen, Michael, et autres
Publié: (2024)
par: Shen, Michael, et autres
Publié: (2024)
A Novel FPGA-based CNN Hardware Accelerator: Optimization for Convolutional Layers using Karatsuba Ofman Multiplier
par: Sarkar, Amit
Publié: (2024)
par: Sarkar, Amit
Publié: (2024)
Enhanced LPDDR4X PHY in 12 nm FinFET
par: Feldmann, Johannes, et autres
Publié: (2025)
par: Feldmann, Johannes, et autres
Publié: (2025)
Hardware vs. Software Implementation of Warp-Level Features in Vortex RISC-V GPU
par: Pu, Huanzhi, et autres
Publié: (2025)
par: Pu, Huanzhi, et autres
Publié: (2025)
Fast-Locking and High-Resolution Mixed-Mode DLL with Binary Search and Clock Failure Detection for Wide Frequency Ranges in 3-nm FinFET CMOS
par: Wainstein, Nicolás, et autres
Publié: (2025)
par: Wainstein, Nicolás, et autres
Publié: (2025)
RED: Energy Optimization Framework for eDRAM-based PIM with Reconfigurable Voltage Swing and Retention-aware Scheduling
par: Kim, Jae-Young, et autres
Publié: (2025)
par: Kim, Jae-Young, et autres
Publié: (2025)
TeAAL: A Declarative Framework for Modeling Sparse Tensor Accelerators
par: Nayak, Nandeeka, et autres
Publié: (2023)
par: Nayak, Nandeeka, et autres
Publié: (2023)
HERO: Hardware-Efficient RL-based Optimization Framework for NeRF Quantization
par: Zhang, Yipu, et autres
Publié: (2025)
par: Zhang, Yipu, et autres
Publié: (2025)
Weight Transformations in Bit-Sliced Crossbar Arrays for Fault Tolerant Computing-in-Memory: Design Techniques and Evaluation Framework
par: Malhotra, Akul, et autres
Publié: (2025)
par: Malhotra, Akul, et autres
Publié: (2025)
Occamy: A 432-Core Dual-Chiplet Dual-HBM2E 768-DP-GFLOP/s RISC-V System for 8-to-64-bit Dense and Sparse Computing in 12nm FinFET
par: Scheffler, Paul, et autres
Publié: (2025)
par: Scheffler, Paul, et autres
Publié: (2025)
Holistic Optimization Framework for FPGA Accelerators
par: Pouget, Stéphane, et autres
Publié: (2025)
par: Pouget, Stéphane, et autres
Publié: (2025)
SnipSnap: A Joint Compression Format and Dataflow Co-Optimization Framework for Efficient Sparse LLM Accelerator Design
par: Wu, Junyi, et autres
Publié: (2025)
par: Wu, Junyi, et autres
Publié: (2025)
HCiM: ADC-Less Hybrid Analog-Digital Compute in Memory Accelerator for Deep Learning Workloads
par: Negi, Shubham, et autres
Publié: (2024)
par: Negi, Shubham, et autres
Publié: (2024)
Investigating Energy Bounds of Analog Compute-in-Memory with Local Normalization
par: Rojkov, Brian, et autres
Publié: (2026)
par: Rojkov, Brian, et autres
Publié: (2026)
ReTern: Exploiting Natural Redundancy and Sign Transformations for Enhanced Fault Tolerance in Compute-in-Memory based Ternary LLMs
par: Malhotra, Akul, et autres
Publié: (2025)
par: Malhotra, Akul, et autres
Publié: (2025)
Occamy: A 432-Core 28.1 DP-GFLOP/s/W 83% FPU Utilization Dual-Chiplet, Dual-HBM2E RISC-V-based Accelerator for Stencil and Sparse Linear Algebra Computations with 8-to-64-bit Floating-Point Support in 12nm FinFET
par: Paulin, Gianna, et autres
Publié: (2024)
par: Paulin, Gianna, et autres
Publié: (2024)
CODMAS: A Dialectic Multi-Agent Collaborative Framework for Structured RTL Optimization
par: Chang, Che-Ming, et autres
Publié: (2026)
par: Chang, Che-Ming, et autres
Publié: (2026)
CHICO-Agent: An LLM Agent for the Cross-layer Optimization of 2.5D and 3D Chiplet-based Systems
par: Wu, Qihang, et autres
Publié: (2026)
par: Wu, Qihang, et autres
Publié: (2026)
AXON: An Automated Netlist Optimization Framework for High-Speed Adders
par: Yang, Tiantian, et autres
Publié: (2026)
par: Yang, Tiantian, et autres
Publié: (2026)
Python-based DSL for generating Verilog model of Synchronous Digital Circuits
par: Datar, Mandar, et autres
Publié: (2024)
par: Datar, Mandar, et autres
Publié: (2024)
CATCH: a Cost Analysis Tool for Co-optimization of chiplet-based Heterogeneous systems
par: Graening, Alexander, et autres
Publié: (2025)
par: Graening, Alexander, et autres
Publié: (2025)
Orthrus: Dual-Loop Automated Framework for System-Technology Co-Optimization
par: Ren, Yi, et autres
Publié: (2025)
par: Ren, Yi, et autres
Publié: (2025)
ECO-CHIP: Estimation of Carbon Footprint of Chiplet-based Architectures for Sustainable VLSI
par: Sudarshan, Chetan Choppali, et autres
Publié: (2023)
par: Sudarshan, Chetan Choppali, et autres
Publié: (2023)
HALO: Memory-Centric Heterogeneous Accelerator with 2.5D Integration for Low-Batch LLM Inference
par: Negi, Shubham, et autres
Publié: (2025)
par: Negi, Shubham, et autres
Publié: (2025)
An Optimizing Framework on MLIR for Efficient FPGA-based Accelerator Generation
par: Zhang, Weichuang, et autres
Publié: (2024)
par: Zhang, Weichuang, et autres
Publié: (2024)
ML-based AIG Timing Prediction to Enhance Logic Optimization
par: Jiang, Wenjing, et autres
Publié: (2024)
par: Jiang, Wenjing, et autres
Publié: (2024)
UFO-MAC: A Unified Framework for Optimization of High-Performance Multipliers and Multiply-Accumulators
par: Zuo, Dongsheng, et autres
Publié: (2024)
par: Zuo, Dongsheng, et autres
Publié: (2024)
ApproxPilot: A GNN-based Accelerator Approximation Framework
par: Zhang, Qing, et autres
Publié: (2024)
par: Zhang, Qing, et autres
Publié: (2024)
CIMPool: Scalable Neural Network Acceleration for Compute-In-Memory using Weight Pools
par: Li, Shurui, et autres
Publié: (2025)
par: Li, Shurui, et autres
Publié: (2025)
Optimizing and Exploring System Performance in Compact Processing-in-Memory-based Chips
par: Chen, Peilin, et autres
Publié: (2025)
par: Chen, Peilin, et autres
Publié: (2025)
FeNOMS: Enhancing Open Modification Spectral Library Search with In-Storage Processing on Ferroelectric NAND (FeNAND) Flash
par: Pinge, Sumukh, et autres
Publié: (2025)
par: Pinge, Sumukh, et autres
Publié: (2025)
PIMSIM-NN: An ISA-based Simulation Framework for Processing-in-Memory Accelerators
par: Wang, Xinyu, et autres
Publié: (2024)
par: Wang, Xinyu, et autres
Publié: (2024)
Chiplet-Gym: Optimizing Chiplet-based AI Accelerator Design with Reinforcement Learning
par: Mishty, Kaniz, et autres
Publié: (2024)
par: Mishty, Kaniz, et autres
Publié: (2024)
CATransformers: Carbon Aware Transformers Through Joint Model-Hardware Optimization
par: Wang, Irene, et autres
Publié: (2025)
par: Wang, Irene, et autres
Publié: (2025)
BinSparX: Sparsified Binary Neural Networks for Reduced Hardware Non-Idealities in Xbar Arrays
par: Malhotra, Akul, et autres
Publié: (2024)
par: Malhotra, Akul, et autres
Publié: (2024)
CAMASim: A Comprehensive Simulation Framework for Content-Addressable Memory based Accelerators
par: Li, Mengyuan, et autres
Publié: (2024)
par: Li, Mengyuan, et autres
Publié: (2024)
Hardware Software Optimizations for Fast Model Recovery on Reconfigurable Architectures
par: Xu, Bin, et autres
Publié: (2025)
par: Xu, Bin, et autres
Publié: (2025)
Link Quality Aware Pathfinding for Chiplet Interconnects
par: Yen, Aaron, et autres
Publié: (2026)
par: Yen, Aaron, et autres
Publié: (2026)
Documents similaires
-
CarbonClarity: Understanding and Addressing Uncertainty in Embodied Carbon for Sustainable Computing
par: Chen, Xuesi, et autres
Publié: (2025) -
A Reconfigurable Time-Domain In-Memory Computing Macro using FeFET-Based CAM with Multilevel Delay Calibration in 28 nm CMOS
par: Mattar, Jeries, et autres
Publié: (2025) -
Towards Understanding Systems Trade-offs in Retrieval-Augmented Generation Model Inference
par: Shen, Michael, et autres
Publié: (2024) -
A Novel FPGA-based CNN Hardware Accelerator: Optimization for Convolutional Layers using Karatsuba Ofman Multiplier
par: Sarkar, Amit
Publié: (2024) -
Enhanced LPDDR4X PHY in 12 nm FinFET
par: Feldmann, Johannes, et autres
Publié: (2025)