Active Imitation Learning for Thermal- and Kernel-Aware LFM Inference on 3D S-NUCA Many-Cores
Fuente:
arXiv
Salvato in:
| Autori principali: | Shen, Yixian, Shen, Chaoyao, Deen, Jan, Floros, George, Pimentel, Andy, Pathania, Anuj |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Energy-Efficient QoS-Aware Scheduling for S-NUCA Many-Cores
di: Wasala, Sudam M., et al.
Pubblicazione: (2025)
di: Wasala, Sudam M., et al.
Pubblicazione: (2025)
TCL: Enabling Fast and Efficient Cross-Hardware Tensor Program Optimization via Continual Learning
di: Shen, Chaoyao, et al.
Pubblicazione: (2026)
di: Shen, Chaoyao, et al.
Pubblicazione: (2026)
Workload-Aware Early-Stage Power Delivery Network Optimization via Architectural Power Traces
di: Hayes, Oran, et al.
Pubblicazione: (2026)
di: Hayes, Oran, et al.
Pubblicazione: (2026)
Multi-Partner Project: COIN-3D -- Collaborative Innovation in 3D VLSI Reliability
di: Gourdoumanis, George Rafael, et al.
Pubblicazione: (2026)
di: Gourdoumanis, George Rafael, et al.
Pubblicazione: (2026)
Design-Oriented Modeling of TSV Substrate Noise Coupling to Ring VCOs
di: Exouzidis, Ilias, et al.
Pubblicazione: (2026)
di: Exouzidis, Ilias, et al.
Pubblicazione: (2026)
TensorPool: A 3D-Stacked 8.4TFLOPS/4.3W Many-Core Domain-Specific Processor for AI-Native Radio Access Networks
di: Bertuletti, Marco, et al.
Pubblicazione: (2026)
di: Bertuletti, Marco, et al.
Pubblicazione: (2026)
D-Legion: A Scalable Many-Core Architecture for Accelerating Matrix Multiplication in Quantized LLMs
di: Abdelmaksoud, Ahmed J., et al.
Pubblicazione: (2026)
di: Abdelmaksoud, Ahmed J., et al.
Pubblicazione: (2026)
ControlPULP: A RISC-V On-Chip Parallel Power Controller for Many-Core HPC Processors with FPGA-Based Hardware-In-The-Loop Power and Thermal Emulation
di: Ottaviano, Alessandro, et al.
Pubblicazione: (2023)
di: Ottaviano, Alessandro, et al.
Pubblicazione: (2023)
Thermal-Aware Floorplanner for 3D IC, including TSVs, Liquid Microchannels and Thermal Domains Optimization
di: Cuesta, David, et al.
Pubblicazione: (2024)
di: Cuesta, David, et al.
Pubblicazione: (2024)
Towards Efficient and Accurate Detection of On-Chip Fail-Slow Failures for Many-Core Accelerators
di: Wu, Junchi, et al.
Pubblicazione: (2025)
di: Wu, Junchi, et al.
Pubblicazione: (2025)
Tasa: Thermal-aware 3D-Stacked Architecture Design with Bandwidth Sharing for LLM Inference
di: He, Siyuan, et al.
Pubblicazione: (2025)
di: He, Siyuan, et al.
Pubblicazione: (2025)
Towards Understanding Systems Trade-offs in Retrieval-Augmented Generation Model Inference
di: Shen, Michael, et al.
Pubblicazione: (2024)
di: Shen, Michael, et al.
Pubblicazione: (2024)
Commercial Evaluation of Zero-Skipping MAC Design for Bit Sparsity Exploitation in DL Inference
di: Nair, Harideep, et al.
Pubblicazione: (2024)
di: Nair, Harideep, et al.
Pubblicazione: (2024)
Context-aware Simopt-Power: Using structural data with simulation metadata to optimise FPGA designs
di: Wadhwa, Eashan, et al.
Pubblicazione: (2026)
di: Wadhwa, Eashan, et al.
Pubblicazione: (2026)
A Multicast-Capable AXI Crossbar for Many-core Machine Learning Accelerators
di: Colagrande, Luca, et al.
Pubblicazione: (2025)
di: Colagrande, Luca, et al.
Pubblicazione: (2025)
Cool-3D: An End-to-End Thermal-Aware Framework for Early-Phase Design Space Exploration of Microfluidic-Cooled 3DICs
di: Wang, Runxi, et al.
Pubblicazione: (2025)
di: Wang, Runxi, et al.
Pubblicazione: (2025)
RACAM: Enhancing DRAM with Reuse-Aware Computation and Automated Mapping for ML Inference
di: Ma, Siyuan, et al.
Pubblicazione: (2025)
di: Ma, Siyuan, et al.
Pubblicazione: (2025)
Reimagining Memory Access for LLM Inference: Compression-Aware Memory Controller Design
di: Xie, Rui, et al.
Pubblicazione: (2025)
di: Xie, Rui, et al.
Pubblicazione: (2025)
ForgeBench: A Machine Learning Benchmark Suite and Auto-Generation Framework for Next-Generation HLS Tools
di: Wanna, Andy, et al.
Pubblicazione: (2025)
di: Wanna, Andy, et al.
Pubblicazione: (2025)
PolyLUT: Ultra-low Latency Polynomial Inference with Hardware-Aware Structured Pruning
di: Andronic, Marta, et al.
Pubblicazione: (2025)
di: Andronic, Marta, et al.
Pubblicazione: (2025)
TENET: An Efficient Sparsity-Aware LUT-Centric Architecture for Ternary LLM Inference On Edge
di: Huang, Zhirui, et al.
Pubblicazione: (2025)
di: Huang, Zhirui, et al.
Pubblicazione: (2025)
Faster Inference of LLMs using FP8 on the Intel Gaudi
di: Lee, Joonhyung, et al.
Pubblicazione: (2025)
di: Lee, Joonhyung, et al.
Pubblicazione: (2025)
MultiVic: A Time-Predictable RISC-V Multi-Core Processor Optimized for Neural Network Inference
di: Kirschner, Maximilian, et al.
Pubblicazione: (2025)
di: Kirschner, Maximilian, et al.
Pubblicazione: (2025)
High Utilization Energy-Aware Real-Time Inference Deep Convolutional Neural Network Accelerator
di: Lin, Kuan-Ting, et al.
Pubblicazione: (2025)
di: Lin, Kuan-Ting, et al.
Pubblicazione: (2025)
THERMOS: Thermally-Aware Multi-Objective Scheduling of AI Workloads on Heterogeneous Multi-Chiplet PIM Architectures
di: Kanani, Alish, et al.
Pubblicazione: (2025)
di: Kanani, Alish, et al.
Pubblicazione: (2025)
A Dataflow Compiler for Efficient LLM Inference using Custom Microscaling Formats
di: Cheng, Jianyi, et al.
Pubblicazione: (2023)
di: Cheng, Jianyi, et al.
Pubblicazione: (2023)
DCI: A Coordinated Allocation and Filling Workload-Aware Dual-Cache Allocation GNN Inference Acceleration System
di: Luo, Yi, et al.
Pubblicazione: (2025)
di: Luo, Yi, et al.
Pubblicazione: (2025)
A Review of Multiscale Thermal Modeling in Heterogeneous 3D ICs
di: Barua, Baibhari Priya, et al.
Pubblicazione: (2026)
di: Barua, Baibhari Priya, et al.
Pubblicazione: (2026)
MFIT: Multi-Fidelity Thermal Modeling for 2.5D and 3D Multi-Chiplet Architectures
di: Pfromm, Lukas, et al.
Pubblicazione: (2024)
di: Pfromm, Lukas, et al.
Pubblicazione: (2024)
DPUConfig: Optimizing ML Inference in FPGAs Using Reinforcement Learning
di: Patras, Alexandros, et al.
Pubblicazione: (2026)
di: Patras, Alexandros, et al.
Pubblicazione: (2026)
TRAPTI: Time-Resolved Analysis for SRAM Banking and Power Gating Optimization in Embedded Transformer Inference
di: Klhufek, Jan, et al.
Pubblicazione: (2026)
di: Klhufek, Jan, et al.
Pubblicazione: (2026)
SRAM-PG: Power Delivery Network Benchmarks from SRAM Circuits
di: Shen, Shan, et al.
Pubblicazione: (2024)
di: Shen, Shan, et al.
Pubblicazione: (2024)
vMCU: Coordinated Memory Management and Kernel Optimization for DNN Inference on MCUs
di: Zheng, Size, et al.
Pubblicazione: (2024)
di: Zheng, Size, et al.
Pubblicazione: (2024)
Efficient Sparse Processing-in-Memory Architecture (ESPIM) for Machine Learning Inference
di: He, Mingxuan, et al.
Pubblicazione: (2024)
di: He, Mingxuan, et al.
Pubblicazione: (2024)
STAMP-2.5D: Structural and Thermal Aware Methodology for Placement in 2.5D Integration
di: Parekh, Varun Darshana, et al.
Pubblicazione: (2025)
di: Parekh, Varun Darshana, et al.
Pubblicazione: (2025)
PolyLUT: Learning Piecewise Polynomials for Ultra-Low Latency FPGA LUT-based Inference
di: Andronic, Marta, et al.
Pubblicazione: (2023)
di: Andronic, Marta, et al.
Pubblicazione: (2023)
LLM-Powered Code Analysis and Optimization for Gaussian Splatting Kernels
di: Hu, Yi, et al.
Pubblicazione: (2025)
di: Hu, Yi, et al.
Pubblicazione: (2025)
Accelerating Mini-batch HGNN Training by Reducing CUDA Kernels
di: Wu, Meng, et al.
Pubblicazione: (2024)
di: Wu, Meng, et al.
Pubblicazione: (2024)
ChipletPart: Cost-Aware Partitioning for 2.5D Systems
di: Graening, Alexander, et al.
Pubblicazione: (2025)
di: Graening, Alexander, et al.
Pubblicazione: (2025)
NVLLM: A 3D NAND-Centric Architecture Enabling Edge on-Device LLM Inference
di: Hao, Mingbo, et al.
Pubblicazione: (2026)
di: Hao, Mingbo, et al.
Pubblicazione: (2026)
Documenti analoghi
-
Energy-Efficient QoS-Aware Scheduling for S-NUCA Many-Cores
di: Wasala, Sudam M., et al.
Pubblicazione: (2025) -
TCL: Enabling Fast and Efficient Cross-Hardware Tensor Program Optimization via Continual Learning
di: Shen, Chaoyao, et al.
Pubblicazione: (2026) -
Workload-Aware Early-Stage Power Delivery Network Optimization via Architectural Power Traces
di: Hayes, Oran, et al.
Pubblicazione: (2026) -
Multi-Partner Project: COIN-3D -- Collaborative Innovation in 3D VLSI Reliability
di: Gourdoumanis, George Rafael, et al.
Pubblicazione: (2026) -
Design-Oriented Modeling of TSV Substrate Noise Coupling to Ring VCOs
di: Exouzidis, Ilias, et al.
Pubblicazione: (2026)