InsightBoard: An Interactive Multi-Metric Visualization and Fairness Analysis Plugin for TensorBoard
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Chen, Ray Zeyao, Grant, Christan |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
FLAASH: Flexible Accelerator Architecture for Sparse High-Order Tensor Contraction
par: Kulp, Gabriel, et autres
Publié: (2024)
par: Kulp, Gabriel, et autres
Publié: (2024)
JExplore: Design Space Exploration Tool for Nvidia Jetson Boards
par: Kutukcu, Basar, et autres
Publié: (2025)
par: Kutukcu, Basar, et autres
Publié: (2025)
Periodic Online Testing for Sparse Systolic Tensor Arrays
par: Peltekis, Christodoulos, et autres
Publié: (2025)
par: Peltekis, Christodoulos, et autres
Publié: (2025)
Hardware-Efficient Photonic Tensor Core: Accelerating Deep Neural Networks with Structured Compression
par: Ning, Shupeng, et autres
Publié: (2025)
par: Ning, Shupeng, et autres
Publié: (2025)
Accelerating Sparse Graph Neural Networks with Tensor Core Optimization
par: Wu, Ka Wai
Publié: (2024)
par: Wu, Ka Wai
Publié: (2024)
Tender: Accelerating Large Language Models via Tensor Decomposition and Runtime Requantization
par: Lee, Jungi, et autres
Publié: (2024)
par: Lee, Jungi, et autres
Publié: (2024)
TCL: Enabling Fast and Efficient Cross-Hardware Tensor Program Optimization via Continual Learning
par: Shen, Chaoyao, et autres
Publié: (2026)
par: Shen, Chaoyao, et autres
Publié: (2026)
Exploring the Performance Improvement of Tensor Processing Engines through Transformation in the Bit-weight Dimension of MACs
par: Wu, Qizhe, et autres
Publié: (2025)
par: Wu, Qizhe, et autres
Publié: (2025)
SCRec: A Scalable Computational Storage System with Statistical Sharding and Tensor-train Decomposition for Recommendation Models
par: Yang, Jinho, et autres
Publié: (2025)
par: Yang, Jinho, et autres
Publié: (2025)
Breaking the Tuning Barrier: Zero-Hyperparameters Yield Multi-Corner Analysis Via Learned Priors
par: Xing, Wei W., et autres
Publié: (2026)
par: Xing, Wei W., et autres
Publié: (2026)
Exploring the Limitations of Kolmogorov-Arnold Networks in Classification: Insights to Software Training and Hardware Implementation
par: Tran, Van Duy, et autres
Publié: (2024)
par: Tran, Van Duy, et autres
Publié: (2024)
LLM-Aided Compilation for Tensor Accelerators
par: Hong, Charles, et autres
Publié: (2024)
par: Hong, Charles, et autres
Publié: (2024)
MAGE: A Multi-Agent Engine for Automated RTL Code Generation
par: Zhao, Yujie, et autres
Publié: (2024)
par: Zhao, Yujie, et autres
Publié: (2024)
Federated Knowledge Distillation for Multi-Model Architectures Lithography Hotspot Detection
par: Li, Yuqi, et autres
Publié: (2025)
par: Li, Yuqi, et autres
Publié: (2025)
Binary Weight Multi-Bit Activation Quantization for Compute-in-Memory CNN Accelerators
par: Zhou, Wenyong, et autres
Publié: (2025)
par: Zhou, Wenyong, et autres
Publié: (2025)
RLPlanner: Reinforcement Learning based Floorplanning for Chiplets with Fast Thermal Analysis
par: Duan, Yuanyuan, et autres
Publié: (2023)
par: Duan, Yuanyuan, et autres
Publié: (2023)
Performance Analysis of DNN Inference/Training with Convolution and non-Convolution Operations
par: Esmaeilzadeh, Hadi, et autres
Publié: (2023)
par: Esmaeilzadeh, Hadi, et autres
Publié: (2023)
MAx-DNN: Multi-Level Arithmetic Approximation for Energy-Efficient DNN Hardware Accelerators
par: Leon, Vasileios, et autres
Publié: (2025)
par: Leon, Vasileios, et autres
Publié: (2025)
From Principles to Practice: A Systematic Study of LLM Serving on Multi-core NPUs
par: Zhu, Tianhao, et autres
Publié: (2025)
par: Zhu, Tianhao, et autres
Publié: (2025)
HWE-Bench: Can Language Models Perform Board-level Schematic Designs?
par: Qiu, Weibo, et autres
Publié: (2026)
par: Qiu, Weibo, et autres
Publié: (2026)
LEGO: Spatial Accelerator Generation and Optimization for Tensor Applications
par: Lin, Yujun, et autres
Publié: (2025)
par: Lin, Yujun, et autres
Publié: (2025)
Cross-Layer Co-Optimized LSTM Accelerator for Real-Time Gait Analysis
par: Ahmadilivani, Mohammad Hasan, et autres
Publié: (2026)
par: Ahmadilivani, Mohammad Hasan, et autres
Publié: (2026)
AI Accelerators for Large Language Model Inference: Architecture Analysis and Scaling Strategies
par: Sharma, Amit
Publié: (2025)
par: Sharma, Amit
Publié: (2025)
RTLSeek: Boosting the LLM-Based RTL Generation with Multi-Stage Diversity-Oriented Reinforcement Learning
par: Zhang, Xinyu, et autres
Publié: (2026)
par: Zhang, Xinyu, et autres
Publié: (2026)
AnalogSAGE: Self-evolving Analog Design Multi-Agents with Stratified Memory and Grounded Experience
par: Wang, Zining, et autres
Publié: (2025)
par: Wang, Zining, et autres
Publié: (2025)
CapBench: A Multi-PDK Dataset for Machine-Learning-Based Post-Layout Capacitance Extraction
par: Rodriguez, Hector R., et autres
Publié: (2026)
par: Rodriguez, Hector R., et autres
Publié: (2026)
Explainable Fuzzy Neural Network with Multi-Fidelity Reinforcement Learning for Micro-Architecture Design Space Exploration
par: Fan, Hanwei, et autres
Publié: (2024)
par: Fan, Hanwei, et autres
Publié: (2024)
Tensor-Compressed and Fully-Quantized Training of Neural PDE Solvers
par: Lu, Jinming, et autres
Publié: (2025)
par: Lu, Jinming, et autres
Publié: (2025)
Optimal Software Pipelining and Warp Specialization for Tensor Core GPUs
par: Soi, Rupanshu, et autres
Publié: (2025)
par: Soi, Rupanshu, et autres
Publié: (2025)
Streaming Tensor Programs: A Streaming Abstraction for Dynamic Parallelism
par: Sohn, Gina, et autres
Publié: (2025)
par: Sohn, Gina, et autres
Publié: (2025)
SetupKit: Efficient Multi-Corner Setup/Hold Time Characterization Using Bias-Enhanced Interpolation and Active Learning
par: Zhou, Junzhuo, et autres
Publié: (2025)
par: Zhou, Junzhuo, et autres
Publié: (2025)
End-to-End Transformer Acceleration Through Processing-in-Memory Architectures
par: Yang, Xiaoxuan, et autres
Publié: (2025)
par: Yang, Xiaoxuan, et autres
Publié: (2025)
Ultra Memory-Efficient On-FPGA Training of Transformers via Tensor-Compressed Optimization
par: Tian, Jiayi, et autres
Publié: (2025)
par: Tian, Jiayi, et autres
Publié: (2025)
APT-LLM: Exploiting Arbitrary-Precision Tensor Core Computing for LLM Acceleration
par: Ma, Shaobo, et autres
Publié: (2025)
par: Ma, Shaobo, et autres
Publié: (2025)
Efficient Arbitrary Precision Acceleration for Large Language Models on GPU Tensor Cores
par: Ma, Shaobo, et autres
Publié: (2024)
par: Ma, Shaobo, et autres
Publié: (2024)
MoE-GPS: Guidlines for Prediction Strategy for Dynamic Expert Duplication in MoE Load Balancing
par: Ma, Haiyue, et autres
Publié: (2025)
par: Ma, Haiyue, et autres
Publié: (2025)
L3: DIMM-PIM Integrated Architecture and Coordination for Scalable Long-Context LLM Inference
par: Liu, Qingyuan, et autres
Publié: (2025)
par: Liu, Qingyuan, et autres
Publié: (2025)
Algorithm and Hardware Co-Design for Efficient Complex-Valued Uncertainty Estimation
par: Zhang, Zehuan, et autres
Publié: (2026)
par: Zhang, Zehuan, et autres
Publié: (2026)
BBS: Bi-directional Bit-level Sparsity for Deep Learning Acceleration
par: Chen, Yuzong, et autres
Publié: (2024)
par: Chen, Yuzong, et autres
Publié: (2024)
EVA: Accelerating LLM Decoding via an Efficient Vector Quantization Architecture
par: Duan, Bowen, et autres
Publié: (2026)
par: Duan, Bowen, et autres
Publié: (2026)
Documents similaires
-
FLAASH: Flexible Accelerator Architecture for Sparse High-Order Tensor Contraction
par: Kulp, Gabriel, et autres
Publié: (2024) -
JExplore: Design Space Exploration Tool for Nvidia Jetson Boards
par: Kutukcu, Basar, et autres
Publié: (2025) -
Periodic Online Testing for Sparse Systolic Tensor Arrays
par: Peltekis, Christodoulos, et autres
Publié: (2025) -
Hardware-Efficient Photonic Tensor Core: Accelerating Deep Neural Networks with Structured Compression
par: Ning, Shupeng, et autres
Publié: (2025) -
Accelerating Sparse Graph Neural Networks with Tensor Core Optimization
par: Wu, Ka Wai
Publié: (2024)