SparseDVFS: Sparse-Aware DVFS for Energy-Efficient Edge Inference
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Zhang, Ziyang, Wu, Zheshun, Liu, Jie, Mottola, Luca |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2026
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
DVFS-Aware DNN Inference on GPUs: Latency Modeling and Performance Analysis
von: Han, Yunchu, et al.
Veröffentlicht: (2025)
von: Han, Yunchu, et al.
Veröffentlicht: (2025)
Energy-Efficient Computation with DVFS using Deep Reinforcement Learning for Multi-Task Systems in Edge Computing
von: Li, Xinyi, et al.
Veröffentlicht: (2024)
von: Li, Xinyi, et al.
Veröffentlicht: (2024)
SparOA: Sparse and Operator-aware Hybrid Scheduling for Edge DNN Inference
von: Zhang, Ziyang, et al.
Veröffentlicht: (2025)
von: Zhang, Ziyang, et al.
Veröffentlicht: (2025)
E4: Energy-Efficient DNN Inference for Edge Video Analytics Via Early-Exit and DVFS
von: Zhang, Ziyang, et al.
Veröffentlicht: (2025)
von: Zhang, Ziyang, et al.
Veröffentlicht: (2025)
Reducing Compute Waste in LLMs through Kernel-Level DVFS
von: Spaan, Jeffrey, et al.
Veröffentlicht: (2026)
von: Spaan, Jeffrey, et al.
Veröffentlicht: (2026)
Modality-Aware Zero-Shot Pruning and Sparse Attention for Efficient Multimodal Edge Inference
von: Sui, Yueyuan, et al.
Veröffentlicht: (2026)
von: Sui, Yueyuan, et al.
Veröffentlicht: (2026)
R-Sparse: Rank-Aware Activation Sparsity for Efficient LLM Inference
von: Zhang, Zhenyu, et al.
Veröffentlicht: (2025)
von: Zhang, Zhenyu, et al.
Veröffentlicht: (2025)
Dissecting the Impact of Mobile DVFS Governors on LLM Inference Performance and Energy Efficiency
von: Zhang, Zongpu, et al.
Veröffentlicht: (2025)
von: Zhang, Zongpu, et al.
Veröffentlicht: (2025)
DualScale: Energy-Efficient Disaggregated LLM Serving via Phase-Aware Placement and DVFS
von: Basit, Omar, et al.
Veröffentlicht: (2026)
von: Basit, Omar, et al.
Veröffentlicht: (2026)
Sparse Optimization for Green Edge AI Inference
von: Yang, Xiangyu, et al.
Veröffentlicht: (2020)
von: Yang, Xiangyu, et al.
Veröffentlicht: (2020)
HiDVFS: A Hierarchical Multi-Agent DVFS Scheduler for OpenMP DAG Workloads
von: Pivezhandi, Mohammad, et al.
Veröffentlicht: (2026)
von: Pivezhandi, Mohammad, et al.
Veröffentlicht: (2026)
ARC: DVFS-Aware Asymmetric-Retention STT-RAM Caches for Energy-Efficient Multicore Processors
von: Gajaria, Dhruv, et al.
Veröffentlicht: (2024)
von: Gajaria, Dhruv, et al.
Veröffentlicht: (2024)
Multi-DNN Inference of Sparse Models on Edge SoCs
von: Luo, Jiawei, et al.
Veröffentlicht: (2026)
von: Luo, Jiawei, et al.
Veröffentlicht: (2026)
Joint Optimization of Offloading, Batching and DVFS for Multiuser Co-Inference
von: Xu, Yaodan, et al.
Veröffentlicht: (2025)
von: Xu, Yaodan, et al.
Veröffentlicht: (2025)
ZO-SAM: Zero-Order Sharpness-Aware Minimization for Efficient Sparse Training
von: Ji, Jie, et al.
Veröffentlicht: (2026)
von: Ji, Jie, et al.
Veröffentlicht: (2026)
Mixture-of-Channels: Exploiting Sparse FFNs for Efficient LLMs Pre-Training and Inference
von: Wu, Tong, et al.
Veröffentlicht: (2025)
von: Wu, Tong, et al.
Veröffentlicht: (2025)
Accelerating Sparse Transformer Inference on GPU
von: Dai, Wenhao, et al.
Veröffentlicht: (2025)
von: Dai, Wenhao, et al.
Veröffentlicht: (2025)
Critical Patch-Aware Sparse Prompting with Decoupled Training for Continual Learning on the Edge
von: Lim, Wonseon, et al.
Veröffentlicht: (2026)
von: Lim, Wonseon, et al.
Veröffentlicht: (2026)
Topology-Aware Revival for Efficient Sparse Training
von: Jin, Meiling, et al.
Veröffentlicht: (2026)
von: Jin, Meiling, et al.
Veröffentlicht: (2026)
Orientation-Aware Sparse Tensor PCA for Efficient Unsupervised Feature Selection
von: Zheng, Junjing, et al.
Veröffentlicht: (2024)
von: Zheng, Junjing, et al.
Veröffentlicht: (2024)
FlexPrefill: A Context-Aware Sparse Attention Mechanism for Efficient Long-Sequence Inference
von: Lai, Xunhao, et al.
Veröffentlicht: (2025)
von: Lai, Xunhao, et al.
Veröffentlicht: (2025)
Sparse Layer Sharpness-Aware Minimization for Efficient Fine-Tuning
von: Cheng, Yifei, et al.
Veröffentlicht: (2026)
von: Cheng, Yifei, et al.
Veröffentlicht: (2026)
Online Optimization for Learning to Communicate over Time-Correlated Channels
von: Wu, Zheshun, et al.
Veröffentlicht: (2024)
von: Wu, Zheshun, et al.
Veröffentlicht: (2024)
Advocating for the Silent: Enhancing Federated Generalization for Non-Participating Clients
von: Wu, Zheshun, et al.
Veröffentlicht: (2023)
von: Wu, Zheshun, et al.
Veröffentlicht: (2023)
AnchorAttention: Difference-Aware Sparse Attention with Stripe Granularity
von: Zhang, Yu, et al.
Veröffentlicht: (2025)
von: Zhang, Yu, et al.
Veröffentlicht: (2025)
Sparse Spectral Training and Inference on Euclidean and Hyperbolic Neural Networks
von: Zhao, Jialin, et al.
Veröffentlicht: (2024)
von: Zhao, Jialin, et al.
Veröffentlicht: (2024)
Fast Inference with Kronecker-Sparse Matrices
von: Gonon, Antoine, et al.
Veröffentlicht: (2024)
von: Gonon, Antoine, et al.
Veröffentlicht: (2024)
FPGA Co-Design for Efficient N:M Sparse and Quantized Model Inference
von: Hsieh, Fen-Yu, et al.
Veröffentlicht: (2025)
von: Hsieh, Fen-Yu, et al.
Veröffentlicht: (2025)
AEGIS: Authentic Edge Growth In Sparsity for Link Prediction in Edge-Sparse Bipartite Knowledge Graphs
von: Liu, Hugh Xuechen, et al.
Veröffentlicht: (2025)
von: Liu, Hugh Xuechen, et al.
Veröffentlicht: (2025)
Learnable Sparse Customization in Heterogeneous Edge Computing
von: Xue, Jingjing, et al.
Veröffentlicht: (2024)
von: Xue, Jingjing, et al.
Veröffentlicht: (2024)
Energy-Efficient Vision Transformer Inference for Edge-AI Deployment
von: Amanzhol, Nursultan, et al.
Veröffentlicht: (2025)
von: Amanzhol, Nursultan, et al.
Veröffentlicht: (2025)
Sparse Orthogonal Variational Inference for Gaussian Processes
von: Shi, Jiaxin, et al.
Veröffentlicht: (2019)
von: Shi, Jiaxin, et al.
Veröffentlicht: (2019)
SparseDM: Toward Sparse Efficient Diffusion Models
von: Wang, Kafeng, et al.
Veröffentlicht: (2024)
von: Wang, Kafeng, et al.
Veröffentlicht: (2024)
Attribute-Efficient PAC Learning of Sparse Halfspaces with Constant Malicious Noise Rate
von: Zeng, Shiwei, et al.
Veröffentlicht: (2025)
von: Zeng, Shiwei, et al.
Veröffentlicht: (2025)
SparseEval: Efficient Evaluation of Large Language Models by Sparse Optimization
von: Zhang, Taolin, et al.
Veröffentlicht: (2026)
von: Zhang, Taolin, et al.
Veröffentlicht: (2026)
Training Bayesian Neural Networks with Sparse Subspace Variational Inference
von: Li, Junbo, et al.
Veröffentlicht: (2024)
von: Li, Junbo, et al.
Veröffentlicht: (2024)
Learning Soft Sparse Shapes for Efficient Time-Series Classification
von: Liu, Zhen, et al.
Veröffentlicht: (2025)
von: Liu, Zhen, et al.
Veröffentlicht: (2025)
On the Necessity of Collaboration for Online Model Selection with Decentralized Data
von: Li, Junfan, et al.
Veröffentlicht: (2024)
von: Li, Junfan, et al.
Veröffentlicht: (2024)
xTern: Energy-Efficient Ternary Neural Network Inference on RISC-V-Based Edge Systems
von: Rutishauser, Georg, et al.
Veröffentlicht: (2024)
von: Rutishauser, Georg, et al.
Veröffentlicht: (2024)
Towards Heterogeneity-Aware and Energy-Efficient Topology Optimization for Decentralized Federated Learning in Edge Environment
von: Liu, Yuze, et al.
Veröffentlicht: (2025)
von: Liu, Yuze, et al.
Veröffentlicht: (2025)
Ähnliche Einträge
-
DVFS-Aware DNN Inference on GPUs: Latency Modeling and Performance Analysis
von: Han, Yunchu, et al.
Veröffentlicht: (2025) -
Energy-Efficient Computation with DVFS using Deep Reinforcement Learning for Multi-Task Systems in Edge Computing
von: Li, Xinyi, et al.
Veröffentlicht: (2024) -
SparOA: Sparse and Operator-aware Hybrid Scheduling for Edge DNN Inference
von: Zhang, Ziyang, et al.
Veröffentlicht: (2025) -
E4: Energy-Efficient DNN Inference for Edge Video Analytics Via Early-Exit and DVFS
von: Zhang, Ziyang, et al.
Veröffentlicht: (2025) -
Reducing Compute Waste in LLMs through Kernel-Level DVFS
von: Spaan, Jeffrey, et al.
Veröffentlicht: (2026)