SmartMem: Layout Transformation Elimination and Adaptation for Efficient DNN Execution on Mobile
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Niu, Wei, Sanim, Md Musfiqur Rahman, Shu, Zhihao, Guan, Jiexiong, Shen, Xipeng, Yin, Miao, Agrawal, Gagan, Ren, Bin |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
FlashMem: Supporting Modern DNN Workloads on Mobile with GPU Memory Hierarchy Optimizations
par: Shu, Zhihao, et autres
Publié: (2026)
par: Shu, Zhihao, et autres
Publié: (2026)
Optimizing 3D Gaussian Splattering for Mobile GPUs
par: Sanim, Md Musfiqur Rahman, et autres
Publié: (2025)
par: Sanim, Md Musfiqur Rahman, et autres
Publié: (2025)
ESG: Pipeline-Conscious Efficient Scheduling of DNN Workflows on Serverless Platforms with Shareable GPUs
par: Hui, Xinning, et autres
Publié: (2024)
par: Hui, Xinning, et autres
Publié: (2024)
Parcae: Proactive, Liveput-Optimized DNN Training on Preemptible Instances
par: Duan, Jiangfei, et autres
Publié: (2024)
par: Duan, Jiangfei, et autres
Publié: (2024)
AdaOper: Energy-efficient and Responsive Concurrent DNN Inference on Mobile Devices
par: Lin, Zheng, et autres
Publié: (2024)
par: Lin, Zheng, et autres
Publié: (2024)
DTVM: Revolutionizing Smart Contract Execution with Determinism and Compatibility
par: Zhou, Wei, et autres
Publié: (2025)
par: Zhou, Wei, et autres
Publié: (2025)
MemGUI-Bench: Benchmarking Memory of Mobile GUI Agents in Dynamic Environments
par: Liu, Guangyi, et autres
Publié: (2026)
par: Liu, Guangyi, et autres
Publié: (2026)
VTC: DNN Compilation with Virtual Tensors for Data Movement Elimination
par: Hu, Muyan, et autres
Publié: (2026)
par: Hu, Muyan, et autres
Publié: (2026)
Collaborative Inference in DNN-based Satellite Systems with Dynamic Task Streams
par: Guan, Jinglong, et autres
Publié: (2023)
par: Guan, Jinglong, et autres
Publié: (2023)
A Review on Edge Large Language Models: Design, Execution, and Applications
par: Zheng, Yue, et autres
Publié: (2024)
par: Zheng, Yue, et autres
Publié: (2024)
Deferred Objects to Enhance Smart Contract Programming with Optimistic Parallel Execution
par: Mitenkov, George, et autres
Publié: (2024)
par: Mitenkov, George, et autres
Publié: (2024)
Preemption Aware Task Scheduling for Priority and Deadline Constrained DNN Inference Task Offloading in Homogeneous Mobile-Edge Networks
par: Cotter, Jamie, et autres
Publié: (2025)
par: Cotter, Jamie, et autres
Publié: (2025)
Atomic Smart Contract Interoperability with High Efficiency via Cross-Chain Integrated Execution
par: Yin, Chaoyue, et autres
Publié: (2025)
par: Yin, Chaoyue, et autres
Publié: (2025)
Ecomap: Sustainability-Driven Optimization of Multi-Tenant DNN Execution on Edge Servers
par: Paramanayakam, Varatheepan, et autres
Publié: (2025)
par: Paramanayakam, Varatheepan, et autres
Publié: (2025)
MemFine: Memory-Aware Fine-Grained Scheduling for MoE Training
par: Zhao, Lu, et autres
Publié: (2025)
par: Zhao, Lu, et autres
Publié: (2025)
Shared Memory-contention-aware Concurrent DNN Execution for Diversely Heterogeneous System-on-Chips
par: Dagli, Ismet, et autres
Publié: (2023)
par: Dagli, Ismet, et autres
Publié: (2023)
AdaBridge: Dynamic Data and Computation Reuse for Efficient Multi-task DNN Co-evolution in Edge Systems
par: Wang, Lehao, et autres
Publié: (2024)
par: Wang, Lehao, et autres
Publié: (2024)
Adaptive Execution Scheduler for DataDios SmartDiff
par: Poduri, Aryan
Publié: (2025)
par: Poduri, Aryan
Publié: (2025)
On the Universality of Round Elimination Fixed Points
par: Balliu, Alkida, et autres
Publié: (2025)
par: Balliu, Alkida, et autres
Publié: (2025)
Training DNN Models over Heterogeneous Clusters with Optimal Performance
par: Nie, Chengyi, et autres
Publié: (2024)
par: Nie, Chengyi, et autres
Publié: (2024)
Performance Characterization of Containerized DNN Training and Inference on Edge Accelerators
par: K., Prashanthi S., et autres
Publié: (2023)
par: K., Prashanthi S., et autres
Publié: (2023)
Fulcrum: Optimizing Concurrent DNN Training and Inferencing on Edge Accelerators
par: K., Prashanthi S., et autres
Publié: (2025)
par: K., Prashanthi S., et autres
Publié: (2025)
EdgeServing: Deadline-Aware Multi-DNN Serving at the Edge
par: Cao, Jiahe, et autres
Publié: (2026)
par: Cao, Jiahe, et autres
Publié: (2026)
SWIFT: Expedited Failure Recovery for Large-scale DNN Training
par: Zhong, Yuchen, et autres
Publié: (2023)
par: Zhong, Yuchen, et autres
Publié: (2023)
MemServe: Context Caching for Disaggregated LLM Serving with Elastic Memory Pool
par: Hu, Cunchen, et autres
Publié: (2024)
par: Hu, Cunchen, et autres
Publié: (2024)
MemAscend: System Memory Optimization for SSD-Offloaded LLM Fine-Tuning
par: Liaw, Yong-Cheng, et autres
Publié: (2025)
par: Liaw, Yong-Cheng, et autres
Publié: (2025)
Pagoda: An Energy and Time Roofline Study for DNN Workloads on Edge Accelerators
par: K., Prashanthi S., et autres
Publié: (2025)
par: K., Prashanthi S., et autres
Publié: (2025)
Nezha: Breaking Multi-Rail Network Barriers for Distributed DNN Training
par: Yu, Enda, et autres
Publié: (2024)
par: Yu, Enda, et autres
Publié: (2024)
Collaborative Satellite Computing through Adaptive DNN Task Splitting and Offloading
par: Peng, Shifeng, et autres
Publié: (2024)
par: Peng, Shifeng, et autres
Publié: (2024)
A Flexible Programmable Pipeline Parallelism Framework for Efficient DNN Training
par: Jiang, Lijuan, et autres
Publié: (2025)
par: Jiang, Lijuan, et autres
Publié: (2025)
Ocularone-Bench: Benchmarking DNN Models on GPUs to Assist the Visually Impaired
par: Raj, Suman, et autres
Publié: (2025)
par: Raj, Suman, et autres
Publié: (2025)
EcoFed: Efficient Communication for DNN Partitioning-based Federated Learning
par: Wu, Di, et autres
Publié: (2023)
par: Wu, Di, et autres
Publié: (2023)
Poplar: Efficient Scaling of Distributed DNN Training on Heterogeneous GPU Clusters
par: Zhang, WenZheng, et autres
Publié: (2024)
par: Zhang, WenZheng, et autres
Publié: (2024)
Online Optimization of DNN Inference Network Utility in Collaborative Edge Computing
par: Li, Rui, et autres
Publié: (2024)
par: Li, Rui, et autres
Publié: (2024)
Evaluating Multi-Instance DNN Inferencing on Multiple Accelerators of an Edge Device
par: Tayal, Mumuksh, et autres
Publié: (2025)
par: Tayal, Mumuksh, et autres
Publié: (2025)
Reliability Analysis of Smart Contract Execution Architectures: A Comparative Simulation Study
par: Gürcan, Önder
Publié: (2025)
par: Gürcan, Önder
Publié: (2025)
Eliminating Domain Bias for Federated Learning in Representation Space
par: Zhang, Jianqing, et autres
Publié: (2023)
par: Zhang, Jianqing, et autres
Publié: (2023)
HAP: SPMD DNN Training on Heterogeneous GPU Clusters with Automated Program Synthesis
par: Zhang, Shiwei, et autres
Publié: (2024)
par: Zhang, Shiwei, et autres
Publié: (2024)
HarmonyBatch: Batching multi-SLO DNN Inference with Heterogeneous Serverless Functions
par: Chen, Jiabin, et autres
Publié: (2024)
par: Chen, Jiabin, et autres
Publié: (2024)
Adaptive Heuristics for Scheduling DNN Inferencing on Edge and Cloud for Personalized UAV Fleets
par: Raj, Suman, et autres
Publié: (2024)
par: Raj, Suman, et autres
Publié: (2024)
Documents similaires
-
FlashMem: Supporting Modern DNN Workloads on Mobile with GPU Memory Hierarchy Optimizations
par: Shu, Zhihao, et autres
Publié: (2026) -
Optimizing 3D Gaussian Splattering for Mobile GPUs
par: Sanim, Md Musfiqur Rahman, et autres
Publié: (2025) -
ESG: Pipeline-Conscious Efficient Scheduling of DNN Workflows on Serverless Platforms with Shareable GPUs
par: Hui, Xinning, et autres
Publié: (2024) -
Parcae: Proactive, Liveput-Optimized DNN Training on Preemptible Instances
par: Duan, Jiangfei, et autres
Publié: (2024) -
AdaOper: Energy-efficient and Responsive Concurrent DNN Inference on Mobile Devices
par: Lin, Zheng, et autres
Publié: (2024)