Quality Scalable Quantization Methodology for Deep Learning on Edge
Fuente:
arXiv
Salvato in:
| Autori principali: | Khaliq, Salman Abdul, Hafiz, Rehan |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Tesserae: Scalable Placement Policies for Deep Learning Workloads
di: Bian, Song, et al.
Pubblicazione: (2025)
di: Bian, Song, et al.
Pubblicazione: (2025)
EdgeRL: Reinforcement Learning-driven Deep Learning Model Inference Optimization at Edge
di: Mounesan, Motahare, et al.
Pubblicazione: (2024)
di: Mounesan, Motahare, et al.
Pubblicazione: (2024)
Reinforcement Learning-driven Data-intensive Workflow Scheduling for Volunteer Edge-Cloud
di: Mounesan, Motahare, et al.
Pubblicazione: (2024)
di: Mounesan, Motahare, et al.
Pubblicazione: (2024)
Accelerated Digital Twin Learning for Edge AI: A Comparison of FPGA and Mobile GPU
di: Xu, Bin, et al.
Pubblicazione: (2025)
di: Xu, Bin, et al.
Pubblicazione: (2025)
Benchmarking Federated Learning in Edge Computing Environments: A Systematic Review and Performance Evaluation
di: Aribe Jr., Sales, et al.
Pubblicazione: (2026)
di: Aribe Jr., Sales, et al.
Pubblicazione: (2026)
Privacy-Preserving Federated Learning: Integrating Zero-Knowledge Proofs in Scalable Distributed Architectures
di: Gupta, Divya
Pubblicazione: (2026)
di: Gupta, Divya
Pubblicazione: (2026)
The Big Send-off: Scalable and Performant Collectives for Deep Learning
di: Singh, Siddharth, et al.
Pubblicazione: (2025)
di: Singh, Siddharth, et al.
Pubblicazione: (2025)
COMET: A Comprehensive Cluster Design Methodology for Distributed Deep Learning Training
di: Kadiyala, Divya Kiran, et al.
Pubblicazione: (2022)
di: Kadiyala, Divya Kiran, et al.
Pubblicazione: (2022)
Percepta: High Performance Stream Processing at the Edge
di: Sousa, Clarisse, et al.
Pubblicazione: (2025)
di: Sousa, Clarisse, et al.
Pubblicazione: (2025)
Rethinking Inference Placement for Deep Learning across Edge and Cloud Platforms: A Multi-Objective Optimization Perspective and Future Directions
di: Zhang, Zongshun, et al.
Pubblicazione: (2025)
di: Zhang, Zongshun, et al.
Pubblicazione: (2025)
Enhancing Communication Efficiency in FL with Adaptive Gradient Quantization and Communication Frequency Optimization
di: Tariq, Asadullah, et al.
Pubblicazione: (2025)
di: Tariq, Asadullah, et al.
Pubblicazione: (2025)
High-Dimensional Data Processing: Benchmarking Machine Learning and Deep Learning Architectures in Local and Distributed Environments
di: Rodriguez, Julian, et al.
Pubblicazione: (2025)
di: Rodriguez, Julian, et al.
Pubblicazione: (2025)
Large Language Model Partitioning for Low-Latency Inference at the Edge
di: Kafetzis, Dimitrios, et al.
Pubblicazione: (2025)
di: Kafetzis, Dimitrios, et al.
Pubblicazione: (2025)
Scalable Cloud-Native Architectures for Intelligent PMU Data Processing
di: Chockalingam, Nachiappan, et al.
Pubblicazione: (2025)
di: Chockalingam, Nachiappan, et al.
Pubblicazione: (2025)
Communication-Efficient Large-Scale Distributed Deep Learning: A Comprehensive Survey
di: Liang, Feng, et al.
Pubblicazione: (2024)
di: Liang, Feng, et al.
Pubblicazione: (2024)
Accurate GPU Memory Prediction for Deep Learning Jobs through Dynamic Analysis
di: Shi, Jiabo, et al.
Pubblicazione: (2025)
di: Shi, Jiabo, et al.
Pubblicazione: (2025)
Deep Reinforcement Learning for Fault-Adaptive Routing in Eisenstein-Jacobi Interconnection Topologies
di: Charrwi, Mohammad Walid, et al.
Pubblicazione: (2026)
di: Charrwi, Mohammad Walid, et al.
Pubblicazione: (2026)
Verify Distributed Deep Learning Model Implementation Refinement with Iterative Relation Inference
di: Wang, Zhanghan, et al.
Pubblicazione: (2025)
di: Wang, Zhanghan, et al.
Pubblicazione: (2025)
Benchmarking of CPU-intensive Stream Data Processing in The Edge Computing Systems
di: Szydlo, Tomasz, et al.
Pubblicazione: (2025)
di: Szydlo, Tomasz, et al.
Pubblicazione: (2025)
Profiling-Driven Adaptive Distributed Transformer Inference on Embedded Edge Deployment
di: Qazi, Muhammad Azlan, et al.
Pubblicazione: (2026)
di: Qazi, Muhammad Azlan, et al.
Pubblicazione: (2026)
Delay-Aware Multi-Stage Edge Server Upgrade with Budget Constraint
di: Wihidayat, Endar Suprih, et al.
Pubblicazione: (2025)
di: Wihidayat, Endar Suprih, et al.
Pubblicazione: (2025)
Adaptive AI-based Decentralized Resource Management in the Cloud-Edge Continuum
di: Li, Lanpei, et al.
Pubblicazione: (2025)
di: Li, Lanpei, et al.
Pubblicazione: (2025)
Dora: QoE-Aware Hybrid Parallelism for Distributed Edge AI
di: Jin, Jianli, et al.
Pubblicazione: (2025)
di: Jin, Jianli, et al.
Pubblicazione: (2025)
Towards Scalable GPU-Accelerated SNN Training via Temporal Fusion
di: Li, Yanchen, et al.
Pubblicazione: (2024)
di: Li, Yanchen, et al.
Pubblicazione: (2024)
Resource Allocation and Workload Scheduling for Large-Scale Distributed Deep Learning: A Survey
di: Liang, Feng, et al.
Pubblicazione: (2024)
di: Liang, Feng, et al.
Pubblicazione: (2024)
TensorHub: Scalable and Elastic Weight Transfer for LLM RL Training
di: Ye, Chenhao, et al.
Pubblicazione: (2026)
di: Ye, Chenhao, et al.
Pubblicazione: (2026)
Safactory: A Scalable Agentic Infrastructure for Training Trustworthy Autonomous Intelligence
di: Chen, Xinquan, et al.
Pubblicazione: (2026)
di: Chen, Xinquan, et al.
Pubblicazione: (2026)
Placement Semantics for Distributed Deep Learning: A Systematic Framework for Analyzing Parallelism Strategies
di: Mehta, Deep Pankajbhai
Pubblicazione: (2026)
di: Mehta, Deep Pankajbhai
Pubblicazione: (2026)
Failure-Resilient Distributed Inference with Model Compression over Heterogeneous Edge Devices
di: Wang, Li, et al.
Pubblicazione: (2024)
di: Wang, Li, et al.
Pubblicazione: (2024)
On the Impact of White-box Deployment Strategies for Edge AI on Latency and Model Performance
di: Singh, Jaskirat, et al.
Pubblicazione: (2024)
di: Singh, Jaskirat, et al.
Pubblicazione: (2024)
CoRaiS: Lightweight Real-Time Scheduler for Multi-Edge Cooperative Computing
di: Hu, Yujiao, et al.
Pubblicazione: (2024)
di: Hu, Yujiao, et al.
Pubblicazione: (2024)
DGRAG: Distributed Graph-based Retrieval-Augmented Generation in Edge-Cloud Systems
di: Zhou, Wenqing, et al.
Pubblicazione: (2025)
di: Zhou, Wenqing, et al.
Pubblicazione: (2025)
Hardware Utilization and Inference Performance of Edge Object Detection Under Fault Injection
di: Pasandideh, Faezeh, et al.
Pubblicazione: (2026)
di: Pasandideh, Faezeh, et al.
Pubblicazione: (2026)
A Model Aware AIGC Task Offloading Algorithm in IIoT Edge Computing
di: Wang, Xin, et al.
Pubblicazione: (2025)
di: Wang, Xin, et al.
Pubblicazione: (2025)
ECCENTRIC: Edge-Cloud Collaboration Framework for Distributed Inference Using Knowledge Adaptation
di: Kamani, Mohammad Mahdi, et al.
Pubblicazione: (2025)
di: Kamani, Mohammad Mahdi, et al.
Pubblicazione: (2025)
SparOA: Sparse and Operator-aware Hybrid Scheduling for Edge DNN Inference
di: Zhang, Ziyang, et al.
Pubblicazione: (2025)
di: Zhang, Ziyang, et al.
Pubblicazione: (2025)
Deep Reinforcement Learning for Job Scheduling and Resource Management in Cloud Computing: An Algorithm-Level Review
di: Gu, Yan, et al.
Pubblicazione: (2025)
di: Gu, Yan, et al.
Pubblicazione: (2025)
ParaGAN: A Scalable Distributed Training Framework for Generative Adversarial Networks
di: Shi, Ziji, et al.
Pubblicazione: (2024)
di: Shi, Ziji, et al.
Pubblicazione: (2024)
AIBrix: Towards Scalable, Cost-Effective Large Language Model Inference Infrastructure
di: The AIBrix Team, et al.
Pubblicazione: (2025)
di: The AIBrix Team, et al.
Pubblicazione: (2025)
Scalable Runtime Architecture for Data-driven, Hybrid HPC and ML Workflow Applications
di: Merzky, Andre, et al.
Pubblicazione: (2025)
di: Merzky, Andre, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Tesserae: Scalable Placement Policies for Deep Learning Workloads
di: Bian, Song, et al.
Pubblicazione: (2025) -
EdgeRL: Reinforcement Learning-driven Deep Learning Model Inference Optimization at Edge
di: Mounesan, Motahare, et al.
Pubblicazione: (2024) -
Reinforcement Learning-driven Data-intensive Workflow Scheduling for Volunteer Edge-Cloud
di: Mounesan, Motahare, et al.
Pubblicazione: (2024) -
Accelerated Digital Twin Learning for Edge AI: A Comparison of FPGA and Mobile GPU
di: Xu, Bin, et al.
Pubblicazione: (2025) -
Benchmarking Federated Learning in Edge Computing Environments: A Systematic Review and Performance Evaluation
di: Aribe Jr., Sales, et al.
Pubblicazione: (2026)