Accelerated Training on Low-Power Edge Devices
Fuente:
arXiv
Salvato in:
| Autori principali: | Ahmed, Mohamed Aboelenien, Pfeiffer, Kilian, Khdr, Heba, Abboud, Osama, Khalili, Ramin, Henkel, Jörg |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Efficient Zero-Order Federated Finetuning of Language Models for Resource-Constrained Devices
di: Ahmed, Mohamed Aboelenien, et al.
Pubblicazione: (2025)
di: Ahmed, Mohamed Aboelenien, et al.
Pubblicazione: (2025)
Efficient Federated Finetuning of Tiny Transformers with Resource-Constrained Devices
di: Pfeiffer, Kilian, et al.
Pubblicazione: (2024)
di: Pfeiffer, Kilian, et al.
Pubblicazione: (2024)
Puzzle: Scheduling Multiple Deep Learning Models on Mobile Device with Heterogeneous Processors
di: Kang, Duseok, et al.
Pubblicazione: (2025)
di: Kang, Duseok, et al.
Pubblicazione: (2025)
Energy-Efficient Computation with DVFS using Deep Reinforcement Learning for Multi-Task Systems in Edge Computing
di: Li, Xinyi, et al.
Pubblicazione: (2024)
di: Li, Xinyi, et al.
Pubblicazione: (2024)
Crash-Consistent Checkpointing for AI Training on macOS/APFS
di: Jeon, Juha
Pubblicazione: (2025)
di: Jeon, Juha
Pubblicazione: (2025)
PowerInfer: Fast Large Language Model Serving with a Consumer-grade GPU
di: Song, Yixin, et al.
Pubblicazione: (2023)
di: Song, Yixin, et al.
Pubblicazione: (2023)
FlexServe: A Fast and Secure LLM Serving System for Mobile Devices with Flexible Resource Isolation
di: Wu, Yinpeng, et al.
Pubblicazione: (2026)
di: Wu, Yinpeng, et al.
Pubblicazione: (2026)
Preparation Meets Opportunity: Enhancing Data Preprocessing for ML Training With Seneca
di: Desai, Omkar, et al.
Pubblicazione: (2025)
di: Desai, Omkar, et al.
Pubblicazione: (2025)
An Integrated Artificial Intelligence Operating System for Advanced Low-Altitude Aviation Applications
di: Tan, Minzhe, et al.
Pubblicazione: (2024)
di: Tan, Minzhe, et al.
Pubblicazione: (2024)
MaLV-OS: Rethinking the Operating System Architecture for Machine Learning in Virtualized Clouds
di: Bitchebe, Stella, et al.
Pubblicazione: (2025)
di: Bitchebe, Stella, et al.
Pubblicazione: (2025)
LithOS: An Operating System for Efficient Machine Learning on GPUs
di: Coppock, Patrick H., et al.
Pubblicazione: (2025)
di: Coppock, Patrick H., et al.
Pubblicazione: (2025)
Herding LLaMaS: Using LLMs as an OS Module
di: Kamath, Aditya K, et al.
Pubblicazione: (2024)
di: Kamath, Aditya K, et al.
Pubblicazione: (2024)
Reinforcement Learning for Dynamic Memory Allocation
di: Lim, Arisrei, et al.
Pubblicazione: (2024)
di: Lim, Arisrei, et al.
Pubblicazione: (2024)
Machine Learning (ML) library in Linux kernel
di: Dubeyko, Viacheslav
Pubblicazione: (2026)
di: Dubeyko, Viacheslav
Pubblicazione: (2026)
vAttention: Dynamic Memory Management for Serving LLMs without PagedAttention
di: Prabhu, Ramya, et al.
Pubblicazione: (2024)
di: Prabhu, Ramya, et al.
Pubblicazione: (2024)
Everything You Always Wanted to Know About Storage Compressibility of Pre-Trained ML Models but Were Afraid to Ask
di: Su, Zhaoyuan, et al.
Pubblicazione: (2024)
di: Su, Zhaoyuan, et al.
Pubblicazione: (2024)
AdaptCache: KV Cache Native Storage Hierarchy for Low-Delay and High-Quality Language Model Serving
di: Feng, Shaoting, et al.
Pubblicazione: (2025)
di: Feng, Shaoting, et al.
Pubblicazione: (2025)
TempoNet: Slack-Quantized Transformer-Guided Reinforcement Scheduler for Adaptive Deadline-Centric Real-Time Dispatchs
di: Fu, Rong, et al.
Pubblicazione: (2026)
di: Fu, Rong, et al.
Pubblicazione: (2026)
Bauplan: zero-copy, scale-up FaaS for data pipelines
di: Tagliabue, Jacopo, et al.
Pubblicazione: (2024)
di: Tagliabue, Jacopo, et al.
Pubblicazione: (2024)
EROICA: Online Performance Troubleshooting for Large-scale Model Training
di: Guan, Yu, et al.
Pubblicazione: (2025)
di: Guan, Yu, et al.
Pubblicazione: (2025)
Data-driven Software-based Power Estimation for Embedded Devices
di: Wang, Haoyu, et al.
Pubblicazione: (2024)
di: Wang, Haoyu, et al.
Pubblicazione: (2024)
Leveraging Machine Learning for Accurate IoT Device Identification in Dynamic Wireless Contexts
di: Tushir, Bhagyashri, et al.
Pubblicazione: (2024)
di: Tushir, Bhagyashri, et al.
Pubblicazione: (2024)
OSWorld-Human: Benchmarking the Efficiency of Computer-Use Agents
di: Abhyankar, Reyna, et al.
Pubblicazione: (2025)
di: Abhyankar, Reyna, et al.
Pubblicazione: (2025)
Semantic Scheduling for LLM Inference
di: Hua, Wenyue, et al.
Pubblicazione: (2025)
di: Hua, Wenyue, et al.
Pubblicazione: (2025)
Selective KV-Cache Sharing to Mitigate Timing Side-Channels in LLM Inference
di: Chu, Kexin, et al.
Pubblicazione: (2025)
di: Chu, Kexin, et al.
Pubblicazione: (2025)
EVICPRESS: Joint KV-Cache Compression and Eviction for Efficient LLM Serving
di: Feng, Shaoting, et al.
Pubblicazione: (2025)
di: Feng, Shaoting, et al.
Pubblicazione: (2025)
From Imperative to Declarative: Towards LLM-friendly OS Interfaces for Boosted Computer-Use Agents
di: Wang, Yuan, et al.
Pubblicazione: (2025)
di: Wang, Yuan, et al.
Pubblicazione: (2025)
When eBPF Meets Machine Learning: On-the-fly OS Kernel Compartmentalization
di: Wang, Zicheng, et al.
Pubblicazione: (2024)
di: Wang, Zicheng, et al.
Pubblicazione: (2024)
ConsumerBench: Benchmarking Generative AI Applications on End-User Devices
di: Gu, Yile, et al.
Pubblicazione: (2025)
di: Gu, Yile, et al.
Pubblicazione: (2025)
Enhancing Battery Storage Energy Arbitrage with Deep Reinforcement Learning and Time-Series Forecasting
di: Sage, Manuel, et al.
Pubblicazione: (2024)
di: Sage, Manuel, et al.
Pubblicazione: (2024)
Generative Profiling for Soft Real-Time Systems and its Applications to Resource Allocation
di: Bondar, Georgiy A., et al.
Pubblicazione: (2026)
di: Bondar, Georgiy A., et al.
Pubblicazione: (2026)
AgenTEE: Confidential LLM Agent Execution on Edge Devices
di: Abdollahi, Sina, et al.
Pubblicazione: (2026)
di: Abdollahi, Sina, et al.
Pubblicazione: (2026)
Samoyeds: Accelerating MoE Models with Structured Sparsity Leveraging Sparse Tensor Cores
di: Wu, Chenpeng, et al.
Pubblicazione: (2025)
di: Wu, Chenpeng, et al.
Pubblicazione: (2025)
An Online Gradient-Based Caching Policy with Logarithmic Complexity and Regret Guarantees
di: Carra, Damiano, et al.
Pubblicazione: (2024)
di: Carra, Damiano, et al.
Pubblicazione: (2024)
Sawtooth Wavefront Reordering: Enhanced CuTile FlashAttention on NVIDIA GB10
di: Zhu, Yifan, et al.
Pubblicazione: (2026)
di: Zhu, Yifan, et al.
Pubblicazione: (2026)
Neuralink: Fast LLM Inference on Smartphones with Neuron Co-Activation Linking
di: Wang, Tuowei, et al.
Pubblicazione: (2024)
di: Wang, Tuowei, et al.
Pubblicazione: (2024)
EdgeWeaver: Accelerating IoT Application Development Across Edge-Cloud Continuum
di: Lertpongrujikorn, Pawissanutt, et al.
Pubblicazione: (2026)
di: Lertpongrujikorn, Pawissanutt, et al.
Pubblicazione: (2026)
LLM as a System Service on Mobile Devices
di: Yin, Wangsong, et al.
Pubblicazione: (2024)
di: Yin, Wangsong, et al.
Pubblicazione: (2024)
Learning Semantics, Not Addresses: Runtime Neural Prefetching for Far Memory
di: Huang, Yutong, et al.
Pubblicazione: (2025)
di: Huang, Yutong, et al.
Pubblicazione: (2025)
Dynamic Optimization of Storage Systems Using Reinforcement Learning Techniques
di: Cheng, Chiyu, et al.
Pubblicazione: (2024)
di: Cheng, Chiyu, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Efficient Zero-Order Federated Finetuning of Language Models for Resource-Constrained Devices
di: Ahmed, Mohamed Aboelenien, et al.
Pubblicazione: (2025) -
Efficient Federated Finetuning of Tiny Transformers with Resource-Constrained Devices
di: Pfeiffer, Kilian, et al.
Pubblicazione: (2024) -
Puzzle: Scheduling Multiple Deep Learning Models on Mobile Device with Heterogeneous Processors
di: Kang, Duseok, et al.
Pubblicazione: (2025) -
Energy-Efficient Computation with DVFS using Deep Reinforcement Learning for Multi-Task Systems in Edge Computing
di: Li, Xinyi, et al.
Pubblicazione: (2024) -
Crash-Consistent Checkpointing for AI Training on macOS/APFS
di: Jeon, Juha
Pubblicazione: (2025)