Decentralized LLM Inference over Edge Networks with Energy Harvesting
Fuente:
arXiv
Salvato in:
| Autori principali: | Khoshsirat, Aria, Perin, Giovanni, Rossi, Michele |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Divide and Save: Splitting Workload Among Containers in an Edge Device to Save Energy and Time
di: Khoshsirat, Aria, et al.
Pubblicazione: (2023)
di: Khoshsirat, Aria, et al.
Pubblicazione: (2023)
Parallax: Efficient LLM Inference Service over Decentralized Environment
di: Tong, Chris, et al.
Pubblicazione: (2025)
di: Tong, Chris, et al.
Pubblicazione: (2025)
Stochastic Modeling for Energy-Efficient Edge Infrastructure
di: Rossi, Fabio Diniz
Pubblicazione: (2025)
di: Rossi, Fabio Diniz
Pubblicazione: (2025)
Neuro-Inspired Task Offloading in Edge-IoT Networks Using Spiking Neural Networks
di: Rossi, Fabio Diniz
Pubblicazione: (2025)
di: Rossi, Fabio Diniz
Pubblicazione: (2025)
EdgeShard: Efficient LLM Inference via Collaborative Edge Computing
di: Zhang, Mingjin, et al.
Pubblicazione: (2024)
di: Zhang, Mingjin, et al.
Pubblicazione: (2024)
Dynamic Service Scheduling and Resource Management in Energy-Harvesting Multi-access Edge Computing
di: Chen, Shuyi, et al.
Pubblicazione: (2025)
di: Chen, Shuyi, et al.
Pubblicazione: (2025)
Communication-Efficient Collaborative LLM Inference over LEO Satellite Networks
di: Zhang, Songge, et al.
Pubblicazione: (2026)
di: Zhang, Songge, et al.
Pubblicazione: (2026)
Understanding the Performance and Power of LLM Inferencing on Edge Accelerators
di: Arya, Mayank, et al.
Pubblicazione: (2025)
di: Arya, Mayank, et al.
Pubblicazione: (2025)
Toward Sustainability-Aware LLM Inference on Edge Clusters
di: Rajashekar, Kolichala, et al.
Pubblicazione: (2025)
di: Rajashekar, Kolichala, et al.
Pubblicazione: (2025)
PICE: A Semantic-Driven Progressive Inference System for LLM Serving in Cloud-Edge Networks
di: Zhan, Huiyou, et al.
Pubblicazione: (2025)
di: Zhan, Huiyou, et al.
Pubblicazione: (2025)
Decentralized AI: Permissionless LLM Inference on POKT Network
di: Olshansky, Daniel, et al.
Pubblicazione: (2024)
di: Olshansky, Daniel, et al.
Pubblicazione: (2024)
PolyLink: A Blockchain Based Decentralized Edge AI Platform for LLM Inference
di: Liu, Hongbo, et al.
Pubblicazione: (2025)
di: Liu, Hongbo, et al.
Pubblicazione: (2025)
SLICE: SLO-Driven Scheduling for LLM Inference on Edge Computing Devices
di: Chow, Will
Pubblicazione: (2025)
di: Chow, Will
Pubblicazione: (2025)
Ghidorah: Fast LLM Inference on Edge with Speculative Decoding and Hetero-Core Parallelism
di: Wei, Jinhui, et al.
Pubblicazione: (2025)
di: Wei, Jinhui, et al.
Pubblicazione: (2025)
LIME:Accelerating Collaborative Lossless LLM Inference on Memory-Constrained Edge Devices
di: Sun, Mingyu, et al.
Pubblicazione: (2025)
di: Sun, Mingyu, et al.
Pubblicazione: (2025)
Efficient Routing of Inference Requests across LLM Instances in Cloud-Edge Computing
di: Yu, Shibo, et al.
Pubblicazione: (2025)
di: Yu, Shibo, et al.
Pubblicazione: (2025)
Offline Energy-Optimal LLM Serving: Workload-Based Energy Models for LLM Inference on Heterogeneous Systems
di: Wilkins, Grant, et al.
Pubblicazione: (2024)
di: Wilkins, Grant, et al.
Pubblicazione: (2024)
Efficient Multi-round LLM Inference over Disaggregated Serving
di: He, Wenhao, et al.
Pubblicazione: (2026)
di: He, Wenhao, et al.
Pubblicazione: (2026)
Federated Learning within Global Energy Budget over Heterogeneous Edge Accelerators
di: Banerjee, Roopkatha, et al.
Pubblicazione: (2025)
di: Banerjee, Roopkatha, et al.
Pubblicazione: (2025)
Online Optimization of DNN Inference Network Utility in Collaborative Edge Computing
di: Li, Rui, et al.
Pubblicazione: (2024)
di: Li, Rui, et al.
Pubblicazione: (2024)
Modular Foundation Model Inference at the Edge: Network-Aware Microservice Optimization
di: Zhu, Juan, et al.
Pubblicazione: (2026)
di: Zhu, Juan, et al.
Pubblicazione: (2026)
Network Edge Inference for Large Language Models: Principles, Techniques, and Opportunities
di: Chen, Zhixiong, et al.
Pubblicazione: (2026)
di: Chen, Zhixiong, et al.
Pubblicazione: (2026)
A Pipelined Collaborative Speculative Decoding Framework for Efficient Edge-Cloud LLM Inference
di: Zhang, Yida, et al.
Pubblicazione: (2026)
di: Zhang, Yida, et al.
Pubblicazione: (2026)
HybridFlow: Resource-Adaptive Subtask Routing for Efficient Edge-Cloud LLM Inference
di: Dong, Jiangwen, et al.
Pubblicazione: (2025)
di: Dong, Jiangwen, et al.
Pubblicazione: (2025)
ContinuumConductor : Decentralized Process Mining on the Edge-Cloud Continuum
di: Reiter, Hendrik, et al.
Pubblicazione: (2025)
di: Reiter, Hendrik, et al.
Pubblicazione: (2025)
Administrative Decentralization in Edge-Cloud Multi-Agent for Mobile Automation
di: Li, Senyao, et al.
Pubblicazione: (2026)
di: Li, Senyao, et al.
Pubblicazione: (2026)
A Decentralized Root Cause Localization Approach for Edge Computing Environments
di: Fernando, Duneesha, et al.
Pubblicazione: (2025)
di: Fernando, Duneesha, et al.
Pubblicazione: (2025)
Quantifying the Energy Consumption and Carbon Emissions of LLM Inference via Simulations
di: Özcan, Miray, et al.
Pubblicazione: (2025)
di: Özcan, Miray, et al.
Pubblicazione: (2025)
MSAO: Adaptive Modality Sparsity-Aware Offloading with Edge-Cloud Collaboration for Efficient Multimodal LLM Inference
di: Yang, Zheming, et al.
Pubblicazione: (2026)
di: Yang, Zheming, et al.
Pubblicazione: (2026)
Communication-Computation Pipeline Parallel Split Learning over Wireless Edge Networks
di: Liu, Chenyu, et al.
Pubblicazione: (2025)
di: Liu, Chenyu, et al.
Pubblicazione: (2025)
A Decentralized Microservice Scheduling Approach Using Service Mesh in Cloud-Edge Systems
di: Wen, Yangyang, et al.
Pubblicazione: (2025)
di: Wen, Yangyang, et al.
Pubblicazione: (2025)
GoodServe: Towards High-Goodput Serving of Agentic LLM Inferences over Heterogeneous Resources
di: Du, Boxiao, et al.
Pubblicazione: (2026)
di: Du, Boxiao, et al.
Pubblicazione: (2026)
MoA-Off: Adaptive Heterogeneous Modality-Aware Offloading with Edge-Cloud Collaboration for Efficient Multimodal LLM Inference
di: Yang, Zheming, et al.
Pubblicazione: (2025)
di: Yang, Zheming, et al.
Pubblicazione: (2025)
CALVO: Improve Serving Efficiency for LLM Inferences with Intense Network Demands
di: Wang, Weiye, et al.
Pubblicazione: (2026)
di: Wang, Weiye, et al.
Pubblicazione: (2026)
SDFLMQ: A Semi-Decentralized Federated Learning Framework over MQTT
di: Ali-Pour, Amir, et al.
Pubblicazione: (2025)
di: Ali-Pour, Amir, et al.
Pubblicazione: (2025)
WWW.Serve: Interconnecting Global LLM Services through Decentralization
di: Wang, Huanyu, et al.
Pubblicazione: (2026)
di: Wang, Huanyu, et al.
Pubblicazione: (2026)
Environment-Aware Dynamic Pruning for Pipelined Edge Inference
di: O'Quinn, Austin, et al.
Pubblicazione: (2025)
di: O'Quinn, Austin, et al.
Pubblicazione: (2025)
Dependency-aware Resource Allocation for Serverless Functions at the Edge
di: Baresi, Luciano, et al.
Pubblicazione: (2023)
di: Baresi, Luciano, et al.
Pubblicazione: (2023)
Lattica: A Decentralized Cross-NAT Communication Framework for Scalable AI Inference and Training
di: Yang, Ween, et al.
Pubblicazione: (2025)
di: Yang, Ween, et al.
Pubblicazione: (2025)
ED-DAO: Energy Donation Algorithms based on Decentralized Autonomous Organization
di: Zekiye, Abdulrezzak, et al.
Pubblicazione: (2025)
di: Zekiye, Abdulrezzak, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Divide and Save: Splitting Workload Among Containers in an Edge Device to Save Energy and Time
di: Khoshsirat, Aria, et al.
Pubblicazione: (2023) -
Parallax: Efficient LLM Inference Service over Decentralized Environment
di: Tong, Chris, et al.
Pubblicazione: (2025) -
Stochastic Modeling for Energy-Efficient Edge Infrastructure
di: Rossi, Fabio Diniz
Pubblicazione: (2025) -
Neuro-Inspired Task Offloading in Edge-IoT Networks Using Spiking Neural Networks
di: Rossi, Fabio Diniz
Pubblicazione: (2025) -
EdgeShard: Efficient LLM Inference via Collaborative Edge Computing
di: Zhang, Mingjin, et al.
Pubblicazione: (2024)