The Future of Consumer Edge-AI Computing
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Laskaridis, Stefanos, Venieris, Stylianos I., Kouris, Alexandros, Li, Rui, Lane, Nicholas D. |
|---|---|
| Format: | Preprint |
| Publié: |
2022
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Progressive Mixed-Precision Decoding for Efficient LLM Inference
par: Chen, Hao Mark, et autres
Publié: (2024)
par: Chen, Hao Mark, et autres
Publié: (2024)
MultiTASC++: A Continuously Adaptive Scheduler for Edge-Based Multi-Device Cascade Inference
par: Nikolaidis, Sokratis, et autres
Publié: (2024)
par: Nikolaidis, Sokratis, et autres
Publié: (2024)
TinyTrain: Resource-Aware Task-Adaptive Sparse Training of DNNs at the Data-Scarce Edge
par: Kwon, Young D., et autres
Publié: (2023)
par: Kwon, Young D., et autres
Publié: (2023)
CARIn: Constraint-Aware and Responsive Inference on Heterogeneous Devices for Single- and Multi-DNN Workloads
par: Panopoulos, Ioannis, et autres
Publié: (2024)
par: Panopoulos, Ioannis, et autres
Publié: (2024)
Speculative Decoding with a Speculative Vocabulary
par: Williams, Miles, et autres
Publié: (2026)
par: Williams, Miles, et autres
Publié: (2026)
Maestro: Uncovering Low-Rank Structures via Trainable Decomposition
par: Horvath, Samuel, et autres
Publié: (2023)
par: Horvath, Samuel, et autres
Publié: (2023)
MELTing point: Mobile Evaluation of Language Transformers
par: Laskaridis, Stefanos, et autres
Publié: (2024)
par: Laskaridis, Stefanos, et autres
Publié: (2024)
FlexRank: Nested Low-Rank Knowledge Decomposition for Adaptive Model Deployment
par: Zaccone, Riccardo, et autres
Publié: (2026)
par: Zaccone, Riccardo, et autres
Publié: (2026)
MoSE: Mixture of Slimmable Experts for Efficient and Adaptive Language Models
par: Tastan, Nurbek, et autres
Publié: (2026)
par: Tastan, Nurbek, et autres
Publié: (2026)
Dynamic Temporal Positional Encodings for Early Intrusion Detection in IoT
par: Panopoulos, Ioannis, et autres
Publié: (2025)
par: Panopoulos, Ioannis, et autres
Publié: (2025)
A-THENA: Early Intrusion Detection for IoT with Time-Aware Hybrid Encoding and Network-Specific Augmentation
par: Panopoulos, Ioannis, et autres
Publié: (2026)
par: Panopoulos, Ioannis, et autres
Publié: (2026)
NoEsis: Differentially Private Knowledge Transfer in Modular LLM Adaptation
par: Romijnders, Rob, et autres
Publié: (2025)
par: Romijnders, Rob, et autres
Publié: (2025)
LoFT: Low-Rank Adaptation That Behaves Like Full Fine-Tuning
par: Tastan, Nurbek, et autres
Publié: (2025)
par: Tastan, Nurbek, et autres
Publié: (2025)
Hardware-Aware Parallel Prompt Decoding for Memory-Efficient Acceleration of LLM Inference
par: Chen, Hao Mark, et autres
Publié: (2024)
par: Chen, Hao Mark, et autres
Publié: (2024)
Recurrent Early Exits for Federated Learning with Heterogeneous Clients
par: Lee, Royson, et autres
Publié: (2024)
par: Lee, Royson, et autres
Publié: (2024)
Beyond Scaling: Agents Are Heading to the Edge
par: Tian, Chunlin, et autres
Publié: (2026)
par: Tian, Chunlin, et autres
Publié: (2026)
Improving face generation quality and prompt following with synthetic captions
par: Tarasiou, Michail, et autres
Publié: (2024)
par: Tarasiou, Michail, et autres
Publié: (2024)
Position: Bridge the Gaps between Machine Unlearning and AI Regulation
par: Marino, Bill, et autres
Publié: (2025)
par: Marino, Bill, et autres
Publié: (2025)
Unsupervised Interpretable Basis Extraction for Concept-Based Visual Explanations
par: Doumanoglou, Alexandros, et autres
Publié: (2023)
par: Doumanoglou, Alexandros, et autres
Publié: (2023)
A collection of the accepted papers for the Human-Centric Representation Learning workshop at AAAI 2024
par: Spathis, Dimitris, et autres
Publié: (2024)
par: Spathis, Dimitris, et autres
Publié: (2024)
Dynamic Semantic Compression for CNN Inference in Multi-access Edge Computing: A Graph Reinforcement Learning-based Autoencoder
par: Li, Nan, et autres
Publié: (2024)
par: Li, Nan, et autres
Publié: (2024)
Cooperative Task Offloading through Asynchronous Deep Reinforcement Learning in Mobile Edge Computing for Future Networks
par: Liu, Yuelin, et autres
Publié: (2025)
par: Liu, Yuelin, et autres
Publié: (2025)
An Unsupervised Deep Explainable AI Framework for Localization of Concurrent Replay Attacks in Nuclear Reactor Signals
par: Vasili, Konstantinos, et autres
Publié: (2025)
par: Vasili, Konstantinos, et autres
Publié: (2025)
Graph Federated Learning Based Proactive Content Caching in Edge Computing
par: Wang, Rui
Publié: (2025)
par: Wang, Rui
Publié: (2025)
Federated Learning-driven Beam Management in LEO 6G Non-Terrestrial Networks
par: Bartsioka, Maria Lamprini, et autres
Publié: (2026)
par: Bartsioka, Maria Lamprini, et autres
Publié: (2026)
Theory of Mixture-of-Experts for Mobile Edge Computing
par: Li, Hongbo, et autres
Publié: (2024)
par: Li, Hongbo, et autres
Publié: (2024)
Geometric Deep Learning for Computer-Aided Design: A Survey
par: Heidari, Negar, et autres
Publié: (2024)
par: Heidari, Negar, et autres
Publié: (2024)
Bringing Federated Learning to Space
par: Kim, Grace, et autres
Publié: (2025)
par: Kim, Grace, et autres
Publié: (2025)
GAC-KAN: An Ultra-Lightweight GNSS Interference Classifier for GenAI-Powered Consumer Edge Devices
par: Zeng, Zhihan, et autres
Publié: (2026)
par: Zeng, Zhihan, et autres
Publié: (2026)
Cognitive Edge Computing: A Comprehensive Survey on Optimizing Large Models and AI Agents for Pervasive Deployment
par: Wang, Xubin, et autres
Publié: (2025)
par: Wang, Xubin, et autres
Publié: (2025)
FRIEND: Federated Learning for Joint Optimization of multi-RIS Configuration and Eavesdropper Intelligent Detection in B5G Networks
par: Bartsioka, Maria Lamprini A., et autres
Publié: (2026)
par: Bartsioka, Maria Lamprini A., et autres
Publié: (2026)
Design Rules for Extreme-Edge Scientific Computing on AI Engines
par: Ma, Zhenghua, et autres
Publié: (2026)
par: Ma, Zhenghua, et autres
Publié: (2026)
Entropy-Aware Task Offloading in Mobile Edge Computing
par: Ardakani, Mohsen Sahraei, et autres
Publié: (2026)
par: Ardakani, Mohsen Sahraei, et autres
Publié: (2026)
The Computational Complexity of Finding Stationary Points in Non-Convex Optimization
par: Hollender, Alexandros, et autres
Publié: (2023)
par: Hollender, Alexandros, et autres
Publié: (2023)
Utilizing Large Language Models for Machine Learning Explainability
par: Vassiliades, Alexandros, et autres
Publié: (2025)
par: Vassiliades, Alexandros, et autres
Publié: (2025)
Bitcoin's Edge: Embedded Sentiment in Blockchain Transactional Data
par: Kleitsikas, Charalampos, et autres
Publié: (2025)
par: Kleitsikas, Charalampos, et autres
Publié: (2025)
FLUX: Efficient Descriptor-Driven Clustered Federated Learning under Arbitrary Distribution Shifts
par: Fenoglio, Dario, et autres
Publié: (2025)
par: Fenoglio, Dario, et autres
Publié: (2025)
Space for Improvement: Navigating the Design Space for Federated Learning in Satellite Constellations
par: Kim, Grace, et autres
Publié: (2024)
par: Kim, Grace, et autres
Publié: (2024)
PRISM: Distributed Inference for Foundation Models at Edge
par: Qazi, Muhammad Azlan, et autres
Publié: (2025)
par: Qazi, Muhammad Azlan, et autres
Publié: (2025)
Sheaf HyperNetworks for Personalized Federated Learning
par: Nguyen, Bao, et autres
Publié: (2024)
par: Nguyen, Bao, et autres
Publié: (2024)
Documents similaires
-
Progressive Mixed-Precision Decoding for Efficient LLM Inference
par: Chen, Hao Mark, et autres
Publié: (2024) -
MultiTASC++: A Continuously Adaptive Scheduler for Edge-Based Multi-Device Cascade Inference
par: Nikolaidis, Sokratis, et autres
Publié: (2024) -
TinyTrain: Resource-Aware Task-Adaptive Sparse Training of DNNs at the Data-Scarce Edge
par: Kwon, Young D., et autres
Publié: (2023) -
CARIn: Constraint-Aware and Responsive Inference on Heterogeneous Devices for Single- and Multi-DNN Workloads
par: Panopoulos, Ioannis, et autres
Publié: (2024) -
Speculative Decoding with a Speculative Vocabulary
par: Williams, Miles, et autres
Publié: (2026)