Ask the Expert: Collaborative Inference for Vision Transformers with Near-Edge Accelerators
Fuente:
arXiv
Salvato in:
| Autori principali: | Liu, Hao, Fahmy, Suhaib A. |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
A Converting Autoencoder Toward Low-latency and Energy-efficient DNN Inference at the Edge
di: Mahmud, Hasanul, et al.
Pubblicazione: (2024)
di: Mahmud, Hasanul, et al.
Pubblicazione: (2024)
Ev-Edge: Efficient Execution of Event-based Vision Algorithms on Commodity Edge Platforms
di: Sridharan, Shrihari, et al.
Pubblicazione: (2024)
di: Sridharan, Shrihari, et al.
Pubblicazione: (2024)
EdgeOL: Efficient in-situ Online Learning on Edge Devices
di: Li, Sheng, et al.
Pubblicazione: (2024)
di: Li, Sheng, et al.
Pubblicazione: (2024)
Accelerating Distributed ML Training via Selective Synchronization
di: Tyagi, Sahil, et al.
Pubblicazione: (2023)
di: Tyagi, Sahil, et al.
Pubblicazione: (2023)
MTL-Split: Multi-Task Learning for Edge Devices using Split Computing
di: Capogrosso, Luigi, et al.
Pubblicazione: (2024)
di: Capogrosso, Luigi, et al.
Pubblicazione: (2024)
InvarDiff: Cross-Scale Invariance Caching for Accelerated Diffusion Models
di: Wu, Zihao
Pubblicazione: (2025)
di: Wu, Zihao
Pubblicazione: (2025)
CodecSight: Leveraging Video Codec Signals for Efficient Streaming VLM Inference
di: Zou, Yulin, et al.
Pubblicazione: (2026)
di: Zou, Yulin, et al.
Pubblicazione: (2026)
Beyond Inference: Performance Analysis of DNN Server Overheads for Computer Vision
di: AbouElhamayed, Ahmed F., et al.
Pubblicazione: (2024)
di: AbouElhamayed, Ahmed F., et al.
Pubblicazione: (2024)
Covariance-Guided Resource Adaptive Learning for Efficient Edge Inference
di: Nabhaan, Ahmad N. L., et al.
Pubblicazione: (2026)
di: Nabhaan, Ahmad N. L., et al.
Pubblicazione: (2026)
A Survey on Collaborative DNN Inference for Edge Intelligence
di: Ren, Weiqing, et al.
Pubblicazione: (2022)
di: Ren, Weiqing, et al.
Pubblicazione: (2022)
Occult: Optimizing Collaborative Communication across Experts for Accelerated Parallel MoE Training and Inference
di: Luo, Shuqing, et al.
Pubblicazione: (2025)
di: Luo, Shuqing, et al.
Pubblicazione: (2025)
Partially Conditioned Patch Parallelism for Accelerated Diffusion Model Inference
di: Zhang, XiuYu, et al.
Pubblicazione: (2024)
di: Zhang, XiuYu, et al.
Pubblicazione: (2024)
Minuet: Accelerating 3D Sparse Convolutions on GPUs
di: Yang, Jiacheng, et al.
Pubblicazione: (2023)
di: Yang, Jiacheng, et al.
Pubblicazione: (2023)
CoFormer: Collaborating with Heterogeneous Edge Devices for Scalable Transformer Inference
di: Xu, Guanyu, et al.
Pubblicazione: (2025)
di: Xu, Guanyu, et al.
Pubblicazione: (2025)
Towards a Proactive Autoscaling Framework for Data Stream Processing at the Edge using GRU and Transfer Learning
di: Armah, Eugene, et al.
Pubblicazione: (2025)
di: Armah, Eugene, et al.
Pubblicazione: (2025)
Privacy-Preserving Split Learning with Vision Transformers using Patch-Wise Random and Noisy CutMix
di: Oh, Seungeun, et al.
Pubblicazione: (2024)
di: Oh, Seungeun, et al.
Pubblicazione: (2024)
GraphLeap: Decoupling Graph Construction and Convolution for Vision GNN Acceleration on FPGA
di: Ramachandran, Anvitha, et al.
Pubblicazione: (2026)
di: Ramachandran, Anvitha, et al.
Pubblicazione: (2026)
Progressive Neural Compression for Adaptive Image Offloading under Timing Constraints
di: Wang, Ruiqi, et al.
Pubblicazione: (2023)
di: Wang, Ruiqi, et al.
Pubblicazione: (2023)
Self-supervised Cross-silo Federated Neural Architecture Search
di: Liang, Xinle, et al.
Pubblicazione: (2021)
di: Liang, Xinle, et al.
Pubblicazione: (2021)
Rate-My-LoRA: Efficient and Adaptive Federated Model Tuning for Cardiac MRI Segmentation
di: He, Xiaoxiao, et al.
Pubblicazione: (2025)
di: He, Xiaoxiao, et al.
Pubblicazione: (2025)
Skewness-Guided Pruning of Multimodal Swin Transformers for Federated Skin Lesion Classification on Edge Devices
di: Paxton, Kuniko, et al.
Pubblicazione: (2025)
di: Paxton, Kuniko, et al.
Pubblicazione: (2025)
SwiftFusion: Scalable Sequence Parallelism for Distributed Inference of Diffusion Transformers on GPUs
di: Yang, Jiacheng, et al.
Pubblicazione: (2026)
di: Yang, Jiacheng, et al.
Pubblicazione: (2026)
t-READi: Transformer-Powered Robust and Efficient Multimodal Inference for Autonomous Driving
di: Hu, Pengfei, et al.
Pubblicazione: (2024)
di: Hu, Pengfei, et al.
Pubblicazione: (2024)
Learning the Optimal Path and DNN Partition for Collaborative Edge Inference
di: Huang, Yin, et al.
Pubblicazione: (2024)
di: Huang, Yin, et al.
Pubblicazione: (2024)
DeepFedNAS: Efficient Hardware-Aware Architecture Adaptation for Heterogeneous IoT Federations via Pareto-Guided Supernet Training
di: Khan, Bostan, et al.
Pubblicazione: (2026)
di: Khan, Bostan, et al.
Pubblicazione: (2026)
LP-GEMM: Integrating Layout Propagation into GEMM Operations
di: Carneiro, César Guedes, et al.
Pubblicazione: (2026)
di: Carneiro, César Guedes, et al.
Pubblicazione: (2026)
Constraint-Aware Execution Planning for Hybrid Space-Ground Compute Workloads
di: Mitra, Subhadip
Pubblicazione: (2026)
di: Mitra, Subhadip
Pubblicazione: (2026)
Consistent Point Matching
di: Yerebakan, Halid Ziya, et al.
Pubblicazione: (2025)
di: Yerebakan, Halid Ziya, et al.
Pubblicazione: (2025)
Synthetic data shuffling accelerates the convergence of federated learning under data heterogeneity
di: Li, Bo, et al.
Pubblicazione: (2023)
di: Li, Bo, et al.
Pubblicazione: (2023)
Rapid Distributed Fine-tuning of a Segmentation Model Onboard Satellites
di: Plumridge, Meghan, et al.
Pubblicazione: (2024)
di: Plumridge, Meghan, et al.
Pubblicazione: (2024)
I-SplitEE: Image classification in Split Computing DNNs with Early Exits
di: Bajpai, Divya Jyoti, et al.
Pubblicazione: (2024)
di: Bajpai, Divya Jyoti, et al.
Pubblicazione: (2024)
Cross-Silo Federated Learning Across Divergent Domains with Iterative Parameter Alignment
di: Gorbett, Matt, et al.
Pubblicazione: (2023)
di: Gorbett, Matt, et al.
Pubblicazione: (2023)
Federated Low-Rank Tensor Estimation for Multimodal Image Reconstruction
di: Van Nguyen, Anh, et al.
Pubblicazione: (2025)
di: Van Nguyen, Anh, et al.
Pubblicazione: (2025)
Federated Learning for Diffusion Models
di: Peng, Zihao, et al.
Pubblicazione: (2025)
di: Peng, Zihao, et al.
Pubblicazione: (2025)
Decentralized Diffusion Models
di: McAllister, David, et al.
Pubblicazione: (2025)
di: McAllister, David, et al.
Pubblicazione: (2025)
Enhancing Split Computing and Early Exit Applications through Predefined Sparsity
di: Capogrosso, Luigi, et al.
Pubblicazione: (2024)
di: Capogrosso, Luigi, et al.
Pubblicazione: (2024)
FedPylot: Navigating Federated Learning for Real-Time Object Detection in Internet of Vehicles
di: Quéméneur, Cyprien, et al.
Pubblicazione: (2024)
di: Quéméneur, Cyprien, et al.
Pubblicazione: (2024)
Data-Free Federated Class Incremental Learning with Diffusion-Based Generative Memory
di: Wang, Naibo, et al.
Pubblicazione: (2024)
di: Wang, Naibo, et al.
Pubblicazione: (2024)
PARDON: Privacy-Aware and Robust Federated Domain Generalization
di: Nguyen, Dung Thuy, et al.
Pubblicazione: (2024)
di: Nguyen, Dung Thuy, et al.
Pubblicazione: (2024)
One-Shot Sequential Federated Learning for Non-IID Data by Enhancing Local Model Diversity
di: Wang, Naibo, et al.
Pubblicazione: (2024)
di: Wang, Naibo, et al.
Pubblicazione: (2024)
Documenti analoghi
-
A Converting Autoencoder Toward Low-latency and Energy-efficient DNN Inference at the Edge
di: Mahmud, Hasanul, et al.
Pubblicazione: (2024) -
Ev-Edge: Efficient Execution of Event-based Vision Algorithms on Commodity Edge Platforms
di: Sridharan, Shrihari, et al.
Pubblicazione: (2024) -
EdgeOL: Efficient in-situ Online Learning on Edge Devices
di: Li, Sheng, et al.
Pubblicazione: (2024) -
Accelerating Distributed ML Training via Selective Synchronization
di: Tyagi, Sahil, et al.
Pubblicazione: (2023) -
MTL-Split: Multi-Task Learning for Edge Devices using Split Computing
di: Capogrosso, Luigi, et al.
Pubblicazione: (2024)