Guardado en:
| Autores principales: | Jia, Fucheng, Jiang, Shiqi, Cao, Ting, Cui, Wei, Xia, Tianrui, Cao, Xu, Li, Yuanchun, Zhang, Deyu, Ren, Ju, Liu, Yunxin, Qiu, Lili, Yang, Mao |
|---|---|
| Formato: | Preprint |
| Publicado: |
2023
|
| Materias: | |
| Acceso en línea: | https://arxiv.org/abs/2309.08978 |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Scaling Up On-Device LLMs via Active-Weight Swapping Between DRAM and Flash
por: Jia, Fucheng, et al.
Publicado: (2025)
por: Jia, Fucheng, et al.
Publicado: (2025)
Anatomizing Deep Learning Inference in Web Browsers
por: Wang, Qipeng, et al.
Publicado: (2024)
por: Wang, Qipeng, et al.
Publicado: (2024)
A First Look At Efficient And Secure On-Device LLM Inference Against KV Leakage
por: Yang, Huan, et al.
Publicado: (2024)
por: Yang, Huan, et al.
Publicado: (2024)
Vec-LUT: Vector Table Lookup for Parallel Ultra-Low-Bit LLM Inference on Edge Devices
por: Li, Xiangyu, et al.
Publicado: (2025)
por: Li, Xiangyu, et al.
Publicado: (2025)
ProRe: A Proactive Reward System for GUI Agents via Reasoner-Actor Collaboration
por: Dai, Gaole, et al.
Publicado: (2025)
por: Dai, Gaole, et al.
Publicado: (2025)
Advancing Mobile GUI Agents: A Verifier-Driven Approach to Practical Deployment
por: Dai, Gaole, et al.
Publicado: (2025)
por: Dai, Gaole, et al.
Publicado: (2025)
AgentProg: Empowering Long-Horizon GUI Agents with Program-Guided Context Management
por: Tian, Shizuo, et al.
Publicado: (2025)
por: Tian, Shizuo, et al.
Publicado: (2025)
Sculptor: Empowering LLMs with Cognitive Agency via Active Context Management
por: Li, Mo, et al.
Publicado: (2025)
por: Li, Mo, et al.
Publicado: (2025)
AdaNav: Adaptive Reasoning with Uncertainty for Vision-Language Navigation
por: Ding, Xin, et al.
Publicado: (2025)
por: Ding, Xin, et al.
Publicado: (2025)
Bitnet.cpp: Efficient Edge Inference for Ternary LLMs
por: Wang, Jinheng, et al.
Publicado: (2025)
por: Wang, Jinheng, et al.
Publicado: (2025)
Matryoshka: Optimization of Dynamic Diverse Quantum Chemistry Systems via Elastic Parallelism Transformation
por: Wang, Tuowei, et al.
Publicado: (2024)
por: Wang, Tuowei, et al.
Publicado: (2024)
EdgeFlex-Transformer: Transformer Inference for Edge Devices
por: Mohammad, Shoaib, et al.
Publicado: (2025)
por: Mohammad, Shoaib, et al.
Publicado: (2025)
EdgeShard: Efficient LLM Inference via Collaborative Edge Computing
por: Zhang, Mingjin, et al.
Publicado: (2024)
por: Zhang, Mingjin, et al.
Publicado: (2024)
Babel: A Scalable Pre-trained Model for Multi-Modal Sensing via Expandable Modality Alignment
por: Dai, Shenghong, et al.
Publicado: (2024)
por: Dai, Shenghong, et al.
Publicado: (2024)
Threshold Neuron: A Brain-inspired Artificial Neuron for Efficient On-device Inference
por: Zheng, Zihao, et al.
Publicado: (2024)
por: Zheng, Zihao, et al.
Publicado: (2024)
KVShare: An LLM Service System with Efficient and Effective Multi-Tenant KV Cache Reuse
por: Yang, Huan, et al.
Publicado: (2025)
por: Yang, Huan, et al.
Publicado: (2025)
Region-based Content Enhancement for Efficient Video Analytics at the Edge
por: Wang, Weijun, et al.
Publicado: (2024)
por: Wang, Weijun, et al.
Publicado: (2024)
OxyGen: Unified KV Cache Management for VLA Inference under Multi-Task Parallelism
por: Li, Xiangyu, et al.
Publicado: (2026)
por: Li, Xiangyu, et al.
Publicado: (2026)
SpinFlow: A Physics-Informed Spin Field Framework for Traffic Phase Inference and Transition Detection
por: Deng, Haopeng, et al.
Publicado: (2026)
por: Deng, Haopeng, et al.
Publicado: (2026)
EdgeOAR: Real-time Online Action Recognition On Edge Devices
por: Luo, Wei, et al.
Publicado: (2024)
por: Luo, Wei, et al.
Publicado: (2024)
Browser Fingerprint Detection and Anti-Tracking
por: Lin, Kaitong, et al.
Publicado: (2025)
por: Lin, Kaitong, et al.
Publicado: (2025)
Image is All You Need to Empower Large-scale Diffusion Models for In-Domain Generation
por: Cao, Pu, et al.
Publicado: (2023)
por: Cao, Pu, et al.
Publicado: (2023)
AVA: Towards Agentic Video Analytics with Vision Language Models
por: Yan, Yuxuan, et al.
Publicado: (2025)
por: Yan, Yuxuan, et al.
Publicado: (2025)
ResPanDiff: Diffusion Model for Pansharpening by Inferring Residual Inference
por: Cao, Shiqi, et al.
Publicado: (2025)
por: Cao, Shiqi, et al.
Publicado: (2025)
SwapNet: Efficient Swapping for DNN Inference on Edge AI Devices Beyond the Memory Budget
por: Wang, Kun, et al.
Publicado: (2024)
por: Wang, Kun, et al.
Publicado: (2024)
Chain-of-Restoration: Multi-Task Image Restoration Models are Zero-Shot Step-by-Step Universal Image Restorers
por: Cao, Jin, et al.
Publicado: (2024)
por: Cao, Jin, et al.
Publicado: (2024)
Edge Graph Intelligence: Reciprocally Empowering Edge Networks with Graph Intelligence
por: Zeng, Liekang, et al.
Publicado: (2024)
por: Zeng, Liekang, et al.
Publicado: (2024)
Vision Enhancing LLMs: Empowering Multimodal Knowledge Storage and Sharing in LLMs
por: Li, Yunxin, et al.
Publicado: (2023)
por: Li, Yunxin, et al.
Publicado: (2023)
Privacy-Aware Multi-Device Cooperative Edge Inference with Distributed Resource Bidding
por: Zhuang, Wenhao, et al.
Publicado: (2024)
por: Zhuang, Wenhao, et al.
Publicado: (2024)
Enhancing Ultra-Low-Bit Quantization of Large Language Models Through Saliency-Aware Partial Retraining
por: Cao, Deyu, et al.
Publicado: (2025)
por: Cao, Deyu, et al.
Publicado: (2025)
GenAI at the Edge: Comprehensive Survey on Empowering Edge Devices
por: Navardi, Mozhgan, et al.
Publicado: (2025)
por: Navardi, Mozhgan, et al.
Publicado: (2025)
Empowering Edge Intelligence: A Comprehensive Survey on On-Device AI Models
por: Wang, Xubin, et al.
Publicado: (2025)
por: Wang, Xubin, et al.
Publicado: (2025)
GRIP-VLM: Group-Relative Importance Pruning for Efficient Vision-Language Models
por: Huang, Mingzhe, et al.
Publicado: (2026)
por: Huang, Mingzhe, et al.
Publicado: (2026)
Infer-EDGE: Dynamic DNN Inference Optimization in 'Just-in-time' Edge-AI Implementations
por: Mounesan, Motahare, et al.
Publicado: (2025)
por: Mounesan, Motahare, et al.
Publicado: (2025)
Recall: Empowering Multimodal Embedding for Edge Devices
por: Cai, Dongqi, et al.
Publicado: (2024)
por: Cai, Dongqi, et al.
Publicado: (2024)
BudgetThinker: Empowering Budget-aware LLM Reasoning with Control Tokens
por: Wen, Hao, et al.
Publicado: (2025)
por: Wen, Hao, et al.
Publicado: (2025)
PracMHBench: Re-evaluating Model-Heterogeneous Federated Learning Based on Practical Edge Device Constraints
por: Guo, Yuanchun, et al.
Publicado: (2025)
por: Guo, Yuanchun, et al.
Publicado: (2025)
WebLLM: A High-Performance In-Browser LLM Inference Engine
por: Ruan, Charlie F., et al.
Publicado: (2024)
por: Ruan, Charlie F., et al.
Publicado: (2024)
Em-Garde: A Propose-Match Framework for Proactive Streaming Video Understanding
por: Zheng, Yikai, et al.
Publicado: (2026)
por: Zheng, Yikai, et al.
Publicado: (2026)
Making Every Frame Matter: Continuous Activity Recognition in Streaming Video via Adaptive Video Context Modeling
por: Wu, Hao, et al.
Publicado: (2024)
por: Wu, Hao, et al.
Publicado: (2024)
Ejemplares similares
-
Scaling Up On-Device LLMs via Active-Weight Swapping Between DRAM and Flash
por: Jia, Fucheng, et al.
Publicado: (2025) -
Anatomizing Deep Learning Inference in Web Browsers
por: Wang, Qipeng, et al.
Publicado: (2024) -
A First Look At Efficient And Secure On-Device LLM Inference Against KV Leakage
por: Yang, Huan, et al.
Publicado: (2024) -
Vec-LUT: Vector Table Lookup for Parallel Ultra-Low-Bit LLM Inference on Edge Devices
por: Li, Xiangyu, et al.
Publicado: (2025) -
ProRe: A Proactive Reward System for GUI Agents via Reasoner-Actor Collaboration
por: Dai, Gaole, et al.
Publicado: (2025)