DUET: A Tuning-Free Device-Cloud Collaborative Parameters Generation Framework for Efficient Device Model Generalization
Fuente:
arXiv
Salvato in:
| Autori principali: | Lv, Zheqi, Zhang, Wenqiao, Zhang, Shengyu, Kuang, Kun, Wang, Feng, Wang, Yongwei, Chen, Zhengyu, Shen, Tao, Yang, Hongxia, Ooi, Beng Chin, Wu, Fei |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2022
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Collaboration of Large Language Models and Small Recommendation Models for Device-Cloud Recommendation
di: Lv, Zheqi, et al.
Pubblicazione: (2025)
di: Lv, Zheqi, et al.
Pubblicazione: (2025)
Intelligent Model Update Strategy for Sequential Recommendation
di: Lv, Zheqi, et al.
Pubblicazione: (2023)
di: Lv, Zheqi, et al.
Pubblicazione: (2023)
Tackling Device Data Distribution Real-time Shift via Prototype-based Parameter Editing
di: Lv, Zheqi, et al.
Pubblicazione: (2025)
di: Lv, Zheqi, et al.
Pubblicazione: (2025)
Backpropagation-Free Multi-modal On-Device Model Adaptation via Cloud-Device Collaboration
di: Ji, Wei, et al.
Pubblicazione: (2024)
di: Ji, Wei, et al.
Pubblicazione: (2024)
Forward Once for All: Structural Parameterized Adaptation for Efficient Cloud-coordinated On-device Recommendation
di: Fu, Kairui, et al.
Pubblicazione: (2025)
di: Fu, Kairui, et al.
Pubblicazione: (2025)
SimDC: A High-Fidelity Device Simulation Platform for Device-Cloud Collaborative Computing
di: Pei, Ruiguang, et al.
Pubblicazione: (2025)
di: Pei, Ruiguang, et al.
Pubblicazione: (2025)
PAAC: Privacy-Aware Agentic Device-Cloud Collaboration
di: Yuan, Liangqi, et al.
Pubblicazione: (2026)
di: Yuan, Liangqi, et al.
Pubblicazione: (2026)
P/D-Device: Disaggregated Large Language Model between Cloud and Devices
di: Jin, Yibo, et al.
Pubblicazione: (2025)
di: Jin, Yibo, et al.
Pubblicazione: (2025)
LoRA-C: Parameter-Efficient Fine-Tuning of Robust CNN for IoT Devices
di: Ding, Chuntao, et al.
Pubblicazione: (2024)
di: Ding, Chuntao, et al.
Pubblicazione: (2024)
DIET: Customized Slimming for Incompatible Networks in Sequential Recommendation
di: Fu, Kairui, et al.
Pubblicazione: (2024)
di: Fu, Kairui, et al.
Pubblicazione: (2024)
ModelGPT: Unleashing LLM's Capabilities for Tailored Model Generation
di: Tang, Zihao, et al.
Pubblicazione: (2024)
di: Tang, Zihao, et al.
Pubblicazione: (2024)
Memory-Efficient Split Federated Learning for LLM Fine-Tuning on Heterogeneous Mobile Devices
di: Chen, Xiaopei, et al.
Pubblicazione: (2025)
di: Chen, Xiaopei, et al.
Pubblicazione: (2025)
SeSeMI: Secure Serverless Model Inference on Sensitive Data
di: Hu, Guoyu, et al.
Pubblicazione: (2024)
di: Hu, Guoyu, et al.
Pubblicazione: (2024)
Collaborative Learning of On-Device Small Model and Cloud-Based Large Model: Advances and Future Directions
di: Niu, Chaoyue, et al.
Pubblicazione: (2025)
di: Niu, Chaoyue, et al.
Pubblicazione: (2025)
LIME:Accelerating Collaborative Lossless LLM Inference on Memory-Constrained Edge Devices
di: Sun, Mingyu, et al.
Pubblicazione: (2025)
di: Sun, Mingyu, et al.
Pubblicazione: (2025)
Pico-Cloud: Cloud Infrastructure for Tiny Edge Devices
di: Guri, Mordechai
Pubblicazione: (2025)
di: Guri, Mordechai
Pubblicazione: (2025)
Adaptive Parameter-Efficient Federated Fine-Tuning on Heterogeneous Devices
di: Liu, Jun, et al.
Pubblicazione: (2024)
di: Liu, Jun, et al.
Pubblicazione: (2024)
Device-Cloud Collaborative Correction for On-Device Recommendation
di: Zhan, Tianyu, et al.
Pubblicazione: (2025)
di: Zhan, Tianyu, et al.
Pubblicazione: (2025)
GroupNL: Low-Resource and Robust CNN Design over Cloud and Device
di: Ding, Chuntao, et al.
Pubblicazione: (2025)
di: Ding, Chuntao, et al.
Pubblicazione: (2025)
DiSCo: Device-Server Collaborative LLM-Based Text Streaming Services
di: Sun, Ting, et al.
Pubblicazione: (2025)
di: Sun, Ting, et al.
Pubblicazione: (2025)
Optimize Incompatible Parameters through Compatibility-aware Knowledge Integration
di: Lv, Zheqi, et al.
Pubblicazione: (2025)
di: Lv, Zheqi, et al.
Pubblicazione: (2025)
Distributed On-Device LLM Inference With Over-the-Air Computation
di: Zhang, Kai, et al.
Pubblicazione: (2025)
di: Zhang, Kai, et al.
Pubblicazione: (2025)
Prefill-as-a-Service: KVCache of Next-Generation Models Could Go Cross-Datacenter
di: Qin, Ruoyu, et al.
Pubblicazione: (2026)
di: Qin, Ruoyu, et al.
Pubblicazione: (2026)
Can LoRA Fusion Support Cross-Domain Tasks in Cloud-Edge Collaboration?
di: Wang, Yatong, et al.
Pubblicazione: (2026)
di: Wang, Yatong, et al.
Pubblicazione: (2026)
An Empirical Study of Production Incidents in Generative AI Cloud Services
di: Yan, Haoran, et al.
Pubblicazione: (2025)
di: Yan, Haoran, et al.
Pubblicazione: (2025)
Jupiter: Fast and Resource-Efficient Collaborative Inference of Generative LLMs on Edge Devices
di: Ye, Shengyuan, et al.
Pubblicazione: (2025)
di: Ye, Shengyuan, et al.
Pubblicazione: (2025)
Security of Cloud Services with Low-Performance Devices in Critical Infrastructures
di: Molle, Michael, et al.
Pubblicazione: (2024)
di: Molle, Michael, et al.
Pubblicazione: (2024)
CtrlCoT: Dual-Granularity Chain-of-Thought Compression for Controllable Reasoning
di: Fan, Zhenxuan, et al.
Pubblicazione: (2026)
di: Fan, Zhenxuan, et al.
Pubblicazione: (2026)
DUET: Disaggregated Hybrid Mamba-Transformer LLMs with Prefill and Decode-Specific Packages
di: Kanani, Alish, et al.
Pubblicazione: (2026)
di: Kanani, Alish, et al.
Pubblicazione: (2026)
A Pipelined Collaborative Speculative Decoding Framework for Efficient Edge-Cloud LLM Inference
di: Zhang, Yida, et al.
Pubblicazione: (2026)
di: Zhang, Yida, et al.
Pubblicazione: (2026)
CoFormer: Collaborating with Heterogeneous Edge Devices for Scalable Transformer Inference
di: Xu, Guanyu, et al.
Pubblicazione: (2025)
di: Xu, Guanyu, et al.
Pubblicazione: (2025)
Adaptive Device-Edge Collaboration on DNN Inference in AIoT: A Digital Twin-Assisted Approach
di: Hu, Shisheng, et al.
Pubblicazione: (2024)
di: Hu, Shisheng, et al.
Pubblicazione: (2024)
RingAda: Pipelining Large Model Fine-Tuning on Edge Devices with Scheduled Layer Unfreezing
di: Li, Liang, et al.
Pubblicazione: (2025)
di: Li, Liang, et al.
Pubblicazione: (2025)
Synera: Synergistic LLM Serving across Device and Cloud at Scale
di: Wang, Genglin, et al.
Pubblicazione: (2025)
di: Wang, Genglin, et al.
Pubblicazione: (2025)
A DataOps Toolbox Enabling Continuous Semantic Integration of Devices for Edge-Cloud AI Applications
di: Scrocca, Mario, et al.
Pubblicazione: (2025)
di: Scrocca, Mario, et al.
Pubblicazione: (2025)
DynaFlow: Transparent and Flexible Intra-Device Parallelism via Programmable Operator Scheduling
di: Pan, Yi, et al.
Pubblicazione: (2026)
di: Pan, Yi, et al.
Pubblicazione: (2026)
Token Level Routing Inference System for Edge Devices
di: She, Jianshu, et al.
Pubblicazione: (2025)
di: She, Jianshu, et al.
Pubblicazione: (2025)
FlexPie: Accelerate Distributed Inference on Edge Devices with Flexible Combinatorial Optimization[Technical Report]
di: Zhang, Runhua, et al.
Pubblicazione: (2025)
di: Zhang, Runhua, et al.
Pubblicazione: (2025)
Failure-Resilient Distributed Inference with Model Compression over Heterogeneous Edge Devices
di: Wang, Li, et al.
Pubblicazione: (2024)
di: Wang, Li, et al.
Pubblicazione: (2024)
ML-ECS: A Collaborative Multimodal Learning Framework for Edge-Cloud Synergies
di: Liu, Yuze, et al.
Pubblicazione: (2026)
di: Liu, Yuze, et al.
Pubblicazione: (2026)
Documenti analoghi
-
Collaboration of Large Language Models and Small Recommendation Models for Device-Cloud Recommendation
di: Lv, Zheqi, et al.
Pubblicazione: (2025) -
Intelligent Model Update Strategy for Sequential Recommendation
di: Lv, Zheqi, et al.
Pubblicazione: (2023) -
Tackling Device Data Distribution Real-time Shift via Prototype-based Parameter Editing
di: Lv, Zheqi, et al.
Pubblicazione: (2025) -
Backpropagation-Free Multi-modal On-Device Model Adaptation via Cloud-Device Collaboration
di: Ji, Wei, et al.
Pubblicazione: (2024) -
Forward Once for All: Structural Parameterized Adaptation for Efficient Cloud-coordinated On-device Recommendation
di: Fu, Kairui, et al.
Pubblicazione: (2025)