CacheFL: Privacy-Preserving and Efficient Federated Cache Model Fine-Tuning for Vision-Language Models
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Yi, Mengjun, Zhang, Hanwen, Dou, Hui, Zhao, Jian, Shen, Furao |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2025
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Decentralized Federated Learning with Model Caching on Mobile Agents
von: Wang, Xiaoyu, et al.
Veröffentlicht: (2024)
von: Wang, Xiaoyu, et al.
Veröffentlicht: (2024)
EcoLoRA: Communication-Efficient Federated Fine-Tuning of Large Language Models
von: Liu, Han, et al.
Veröffentlicht: (2025)
von: Liu, Han, et al.
Veröffentlicht: (2025)
CaBaFL: Asynchronous Federated Learning via Hierarchical Cache and Feature Balance
von: Xia, Zeke, et al.
Veröffentlicht: (2024)
von: Xia, Zeke, et al.
Veröffentlicht: (2024)
Strata: Hierarchical Context Caching for Long Context Language Model Serving
von: Xie, Zhiqiang, et al.
Veröffentlicht: (2025)
von: Xie, Zhiqiang, et al.
Veröffentlicht: (2025)
FedCache: A Knowledge Cache-driven Federated Learning Architecture for Personalized Edge Intelligence
von: Wu, Zhiyuan, et al.
Veröffentlicht: (2023)
von: Wu, Zhiyuan, et al.
Veröffentlicht: (2023)
Cache Your Prompt When It's Green: Carbon-Aware Caching for Large Language Model Serving
von: Tian, Yuyang, et al.
Veröffentlicht: (2025)
von: Tian, Yuyang, et al.
Veröffentlicht: (2025)
Memory-Efficient Federated Fine-Tuning of Large Language Models via Layer Pruning
von: Wu, Yebo, et al.
Veröffentlicht: (2025)
von: Wu, Yebo, et al.
Veröffentlicht: (2025)
CacheFlow: Efficient LLM Serving with 3D-Parallel KV Cache Restoration
von: Nian, Sean, et al.
Veröffentlicht: (2026)
von: Nian, Sean, et al.
Veröffentlicht: (2026)
Mell: Memory-Efficient Large Language Model Serving via Multi-GPU KV Cache Management
von: Qianli, Liu, et al.
Veröffentlicht: (2025)
von: Qianli, Liu, et al.
Veröffentlicht: (2025)
Fine-Grained Vectorized Merge Sorting on RISC-V: From Register to Cache
von: Zhang, Jin, et al.
Veröffentlicht: (2024)
von: Zhang, Jin, et al.
Veröffentlicht: (2024)
Split Fine-Tuning for Large Language Models in Wireless Networks
von: Zhang, Songge, et al.
Veröffentlicht: (2025)
von: Zhang, Songge, et al.
Veröffentlicht: (2025)
PerCache: Predictive Hierarchical Cache for RAG Applications on Mobile Devices
von: Liu, Kaiwei, et al.
Veröffentlicht: (2025)
von: Liu, Kaiwei, et al.
Veröffentlicht: (2025)
Adaptive K-PackCache: Cost-Centric Data Caching in Cloud
von: Sarkar, Suvarthi, et al.
Veröffentlicht: (2025)
von: Sarkar, Suvarthi, et al.
Veröffentlicht: (2025)
Efficient LLM Inference with Activation Checkpointing and Hybrid Caching
von: Lee, Sanghyeon, et al.
Veröffentlicht: (2025)
von: Lee, Sanghyeon, et al.
Veröffentlicht: (2025)
Low-Latency Federated Fine-Tuning for Large Language Models Over Wireless Networks
von: Pang, Zhiwen, et al.
Veröffentlicht: (2026)
von: Pang, Zhiwen, et al.
Veröffentlicht: (2026)
DiFache: Efficient and Scalable Caching on Disaggregated Memory using Decentralized Coherence
von: Zhang, Hanze, et al.
Veröffentlicht: (2025)
von: Zhang, Hanze, et al.
Veröffentlicht: (2025)
Robust Federated Fine-Tuning in Heterogeneous Networks with Unreliable Connections: An Aggregation View
von: Wang, Yanmeng, et al.
Veröffentlicht: (2025)
von: Wang, Yanmeng, et al.
Veröffentlicht: (2025)
Caching Aided Multi-Tenant Serverless Computing
von: Qiao, Chu, et al.
Veröffentlicht: (2024)
von: Qiao, Chu, et al.
Veröffentlicht: (2024)
HLoRA: Efficient Federated Learning System for LLM Heterogeneous Fine-Tuning
von: Liu, Qianli, et al.
Veröffentlicht: (2025)
von: Liu, Qianli, et al.
Veröffentlicht: (2025)
CARM Tool: Cache-Aware Roofline Model Automatic Benchmarking and Application Analysis
von: Morgado, José, et al.
Veröffentlicht: (2026)
von: Morgado, José, et al.
Veröffentlicht: (2026)
KVCache Cache in the Wild: Characterizing and Optimizing KVCache Cache at a Large Cloud Provider
von: Wang, Jiahao, et al.
Veröffentlicht: (2025)
von: Wang, Jiahao, et al.
Veröffentlicht: (2025)
InfiniGen: Efficient Generative Inference of Large Language Models with Dynamic KV Cache Management
von: Lee, Wonbeom, et al.
Veröffentlicht: (2024)
von: Lee, Wonbeom, et al.
Veröffentlicht: (2024)
Efficient Unified Caching for Accelerating Heterogeneous AI Workloads
von: Wang, Tianze, et al.
Veröffentlicht: (2025)
von: Wang, Tianze, et al.
Veröffentlicht: (2025)
InstCache: A Predictive Cache for LLM Serving
von: Zou, Longwei, et al.
Veröffentlicht: (2024)
von: Zou, Longwei, et al.
Veröffentlicht: (2024)
RcLLM: Accelerating Generative Recommendation via Beyond-Prefix KV Caching
von: Zhao, Zhan, et al.
Veröffentlicht: (2026)
von: Zhao, Zhan, et al.
Veröffentlicht: (2026)
MPCPA: Multi-Center Privacy Computing with Predictions Aggregation based on Denoising Diffusion Probabilistic Model
von: Luo, Guibo, et al.
Veröffentlicht: (2024)
von: Luo, Guibo, et al.
Veröffentlicht: (2024)
KV Cache Compression for Inference Efficiency in LLMs: A Review
von: Liu, Yanyu, et al.
Veröffentlicht: (2025)
von: Liu, Yanyu, et al.
Veröffentlicht: (2025)
Communication-Efficient Federated Fine-Tuning
von: Theologitis, Michael, et al.
Veröffentlicht: (2025)
von: Theologitis, Michael, et al.
Veröffentlicht: (2025)
Heterogeneous Federated Fine-Tuning with Parallel One-Rank Adaptation
von: Zhang, Zikai, et al.
Veröffentlicht: (2026)
von: Zhang, Zikai, et al.
Veröffentlicht: (2026)
LLM-dCache: Improving Tool-Augmented LLMs with GPT-Driven Localized Data Caching
von: Singh, Simranjit, et al.
Veröffentlicht: (2024)
von: Singh, Simranjit, et al.
Veröffentlicht: (2024)
FLoRA: Federated Fine-Tuning Large Language Models with Heterogeneous Low-Rank Adaptations
von: Wang, Ziyao, et al.
Veröffentlicht: (2024)
von: Wang, Ziyao, et al.
Veröffentlicht: (2024)
FastCache: Optimizing Multimodal LLM Serving through Lightweight KV-Cache Compression Framework
von: Zhu, Jianian, et al.
Veröffentlicht: (2025)
von: Zhu, Jianian, et al.
Veröffentlicht: (2025)
Experimental Analysis of Server-Side Caching for Web Performance
von: Umar, Mohammad, et al.
Veröffentlicht: (2026)
von: Umar, Mohammad, et al.
Veröffentlicht: (2026)
CARAT: Client-Side Adaptive RPC and Cache Co-Tuning for Parallel File Systems
von: Rashid, Md Hasanur, et al.
Veröffentlicht: (2026)
von: Rashid, Md Hasanur, et al.
Veröffentlicht: (2026)
Memory-Efficient Split Federated Learning for LLM Fine-Tuning on Heterogeneous Mobile Devices
von: Chen, Xiaopei, et al.
Veröffentlicht: (2025)
von: Chen, Xiaopei, et al.
Veröffentlicht: (2025)
Data Caching for Enterprise-Grade Petabyte-Scale OLAP
von: Tang, Chunxu, et al.
Veröffentlicht: (2024)
von: Tang, Chunxu, et al.
Veröffentlicht: (2024)
CroSatFL: Energy-Efficient Federated Learning with Cross-Aggregation for Satellite Edge Computing
von: Yang, Nan, et al.
Veröffentlicht: (2026)
von: Yang, Nan, et al.
Veröffentlicht: (2026)
A Survey on Privacy-Preserving Caching at Network Edge: Classification, Solutions, and Challenges
von: Zhang, Xianzhi, et al.
Veröffentlicht: (2024)
von: Zhang, Xianzhi, et al.
Veröffentlicht: (2024)
A Survey on Large Language Model Acceleration based on KV Cache Management
von: Li, Haoyang, et al.
Veröffentlicht: (2024)
von: Li, Haoyang, et al.
Veröffentlicht: (2024)
TDC-Cache: A Trustworthy Decentralized Cooperative Caching Framework for Web3.0
von: Chen, Jinyu, et al.
Veröffentlicht: (2025)
von: Chen, Jinyu, et al.
Veröffentlicht: (2025)
Ähnliche Einträge
-
Decentralized Federated Learning with Model Caching on Mobile Agents
von: Wang, Xiaoyu, et al.
Veröffentlicht: (2024) -
EcoLoRA: Communication-Efficient Federated Fine-Tuning of Large Language Models
von: Liu, Han, et al.
Veröffentlicht: (2025) -
CaBaFL: Asynchronous Federated Learning via Hierarchical Cache and Feature Balance
von: Xia, Zeke, et al.
Veröffentlicht: (2024) -
Strata: Hierarchical Context Caching for Long Context Language Model Serving
von: Xie, Zhiqiang, et al.
Veröffentlicht: (2025) -
FedCache: A Knowledge Cache-driven Federated Learning Architecture for Personalized Edge Intelligence
von: Wu, Zhiyuan, et al.
Veröffentlicht: (2023)