CLLoRA: An Approach to Measure the Effects of the Context Length for LLM Fine-Tuning
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Zhang, Ping, Zhang, Zhaorui, Di, Sheng, Xin, Yao, Liu, Benben |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
HLoRA: Efficient Federated Learning System for LLM Heterogeneous Fine-Tuning
par: Liu, Qianli, et autres
Publié: (2025)
par: Liu, Qianli, et autres
Publié: (2025)
SplitFT: An Adaptive Federated Split Learning System For LLMs Fine-Tuning
par: Shan, Yimeng, et autres
Publié: (2026)
par: Shan, Yimeng, et autres
Publié: (2026)
MoE-Compression: How the Compression Error of Experts Affects the Inference Accuracy of MoE Model?
par: Ma, Songkai, et autres
Publié: (2025)
par: Ma, Songkai, et autres
Publié: (2025)
FedFa: A Fully Asynchronous Training Paradigm for Federated Learning
par: Xu, Haotian, et autres
Publié: (2024)
par: Xu, Haotian, et autres
Publié: (2024)
Fed-pilot: Optimizing LoRA Allocation for Efficient Federated Fine-Tuning with Heterogeneous Clients
par: Zhang, Zikai, et autres
Publié: (2024)
par: Zhang, Zikai, et autres
Publié: (2024)
Fed-HeLLo: Efficient Federated Foundation Model Fine-Tuning with Heterogeneous LoRA Allocation
par: Zhang, Zikai, et autres
Publié: (2025)
par: Zhang, Zikai, et autres
Publié: (2025)
Stabilizing Decentralized Federated Fine-Tuning via Topology-Aware Alternating LoRA
par: Wang, Xiaoyu, et autres
Publié: (2026)
par: Wang, Xiaoyu, et autres
Publié: (2026)
An Efficient Gradient-Aware Error-Bounded Lossy Compressor for Federated Learning
par: Ye, Zhijing, et autres
Publié: (2025)
par: Ye, Zhijing, et autres
Publié: (2025)
FLoRA: Federated Fine-Tuning Large Language Models with Heterogeneous Low-Rank Adaptations
par: Wang, Ziyao, et autres
Publié: (2024)
par: Wang, Ziyao, et autres
Publié: (2024)
TokenLake: A Unified Segment-level Prefix Cache Pool for Fine-grained Elastic Long-Context LLM Serving
par: Wu, Bingyang, et autres
Publié: (2025)
par: Wu, Bingyang, et autres
Publié: (2025)
pFedLoRA: Model-Heterogeneous Personalized Federated Learning with LoRA Tuning
par: Yi, Liping, et autres
Publié: (2023)
par: Yi, Liping, et autres
Publié: (2023)
MEMO: Fine-grained Tensor Management For Ultra-long Context LLM Training
par: Zhao, Pinxue, et autres
Publié: (2024)
par: Zhao, Pinxue, et autres
Publié: (2024)
Heterogeneous LoRA for Federated Fine-tuning of On-Device Foundation Models
par: Cho, Yae Jee, et autres
Publié: (2024)
par: Cho, Yae Jee, et autres
Publié: (2024)
LoRAFusion: Efficient LoRA Fine-Tuning for LLMs
par: Zhu, Zhanda, et autres
Publié: (2025)
par: Zhu, Zhanda, et autres
Publié: (2025)
Deadline-Aware Online Scheduling for LLM Fine-Tuning with Spot Market Predictions
par: Kong, Linggao, et autres
Publié: (2025)
par: Kong, Linggao, et autres
Publié: (2025)
JORA: JAX Tensor-Parallel LoRA Library for Retrieval Augmented Fine-Tuning
par: Tahir, Anique, et autres
Publié: (2024)
par: Tahir, Anique, et autres
Publié: (2024)
Exploring Selective Layer Fine-Tuning in Federated Learning
par: Sun, Yuchang, et autres
Publié: (2024)
par: Sun, Yuchang, et autres
Publié: (2024)
MobiZO: Enabling Efficient LLM Fine-Tuning at the Edge via Inference Engines
par: Gao, Lei, et autres
Publié: (2024)
par: Gao, Lei, et autres
Publié: (2024)
SplitLoRA: A Split Parameter-Efficient Fine-Tuning Framework for Large Language Models
par: Lin, Zheng, et autres
Publié: (2024)
par: Lin, Zheng, et autres
Publié: (2024)
Communication-Efficient Federated Fine-Tuning
par: Theologitis, Michael, et autres
Publié: (2025)
par: Theologitis, Michael, et autres
Publié: (2025)
RBLA: Rank-Based-LoRA-Aggregation for Fine-tuning Heterogeneous Models in FLaaS
par: Chen, Shuaijun, et autres
Publié: (2024)
par: Chen, Shuaijun, et autres
Publié: (2024)
HSplitLoRA: A Heterogeneous Split Parameter-Efficient Fine-Tuning Framework for Large Language Models
par: Lin, Zheng, et autres
Publié: (2025)
par: Lin, Zheng, et autres
Publié: (2025)
WarmServe: Enabling One-for-Many GPU Prewarming for Multi-LLM Serving
par: Lou, Chiheng, et autres
Publié: (2025)
par: Lou, Chiheng, et autres
Publié: (2025)
Foundry: Template-Based CUDA Graph Context Materialization for Fast LLM Serving Cold Start
par: Liu, Xueshen, et autres
Publié: (2026)
par: Liu, Xueshen, et autres
Publié: (2026)
Revisiting Federated Fine-Tuning: A Single Communication Round is Enough for Foundation Models
par: Wang, Ziyao, et autres
Publié: (2024)
par: Wang, Ziyao, et autres
Publié: (2024)
HAFLQ: Heterogeneous Adaptive Federated LoRA Fine-tuned LLM with Quantization
par: Su, Yang, et autres
Publié: (2024)
par: Su, Yang, et autres
Publié: (2024)
Seer: Online Context Learning for Fast Synchronous LLM Reinforcement Learning
par: Qin, Ruoyu, et autres
Publié: (2025)
par: Qin, Ruoyu, et autres
Publié: (2025)
Mitigating Catastrophic Forgetting with Adaptive Transformer Block Expansion in Federated Fine-Tuning
par: Huo, Yujia, et autres
Publié: (2025)
par: Huo, Yujia, et autres
Publié: (2025)
ALTO: Adaptive LoRA Tuning and Orchestration for Heterogeneous LoRA Training Workloads
par: Zuo, Jingwei, et autres
Publié: (2026)
par: Zuo, Jingwei, et autres
Publié: (2026)
DLoRA: Distributed Parameter-Efficient Fine-Tuning Solution for Large Language Model
par: Gao, Chao, et autres
Publié: (2024)
par: Gao, Chao, et autres
Publié: (2024)
70% Size, 100% Accuracy: Lossless LLM Compression for Efficient GPU Inference via Dynamic-Length Float (DFloat11)
par: Zhang, Tianyi, et autres
Publié: (2025)
par: Zhang, Tianyi, et autres
Publié: (2025)
EcoLoRA: Communication-Efficient Federated Fine-Tuning of Large Language Models
par: Liu, Han, et autres
Publié: (2025)
par: Liu, Han, et autres
Publié: (2025)
ByteScale: Efficient Scaling of LLM Training with a 2048K Context Length on More Than 12,000 GPUs
par: Ge, Hao, et autres
Publié: (2025)
par: Ge, Hao, et autres
Publié: (2025)
TSFLora: Token-Compressed Split Fine-Tuning for Wireless Edge Networks
par: Qiang, Xianke, et autres
Publié: (2026)
par: Qiang, Xianke, et autres
Publié: (2026)
No Request Left Behind: Tackling Heterogeneity in Long-Context LLM Inference with Medha
par: Agrawal, Amey, et autres
Publié: (2024)
par: Agrawal, Amey, et autres
Publié: (2024)
Flexible Personalized Split Federated Learning for On-Device Fine-Tuning of Foundation Models
par: Yuan, Tianjun, et autres
Publié: (2025)
par: Yuan, Tianjun, et autres
Publié: (2025)
AutoRank: MCDA Based Rank Personalization for LoRA-Enabled Distributed Learning
par: Chen, Shuaijun, et autres
Publié: (2024)
par: Chen, Shuaijun, et autres
Publié: (2024)
ServerlessLoRA: Minimizing Latency and Cost in Serverless Inference for LoRA-Based LLMs
par: Sui, Yifan, et autres
Publié: (2025)
par: Sui, Yifan, et autres
Publié: (2025)
You Don't Need All Attentions: Distributed Dynamic Fine-Tuning for Foundation Models
par: Ding, Shiwei, et autres
Publié: (2025)
par: Ding, Shiwei, et autres
Publié: (2025)
Federated LoRA with Sparse Communication
par: Kuo, Kevin, et autres
Publié: (2024)
par: Kuo, Kevin, et autres
Publié: (2024)
Documents similaires
-
HLoRA: Efficient Federated Learning System for LLM Heterogeneous Fine-Tuning
par: Liu, Qianli, et autres
Publié: (2025) -
SplitFT: An Adaptive Federated Split Learning System For LLMs Fine-Tuning
par: Shan, Yimeng, et autres
Publié: (2026) -
MoE-Compression: How the Compression Error of Experts Affects the Inference Accuracy of MoE Model?
par: Ma, Songkai, et autres
Publié: (2025) -
FedFa: A Fully Asynchronous Training Paradigm for Federated Learning
par: Xu, Haotian, et autres
Publié: (2024) -
Fed-pilot: Optimizing LoRA Allocation for Efficient Federated Fine-Tuning with Heterogeneous Clients
par: Zhang, Zikai, et autres
Publié: (2024)