SinkLoRA: Enhanced Efficiency and Chat Capabilities for Long-Context Large Language Models
Fuente:
arXiv
Enregistré dans:
| Auteur principal: | Zhang, Hengyu |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
LongLoRA: Efficient Fine-tuning of Long-Context Large Language Models
par: Chen, Yukang, et autres
Publié: (2023)
par: Chen, Yukang, et autres
Publié: (2023)
MixLoRA: Enhancing Large Language Models Fine-Tuning with LoRA-based Mixture of Experts
par: Li, Dengchun, et autres
Publié: (2024)
par: Li, Dengchun, et autres
Publié: (2024)
LoRA-Flow: Dynamic LoRA Fusion for Large Language Models in Generative Tasks
par: Wang, Hanqing, et autres
Publié: (2024)
par: Wang, Hanqing, et autres
Publié: (2024)
Optimizing Large Language Models with an Enhanced LoRA Fine-Tuning Algorithm for Efficiency and Robustness in NLP Tasks
par: Hu, Jiacheng, et autres
Publié: (2024)
par: Hu, Jiacheng, et autres
Publié: (2024)
LoRA-Gen: Specializing Large Language Model via Online LoRA Generation
par: Xiao, Yicheng, et autres
Publié: (2025)
par: Xiao, Yicheng, et autres
Publié: (2025)
Dual LoRA: Enhancing LoRA with Magnitude and Direction Updates
par: Xu, Yixing, et autres
Publié: (2025)
par: Xu, Yixing, et autres
Publié: (2025)
NeedleInATable: Exploring Long-Context Capability of Large Language Models towards Long-Structured Tables
par: Wang, Lanrui, et autres
Publié: (2025)
par: Wang, Lanrui, et autres
Publié: (2025)
A Survey on LoRA of Large Language Models
par: Mao, Yuren, et autres
Publié: (2024)
par: Mao, Yuren, et autres
Publié: (2024)
DLP-LoRA: Efficient Task-Specific LoRA Fusion with a Dynamic, Lightweight Plugin for Large Language Models
par: Zhang, Yuxuan, et autres
Publié: (2024)
par: Zhang, Yuxuan, et autres
Publié: (2024)
Garbage Attention in Large Language Models: BOS Sink Heads and Sink-aware Pruning
par: Sok, Jaewon, et autres
Publié: (2026)
par: Sok, Jaewon, et autres
Publié: (2026)
In-Context Meta LoRA Generation
par: Shao, Yihua, et autres
Publié: (2025)
par: Shao, Yihua, et autres
Publié: (2025)
LoRASuite: Efficient LoRA Adaptation Across Large Language Model Upgrades
par: Li, Yanan, et autres
Publié: (2025)
par: Li, Yanan, et autres
Publié: (2025)
DiffLoRA: Differential Low-Rank Adapters for Large Language Models
par: Misrahi, Alexandre, et autres
Publié: (2025)
par: Misrahi, Alexandre, et autres
Publié: (2025)
MeteoRA: Multiple-tasks Embedded LoRA for Large Language Models
par: Xu, Jingwei, et autres
Publié: (2024)
par: Xu, Jingwei, et autres
Publié: (2024)
DenseLoRA: Dense Low-Rank Adaptation of Large Language Models
par: Mu, Lin, et autres
Publié: (2025)
par: Mu, Lin, et autres
Publié: (2025)
LoPT: Lossless Parallel Tokenization Acceleration for Long Context Inference of Large Language Model
par: Shao, Wei, et autres
Publié: (2025)
par: Shao, Wei, et autres
Publié: (2025)
TableLoRA: Low-rank Adaptation on Table Structure Understanding for Large Language Models
par: He, Xinyi, et autres
Publié: (2025)
par: He, Xinyi, et autres
Publié: (2025)
To Sink or Not to Sink: Visual Information Pathways in Large Vision-Language Models
par: Luo, Jiayun, et autres
Publié: (2025)
par: Luo, Jiayun, et autres
Publié: (2025)
Adapting Large Language Models to a Low-Resource Agglutinative Language: A Comparative Study of LoRA and QLoRA for Bashkir
par: Arabov, Mullosharaf K., et autres
Publié: (2026)
par: Arabov, Mullosharaf K., et autres
Publié: (2026)
Assertion Detection Large Language Model In-context Learning LoRA Fine-tuning
par: Ji, Yuelyu, et autres
Publié: (2024)
par: Ji, Yuelyu, et autres
Publié: (2024)
Mixture-of-Agents Enhances Large Language Model Capabilities
par: Wang, Junlin, et autres
Publié: (2024)
par: Wang, Junlin, et autres
Publié: (2024)
Event Detection with a Context-Aware Encoder and LoRA for Improved Performance on Long-Tailed Classes
par: Monsur, Abdullah Al, et autres
Publié: (2026)
par: Monsur, Abdullah Al, et autres
Publié: (2026)
MiLoRA: Efficient Mixture of Low-Rank Adaptation for Large Language Models Fine-tuning
par: Zhang, Jingfan, et autres
Publié: (2024)
par: Zhang, Jingfan, et autres
Publié: (2024)
LoRA$^2$ : Multi-Scale Low-Rank Approximations for Fine-Tuning Large Language Models
par: Zhang, Jia-Chen, et autres
Publié: (2024)
par: Zhang, Jia-Chen, et autres
Publié: (2024)
SoLoPO: Unlocking Long-Context Capabilities in LLMs via Short-to-Long Preference Optimization
par: Sun, Huashan, et autres
Publié: (2025)
par: Sun, Huashan, et autres
Publié: (2025)
CTR-Sink: Attention Sink for Language Models in Click-Through Rate Prediction
par: Li, Zixuan, et autres
Publié: (2025)
par: Li, Zixuan, et autres
Publié: (2025)
Doc-to-LoRA: Learning to Instantly Internalize Contexts
par: Charakorn, Rujikorn, et autres
Publié: (2026)
par: Charakorn, Rujikorn, et autres
Publié: (2026)
HypeLoRA: Hyper-Network-Generated LoRA Adapters for Calibrated Language Model Fine-Tuning
par: Trojan, Bartosz, et autres
Publié: (2026)
par: Trojan, Bartosz, et autres
Publié: (2026)
HelloBench: Evaluating Long Text Generation Capabilities of Large Language Models
par: Que, Haoran, et autres
Publié: (2024)
par: Que, Haoran, et autres
Publié: (2024)
Train Small, Infer Large: Memory-Efficient LoRA Training for Large Language Models
par: Zhang, Jun, et autres
Publié: (2025)
par: Zhang, Jun, et autres
Publié: (2025)
MeTA-LoRA: Data-Efficient Multi-Task Fine-Tuning for Large Language Models
par: Cheng, Bo, et autres
Publié: (2025)
par: Cheng, Bo, et autres
Publié: (2025)
Multimodal Needle in a Haystack: Benchmarking Long-Context Capability of Multimodal Large Language Models
par: Wang, Hengyi, et autres
Publié: (2024)
par: Wang, Hengyi, et autres
Publié: (2024)
ELDER: Enhancing Lifelong Model Editing with Mixture-of-LoRA
par: Li, Jiaang, et autres
Publié: (2024)
par: Li, Jiaang, et autres
Publié: (2024)
LoRA-Leak: Membership Inference Attacks Against LoRA Fine-tuned Language Models
par: Ran, Delong, et autres
Publié: (2025)
par: Ran, Delong, et autres
Publié: (2025)
JumpLoRA: Sparse Adapters for Continual Learning in Large Language Models
par: Dragomir, Alexandra, et autres
Publié: (2026)
par: Dragomir, Alexandra, et autres
Publié: (2026)
Training-Free Long-Context Scaling of Large Language Models
par: An, Chenxin, et autres
Publié: (2024)
par: An, Chenxin, et autres
Publié: (2024)
PeriodicLoRA: Breaking the Low-Rank Bottleneck in LoRA Optimization
par: Meng, Xiangdi, et autres
Publié: (2024)
par: Meng, Xiangdi, et autres
Publié: (2024)
LoRA-Drop: Temporal LoRA Decoding for Efficient LLM Inference
par: Rajabzadeh, Hossein, et autres
Publié: (2026)
par: Rajabzadeh, Hossein, et autres
Publié: (2026)
SHINE: A Scalable In-Context Hypernetwork for Mapping Context to LoRA in a Single Pass
par: Liu, Yewei, et autres
Publié: (2026)
par: Liu, Yewei, et autres
Publié: (2026)
Chain of Agents: Large Language Models Collaborating on Long-Context Tasks
par: Zhang, Yusen, et autres
Publié: (2024)
par: Zhang, Yusen, et autres
Publié: (2024)
Documents similaires
-
LongLoRA: Efficient Fine-tuning of Long-Context Large Language Models
par: Chen, Yukang, et autres
Publié: (2023) -
MixLoRA: Enhancing Large Language Models Fine-Tuning with LoRA-based Mixture of Experts
par: Li, Dengchun, et autres
Publié: (2024) -
LoRA-Flow: Dynamic LoRA Fusion for Large Language Models in Generative Tasks
par: Wang, Hanqing, et autres
Publié: (2024) -
Optimizing Large Language Models with an Enhanced LoRA Fine-Tuning Algorithm for Efficiency and Robustness in NLP Tasks
par: Hu, Jiacheng, et autres
Publié: (2024) -
LoRA-Gen: Specializing Large Language Model via Online LoRA Generation
par: Xiao, Yicheng, et autres
Publié: (2025)