SinkLoRA: Enhanced Efficiency and Chat Capabilities for Long-Context Large Language Models
Fuente:
arXiv
Salvato in:
| Autore principale: | Zhang, Hengyu |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
LongLoRA: Efficient Fine-tuning of Long-Context Large Language Models
di: Chen, Yukang, et al.
Pubblicazione: (2023)
di: Chen, Yukang, et al.
Pubblicazione: (2023)
MixLoRA: Enhancing Large Language Models Fine-Tuning with LoRA-based Mixture of Experts
di: Li, Dengchun, et al.
Pubblicazione: (2024)
di: Li, Dengchun, et al.
Pubblicazione: (2024)
LoRA-Flow: Dynamic LoRA Fusion for Large Language Models in Generative Tasks
di: Wang, Hanqing, et al.
Pubblicazione: (2024)
di: Wang, Hanqing, et al.
Pubblicazione: (2024)
Optimizing Large Language Models with an Enhanced LoRA Fine-Tuning Algorithm for Efficiency and Robustness in NLP Tasks
di: Hu, Jiacheng, et al.
Pubblicazione: (2024)
di: Hu, Jiacheng, et al.
Pubblicazione: (2024)
LoRA-Gen: Specializing Large Language Model via Online LoRA Generation
di: Xiao, Yicheng, et al.
Pubblicazione: (2025)
di: Xiao, Yicheng, et al.
Pubblicazione: (2025)
Dual LoRA: Enhancing LoRA with Magnitude and Direction Updates
di: Xu, Yixing, et al.
Pubblicazione: (2025)
di: Xu, Yixing, et al.
Pubblicazione: (2025)
NeedleInATable: Exploring Long-Context Capability of Large Language Models towards Long-Structured Tables
di: Wang, Lanrui, et al.
Pubblicazione: (2025)
di: Wang, Lanrui, et al.
Pubblicazione: (2025)
A Survey on LoRA of Large Language Models
di: Mao, Yuren, et al.
Pubblicazione: (2024)
di: Mao, Yuren, et al.
Pubblicazione: (2024)
DLP-LoRA: Efficient Task-Specific LoRA Fusion with a Dynamic, Lightweight Plugin for Large Language Models
di: Zhang, Yuxuan, et al.
Pubblicazione: (2024)
di: Zhang, Yuxuan, et al.
Pubblicazione: (2024)
Garbage Attention in Large Language Models: BOS Sink Heads and Sink-aware Pruning
di: Sok, Jaewon, et al.
Pubblicazione: (2026)
di: Sok, Jaewon, et al.
Pubblicazione: (2026)
In-Context Meta LoRA Generation
di: Shao, Yihua, et al.
Pubblicazione: (2025)
di: Shao, Yihua, et al.
Pubblicazione: (2025)
LoRASuite: Efficient LoRA Adaptation Across Large Language Model Upgrades
di: Li, Yanan, et al.
Pubblicazione: (2025)
di: Li, Yanan, et al.
Pubblicazione: (2025)
DiffLoRA: Differential Low-Rank Adapters for Large Language Models
di: Misrahi, Alexandre, et al.
Pubblicazione: (2025)
di: Misrahi, Alexandre, et al.
Pubblicazione: (2025)
MeteoRA: Multiple-tasks Embedded LoRA for Large Language Models
di: Xu, Jingwei, et al.
Pubblicazione: (2024)
di: Xu, Jingwei, et al.
Pubblicazione: (2024)
DenseLoRA: Dense Low-Rank Adaptation of Large Language Models
di: Mu, Lin, et al.
Pubblicazione: (2025)
di: Mu, Lin, et al.
Pubblicazione: (2025)
LoPT: Lossless Parallel Tokenization Acceleration for Long Context Inference of Large Language Model
di: Shao, Wei, et al.
Pubblicazione: (2025)
di: Shao, Wei, et al.
Pubblicazione: (2025)
TableLoRA: Low-rank Adaptation on Table Structure Understanding for Large Language Models
di: He, Xinyi, et al.
Pubblicazione: (2025)
di: He, Xinyi, et al.
Pubblicazione: (2025)
To Sink or Not to Sink: Visual Information Pathways in Large Vision-Language Models
di: Luo, Jiayun, et al.
Pubblicazione: (2025)
di: Luo, Jiayun, et al.
Pubblicazione: (2025)
Adapting Large Language Models to a Low-Resource Agglutinative Language: A Comparative Study of LoRA and QLoRA for Bashkir
di: Arabov, Mullosharaf K., et al.
Pubblicazione: (2026)
di: Arabov, Mullosharaf K., et al.
Pubblicazione: (2026)
Assertion Detection Large Language Model In-context Learning LoRA Fine-tuning
di: Ji, Yuelyu, et al.
Pubblicazione: (2024)
di: Ji, Yuelyu, et al.
Pubblicazione: (2024)
Mixture-of-Agents Enhances Large Language Model Capabilities
di: Wang, Junlin, et al.
Pubblicazione: (2024)
di: Wang, Junlin, et al.
Pubblicazione: (2024)
Event Detection with a Context-Aware Encoder and LoRA for Improved Performance on Long-Tailed Classes
di: Monsur, Abdullah Al, et al.
Pubblicazione: (2026)
di: Monsur, Abdullah Al, et al.
Pubblicazione: (2026)
MiLoRA: Efficient Mixture of Low-Rank Adaptation for Large Language Models Fine-tuning
di: Zhang, Jingfan, et al.
Pubblicazione: (2024)
di: Zhang, Jingfan, et al.
Pubblicazione: (2024)
LoRA$^2$ : Multi-Scale Low-Rank Approximations for Fine-Tuning Large Language Models
di: Zhang, Jia-Chen, et al.
Pubblicazione: (2024)
di: Zhang, Jia-Chen, et al.
Pubblicazione: (2024)
SoLoPO: Unlocking Long-Context Capabilities in LLMs via Short-to-Long Preference Optimization
di: Sun, Huashan, et al.
Pubblicazione: (2025)
di: Sun, Huashan, et al.
Pubblicazione: (2025)
CTR-Sink: Attention Sink for Language Models in Click-Through Rate Prediction
di: Li, Zixuan, et al.
Pubblicazione: (2025)
di: Li, Zixuan, et al.
Pubblicazione: (2025)
Doc-to-LoRA: Learning to Instantly Internalize Contexts
di: Charakorn, Rujikorn, et al.
Pubblicazione: (2026)
di: Charakorn, Rujikorn, et al.
Pubblicazione: (2026)
HypeLoRA: Hyper-Network-Generated LoRA Adapters for Calibrated Language Model Fine-Tuning
di: Trojan, Bartosz, et al.
Pubblicazione: (2026)
di: Trojan, Bartosz, et al.
Pubblicazione: (2026)
HelloBench: Evaluating Long Text Generation Capabilities of Large Language Models
di: Que, Haoran, et al.
Pubblicazione: (2024)
di: Que, Haoran, et al.
Pubblicazione: (2024)
Train Small, Infer Large: Memory-Efficient LoRA Training for Large Language Models
di: Zhang, Jun, et al.
Pubblicazione: (2025)
di: Zhang, Jun, et al.
Pubblicazione: (2025)
MeTA-LoRA: Data-Efficient Multi-Task Fine-Tuning for Large Language Models
di: Cheng, Bo, et al.
Pubblicazione: (2025)
di: Cheng, Bo, et al.
Pubblicazione: (2025)
Multimodal Needle in a Haystack: Benchmarking Long-Context Capability of Multimodal Large Language Models
di: Wang, Hengyi, et al.
Pubblicazione: (2024)
di: Wang, Hengyi, et al.
Pubblicazione: (2024)
ELDER: Enhancing Lifelong Model Editing with Mixture-of-LoRA
di: Li, Jiaang, et al.
Pubblicazione: (2024)
di: Li, Jiaang, et al.
Pubblicazione: (2024)
LoRA-Leak: Membership Inference Attacks Against LoRA Fine-tuned Language Models
di: Ran, Delong, et al.
Pubblicazione: (2025)
di: Ran, Delong, et al.
Pubblicazione: (2025)
JumpLoRA: Sparse Adapters for Continual Learning in Large Language Models
di: Dragomir, Alexandra, et al.
Pubblicazione: (2026)
di: Dragomir, Alexandra, et al.
Pubblicazione: (2026)
Training-Free Long-Context Scaling of Large Language Models
di: An, Chenxin, et al.
Pubblicazione: (2024)
di: An, Chenxin, et al.
Pubblicazione: (2024)
PeriodicLoRA: Breaking the Low-Rank Bottleneck in LoRA Optimization
di: Meng, Xiangdi, et al.
Pubblicazione: (2024)
di: Meng, Xiangdi, et al.
Pubblicazione: (2024)
LoRA-Drop: Temporal LoRA Decoding for Efficient LLM Inference
di: Rajabzadeh, Hossein, et al.
Pubblicazione: (2026)
di: Rajabzadeh, Hossein, et al.
Pubblicazione: (2026)
SHINE: A Scalable In-Context Hypernetwork for Mapping Context to LoRA in a Single Pass
di: Liu, Yewei, et al.
Pubblicazione: (2026)
di: Liu, Yewei, et al.
Pubblicazione: (2026)
Chain of Agents: Large Language Models Collaborating on Long-Context Tasks
di: Zhang, Yusen, et al.
Pubblicazione: (2024)
di: Zhang, Yusen, et al.
Pubblicazione: (2024)
Documenti analoghi
-
LongLoRA: Efficient Fine-tuning of Long-Context Large Language Models
di: Chen, Yukang, et al.
Pubblicazione: (2023) -
MixLoRA: Enhancing Large Language Models Fine-Tuning with LoRA-based Mixture of Experts
di: Li, Dengchun, et al.
Pubblicazione: (2024) -
LoRA-Flow: Dynamic LoRA Fusion for Large Language Models in Generative Tasks
di: Wang, Hanqing, et al.
Pubblicazione: (2024) -
Optimizing Large Language Models with an Enhanced LoRA Fine-Tuning Algorithm for Efficiency and Robustness in NLP Tasks
di: Hu, Jiacheng, et al.
Pubblicazione: (2024) -
LoRA-Gen: Specializing Large Language Model via Online LoRA Generation
di: Xiao, Yicheng, et al.
Pubblicazione: (2025)