Skrull: Towards Efficient Long Context Fine-tuning through Dynamic Data Scheduling
Fuente:
arXiv
Guardado en:
| Autores principales: | Xu, Hongtao, Shen, Wenting, Wei, Yuanxin, Wang, Ang, Runfan, Guo, Wang, Tianxing, Li, Yong, Li, Mingzhen, Jia, Weile |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Efficient Long Context Fine-tuning with Chunk Flow
por: Yuan, Xiulong, et al.
Publicado: (2025)
por: Yuan, Xiulong, et al.
Publicado: (2025)
Large-scale Neural Network Quantum States for ab initio Quantum Chemistry Simulations on Fugaku
por: Xu, Hongtao, et al.
Publicado: (2025)
por: Xu, Hongtao, et al.
Publicado: (2025)
SparseBalance: Load-Balanced Long Context Training with Dynamic Sparse Attention
por: Xu, Hongtao, et al.
Publicado: (2026)
por: Xu, Hongtao, et al.
Publicado: (2026)
JanusPipe: Efficient Pipeline Parallel Training for Machine Learning Interatomic Potentials
por: Wang, Hongyu, et al.
Publicado: (2026)
por: Wang, Hongyu, et al.
Publicado: (2026)
LongLoRA: Efficient Fine-tuning of Long-Context Large Language Models
por: Chen, Yukang, et al.
Publicado: (2023)
por: Chen, Yukang, et al.
Publicado: (2023)
Scaling Neural-Network-Based Molecular Dynamics with Long-Range Electrostatic Interactions to 51 Nanoseconds per Day
por: Li, Jianxiong, et al.
Publicado: (2025)
por: Li, Jianxiong, et al.
Publicado: (2025)
Hierarchical Balance Packing: Towards Efficient Supervised Fine-tuning for Long-Context LLM
por: Yao, Yongqiang, et al.
Publicado: (2025)
por: Yao, Yongqiang, et al.
Publicado: (2025)
Scaling Molecular Dynamics with ab initio Accuracy to 149 Nanoseconds per Day
por: Li, Jianxiong, et al.
Publicado: (2024)
por: Li, Jianxiong, et al.
Publicado: (2024)
A Novel Dynamic Peer-to-Peer Clustering Algorithm and Its Application to Aggregate Energy Storage Systems
por: Zhang, Runfan, et al.
Publicado: (2019)
por: Zhang, Runfan, et al.
Publicado: (2019)
SC-LoRA: Balancing Efficient Fine-tuning and Knowledge Preservation via Subspace-Constrained LoRA
por: Luo, Minrui, et al.
Publicado: (2025)
por: Luo, Minrui, et al.
Publicado: (2025)
Moderator: Moderating Text-to-Image Diffusion Models through Fine-grained Context-based Policies
por: Wang, Peiran, et al.
Publicado: (2024)
por: Wang, Peiran, et al.
Publicado: (2024)
LiteLong: Resource-Efficient Long-Context Data Synthesis for LLMs
por: Jia, Junlong, et al.
Publicado: (2025)
por: Jia, Junlong, et al.
Publicado: (2025)
DICE: Enabling Efficient General-Purpose SIMT Execution with Statically Scheduled Coarse-Grained Reconfigurable Arrays
por: Wang, Jiayi, et al.
Publicado: (2026)
por: Wang, Jiayi, et al.
Publicado: (2026)
Towards Context-Robust LLMs: A Gated Representation Fine-tuning Approach
por: Zeng, Shenglai, et al.
Publicado: (2025)
por: Zeng, Shenglai, et al.
Publicado: (2025)
MatRIS: Toward Reliable and Efficient Pretrained Machine Learning Interatomic Potentials
por: Zhou, Yuanchang, et al.
Publicado: (2026)
por: Zhou, Yuanchang, et al.
Publicado: (2026)
Efficient Ensemble for Fine-tuning Language Models on Multiple Datasets
por: Li, Dongyue, et al.
Publicado: (2025)
por: Li, Dongyue, et al.
Publicado: (2025)
Towards Building Non-Fine-Tunable Foundation Models
por: Wang, Ziyao, et al.
Publicado: (2026)
por: Wang, Ziyao, et al.
Publicado: (2026)
Maintaining Structural Integrity in Parameter Spaces for Parameter Efficient Fine-tuning
por: Si, Chongjie, et al.
Publicado: (2024)
por: Si, Chongjie, et al.
Publicado: (2024)
Selective Fine-tuning on LLM-labeled Data May Reduce Reliance on Human Annotation: A Case Study Using Schedule-of-Event Table Detection
por: Kumar, Bhawesh, et al.
Publicado: (2024)
por: Kumar, Bhawesh, et al.
Publicado: (2024)
On the Loss of Context-awareness in General Instruction Fine-tuning
por: Wang, Yihan, et al.
Publicado: (2024)
por: Wang, Yihan, et al.
Publicado: (2024)
COSMIC: Data Efficient Instruction-tuning For Speech In-Context Learning
por: Pan, Jing, et al.
Publicado: (2023)
por: Pan, Jing, et al.
Publicado: (2023)
Pharmacist: Safety Alignment Data Curation for Large Language Models against Harmful Fine-tuning
por: Liu, Guozhi, et al.
Publicado: (2025)
por: Liu, Guozhi, et al.
Publicado: (2025)
Efficient Model Development through Fine-tuning Transfer
por: Lin, Pin-Jie, et al.
Publicado: (2025)
por: Lin, Pin-Jie, et al.
Publicado: (2025)
LeMo: Enabling LEss Token Involvement for MOre Context Fine-tuning
por: Wang, Tuowei, et al.
Publicado: (2025)
por: Wang, Tuowei, et al.
Publicado: (2025)
Towards Resilient Safety-driven Unlearning for Diffusion Models against Downstream Fine-tuning
por: Li, Boheng, et al.
Publicado: (2025)
por: Li, Boheng, et al.
Publicado: (2025)
MLP Fusion: Towards Efficient Fine-tuning of Dense and Mixture-of-Experts Language Models
por: Ai, Mengting, et al.
Publicado: (2023)
por: Ai, Mengting, et al.
Publicado: (2023)
Adaptive Defense against Harmful Fine-Tuning for Large Language Models via Bayesian Data Scheduler
por: Hu, Zixuan, et al.
Publicado: (2025)
por: Hu, Zixuan, et al.
Publicado: (2025)
Data-efficient Fine-tuning for LLM-based Recommendation
por: Lin, Xinyu, et al.
Publicado: (2024)
por: Lin, Xinyu, et al.
Publicado: (2024)
DSO: A GPU Energy Efficiency Optimizer by Fusing Dynamic and Static Information
por: Wang, Qiang, et al.
Publicado: (2024)
por: Wang, Qiang, et al.
Publicado: (2024)
Memento: Fine-tuning LLM Agents without Fine-tuning LLMs
por: Zhou, Huichi, et al.
Publicado: (2025)
por: Zhou, Huichi, et al.
Publicado: (2025)
Fine-tuned In-Context Learning Transformers are Excellent Tabular Data Classifiers
por: Breejen, Felix den, et al.
Publicado: (2024)
por: Breejen, Felix den, et al.
Publicado: (2024)
When Long Helps Short: How Context Length in Supervised Fine-tuning Affects Behavior of Large Language Models
por: Zheng, Yingming, et al.
Publicado: (2025)
por: Zheng, Yingming, et al.
Publicado: (2025)
Explain Less, Understand More: Jargon Detection via Personalized Parameter-Efficient Fine-tuning
por: Wu, Bohao, et al.
Publicado: (2025)
por: Wu, Bohao, et al.
Publicado: (2025)
MEDA: Dynamic KV Cache Allocation for Efficient Multimodal Long-Context Inference
por: Wan, Zhongwei, et al.
Publicado: (2025)
por: Wan, Zhongwei, et al.
Publicado: (2025)
Beyond Accuracy: On the Effects of Fine-tuning Towards Vision-Language Model's Prediction Rationality
por: Wang, Qitong, et al.
Publicado: (2024)
por: Wang, Qitong, et al.
Publicado: (2024)
Towards Compatible Fine-tuning for Vision-Language Model Updates
por: Wang, Zhengbo, et al.
Publicado: (2024)
por: Wang, Zhengbo, et al.
Publicado: (2024)
QUITO: Accelerating Long-Context Reasoning through Query-Guided Context Compression
por: Wang, Wenshan, et al.
Publicado: (2024)
por: Wang, Wenshan, et al.
Publicado: (2024)
Efficient End-to-end Language Model Fine-tuning on Graphs
por: Xue, Rui, et al.
Publicado: (2023)
por: Xue, Rui, et al.
Publicado: (2023)
QwenLong-CPRS: Towards $\infty$-LLMs with Dynamic Context Optimization
por: Shen, Weizhou, et al.
Publicado: (2025)
por: Shen, Weizhou, et al.
Publicado: (2025)
Data Whisperer: Efficient Data Selection for Task-Specific LLM Fine-Tuning via Few-Shot In-Context Learning
por: Wang, Shaobo, et al.
Publicado: (2025)
por: Wang, Shaobo, et al.
Publicado: (2025)
Ejemplares similares
-
Efficient Long Context Fine-tuning with Chunk Flow
por: Yuan, Xiulong, et al.
Publicado: (2025) -
Large-scale Neural Network Quantum States for ab initio Quantum Chemistry Simulations on Fugaku
por: Xu, Hongtao, et al.
Publicado: (2025) -
SparseBalance: Load-Balanced Long Context Training with Dynamic Sparse Attention
por: Xu, Hongtao, et al.
Publicado: (2026) -
JanusPipe: Efficient Pipeline Parallel Training for Machine Learning Interatomic Potentials
por: Wang, Hongyu, et al.
Publicado: (2026) -
LongLoRA: Efficient Fine-tuning of Long-Context Large Language Models
por: Chen, Yukang, et al.
Publicado: (2023)