Guardado en:
| Autores principales: | Li, Dongyue, Zhang, Ziniu, Wang, Lu, Zhang, Hongyang R. |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | https://arxiv.org/abs/2409.19458 |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Efficient Ensemble for Fine-tuning Language Models on Multiple Datasets
por: Li, Dongyue, et al.
Publicado: (2025)
por: Li, Dongyue, et al.
Publicado: (2025)
Linear-Time Demonstration Selection for In-Context Learning via Gradient Estimation
por: Zhang, Ziniu, et al.
Publicado: (2025)
por: Zhang, Ziniu, et al.
Publicado: (2025)
Improved Regularization and Robustness for Fine-tuning in Neural Networks
por: Li, Dongyue, et al.
Publicado: (2021)
por: Li, Dongyue, et al.
Publicado: (2021)
Memento: Fine-tuning LLM Agents without Fine-tuning LLMs
por: Zhou, Huichi, et al.
Publicado: (2025)
por: Zhou, Huichi, et al.
Publicado: (2025)
Fine-tuning can Help Detect Pretraining Data from Large Language Models
por: Zhang, Hengxiang, et al.
Publicado: (2024)
por: Zhang, Hengxiang, et al.
Publicado: (2024)
Advancing Parameter Efficiency in Fine-tuning via Representation Editing
por: Wu, Muling, et al.
Publicado: (2024)
por: Wu, Muling, et al.
Publicado: (2024)
SEE: Continual Fine-tuning with Sequential Ensemble of Experts
por: Wang, Zhilin, et al.
Publicado: (2025)
por: Wang, Zhilin, et al.
Publicado: (2025)
Relational Knowledge Distillation Using Fine-tuned Function Vectors
por: Kang, Andrea, et al.
Publicado: (2026)
por: Kang, Andrea, et al.
Publicado: (2026)
Outlier-weighed Layerwise Sampling for LLM Fine-tuning
por: Li, Pengxiang, et al.
Publicado: (2024)
por: Li, Pengxiang, et al.
Publicado: (2024)
How Abilities in Large Language Models are Affected by Supervised Fine-tuning Data Composition
por: Dong, Guanting, et al.
Publicado: (2023)
por: Dong, Guanting, et al.
Publicado: (2023)
Personalized Federated Fine-tuning for Heterogeneous Data: An Automatic Rank Learning Approach via Two-Level LoRA
por: Hao, Jie, et al.
Publicado: (2025)
por: Hao, Jie, et al.
Publicado: (2025)
Improving Data Efficiency for LLM Reinforcement Fine-tuning Through Difficulty-targeted Online Data Selection and Rollout Replay
por: Sun, Yifan, et al.
Publicado: (2025)
por: Sun, Yifan, et al.
Publicado: (2025)
Fine-tuning MLLMs Without Forgetting Is Easier Than You Think
por: Li, He, et al.
Publicado: (2026)
por: Li, He, et al.
Publicado: (2026)
A General Framework to Enhance Fine-tuning-based LLM Unlearning
por: Ren, Jie, et al.
Publicado: (2025)
por: Ren, Jie, et al.
Publicado: (2025)
S'MoRE: Structural Mixture of Residual Experts for Parameter-Efficient LLM Fine-tuning
por: Zeng, Hanqing, et al.
Publicado: (2025)
por: Zeng, Hanqing, et al.
Publicado: (2025)
On the Loss of Context-awareness in General Instruction Fine-tuning
por: Wang, Yihan, et al.
Publicado: (2024)
por: Wang, Yihan, et al.
Publicado: (2024)
Financial Sentiment Analysis: Leveraging Actual and Synthetic Data for Supervised Fine-tuning
por: Atsiwo, Abraham
Publicado: (2024)
por: Atsiwo, Abraham
Publicado: (2024)
Scalable Multitask Learning Using Gradient-based Estimation of Task Affinity
por: Li, Dongyue, et al.
Publicado: (2024)
por: Li, Dongyue, et al.
Publicado: (2024)
Revisiting Zeroth-Order Optimization for Memory-Efficient LLM Fine-Tuning: A Benchmark
por: Zhang, Yihua, et al.
Publicado: (2024)
por: Zhang, Yihua, et al.
Publicado: (2024)
PMSS: Pretrained Matrices Skeleton Selection for LLM Fine-tuning
por: Wang, Qibin, et al.
Publicado: (2024)
por: Wang, Qibin, et al.
Publicado: (2024)
Fine-tuning Language Models with Generative Adversarial Reward Modelling
por: Yu, Zhang Ze, et al.
Publicado: (2023)
por: Yu, Zhang Ze, et al.
Publicado: (2023)
A Note on Hybrid Online Reinforcement and Imitation Learning for LLMs: Formulations and Algorithms
por: Li, Yingru, et al.
Publicado: (2025)
por: Li, Yingru, et al.
Publicado: (2025)
Sparse is Enough in Fine-tuning Pre-trained Large Language Models
por: Song, Weixi, et al.
Publicado: (2023)
por: Song, Weixi, et al.
Publicado: (2023)
Two-stage LLM Fine-tuning with Less Specialization and More Generalization
por: Wang, Yihan, et al.
Publicado: (2022)
por: Wang, Yihan, et al.
Publicado: (2022)
Learning Tree-Structured Composition of Data Augmentation
por: Li, Dongyue, et al.
Publicado: (2024)
por: Li, Dongyue, et al.
Publicado: (2024)
Random Masking Finds Winning Tickets for Parameter Efficient Fine-tuning
por: Xu, Jing, et al.
Publicado: (2024)
por: Xu, Jing, et al.
Publicado: (2024)
SmallToLarge (S2L): Scalable Data Selection for Fine-tuning Large Language Models by Summarizing Training Trajectories of Small Models
por: Yang, Yu, et al.
Publicado: (2024)
por: Yang, Yu, et al.
Publicado: (2024)
Exploring Memorization in Fine-tuned Language Models
por: Zeng, Shenglai, et al.
Publicado: (2023)
por: Zeng, Shenglai, et al.
Publicado: (2023)
PFDial: A Structured Dialogue Instruction Fine-tuning Method Based on UML Flowcharts
por: Zhang, Ming, et al.
Publicado: (2025)
por: Zhang, Ming, et al.
Publicado: (2025)
EAGLE-2: Faster Inference of Language Models with Dynamic Draft Trees
por: Li, Yuhui, et al.
Publicado: (2024)
por: Li, Yuhui, et al.
Publicado: (2024)
EAGLE: Speculative Sampling Requires Rethinking Feature Uncertainty
por: Li, Yuhui, et al.
Publicado: (2024)
por: Li, Yuhui, et al.
Publicado: (2024)
TreeRL: LLM Reinforcement Learning with On-Policy Tree Search
por: Hou, Zhenyu, et al.
Publicado: (2025)
por: Hou, Zhenyu, et al.
Publicado: (2025)
Topic Modeling with Fine-tuning LLMs and Bag of Sentences
por: Schneider, Johannes
Publicado: (2024)
por: Schneider, Johannes
Publicado: (2024)
The Importance of Online Data: Understanding Preference Fine-tuning via Coverage
por: Song, Yuda, et al.
Publicado: (2024)
por: Song, Yuda, et al.
Publicado: (2024)
LLM-AutoDP: Automatic Data Processing via LLM Agents for Model Fine-tuning
por: Huang, Wei, et al.
Publicado: (2026)
por: Huang, Wei, et al.
Publicado: (2026)
Scalable Data Ablation Approximations for Language Models through Modular Training and Merging
por: Na, Clara, et al.
Publicado: (2024)
por: Na, Clara, et al.
Publicado: (2024)
BWArea Model: Learning World Model, Inverse Dynamics, and Policy for Controllable Language Generation
por: Jia, Chengxing, et al.
Publicado: (2024)
por: Jia, Chengxing, et al.
Publicado: (2024)
Fine-tuning Large Language Models for Domain-specific Machine Translation
por: Zheng, Jiawei, et al.
Publicado: (2024)
por: Zheng, Jiawei, et al.
Publicado: (2024)
Learn Hard Problems During RL with Reference Guided Fine-tuning
por: Wu, Yangzhen, et al.
Publicado: (2026)
por: Wu, Yangzhen, et al.
Publicado: (2026)
What Makes and Breaks Safety Fine-tuning? A Mechanistic Study
por: Jain, Samyak, et al.
Publicado: (2024)
por: Jain, Samyak, et al.
Publicado: (2024)
Ejemplares similares
-
Efficient Ensemble for Fine-tuning Language Models on Multiple Datasets
por: Li, Dongyue, et al.
Publicado: (2025) -
Linear-Time Demonstration Selection for In-Context Learning via Gradient Estimation
por: Zhang, Ziniu, et al.
Publicado: (2025) -
Improved Regularization and Robustness for Fine-tuning in Neural Networks
por: Li, Dongyue, et al.
Publicado: (2021) -
Memento: Fine-tuning LLM Agents without Fine-tuning LLMs
por: Zhou, Huichi, et al.
Publicado: (2025) -
Fine-tuning can Help Detect Pretraining Data from Large Language Models
por: Zhang, Hengxiang, et al.
Publicado: (2024)