Building a Family of Data Augmentation Models for Low-cost LLM Fine-tuning on the Cloud
Fuente:
arXiv
Salvato in:
| Autori principali: | Yue, Yuanhao, Wang, Chengyu, Huang, Jun, Wang, Peng |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Distilling Instruction-following Abilities of Large Language Models with Task-aware Curriculum Planning
di: Yue, Yuanhao, et al.
Pubblicazione: (2024)
di: Yue, Yuanhao, et al.
Pubblicazione: (2024)
DistilQwen2.5: Industrial Practices of Training Distilled Open Lightweight Language Models
di: Wang, Chengyu, et al.
Pubblicazione: (2025)
di: Wang, Chengyu, et al.
Pubblicazione: (2025)
OmniThoughtVis: A Scalable Distillation Pipeline for Deployable Multimodal Reasoning Models
di: Yue, Yuanhao, et al.
Pubblicazione: (2026)
di: Yue, Yuanhao, et al.
Pubblicazione: (2026)
AgenticQwen: Training Small Agentic Language Models with Dual Data Flywheels for Industrial-Scale Tool Use
di: Lyu, Yuanjie, et al.
Pubblicazione: (2026)
di: Lyu, Yuanjie, et al.
Pubblicazione: (2026)
Data-efficient LLM Fine-tuning for Code Generation
di: Lv, Weijie, et al.
Pubblicazione: (2025)
di: Lv, Weijie, et al.
Pubblicazione: (2025)
EasyDistill: A Comprehensive Toolkit for Effective Knowledge Distillation of Large Language Models
di: Wang, Chengyu, et al.
Pubblicazione: (2025)
di: Wang, Chengyu, et al.
Pubblicazione: (2025)
LLM-AutoDP: Automatic Data Processing via LLM Agents for Model Fine-tuning
di: Huang, Wei, et al.
Pubblicazione: (2026)
di: Huang, Wei, et al.
Pubblicazione: (2026)
Memento: Fine-tuning LLM Agents without Fine-tuning LLMs
di: Zhou, Huichi, et al.
Pubblicazione: (2025)
di: Zhou, Huichi, et al.
Pubblicazione: (2025)
Improving Multilingual Speech Models on ML-SUPERB 2.0: Fine-tuning with Data Augmentation and LID-Aware CTC
di: Wang, Qingzheng, et al.
Pubblicazione: (2025)
di: Wang, Qingzheng, et al.
Pubblicazione: (2025)
Be Careful When Fine-tuning On Open-Source LLMs: Your Fine-tuning Data Could Be Secretly Stolen!
di: Zhang, Zhexin, et al.
Pubblicazione: (2025)
di: Zhang, Zhexin, et al.
Pubblicazione: (2025)
Mock Worlds, Real Skills: Building Small Agentic Language Models with Synthetic Tasks, Simulated Environments, and Rubric-Based Rewards
di: Lyu, Yuanjie, et al.
Pubblicazione: (2026)
di: Lyu, Yuanjie, et al.
Pubblicazione: (2026)
Token-level Data Selection for Safe LLM Fine-tuning
di: Li, Yanping, et al.
Pubblicazione: (2026)
di: Li, Yanping, et al.
Pubblicazione: (2026)
Training Language Models to Generate Text with Citations via Fine-grained Rewards
di: Huang, Chengyu, et al.
Pubblicazione: (2024)
di: Huang, Chengyu, et al.
Pubblicazione: (2024)
Investigating the Representation of Backchannels and Fillers in Fine-tuned Language Models
di: Wang, Yu, et al.
Pubblicazione: (2025)
di: Wang, Yu, et al.
Pubblicazione: (2025)
PMSS: Pretrained Matrices Skeleton Selection for LLM Fine-tuning
di: Wang, Qibin, et al.
Pubblicazione: (2024)
di: Wang, Qibin, et al.
Pubblicazione: (2024)
EoRA: Fine-tuning-free Compensation for Compressed LLM with Eigenspace Low-Rank Approximation
di: Liu, Shih-Yang, et al.
Pubblicazione: (2024)
di: Liu, Shih-Yang, et al.
Pubblicazione: (2024)
Agent Data Protocol: Unifying Datasets for Diverse, Effective Fine-tuning of LLM Agents
di: Song, Yueqi, et al.
Pubblicazione: (2025)
di: Song, Yueqi, et al.
Pubblicazione: (2025)
A General Framework to Enhance Fine-tuning-based LLM Unlearning
di: Ren, Jie, et al.
Pubblicazione: (2025)
di: Ren, Jie, et al.
Pubblicazione: (2025)
R4: Reinforced Retriever-Reorder-Responder for Retrieval-Augmented Large Language Models
di: Zhang, Taolin, et al.
Pubblicazione: (2024)
di: Zhang, Taolin, et al.
Pubblicazione: (2024)
LoX: Low-Rank Extrapolation Robustifies LLM Safety Against Fine-tuning
di: Perin, Gabriel J., et al.
Pubblicazione: (2025)
di: Perin, Gabriel J., et al.
Pubblicazione: (2025)
An Empirical Study of LLM-as-a-Judge for LLM Evaluation: Fine-tuned Judge Model is not a General Substitute for GPT-4
di: Huang, Hui, et al.
Pubblicazione: (2024)
di: Huang, Hui, et al.
Pubblicazione: (2024)
Fine-tuning Done Right in Model Editing
di: Yang, Wanli, et al.
Pubblicazione: (2025)
di: Yang, Wanli, et al.
Pubblicazione: (2025)
LoFiT: Localized Fine-tuning on LLM Representations
di: Yin, Fangcong, et al.
Pubblicazione: (2024)
di: Yin, Fangcong, et al.
Pubblicazione: (2024)
Impact of Model Size on Fine-tuned LLM Performance in Data-to-Text Generation: A State-of-the-Art Investigation
di: Mahapatra, Joy, et al.
Pubblicazione: (2024)
di: Mahapatra, Joy, et al.
Pubblicazione: (2024)
PocketLLM: Enabling On-Device Fine-Tuning for Personalized LLMs
di: Peng, Dan, et al.
Pubblicazione: (2024)
di: Peng, Dan, et al.
Pubblicazione: (2024)
Aloe: A Family of Fine-tuned Open Healthcare LLMs
di: Gururajan, Ashwin Kumar, et al.
Pubblicazione: (2024)
di: Gururajan, Ashwin Kumar, et al.
Pubblicazione: (2024)
As Simple as Fine-tuning: LLM Alignment via Bidirectional Negative Feedback Loss
di: Mao, Xin, et al.
Pubblicazione: (2024)
di: Mao, Xin, et al.
Pubblicazione: (2024)
Large Language Model for Multi-Domain Translation: Benchmarking and Domain CoT Fine-tuning
di: Hu, Tianxiang, et al.
Pubblicazione: (2024)
di: Hu, Tianxiang, et al.
Pubblicazione: (2024)
AlignSum: Data Pyramid Hierarchical Fine-tuning for Aligning with Human Summarization Preference
di: Han, Yang, et al.
Pubblicazione: (2024)
di: Han, Yang, et al.
Pubblicazione: (2024)
DaMoC: Efficiently Selecting the Optimal Large Language Model for Fine-tuning Domain Tasks Based on Data and Model Compression
di: Huang, Wei, et al.
Pubblicazione: (2025)
di: Huang, Wei, et al.
Pubblicazione: (2025)
Panacea: Mitigating Harmful Fine-tuning for Large Language Models via Post-fine-tuning Perturbation
di: Wang, Yibo, et al.
Pubblicazione: (2025)
di: Wang, Yibo, et al.
Pubblicazione: (2025)
Exploring Memorization in Fine-tuned Language Models
di: Zeng, Shenglai, et al.
Pubblicazione: (2023)
di: Zeng, Shenglai, et al.
Pubblicazione: (2023)
On the Loss of Context-awareness in General Instruction Fine-tuning
di: Wang, Yihan, et al.
Pubblicazione: (2024)
di: Wang, Yihan, et al.
Pubblicazione: (2024)
Building Dialogue Understanding Models for Low-resource Language Indonesian from Scratch
di: Di, Donglin, et al.
Pubblicazione: (2024)
di: Di, Donglin, et al.
Pubblicazione: (2024)
Improving Data Efficiency for LLM Reinforcement Fine-tuning Through Difficulty-targeted Online Data Selection and Rollout Replay
di: Sun, Yifan, et al.
Pubblicazione: (2025)
di: Sun, Yifan, et al.
Pubblicazione: (2025)
ALoRA: Allocating Low-Rank Adaptation for Fine-tuning Large Language Models
di: Liu, Zequan, et al.
Pubblicazione: (2024)
di: Liu, Zequan, et al.
Pubblicazione: (2024)
JudgeLM: Fine-tuned Large Language Models are Scalable Judges
di: Zhu, Lianghui, et al.
Pubblicazione: (2023)
di: Zhu, Lianghui, et al.
Pubblicazione: (2023)
Two-stage LLM Fine-tuning with Less Specialization and More Generalization
di: Wang, Yihan, et al.
Pubblicazione: (2022)
di: Wang, Yihan, et al.
Pubblicazione: (2022)
Do Large Language Models Understand Logic or Just Mimick Context?
di: Yan, Junbing, et al.
Pubblicazione: (2024)
di: Yan, Junbing, et al.
Pubblicazione: (2024)
From Correction to Mastery: Reinforced Distillation of Large Language Model Agents
di: Lyu, Yuanjie, et al.
Pubblicazione: (2025)
di: Lyu, Yuanjie, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Distilling Instruction-following Abilities of Large Language Models with Task-aware Curriculum Planning
di: Yue, Yuanhao, et al.
Pubblicazione: (2024) -
DistilQwen2.5: Industrial Practices of Training Distilled Open Lightweight Language Models
di: Wang, Chengyu, et al.
Pubblicazione: (2025) -
OmniThoughtVis: A Scalable Distillation Pipeline for Deployable Multimodal Reasoning Models
di: Yue, Yuanhao, et al.
Pubblicazione: (2026) -
AgenticQwen: Training Small Agentic Language Models with Dual Data Flywheels for Industrial-Scale Tool Use
di: Lyu, Yuanjie, et al.
Pubblicazione: (2026) -
Data-efficient LLM Fine-tuning for Code Generation
di: Lv, Weijie, et al.
Pubblicazione: (2025)