Meta-Learning and Synthetic Data for Automated Pretraining and Finetuning
Fuente:
arXiv
Enregistré dans:
| Auteur principal: | Ferreira, Fabio |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Quick-Tune: Quickly Learning Which Pretrained Model to Finetune and How
par: Arango, Sebastian Pineda, et autres
Publié: (2023)
par: Arango, Sebastian Pineda, et autres
Publié: (2023)
The Finetuner's Fallacy: When to Pretrain with Your Finetuning Data
par: Baek, Christina, et autres
Publié: (2026)
par: Baek, Christina, et autres
Publié: (2026)
Scaling Laws for Forgetting during Finetuning with Pretraining Data Injection
par: Bethune, Louis, et autres
Publié: (2025)
par: Bethune, Louis, et autres
Publié: (2025)
Extractive Structures Learned in Pretraining Enable Generalization on Finetuned Facts
par: Feng, Jiahai, et autres
Publié: (2024)
par: Feng, Jiahai, et autres
Publié: (2024)
OLLIE: Imitation Learning from Offline Pretraining to Online Finetuning
par: Yue, Sheng, et autres
Publié: (2024)
par: Yue, Sheng, et autres
Publié: (2024)
LLM-Inspired Pretrain-Then-Finetune for Small-Data, Large-Scale Optimization
par: Zhang, Zishi, et autres
Publié: (2026)
par: Zhang, Zishi, et autres
Publié: (2026)
TMI! Finetuned Models Leak Private Information from their Pretraining Data
par: Abascal, John, et autres
Publié: (2023)
par: Abascal, John, et autres
Publié: (2023)
Finetune-Informed Pretraining Boosts Downstream Performance
par: Faysal, Atik, et autres
Publié: (2026)
par: Faysal, Atik, et autres
Publié: (2026)
Transfer Learning for Finetuning Large Language Models
par: Strangmann, Tobias, et autres
Publié: (2024)
par: Strangmann, Tobias, et autres
Publié: (2024)
Chameleon: A Flexible Data-mixing Framework for Language Model Pretraining and Finetuning
par: Xie, Wanyun, et autres
Publié: (2025)
par: Xie, Wanyun, et autres
Publié: (2025)
Towards Active Synthetic Data Generation for Finetuning Language Models
par: Kessler, Samuel, et autres
Publié: (2025)
par: Kessler, Samuel, et autres
Publié: (2025)
Boosting Statistic Learning with Synthetic Data from Pretrained Large Models
par: Jiang, Jialong, et autres
Publié: (2025)
par: Jiang, Jialong, et autres
Publié: (2025)
On the Emergence of Cross-Task Linearity in the Pretraining-Finetuning Paradigm
par: Zhou, Zhanpeng, et autres
Publié: (2024)
par: Zhou, Zhanpeng, et autres
Publié: (2024)
CIMGEN: Controlled Image Manipulation by Finetuning Pretrained Generative Models on Limited Data
par: Gudavalli, Chandrakanth, et autres
Publié: (2024)
par: Gudavalli, Chandrakanth, et autres
Publié: (2024)
Hierarchical Retrieval: The Geometry and a Pretrain-Finetune Recipe
par: You, Chong, et autres
Publié: (2025)
par: You, Chong, et autres
Publié: (2025)
A Pretraining-Finetuning Computational Framework for Material Homogenization
par: Wang, Yizheng, et autres
Publié: (2024)
par: Wang, Yizheng, et autres
Publié: (2024)
Data-Efficient Sleep Staging with Synthetic Time Series Pretraining
par: Grieger, Niklas, et autres
Publié: (2024)
par: Grieger, Niklas, et autres
Publié: (2024)
Posterior Behavioral Cloning: Pretraining BC Policies for Efficient RL Finetuning
par: Wagenmaker, Andrew, et autres
Publié: (2025)
par: Wagenmaker, Andrew, et autres
Publié: (2025)
Generalizable and Stable Finetuning of Pretrained Language Models on Low-Resource Texts
par: Somayajula, Sai Ashish, et autres
Publié: (2024)
par: Somayajula, Sai Ashish, et autres
Publié: (2024)
TMRL: Diffusion Timestep-Modulated Pretraining Enables Exploration for Efficient Policy Finetuning
par: Hong, Matthew M., et autres
Publié: (2026)
par: Hong, Matthew M., et autres
Publié: (2026)
ATLAS: Adaptive Transfer Scaling Laws for Multilingual Pretraining, Finetuning, and Decoding the Curse of Multilinguality
par: Longpre, Shayne, et autres
Publié: (2025)
par: Longpre, Shayne, et autres
Publié: (2025)
RL-Finetuned LLMs for Privacy-Preserving Synthetic Rewriting
par: Shi, Zhan, et autres
Publié: (2025)
par: Shi, Zhan, et autres
Publié: (2025)
BeyondWeb: Lessons from Scaling Synthetic Data for Trillion-scale Pretraining
par: DatologyAI, et autres
Publié: (2025)
par: DatologyAI, et autres
Publié: (2025)
When Scaling Meets LLM Finetuning: The Effect of Data, Model and Finetuning Method
par: Zhang, Biao, et autres
Publié: (2024)
par: Zhang, Biao, et autres
Publié: (2024)
Less Finetuning, Better Retrieval: Rethinking LLM Adaptation for Biomedical Retrievers via Synthetic Data and Model Merging
par: Khattab, Sameh, et autres
Publié: (2026)
par: Khattab, Sameh, et autres
Publié: (2026)
From Artificial Needles to Real Haystacks: Improving Retrieval Capabilities in LLMs by Finetuning on Synthetic Data
par: Xiong, Zheyang, et autres
Publié: (2024)
par: Xiong, Zheyang, et autres
Publié: (2024)
Optimizer-Model Consistency: Full Finetuning with the Same Optimizer as Pretraining Forgets Less
par: Liu, Yuxing, et autres
Publié: (2026)
par: Liu, Yuxing, et autres
Publié: (2026)
From Basic to Extra Features: Hypergraph Transformer Pretrain-then-Finetuning for Balanced Clinical Predictions on EHR
par: Xu, Ran, et autres
Publié: (2024)
par: Xu, Ran, et autres
Publié: (2024)
Understanding Contextual Recall in Transformers: How Finetuning Enables In-Context Reasoning over Pretraining Knowledge
par: Vasudeva, Bhavya, et autres
Publié: (2026)
par: Vasudeva, Bhavya, et autres
Publié: (2026)
On Pretraining Data Diversity for Self-Supervised Learning
par: Hammoud, Hasan Abed Al Kader, et autres
Publié: (2024)
par: Hammoud, Hasan Abed Al Kader, et autres
Publié: (2024)
RL-Guided Data Selection for Language Model Finetuning
par: Jha, Animesh, et autres
Publié: (2025)
par: Jha, Animesh, et autres
Publié: (2025)
CauKer: Classification Time Series Foundation Models Can Be Pretrained on Synthetic Data
par: Xie, Shifeng, et autres
Publié: (2025)
par: Xie, Shifeng, et autres
Publié: (2025)
Learning Dynamics of VLM Finetuning
par: Zhang, Jusheng, et autres
Publié: (2025)
par: Zhang, Jusheng, et autres
Publié: (2025)
Representation Finetuning for Continual Learning
par: Luo, Haihua, et autres
Publié: (2026)
par: Luo, Haihua, et autres
Publié: (2026)
Planted in Pretraining, Swayed by Finetuning: A Case Study on the Origins of Cognitive Biases in LLMs
par: Itzhak, Itay, et autres
Publié: (2025)
par: Itzhak, Itay, et autres
Publié: (2025)
Data-Efficient Operator Learning via Unsupervised Pretraining and In-Context Learning
par: Chen, Wuyang, et autres
Publié: (2024)
par: Chen, Wuyang, et autres
Publié: (2024)
Weakly Supervised Pretraining and Multi-Annotator Supervised Finetuning for Facial Wrinkle Detection
par: Moon, Ik Jun, et autres
Publié: (2024)
par: Moon, Ik Jun, et autres
Publié: (2024)
Synthetic Data Generation and Automated Multidimensional Data Labeling for AI/ML in General and Circular Coordinates
par: Williams, Alice, et autres
Publié: (2024)
par: Williams, Alice, et autres
Publié: (2024)
Exact Unlearning of Finetuning Data via Model Merging at Scale
par: Kuo, Kevin, et autres
Publié: (2025)
par: Kuo, Kevin, et autres
Publié: (2025)
Mining Hidden Thoughts from Texts: Evaluating Continual Pretraining with Synthetic Data for LLM Reasoning
par: Ishibashi, Yoichi, et autres
Publié: (2025)
par: Ishibashi, Yoichi, et autres
Publié: (2025)
Documents similaires
-
Quick-Tune: Quickly Learning Which Pretrained Model to Finetune and How
par: Arango, Sebastian Pineda, et autres
Publié: (2023) -
The Finetuner's Fallacy: When to Pretrain with Your Finetuning Data
par: Baek, Christina, et autres
Publié: (2026) -
Scaling Laws for Forgetting during Finetuning with Pretraining Data Injection
par: Bethune, Louis, et autres
Publié: (2025) -
Extractive Structures Learned in Pretraining Enable Generalization on Finetuned Facts
par: Feng, Jiahai, et autres
Publié: (2024) -
OLLIE: Imitation Learning from Offline Pretraining to Online Finetuning
par: Yue, Sheng, et autres
Publié: (2024)