Fine-tuning on simulated data outperforms prompting for agent tone of voice
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Marquardt, Ingo, Brule, Philippe |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Practical Membership Inference Attacks against Fine-tuned Large Language Models via Self-prompt Calibration
par: Fu, Wenjie, et autres
Publié: (2023)
par: Fu, Wenjie, et autres
Publié: (2023)
Model Balancing Helps Low-data Training and Fine-tuning
par: Liu, Zihang, et autres
Publié: (2024)
par: Liu, Zihang, et autres
Publié: (2024)
Memento: Fine-tuning LLM Agents without Fine-tuning LLMs
par: Zhou, Huichi, et autres
Publié: (2025)
par: Zhou, Huichi, et autres
Publié: (2025)
Is the reconstruction loss culprit? An attempt to outperform JEPA
par: Potapov, Alexey, et autres
Publié: (2026)
par: Potapov, Alexey, et autres
Publié: (2026)
HOFT: Householder Orthogonal Fine-tuning
par: Arcas, Alejandro Moreno, et autres
Publié: (2025)
par: Arcas, Alejandro Moreno, et autres
Publié: (2025)
Bayesian Fine-tuning in Projected Subspaces
par: Dubovik, Viktar, et autres
Publié: (2026)
par: Dubovik, Viktar, et autres
Publié: (2026)
Probe-based Fine-tuning for Reducing Toxicity
par: Wehner, Jan, et autres
Publié: (2025)
par: Wehner, Jan, et autres
Publié: (2025)
Open-Vocabulary Calibration for Fine-tuned CLIP
par: Wang, Shuoyuan, et autres
Publié: (2024)
par: Wang, Shuoyuan, et autres
Publié: (2024)
Analyzing the Effect of Noise in LLM Fine-tuning
par: Li, Lingfang, et autres
Publié: (2026)
par: Li, Lingfang, et autres
Publié: (2026)
Transmuting prompts into weights
par: Mazzawi, Hanna, et autres
Publié: (2025)
par: Mazzawi, Hanna, et autres
Publié: (2025)
Can Muon Fine-tune Adam-Pretrained Models?
par: Qu, Xingyu, et autres
Publié: (2026)
par: Qu, Xingyu, et autres
Publié: (2026)
Online Joint Fine-tuning of Multi-Agent Flows
par: Mineiro, Paul
Publié: (2024)
par: Mineiro, Paul
Publié: (2024)
Efficient Adjoint Matching for Fine-tuning Diffusion Models
par: Shin, Jeongwoo, et autres
Publié: (2026)
par: Shin, Jeongwoo, et autres
Publié: (2026)
Grow, Don't Overwrite: Fine-tuning Without Forgetting
par: Adila, Dyah, et autres
Publié: (2026)
par: Adila, Dyah, et autres
Publié: (2026)
Fine Flood Forecasts: Incorporating local data into global models through fine-tuning
par: Ryd, Emil, et autres
Publié: (2025)
par: Ryd, Emil, et autres
Publié: (2025)
Deep learning outperforms traditional machine learning methods in predicting childhood malnutrition: evidence from survey data
par: Bastola, Deepak, et autres
Publié: (2026)
par: Bastola, Deepak, et autres
Publié: (2026)
ReFine: Boosting Time Series Prediction of Extreme Events by Reweighting and Fine-tuning
par: Shi, Jimeng, et autres
Publié: (2024)
par: Shi, Jimeng, et autres
Publié: (2024)
Why is prompting hard? Understanding prompts on binary sequence predictors
par: Wenliang, Li Kevin, et autres
Publié: (2025)
par: Wenliang, Li Kevin, et autres
Publié: (2025)
Error whitening: Why Gauss-Newton outperforms Newton
par: McKay, Maricela Best, et autres
Publié: (2026)
par: McKay, Maricela Best, et autres
Publié: (2026)
Efficiently Estimating Data Efficiency for Language Model Fine-tuning
par: Je, Gyung Hyun, et autres
Publié: (2025)
par: Je, Gyung Hyun, et autres
Publié: (2025)
A Study of Optimizations for Fine-tuning Large Language Models
par: Singh, Arjun, et autres
Publié: (2024)
par: Singh, Arjun, et autres
Publié: (2024)
Understanding Fine-tuning in Approximate Unlearning: A Theoretical Perspective
par: Ding, Meng, et autres
Publié: (2024)
par: Ding, Meng, et autres
Publié: (2024)
Functional-level Uncertainty Quantification for Calibrated Fine-tuning on LLMs
par: Niu, Ruijia, et autres
Publié: (2024)
par: Niu, Ruijia, et autres
Publié: (2024)
LLMs for energy and macronutrients estimation using only text data from 24-hour dietary recalls: a parameter-efficient fine-tuning experiment using a 10-shot prompt
par: Carrillo-Larco, Rodrigo M
Publié: (2025)
par: Carrillo-Larco, Rodrigo M
Publié: (2025)
FDPP: Fine-tune Diffusion Policy with Human Preference
par: Chen, Yuxin, et autres
Publié: (2025)
par: Chen, Yuxin, et autres
Publié: (2025)
SMART Fine-tuning Factor Augmented Neural Lasso
par: Chai, Jinhang, et autres
Publié: (2026)
par: Chai, Jinhang, et autres
Publié: (2026)
Selective Pre-training for Private Fine-tuning
par: Yu, Da, et autres
Publié: (2023)
par: Yu, Da, et autres
Publié: (2023)
Optimizing ZX-Diagrams with Deep Reinforcement Learning
par: Nägele, Maximilian, et autres
Publié: (2023)
par: Nägele, Maximilian, et autres
Publié: (2023)
Fine-tuning is Not Fine: Mitigating Backdoor Attacks in GNNs with Limited Clean Data
par: Zhang, Jiale, et autres
Publié: (2025)
par: Zhang, Jiale, et autres
Publié: (2025)
Towards Safeguarding LLM Fine-tuning APIs against Cipher Attacks
par: Youstra, Jack, et autres
Publié: (2025)
par: Youstra, Jack, et autres
Publié: (2025)
DP-MicroAdam: Private and Frugal Algorithm for Training and Fine-tuning
par: Hudişteanu, Mihaela, et autres
Publié: (2025)
par: Hudişteanu, Mihaela, et autres
Publié: (2025)
TuneShift-KD: Knowledge Distillation and Transfer for Fine-tuned Models
par: Guan, Yushi, et autres
Publié: (2026)
par: Guan, Yushi, et autres
Publié: (2026)
Reliable and Compact Graph Fine-tuning via GraphSparse Prompting
par: Jiang, Bo, et autres
Publié: (2024)
par: Jiang, Bo, et autres
Publié: (2024)
Kaizen: Practical Self-supervised Continual Learning with Continual Fine-tuning
par: Tang, Chi Ian, et autres
Publié: (2023)
par: Tang, Chi Ian, et autres
Publié: (2023)
Fine-tuned In-Context Learning Transformers are Excellent Tabular Data Classifiers
par: Breejen, Felix den, et autres
Publié: (2024)
par: Breejen, Felix den, et autres
Publié: (2024)
Mechanistic Fine-tuning for In-context Learning
par: Cho, Hakaze, et autres
Publié: (2025)
par: Cho, Hakaze, et autres
Publié: (2025)
Fine-tuning with Very Large Dropout
par: Zhang, Jianyu, et autres
Publié: (2024)
par: Zhang, Jianyu, et autres
Publié: (2024)
Behavioral Mode Discovery for Fine-tuning Multimodal Generative Policies
par: Longhini, Alberta, et autres
Publié: (2026)
par: Longhini, Alberta, et autres
Publié: (2026)
SEE: Continual Fine-tuning with Sequential Ensemble of Experts
par: Wang, Zhilin, et autres
Publié: (2025)
par: Wang, Zhilin, et autres
Publié: (2025)
Activated LoRA: Fine-tuned LLMs for Intrinsics
par: Greenewald, Kristjan, et autres
Publié: (2025)
par: Greenewald, Kristjan, et autres
Publié: (2025)
Documents similaires
-
Practical Membership Inference Attacks against Fine-tuned Large Language Models via Self-prompt Calibration
par: Fu, Wenjie, et autres
Publié: (2023) -
Model Balancing Helps Low-data Training and Fine-tuning
par: Liu, Zihang, et autres
Publié: (2024) -
Memento: Fine-tuning LLM Agents without Fine-tuning LLMs
par: Zhou, Huichi, et autres
Publié: (2025) -
Is the reconstruction loss culprit? An attempt to outperform JEPA
par: Potapov, Alexey, et autres
Publié: (2026) -
HOFT: Householder Orthogonal Fine-tuning
par: Arcas, Alejandro Moreno, et autres
Publié: (2025)