Towards Objective Fine-tuning: How LLMs' Prior Knowledge Causes Potential Poor Calibration?
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Wang, Ziming, Shi, Zeyu, Zhou, Haoyi, Gao, Shiqi, Sun, Qingyun, Li, Jianxin |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Fine-Tuned LLMs Know They Don't Know: A Parameter-Efficient Approach to Recovering Honesty
par: Shi, Zeyu, et autres
Publié: (2025)
par: Shi, Zeyu, et autres
Publié: (2025)
MIKO: Multimodal Intention Knowledge Distillation from Large Language Models for Social-Media Commonsense Discovery
par: Lu, Feihong, et autres
Publié: (2024)
par: Lu, Feihong, et autres
Publié: (2024)
Memento: Fine-tuning LLM Agents without Fine-tuning LLMs
par: Zhou, Huichi, et autres
Publié: (2025)
par: Zhou, Huichi, et autres
Publié: (2025)
Stage-wise Fine-tuning for Graph-to-Text Generation
par: Wang, Qingyun, et autres
Publié: (2021)
par: Wang, Qingyun, et autres
Publié: (2021)
Beyond Fine-tuning: Unleashing the Potential of Continuous Pretraining for Clinical LLMs
par: Christophe, Clément, et autres
Publié: (2024)
par: Christophe, Clément, et autres
Publié: (2024)
Double-Calibration: Towards Reliable LLMs via Calibrating Knowledge and Reasoning Confidence
par: Lu, Yuyin, et autres
Publié: (2026)
par: Lu, Yuyin, et autres
Publié: (2026)
Be Careful When Fine-tuning On Open-Source LLMs: Your Fine-tuning Data Could Be Secretly Stolen!
par: Zhang, Zhexin, et autres
Publié: (2025)
par: Zhang, Zhexin, et autres
Publié: (2025)
Explain Less, Understand More: Jargon Detection via Personalized Parameter-Efficient Fine-tuning
par: Wu, Bohao, et autres
Publié: (2025)
par: Wu, Bohao, et autres
Publié: (2025)
Beyond Human Preferences: Exploring Reinforcement Learning Trajectory Evaluation and Improvement through LLMs
par: Shen, Zichao, et autres
Publié: (2024)
par: Shen, Zichao, et autres
Publié: (2024)
Unlocking the Potentials of Retrieval-Augmented Generation for Diffusion Language Models
par: Yu, Chuanyue, et autres
Publié: (2026)
par: Yu, Chuanyue, et autres
Publié: (2026)
Towards Context-Robust LLMs: A Gated Representation Fine-tuning Approach
par: Zeng, Shenglai, et autres
Publié: (2025)
par: Zeng, Shenglai, et autres
Publié: (2025)
Disentangling Reasoning Tokens and Boilerplate Tokens For Language Model Fine-tuning
par: Ye, Ziang, et autres
Publié: (2024)
par: Ye, Ziang, et autres
Publié: (2024)
KnowTuning: Knowledge-aware Fine-tuning for Large Language Models
par: Lyu, Yougang, et autres
Publié: (2024)
par: Lyu, Yougang, et autres
Publié: (2024)
Practical Membership Inference Attacks against Fine-tuned Large Language Models via Self-prompt Calibration
par: Fu, Wenjie, et autres
Publié: (2023)
par: Fu, Wenjie, et autres
Publié: (2023)
KaFT: Knowledge-aware Fine-tuning for Boosting LLMs' Domain-specific Question-Answering Performance
par: Zhong, Qihuang, et autres
Publié: (2025)
par: Zhong, Qihuang, et autres
Publié: (2025)
GSQ-Tuning: Group-Shared Exponents Integer in Fully Quantized Training for LLMs On-Device Fine-tuning
par: Zhou, Sifan, et autres
Publié: (2025)
par: Zhou, Sifan, et autres
Publié: (2025)
UltraLink: An Open-Source Knowledge-Enhanced Multilingual Supervised Fine-tuning Dataset
par: Wang, Haoyu, et autres
Publié: (2024)
par: Wang, Haoyu, et autres
Publié: (2024)
From Text to Trajectory: Exploring Complex Constraint Representation and Decomposition in Safe Reinforcement Learning
par: Dong, Pusen, et autres
Publié: (2024)
par: Dong, Pusen, et autres
Publié: (2024)
GRAVER: Generative Graph Vocabularies for Robust Graph Foundation Models Fine-tuning
par: Yuan, Haonan, et autres
Publié: (2025)
par: Yuan, Haonan, et autres
Publié: (2025)
Intent Mismatch Causes LLMs to Get Lost in Multi-Turn Conversation
par: Liu, Geng, et autres
Publié: (2026)
par: Liu, Geng, et autres
Publié: (2026)
KcMF: A Knowledge-compliant Framework for Schema and Entity Matching with Fine-tuning-free LLMs
par: Xu, Yongqin, et autres
Publié: (2024)
par: Xu, Yongqin, et autres
Publié: (2024)
Identity Lock: Locking API Fine-tuned LLMs With Identity-based Wake Words
par: Su, Hongyu, et autres
Publié: (2025)
par: Su, Hongyu, et autres
Publié: (2025)
How Abilities in Large Language Models are Affected by Supervised Fine-tuning Data Composition
par: Dong, Guanting, et autres
Publié: (2023)
par: Dong, Guanting, et autres
Publié: (2023)
Topic Modeling with Fine-tuning LLMs and Bag of Sentences
par: Schneider, Johannes
Publié: (2024)
par: Schneider, Johannes
Publié: (2024)
Fine-tuning and Utilization Methods of Domain-specific LLMs
par: Jeong, Cheonsu
Publié: (2024)
par: Jeong, Cheonsu
Publié: (2024)
medIKAL: Integrating Knowledge Graphs as Assistants of LLMs for Enhanced Clinical Diagnosis on EMRs
par: Jia, Mingyi, et autres
Publié: (2024)
par: Jia, Mingyi, et autres
Publié: (2024)
Precise Localization of Memories: A Fine-grained Neuron-level Knowledge Editing Technique for LLMs
par: Pan, Haowen, et autres
Publié: (2025)
par: Pan, Haowen, et autres
Publié: (2025)
ITERTL: An Iterative Framework for Fine-tuning LLMs for RTL Code Generation
par: Wu, Peiyang, et autres
Publié: (2024)
par: Wu, Peiyang, et autres
Publié: (2024)
RepCali: High Efficient Fine-tuning Via Representation Calibration in Latent Space for Pre-trained Language Models
par: Zhang, Fujun, et autres
Publié: (2025)
par: Zhang, Fujun, et autres
Publié: (2025)
Agent Fine-tuning through Distillation for Domain-specific LLMs in Microdomains
par: Xue, Yawen, et autres
Publié: (2025)
par: Xue, Yawen, et autres
Publié: (2025)
RoseLoRA: Row and Column-wise Sparse Low-rank Adaptation of Pre-trained Language Model for Knowledge Editing and Fine-tuning
par: Wang, Haoyu, et autres
Publié: (2024)
par: Wang, Haoyu, et autres
Publié: (2024)
Aloe: A Family of Fine-tuned Open Healthcare LLMs
par: Gururajan, Ashwin Kumar, et autres
Publié: (2024)
par: Gururajan, Ashwin Kumar, et autres
Publié: (2024)
Structure-aware Fine-tuning for Code Pre-trained Models
par: Wu, Jiayi, et autres
Publié: (2024)
par: Wu, Jiayi, et autres
Publié: (2024)
FineTuneBench: How well do commercial fine-tuning APIs infuse knowledge into LLMs?
par: Wu, Eric, et autres
Publié: (2024)
par: Wu, Eric, et autres
Publié: (2024)
Relational Knowledge Distillation Using Fine-tuned Function Vectors
par: Kang, Andrea, et autres
Publié: (2026)
par: Kang, Andrea, et autres
Publié: (2026)
UniARM: Towards a Unified Autoregressive Reward Model for Multi-Objective Test-Time Alignment
par: Xie, Hongyan, et autres
Publié: (2026)
par: Xie, Hongyan, et autres
Publié: (2026)
Fine-tuning Done Right in Model Editing
par: Yang, Wanli, et autres
Publié: (2025)
par: Yang, Wanli, et autres
Publié: (2025)
AgenticGEO: A Self-Evolving Agentic System for Generative Engine Optimization
par: Yuan, Jiaqi, et autres
Publié: (2026)
par: Yuan, Jiaqi, et autres
Publié: (2026)
Instructing the Architecture Search for Spatial-temporal Sequence Forecasting with LLM
par: Xue, Xin, et autres
Publié: (2025)
par: Xue, Xin, et autres
Publié: (2025)
Automatic Essay Multi-dimensional Scoring with Fine-tuning and Multiple Regression
par: Sun, Kun, et autres
Publié: (2024)
par: Sun, Kun, et autres
Publié: (2024)
Documents similaires
-
Fine-Tuned LLMs Know They Don't Know: A Parameter-Efficient Approach to Recovering Honesty
par: Shi, Zeyu, et autres
Publié: (2025) -
MIKO: Multimodal Intention Knowledge Distillation from Large Language Models for Social-Media Commonsense Discovery
par: Lu, Feihong, et autres
Publié: (2024) -
Memento: Fine-tuning LLM Agents without Fine-tuning LLMs
par: Zhou, Huichi, et autres
Publié: (2025) -
Stage-wise Fine-tuning for Graph-to-Text Generation
par: Wang, Qingyun, et autres
Publié: (2021) -
Beyond Fine-tuning: Unleashing the Potential of Continuous Pretraining for Clinical LLMs
par: Christophe, Clément, et autres
Publié: (2024)