Information Guided Regularization for Fine-tuning Language Models
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Sharma, Mandar, Muralidhar, Nikhil, Xu, Shengzhe, Yousuf, Raquib Bin, Ramakrishnan, Naren |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2024
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Can an LLM Induce a Graph? Investigating Memory Drift and Context Length
von: Yousuf, Raquib Bin, et al.
Veröffentlicht: (2025)
von: Yousuf, Raquib Bin, et al.
Veröffentlicht: (2025)
LLM Augmentations to support Analytical Reasoning over Multiple Documents
von: Yousuf, Raquib Bin, et al.
Veröffentlicht: (2024)
von: Yousuf, Raquib Bin, et al.
Veröffentlicht: (2024)
Laying Anchors: Semantically Priming Numerals in Language Modeling
von: Sharma, Mandar, et al.
Veröffentlicht: (2024)
von: Sharma, Mandar, et al.
Veröffentlicht: (2024)
Utilizing Metadata for Better Retrieval-Augmented Generation
von: Yousuf, Raquib Bin, et al.
Veröffentlicht: (2026)
von: Yousuf, Raquib Bin, et al.
Veröffentlicht: (2026)
Why LLMs Are Bad at Synthetic Table Generation (and what to do about it)
von: Xu, Shengzhe, et al.
Veröffentlicht: (2024)
von: Xu, Shengzhe, et al.
Veröffentlicht: (2024)
Large Multi-Modal Models (LMMs) as Universal Foundation Models for AI-Native Wireless Systems
von: Xu, Shengzhe, et al.
Veröffentlicht: (2024)
von: Xu, Shengzhe, et al.
Veröffentlicht: (2024)
The Prompt is Mightier than the Example
von: Xu, Shengzhe, et al.
Veröffentlicht: (2025)
von: Xu, Shengzhe, et al.
Veröffentlicht: (2025)
Efficient Model Development through Fine-tuning Transfer
von: Lin, Pin-Jie, et al.
Veröffentlicht: (2025)
von: Lin, Pin-Jie, et al.
Veröffentlicht: (2025)
Exploring Memorization in Fine-tuned Language Models
von: Zeng, Shenglai, et al.
Veröffentlicht: (2023)
von: Zeng, Shenglai, et al.
Veröffentlicht: (2023)
Fine-tuning Large Language Models with Limited Data: A Survey and Practical Guide
von: Szep, Marton, et al.
Veröffentlicht: (2024)
von: Szep, Marton, et al.
Veröffentlicht: (2024)
G-Loss: Graph-Guided Fine-Tuning of Language Models
von: Sharma, Aditya, et al.
Veröffentlicht: (2026)
von: Sharma, Aditya, et al.
Veröffentlicht: (2026)
Fine-tuning Language Models with Generative Adversarial Reward Modelling
von: Yu, Zhang Ze, et al.
Veröffentlicht: (2023)
von: Yu, Zhang Ze, et al.
Veröffentlicht: (2023)
Efficient End-to-end Language Model Fine-tuning on Graphs
von: Xue, Rui, et al.
Veröffentlicht: (2023)
von: Xue, Rui, et al.
Veröffentlicht: (2023)
Sparse is Enough in Fine-tuning Pre-trained Large Language Models
von: Song, Weixi, et al.
Veröffentlicht: (2023)
von: Song, Weixi, et al.
Veröffentlicht: (2023)
APE: Selective Fine-tuning with Acceptance Criteria for Language Model Adaptation
von: Marín, Javier
Veröffentlicht: (2025)
von: Marín, Javier
Veröffentlicht: (2025)
LaFFi: Leveraging Hybrid Natural Language Feedback for Fine-tuning Language Models
von: Li, Qianxi, et al.
Veröffentlicht: (2023)
von: Li, Qianxi, et al.
Veröffentlicht: (2023)
Selecting Large Language Model to Fine-tune via Rectified Scaling Law
von: Lin, Haowei, et al.
Veröffentlicht: (2024)
von: Lin, Haowei, et al.
Veröffentlicht: (2024)
InstructAV: Instruction Fine-tuning Large Language Models for Authorship Verification
von: Hu, Yujia, et al.
Veröffentlicht: (2024)
von: Hu, Yujia, et al.
Veröffentlicht: (2024)
Fundamental Safety-Capability Trade-offs in Fine-tuning Large Language Models
von: Chen, Pin-Yu, et al.
Veröffentlicht: (2025)
von: Chen, Pin-Yu, et al.
Veröffentlicht: (2025)
Fine-Tuning Improves Information Conveyance in Language Models
von: Cheng, Yuwei, et al.
Veröffentlicht: (2026)
von: Cheng, Yuwei, et al.
Veröffentlicht: (2026)
Fine-tuning can Help Detect Pretraining Data from Large Language Models
von: Zhang, Hengxiang, et al.
Veröffentlicht: (2024)
von: Zhang, Hengxiang, et al.
Veröffentlicht: (2024)
How Abilities in Large Language Models are Affected by Supervised Fine-tuning Data Composition
von: Dong, Guanting, et al.
Veröffentlicht: (2023)
von: Dong, Guanting, et al.
Veröffentlicht: (2023)
LongLoRA: Efficient Fine-tuning of Long-Context Large Language Models
von: Chen, Yukang, et al.
Veröffentlicht: (2023)
von: Chen, Yukang, et al.
Veröffentlicht: (2023)
Harnessing Large Language Models: Fine-tuned BERT for Detecting Charismatic Leadership Tactics in Natural Language
von: Saeid, Yasser, et al.
Veröffentlicht: (2024)
von: Saeid, Yasser, et al.
Veröffentlicht: (2024)
Random Masking Finds Winning Tickets for Parameter Efficient Fine-tuning
von: Xu, Jing, et al.
Veröffentlicht: (2024)
von: Xu, Jing, et al.
Veröffentlicht: (2024)
FeDeRA:Efficient Fine-tuning of Language Models in Federated Learning Leveraging Weight Decomposition
von: Yan, Yuxuan, et al.
Veröffentlicht: (2024)
von: Yan, Yuxuan, et al.
Veröffentlicht: (2024)
A Study of Backdoors in Instruction Fine-tuned Language Models
von: Raghuram, Jayaram, et al.
Veröffentlicht: (2024)
von: Raghuram, Jayaram, et al.
Veröffentlicht: (2024)
Mechanistic Fine-tuning for In-context Learning
von: Cho, Hakaze, et al.
Veröffentlicht: (2025)
von: Cho, Hakaze, et al.
Veröffentlicht: (2025)
PromptIntern: Saving Inference Costs by Internalizing Recurrent Prompt during Large Language Model Fine-tuning
von: Zou, Jiaru, et al.
Veröffentlicht: (2024)
von: Zou, Jiaru, et al.
Veröffentlicht: (2024)
LLM4DistReconfig: A Fine-tuned Large Language Model for Power Distribution Network Reconfiguration
von: Christou, Panayiotis, et al.
Veröffentlicht: (2025)
von: Christou, Panayiotis, et al.
Veröffentlicht: (2025)
The Impact of Fine-tuning Large Language Models on Automated Program Repair
von: Macháček, Roman, et al.
Veröffentlicht: (2025)
von: Macháček, Roman, et al.
Veröffentlicht: (2025)
Entity-level Factual Adaptiveness of Fine-tuning based Abstractive Summarization Models
von: Song, Jongyoon, et al.
Veröffentlicht: (2024)
von: Song, Jongyoon, et al.
Veröffentlicht: (2024)
LoRA+: Efficient Low Rank Adaptation of Large Models
von: Hayou, Soufiane, et al.
Veröffentlicht: (2024)
von: Hayou, Soufiane, et al.
Veröffentlicht: (2024)
Regularization Through Reasoning: Systematic Improvements in Language Model Classification via Explanation-Enhanced Fine-Tuning
von: Shah, Vivswan, et al.
Veröffentlicht: (2025)
von: Shah, Vivswan, et al.
Veröffentlicht: (2025)
SmallToLarge (S2L): Scalable Data Selection for Fine-tuning Large Language Models by Summarizing Training Trajectories of Small Models
von: Yang, Yu, et al.
Veröffentlicht: (2024)
von: Yang, Yu, et al.
Veröffentlicht: (2024)
DaMoC: Efficiently Selecting the Optimal Large Language Model for Fine-tuning Domain Tasks Based on Data and Model Compression
von: Huang, Wei, et al.
Veröffentlicht: (2025)
von: Huang, Wei, et al.
Veröffentlicht: (2025)
Outlier-weighed Layerwise Sampling for LLM Fine-tuning
von: Li, Pengxiang, et al.
Veröffentlicht: (2024)
von: Li, Pengxiang, et al.
Veröffentlicht: (2024)
Fine-tuning Smaller Language Models for Question Answering over Financial Documents
von: Phogat, Karmvir Singh, et al.
Veröffentlicht: (2024)
von: Phogat, Karmvir Singh, et al.
Veröffentlicht: (2024)
A Fine-tuning Dataset and Benchmark for Large Language Models for Protein Understanding
von: Shen, Yiqing, et al.
Veröffentlicht: (2024)
von: Shen, Yiqing, et al.
Veröffentlicht: (2024)
Non-instructional Fine-tuning: Enabling Instruction-Following Capabilities in Pre-trained Language Models without Instruction-Following Data
von: Xie, Juncheng, et al.
Veröffentlicht: (2024)
von: Xie, Juncheng, et al.
Veröffentlicht: (2024)
Ähnliche Einträge
-
Can an LLM Induce a Graph? Investigating Memory Drift and Context Length
von: Yousuf, Raquib Bin, et al.
Veröffentlicht: (2025) -
LLM Augmentations to support Analytical Reasoning over Multiple Documents
von: Yousuf, Raquib Bin, et al.
Veröffentlicht: (2024) -
Laying Anchors: Semantically Priming Numerals in Language Modeling
von: Sharma, Mandar, et al.
Veröffentlicht: (2024) -
Utilizing Metadata for Better Retrieval-Augmented Generation
von: Yousuf, Raquib Bin, et al.
Veröffentlicht: (2026) -
Why LLMs Are Bad at Synthetic Table Generation (and what to do about it)
von: Xu, Shengzhe, et al.
Veröffentlicht: (2024)