From Style to Facts: Mapping the Boundaries of Knowledge Injection with Finetuning
Fuente:
arXiv
Salvato in:
| Autori principali: | Zhao, Eric, Awasthi, Pranjal, Haghtalab, Nika |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Covert Malicious Finetuning: Challenges in Safeguarding LLM Adaptation
di: Halawi, Danny, et al.
Pubblicazione: (2024)
di: Halawi, Danny, et al.
Pubblicazione: (2024)
The Limits of Preference Data for Post-Training
di: Zhao, Eric, et al.
Pubblicazione: (2025)
di: Zhao, Eric, et al.
Pubblicazione: (2025)
Learning With Multi-Group Guarantees For Clusterable Subpopulations
di: Dai, Jessica, et al.
Pubblicazione: (2024)
di: Dai, Jessica, et al.
Pubblicazione: (2024)
On-Demand Sampling: Learning Optimally from Multiple Distributions
di: Haghtalab, Nika, et al.
Pubblicazione: (2022)
di: Haghtalab, Nika, et al.
Pubblicazione: (2022)
Extractive Structures Learned in Pretraining Enable Generalization on Finetuned Facts
di: Feng, Jiahai, et al.
Pubblicazione: (2024)
di: Feng, Jiahai, et al.
Pubblicazione: (2024)
Subliminal Effects in Your Data: A General Mechanism via Log-Linearity
di: Aden-Ali, Ishaq, et al.
Pubblicazione: (2026)
di: Aden-Ali, Ishaq, et al.
Pubblicazione: (2026)
Scaling Laws for Forgetting during Finetuning with Pretraining Data Injection
di: Bethune, Louis, et al.
Pubblicazione: (2025)
di: Bethune, Louis, et al.
Pubblicazione: (2025)
Diffusion Language Models are Provably Optimal Parallel Samplers
di: Jiang, Haozhe, et al.
Pubblicazione: (2025)
di: Jiang, Haozhe, et al.
Pubblicazione: (2025)
Is Knowledge Power? On the (Im)possibility of Learning from Strategic Interactions
di: Ananthakrishnan, Nivasini, et al.
Pubblicazione: (2024)
di: Ananthakrishnan, Nivasini, et al.
Pubblicazione: (2024)
KnowLA: Enhancing Parameter-efficient Finetuning with Knowledgeable Adaptation
di: Luo, Xindi, et al.
Pubblicazione: (2024)
di: Luo, Xindi, et al.
Pubblicazione: (2024)
On Surjectivity of Neural Networks: Can you elicit any behavior from your model?
di: Jiang, Haozhe, et al.
Pubblicazione: (2025)
di: Jiang, Haozhe, et al.
Pubblicazione: (2025)
Understanding Finetuning for Factual Knowledge Extraction
di: Ghosal, Gaurav, et al.
Pubblicazione: (2024)
di: Ghosal, Gaurav, et al.
Pubblicazione: (2024)
Task Matrices: Linear Maps for Cross-Model Finetuning Transfer
di: Brien, Darrin O', et al.
Pubblicazione: (2025)
di: Brien, Darrin O', et al.
Pubblicazione: (2025)
Distortion of AI Alignment: Does Preference Optimization Optimize for Preferences?
di: Gölz, Paul, et al.
Pubblicazione: (2025)
di: Gölz, Paul, et al.
Pubblicazione: (2025)
Predicting Emergent Capabilities by Finetuning
di: Snell, Charlie, et al.
Pubblicazione: (2024)
di: Snell, Charlie, et al.
Pubblicazione: (2024)
Algorithmic Content Selection and the Impact of User Disengagement
di: Calvano, Emilio, et al.
Pubblicazione: (2024)
di: Calvano, Emilio, et al.
Pubblicazione: (2024)
From Data to Knowledge: Evaluating How Efficiently Language Models Learn Facts
di: Christoph, Daniel, et al.
Pubblicazione: (2025)
di: Christoph, Daniel, et al.
Pubblicazione: (2025)
Position Coupling: Improving Length Generalization of Arithmetic Transformers Using Task Structure
di: Cho, Hanseul, et al.
Pubblicazione: (2024)
di: Cho, Hanseul, et al.
Pubblicazione: (2024)
Truthfulness of Calibration Measures
di: Haghtalab, Nika, et al.
Pubblicazione: (2024)
di: Haghtalab, Nika, et al.
Pubblicazione: (2024)
Paying Attention to Facts: Quantifying the Knowledge Capacity of Attention Layers
di: Wong, Liang Ze
Pubblicazione: (2025)
di: Wong, Liang Ze
Pubblicazione: (2025)
Time Sensitive Knowledge Editing through Efficient Finetuning
di: Ge, Xiou, et al.
Pubblicazione: (2024)
di: Ge, Xiou, et al.
Pubblicazione: (2024)
When Scaling Meets LLM Finetuning: The Effect of Data, Model and Finetuning Method
di: Zhang, Biao, et al.
Pubblicazione: (2024)
di: Zhang, Biao, et al.
Pubblicazione: (2024)
Panprediction: Optimal Predictions for Any Downstream Task and Loss
di: Balakrishnan, Sivaraman, et al.
Pubblicazione: (2025)
di: Balakrishnan, Sivaraman, et al.
Pubblicazione: (2025)
Efficient Knowledge Injection in LLMs via Self-Distillation
di: Kujanpää, Kalle, et al.
Pubblicazione: (2024)
di: Kujanpää, Kalle, et al.
Pubblicazione: (2024)
Efficient Reinforcement Finetuning via Adaptive Curriculum Learning
di: Shi, Taiwei, et al.
Pubblicazione: (2025)
di: Shi, Taiwei, et al.
Pubblicazione: (2025)
Understanding Contextual Recall in Transformers: How Finetuning Enables In-Context Reasoning over Pretraining Knowledge
di: Vasudeva, Bhavya, et al.
Pubblicazione: (2026)
di: Vasudeva, Bhavya, et al.
Pubblicazione: (2026)
Fact or Fiction? Improving Fact Verification with Knowledge Graphs through Simplified Subgraph Retrievals
di: Opsahl, Tobias A.
Pubblicazione: (2024)
di: Opsahl, Tobias A.
Pubblicazione: (2024)
Sample, Scrutinize and Scale: Effective Inference-Time Search by Scaling Verification
di: Zhao, Eric, et al.
Pubblicazione: (2025)
di: Zhao, Eric, et al.
Pubblicazione: (2025)
Sparse Memory Finetuning as a Low-Forgetting Alternative to LoRA and Full Finetuning
di: Gupta, Prakhar, et al.
Pubblicazione: (2026)
di: Gupta, Prakhar, et al.
Pubblicazione: (2026)
Improving Sparse Memory Finetuning
di: Goyal, Satyam, et al.
Pubblicazione: (2026)
di: Goyal, Satyam, et al.
Pubblicazione: (2026)
Dialectical Behavior Therapy Approach to LLM Prompting
di: Vitman, Oxana, et al.
Pubblicazione: (2024)
di: Vitman, Oxana, et al.
Pubblicazione: (2024)
From Facts to Folklore: Evaluating Large Language Models on Bengali Cultural Knowledge
di: Chowdhury, Nafis, et al.
Pubblicazione: (2025)
di: Chowdhury, Nafis, et al.
Pubblicazione: (2025)
Can Probabilistic Feedback Drive User Impacts in Online Platforms?
di: Dai, Jessica, et al.
Pubblicazione: (2024)
di: Dai, Jessica, et al.
Pubblicazione: (2024)
LQ-LoRA: Low-rank Plus Quantized Matrix Decomposition for Efficient Language Model Finetuning
di: Guo, Han, et al.
Pubblicazione: (2023)
di: Guo, Han, et al.
Pubblicazione: (2023)
Improved Bayes Risk Can Yield Reduced Social Welfare Under Competition
di: Jagadeesan, Meena, et al.
Pubblicazione: (2023)
di: Jagadeesan, Meena, et al.
Pubblicazione: (2023)
Large Language Models to Diffusion Finetuning
di: Cetin, Edoardo, et al.
Pubblicazione: (2025)
di: Cetin, Edoardo, et al.
Pubblicazione: (2025)
Probing the Knowledge Boundary: An Interactive Agentic Framework for Deep Knowledge Extraction
di: Yang, Yuheng, et al.
Pubblicazione: (2026)
di: Yang, Yuheng, et al.
Pubblicazione: (2026)
From Directions to Cones: Exploring Multidimensional Representations of Propositional Facts in LLMs
di: Yu, Stanley, et al.
Pubblicazione: (2025)
di: Yu, Stanley, et al.
Pubblicazione: (2025)
Sparse Upcycling: Inference Inefficient Finetuning
di: Doubov, Sasha, et al.
Pubblicazione: (2024)
di: Doubov, Sasha, et al.
Pubblicazione: (2024)
Fact or Guesswork? Evaluating Large Language Models' Medical Knowledge with Structured One-Hop Judgments
di: Li, Jiaxi, et al.
Pubblicazione: (2025)
di: Li, Jiaxi, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Covert Malicious Finetuning: Challenges in Safeguarding LLM Adaptation
di: Halawi, Danny, et al.
Pubblicazione: (2024) -
The Limits of Preference Data for Post-Training
di: Zhao, Eric, et al.
Pubblicazione: (2025) -
Learning With Multi-Group Guarantees For Clusterable Subpopulations
di: Dai, Jessica, et al.
Pubblicazione: (2024) -
On-Demand Sampling: Learning Optimally from Multiple Distributions
di: Haghtalab, Nika, et al.
Pubblicazione: (2022) -
Extractive Structures Learned in Pretraining Enable Generalization on Finetuned Facts
di: Feng, Jiahai, et al.
Pubblicazione: (2024)