Latent Traits and Cross-Task Transfer: Deconstructing Dataset Interactions in LLM Fine-tuning
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Krishna, Shambhavi, Naik, Atharva, Agarwal, Chaitali, Govindan, Sudharshan, Lee, Taesung, Chang, Haw-Shiuan |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
CoKe: Customizable Fine-Grained Story Evaluation via Chain-of-Keyword Rationalization
par: Joshi, Brihi, et autres
Publié: (2025)
par: Joshi, Brihi, et autres
Publié: (2025)
Task-Aware LoRA Adapter Composition via Similarity Retrieval in Vector Databases
par: Adsul, Riya, et autres
Publié: (2026)
par: Adsul, Riya, et autres
Publié: (2026)
Truncated Step-Level Sampling with Process Rewards for Retrieval-Augmented Reasoning
par: Samarinas, Chris, et autres
Publié: (2026)
par: Samarinas, Chris, et autres
Publié: (2026)
PROMPT2BOX: Uncovering Entailment Structure among LLM Prompts
par: Bhuiya, Neeladri, et autres
Publié: (2026)
par: Bhuiya, Neeladri, et autres
Publié: (2026)
Solving the Inverse Alignment Problem for Efficient RLHF
par: Krishna, Shambhavi, et autres
Publié: (2024)
par: Krishna, Shambhavi, et autres
Publié: (2024)
Explaining and Improving Contrastive Decoding by Extrapolating the Probabilities of a Huge and Hypothetical LM
par: Chang, Haw-Shiuan, et autres
Publié: (2024)
par: Chang, Haw-Shiuan, et autres
Publié: (2024)
Memento: Fine-tuning LLM Agents without Fine-tuning LLMs
par: Zhou, Huichi, et autres
Publié: (2025)
par: Zhou, Huichi, et autres
Publié: (2025)
REAL Sampling: Boosting Factuality and Diversity of Open-Ended Generation via Asymptotic Entropy
par: Chang, Haw-Shiuan, et autres
Publié: (2024)
par: Chang, Haw-Shiuan, et autres
Publié: (2024)
FineScope : SAE-guided Data Selection Enables Domain Specific LLM Pruning and Finetuning
par: Bhattacharyya, Chaitali, et autres
Publié: (2025)
par: Bhattacharyya, Chaitali, et autres
Publié: (2025)
GRDD+: An Extended Greek Dialectal Dataset with Cross-Architecture Fine-tuning Evaluation
par: Chatzikyriakidis, Stergios, et autres
Publié: (2025)
par: Chatzikyriakidis, Stergios, et autres
Publié: (2025)
Explainable Token-level Noise Filtering for LLM Fine-tuning Datasets
par: Yang, Yuchen, et autres
Publié: (2026)
par: Yang, Yuchen, et autres
Publié: (2026)
ReaComp: Compiling LLM Reasoning into Symbolic Solvers for Efficient Program Synthesis
par: Naik, Atharva, et autres
Publié: (2026)
par: Naik, Atharva, et autres
Publié: (2026)
BITS Pilani at SemEval-2026 Task 9: Structured Supervised Fine-Tuning with DPO Refinement for Polarization Detection
par: Gupta, Atharva, et autres
Publié: (2026)
par: Gupta, Atharva, et autres
Publié: (2026)
Why LLM Safety Guardrails Collapse After Fine-tuning: A Similarity Analysis Between Alignment and Fine-tuning Datasets
par: Hsiung, Lei, et autres
Publié: (2025)
par: Hsiung, Lei, et autres
Publié: (2025)
Agent Data Protocol: Unifying Datasets for Diverse, Effective Fine-tuning of LLM Agents
par: Song, Yueqi, et autres
Publié: (2025)
par: Song, Yueqi, et autres
Publié: (2025)
ObfuscaTune: Obfuscated Offsite Fine-tuning and Inference of Proprietary LLMs on Private Datasets
par: Frikha, Ahmed, et autres
Publié: (2024)
par: Frikha, Ahmed, et autres
Publié: (2024)
Step-by-Step Unmasking for Parameter-Efficient Fine-tuning of Large Language Models
par: Agarwal, Aradhye, et autres
Publié: (2024)
par: Agarwal, Aradhye, et autres
Publié: (2024)
Data-efficient LLM Fine-tuning for Code Generation
par: Lv, Weijie, et autres
Publié: (2025)
par: Lv, Weijie, et autres
Publié: (2025)
LoFiT: Localized Fine-tuning on LLM Representations
par: Yin, Fangcong, et autres
Publié: (2024)
par: Yin, Fangcong, et autres
Publié: (2024)
CS4: Measuring the Creativity of Large Language Models Automatically by Controlling the Number of Story-Writing Constraints
par: Atmakuru, Anirudh, et autres
Publié: (2024)
par: Atmakuru, Anirudh, et autres
Publié: (2024)
TRACT: Regression-Aware Fine-tuning Meets Chain-of-Thought Reasoning for LLM-as-a-Judge
par: Chiang, Cheng-Han, et autres
Publié: (2025)
par: Chiang, Cheng-Han, et autres
Publié: (2025)
Efficient Model Development through Fine-tuning Transfer
par: Lin, Pin-Jie, et autres
Publié: (2025)
par: Lin, Pin-Jie, et autres
Publié: (2025)
Sima AIunty: Caste Audit in LLM-Driven Matchmaking
par: Naik, Atharva, et autres
Publié: (2026)
par: Naik, Atharva, et autres
Publié: (2026)
An Empirical Study of the Role of Incompleteness and Ambiguity in Interactions with Large Language Models
par: Naik, Riya, et autres
Publié: (2025)
par: Naik, Riya, et autres
Publié: (2025)
Efficient Ensemble for Fine-tuning Language Models on Multiple Datasets
par: Li, Dongyue, et autres
Publié: (2025)
par: Li, Dongyue, et autres
Publié: (2025)
Transfer-Prompting: Enhancing Cross-Task Adaptation in Large Language Models via Dual-Stage Prompts Optimization
par: Chang, Yupeng, et autres
Publié: (2025)
par: Chang, Yupeng, et autres
Publié: (2025)
Fine-tuning Transformer-based Encoder for Turkish Language Understanding Tasks
par: Yildirim, Savas
Publié: (2024)
par: Yildirim, Savas
Publié: (2024)
Data Augmentation for Code Translation with Comparable Corpora and Multiple References
par: Xie, Yiqing, et autres
Publié: (2023)
par: Xie, Yiqing, et autres
Publié: (2023)
CRScore: Grounding Automated Evaluation of Code Review Comments in Code Claims and Smells
par: Naik, Atharva, et autres
Publié: (2024)
par: Naik, Atharva, et autres
Publié: (2024)
Automatic Pruning of Fine-tuning Datasets for Transformer-based Language Models
par: Tayaranian, Mohammadreza, et autres
Publié: (2024)
par: Tayaranian, Mohammadreza, et autres
Publié: (2024)
NeurIPS 2023 LLM Efficiency Fine-tuning Competition
par: Saroufim, Mark, et autres
Publié: (2025)
par: Saroufim, Mark, et autres
Publié: (2025)
Fine-tuning with RAG for Improving LLM Learning of New Skills
par: Ibrahim, Humaid, et autres
Publié: (2025)
par: Ibrahim, Humaid, et autres
Publié: (2025)
PMSS: Pretrained Matrices Skeleton Selection for LLM Fine-tuning
par: Wang, Qibin, et autres
Publié: (2024)
par: Wang, Qibin, et autres
Publié: (2024)
Tricking LLMs into Disobedience: Formalizing, Analyzing, and Detecting Jailbreaks
par: Rao, Abhinav, et autres
Publié: (2023)
par: Rao, Abhinav, et autres
Publié: (2023)
Outlier-weighed Layerwise Sampling for LLM Fine-tuning
par: Li, Pengxiang, et autres
Publié: (2024)
par: Li, Pengxiang, et autres
Publié: (2024)
LLM Self-Correction with DeCRIM: Decompose, Critique, and Refine for Enhanced Following of Instructions with Multiple Constraints
par: Ferraz, Thomas Palmeira, et autres
Publié: (2024)
par: Ferraz, Thomas Palmeira, et autres
Publié: (2024)
ChartEditBench: Evaluating Grounded Multi-Turn Chart Editing in Multimodal Language Models
par: Kapadnis, Manav Nitin, et autres
Publié: (2026)
par: Kapadnis, Manav Nitin, et autres
Publié: (2026)
UltraLink: An Open-Source Knowledge-Enhanced Multilingual Supervised Fine-tuning Dataset
par: Wang, Haoyu, et autres
Publié: (2024)
par: Wang, Haoyu, et autres
Publié: (2024)
Breaking mBad! Supervised Fine-tuning for Cross-Lingual Detoxification
par: Beniwal, Himanshu, et autres
Publié: (2025)
par: Beniwal, Himanshu, et autres
Publié: (2025)
DICE: Detecting In-distribution Contamination in LLM's Fine-tuning Phase for Math Reasoning
par: Tu, Shangqing, et autres
Publié: (2024)
par: Tu, Shangqing, et autres
Publié: (2024)
Documents similaires
-
CoKe: Customizable Fine-Grained Story Evaluation via Chain-of-Keyword Rationalization
par: Joshi, Brihi, et autres
Publié: (2025) -
Task-Aware LoRA Adapter Composition via Similarity Retrieval in Vector Databases
par: Adsul, Riya, et autres
Publié: (2026) -
Truncated Step-Level Sampling with Process Rewards for Retrieval-Augmented Reasoning
par: Samarinas, Chris, et autres
Publié: (2026) -
PROMPT2BOX: Uncovering Entailment Structure among LLM Prompts
par: Bhuiya, Neeladri, et autres
Publié: (2026) -
Solving the Inverse Alignment Problem for Efficient RLHF
par: Krishna, Shambhavi, et autres
Publié: (2024)