In2Core: Leveraging Influence Functions for Coreset Selection in Instruction Finetuning of Large Language Models
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Joaquin, Ayrton San, Wang, Bin, Liu, Zhengyuan, Asher, Nicholas, Lim, Brian, Muller, Philippe, Chen, Nancy F. |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Minimal Clips, Maximum Salience: Long Video Summarization via Key Moment Extraction
par: Pennec, Galann, et autres
Publié: (2025)
par: Pennec, Galann, et autres
Publié: (2025)
Integrating Video and Text: A Balanced Approach to Multimodal Summary Generation and Evaluation
par: Pennec, Galann, et autres
Publié: (2025)
par: Pennec, Galann, et autres
Publié: (2025)
Resilience of Large Language Models for Noisy Instructions
par: Wang, Bin, et autres
Publié: (2024)
par: Wang, Bin, et autres
Publié: (2024)
HyperCore: Coreset Selection under Noise via Hypersphere Models
par: Moser, Brian B., et autres
Publié: (2025)
par: Moser, Brian B., et autres
Publié: (2025)
CrossIn: An Efficient Instruction Tuning Approach for Cross-Lingual Knowledge Alignment
par: Lin, Geyu, et autres
Publié: (2024)
par: Lin, Geyu, et autres
Publié: (2024)
A Coreset Selection of Coreset Selection Literature: Introduction and Recent Advances
par: Moser, Brian B., et autres
Publié: (2025)
par: Moser, Brian B., et autres
Publié: (2025)
GRACE: A Dynamic Coreset Selection Framework for Large Language Model Optimization
par: Tang, Tianhao, et autres
Publié: (2026)
par: Tang, Tianhao, et autres
Publié: (2026)
CRAFT: Extracting and Tuning Cultural Instructions from the Wild
par: Wang, Bin, et autres
Publié: (2024)
par: Wang, Bin, et autres
Publié: (2024)
Scaffolding Language Learning via Multi-modal Tutoring Systems with Pedagogical Instructions
par: Liu, Zhengyuan, et autres
Publié: (2024)
par: Liu, Zhengyuan, et autres
Publié: (2024)
SubZeroCore: A Submodular Approach with Zero Training for Coreset Selection
par: Moser, Brian B., et autres
Publié: (2025)
par: Moser, Brian B., et autres
Publié: (2025)
Deprecating Benchmarks: Criteria and Framework
par: Joaquin, Ayrton San, et autres
Publié: (2025)
par: Joaquin, Ayrton San, et autres
Publié: (2025)
Delta Activations: A Representation for Finetuned Large Language Models
par: Xu, Zhiqiu, et autres
Publié: (2025)
par: Xu, Zhiqiu, et autres
Publié: (2025)
Eliciting the Translation Ability of Large Language Models via Multilingual Finetuning with Translation Instructions
par: Li, Jiahuan, et autres
Publié: (2023)
par: Li, Jiahuan, et autres
Publié: (2023)
Instructive Dialogue Summarization with Query Aggregations
par: Wang, Bin, et autres
Publié: (2023)
par: Wang, Bin, et autres
Publié: (2023)
MAGIC: Multimodal Alignment & Grounding-aware Instruction Coreset for Vision-Language Models
par: Biswas, Shristi Das, et autres
Publié: (2026)
par: Biswas, Shristi Das, et autres
Publié: (2026)
Finetuning Generative Large Language Models with Discrimination Instructions for Knowledge Graph Completion
par: Liu, Yang, et autres
Publié: (2024)
par: Liu, Yang, et autres
Publié: (2024)
Refined Coreset Selection: Towards Minimal Coreset Size under Model Performance Constraints
par: Xia, Xiaobo, et autres
Publié: (2023)
par: Xia, Xiaobo, et autres
Publié: (2023)
TAGCOS: Task-agnostic Gradient Clustered Coreset Selection for Instruction Tuning Data
par: Zhang, Jipeng, et autres
Publié: (2024)
par: Zhang, Jipeng, et autres
Publié: (2024)
Exploring Self-supervised Logic-enhanced Training for Large Language Models
par: Jiao, Fangkai, et autres
Publié: (2023)
par: Jiao, Fangkai, et autres
Publié: (2023)
Uncertainty-Guided Checkpoint Selection for Reinforcement Finetuning of Large Language Models
par: Nguyen, Manh, et autres
Publié: (2025)
par: Nguyen, Manh, et autres
Publié: (2025)
Finetuning Large Language Model as an Effective Symbolic Regressor
par: Hua, Yingfan, et autres
Publié: (2025)
par: Hua, Yingfan, et autres
Publié: (2025)
Zero-Shot Classification of Crisis Tweets Using Instruction-Finetuned Large Language Models
par: McDaniel, Emma, et autres
Publié: (2024)
par: McDaniel, Emma, et autres
Publié: (2024)
Efficient Content-based Recommendation Model Training via Noise-aware Coreset Selection
par: Tran, Hung Vinh, et autres
Publié: (2026)
par: Tran, Hung Vinh, et autres
Publié: (2026)
Maya: An Instruction Finetuned Multilingual Multimodal Model
par: Alam, Nahid, et autres
Publié: (2024)
par: Alam, Nahid, et autres
Publié: (2024)
Coreset Selection for Object Detection
par: Lee, Hojun, et autres
Publié: (2024)
par: Lee, Hojun, et autres
Publié: (2024)
LLMTaxo: Leveraging Large Language Models for Constructing Taxonomy of Factual Claims from Social Media
par: Zhang, Haiqi, et autres
Publié: (2025)
par: Zhang, Haiqi, et autres
Publié: (2025)
Large Language Models to Diffusion Finetuning
par: Cetin, Edoardo, et autres
Publié: (2025)
par: Cetin, Edoardo, et autres
Publié: (2025)
AudioBench: A Universal Benchmark for Audio Large Language Models
par: Wang, Bin, et autres
Publié: (2024)
par: Wang, Bin, et autres
Publié: (2024)
Aya Model: An Instruction Finetuned Open-Access Multilingual Language Model
par: Üstün, Ahmet, et autres
Publié: (2024)
par: Üstün, Ahmet, et autres
Publié: (2024)
ELFS: Label-Free Coreset Selection with Proxy Training Dynamics
par: Zheng, Haizhong, et autres
Publié: (2024)
par: Zheng, Haizhong, et autres
Publié: (2024)
DnA-Eval: Enhancing Large Language Model Evaluation through Decomposition and Aggregation
par: Li, Minzhi, et autres
Publié: (2024)
par: Li, Minzhi, et autres
Publié: (2024)
Mitigating Large Language Model Hallucination with Faithful Finetuning
par: Hu, Minda, et autres
Publié: (2024)
par: Hu, Minda, et autres
Publié: (2024)
FedCore: Straggler-Free Federated Learning with Distributed Coresets
par: Guo, Hongpeng, et autres
Publié: (2024)
par: Guo, Hongpeng, et autres
Publié: (2024)
RL-Guided Data Selection for Language Model Finetuning
par: Jha, Animesh, et autres
Publié: (2025)
par: Jha, Animesh, et autres
Publié: (2025)
IgnitionInnovators at "Discharge Me!": Chain-of-Thought Instruction Finetuning Large Language Models for Discharge Summaries
par: Tang, An Quang, et autres
Publié: (2024)
par: Tang, An Quang, et autres
Publié: (2024)
Finetuning Large Language Model for Personalized Ranking
par: Bai, Zhuoxi, et autres
Publié: (2024)
par: Bai, Zhuoxi, et autres
Publié: (2024)
Risk-Averse Finetuning of Large Language Models
par: Chaudhary, Sapana, et autres
Publié: (2025)
par: Chaudhary, Sapana, et autres
Publié: (2025)
Finetuning Large Language Models for Vulnerability Detection
par: Shestov, Alexey, et autres
Publié: (2024)
par: Shestov, Alexey, et autres
Publié: (2024)
Transfer Learning for Finetuning Large Language Models
par: Strangmann, Tobias, et autres
Publié: (2024)
par: Strangmann, Tobias, et autres
Publié: (2024)
Leveraging Unstructured Text Data for Federated Instruction Tuning of Large Language Models
par: Ye, Rui, et autres
Publié: (2024)
par: Ye, Rui, et autres
Publié: (2024)
Documents similaires
-
Minimal Clips, Maximum Salience: Long Video Summarization via Key Moment Extraction
par: Pennec, Galann, et autres
Publié: (2025) -
Integrating Video and Text: A Balanced Approach to Multimodal Summary Generation and Evaluation
par: Pennec, Galann, et autres
Publié: (2025) -
Resilience of Large Language Models for Noisy Instructions
par: Wang, Bin, et autres
Publié: (2024) -
HyperCore: Coreset Selection under Noise via Hypersphere Models
par: Moser, Brian B., et autres
Publié: (2025) -
CrossIn: An Efficient Instruction Tuning Approach for Cross-Lingual Knowledge Alignment
par: Lin, Geyu, et autres
Publié: (2024)