MIG: Automatic Data Selection for Instruction Tuning by Maximizing Information Gain in Semantic Space
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Chen, Yicheng, Li, Yining, Hu, Kai, Ma, Zerun, Ye, Haochen, Chen, Kai |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
DataChef: Cooking Up Optimal Data Recipes for LLM Adaptation via Reinforcement Learning
par: Chen, Yicheng, et autres
Publié: (2026)
par: Chen, Yicheng, et autres
Publié: (2026)
Star-Agents: Automatic Data Optimization with LLM Agents for Instruction Tuning
par: Zhou, Hang, et autres
Publié: (2024)
par: Zhou, Hang, et autres
Publié: (2024)
GTA: A Benchmark for General Tool Agents
par: Wang, Jize, et autres
Publié: (2024)
par: Wang, Jize, et autres
Publié: (2024)
TREX: Automating LLM Fine-tuning via Agent-Driven Tree-based Exploration
par: Ma, Zerun, et autres
Publié: (2026)
par: Ma, Zerun, et autres
Publié: (2026)
Data Selection for Multi-turn Dialogue Instruction Tuning
par: Li, Bo, et autres
Publié: (2026)
par: Li, Bo, et autres
Publié: (2026)
Selective Reflection-Tuning: Student-Selected Data Recycling for LLM Instruction-Tuning
par: Li, Ming, et autres
Publié: (2024)
par: Li, Ming, et autres
Publié: (2024)
Towards Automatic Continual Learning: A Self-Adaptive Framework for Continual Instruction Tuning
par: Lin, Peiyi, et autres
Publié: (2025)
par: Lin, Peiyi, et autres
Publié: (2025)
CrisisSense-LLM: Instruction Fine-Tuned Large Language Model for Multi-label Social Media Text Classification in Disaster Informatics
par: Yin, Kai, et autres
Publié: (2024)
par: Yin, Kai, et autres
Publié: (2024)
PandaLM: An Automatic Evaluation Benchmark for LLM Instruction Tuning Optimization
par: Wang, Yidong, et autres
Publié: (2023)
par: Wang, Yidong, et autres
Publié: (2023)
Optimizing Instruction Synthesis: Effective Exploration of Evolutionary Space with Tree Search
par: Li, Chenglin, et autres
Publié: (2024)
par: Li, Chenglin, et autres
Publié: (2024)
LESS: Selecting Influential Data for Targeted Instruction Tuning
par: Xia, Mengzhou, et autres
Publié: (2024)
par: Xia, Mengzhou, et autres
Publié: (2024)
What Makes Good Data for Alignment? A Comprehensive Study of Automatic Data Selection in Instruction Tuning
par: Liu, Wei, et autres
Publié: (2023)
par: Liu, Wei, et autres
Publié: (2023)
Capability Instruction Tuning: A New Paradigm for Dynamic LLM Routing
par: Zhang, Yi-Kai, et autres
Publié: (2025)
par: Zhang, Yi-Kai, et autres
Publié: (2025)
Generalizing From Short to Long: Effective Data Synthesis for Long-Context Instruction Tuning
par: Zhu, Wenhao, et autres
Publié: (2025)
par: Zhu, Wenhao, et autres
Publié: (2025)
Unveiling the Impact of Coding Data Instruction Fine-Tuning on Large Language Models Reasoning
par: Zhang, Xinlu, et autres
Publié: (2024)
par: Zhang, Xinlu, et autres
Publié: (2024)
Select2Reason: Efficient Instruction-Tuning Data Selection for Long-CoT Reasoning
par: Yang, Cehao, et autres
Publié: (2025)
par: Yang, Cehao, et autres
Publié: (2025)
How Reliable Are Automatic Evaluation Methods for Instruction-Tuned LLMs?
par: Doostmohammadi, Ehsan, et autres
Publié: (2024)
par: Doostmohammadi, Ehsan, et autres
Publié: (2024)
Instruction Mining: Instruction Data Selection for Tuning Large Language Models
par: Cao, Yihan, et autres
Publié: (2023)
par: Cao, Yihan, et autres
Publié: (2023)
MIST: Jailbreaking Black-box Large Language Models via Iterative Semantic Tuning
par: Zheng, Muyang, et autres
Publié: (2025)
par: Zheng, Muyang, et autres
Publié: (2025)
CrowdSelect: Synthetic Instruction Data Selection with Multi-LLM Wisdom
par: Li, Yisen, et autres
Publié: (2025)
par: Li, Yisen, et autres
Publié: (2025)
TACOS: Open Tagging and Comparative Scoring for Instruction Fine-Tuning Data Selection
par: He, Xixiang, et autres
Publié: (2025)
par: He, Xixiang, et autres
Publié: (2025)
What are the Essential Factors in Crafting Effective Long Context Multi-Hop Instruction Datasets? Insights and Best Practices
par: Chen, Zhi, et autres
Publié: (2024)
par: Chen, Zhi, et autres
Publié: (2024)
A New Pipeline For Generating Instruction Dataset via RAG and Self Fine-Tuning
par: Song, Chih-Wei, et autres
Publié: (2024)
par: Song, Chih-Wei, et autres
Publié: (2024)
SelectIT: Selective Instruction Tuning for LLMs via Uncertainty-Aware Self-Reflection
par: Liu, Liangxin, et autres
Publié: (2024)
par: Liu, Liangxin, et autres
Publié: (2024)
Leveraging Unstructured Text Data for Federated Instruction Tuning of Large Language Models
par: Ye, Rui, et autres
Publié: (2024)
par: Ye, Rui, et autres
Publié: (2024)
Not All Documents Are What You Need for Extracting Instruction Tuning Data
par: Zhang, Chi, et autres
Publié: (2025)
par: Zhang, Chi, et autres
Publié: (2025)
Automatic Instruction Evolving for Large Language Models
par: Zeng, Weihao, et autres
Publié: (2024)
par: Zeng, Weihao, et autres
Publié: (2024)
Uncertainty-Aware Gradient Signal-to-Noise Data Selection for Instruction Tuning
par: Yuan, Zhihang, et autres
Publié: (2026)
par: Yuan, Zhihang, et autres
Publié: (2026)
Is It Good Data for Multilingual Instruction Tuning or Just Bad Multilingual Evaluation for Large Language Models?
par: Chen, Pinzhen, et autres
Publié: (2024)
par: Chen, Pinzhen, et autres
Publié: (2024)
ROSE: A Reward-Oriented Data Selection Framework for LLM Task-Specific Instruction Tuning
par: Wu, Yang, et autres
Publié: (2024)
par: Wu, Yang, et autres
Publié: (2024)
Joint Flashback Adaptation for Forgetting-Resistant Instruction Tuning
par: Zhao, Yukun, et autres
Publié: (2025)
par: Zhao, Yukun, et autres
Publié: (2025)
OneNet: A Fine-Tuning Free Framework for Few-Shot Entity Linking via Large Language Model Prompting
par: Liu, Xukai, et autres
Publié: (2024)
par: Liu, Xukai, et autres
Publié: (2024)
ClimateChat: Designing Data and Methods for Instruction Tuning LLMs to Answer Climate Change Queries
par: Chen, Zhou, et autres
Publié: (2025)
par: Chen, Zhou, et autres
Publié: (2025)
Call for Rigor in Reporting Quality of Instruction Tuning Data
par: Moon, Hyeonseok, et autres
Publié: (2025)
par: Moon, Hyeonseok, et autres
Publié: (2025)
AIR: Complex Instruction Generation via Automatic Iterative Refinement
par: Liu, Wei, et autres
Publié: (2025)
par: Liu, Wei, et autres
Publié: (2025)
Reconstructive Visual Instruction Tuning
par: Wang, Haochen, et autres
Publié: (2024)
par: Wang, Haochen, et autres
Publié: (2024)
TAGCOS: Task-agnostic Gradient Clustered Coreset Selection for Instruction Tuning Data
par: Zhang, Jipeng, et autres
Publié: (2024)
par: Zhang, Jipeng, et autres
Publié: (2024)
Towards Robust Instruction Tuning on Multimodal Large Language Models
par: Han, Wei, et autres
Publié: (2024)
par: Han, Wei, et autres
Publié: (2024)
Instruction Tuning With Loss Over Instructions
par: Shi, Zhengyan, et autres
Publié: (2024)
par: Shi, Zhengyan, et autres
Publié: (2024)
RA-DIT: Retrieval-Augmented Dual Instruction Tuning
par: Lin, Xi Victoria, et autres
Publié: (2023)
par: Lin, Xi Victoria, et autres
Publié: (2023)
Documents similaires
-
DataChef: Cooking Up Optimal Data Recipes for LLM Adaptation via Reinforcement Learning
par: Chen, Yicheng, et autres
Publié: (2026) -
Star-Agents: Automatic Data Optimization with LLM Agents for Instruction Tuning
par: Zhou, Hang, et autres
Publié: (2024) -
GTA: A Benchmark for General Tool Agents
par: Wang, Jize, et autres
Publié: (2024) -
TREX: Automating LLM Fine-tuning via Agent-Driven Tree-based Exploration
par: Ma, Zerun, et autres
Publié: (2026) -
Data Selection for Multi-turn Dialogue Instruction Tuning
par: Li, Bo, et autres
Publié: (2026)