From Tags to Trees: Structuring Fine-Grained Knowledge for Controllable Data Selection in LLM Instruction Tuning
Fuente:
arXiv
Salvato in:
| Autori principali: | Niu, Zihan, Hu, Wenping, Chen, Junmin, Wang, Xiyue, Xu, Tong, Tang, Ruiming |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
TACOS: Open Tagging and Comparative Scoring for Instruction Fine-Tuning Data Selection
di: He, Xixiang, et al.
Pubblicazione: (2025)
di: He, Xixiang, et al.
Pubblicazione: (2025)
Token Cleaning: Fine-Grained Data Selection for LLM Supervised Fine-Tuning
di: Pang, Jinlong, et al.
Pubblicazione: (2025)
di: Pang, Jinlong, et al.
Pubblicazione: (2025)
Selective Reflection-Tuning: Student-Selected Data Recycling for LLM Instruction-Tuning
di: Li, Ming, et al.
Pubblicazione: (2024)
di: Li, Ming, et al.
Pubblicazione: (2024)
Importance-Aware Data Selection for Efficient LLM Instruction Tuning
di: Jiang, Tingyu, et al.
Pubblicazione: (2025)
di: Jiang, Tingyu, et al.
Pubblicazione: (2025)
From Quantity to Quality: Boosting LLM Performance with Self-Guided Data Selection for Instruction Tuning
di: Li, Ming, et al.
Pubblicazione: (2023)
di: Li, Ming, et al.
Pubblicazione: (2023)
A Survey on Data Selection for LLM Instruction Tuning
di: Zhang, Bolin, et al.
Pubblicazione: (2024)
di: Zhang, Bolin, et al.
Pubblicazione: (2024)
Selection of LLM Fine-Tuning Data based on Orthogonal Rules
di: Li, Xiaomin, et al.
Pubblicazione: (2024)
di: Li, Xiaomin, et al.
Pubblicazione: (2024)
Enhancing and Assessing Instruction-Following with Fine-Grained Instruction Variants
di: Yang, Jiuding, et al.
Pubblicazione: (2024)
di: Yang, Jiuding, et al.
Pubblicazione: (2024)
Instruction-Tuning Data Synthesis from Scratch via Web Reconstruction
di: Jiang, Yuxin, et al.
Pubblicazione: (2025)
di: Jiang, Yuxin, et al.
Pubblicazione: (2025)
IF-CRITIC: Towards a Fine-Grained LLM Critic for Instruction-Following Evaluation
di: Wen, Bosi, et al.
Pubblicazione: (2025)
di: Wen, Bosi, et al.
Pubblicazione: (2025)
DARL: Encouraging Diverse Answers for General Reasoning without Verifiers
di: Huang, Chongxuan, et al.
Pubblicazione: (2026)
di: Huang, Chongxuan, et al.
Pubblicazione: (2026)
Retrieve-Plan-Generation: An Iterative Planning and Answering Framework for Knowledge-Intensive LLM Generation
di: Lyu, Yuanjie, et al.
Pubblicazione: (2024)
di: Lyu, Yuanjie, et al.
Pubblicazione: (2024)
Fine-Tuned Language Models for Domain-Specific Summarization and Tagging
di: Wang, Jun, et al.
Pubblicazione: (2025)
di: Wang, Jun, et al.
Pubblicazione: (2025)
From Instance Selection to Fixed-Pool Data Recipe Search for Supervised Fine-Tuning
di: Wu, Haodong, et al.
Pubblicazione: (2026)
di: Wu, Haodong, et al.
Pubblicazione: (2026)
DataShield: Safety-degrading Data Filtering for LLM Benign Instruction Fine-Tuning
di: Zhang, Junbo, et al.
Pubblicazione: (2026)
di: Zhang, Junbo, et al.
Pubblicazione: (2026)
SKA-Bench: A Fine-Grained Benchmark for Evaluating Structured Knowledge Understanding of LLMs
di: Liu, Zhiqiang, et al.
Pubblicazione: (2025)
di: Liu, Zhiqiang, et al.
Pubblicazione: (2025)
Skill-Aware Data Selection and Fine-Tuning for Data-Efficient Reasoning Distillation
di: Zhang, Lechen, et al.
Pubblicazione: (2026)
di: Zhang, Lechen, et al.
Pubblicazione: (2026)
Large-Scale Data Selection for Instruction Tuning
di: Ivison, Hamish, et al.
Pubblicazione: (2025)
di: Ivison, Hamish, et al.
Pubblicazione: (2025)
ProcTag: Process Tagging for Assessing the Efficacy of Document Instruction Data
di: Shen, Yufan, et al.
Pubblicazione: (2024)
di: Shen, Yufan, et al.
Pubblicazione: (2024)
InstructDiff: Domain-Adaptive Data Selection via Differential Entropy for Efficient LLM Fine-Tuning
di: Su, Junyou, et al.
Pubblicazione: (2026)
di: Su, Junyou, et al.
Pubblicazione: (2026)
IterSelectTune: An Iterative Training Framework for Efficient Instruction-Tuning Data Selection
di: Song, Jielin, et al.
Pubblicazione: (2024)
di: Song, Jielin, et al.
Pubblicazione: (2024)
MIG: Automatic Data Selection for Instruction Tuning by Maximizing Information Gain in Semantic Space
di: Chen, Yicheng, et al.
Pubblicazione: (2025)
di: Chen, Yicheng, et al.
Pubblicazione: (2025)
Automate Knowledge Concept Tagging on Math Questions with LLMs
di: Li, Hang, et al.
Pubblicazione: (2024)
di: Li, Hang, et al.
Pubblicazione: (2024)
DELIFT: Data Efficient Language model Instruction Fine Tuning
di: Agarwal, Ishika, et al.
Pubblicazione: (2024)
di: Agarwal, Ishika, et al.
Pubblicazione: (2024)
Data Whisperer: Efficient Data Selection for Task-Specific LLM Fine-Tuning via Few-Shot In-Context Learning
di: Wang, Shaobo, et al.
Pubblicazione: (2025)
di: Wang, Shaobo, et al.
Pubblicazione: (2025)
Rethinking Data Selection for Supervised Fine-Tuning
di: Shen, Ming
Pubblicazione: (2024)
di: Shen, Ming
Pubblicazione: (2024)
Filter-then-Weight: Online Data Selection and Reweighting for LLM Fine-Tuning
di: Wang, Fangxin, et al.
Pubblicazione: (2026)
di: Wang, Fangxin, et al.
Pubblicazione: (2026)
TalkTag: Fine-Grained Morphosyntactic Error Annotation for Transcribed Speech
di: Venturini, Shamira, et al.
Pubblicazione: (2026)
di: Venturini, Shamira, et al.
Pubblicazione: (2026)
LESS: Selecting Influential Data for Targeted Instruction Tuning
di: Xia, Mengzhou, et al.
Pubblicazione: (2024)
di: Xia, Mengzhou, et al.
Pubblicazione: (2024)
ROSE: A Reward-Oriented Data Selection Framework for LLM Task-Specific Instruction Tuning
di: Wu, Yang, et al.
Pubblicazione: (2024)
di: Wu, Yang, et al.
Pubblicazione: (2024)
Gradient Surgery for Safe LLM Fine-Tuning
di: Yi, Biao, et al.
Pubblicazione: (2025)
di: Yi, Biao, et al.
Pubblicazione: (2025)
Improving Translation Quality by Selecting Better Data for LLM Fine-Tuning: A Comparative Analysis
di: de Mello, Felipe Ribeiro Fujita, et al.
Pubblicazione: (2025)
di: de Mello, Felipe Ribeiro Fujita, et al.
Pubblicazione: (2025)
Star-Agents: Automatic Data Optimization with LLM Agents for Instruction Tuning
di: Zhou, Hang, et al.
Pubblicazione: (2024)
di: Zhou, Hang, et al.
Pubblicazione: (2024)
TAGCOS: Task-agnostic Gradient Clustered Coreset Selection for Instruction Tuning Data
di: Zhang, Jipeng, et al.
Pubblicazione: (2024)
di: Zhang, Jipeng, et al.
Pubblicazione: (2024)
Dynamic Data Mixing Maximizes Instruction Tuning for Mixture-of-Experts
di: Zhu, Tong, et al.
Pubblicazione: (2024)
di: Zhu, Tong, et al.
Pubblicazione: (2024)
Neuron-Aware Data Selection In Instruction Tuning For Large Language Models
di: Chen, Xin, et al.
Pubblicazione: (2026)
di: Chen, Xin, et al.
Pubblicazione: (2026)
From Single to Multi-Granularity: Toward Long-Term Memory Association and Selection of Conversational Agents
di: Xu, Derong, et al.
Pubblicazione: (2025)
di: Xu, Derong, et al.
Pubblicazione: (2025)
RECOST: External Knowledge Guided Data-efficient Instruction Tuning
di: Zhang, Qi, et al.
Pubblicazione: (2024)
di: Zhang, Qi, et al.
Pubblicazione: (2024)
Know the Unknown: An Uncertainty-Sensitive Method for LLM Instruction Tuning
di: Li, Jiaqi, et al.
Pubblicazione: (2024)
di: Li, Jiaqi, et al.
Pubblicazione: (2024)
GIFT: Guided Fine-Tuning and Transfer for Enhancing Instruction-Tuned Language Models
di: Ruan, Zhiwen, et al.
Pubblicazione: (2026)
di: Ruan, Zhiwen, et al.
Pubblicazione: (2026)
Documenti analoghi
-
TACOS: Open Tagging and Comparative Scoring for Instruction Fine-Tuning Data Selection
di: He, Xixiang, et al.
Pubblicazione: (2025) -
Token Cleaning: Fine-Grained Data Selection for LLM Supervised Fine-Tuning
di: Pang, Jinlong, et al.
Pubblicazione: (2025) -
Selective Reflection-Tuning: Student-Selected Data Recycling for LLM Instruction-Tuning
di: Li, Ming, et al.
Pubblicazione: (2024) -
Importance-Aware Data Selection for Efficient LLM Instruction Tuning
di: Jiang, Tingyu, et al.
Pubblicazione: (2025) -
From Quantity to Quality: Boosting LLM Performance with Self-Guided Data Selection for Instruction Tuning
di: Li, Ming, et al.
Pubblicazione: (2023)