TACOS: Open Tagging and Comparative Scoring for Instruction Fine-Tuning Data Selection
Fuente:
arXiv
Guardado en:
| Autores principales: | He, Xixiang, Yu, Hao, Sun, Qiyao, Cheng, Ao, Zhang, Tailai, Liu, Cong, Guo, Shuxuan |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Token Cleaning: Fine-Grained Data Selection for LLM Supervised Fine-Tuning
por: Pang, Jinlong, et al.
Publicado: (2025)
por: Pang, Jinlong, et al.
Publicado: (2025)
Low-Resource Fine-Tuning for Multi-Task Structured Information Extraction with a Billion-Parameter Instruction-Tuned Model
por: Chih, Yu Cheng, et al.
Publicado: (2025)
por: Chih, Yu Cheng, et al.
Publicado: (2025)
Selective Reflection-Tuning: Student-Selected Data Recycling for LLM Instruction-Tuning
por: Li, Ming, et al.
Publicado: (2024)
por: Li, Ming, et al.
Publicado: (2024)
Select2Reason: Efficient Instruction-Tuning Data Selection for Long-CoT Reasoning
por: Yang, Cehao, et al.
Publicado: (2025)
por: Yang, Cehao, et al.
Publicado: (2025)
Instruction Mining: Instruction Data Selection for Tuning Large Language Models
por: Cao, Yihan, et al.
Publicado: (2023)
por: Cao, Yihan, et al.
Publicado: (2023)
Fine-Tuned Language Models for Domain-Specific Summarization and Tagging
por: Wang, Jun, et al.
Publicado: (2025)
por: Wang, Jun, et al.
Publicado: (2025)
What Makes Good Data for Alignment? A Comprehensive Study of Automatic Data Selection in Instruction Tuning
por: Liu, Wei, et al.
Publicado: (2023)
por: Liu, Wei, et al.
Publicado: (2023)
From Tags to Trees: Structuring Fine-Grained Knowledge for Controllable Data Selection in LLM Instruction Tuning
por: Niu, Zihan, et al.
Publicado: (2026)
por: Niu, Zihan, et al.
Publicado: (2026)
xCoT: Cross-lingual Instruction Tuning for Cross-lingual Chain-of-Thought Reasoning
por: Chai, Linzheng, et al.
Publicado: (2024)
por: Chai, Linzheng, et al.
Publicado: (2024)
A Comparative Analysis of Instruction Fine-Tuning LLMs for Financial Text Classification
por: Fatemi, Sorouralsadat, et al.
Publicado: (2024)
por: Fatemi, Sorouralsadat, et al.
Publicado: (2024)
Filter-then-Weight: Online Data Selection and Reweighting for LLM Fine-Tuning
por: Wang, Fangxin, et al.
Publicado: (2026)
por: Wang, Fangxin, et al.
Publicado: (2026)
Data Selection for Multi-turn Dialogue Instruction Tuning
por: Li, Bo, et al.
Publicado: (2026)
por: Li, Bo, et al.
Publicado: (2026)
Exploring Format Consistency for Instruction Tuning
por: Liang, Shihao, et al.
Publicado: (2023)
por: Liang, Shihao, et al.
Publicado: (2023)
Supervised Fine-Tuning as Inverse Reinforcement Learning
por: Sun, Hao
Publicado: (2024)
por: Sun, Hao
Publicado: (2024)
LESS: Selecting Influential Data for Targeted Instruction Tuning
por: Xia, Mengzhou, et al.
Publicado: (2024)
por: Xia, Mengzhou, et al.
Publicado: (2024)
ROSE: A Reward-Oriented Data Selection Framework for LLM Task-Specific Instruction Tuning
por: Wu, Yang, et al.
Publicado: (2024)
por: Wu, Yang, et al.
Publicado: (2024)
Scaling Data Diversity for Fine-Tuning Language Models in Human Alignment
por: Song, Feifan, et al.
Publicado: (2024)
por: Song, Feifan, et al.
Publicado: (2024)
Unveiling the Impact of Coding Data Instruction Fine-Tuning on Large Language Models Reasoning
por: Zhang, Xinlu, et al.
Publicado: (2024)
por: Zhang, Xinlu, et al.
Publicado: (2024)
Efficient Hallucination Detection: Adaptive Bayesian Estimation of Semantic Entropy with Guided Semantic Exploration
por: Sun, Qiyao, et al.
Publicado: (2026)
por: Sun, Qiyao, et al.
Publicado: (2026)
The Best Instruction-Tuning Data are Those That Fit
por: Zhang, Dylan, et al.
Publicado: (2025)
por: Zhang, Dylan, et al.
Publicado: (2025)
Phased Instruction Fine-Tuning for Large Language Models
por: Pang, Wei, et al.
Publicado: (2024)
por: Pang, Wei, et al.
Publicado: (2024)
DataShield: Safety-degrading Data Filtering for LLM Benign Instruction Fine-Tuning
por: Zhang, Junbo, et al.
Publicado: (2026)
por: Zhang, Junbo, et al.
Publicado: (2026)
Is It Good Data for Multilingual Instruction Tuning or Just Bad Multilingual Evaluation for Large Language Models?
por: Chen, Pinzhen, et al.
Publicado: (2024)
por: Chen, Pinzhen, et al.
Publicado: (2024)
Neural Networks for Learnable and Scalable Influence Estimation of Instruction Fine-Tuning Data
por: Agarwal, Ishika, et al.
Publicado: (2025)
por: Agarwal, Ishika, et al.
Publicado: (2025)
T-T: Table Transformer for Tagging-based Aspect Sentiment Triplet Extraction
por: Peng, Kun, et al.
Publicado: (2025)
por: Peng, Kun, et al.
Publicado: (2025)
Selection of LLM Fine-Tuning Data based on Orthogonal Rules
por: Li, Xiaomin, et al.
Publicado: (2024)
por: Li, Xiaomin, et al.
Publicado: (2024)
MANTIS: Interleaved Multi-Image Instruction Tuning
por: Jiang, Dongfu, et al.
Publicado: (2024)
por: Jiang, Dongfu, et al.
Publicado: (2024)
A New Pipeline For Generating Instruction Dataset via RAG and Self Fine-Tuning
por: Song, Chih-Wei, et al.
Publicado: (2024)
por: Song, Chih-Wei, et al.
Publicado: (2024)
Balancing Truthfulness and Informativeness with Uncertainty-Aware Instruction Fine-Tuning
por: Wu, Tianyi, et al.
Publicado: (2025)
por: Wu, Tianyi, et al.
Publicado: (2025)
MIG: Automatic Data Selection for Instruction Tuning by Maximizing Information Gain in Semantic Space
por: Chen, Yicheng, et al.
Publicado: (2025)
por: Chen, Yicheng, et al.
Publicado: (2025)
Uncertainty-Aware Gradient Signal-to-Noise Data Selection for Instruction Tuning
por: Yuan, Zhihang, et al.
Publicado: (2026)
por: Yuan, Zhihang, et al.
Publicado: (2026)
MLLM-CTBench: A Benchmark for Continual Instruction Tuning with Reasoning Process Diagnosis
por: Guo, Haiyun, et al.
Publicado: (2025)
por: Guo, Haiyun, et al.
Publicado: (2025)
Natural Language Fine-Tuning
por: Liu, Jia, et al.
Publicado: (2024)
por: Liu, Jia, et al.
Publicado: (2024)
Is Fine-Tuning an Effective Solution? Reassessing Knowledge Editing for Unstructured Data
por: Xiong, Hao, et al.
Publicado: (2025)
por: Xiong, Hao, et al.
Publicado: (2025)
EvalYaks: Instruction Tuning Datasets and LoRA Fine-tuned Models for Automated Scoring of CEFR B2 Speaking Assessment Transcripts
por: Scaria, Nicy, et al.
Publicado: (2024)
por: Scaria, Nicy, et al.
Publicado: (2024)
Get more for less: Principled Data Selection for Warming Up Fine-Tuning in LLMs
por: Kang, Feiyang, et al.
Publicado: (2024)
por: Kang, Feiyang, et al.
Publicado: (2024)
Improving Influence-based Instruction Tuning Data Selection for Balanced Learning of Diverse Capabilities
por: Dai, Qirun, et al.
Publicado: (2025)
por: Dai, Qirun, et al.
Publicado: (2025)
CommonIT: Commonality-Aware Instruction Tuning for Large Language Models via Data Partitions
por: Rao, Jun, et al.
Publicado: (2024)
por: Rao, Jun, et al.
Publicado: (2024)
A Study of Large Language Models for Patient Information Extraction: Model Architecture, Fine-Tuning Strategy, and Multi-task Instruction Tuning
por: Peng, Cheng, et al.
Publicado: (2025)
por: Peng, Cheng, et al.
Publicado: (2025)
Parameter-Efficient Fine-Tuning for Medical Text Summarization: A Comparative Study of Lora, Prompt Tuning, and Full Fine-Tuning
por: Shernazarov, Ulugbek, et al.
Publicado: (2026)
por: Shernazarov, Ulugbek, et al.
Publicado: (2026)
Ejemplares similares
-
Token Cleaning: Fine-Grained Data Selection for LLM Supervised Fine-Tuning
por: Pang, Jinlong, et al.
Publicado: (2025) -
Low-Resource Fine-Tuning for Multi-Task Structured Information Extraction with a Billion-Parameter Instruction-Tuned Model
por: Chih, Yu Cheng, et al.
Publicado: (2025) -
Selective Reflection-Tuning: Student-Selected Data Recycling for LLM Instruction-Tuning
por: Li, Ming, et al.
Publicado: (2024) -
Select2Reason: Efficient Instruction-Tuning Data Selection for Long-CoT Reasoning
por: Yang, Cehao, et al.
Publicado: (2025) -
Instruction Mining: Instruction Data Selection for Tuning Large Language Models
por: Cao, Yihan, et al.
Publicado: (2023)