T-SHIRT: Token-Selective Hierarchical Data Selection for Instruction Tuning
Fuente:
arXiv
Salvato in:
| Autori principali: | Fu, Yanjun, Hamman, Faisal, Dutta, Sanghamitra |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Few-Shot Knowledge Distillation of LLMs With Counterfactual Explanations
di: Hamman, Faisal, et al.
Pubblicazione: (2025)
di: Hamman, Faisal, et al.
Pubblicazione: (2025)
Quantifying Prediction Consistency Under Fine-Tuning Multiplicity in Tabular LLMs
di: Hamman, Faisal, et al.
Pubblicazione: (2024)
di: Hamman, Faisal, et al.
Pubblicazione: (2024)
Demystifying Local and Global Fairness Trade-offs in Federated Learning Using Partial Information Decomposition
di: Hamman, Faisal, et al.
Pubblicazione: (2023)
di: Hamman, Faisal, et al.
Pubblicazione: (2023)
A Unified View of Group Fairness Tradeoffs Using Partial Information Decomposition
di: Hamman, Faisal, et al.
Pubblicazione: (2024)
di: Hamman, Faisal, et al.
Pubblicazione: (2024)
Robust Counterfactual Explanations for Neural Networks With Probabilistic Guarantees
di: Hamman, Faisal, et al.
Pubblicazione: (2023)
di: Hamman, Faisal, et al.
Pubblicazione: (2023)
Improving Consistency in Retrieval-Augmented Systems with Group Similarity Rewards
di: Hamman, Faisal, et al.
Pubblicazione: (2025)
di: Hamman, Faisal, et al.
Pubblicazione: (2025)
MergeIT: From Selection to Merging for Efficient Instruction Tuning
di: Cai, Hongyi, et al.
Pubblicazione: (2025)
di: Cai, Hongyi, et al.
Pubblicazione: (2025)
Towards Formalizing Spuriousness of Biased Datasets Using Partial Information Decomposition
di: Halder, Barproda, et al.
Pubblicazione: (2024)
di: Halder, Barproda, et al.
Pubblicazione: (2024)
Selective Reflection-Tuning: Student-Selected Data Recycling for LLM Instruction-Tuning
di: Li, Ming, et al.
Pubblicazione: (2024)
di: Li, Ming, et al.
Pubblicazione: (2024)
LEAD: Iterative Data Selection for Efficient LLM Instruction Tuning
di: Lin, Xiaotian, et al.
Pubblicazione: (2025)
di: Lin, Xiaotian, et al.
Pubblicazione: (2025)
Instruction Mining: Instruction Data Selection for Tuning Large Language Models
di: Cao, Yihan, et al.
Pubblicazione: (2023)
di: Cao, Yihan, et al.
Pubblicazione: (2023)
LESS: Selecting Influential Data for Targeted Instruction Tuning
di: Xia, Mengzhou, et al.
Pubblicazione: (2024)
di: Xia, Mengzhou, et al.
Pubblicazione: (2024)
Counterfactual Explanations for Model Ensembles Using Entropic Risk Measures
di: Noorani, Erfaun, et al.
Pubblicazione: (2025)
di: Noorani, Erfaun, et al.
Pubblicazione: (2025)
TabDistill: Distilling Transformers into Neural Nets for Few-Shot Tabular Classification
di: Dissanayake, Pasan, et al.
Pubblicazione: (2025)
di: Dissanayake, Pasan, et al.
Pubblicazione: (2025)
Hyper-parameter Tuning for Fair Classification without Sensitive Attribute Access
di: Veldanda, Akshaj Kumar, et al.
Pubblicazione: (2023)
di: Veldanda, Akshaj Kumar, et al.
Pubblicazione: (2023)
Adapt-$\infty$: Scalable Continual Multimodal Instruction Tuning via Dynamic Data Selection
di: Maharana, Adyasha, et al.
Pubblicazione: (2024)
di: Maharana, Adyasha, et al.
Pubblicazione: (2024)
Uncertainty-Aware Gradient Signal-to-Noise Data Selection for Instruction Tuning
di: Yuan, Zhihang, et al.
Pubblicazione: (2026)
di: Yuan, Zhihang, et al.
Pubblicazione: (2026)
TAGCOS: Task-agnostic Gradient Clustered Coreset Selection for Instruction Tuning Data
di: Zhang, Jipeng, et al.
Pubblicazione: (2024)
di: Zhang, Jipeng, et al.
Pubblicazione: (2024)
SelectIT: Selective Instruction Tuning for LLMs via Uncertainty-Aware Self-Reflection
di: Liu, Liangxin, et al.
Pubblicazione: (2024)
di: Liu, Liangxin, et al.
Pubblicazione: (2024)
Learning Invariant Graph Representations Through Redundant Information
di: Halder, Barproda, et al.
Pubblicazione: (2025)
di: Halder, Barproda, et al.
Pubblicazione: (2025)
Hierarchical Dataset Selection for High-Quality Data Sharing
di: Zhou, Xiaona, et al.
Pubblicazione: (2025)
di: Zhou, Xiaona, et al.
Pubblicazione: (2025)
Filter Images First, Generate Instructions Later: Pre-Instruction Data Selection for Visual Instruction Tuning
di: Safaei, Bardia, et al.
Pubblicazione: (2025)
di: Safaei, Bardia, et al.
Pubblicazione: (2025)
What Makes Good Data for Alignment? A Comprehensive Study of Automatic Data Selection in Instruction Tuning
di: Liu, Wei, et al.
Pubblicazione: (2023)
di: Liu, Wei, et al.
Pubblicazione: (2023)
ROSE: A Reward-Oriented Data Selection Framework for LLM Task-Specific Instruction Tuning
di: Wu, Yang, et al.
Pubblicazione: (2024)
di: Wu, Yang, et al.
Pubblicazione: (2024)
GIST: Targeted Data Selection for Instruction Tuning via Coupled Optimization Geometry
di: Min, Guanghui, et al.
Pubblicazione: (2026)
di: Min, Guanghui, et al.
Pubblicazione: (2026)
VISION: Robust and Interpretable Code Vulnerability Detection Leveraging Counterfactual Augmentation
di: Egea, David, et al.
Pubblicazione: (2025)
di: Egea, David, et al.
Pubblicazione: (2025)
TokenSelect: Efficient Long-Context Inference and Length Extrapolation for LLMs via Dynamic Token-Level KV Cache Selection
di: Wu, Wei, et al.
Pubblicazione: (2024)
di: Wu, Wei, et al.
Pubblicazione: (2024)
FedSelect: Personalized Federated Learning with Customized Selection of Parameters for Fine-Tuning
di: Tamirisa, Rishub, et al.
Pubblicazione: (2024)
di: Tamirisa, Rishub, et al.
Pubblicazione: (2024)
Geometric Analysis of Token Selection in Multi-Head Attention
di: Mudarisov, Timur, et al.
Pubblicazione: (2026)
di: Mudarisov, Timur, et al.
Pubblicazione: (2026)
FedSelect: Customized Selection of Parameters for Fine-Tuning during Personalized Federated Learning
di: Tamirisa, Rishub, et al.
Pubblicazione: (2023)
di: Tamirisa, Rishub, et al.
Pubblicazione: (2023)
Improving Influence-based Instruction Tuning Data Selection for Balanced Learning of Diverse Capabilities
di: Dai, Qirun, et al.
Pubblicazione: (2025)
di: Dai, Qirun, et al.
Pubblicazione: (2025)
Demystifying the Accuracy-Interpretability Trade-Off: A Case Study of Inferring Ratings from Reviews
di: Atrey, Pranjal, et al.
Pubblicazione: (2025)
di: Atrey, Pranjal, et al.
Pubblicazione: (2025)
Selection of LLM Fine-Tuning Data based on Orthogonal Rules
di: Li, Xiaomin, et al.
Pubblicazione: (2024)
di: Li, Xiaomin, et al.
Pubblicazione: (2024)
Training-Trajectory-Aware Token Selection
di: Shen, Zhanming, et al.
Pubblicazione: (2026)
di: Shen, Zhanming, et al.
Pubblicazione: (2026)
LENSLLM: Unveiling Fine-Tuning Dynamics for LLM Selection
di: Zeng, Xinyue, et al.
Pubblicazione: (2025)
di: Zeng, Xinyue, et al.
Pubblicazione: (2025)
GradientSpace: Unsupervised Data Clustering for Improved Instruction Tuning
di: Sridharan, Shrihari, et al.
Pubblicazione: (2025)
di: Sridharan, Shrihari, et al.
Pubblicazione: (2025)
Filter-then-Weight: Online Data Selection and Reweighting for LLM Fine-Tuning
di: Wang, Fangxin, et al.
Pubblicazione: (2026)
di: Wang, Fangxin, et al.
Pubblicazione: (2026)
Offline Behavioral Data Selection
di: Lei, Shiye, et al.
Pubblicazione: (2025)
di: Lei, Shiye, et al.
Pubblicazione: (2025)
Federated Continual Instruction Tuning
di: Guo, Haiyang, et al.
Pubblicazione: (2025)
di: Guo, Haiyang, et al.
Pubblicazione: (2025)
Diversity-driven Data Selection for Language Model Tuning through Sparse Autoencoder
di: Yang, Xianjun, et al.
Pubblicazione: (2025)
di: Yang, Xianjun, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Few-Shot Knowledge Distillation of LLMs With Counterfactual Explanations
di: Hamman, Faisal, et al.
Pubblicazione: (2025) -
Quantifying Prediction Consistency Under Fine-Tuning Multiplicity in Tabular LLMs
di: Hamman, Faisal, et al.
Pubblicazione: (2024) -
Demystifying Local and Global Fairness Trade-offs in Federated Learning Using Partial Information Decomposition
di: Hamman, Faisal, et al.
Pubblicazione: (2023) -
A Unified View of Group Fairness Tradeoffs Using Partial Information Decomposition
di: Hamman, Faisal, et al.
Pubblicazione: (2024) -
Robust Counterfactual Explanations for Neural Networks With Probabilistic Guarantees
di: Hamman, Faisal, et al.
Pubblicazione: (2023)