Task-Specific Data Selection for Instruction Tuning via Monosemantic Neuronal Activations
Fuente:
arXiv
Guardado en:
| Autores principales: | Ma, Da, Shang, Gonghu, Chen, Zhi, Qin, Libo, Luo, Yijie, Pan, Lei, Fan, Shuai, Chen, Lu, Yu, Kai |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Learning from Emergence: A Study on Proactively Inhibiting the Monosemantic Neurons of Artificial Neural Networks
por: Wang, Jiachuan, et al.
Publicado: (2023)
por: Wang, Jiachuan, et al.
Publicado: (2023)
TAGCOS: Task-agnostic Gradient Clustered Coreset Selection for Instruction Tuning Data
por: Zhang, Jipeng, et al.
Publicado: (2024)
por: Zhang, Jipeng, et al.
Publicado: (2024)
ESAinsTOD: A Unified End-to-End Schema-Aware Instruction-Tuning Framework for Task-Oriented Dialog Modeling
por: Teng, Dechuan, et al.
Publicado: (2026)
por: Teng, Dechuan, et al.
Publicado: (2026)
Neuron-Aware Data Selection In Instruction Tuning For Large Language Models
por: Chen, Xin, et al.
Publicado: (2026)
por: Chen, Xin, et al.
Publicado: (2026)
ROSE: A Reward-Oriented Data Selection Framework for LLM Task-Specific Instruction Tuning
por: Wu, Yang, et al.
Publicado: (2024)
por: Wu, Yang, et al.
Publicado: (2024)
MIG: Automatic Data Selection for Instruction Tuning by Maximizing Information Gain in Semantic Space
por: Chen, Yicheng, et al.
Publicado: (2025)
por: Chen, Yicheng, et al.
Publicado: (2025)
Learning Towards Emergence: Paving the Way to Induce Emergence by Inhibiting Monosemantic Neurons on Pre-trained Models
por: Wang, Jiachuan, et al.
Publicado: (2025)
por: Wang, Jiachuan, et al.
Publicado: (2025)
Instruction Matters: A Simple yet Effective Task Selection for Optimized Instruction Tuning of Specific Tasks
por: Lee, Changho, et al.
Publicado: (2024)
por: Lee, Changho, et al.
Publicado: (2024)
Encourage or Inhibit Monosemanticity? Revisit Monosemanticity from a Feature Decorrelation Perspective
por: Yan, Hanqi, et al.
Publicado: (2024)
por: Yan, Hanqi, et al.
Publicado: (2024)
Beyond Interpretability: The Gains of Feature Monosemanticity on Model Robustness
por: Zhang, Qi, et al.
Publicado: (2024)
por: Zhang, Qi, et al.
Publicado: (2024)
Selective Reflection-Tuning: Student-Selected Data Recycling for LLM Instruction-Tuning
por: Li, Ming, et al.
Publicado: (2024)
por: Li, Ming, et al.
Publicado: (2024)
AHAMask: Reliable Task Specification for Large Audio Language Models without Instructions
por: Guo, Yiwei, et al.
Publicado: (2025)
por: Guo, Yiwei, et al.
Publicado: (2025)
ScalSelect: Scalable Training-Free Multimodal Data Selection for Efficient Visual Instruction Tuning
por: Wu, Changti, et al.
Publicado: (2026)
por: Wu, Changti, et al.
Publicado: (2026)
LangGPS: Language Separability Guided Data Pre-Selection for Joint Multilingual Instruction Tuning
por: Ye, Yangfan, et al.
Publicado: (2025)
por: Ye, Yangfan, et al.
Publicado: (2025)
Measuring and Guiding Monosemanticity
por: Härle, Ruben, et al.
Publicado: (2025)
por: Härle, Ruben, et al.
Publicado: (2025)
LESS: Selecting Influential Data for Targeted Instruction Tuning
por: Xia, Mengzhou, et al.
Publicado: (2024)
por: Xia, Mengzhou, et al.
Publicado: (2024)
SED-SFT: Selectively Encouraging Diversity in Supervised Fine-Tuning
por: Chen, Yijie, et al.
Publicado: (2026)
por: Chen, Yijie, et al.
Publicado: (2026)
NeuroAda: Activating Each Neuron's Potential for Parameter-Efficient Fine-Tuning
por: Zhang, Zhi, et al.
Publicado: (2025)
por: Zhang, Zhi, et al.
Publicado: (2025)
GIST: Targeted Data Selection for Instruction Tuning via Coupled Optimization Geometry
por: Min, Guanghui, et al.
Publicado: (2026)
por: Min, Guanghui, et al.
Publicado: (2026)
Compressing KV Cache for Long-Context LLM Inference with Inter-Layer Attention Similarity
por: Ma, Da, et al.
Publicado: (2024)
por: Ma, Da, et al.
Publicado: (2024)
Hint Tuning: Less Data Makes Better Reasoners
por: Fan, Siqi, et al.
Publicado: (2026)
por: Fan, Siqi, et al.
Publicado: (2026)
No One-Size-Fits-All Neurons: Task-based Neurons for Artificial Neural Networks
por: Fan, Feng-Lei, et al.
Publicado: (2024)
por: Fan, Feng-Lei, et al.
Publicado: (2024)
LEAD: Iterative Data Selection for Efficient LLM Instruction Tuning
por: Lin, Xiaotian, et al.
Publicado: (2025)
por: Lin, Xiaotian, et al.
Publicado: (2025)
CoTasks: Chain-of-Thought based Video Instruction Tuning Tasks
por: Wang, Yanan, et al.
Publicado: (2025)
por: Wang, Yanan, et al.
Publicado: (2025)
Monet: Mixture of Monosemantic Experts for Transformers
por: Park, Jungwoo, et al.
Publicado: (2024)
por: Park, Jungwoo, et al.
Publicado: (2024)
Evaluating Sparse Autoencoders for Monosemantic Representation
por: Fereidouni, Moghis, et al.
Publicado: (2025)
por: Fereidouni, Moghis, et al.
Publicado: (2025)
Uncertainty-Aware Gradient Signal-to-Noise Data Selection for Instruction Tuning
por: Yuan, Zhihang, et al.
Publicado: (2026)
por: Yuan, Zhihang, et al.
Publicado: (2026)
ProDS: Preference-oriented Data Selection for Instruction Tuning
por: Guo, Wenya, et al.
Publicado: (2025)
por: Guo, Wenya, et al.
Publicado: (2025)
X2Edit: Revisiting Arbitrary-Instruction Image Editing through Self-Constructed Data and Task-Aware Representation Learning
por: Ma, Jian, et al.
Publicado: (2025)
por: Ma, Jian, et al.
Publicado: (2025)
What are the Essential Factors in Crafting Effective Long Context Multi-Hop Instruction Datasets? Insights and Best Practices
por: Chen, Zhi, et al.
Publicado: (2024)
por: Chen, Zhi, et al.
Publicado: (2024)
Large-Scale Data Selection for Instruction Tuning
por: Ivison, Hamish, et al.
Publicado: (2025)
por: Ivison, Hamish, et al.
Publicado: (2025)
Beyond Similarity: A Gradient-based Graph Method for Instruction Tuning Data Selection
por: Zhao, Yang, et al.
Publicado: (2025)
por: Zhao, Yang, et al.
Publicado: (2025)
Visual Instruction Tuning with Chain of Region-of-Interest
por: Chen, Yixin, et al.
Publicado: (2025)
por: Chen, Yixin, et al.
Publicado: (2025)
NeuronSeek: On Stability and Expressivity of Task-driven Neurons
por: Pei, Hanyu, et al.
Publicado: (2025)
por: Pei, Hanyu, et al.
Publicado: (2025)
T-SHIRT: Token-Selective Hierarchical Data Selection for Instruction Tuning
por: Fu, Yanjun, et al.
Publicado: (2025)
por: Fu, Yanjun, et al.
Publicado: (2025)
Target-Oriented Pretraining Data Selection via Neuron-Activated Graph
por: Wang, Zijun, et al.
Publicado: (2026)
por: Wang, Zijun, et al.
Publicado: (2026)
Instruction Mining: Instruction Data Selection for Tuning Large Language Models
por: Cao, Yihan, et al.
Publicado: (2023)
por: Cao, Yihan, et al.
Publicado: (2023)
IterSelectTune: An Iterative Training Framework for Efficient Instruction-Tuning Data Selection
por: Song, Jielin, et al.
Publicado: (2024)
por: Song, Jielin, et al.
Publicado: (2024)
ReqBrain: Task-Specific Instruction Tuning of LLMs for AI-Assisted Requirements Generation
por: Habib, Mohammad Kasra, et al.
Publicado: (2025)
por: Habib, Mohammad Kasra, et al.
Publicado: (2025)
Parrot: Multilingual Visual Instruction Tuning
por: Sun, Hai-Long, et al.
Publicado: (2024)
por: Sun, Hai-Long, et al.
Publicado: (2024)
Ejemplares similares
-
Learning from Emergence: A Study on Proactively Inhibiting the Monosemantic Neurons of Artificial Neural Networks
por: Wang, Jiachuan, et al.
Publicado: (2023) -
TAGCOS: Task-agnostic Gradient Clustered Coreset Selection for Instruction Tuning Data
por: Zhang, Jipeng, et al.
Publicado: (2024) -
ESAinsTOD: A Unified End-to-End Schema-Aware Instruction-Tuning Framework for Task-Oriented Dialog Modeling
por: Teng, Dechuan, et al.
Publicado: (2026) -
Neuron-Aware Data Selection In Instruction Tuning For Large Language Models
por: Chen, Xin, et al.
Publicado: (2026) -
ROSE: A Reward-Oriented Data Selection Framework for LLM Task-Specific Instruction Tuning
por: Wu, Yang, et al.
Publicado: (2024)