Guardado en:
| Autores principales: | Guo, Wenya, Zhang, Zhengkun, Liu, Xumeng, Zhang, Ying, Lu, Ziyu, Zhu, Haoze, Liu, Xubo, Yan, Ruxue |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | https://arxiv.org/abs/2505.12754 |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
From "What" to "How": Constrained Reasoning for Autoregressive Image Generation
por: Yan, Ruxue, et al.
Publicado: (2026)
por: Yan, Ruxue, et al.
Publicado: (2026)
D3: Diversity, Difficulty, and Dependability-Aware Data Selection for Sample-Efficient LLM Instruction Tuning
por: Zhang, Jia, et al.
Publicado: (2025)
por: Zhang, Jia, et al.
Publicado: (2025)
On Representation Redundancy in Large-Scale Instruction Tuning Data Selection
por: Shu, Youwei, et al.
Publicado: (2026)
por: Shu, Youwei, et al.
Publicado: (2026)
Selective Prompting Tuning for Personalized Conversations with LLMs
por: Huang, Qiushi, et al.
Publicado: (2024)
por: Huang, Qiushi, et al.
Publicado: (2024)
Data Selection for LLM Alignment Using Fine-Grained Preferences
por: Zhang, Jia, et al.
Publicado: (2025)
por: Zhang, Jia, et al.
Publicado: (2025)
Federated Continual Instruction Tuning
por: Guo, Haiyang, et al.
Publicado: (2025)
por: Guo, Haiyang, et al.
Publicado: (2025)
SelectIT: Selective Instruction Tuning for LLMs via Uncertainty-Aware Self-Reflection
por: Liu, Liangxin, et al.
Publicado: (2024)
por: Liu, Liangxin, et al.
Publicado: (2024)
PRISM: Preference-Aware Influence Function Based Data Selection Method for Efficient Fine-Tuning
por: Lin, Qihao, et al.
Publicado: (2026)
por: Lin, Qihao, et al.
Publicado: (2026)
Cross-Fusion Distance: A Novel Metric for Measuring Fusion and Separability Between Data Groups in Representation Space
por: Zhang, Xiaolong, et al.
Publicado: (2026)
por: Zhang, Xiaolong, et al.
Publicado: (2026)
LEAD: Iterative Data Selection for Efficient LLM Instruction Tuning
por: Lin, Xiaotian, et al.
Publicado: (2025)
por: Lin, Xiaotian, et al.
Publicado: (2025)
TAGCOS: Task-agnostic Gradient Clustered Coreset Selection for Instruction Tuning Data
por: Zhang, Jipeng, et al.
Publicado: (2024)
por: Zhang, Jipeng, et al.
Publicado: (2024)
Task-Specific Data Selection for Instruction Tuning via Monosemantic Neuronal Activations
por: Ma, Da, et al.
Publicado: (2025)
por: Ma, Da, et al.
Publicado: (2025)
T-SHIRT: Token-Selective Hierarchical Data Selection for Instruction Tuning
por: Fu, Yanjun, et al.
Publicado: (2025)
por: Fu, Yanjun, et al.
Publicado: (2025)
ROSE: A Reward-Oriented Data Selection Framework for LLM Task-Specific Instruction Tuning
por: Wu, Yang, et al.
Publicado: (2024)
por: Wu, Yang, et al.
Publicado: (2024)
Selective Reflection-Tuning: Student-Selected Data Recycling for LLM Instruction-Tuning
por: Li, Ming, et al.
Publicado: (2024)
por: Li, Ming, et al.
Publicado: (2024)
Federated Learning of Dynamic Bayesian Network via Continuous Optimization from Time Series Data
por: Chen, Jianhong, et al.
Publicado: (2024)
por: Chen, Jianhong, et al.
Publicado: (2024)
Instruction Mining: Instruction Data Selection for Tuning Large Language Models
por: Cao, Yihan, et al.
Publicado: (2023)
por: Cao, Yihan, et al.
Publicado: (2023)
LESS: Selecting Influential Data for Targeted Instruction Tuning
por: Xia, Mengzhou, et al.
Publicado: (2024)
por: Xia, Mengzhou, et al.
Publicado: (2024)
Diversity Measurement and Subset Selection for Instruction Tuning Datasets
por: Wang, Peiqi, et al.
Publicado: (2024)
por: Wang, Peiqi, et al.
Publicado: (2024)
InfinityMATH: A Scalable Instruction Tuning Dataset in Programmatic Mathematical Reasoning
por: Zhang, Bo-Wen, et al.
Publicado: (2024)
por: Zhang, Bo-Wen, et al.
Publicado: (2024)
What Makes Good Data for Alignment? A Comprehensive Study of Automatic Data Selection in Instruction Tuning
por: Liu, Wei, et al.
Publicado: (2023)
por: Liu, Wei, et al.
Publicado: (2023)
Harnessing LLMs Explanations to Boost Surrogate Models in Tabular Data Classification
por: Shi, Ruxue, et al.
Publicado: (2025)
por: Shi, Ruxue, et al.
Publicado: (2025)
Deep Learning-based Anomaly Detection and Log Analysis for Computer Networks
por: Wang, Shuzhan, et al.
Publicado: (2024)
por: Wang, Shuzhan, et al.
Publicado: (2024)
The Best Instruction-Tuning Data are Those That Fit
por: Zhang, Dylan, et al.
Publicado: (2025)
por: Zhang, Dylan, et al.
Publicado: (2025)
Data Diversity Matters for Robust Instruction Tuning
por: Bukharin, Alexander, et al.
Publicado: (2023)
por: Bukharin, Alexander, et al.
Publicado: (2023)
Destroy and Repair Using Hyper Graphs for Routing
por: Li, Ke, et al.
Publicado: (2025)
por: Li, Ke, et al.
Publicado: (2025)
Guidelines for Augmentation Selection in Contrastive Learning for Time Series Classification
por: Liu, Ziyu, et al.
Publicado: (2024)
por: Liu, Ziyu, et al.
Publicado: (2024)
RPO: Fine-Tuning Visual Generative Models via Rich Vision-Language Preferences
por: Zhao, Hanyang, et al.
Publicado: (2025)
por: Zhao, Hanyang, et al.
Publicado: (2025)
OPTune: Efficient Online Preference Tuning
por: Chen, Lichang, et al.
Publicado: (2024)
por: Chen, Lichang, et al.
Publicado: (2024)
Feature Matching Intervention: Leveraging Observational Data for Causal Representation Learning
por: Li, Haoze, et al.
Publicado: (2025)
por: Li, Haoze, et al.
Publicado: (2025)
HiDe-LLaVA: Hierarchical Decoupling for Continual Instruction Tuning of Multimodal Large Language Model
por: Guo, Haiyang, et al.
Publicado: (2025)
por: Guo, Haiyang, et al.
Publicado: (2025)
Improving Influence-based Instruction Tuning Data Selection for Balanced Learning of Diverse Capabilities
por: Dai, Qirun, et al.
Publicado: (2025)
por: Dai, Qirun, et al.
Publicado: (2025)
DS-Agent: Automated Data Science by Empowering Large Language Models with Case-Based Reasoning
por: Guo, Siyuan, et al.
Publicado: (2024)
por: Guo, Siyuan, et al.
Publicado: (2024)
3DS: Medical Domain Adaptation of LLMs via Decomposed Difficulty-based Data Selection
por: Ding, Hongxin, et al.
Publicado: (2024)
por: Ding, Hongxin, et al.
Publicado: (2024)
Uncertainty-Aware Gradient Signal-to-Noise Data Selection for Instruction Tuning
por: Yuan, Zhihang, et al.
Publicado: (2026)
por: Yuan, Zhihang, et al.
Publicado: (2026)
Dynamic Bayesian Optimization Framework for Instruction Tuning in Partial Differential Equation Discovery
por: Qu, Junqi, et al.
Publicado: (2025)
por: Qu, Junqi, et al.
Publicado: (2025)
Filter Images First, Generate Instructions Later: Pre-Instruction Data Selection for Visual Instruction Tuning
por: Safaei, Bardia, et al.
Publicado: (2025)
por: Safaei, Bardia, et al.
Publicado: (2025)
A Comprehensive Survey of Synthetic Tabular Data Generation
por: Shi, Ruxue, et al.
Publicado: (2025)
por: Shi, Ruxue, et al.
Publicado: (2025)
Adapt-$\infty$: Scalable Continual Multimodal Instruction Tuning via Dynamic Data Selection
por: Maharana, Adyasha, et al.
Publicado: (2024)
por: Maharana, Adyasha, et al.
Publicado: (2024)
Graph-Guided Concept Selection for Efficient Retrieval-Augmented Generation
por: Liu, Ziyu, et al.
Publicado: (2025)
por: Liu, Ziyu, et al.
Publicado: (2025)
Ejemplares similares
-
From "What" to "How": Constrained Reasoning for Autoregressive Image Generation
por: Yan, Ruxue, et al.
Publicado: (2026) -
D3: Diversity, Difficulty, and Dependability-Aware Data Selection for Sample-Efficient LLM Instruction Tuning
por: Zhang, Jia, et al.
Publicado: (2025) -
On Representation Redundancy in Large-Scale Instruction Tuning Data Selection
por: Shu, Youwei, et al.
Publicado: (2026) -
Selective Prompting Tuning for Personalized Conversations with LLMs
por: Huang, Qiushi, et al.
Publicado: (2024) -
Data Selection for LLM Alignment Using Fine-Grained Preferences
por: Zhang, Jia, et al.
Publicado: (2025)