Instruction Data Selection via Answer Divergence
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Li, Bo, Wang, Mingda, Zhang, Shikun, Ye, Wei |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2026
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Data Selection for Multi-turn Dialogue Instruction Tuning
von: Li, Bo, et al.
Veröffentlicht: (2026)
von: Li, Bo, et al.
Veröffentlicht: (2026)
Retrieval as Generation: A Unified Framework with Self-Triggered Information Planning
von: Li, Bo, et al.
Veröffentlicht: (2026)
von: Li, Bo, et al.
Veröffentlicht: (2026)
SG-Bench: Evaluating LLM Safety Generalization Across Diverse Tasks and Prompt Types
von: Mou, Yutao, et al.
Veröffentlicht: (2024)
von: Mou, Yutao, et al.
Veröffentlicht: (2024)
Answer is All You Need: Instruction-following Text Embedding via Answering the Question
von: Peng, Letian, et al.
Veröffentlicht: (2024)
von: Peng, Letian, et al.
Veröffentlicht: (2024)
Modeling Uncertainty Trends for Timely Retrieval in Dynamic RAG
von: Li, Bo, et al.
Veröffentlicht: (2025)
von: Li, Bo, et al.
Veröffentlicht: (2025)
SteerRM: Debiasing Reward Models via Sparse Autoencoders
von: Sun, Mengyuan, et al.
Veröffentlicht: (2026)
von: Sun, Mengyuan, et al.
Veröffentlicht: (2026)
Large-Scale Data Selection for Instruction Tuning
von: Ivison, Hamish, et al.
Veröffentlicht: (2025)
von: Ivison, Hamish, et al.
Veröffentlicht: (2025)
MPL: Multiple Programming Languages with Large Language Models for Information Extraction
von: Li, Bo, et al.
Veröffentlicht: (2025)
von: Li, Bo, et al.
Veröffentlicht: (2025)
SaRO: Enhancing LLM Safety through Reasoning-based Alignment
von: Mou, Yutao, et al.
Veröffentlicht: (2025)
von: Mou, Yutao, et al.
Veröffentlicht: (2025)
A Survey on Data Selection for LLM Instruction Tuning
von: Zhang, Bolin, et al.
Veröffentlicht: (2024)
von: Zhang, Bolin, et al.
Veröffentlicht: (2024)
Policy-driven Knowledge Selection and Response Generation for Document-grounded Dialogue
von: Ma, Longxuan, et al.
Veröffentlicht: (2024)
von: Ma, Longxuan, et al.
Veröffentlicht: (2024)
Importance-Aware Data Selection for Efficient LLM Instruction Tuning
von: Jiang, Tingyu, et al.
Veröffentlicht: (2025)
von: Jiang, Tingyu, et al.
Veröffentlicht: (2025)
"My Answer is C": First-Token Probabilities Do Not Match Text Answers in Instruction-Tuned Language Models
von: Wang, Xinpeng, et al.
Veröffentlicht: (2024)
von: Wang, Xinpeng, et al.
Veröffentlicht: (2024)
SampleMix: A Sample-wise Pre-training Data Mixing Strategey by Coordinating Data Quality and Diversity
von: Xi, Xiangyu, et al.
Veröffentlicht: (2025)
von: Xi, Xiangyu, et al.
Veröffentlicht: (2025)
ToolSafe: Enhancing Tool Invocation Safety of LLM-based agents via Proactive Step-level Guardrail and Feedback
von: Mou, Yutao, et al.
Veröffentlicht: (2026)
von: Mou, Yutao, et al.
Veröffentlicht: (2026)
Exploiting Pseudo Image Captions for Multimodal Summarization
von: Jiang, Chaoya, et al.
Veröffentlicht: (2023)
von: Jiang, Chaoya, et al.
Veröffentlicht: (2023)
Can You Really Trust Code Copilots? Evaluating Large Language Models from a Code Security Perspective
von: Mou, Yutao, et al.
Veröffentlicht: (2025)
von: Mou, Yutao, et al.
Veröffentlicht: (2025)
Decoupling Safety into Orthogonal Subspace: Cost-Efficient and Performance-Preserving Alignment for Large Language Models
von: Mou, Yutao, et al.
Veröffentlicht: (2025)
von: Mou, Yutao, et al.
Veröffentlicht: (2025)
ClimateChat: Designing Data and Methods for Instruction Tuning LLMs to Answer Climate Change Queries
von: Chen, Zhou, et al.
Veröffentlicht: (2025)
von: Chen, Zhou, et al.
Veröffentlicht: (2025)
Datasets for Multilingual Answer Sentence Selection
von: Gabburo, Matteo, et al.
Veröffentlicht: (2024)
von: Gabburo, Matteo, et al.
Veröffentlicht: (2024)
LLaVA-Video: Video Instruction Tuning With Synthetic Data
von: Zhang, Yuanhan, et al.
Veröffentlicht: (2024)
von: Zhang, Yuanhan, et al.
Veröffentlicht: (2024)
PandaLM: An Automatic Evaluation Benchmark for LLM Instruction Tuning Optimization
von: Wang, Yidong, et al.
Veröffentlicht: (2023)
von: Wang, Yidong, et al.
Veröffentlicht: (2023)
From Quantity to Quality: Boosting LLM Performance with Self-Guided Data Selection for Instruction Tuning
von: Li, Ming, et al.
Veröffentlicht: (2023)
von: Li, Ming, et al.
Veröffentlicht: (2023)
MIG: Automatic Data Selection for Instruction Tuning by Maximizing Information Gain in Semantic Space
von: Chen, Yicheng, et al.
Veröffentlicht: (2025)
von: Chen, Yicheng, et al.
Veröffentlicht: (2025)
ZPD Detector: Data Selection via Capability-Difficulty Alignment for Large Language Models
von: Yang, Bo, et al.
Veröffentlicht: (2026)
von: Yang, Bo, et al.
Veröffentlicht: (2026)
Self-Judge: Selective Instruction Following with Alignment Self-Evaluation
von: Ye, Hai, et al.
Veröffentlicht: (2024)
von: Ye, Hai, et al.
Veröffentlicht: (2024)
WildLong: Synthesizing Realistic Long-Context Instruction Data at Scale
von: Li, Jiaxi, et al.
Veröffentlicht: (2025)
von: Li, Jiaxi, et al.
Veröffentlicht: (2025)
Two-Stage Quranic QA via Ensemble Retrieval and Instruction-Tuned Answer Extraction
von: Basem, Mohamed, et al.
Veröffentlicht: (2025)
von: Basem, Mohamed, et al.
Veröffentlicht: (2025)
Learn to Select: Exploring Label Distribution Divergence for In-Context Demonstration Selection in Text Classification
von: Jiang, Ye, et al.
Veröffentlicht: (2025)
von: Jiang, Ye, et al.
Veröffentlicht: (2025)
xVerify: Efficient Answer Verifier for Reasoning Model Evaluations
von: Chen, Ding, et al.
Veröffentlicht: (2025)
von: Chen, Ding, et al.
Veröffentlicht: (2025)
Infinity Instruct: Scaling Instruction Selection and Synthesis to Enhance Language Models
von: Li, Jijie, et al.
Veröffentlicht: (2025)
von: Li, Jijie, et al.
Veröffentlicht: (2025)
Data Selection via Optimal Control for Language Models
von: Gu, Yuxian, et al.
Veröffentlicht: (2024)
von: Gu, Yuxian, et al.
Veröffentlicht: (2024)
Resolving Knowledge Conflicts in Domain-specific Data Selection: A Case Study on Medical Instruction-tuning
von: Zhong, Qihuang, et al.
Veröffentlicht: (2025)
von: Zhong, Qihuang, et al.
Veröffentlicht: (2025)
CrowdSelect: Synthetic Instruction Data Selection with Multi-LLM Wisdom
von: Li, Yisen, et al.
Veröffentlicht: (2025)
von: Li, Yisen, et al.
Veröffentlicht: (2025)
Kun: Answer Polishment for Chinese Self-Alignment with Instruction Back-Translation
von: Zheng, Tianyu, et al.
Veröffentlicht: (2024)
von: Zheng, Tianyu, et al.
Veröffentlicht: (2024)
Few-Shot Data Synthesis for Open Domain Multi-Hop Question Answering
von: Chen, Mingda, et al.
Veröffentlicht: (2023)
von: Chen, Mingda, et al.
Veröffentlicht: (2023)
Instruction-Tuning Data Synthesis from Scratch via Web Reconstruction
von: Jiang, Yuxin, et al.
Veröffentlicht: (2025)
von: Jiang, Yuxin, et al.
Veröffentlicht: (2025)
Beyond Similarity: A Gradient-based Graph Method for Instruction Tuning Data Selection
von: Zhao, Yang, et al.
Veröffentlicht: (2025)
von: Zhao, Yang, et al.
Veröffentlicht: (2025)
SelectIT: Selective Instruction Tuning for LLMs via Uncertainty-Aware Self-Reflection
von: Liu, Liangxin, et al.
Veröffentlicht: (2024)
von: Liu, Liangxin, et al.
Veröffentlicht: (2024)
Instruction Mining: Instruction Data Selection for Tuning Large Language Models
von: Cao, Yihan, et al.
Veröffentlicht: (2023)
von: Cao, Yihan, et al.
Veröffentlicht: (2023)
Ähnliche Einträge
-
Data Selection for Multi-turn Dialogue Instruction Tuning
von: Li, Bo, et al.
Veröffentlicht: (2026) -
Retrieval as Generation: A Unified Framework with Self-Triggered Information Planning
von: Li, Bo, et al.
Veröffentlicht: (2026) -
SG-Bench: Evaluating LLM Safety Generalization Across Diverse Tasks and Prompt Types
von: Mou, Yutao, et al.
Veröffentlicht: (2024) -
Answer is All You Need: Instruction-following Text Embedding via Answering the Question
von: Peng, Letian, et al.
Veröffentlicht: (2024) -
Modeling Uncertainty Trends for Timely Retrieval in Dynamic RAG
von: Li, Bo, et al.
Veröffentlicht: (2025)