Data Selection for Multi-turn Dialogue Instruction Tuning
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Li, Bo, Zhang, Shikun, Ye, Wei |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Improving Multi-turn Dialogue Consistency with Self-Recall Thinking
par: Pang, Renning, et autres
Publié: (2026)
par: Pang, Renning, et autres
Publié: (2026)
On the Multi-turn Instruction Following for Conversational Web Agents
par: Deng, Yang, et autres
Publié: (2024)
par: Deng, Yang, et autres
Publié: (2024)
MIG: Automatic Data Selection for Instruction Tuning by Maximizing Information Gain in Semantic Space
par: Chen, Yicheng, et autres
Publié: (2025)
par: Chen, Yicheng, et autres
Publié: (2025)
PandaLM: An Automatic Evaluation Benchmark for LLM Instruction Tuning Optimization
par: Wang, Yidong, et autres
Publié: (2023)
par: Wang, Yidong, et autres
Publié: (2023)
Instruction Data Selection via Answer Divergence
par: Li, Bo, et autres
Publié: (2026)
par: Li, Bo, et autres
Publié: (2026)
CPsyCoun: A Report-based Multi-turn Dialogue Reconstruction and Evaluation Framework for Chinese Psychological Counseling
par: Zhang, Chenhao, et autres
Publié: (2024)
par: Zhang, Chenhao, et autres
Publié: (2024)
Retrieval as Generation: A Unified Framework with Self-Triggered Information Planning
par: Li, Bo, et autres
Publié: (2026)
par: Li, Bo, et autres
Publié: (2026)
TextBind: Multi-turn Interleaved Multimodal Instruction-following in the Wild
par: Li, Huayang, et autres
Publié: (2023)
par: Li, Huayang, et autres
Publié: (2023)
Speak Out of Turn: Safety Vulnerability of Large Language Models in Multi-turn Dialogue
par: Zhou, Zhenhong, et autres
Publié: (2024)
par: Zhou, Zhenhong, et autres
Publié: (2024)
Selective Reflection-Tuning: Student-Selected Data Recycling for LLM Instruction-Tuning
par: Li, Ming, et autres
Publié: (2024)
par: Li, Ming, et autres
Publié: (2024)
A Survey on Recent Advances in LLM-Based Multi-turn Dialogue Systems
par: Yi, Zihao, et autres
Publié: (2024)
par: Yi, Zihao, et autres
Publié: (2024)
A State-Update Prompting Strategy for Efficient and Robust Multi-turn Dialogue
par: Liu, Ziyi
Publié: (2025)
par: Liu, Ziyi
Publié: (2025)
MARS-Bench: A Multi-turn Athletic Real-world Scenario Benchmark for Dialogue Evaluation
par: Yang, Chenghao, et autres
Publié: (2025)
par: Yang, Chenghao, et autres
Publié: (2025)
TACOS: Open Tagging and Comparative Scoring for Instruction Fine-Tuning Data Selection
par: He, Xixiang, et autres
Publié: (2025)
par: He, Xixiang, et autres
Publié: (2025)
Inductive-Deductive Strategy Reuse for Multi-Turn Instructional Dialogues
par: Ou, Jiao, et autres
Publié: (2024)
par: Ou, Jiao, et autres
Publié: (2024)
Select2Reason: Efficient Instruction-Tuning Data Selection for Long-CoT Reasoning
par: Yang, Cehao, et autres
Publié: (2025)
par: Yang, Cehao, et autres
Publié: (2025)
CrowdSelect: Synthetic Instruction Data Selection with Multi-LLM Wisdom
par: Li, Yisen, et autres
Publié: (2025)
par: Li, Yisen, et autres
Publié: (2025)
MemeCMD: An Automatically Generated Chinese Multi-turn Dialogue Dataset with Contextually Retrieved Memes
par: Wang, Yuheng, et autres
Publié: (2025)
par: Wang, Yuheng, et autres
Publié: (2025)
SEADialogues: A Multilingual Culturally Grounded Multi-turn Dialogue Dataset on Southeast Asian Languages
par: Kautsar, Muhammad Dehan Al, et autres
Publié: (2025)
par: Kautsar, Muhammad Dehan Al, et autres
Publié: (2025)
Instruction Mining: Instruction Data Selection for Tuning Large Language Models
par: Cao, Yihan, et autres
Publié: (2023)
par: Cao, Yihan, et autres
Publié: (2023)
LESS: Selecting Influential Data for Targeted Instruction Tuning
par: Xia, Mengzhou, et autres
Publié: (2024)
par: Xia, Mengzhou, et autres
Publié: (2024)
Asymmetric Actor-Critic for Multi-turn LLM Agents
par: Jiang, Shuli, et autres
Publié: (2026)
par: Jiang, Shuli, et autres
Publié: (2026)
TAGCOS: Task-agnostic Gradient Clustered Coreset Selection for Instruction Tuning Data
par: Zhang, Jipeng, et autres
Publié: (2024)
par: Zhang, Jipeng, et autres
Publié: (2024)
Not All Documents Are What You Need for Extracting Instruction Tuning Data
par: Zhang, Chi, et autres
Publié: (2025)
par: Zhang, Chi, et autres
Publié: (2025)
Evaluating & Reducing Deceptive Dialogue From Language Models with Multi-turn RL
par: Abdulhai, Marwa, et autres
Publié: (2025)
par: Abdulhai, Marwa, et autres
Publié: (2025)
ROSE: A Reward-Oriented Data Selection Framework for LLM Task-Specific Instruction Tuning
par: Wu, Yang, et autres
Publié: (2024)
par: Wu, Yang, et autres
Publié: (2024)
Position Debiasing Fine-Tuning for Causal Perception in Long-Term Dialogue
par: Fan, Shixuan, et autres
Publié: (2024)
par: Fan, Shixuan, et autres
Publié: (2024)
What Makes Good Data for Alignment? A Comprehensive Study of Automatic Data Selection in Instruction Tuning
par: Liu, Wei, et autres
Publié: (2023)
par: Liu, Wei, et autres
Publié: (2023)
Beyond Single-shot Writing: Deep Research Agents are Unreliable at Multi-turn Report Revision
par: Chen, Bingsen, et autres
Publié: (2026)
par: Chen, Bingsen, et autres
Publié: (2026)
Unveiling the Impact of Coding Data Instruction Fine-Tuning on Large Language Models Reasoning
par: Zhang, Xinlu, et autres
Publié: (2024)
par: Zhang, Xinlu, et autres
Publié: (2024)
Raw Text is All you Need: Knowledge-intensive Multi-turn Instruction Tuning for Large Language Model
par: Hou, Xia, et autres
Publié: (2024)
par: Hou, Xia, et autres
Publié: (2024)
Uncertainty-Aware Gradient Signal-to-Noise Data Selection for Instruction Tuning
par: Yuan, Zhihang, et autres
Publié: (2026)
par: Yuan, Zhihang, et autres
Publié: (2026)
Investigating Instruction Tuning Large Language Models on Graphs
par: Zhu, Kerui, et autres
Publié: (2024)
par: Zhu, Kerui, et autres
Publié: (2024)
SelectIT: Selective Instruction Tuning for LLMs via Uncertainty-Aware Self-Reflection
par: Liu, Liangxin, et autres
Publié: (2024)
par: Liu, Liangxin, et autres
Publié: (2024)
Personalized Topic Selection Model for Topic-Grounded Dialogue
par: Fan, Shixuan, et autres
Publié: (2024)
par: Fan, Shixuan, et autres
Publié: (2024)
M2S: Multi-turn to Single-turn jailbreak in Red Teaming for LLMs
par: Ha, Junwoo, et autres
Publié: (2025)
par: Ha, Junwoo, et autres
Publié: (2025)
Call for Rigor in Reporting Quality of Instruction Tuning Data
par: Moon, Hyeonseok, et autres
Publié: (2025)
par: Moon, Hyeonseok, et autres
Publié: (2025)
The Best Instruction-Tuning Data are Those That Fit
par: Zhang, Dylan, et autres
Publié: (2025)
par: Zhang, Dylan, et autres
Publié: (2025)
CrisisSense-LLM: Instruction Fine-Tuned Large Language Model for Multi-label Social Media Text Classification in Disaster Informatics
par: Yin, Kai, et autres
Publié: (2024)
par: Yin, Kai, et autres
Publié: (2024)
Instruct Once, Chat Consistently in Multiple Rounds: An Efficient Tuning Framework for Dialogue
par: Wang, Jian, et autres
Publié: (2024)
par: Wang, Jian, et autres
Publié: (2024)
Documents similaires
-
Improving Multi-turn Dialogue Consistency with Self-Recall Thinking
par: Pang, Renning, et autres
Publié: (2026) -
On the Multi-turn Instruction Following for Conversational Web Agents
par: Deng, Yang, et autres
Publié: (2024) -
MIG: Automatic Data Selection for Instruction Tuning by Maximizing Information Gain in Semantic Space
par: Chen, Yicheng, et autres
Publié: (2025) -
PandaLM: An Automatic Evaluation Benchmark for LLM Instruction Tuning Optimization
par: Wang, Yidong, et autres
Publié: (2023) -
Instruction Data Selection via Answer Divergence
par: Li, Bo, et autres
Publié: (2026)