ClarifyMT-Bench: Benchmarking and Improving Multi-Turn Clarification for Conversational Large Language Models
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Luo, Sichun, Huang, Yi, Li, Mukai, Meng, Shichang, Liu, Fengyuan, Hu, Zefa, Feng, Junlan, Liu, Qi |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Clarifying the Path to User Satisfaction: An Investigation into Clarification Usefulness
par: Rahmani, Hossein A., et autres
Publié: (2024)
par: Rahmani, Hossein A., et autres
Publié: (2024)
Multi-Turn Multi-Modal Question Clarification for Enhanced Conversational Understanding
par: Ramezan, Kimia, et autres
Publié: (2025)
par: Ramezan, Kimia, et autres
Publié: (2025)
Clarifying Ambiguities: on the Role of Ambiguity Types in Prompting Methods for Clarification Generation
par: Tang, Anfu, et autres
Publié: (2025)
par: Tang, Anfu, et autres
Publié: (2025)
Cognitive Alpha Mining via LLM-Driven Code-Based Evolution
par: Liu, Fengyuan, et autres
Publié: (2025)
par: Liu, Fengyuan, et autres
Publié: (2025)
LexRAG: Benchmarking Retrieval-Augmented Generation in Multi-Turn Legal Consultation Conversation
par: Li, Haitao, et autres
Publié: (2025)
par: Li, Haitao, et autres
Publié: (2025)
SeaEvo: Advancing Algorithm Discovery with Strategy Space Evolution
par: Luo, Sichun, et autres
Publié: (2026)
par: Luo, Sichun, et autres
Publié: (2026)
ProductAgent: Benchmarking Conversational Product Search Agent with Asking Clarification Questions
par: Ye, Jingheng, et autres
Publié: (2024)
par: Ye, Jingheng, et autres
Publié: (2024)
RALLRec: Improving Retrieval Augmented Large Language Model Recommendation with Representation Learning
par: Xu, Jian, et autres
Publié: (2025)
par: Xu, Jian, et autres
Publié: (2025)
RAC: Retrieval-Augmented Clarification for Faithful Conversational Search
par: Kebir, Ahmed Rayane, et autres
Publié: (2026)
par: Kebir, Ahmed Rayane, et autres
Publié: (2026)
Proactive Guidance of Multi-Turn Conversation in Industrial Search
par: Li, Xiaoyu, et autres
Publié: (2025)
par: Li, Xiaoyu, et autres
Publié: (2025)
RALLRec+: Retrieval Augmented Large Language Model Recommendation with Reasoning
par: Luo, Sichun, et autres
Publié: (2025)
par: Luo, Sichun, et autres
Publié: (2025)
Estimating the Usefulness of Clarifying Questions and Answers for Conversational Search
par: Sekulić, Ivan, et autres
Publié: (2024)
par: Sekulić, Ivan, et autres
Publié: (2024)
Do Images Clarify? A Study on the Effect of Images on Clarifying Questions in Conversational Search
par: Siro, Clemencia, et autres
Publié: (2026)
par: Siro, Clemencia, et autres
Publié: (2026)
Zero-Shot and Efficient Clarification Need Prediction in Conversational Search
par: Lu, Lili, et autres
Publié: (2025)
par: Lu, Lili, et autres
Publié: (2025)
The 3rd Place Solution of CCIR CUP 2025: A Framework for Retrieval-Augmented Generation in Multi-Turn Legal Conversation
par: Li, Da, et autres
Publié: (2025)
par: Li, Da, et autres
Publié: (2025)
Turning Semantics into Topology: LLM-Driven Attribute Augmentation for Collaborative Filtering
par: Meng, Junjie, et autres
Publié: (2026)
par: Meng, Junjie, et autres
Publié: (2026)
Online and Offline Evaluation in Search Clarification
par: Tavakoli, Leila, et autres
Publié: (2024)
par: Tavakoli, Leila, et autres
Publié: (2024)
RecRM-Bench: Benchmarking Multidimensional Reward Modeling for Agentic Recommender Systems
par: Zeng, Wenwen, et autres
Publié: (2026)
par: Zeng, Wenwen, et autres
Publié: (2026)
User Simulator-Guided Multi-Turn Preference Optimization for Reasoning LLM-based Conversational Recommendation
par: Xiang, Xingyuan, et autres
Publié: (2026)
par: Xiang, Xingyuan, et autres
Publié: (2026)
Improving the Reusability of Conversational Search Test Collections
par: Abbasiantaeb, Zahra, et autres
Publié: (2025)
par: Abbasiantaeb, Zahra, et autres
Publié: (2025)
FloodSQL-Bench: A Retrieval-Augmented Benchmark for Geospatially-Grounded Text-to-SQL
par: Liu, Hanzhou, et autres
Publié: (2025)
par: Liu, Hanzhou, et autres
Publié: (2025)
AGENT-CQ: Automatic Generation and Evaluation of Clarifying Questions for Conversational Search with LLMs
par: Siro, Clemencia, et autres
Publié: (2024)
par: Siro, Clemencia, et autres
Publié: (2024)
Jamendo-MT-QA: A Benchmark for Multi-Track Comparative Music Question Answering
par: Koh, Junyoung, et autres
Publié: (2026)
par: Koh, Junyoung, et autres
Publié: (2026)
RECOR: Reasoning-focused Multi-turn Conversational Retrieval Benchmark
par: Ali, Mohammed, et autres
Publié: (2026)
par: Ali, Mohammed, et autres
Publié: (2026)
RecRanker: Instruction Tuning Large Language Model as Ranker for Top-k Recommendation
par: Luo, Sichun, et autres
Publié: (2023)
par: Luo, Sichun, et autres
Publié: (2023)
Analyzing Coherency in Facet-based Clarification Prompt Generation for Search
par: Litvinov, Oleg, et autres
Publié: (2024)
par: Litvinov, Oleg, et autres
Publié: (2024)
Corpus-informed Retrieval Augmented Generation of Clarifying Questions
par: Krasakis, Antonios Minas, et autres
Publié: (2024)
par: Krasakis, Antonios Minas, et autres
Publié: (2024)
Sensitivity-Aware Retrieval-Augmented Intent Clarification
par: Larooij, Maik
Publié: (2026)
par: Larooij, Maik
Publié: (2026)
AIR-Bench: Automated Heterogeneous Information Retrieval Benchmark
par: Chen, Jianlyu, et autres
Publié: (2024)
par: Chen, Jianlyu, et autres
Publié: (2024)
MCiteBench: A Multimodal Benchmark for Generating Text with Citations
par: Hu, Caiyu, et autres
Publié: (2025)
par: Hu, Caiyu, et autres
Publié: (2025)
User Long-Term Multi-Interest Retrieval Model for Recommendation
par: Meng, Yue, et autres
Publié: (2025)
par: Meng, Yue, et autres
Publié: (2025)
CORAL: Benchmarking Multi-turn Conversational Retrieval-Augmentation Generation
par: Cheng, Yiruo, et autres
Publié: (2024)
par: Cheng, Yiruo, et autres
Publié: (2024)
LARA: Linguistic-Adaptive Retrieval-Augmentation for Multi-Turn Intent Classification
par: Liu, Junhua, et autres
Publié: (2024)
par: Liu, Junhua, et autres
Publié: (2024)
FAB-Bench: A Framework for Adaptive RAG Benchmarking in Semiconductor Manufacturing
par: Qian, Jingbin, et autres
Publié: (2026)
par: Qian, Jingbin, et autres
Publié: (2026)
Integrating Large Language Models into Recommendation via Mutual Augmentation and Adaptive Aggregation
par: Luo, Sichun, et autres
Publié: (2024)
par: Luo, Sichun, et autres
Publié: (2024)
RAGRouter-Bench: A Dataset and Benchmark for Adaptive RAG Routing
par: Wang, Ziqi, et autres
Publié: (2026)
par: Wang, Ziqi, et autres
Publié: (2026)
Can LLM Substitute Human Labeling? A Case Study of Fine-grained Chinese Address Entity Recognition Dataset for UAV Delivery
par: Yao, Yuxuan, et autres
Publié: (2024)
par: Yao, Yuxuan, et autres
Publié: (2024)
H-RAG at SemEval-2026 Task 8: Hierarchical Parent-Child Retrieval for Multi-Turn RAG Conversations
par: Elchafei, Passant, et autres
Publié: (2026)
par: Elchafei, Passant, et autres
Publié: (2026)
UniConv: Unifying Retrieval and Response Generation for Large Language Models in Conversations
par: Mo, Fengran, et autres
Publié: (2025)
par: Mo, Fengran, et autres
Publié: (2025)
Improving Multi-modal Recommender Systems by Denoising and Aligning Multi-modal Content and User Feedback
par: Xv, Guipeng, et autres
Publié: (2024)
par: Xv, Guipeng, et autres
Publié: (2024)
Documents similaires
-
Clarifying the Path to User Satisfaction: An Investigation into Clarification Usefulness
par: Rahmani, Hossein A., et autres
Publié: (2024) -
Multi-Turn Multi-Modal Question Clarification for Enhanced Conversational Understanding
par: Ramezan, Kimia, et autres
Publié: (2025) -
Clarifying Ambiguities: on the Role of Ambiguity Types in Prompting Methods for Clarification Generation
par: Tang, Anfu, et autres
Publié: (2025) -
Cognitive Alpha Mining via LLM-Driven Code-Based Evolution
par: Liu, Fengyuan, et autres
Publié: (2025) -
LexRAG: Benchmarking Retrieval-Augmented Generation in Multi-Turn Legal Consultation Conversation
par: Li, Haitao, et autres
Publié: (2025)