Salvato in:
| Autori principali: | Mao, Manqing, Ting, Paishun, Xiang, Yijian, Xu, Mingyang, Chen, Julia, Lin, Jianzhe |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | https://arxiv.org/abs/2401.04883 |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
GroupGPT: A Token-efficient and Privacy-preserving Agentic Framework for Multi-User Chat Assistant
di: Shen, Zhuokang, et al.
Pubblicazione: (2026)
di: Shen, Zhuokang, et al.
Pubblicazione: (2026)
User-Assistant Bias in LLMs
di: Pan, Xu, et al.
Pubblicazione: (2025)
di: Pan, Xu, et al.
Pubblicazione: (2025)
Learning How To Ask: Cycle-Consistency Refines Prompts in Multimodal Foundation Models
di: Diesendruck, Maurice, et al.
Pubblicazione: (2024)
di: Diesendruck, Maurice, et al.
Pubblicazione: (2024)
Facilitating Multi-turn Function Calling for LLMs via Compositional Instruction Tuning
di: Chen, Mingyang, et al.
Pubblicazione: (2024)
di: Chen, Mingyang, et al.
Pubblicazione: (2024)
Multi-trait User Simulation with Adaptive Decoding for Conversational Task Assistants
di: Ferreira, Rafael, et al.
Pubblicazione: (2024)
di: Ferreira, Rafael, et al.
Pubblicazione: (2024)
Humanlike Multi-user Agent (HUMA): Designing a Deceptively Human AI Facilitator for Group Chats
di: Jacniacki, Mateusz, et al.
Pubblicazione: (2025)
di: Jacniacki, Mateusz, et al.
Pubblicazione: (2025)
Can LLMs Infer Conversational Agent Users' Personality Traits from Chat History?
di: Cögendez, Derya, et al.
Pubblicazione: (2026)
di: Cögendez, Derya, et al.
Pubblicazione: (2026)
When Benchmarks Leak: Inference-Time Decontamination for LLMs
di: Chai, Jianzhe, et al.
Pubblicazione: (2026)
di: Chai, Jianzhe, et al.
Pubblicazione: (2026)
Conversational Assistants to support Heart Failure Patients: comparing a Neurosymbolic Architecture with ChatGPT
di: Tayal, Anuja, et al.
Pubblicazione: (2025)
di: Tayal, Anuja, et al.
Pubblicazione: (2025)
GRP: Goal-Reversed Prompting for Zero-Shot Evaluation with LLMs
di: Song, Mingyang, et al.
Pubblicazione: (2025)
di: Song, Mingyang, et al.
Pubblicazione: (2025)
MAC: A Multi-Agent Framework for Interactive User Clarification in Multi-turn Conversations
di: Acikgoz, Emre Can, et al.
Pubblicazione: (2025)
di: Acikgoz, Emre Can, et al.
Pubblicazione: (2025)
Synthetic Users, Real Differences: an Evaluation Framework for User Simulation in Multi-Turn Conversations
di: Liu, Yu Lu, et al.
Pubblicazione: (2026)
di: Liu, Yu Lu, et al.
Pubblicazione: (2026)
Question Suggestion for Conversational Shopping Assistants Using Product Metadata
di: Vedula, Nikhita, et al.
Pubblicazione: (2024)
di: Vedula, Nikhita, et al.
Pubblicazione: (2024)
Think Globally, Group Locally: Evaluating LLMs Using Multi-Lingual Word Grouping Games
di: Guerra-Solano, César, et al.
Pubblicazione: (2025)
di: Guerra-Solano, César, et al.
Pubblicazione: (2025)
AgentGroupChat: An Interactive Group Chat Simulacra For Better Eliciting Emergent Behavior
di: Gu, Zhouhong, et al.
Pubblicazione: (2024)
di: Gu, Zhouhong, et al.
Pubblicazione: (2024)
SimulatorArena: Are User Simulators Reliable Proxies for Multi-Turn Evaluation of AI Assistants?
di: Dou, Yao, et al.
Pubblicazione: (2025)
di: Dou, Yao, et al.
Pubblicazione: (2025)
Can Many-Shot In-Context Learning Help LLMs as Evaluators? A Preliminary Empirical Study
di: Song, Mingyang, et al.
Pubblicazione: (2024)
di: Song, Mingyang, et al.
Pubblicazione: (2024)
RMTBench: Benchmarking LLMs Through Multi-Turn User-Centric Role-Playing
di: Xiang, Hao, et al.
Pubblicazione: (2025)
di: Xiang, Hao, et al.
Pubblicazione: (2025)
Detecting Ambiguities to Guide Query Rewrite for Robust Conversations in Enterprise AI Assistants
di: Tanjim, Md Mehrab, et al.
Pubblicazione: (2025)
di: Tanjim, Md Mehrab, et al.
Pubblicazione: (2025)
PRISM: Probability Reallocation with In-Span Masking for Knowledge-Sensitive Alignment
di: Xu, Chenning, et al.
Pubblicazione: (2026)
di: Xu, Chenning, et al.
Pubblicazione: (2026)
Beyond the Illusion of Consensus: From Surface Heuristics to Knowledge-Grounded Evaluation in LLM-as-a-Judge
di: Song, Mingyang, et al.
Pubblicazione: (2026)
di: Song, Mingyang, et al.
Pubblicazione: (2026)
Assessing Web Search Credibility and Response Groundedness in Chat Assistants
di: Vykopal, Ivan, et al.
Pubblicazione: (2025)
di: Vykopal, Ivan, et al.
Pubblicazione: (2025)
SafeChat: A Framework for Building Trustworthy Collaborative Assistants and a Case Study of its Usefulness
di: Srivastava, Biplav, et al.
Pubblicazione: (2025)
di: Srivastava, Biplav, et al.
Pubblicazione: (2025)
Counting-Stars: A Multi-evidence, Position-aware, and Scalable Benchmark for Evaluating Long-Context Large Language Models
di: Song, Mingyang, et al.
Pubblicazione: (2024)
di: Song, Mingyang, et al.
Pubblicazione: (2024)
BatchPrompt: Accomplish more with less
di: Lin, Jianzhe, et al.
Pubblicazione: (2023)
di: Lin, Jianzhe, et al.
Pubblicazione: (2023)
Exploring a New Competency Modeling Process with Large Language Models
di: Du, Silin, et al.
Pubblicazione: (2026)
di: Du, Silin, et al.
Pubblicazione: (2026)
FlowKV: Enhancing Multi-Turn Conversational Coherence in LLMs via Isolated Key-Value Cache Management
di: Liu, Xiang, et al.
Pubblicazione: (2025)
di: Liu, Xiang, et al.
Pubblicazione: (2025)
PRISM of Opinions: A Persona-Reasoned Multimodal Framework for User-centric Conversational Stance Detection
di: Wang, Bingbing, et al.
Pubblicazione: (2025)
di: Wang, Bingbing, et al.
Pubblicazione: (2025)
Model Merging in the Era of Large Language Models: Methods, Applications, and Future Directions
di: Song, Mingyang, et al.
Pubblicazione: (2026)
di: Song, Mingyang, et al.
Pubblicazione: (2026)
Walk Before You Run! Concise LLM Reasoning via Reinforcement Learning
di: Song, Mingyang, et al.
Pubblicazione: (2025)
di: Song, Mingyang, et al.
Pubblicazione: (2025)
A Survey of Query Optimization in Large Language Models
di: Song, Mingyang, et al.
Pubblicazione: (2024)
di: Song, Mingyang, et al.
Pubblicazione: (2024)
ChatRetriever: Adapting Large Language Models for Generalized and Robust Conversational Dense Retrieval
di: Mao, Kelong, et al.
Pubblicazione: (2024)
di: Mao, Kelong, et al.
Pubblicazione: (2024)
LLAMAPIE: Proactive In-Ear Conversation Assistants
di: Chen, Tuochao, et al.
Pubblicazione: (2025)
di: Chen, Tuochao, et al.
Pubblicazione: (2025)
Beware of Words: Evaluating the Lexical Diversity of Conversational LLMs using ChatGPT as Case Study
di: Martínez, Gonzalo, et al.
Pubblicazione: (2024)
di: Martínez, Gonzalo, et al.
Pubblicazione: (2024)
Prosa: Rubric-Based Evaluation of LLMs on Real User Chats in Brazilian Portuguese
di: Junior, Roseval Malaquias, et al.
Pubblicazione: (2026)
di: Junior, Roseval Malaquias, et al.
Pubblicazione: (2026)
Proactive Hearing Assistants that Isolate Egocentric Conversations
di: Hu, Guilin, et al.
Pubblicazione: (2025)
di: Hu, Guilin, et al.
Pubblicazione: (2025)
Note2Chat: Improving LLMs for Multi-Turn Clinical History Taking Using Medical Notes
di: Zhou, Yang, et al.
Pubblicazione: (2026)
di: Zhou, Yang, et al.
Pubblicazione: (2026)
ChatSOS: Vector Database Augmented Generative Question Answering Assistant in Safety Engineering
di: Tang, Haiyang, et al.
Pubblicazione: (2024)
di: Tang, Haiyang, et al.
Pubblicazione: (2024)
The MUCA Roma
ProPerSim: Developing Proactive and Personalized AI Assistants through User-Assistant Simulation
di: Kim, Jiho, et al.
Pubblicazione: (2025)
di: Kim, Jiho, et al.
Pubblicazione: (2025)
Documenti analoghi
-
GroupGPT: A Token-efficient and Privacy-preserving Agentic Framework for Multi-User Chat Assistant
di: Shen, Zhuokang, et al.
Pubblicazione: (2026) -
User-Assistant Bias in LLMs
di: Pan, Xu, et al.
Pubblicazione: (2025) -
Learning How To Ask: Cycle-Consistency Refines Prompts in Multimodal Foundation Models
di: Diesendruck, Maurice, et al.
Pubblicazione: (2024) -
Facilitating Multi-turn Function Calling for LLMs via Compositional Instruction Tuning
di: Chen, Mingyang, et al.
Pubblicazione: (2024) -
Multi-trait User Simulation with Adaptive Decoding for Conversational Task Assistants
di: Ferreira, Rafael, et al.
Pubblicazione: (2024)