MultiSessionCollab: Learning User Preferences with Memory to Improve Long-Term Collaboration
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Mehri, Shuhaib, Kargupta, Priyanka, August, Tal, Hakkani-Tür, Dilek |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Sparking Scientific Creativity via LLM-Driven Interdisciplinary Inspiration
par: Kargupta, Priyanka, et autres
Publié: (2026)
par: Kargupta, Priyanka, et autres
Publié: (2026)
Goal Alignment in LLM-Based User Simulators for Conversational AI
par: Mehri, Shuhaib, et autres
Publié: (2025)
par: Mehri, Shuhaib, et autres
Publié: (2025)
User Preference Modeling for Conversational LLM Agents: Weak Rewards from Retrieval-Augmented Interaction
par: Hao, Yuren, et autres
Publié: (2026)
par: Hao, Yuren, et autres
Publié: (2026)
Persuade Me if You Can: A Framework for Evaluating Persuasion Effectiveness and Susceptibility Among Large Language Models
par: Bozdag, Nimet Beyza, et autres
Publié: (2025)
par: Bozdag, Nimet Beyza, et autres
Publié: (2025)
AURA: A Diagnostic Framework for Tracking User Satisfaction of Interactive Planning Agents
par: Kim, Takyoung, et autres
Publié: (2025)
par: Kim, Takyoung, et autres
Publié: (2025)
Tree-of-Debate: Multi-Persona Debate Trees Elicit Critical Thinking for Scientific Comparative Analysis
par: Kargupta, Priyanka, et autres
Publié: (2025)
par: Kargupta, Priyanka, et autres
Publié: (2025)
Embodied Multi-Agent Coordination by Aligning World Models Through Dialogue
par: Dongre, Vardhan, et autres
Publié: (2026)
par: Dongre, Vardhan, et autres
Publié: (2026)
Simulating User Agents for Embodied Conversational-AI
par: Philipov, Daniel, et autres
Publié: (2024)
par: Philipov, Daniel, et autres
Publié: (2024)
Unsupervised Human Preference Learning
par: Shashidhar, Sumuk, et autres
Publié: (2024)
par: Shashidhar, Sumuk, et autres
Publié: (2024)
Beyond Sample-Level Feedback: Using Reference-Level Feedback to Guide Data Synthesis
par: Mehri, Shuhaib, et autres
Publié: (2025)
par: Mehri, Shuhaib, et autres
Publié: (2025)
Instruct, Not Assist: LLM-based Multi-Turn Planning and Hierarchical Questioning for Socratic Code Debugging
par: Kargupta, Priyanka, et autres
Publié: (2024)
par: Kargupta, Priyanka, et autres
Publié: (2024)
Do LLMs Encode Functional Importance of Reasoning Tokens?
par: Singh, Janvijay, et autres
Publié: (2026)
par: Singh, Janvijay, et autres
Publié: (2026)
Neural Networks for Learnable and Scalable Influence Estimation of Instruction Fine-Tuning Data
par: Agarwal, Ishika, et autres
Publié: (2025)
par: Agarwal, Ishika, et autres
Publié: (2025)
Large Language Models as User-Agents for Evaluating Task-Oriented-Dialogue Systems
par: Kazi, Taaha, et autres
Publié: (2024)
par: Kazi, Taaha, et autres
Publié: (2024)
Must Read: A Comprehensive Survey of Computational Persuasion
par: Bozdag, Nimet Beyza, et autres
Publié: (2025)
par: Bozdag, Nimet Beyza, et autres
Publié: (2025)
PSI-Bench: Towards Clinically Grounded and Interpretable Evaluation of Depression Patient Simulators
par: Hoang, Nguyen Khoi, et autres
Publié: (2026)
par: Hoang, Nguyen Khoi, et autres
Publié: (2026)
Plan Verification for LLM-Based Embodied Task Completion Agents
par: Hariharan, Ananth, et autres
Publié: (2025)
par: Hariharan, Ananth, et autres
Publié: (2025)
SIMU: Selective Influence Machine Unlearning
par: Agarwal, Anu, et autres
Publié: (2025)
par: Agarwal, Anu, et autres
Publié: (2025)
Question Generation for Assessing Early Literacy Reading Comprehension
par: Yang, Xiaocheng, et autres
Publié: (2025)
par: Yang, Xiaocheng, et autres
Publié: (2025)
Self-Improving LLM Agents at Test-Time
par: Acikgoz, Emre Can, et autres
Publié: (2025)
par: Acikgoz, Emre Can, et autres
Publié: (2025)
Confidence Estimation for LLM-Based Dialogue State Tracking
par: Sun, Yi-Jyun, et autres
Publié: (2024)
par: Sun, Yi-Jyun, et autres
Publié: (2024)
MemGuard: Preventing Memory Contamination in Long-Term Memory-Augmented Large Language Models
par: Ha, Hyeonjeong, et autres
Publié: (2026)
par: Ha, Hyeonjeong, et autres
Publié: (2026)
Measuring and Mitigating the Distributional Gap Between Real and Simulated User Behaviors
par: Mehri, Shuhaib, et autres
Publié: (2026)
par: Mehri, Shuhaib, et autres
Publié: (2026)
Aligning LLMs with Individual Preferences via Interaction
par: Wu, Shujin, et autres
Publié: (2024)
par: Wu, Shujin, et autres
Publié: (2024)
MAC: A Multi-Agent Framework for Interactive User Clarification in Multi-turn Conversations
par: Acikgoz, Emre Can, et autres
Publié: (2025)
par: Acikgoz, Emre Can, et autres
Publié: (2025)
Do We Need Adam? Surprisingly Strong and Sparse Reinforcement Learning with SGD in LLMs
par: Mukherjee, Sagnik, et autres
Publié: (2026)
par: Mukherjee, Sagnik, et autres
Publié: (2026)
YourBench: Easy Custom Evaluation Sets for Everyone
par: Shashidhar, Sumuk, et autres
Publié: (2025)
par: Shashidhar, Sumuk, et autres
Publié: (2025)
From Context to Action: Analysis of the Impact of State Representation and Context on the Generalization of Multi-Turn Web Navigation Agents
par: Tiwary, Nalin, et autres
Publié: (2024)
par: Tiwary, Nalin, et autres
Publié: (2024)
When Attention Closes: How LLMs Lose the Thread in Multi-Turn Interaction
par: Dongre, Vardhan, et autres
Publié: (2026)
par: Dongre, Vardhan, et autres
Publié: (2026)
ReSpAct: Harmonizing Reasoning, Speaking, and Acting Towards Building Large Language Model-Based Conversational AI Agents
par: Dongre, Vardhan, et autres
Publié: (2024)
par: Dongre, Vardhan, et autres
Publié: (2024)
TD-EVAL: Revisiting Task-Oriented Dialogue Evaluation by Combining Turn-Level Precision with Dialogue-Level Comparisons
par: Acikgoz, Emre Can, et autres
Publié: (2025)
par: Acikgoz, Emre Can, et autres
Publié: (2025)
Instructor-Aligned Knowledge Graphs for Personalized Learning
par: AlRabah, Abdulrahman, et autres
Publié: (2026)
par: AlRabah, Abdulrahman, et autres
Publié: (2026)
ATOD: An Evaluation Framework and Benchmark for Agentic Task-Oriented Dialogue Systems
par: Zhang, Yifei, et autres
Publié: (2026)
par: Zhang, Yifei, et autres
Publié: (2026)
ToolRL: Reward is All Tool Learning Needs
par: Qian, Cheng, et autres
Publié: (2025)
par: Qian, Cheng, et autres
Publié: (2025)
Drift No More? Context Equilibria in Multi-Turn LLM Interactions
par: Dongre, Vardhan, et autres
Publié: (2025)
par: Dongre, Vardhan, et autres
Publié: (2025)
ReIn: Conversational Error Recovery with Reasoning Inception
par: Kim, Takyoung, et autres
Publié: (2026)
par: Kim, Takyoung, et autres
Publié: (2026)
MemCollab: Cross-Model Memory Collaboration via Contrastive Trajectory Distillation
par: Chang, Yurui, et autres
Publié: (2026)
par: Chang, Yurui, et autres
Publié: (2026)
Enabling Chatbots with Eyes and Ears: An Immersive Multimodal Conversation System for Dynamic Interactions
par: Jang, Jihyoung, et autres
Publié: (2025)
par: Jang, Jihyoung, et autres
Publié: (2025)
Can a Single Model Master Both Multi-turn Conversations and Tool Use? CoALM: A Unified Conversational Agentic Language Model
par: Acikgoz, Emre Can, et autres
Publié: (2025)
par: Acikgoz, Emre Can, et autres
Publié: (2025)
CollabEval: Enhancing LLM-as-a-Judge via Multi-Agent Collaboration
par: Qian, Yiyue, et autres
Publié: (2026)
par: Qian, Yiyue, et autres
Publié: (2026)
Documents similaires
-
Sparking Scientific Creativity via LLM-Driven Interdisciplinary Inspiration
par: Kargupta, Priyanka, et autres
Publié: (2026) -
Goal Alignment in LLM-Based User Simulators for Conversational AI
par: Mehri, Shuhaib, et autres
Publié: (2025) -
User Preference Modeling for Conversational LLM Agents: Weak Rewards from Retrieval-Augmented Interaction
par: Hao, Yuren, et autres
Publié: (2026) -
Persuade Me if You Can: A Framework for Evaluating Persuasion Effectiveness and Susceptibility Among Large Language Models
par: Bozdag, Nimet Beyza, et autres
Publié: (2025) -
AURA: A Diagnostic Framework for Tracking User Satisfaction of Interactive Planning Agents
par: Kim, Takyoung, et autres
Publié: (2025)