Enregistré dans:
| Auteurs principaux: | Rabbani, Parisa, Sahoo, Priyam, Mathew, Ruben, Mondal, Aishee, Ketharaman, Harshita, Bozdag, Nimet Beyza, Hakkani-Tür, Dilek |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | https://arxiv.org/abs/2601.10896 |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
From Fact to Judgment: Investigating the Impact of Task Framing on LLM Conviction in Dialogue Systems
par: Rabbani, Parisa, et autres
Publié: (2025)
par: Rabbani, Parisa, et autres
Publié: (2025)
Persuade Me if You Can: A Framework for Evaluating Persuasion Effectiveness and Susceptibility Among Large Language Models
par: Bozdag, Nimet Beyza, et autres
Publié: (2025)
par: Bozdag, Nimet Beyza, et autres
Publié: (2025)
Language Specific Knowledge: Do Models Know Better in X than in English?
par: Agarwal, Ishika, et autres
Publié: (2025)
par: Agarwal, Ishika, et autres
Publié: (2025)
Few-Shot Accent Synthesis for ASR with LLM-Guided Phoneme Editing
par: Halychanskyi, Yurii, et autres
Publié: (2026)
par: Halychanskyi, Yurii, et autres
Publié: (2026)
AURA: A Diagnostic Framework for Tracking User Satisfaction of Interactive Planning Agents
par: Kim, Takyoung, et autres
Publié: (2025)
par: Kim, Takyoung, et autres
Publié: (2025)
Too Polite to Disagree: Understanding Sycophancy Propagation in Multi-Agent Systems
par: Kasprova, Vira, et autres
Publié: (2026)
par: Kasprova, Vira, et autres
Publié: (2026)
Must Read: A Comprehensive Survey of Computational Persuasion
par: Bozdag, Nimet Beyza, et autres
Publié: (2025)
par: Bozdag, Nimet Beyza, et autres
Publié: (2025)
Dialog Flow Induction for Constrainable LLM-Based Chatbots
par: Agrawal, Stuti, et autres
Publié: (2024)
par: Agrawal, Stuti, et autres
Publié: (2024)
Do LLMs Encode Functional Importance of Reasoning Tokens?
par: Singh, Janvijay, et autres
Publié: (2026)
par: Singh, Janvijay, et autres
Publié: (2026)
Neural Networks for Learnable and Scalable Influence Estimation of Instruction Fine-Tuning Data
par: Agarwal, Ishika, et autres
Publié: (2025)
par: Agarwal, Ishika, et autres
Publié: (2025)
Embodied Multi-Agent Coordination by Aligning World Models Through Dialogue
par: Dongre, Vardhan, et autres
Publié: (2026)
par: Dongre, Vardhan, et autres
Publié: (2026)
Confidence Estimation for LLM-Based Dialogue State Tracking
par: Sun, Yi-Jyun, et autres
Publié: (2024)
par: Sun, Yi-Jyun, et autres
Publié: (2024)
Sparking Scientific Creativity via LLM-Driven Interdisciplinary Inspiration
par: Kargupta, Priyanka, et autres
Publié: (2026)
par: Kargupta, Priyanka, et autres
Publié: (2026)
Simulating User Agents for Embodied Conversational-AI
par: Philipov, Daniel, et autres
Publié: (2024)
par: Philipov, Daniel, et autres
Publié: (2024)
Self-Improving LLM Agents at Test-Time
par: Acikgoz, Emre Can, et autres
Publié: (2025)
par: Acikgoz, Emre Can, et autres
Publié: (2025)
Question Generation for Assessing Early Literacy Reading Comprehension
par: Yang, Xiaocheng, et autres
Publié: (2025)
par: Yang, Xiaocheng, et autres
Publié: (2025)
Instruct, Not Assist: LLM-based Multi-Turn Planning and Hierarchical Questioning for Socratic Code Debugging
par: Kargupta, Priyanka, et autres
Publié: (2024)
par: Kargupta, Priyanka, et autres
Publié: (2024)
Know Your Mistakes: Towards Preventing Overreliance on Task-Oriented Conversational AI Through Accountability Modeling
par: Dey, Suvodip, et autres
Publié: (2025)
par: Dey, Suvodip, et autres
Publié: (2025)
Goal Alignment in LLM-Based User Simulators for Conversational AI
par: Mehri, Shuhaib, et autres
Publié: (2025)
par: Mehri, Shuhaib, et autres
Publié: (2025)
Large Language Models as User-Agents for Evaluating Task-Oriented-Dialogue Systems
par: Kazi, Taaha, et autres
Publié: (2024)
par: Kazi, Taaha, et autres
Publié: (2024)
Beyond Sample-Level Feedback: Using Reference-Level Feedback to Guide Data Synthesis
par: Mehri, Shuhaib, et autres
Publié: (2025)
par: Mehri, Shuhaib, et autres
Publié: (2025)
A Rising Tide Lifts All Boats: MTQE Rewards for Idioms Improve General Translation Quality
par: Agarwal, Ishika, et autres
Publié: (2026)
par: Agarwal, Ishika, et autres
Publié: (2026)
LLMs are Vulnerable to Malicious Prompts Disguised as Scientific Language
par: Ge, Yubin, et autres
Publié: (2025)
par: Ge, Yubin, et autres
Publié: (2025)
ReasoningFlow: Semantic Structure of Complex Reasoning Traces
par: Lee, Jinu, et autres
Publié: (2025)
par: Lee, Jinu, et autres
Publié: (2025)
DocCHA: Towards LLM-Augmented Interactive Online diagnosis System
par: Liu, Xinyi, et autres
Publié: (2025)
par: Liu, Xinyi, et autres
Publié: (2025)
SMART: Self-Aware Agent for Tool Overuse Mitigation
par: Qian, Cheng, et autres
Publié: (2025)
par: Qian, Cheng, et autres
Publié: (2025)
User Preference Modeling for Conversational LLM Agents: Weak Rewards from Retrieval-Augmented Interaction
par: Hao, Yuren, et autres
Publié: (2026)
par: Hao, Yuren, et autres
Publié: (2026)
ATOD: An Evaluation Framework and Benchmark for Agentic Task-Oriented Dialogue Systems
par: Zhang, Yifei, et autres
Publié: (2026)
par: Zhang, Yifei, et autres
Publié: (2026)
Unsupervised Human Preference Learning
par: Shashidhar, Sumuk, et autres
Publié: (2024)
par: Shashidhar, Sumuk, et autres
Publié: (2024)
Measuring and Mitigating the Distributional Gap Between Real and Simulated User Behaviors
par: Mehri, Shuhaib, et autres
Publié: (2026)
par: Mehri, Shuhaib, et autres
Publié: (2026)
YourBench: Easy Custom Evaluation Sets for Everyone
par: Shashidhar, Sumuk, et autres
Publié: (2025)
par: Shashidhar, Sumuk, et autres
Publié: (2025)
On the Shelf Life of Fine-Tuned LLM-Judges: Future-Proofing, Backward-Compatibility, and Question Generalization
par: Singh, Janvijay, et autres
Publié: (2025)
par: Singh, Janvijay, et autres
Publié: (2025)
Plan Verification for LLM-Based Embodied Task Completion Agents
par: Hariharan, Ananth, et autres
Publié: (2025)
par: Hariharan, Ananth, et autres
Publié: (2025)
Infogent: An Agent-Based Framework for Web Information Aggregation
par: Reddy, Revanth Gangi, et autres
Publié: (2024)
par: Reddy, Revanth Gangi, et autres
Publié: (2024)
ReSpAct: Harmonizing Reasoning, Speaking, and Acting Towards Building Large Language Model-Based Conversational AI Agents
par: Dongre, Vardhan, et autres
Publié: (2024)
par: Dongre, Vardhan, et autres
Publié: (2024)
Premise-Augmented Reasoning Chains Improve Error Identification in Math reasoning with LLMs
par: Mukherjee, Sagnik, et autres
Publié: (2025)
par: Mukherjee, Sagnik, et autres
Publié: (2025)
Deferred Commitment Decoding for Diffusion Language Models
par: Shu, Yingte, et autres
Publié: (2026)
par: Shu, Yingte, et autres
Publié: (2026)
Enabling Chatbots with Eyes and Ears: An Immersive Multimodal Conversation System for Dynamic Interactions
par: Jang, Jihyoung, et autres
Publié: (2025)
par: Jang, Jihyoung, et autres
Publié: (2025)
TD-EVAL: Revisiting Task-Oriented Dialogue Evaluation by Combining Turn-Level Precision with Dialogue-Level Comparisons
par: Acikgoz, Emre Can, et autres
Publié: (2025)
par: Acikgoz, Emre Can, et autres
Publié: (2025)
Drift No More? Context Equilibria in Multi-Turn LLM Interactions
par: Dongre, Vardhan, et autres
Publié: (2025)
par: Dongre, Vardhan, et autres
Publié: (2025)
Documents similaires
-
From Fact to Judgment: Investigating the Impact of Task Framing on LLM Conviction in Dialogue Systems
par: Rabbani, Parisa, et autres
Publié: (2025) -
Persuade Me if You Can: A Framework for Evaluating Persuasion Effectiveness and Susceptibility Among Large Language Models
par: Bozdag, Nimet Beyza, et autres
Publié: (2025) -
Language Specific Knowledge: Do Models Know Better in X than in English?
par: Agarwal, Ishika, et autres
Publié: (2025) -
Few-Shot Accent Synthesis for ASR with LLM-Guided Phoneme Editing
par: Halychanskyi, Yurii, et autres
Publié: (2026) -
AURA: A Diagnostic Framework for Tracking User Satisfaction of Interactive Planning Agents
par: Kim, Takyoung, et autres
Publié: (2025)