Persuade Me if You Can: A Framework for Evaluating Persuasion Effectiveness and Susceptibility Among Large Language Models
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Bozdag, Nimet Beyza, Mehri, Shuhaib, Tur, Gokhan, Hakkani-Tür, Dilek |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Embodied Multi-Agent Coordination by Aligning World Models Through Dialogue
par: Dongre, Vardhan, et autres
Publié: (2026)
par: Dongre, Vardhan, et autres
Publié: (2026)
ATOD: An Evaluation Framework and Benchmark for Agentic Task-Oriented Dialogue Systems
par: Zhang, Yifei, et autres
Publié: (2026)
par: Zhang, Yifei, et autres
Publié: (2026)
Too Polite to Disagree: Understanding Sycophancy Propagation in Multi-Agent Systems
par: Kasprova, Vira, et autres
Publié: (2026)
par: Kasprova, Vira, et autres
Publié: (2026)
Must Read: A Comprehensive Survey of Computational Persuasion
par: Bozdag, Nimet Beyza, et autres
Publié: (2025)
par: Bozdag, Nimet Beyza, et autres
Publié: (2025)
From Fact to Judgment: Investigating the Impact of Task Framing on LLM Conviction in Dialogue Systems
par: Rabbani, Parisa, et autres
Publié: (2025)
par: Rabbani, Parisa, et autres
Publié: (2025)
AURA: A Diagnostic Framework for Tracking User Satisfaction of Interactive Planning Agents
par: Kim, Takyoung, et autres
Publié: (2025)
par: Kim, Takyoung, et autres
Publié: (2025)
Instruct, Not Assist: LLM-based Multi-Turn Planning and Hierarchical Questioning for Socratic Code Debugging
par: Kargupta, Priyanka, et autres
Publié: (2024)
par: Kargupta, Priyanka, et autres
Publié: (2024)
Language Specific Knowledge: Do Models Know Better in X than in English?
par: Agarwal, Ishika, et autres
Publié: (2025)
par: Agarwal, Ishika, et autres
Publié: (2025)
Goal Alignment in LLM-Based User Simulators for Conversational AI
par: Mehri, Shuhaib, et autres
Publié: (2025)
par: Mehri, Shuhaib, et autres
Publié: (2025)
Beyond Sample-Level Feedback: Using Reference-Level Feedback to Guide Data Synthesis
par: Mehri, Shuhaib, et autres
Publié: (2025)
par: Mehri, Shuhaib, et autres
Publié: (2025)
Sparking Scientific Creativity via LLM-Driven Interdisciplinary Inspiration
par: Kargupta, Priyanka, et autres
Publié: (2026)
par: Kargupta, Priyanka, et autres
Publié: (2026)
Large Language Models as User-Agents for Evaluating Task-Oriented-Dialogue Systems
par: Kazi, Taaha, et autres
Publié: (2024)
par: Kazi, Taaha, et autres
Publié: (2024)
User Preference Modeling for Conversational LLM Agents: Weak Rewards from Retrieval-Augmented Interaction
par: Hao, Yuren, et autres
Publié: (2026)
par: Hao, Yuren, et autres
Publié: (2026)
DialDefer: A Framework for Detecting and Mitigating LLM Dialogic Deference
par: Rabbani, Parisa, et autres
Publié: (2026)
par: Rabbani, Parisa, et autres
Publié: (2026)
Know Your Mistakes: Towards Preventing Overreliance on Task-Oriented Conversational AI Through Accountability Modeling
par: Dey, Suvodip, et autres
Publié: (2025)
par: Dey, Suvodip, et autres
Publié: (2025)
Simulating User Agents for Embodied Conversational-AI
par: Philipov, Daniel, et autres
Publié: (2024)
par: Philipov, Daniel, et autres
Publié: (2024)
MultiSessionCollab: Learning User Preferences with Memory to Improve Long-Term Collaboration
par: Mehri, Shuhaib, et autres
Publié: (2026)
par: Mehri, Shuhaib, et autres
Publié: (2026)
Confidence Estimation for LLM-Based Dialogue State Tracking
par: Sun, Yi-Jyun, et autres
Publié: (2024)
par: Sun, Yi-Jyun, et autres
Publié: (2024)
Under the Influence: Quantifying Persuasion and Vigilance in Large Language Models
par: Robinson, Sasha, et autres
Publié: (2026)
par: Robinson, Sasha, et autres
Publié: (2026)
Few-Shot Accent Synthesis for ASR with LLM-Guided Phoneme Editing
par: Halychanskyi, Yurii, et autres
Publié: (2026)
par: Halychanskyi, Yurii, et autres
Publié: (2026)
ReSpAct: Harmonizing Reasoning, Speaking, and Acting Towards Building Large Language Model-Based Conversational AI Agents
par: Dongre, Vardhan, et autres
Publié: (2024)
par: Dongre, Vardhan, et autres
Publié: (2024)
Measuring and Mitigating the Distributional Gap Between Real and Simulated User Behaviors
par: Mehri, Shuhaib, et autres
Publié: (2026)
par: Mehri, Shuhaib, et autres
Publié: (2026)
YourBench: Easy Custom Evaluation Sets for Everyone
par: Shashidhar, Sumuk, et autres
Publié: (2025)
par: Shashidhar, Sumuk, et autres
Publié: (2025)
Do LLMs Encode Functional Importance of Reasoning Tokens?
par: Singh, Janvijay, et autres
Publié: (2026)
par: Singh, Janvijay, et autres
Publié: (2026)
Neural Networks for Learnable and Scalable Influence Estimation of Instruction Fine-Tuning Data
par: Agarwal, Ishika, et autres
Publié: (2025)
par: Agarwal, Ishika, et autres
Publié: (2025)
Self-Improving LLM Agents at Test-Time
par: Acikgoz, Emre Can, et autres
Publié: (2025)
par: Acikgoz, Emre Can, et autres
Publié: (2025)
LLM-Coordination: Evaluating and Analyzing Multi-agent Coordination Abilities in Large Language Models
par: Agashe, Saaket, et autres
Publié: (2023)
par: Agashe, Saaket, et autres
Publié: (2023)
Value-Based Large Language Model Agent Simulation for Mutual Evaluation of Trust and Interpersonal Closeness
par: Sakamoto, Yuki, et autres
Publié: (2025)
par: Sakamoto, Yuki, et autres
Publié: (2025)
CAF-I: A Collaborative Multi-Agent Framework for Enhanced Irony Detection with Large Language Models
par: Liu, Ziqi., et autres
Publié: (2025)
par: Liu, Ziqi., et autres
Publié: (2025)
Multi-User Large Language Model Agents
par: Yang, Shu, et autres
Publié: (2026)
par: Yang, Shu, et autres
Publié: (2026)
Nature-Inspired Population-Based Evolution of Large Language Models
par: Zhang, Yiqun, et autres
Publié: (2025)
par: Zhang, Yiqun, et autres
Publié: (2025)
AFSPP: Agent Framework for Shaping Preference and Personality with Large Language Models
par: He, Zihong, et autres
Publié: (2024)
par: He, Zihong, et autres
Publié: (2024)
Collab-Overcooked: Benchmarking and Evaluating Large Language Models as Collaborative Agents
par: Sun, Haochen, et autres
Publié: (2025)
par: Sun, Haochen, et autres
Publié: (2025)
TD-EVAL: Revisiting Task-Oriented Dialogue Evaluation by Combining Turn-Level Precision with Dialogue-Level Comparisons
par: Acikgoz, Emre Can, et autres
Publié: (2025)
par: Acikgoz, Emre Can, et autres
Publié: (2025)
Can a Single Model Master Both Multi-turn Conversations and Tool Use? CoALM: A Unified Conversational Agentic Language Model
par: Acikgoz, Emre Can, et autres
Publié: (2025)
par: Acikgoz, Emre Can, et autres
Publié: (2025)
Toward Reasonable Parrots: Why Large Language Models Should Argue with Us by Design
par: Musi, Elena, et autres
Publié: (2025)
par: Musi, Elena, et autres
Publié: (2025)
Debate or Vote: Which Yields Better Decisions in Multi-Agent Large Language Models?
par: Choi, Hyeong Kyu, et autres
Publié: (2025)
par: Choi, Hyeong Kyu, et autres
Publié: (2025)
Integration of Large Vision Language Models for Efficient Post-disaster Damage Assessment and Reporting
par: Chen, Zhaohui, et autres
Publié: (2024)
par: Chen, Zhaohui, et autres
Publié: (2024)
Consensus Is All You Need: Gossip-Based Reasoning Among Large Language Models
par: Arora, Saksham
Publié: (2025)
par: Arora, Saksham
Publié: (2025)
Mitigating Bias in Queer Representation within Large Language Models: A Collaborative Agent Approach
par: Huang, Tianyi, et autres
Publié: (2024)
par: Huang, Tianyi, et autres
Publié: (2024)
Documents similaires
-
Embodied Multi-Agent Coordination by Aligning World Models Through Dialogue
par: Dongre, Vardhan, et autres
Publié: (2026) -
ATOD: An Evaluation Framework and Benchmark for Agentic Task-Oriented Dialogue Systems
par: Zhang, Yifei, et autres
Publié: (2026) -
Too Polite to Disagree: Understanding Sycophancy Propagation in Multi-Agent Systems
par: Kasprova, Vira, et autres
Publié: (2026) -
Must Read: A Comprehensive Survey of Computational Persuasion
par: Bozdag, Nimet Beyza, et autres
Publié: (2025) -
From Fact to Judgment: Investigating the Impact of Task Framing on LLM Conviction in Dialogue Systems
par: Rabbani, Parisa, et autres
Publié: (2025)