Comparing Exploration-Exploitation Strategies of LLMs and Humans: Insights from Standard Multi-armed Bandit Experiments
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Zhang, Ziyuan, Wang, Darcy, Chen, Ningyuan, Mansur, Rodrigo, Sarhangian, Vahid |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Evaluating LLMs as Human Surrogates in Controlled Experiments
par: Hoq, Adnan, et autres
Publié: (2026)
par: Hoq, Adnan, et autres
Publié: (2026)
Performance Gains of LLMs With Humans in a World of LLMs Versus Humans
par: McCullum, Lucas, et autres
Publié: (2025)
par: McCullum, Lucas, et autres
Publié: (2025)
The Alignment Floor: How Persona Customization Breaks Safety in Weakly-Aligned LLMs
par: Zhang, Xing, et autres
Publié: (2026)
par: Zhang, Xing, et autres
Publié: (2026)
HARGPT: Are LLMs Zero-Shot Human Activity Recognizers?
par: Ji, Sijie, et autres
Publié: (2024)
par: Ji, Sijie, et autres
Publié: (2024)
Strategic Chain-of-Thought: Guiding Accurate Reasoning in LLMs through Strategy Elicitation
par: Wang, Yu, et autres
Publié: (2024)
par: Wang, Yu, et autres
Publié: (2024)
Unpacking Human Preference for LLMs: Demographically Aware Evaluation with the HUMAINE Framework
par: Petrova, Nora, et autres
Publié: (2026)
par: Petrova, Nora, et autres
Publié: (2026)
How Do AI Agents Do Human Work? Comparing AI and Human Workflows Across Diverse Occupations
par: Wang, Zora Zhiruo, et autres
Publié: (2025)
par: Wang, Zora Zhiruo, et autres
Publié: (2025)
LLMs Can Simulate Standardized Patients via Agent Coevolution
par: Du, Zhuoyun, et autres
Publié: (2024)
par: Du, Zhuoyun, et autres
Publié: (2024)
Mitigating Harmful Erraticism in LLMs Through Dialectical Behavior Therapy Based De-Escalation Strategies
par: Rangarajan, Pooja, et autres
Publié: (2025)
par: Rangarajan, Pooja, et autres
Publié: (2025)
ValueCompass: A Framework for Measuring Contextual Value Alignment Between Human and LLMs
par: Shen, Hua, et autres
Publié: (2024)
par: Shen, Hua, et autres
Publié: (2024)
From Scratch to Fine-Tuned: A Comparative Study of Transformer Training Strategies for Legal Machine Translation
par: Barman, Amit, et autres
Publié: (2025)
par: Barman, Amit, et autres
Publié: (2025)
Red Teaming LLMs as Socio-Technical Practice: From Exploration and Data Creation to Evaluation
par: Garcia, Adriana Alvarado, et autres
Publié: (2026)
par: Garcia, Adriana Alvarado, et autres
Publié: (2026)
Effects of Theory of Mind and Prosocial Beliefs on Steering Human-Aligned Behaviors of LLMs in Ultimatum Games
par: Yadav, Neemesh, et autres
Publié: (2025)
par: Yadav, Neemesh, et autres
Publié: (2025)
The Alternative Annotator Test for LLM-as-a-Judge: How to Statistically Justify Replacing Human Annotators with LLMs
par: Calderon, Nitay, et autres
Publié: (2025)
par: Calderon, Nitay, et autres
Publié: (2025)
Through the Lens of Human-Human Collaboration: A Configurable Research Platform for Exploring Human-Agent Collaboration
par: Yao, Bingsheng, et autres
Publié: (2025)
par: Yao, Bingsheng, et autres
Publié: (2025)
Exploring Human Perceptions of AI Responses: Insights from a Mixed-Methods Study on Risk Mitigation in Generative Models
par: Candello, Heloisa, et autres
Publié: (2025)
par: Candello, Heloisa, et autres
Publié: (2025)
A Survey on Human-AI Collaboration with Large Foundation Models
par: Vats, Vanshika, et autres
Publié: (2024)
par: Vats, Vanshika, et autres
Publié: (2024)
Imperfectly Cooperative Human-AI Interactions: Comparing the Impacts of Human and AI Attributes in Simulated and User Studies
par: Cohen, Myke C., et autres
Publié: (2026)
par: Cohen, Myke C., et autres
Publié: (2026)
Automatic Histograms: Leveraging Language Models for Text Dataset Exploration
par: Reif, Emily, et autres
Publié: (2024)
par: Reif, Emily, et autres
Publié: (2024)
Evaluating Behavioral Alignment in Conflict Dialogue: A Multi-Dimensional Comparison of LLM Agents and Humans
par: Kwon, Deuksin, et autres
Publié: (2025)
par: Kwon, Deuksin, et autres
Publié: (2025)
Diverse and Fine-Grained Instruction-Following Ability Exploration with Synthetic Data
par: Gu, Zihui, et autres
Publié: (2024)
par: Gu, Zihui, et autres
Publié: (2024)
Dyadic: A Scalable Platform for Human-Human and Human-AI Conversation Research
par: Markowitz, David M.
Publié: (2026)
par: Markowitz, David M.
Publié: (2026)
Designing and Evaluating Multi-Chatbot Interface for Human-AI Communication: Preliminary Findings from a Persuasion Task
par: Yoon, Sion, et autres
Publié: (2024)
par: Yoon, Sion, et autres
Publié: (2024)
How Persuasive Could LLMs Be? A First Study Combining Linguistic-Rhetorical Analysis and User Experiments
par: Raffini, Daniel, et autres
Publié: (2025)
par: Raffini, Daniel, et autres
Publié: (2025)
SSKG Hub: An Expert-Guided Platform for LLM-Empowered Sustainability Standards Knowledge Graphs
par: He, Chaoyue, et autres
Publié: (2026)
par: He, Chaoyue, et autres
Publié: (2026)
User-Assistant Bias in LLMs
par: Pan, Xu, et autres
Publié: (2025)
par: Pan, Xu, et autres
Publié: (2025)
Bandit-Based Prompt Design Strategy Selection Improves Prompt Optimizers
par: Ashizawa, Rin, et autres
Publié: (2025)
par: Ashizawa, Rin, et autres
Publié: (2025)
Logic-Scaffolding: Personalized Aspect-Instructed Recommendation Explanation Generation using LLMs
par: Rahdari, Behnam, et autres
Publié: (2023)
par: Rahdari, Behnam, et autres
Publié: (2023)
PRompt Optimization in Multi-Step Tasks (PROMST): Integrating Human Feedback and Heuristic-based Sampling
par: Chen, Yongchao, et autres
Publié: (2024)
par: Chen, Yongchao, et autres
Publié: (2024)
LLMs as Workers in Human-Computational Algorithms? Replicating Crowdsourcing Pipelines with LLMs
par: Wu, Tongshuang, et autres
Publié: (2023)
par: Wu, Tongshuang, et autres
Publié: (2023)
Structured Exploration vs. Generative Flexibility: A Field Study Comparing Bandit and LLM Architectures for Personalised Health Behaviour Interventions
par: Hofer, Dominik P., et autres
Publié: (2026)
par: Hofer, Dominik P., et autres
Publié: (2026)
Prompts Matter: Comparing ML/GAI Approaches for Generating Inductive Qualitative Coding Results
par: Chen, John, et autres
Publié: (2024)
par: Chen, John, et autres
Publié: (2024)
HICode: Hierarchical Inductive Coding with LLMs
par: Zhong, Mian, et autres
Publié: (2025)
par: Zhong, Mian, et autres
Publié: (2025)
Can LLMs Generate Visualizations with Dataless Prompts?
par: Coelho, Darius, et autres
Publié: (2024)
par: Coelho, Darius, et autres
Publié: (2024)
Aligning LLMs with Individual Preferences via Interaction
par: Wu, Shujin, et autres
Publié: (2024)
par: Wu, Shujin, et autres
Publié: (2024)
Offscript: Automated Auditing of Instruction Adherence in LLMs
par: Clark, Nicholas, et autres
Publié: (2025)
par: Clark, Nicholas, et autres
Publié: (2025)
TAMA: A Human-AI Collaborative Thematic Analysis Framework Using Multi-Agent LLMs for Clinical Interviews
par: Xu, Huimin, et autres
Publié: (2025)
par: Xu, Huimin, et autres
Publié: (2025)
Advancing AI-Scientist Understanding: Multi-Agent LLMs with Interpretable Physics Reasoning
par: Xu, Yinggan, et autres
Publié: (2025)
par: Xu, Yinggan, et autres
Publié: (2025)
AutoLife: Automatic Life Journaling with Smartphones and LLMs
par: Xu, Huatao, et autres
Publié: (2024)
par: Xu, Huatao, et autres
Publié: (2024)
Are Today's LLMs Ready to Explain Well-Being Concepts?
par: Jiang, Bohan, et autres
Publié: (2025)
par: Jiang, Bohan, et autres
Publié: (2025)
Documents similaires
-
Evaluating LLMs as Human Surrogates in Controlled Experiments
par: Hoq, Adnan, et autres
Publié: (2026) -
Performance Gains of LLMs With Humans in a World of LLMs Versus Humans
par: McCullum, Lucas, et autres
Publié: (2025) -
The Alignment Floor: How Persona Customization Breaks Safety in Weakly-Aligned LLMs
par: Zhang, Xing, et autres
Publié: (2026) -
HARGPT: Are LLMs Zero-Shot Human Activity Recognizers?
par: Ji, Sijie, et autres
Publié: (2024) -
Strategic Chain-of-Thought: Guiding Accurate Reasoning in LLMs through Strategy Elicitation
par: Wang, Yu, et autres
Publié: (2024)