DeliberationBench: A Normative Benchmark for the Influence of Large Language Models on Users' Views
Fuente:
arXiv
Salvato in:
| Autori principali: | Hewitt, Luke, Dale, Maximilian Kroner, de Font-Reaulx, Paul |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
DeliberationBench: When Do More Voices Hurt? A Controlled Study of Multi-LLM Deliberation Protocols
di: Kaushal, Vaarunay, et al.
Pubblicazione: (2025)
di: Kaushal, Vaarunay, et al.
Pubblicazione: (2025)
Machine Theory of Mind and the Structure of Human Values
di: de Font-Reaulx, Paul
Pubblicazione: (2025)
di: de Font-Reaulx, Paul
Pubblicazione: (2025)
Normative Moral Pluralism for AI: A Framework for Deliberation in Complex Moral Contexts
di: Yaacov, David-Doron
Pubblicazione: (2025)
di: Yaacov, David-Doron
Pubblicazione: (2025)
Normative Evaluation of Large Language Models with Everyday Moral Dilemmas
di: Sachdeva, Pratik S., et al.
Pubblicazione: (2025)
di: Sachdeva, Pratik S., et al.
Pubblicazione: (2025)
WorldView-Bench: A Benchmark for Evaluating Global Cultural Perspectives in Large Language Models
di: Mushtaq, Abdullah, et al.
Pubblicazione: (2025)
di: Mushtaq, Abdullah, et al.
Pubblicazione: (2025)
DarkBench: Benchmarking Dark Patterns in Large Language Models
di: Kran, Esben, et al.
Pubblicazione: (2025)
di: Kran, Esben, et al.
Pubblicazione: (2025)
SimBench: Benchmarking the Ability of Large Language Models to Simulate Human Behaviors
di: Hu, Tiancheng, et al.
Pubblicazione: (2025)
di: Hu, Tiancheng, et al.
Pubblicazione: (2025)
MoReBench: Evaluating Procedural and Pluralistic Moral Reasoning in Language Models, More than Outcomes
di: Chiu, Yu Ying, et al.
Pubblicazione: (2025)
di: Chiu, Yu Ying, et al.
Pubblicazione: (2025)
LocalValueBench: A Collaboratively Built and Extensible Benchmark for Evaluating Localized Value Alignment and Ethical Safety in Large Language Models
di: Meadows, Gwenyth Isobel, et al.
Pubblicazione: (2024)
di: Meadows, Gwenyth Isobel, et al.
Pubblicazione: (2024)
BiasFreeBench: a Benchmark for Mitigating Bias in Large Language Model Responses
di: Xu, Xin, et al.
Pubblicazione: (2025)
di: Xu, Xin, et al.
Pubblicazione: (2025)
Nunchi-Bench: Benchmarking Language Models on Cultural Reasoning with a Focus on Korean Superstition
di: Kim, Kyuhee, et al.
Pubblicazione: (2025)
di: Kim, Kyuhee, et al.
Pubblicazione: (2025)
PsychBench: Auditing Epidemiological Fidelity in Large Language Model Mental Health Simulations
di: Keough, Patrick
Pubblicazione: (2026)
di: Keough, Patrick
Pubblicazione: (2026)
How Do Language Models Process Ethical Instructions? Deliberation, Consistency, and Other-Recognition Across Four Models
di: Fukui, Hiroki
Pubblicazione: (2026)
di: Fukui, Hiroki
Pubblicazione: (2026)
MDK12-Bench: A Comprehensive Evaluation of Multimodal Large Language Models on Multidisciplinary Exams
di: Zhou, Pengfei, et al.
Pubblicazione: (2025)
di: Zhou, Pengfei, et al.
Pubblicazione: (2025)
Benchmarking Large Language Models on Homework Assessment in Circuit Analysis
di: Chen, Liangliang, et al.
Pubblicazione: (2025)
di: Chen, Liangliang, et al.
Pubblicazione: (2025)
Can Large Language Models Replace Human Coders? Introducing ContentBench
di: Haman, Michael
Pubblicazione: (2026)
di: Haman, Michael
Pubblicazione: (2026)
CBT-Bench: Evaluating Large Language Models on Assisting Cognitive Behavior Therapy
di: Zhang, Mian, et al.
Pubblicazione: (2024)
di: Zhang, Mian, et al.
Pubblicazione: (2024)
The Illusory Normativity of Rights-Based AI Regulation
di: Mei, Yiyang, et al.
Pubblicazione: (2025)
di: Mei, Yiyang, et al.
Pubblicazione: (2025)
Traits of a Leader: User Influence Level Prediction through Sociolinguistic Modeling
di: Katerenchuk, Denys, et al.
Pubblicazione: (2025)
di: Katerenchuk, Denys, et al.
Pubblicazione: (2025)
Susceptibility of Large Language Models to User-Driven Factors in Medical Queries
di: Lim, Kyung Ho, et al.
Pubblicazione: (2025)
di: Lim, Kyung Ho, et al.
Pubblicazione: (2025)
Epistemic Control and the Normativity of Machine Learning-Based Science
di: Ratti, Emanuele
Pubblicazione: (2026)
di: Ratti, Emanuele
Pubblicazione: (2026)
Dynamic Normativity: Necessary and Sufficient Conditions for Value Alignment
di: Corrêa, Nicholas Kluge
Pubblicazione: (2024)
di: Corrêa, Nicholas Kluge
Pubblicazione: (2024)
AccessEval: Benchmarking Disability Bias in Large Language Models
di: Panda, Srikant, et al.
Pubblicazione: (2025)
di: Panda, Srikant, et al.
Pubblicazione: (2025)
Large Language Models and User Trust: Consequence of Self-Referential Learning Loop and the Deskilling of Healthcare Professionals
di: Choudhury, Avishek, et al.
Pubblicazione: (2024)
di: Choudhury, Avishek, et al.
Pubblicazione: (2024)
STOP! Benchmarking Large Language Models with Sensitivity Testing on Offensive Progressions
di: Morabito, Robert, et al.
Pubblicazione: (2024)
di: Morabito, Robert, et al.
Pubblicazione: (2024)
Benchmarking the Safety of Large Language Models for Robotic Health Attendant Control
di: Nakao, Mahiro, et al.
Pubblicazione: (2026)
di: Nakao, Mahiro, et al.
Pubblicazione: (2026)
Regulating Large Language Models: A Roundtable Report
di: Nicholas, Gabriel, et al.
Pubblicazione: (2024)
di: Nicholas, Gabriel, et al.
Pubblicazione: (2024)
Inadequacies of Large Language Model Benchmarks in the Era of Generative Artificial Intelligence
di: McIntosh, Timothy R., et al.
Pubblicazione: (2024)
di: McIntosh, Timothy R., et al.
Pubblicazione: (2024)
Scientific production in the era of Large Language Models
di: Kusumegi, Keigo, et al.
Pubblicazione: (2026)
di: Kusumegi, Keigo, et al.
Pubblicazione: (2026)
Artificial intelligence can persuade people to take political actions
di: Hackenburg, Kobi, et al.
Pubblicazione: (2026)
di: Hackenburg, Kobi, et al.
Pubblicazione: (2026)
PropensityBench: Evaluating Latent Safety Risks in Large Language Models via an Agentic Approach
di: Sehwag, Udari Madhushani, et al.
Pubblicazione: (2025)
di: Sehwag, Udari Madhushani, et al.
Pubblicazione: (2025)
Dr.Academy: A Benchmark for Evaluating Questioning Capability in Education for Large Language Models
di: Chen, Yuyan, et al.
Pubblicazione: (2024)
di: Chen, Yuyan, et al.
Pubblicazione: (2024)
JobFair: A Framework for Benchmarking Gender Hiring Bias in Large Language Models
di: Wang, Ze, et al.
Pubblicazione: (2024)
di: Wang, Ze, et al.
Pubblicazione: (2024)
User Privacy and Large Language Models: An Analysis of Frontier Developers' Privacy Policies
di: King, Jennifer, et al.
Pubblicazione: (2025)
di: King, Jennifer, et al.
Pubblicazione: (2025)
QueerBench: Quantifying Discrimination in Language Models Toward Queer Identities
di: Sosto, Mae, et al.
Pubblicazione: (2024)
di: Sosto, Mae, et al.
Pubblicazione: (2024)
InterveneBench: Benchmarking LLMs for Intervention Reasoning and Causal Study Design in Real Social Systems
di: Shi, Shaojie, et al.
Pubblicazione: (2026)
di: Shi, Shaojie, et al.
Pubblicazione: (2026)
AIR-Bench 2024: A Safety Benchmark Based on Risk Categories from Regulations and Policies
di: Zeng, Yi, et al.
Pubblicazione: (2024)
di: Zeng, Yi, et al.
Pubblicazione: (2024)
LocalBench: Benchmarking LLMs on County-Level Local Knowledge and Reasoning
di: Gao, Zihan, et al.
Pubblicazione: (2025)
di: Gao, Zihan, et al.
Pubblicazione: (2025)
Beyond Context: Large Language Models' Failure to Grasp Users' Intent
di: Hussain, Ahmed M., et al.
Pubblicazione: (2025)
di: Hussain, Ahmed M., et al.
Pubblicazione: (2025)
TCC-Bench: Benchmarking the Traditional Chinese Culture Understanding Capabilities of MLLMs
di: Xu, Pengju, et al.
Pubblicazione: (2025)
di: Xu, Pengju, et al.
Pubblicazione: (2025)
Documenti analoghi
-
DeliberationBench: When Do More Voices Hurt? A Controlled Study of Multi-LLM Deliberation Protocols
di: Kaushal, Vaarunay, et al.
Pubblicazione: (2025) -
Machine Theory of Mind and the Structure of Human Values
di: de Font-Reaulx, Paul
Pubblicazione: (2025) -
Normative Moral Pluralism for AI: A Framework for Deliberation in Complex Moral Contexts
di: Yaacov, David-Doron
Pubblicazione: (2025) -
Normative Evaluation of Large Language Models with Everyday Moral Dilemmas
di: Sachdeva, Pratik S., et al.
Pubblicazione: (2025) -
WorldView-Bench: A Benchmark for Evaluating Global Cultural Perspectives in Large Language Models
di: Mushtaq, Abdullah, et al.
Pubblicazione: (2025)