Language Models Exhibit Inconsistent Biases Towards Algorithmic Agents and Human Experts
Fuente:
arXiv
Salvato in:
| Autori principali: | Bo, Jessica Y., Mok, Lillio, Anderson, Ashton |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
LLM Agents Display Human Biases but Exhibit Distinct Learning Patterns
di: Horowitz, Idan, et al.
Pubblicazione: (2025)
di: Horowitz, Idan, et al.
Pubblicazione: (2025)
Do Language Models Exhibit the Same Cognitive Biases in Problem Solving as Human Learners?
di: Opedal, Andreas, et al.
Pubblicazione: (2024)
di: Opedal, Andreas, et al.
Pubblicazione: (2024)
Tandem Training for Language Models
di: West, Robert, et al.
Pubblicazione: (2025)
di: West, Robert, et al.
Pubblicazione: (2025)
ChessQA: Evaluating Large Language Models for Chess Understanding
di: Wen, Qianfeng, et al.
Pubblicazione: (2025)
di: Wen, Qianfeng, et al.
Pubblicazione: (2025)
The Other Mind: How Language Models Exhibit Human Temporal Cognition
di: Li, Lingyu, et al.
Pubblicazione: (2025)
di: Li, Lingyu, et al.
Pubblicazione: (2025)
Large Language Models are Inconsistent and Biased Evaluators
di: Stureborg, Rickard, et al.
Pubblicazione: (2024)
di: Stureborg, Rickard, et al.
Pubblicazione: (2024)
Inconsistencies in Masked Language Models
di: Young, Tom, et al.
Pubblicazione: (2022)
di: Young, Tom, et al.
Pubblicazione: (2022)
Modeling Expert Interactions in Sparse Mixture of Experts via Graph Structures
di: Nguyen-Nhat, Minh-Khoi, et al.
Pubblicazione: (2025)
di: Nguyen-Nhat, Minh-Khoi, et al.
Pubblicazione: (2025)
Model-Free RL Agents Demonstrate System 1-Like Intentionality
di: Ashton, Hal, et al.
Pubblicazione: (2025)
di: Ashton, Hal, et al.
Pubblicazione: (2025)
ThinkTwice: Jointly Optimizing Large Language Models for Reasoning and Self-Refinement
di: Jiao, Difan, et al.
Pubblicazione: (2026)
di: Jiao, Difan, et al.
Pubblicazione: (2026)
Language Models Largely Exhibit Human-like Constituent Ordering Preferences
di: Tur, Ada Defne, et al.
Pubblicazione: (2025)
di: Tur, Ada Defne, et al.
Pubblicazione: (2025)
Measuring Free-Form Decision-Making Inconsistency of Language Models in Military Crisis Simulations
di: Shrivastava, Aryan, et al.
Pubblicazione: (2024)
di: Shrivastava, Aryan, et al.
Pubblicazione: (2024)
Maia-2: A Unified Model for Human-AI Alignment in Chess
di: Tang, Zhenwei, et al.
Pubblicazione: (2024)
di: Tang, Zhenwei, et al.
Pubblicazione: (2024)
Persona-Assigned Large Language Models Exhibit Human-Like Motivated Reasoning
di: Dash, Saloni, et al.
Pubblicazione: (2025)
di: Dash, Saloni, et al.
Pubblicazione: (2025)
SEAM: Semantically Equivalent Across Modalities Benchmark for Vision-Language Models
di: Tang, Zhenwei, et al.
Pubblicazione: (2025)
di: Tang, Zhenwei, et al.
Pubblicazione: (2025)
Towards Data Contamination Detection for Modern Large Language Models: Limitations, Inconsistencies, and Oracle Challenges
di: Samuel, Vinay, et al.
Pubblicazione: (2024)
di: Samuel, Vinay, et al.
Pubblicazione: (2024)
Comparison of SAT-based and ASP-based Algorithms for Inconsistency Measurement
di: Kuhlmann, Isabelle, et al.
Pubblicazione: (2023)
di: Kuhlmann, Isabelle, et al.
Pubblicazione: (2023)
Fostering Appropriate Reliance on Large Language Models: The Role of Explanations, Sources, and Inconsistencies
di: Kim, Sunnie S. Y., et al.
Pubblicazione: (2025)
di: Kim, Sunnie S. Y., et al.
Pubblicazione: (2025)
Inducing Human-like Biases in Moral Reasoning Language Models
di: Karpov, Artem, et al.
Pubblicazione: (2024)
di: Karpov, Artem, et al.
Pubblicazione: (2024)
Uncovering Biases with Reflective Large Language Models
di: Chang, Edward Y.
Pubblicazione: (2024)
di: Chang, Edward Y.
Pubblicazione: (2024)
Grounded Chess Reasoning in Language Models via Master Distillation
di: Tang, Zhenwei, et al.
Pubblicazione: (2026)
di: Tang, Zhenwei, et al.
Pubblicazione: (2026)
Laissez-Faire Harms: Algorithmic Biases in Generative Language Models
di: Shieh, Evan, et al.
Pubblicazione: (2024)
di: Shieh, Evan, et al.
Pubblicazione: (2024)
ChatBench: From Static Benchmarks to Human-AI Evaluation
di: Chang, Serina, et al.
Pubblicazione: (2025)
di: Chang, Serina, et al.
Pubblicazione: (2025)
Predicting Biased Human Decision-Making with Large Language Models in Conversational Settings
di: Pilli, Stephen, et al.
Pubblicazione: (2026)
di: Pilli, Stephen, et al.
Pubblicazione: (2026)
Visual Large Language Models Exhibit Human-Level Cognitive Flexibility in the Wisconsin Card Sorting Test
di: Hao, Guangfu, et al.
Pubblicazione: (2025)
di: Hao, Guangfu, et al.
Pubblicazione: (2025)
Toward Cybersecurity-Expert Small Language Models
di: Levi, Matan, et al.
Pubblicazione: (2025)
di: Levi, Matan, et al.
Pubblicazione: (2025)
An Embedding-based Approach to Inconsistency-tolerant Reasoning with Inconsistent Ontologies
di: Wang, Keyu, et al.
Pubblicazione: (2023)
di: Wang, Keyu, et al.
Pubblicazione: (2023)
Knowledge Localization in Mixture-of-Experts LLMs Using Cross-Lingual Inconsistency
di: Bandarkar, Lucas, et al.
Pubblicazione: (2026)
di: Bandarkar, Lucas, et al.
Pubblicazione: (2026)
Language Agents Mirror Human Causal Reasoning Biases. How Can We Help Them Think Like Scientists?
di: GX-Chen, Anthony, et al.
Pubblicazione: (2025)
di: GX-Chen, Anthony, et al.
Pubblicazione: (2025)
\$OneMillion-Bench: How Far are Language Agents from Human Experts?
di: Yang, Qianyu, et al.
Pubblicazione: (2026)
di: Yang, Qianyu, et al.
Pubblicazione: (2026)
Large Language Models are Biased Because They Are Large Language Models
di: Resnik, Philip
Pubblicazione: (2024)
di: Resnik, Philip
Pubblicazione: (2024)
From Biased Chatbots to Biased Agents: Examining Role Assignment Effects on LLM Agent Robustness
di: Cao, Linbo, et al.
Pubblicazione: (2026)
di: Cao, Linbo, et al.
Pubblicazione: (2026)
Unraveling and Mitigating Retriever Inconsistencies in Retrieval-Augmented Large Language Models
di: Li, Mingda, et al.
Pubblicazione: (2024)
di: Li, Mingda, et al.
Pubblicazione: (2024)
Toward Revealing Nuanced Biases in Medical LLMs
di: Adiba, Farzana Islam, et al.
Pubblicazione: (2025)
di: Adiba, Farzana Islam, et al.
Pubblicazione: (2025)
Bias Amplification: Large Language Models as Increasingly Biased Media
di: Wang, Ze, et al.
Pubblicazione: (2024)
di: Wang, Ze, et al.
Pubblicazione: (2024)
The Expert Interchange Standard: Enabling Dynamic Expert Management in Mixture-of-Experts Language Models
di: Kashinath, Kadaba Shrish
Pubblicazione: (2026)
di: Kashinath, Kadaba Shrish
Pubblicazione: (2026)
Do Machines Fail Like Humans? A Human-Centred Out-of-Distribution Spectrum for Mapping Error Alignment
di: Xu, Binxia, et al.
Pubblicazione: (2026)
di: Xu, Binxia, et al.
Pubblicazione: (2026)
What Counts as AI Sycophancy? A Taxonomy and Expert Survey of a Fragmented Construct
di: Ye, Meryl, et al.
Pubblicazione: (2026)
di: Ye, Meryl, et al.
Pubblicazione: (2026)
Do Large Language Model Agents Exhibit a Survival Instinct? An Empirical Study in a Sugarscape-Style Simulation
di: Masumori, Atsushi, et al.
Pubblicazione: (2025)
di: Masumori, Atsushi, et al.
Pubblicazione: (2025)
Every Expert Matters: Towards Effective Knowledge Distillation for Mixture-of-Experts Language Models
di: Kim, Gyeongman, et al.
Pubblicazione: (2025)
di: Kim, Gyeongman, et al.
Pubblicazione: (2025)
Documenti analoghi
-
LLM Agents Display Human Biases but Exhibit Distinct Learning Patterns
di: Horowitz, Idan, et al.
Pubblicazione: (2025) -
Do Language Models Exhibit the Same Cognitive Biases in Problem Solving as Human Learners?
di: Opedal, Andreas, et al.
Pubblicazione: (2024) -
Tandem Training for Language Models
di: West, Robert, et al.
Pubblicazione: (2025) -
ChessQA: Evaluating Large Language Models for Chess Understanding
di: Wen, Qianfeng, et al.
Pubblicazione: (2025) -
The Other Mind: How Language Models Exhibit Human Temporal Cognition
di: Li, Lingyu, et al.
Pubblicazione: (2025)