The Hidden Bias: A Study on Explicit and Implicit Political Stereotypes in Large Language Models
Fuente:
arXiv
Salvato in:
| Autori principali: | Löhr, Konrad, Yuan, Shuzhou, Färber, Michael |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Hidden Bias in the Machine: Stereotypes in Text-to-Image Models
di: Porikli, Sedat, et al.
Pubblicazione: (2025)
di: Porikli, Sedat, et al.
Pubblicazione: (2025)
AfriStereo: A Culturally Grounded Dataset for Evaluating Stereotypical Bias in Large Language Models
di: Beux, Yann Le, et al.
Pubblicazione: (2025)
di: Beux, Yann Le, et al.
Pubblicazione: (2025)
BiasEdit: Debiasing Stereotyped Language Models via Model Editing
di: Xu, Xin, et al.
Pubblicazione: (2025)
di: Xu, Xin, et al.
Pubblicazione: (2025)
A Taxonomy of Stereotype Content in Large Language Models
di: Nicolas, Gandalf, et al.
Pubblicazione: (2024)
di: Nicolas, Gandalf, et al.
Pubblicazione: (2024)
GNNavi: Navigating the Information Flow in Large Language Models by Graph Neural Network
di: Yuan, Shuzhou, et al.
Pubblicazione: (2024)
di: Yuan, Shuzhou, et al.
Pubblicazione: (2024)
Benchmarking Gender and Political Bias in Large Language Models
di: Yang, Jinrui, et al.
Pubblicazione: (2025)
di: Yang, Jinrui, et al.
Pubblicazione: (2025)
Can LLMs Leverage Observational Data? Towards Data-Driven Causal Discovery with LLMs
di: Susanti, Yuni, et al.
Pubblicazione: (2025)
di: Susanti, Yuni, et al.
Pubblicazione: (2025)
Risk Horizons: Structured Hypothesis Spaces for Longitudinal Clinical Prediction
di: Qu, Zhan, et al.
Pubblicazione: (2026)
di: Qu, Zhan, et al.
Pubblicazione: (2026)
Auto-Rubric: Learning From Implicit Weights to Explicit Rubrics for Reward Modeling
di: Xie, Lipeng, et al.
Pubblicazione: (2025)
di: Xie, Lipeng, et al.
Pubblicazione: (2025)
Uncovering Bias in Foundation Models: Impact, Testing, Harm, and Mitigation
di: Sun, Shuzhou, et al.
Pubblicazione: (2025)
di: Sun, Shuzhou, et al.
Pubblicazione: (2025)
Learning Implicit Bias in Generative Spaces for Accelerating Protein Dynamics Emulation
di: Cheng, Kaihui, et al.
Pubblicazione: (2026)
di: Cheng, Kaihui, et al.
Pubblicazione: (2026)
Large Language Models as Recommender Systems: A Study of Popularity Bias
di: Lichtenberg, Jan Malte, et al.
Pubblicazione: (2024)
di: Lichtenberg, Jan Malte, et al.
Pubblicazione: (2024)
Pre-trained Large Language Models Learn Hidden Markov Models In-context
di: Dai, Yijia, et al.
Pubblicazione: (2025)
di: Dai, Yijia, et al.
Pubblicazione: (2025)
PoeTone: A Framework for Constrained Generation of Structured Chinese Songci with LLMs
di: Qu, Zhan, et al.
Pubblicazione: (2025)
di: Qu, Zhan, et al.
Pubblicazione: (2025)
Unveiling Hidden Collaboration within Mixture-of-Experts in Large Language Models
di: Tang, Yuanbo, et al.
Pubblicazione: (2025)
di: Tang, Yuanbo, et al.
Pubblicazione: (2025)
Discovering and Reasoning of Causality in the Hidden World with Large Language Models
di: Liu, Chenxi, et al.
Pubblicazione: (2024)
di: Liu, Chenxi, et al.
Pubblicazione: (2024)
CoDy: Counterfactual Explainers for Dynamic Graphs
di: Qu, Zhan, et al.
Pubblicazione: (2024)
di: Qu, Zhan, et al.
Pubblicazione: (2024)
Disentangling Granularity: An Implicit Inductive Bias in Factorized VAEs
di: Chen, Zihao, et al.
Pubblicazione: (2025)
di: Chen, Zihao, et al.
Pubblicazione: (2025)
Implicit Bias of the JKO Scheme
di: Halmos, Peter, et al.
Pubblicazione: (2025)
di: Halmos, Peter, et al.
Pubblicazione: (2025)
DavIR: Data Selection via Implicit Reward for Large Language Models
di: Zhou, Haotian, et al.
Pubblicazione: (2023)
di: Zhou, Haotian, et al.
Pubblicazione: (2023)
Vital Trace: Protocol-Constrained Patient-State Reasoning for Longitudinal Clinical Trajectories
di: Qu, Zhan, et al.
Pubblicazione: (2026)
di: Qu, Zhan, et al.
Pubblicazione: (2026)
HiPER: Hierarchical Reinforcement Learning with Explicit Credit Assignment for Large Language Model Agents
di: Peng, Jiangweizhi, et al.
Pubblicazione: (2026)
di: Peng, Jiangweizhi, et al.
Pubblicazione: (2026)
On the Implicit Bias of Adam
di: Cattaneo, Matias D., et al.
Pubblicazione: (2023)
di: Cattaneo, Matias D., et al.
Pubblicazione: (2023)
Diminishing Stereotype Bias in Image Generation Model using Reinforcemenlent Learning Feedback
di: Chen, Xin, et al.
Pubblicazione: (2024)
di: Chen, Xin, et al.
Pubblicazione: (2024)
Beyond Parameter Count: Implicit Bias in Soft Mixture of Experts
di: Chung, Youngseog, et al.
Pubblicazione: (2024)
di: Chung, Youngseog, et al.
Pubblicazione: (2024)
DualDynamics: Synergizing Implicit and Explicit Methods for Robust Irregular Time Series Analysis
di: Oh, YongKyung, et al.
Pubblicazione: (2024)
di: Oh, YongKyung, et al.
Pubblicazione: (2024)
Self-Debiasing Large Language Models: Zero-Shot Recognition and Reduction of Stereotypes
di: Gallegos, Isabel O., et al.
Pubblicazione: (2024)
di: Gallegos, Isabel O., et al.
Pubblicazione: (2024)
Mitigating Selection Bias in Large Language Models via Permutation-Aware GRPO
di: Zheng, Jinquan, et al.
Pubblicazione: (2026)
di: Zheng, Jinquan, et al.
Pubblicazione: (2026)
SeRA: Self-Reviewing and Alignment of Large Language Models using Implicit Reward Margins
di: Ko, Jongwoo, et al.
Pubblicazione: (2024)
di: Ko, Jongwoo, et al.
Pubblicazione: (2024)
Break Out of a Pigeonhole: A Unified Framework for Examining Miscalibration, Bias, and Stereotype in Recommender Systems
di: Ahn, Yongsu, et al.
Pubblicazione: (2023)
di: Ahn, Yongsu, et al.
Pubblicazione: (2023)
Having Beer after Prayer? Measuring Cultural Bias in Large Language Models
di: Naous, Tarek, et al.
Pubblicazione: (2023)
di: Naous, Tarek, et al.
Pubblicazione: (2023)
Evaluating LLMs in Finance Requires Explicit Bias Consideration
di: Kong, Yaxuan, et al.
Pubblicazione: (2026)
di: Kong, Yaxuan, et al.
Pubblicazione: (2026)
Implicit Language Models are RNNs: Balancing Parallelization and Expressivity
di: Schöne, Mark, et al.
Pubblicazione: (2025)
di: Schöne, Mark, et al.
Pubblicazione: (2025)
Induced Numerical Instability: Hidden Costs in Multimodal Large Language Models
di: Wong, Wai Tuck, et al.
Pubblicazione: (2026)
di: Wong, Wai Tuck, et al.
Pubblicazione: (2026)
Introducing Background Temperature to Characterise Hidden Randomness in Large Language Models
di: Messina, Alberto, et al.
Pubblicazione: (2026)
di: Messina, Alberto, et al.
Pubblicazione: (2026)
Distributional Clarity: The Hidden Driver of RL-Friendliness in Large Language Models
di: Sun, Shaoning, et al.
Pubblicazione: (2026)
di: Sun, Shaoning, et al.
Pubblicazione: (2026)
Quotient Geometry, Effective Curvature, and Implicit Bias in Simple Shallow Neural Networks
di: Dong, Hang-Cheng, et al.
Pubblicazione: (2026)
di: Dong, Hang-Cheng, et al.
Pubblicazione: (2026)
ParlAI Vote: A Web Platform for Analyzing Gender and Political Bias in Large Language Models
di: Lin, Wenjie, et al.
Pubblicazione: (2025)
di: Lin, Wenjie, et al.
Pubblicazione: (2025)
Explicit Multi-head Attention for Inter-head Interaction in Large Language Models
di: Peng, Runyu, et al.
Pubblicazione: (2026)
di: Peng, Runyu, et al.
Pubblicazione: (2026)
Explicit Diversity Conditions for Effective Question Answer Generation with Large Language Models
di: Yadav, Vikas, et al.
Pubblicazione: (2024)
di: Yadav, Vikas, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Hidden Bias in the Machine: Stereotypes in Text-to-Image Models
di: Porikli, Sedat, et al.
Pubblicazione: (2025) -
AfriStereo: A Culturally Grounded Dataset for Evaluating Stereotypical Bias in Large Language Models
di: Beux, Yann Le, et al.
Pubblicazione: (2025) -
BiasEdit: Debiasing Stereotyped Language Models via Model Editing
di: Xu, Xin, et al.
Pubblicazione: (2025) -
A Taxonomy of Stereotype Content in Large Language Models
di: Nicolas, Gandalf, et al.
Pubblicazione: (2024) -
GNNavi: Navigating the Information Flow in Large Language Models by Graph Neural Network
di: Yuan, Shuzhou, et al.
Pubblicazione: (2024)