Are LLMs (Really) Ideological? An IRT-based Analysis and Alignment Tool for Perceived Socio-Economic Bias in LLMs
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Wachter, Jasmin, Radloff, Michael, Smolej, Maja, Kinder-Kurlanda, Katharina |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Perceived Political Bias in LLMs Reduces Persuasive Abilities
par: DiGiuseppe, Matthew, et autres
Publié: (2026)
par: DiGiuseppe, Matthew, et autres
Publié: (2026)
Ideological Bias in LLMs' Economic Causal Reasoning
par: Lee, Donggyu, et autres
Publié: (2026)
par: Lee, Donggyu, et autres
Publié: (2026)
EtiCor++: Towards Understanding Etiquettical Bias in LLMs
par: Dwivedi, Ashutosh, et autres
Publié: (2025)
par: Dwivedi, Ashutosh, et autres
Publié: (2025)
Mitigating Gender Bias via Fostering Exploratory Thinking in LLMs
par: Wei, Kangda, et autres
Publié: (2025)
par: Wei, Kangda, et autres
Publié: (2025)
Widespread Gender and Pronoun Bias in Moral Judgments Across LLMs
par: Fernandes, Gustavo Lúcius, et autres
Publié: (2026)
par: Fernandes, Gustavo Lúcius, et autres
Publié: (2026)
Fluent but Foreign: Even Regional LLMs Lack Cultural Alignment
par: Agarwal, Dhruv, et autres
Publié: (2025)
par: Agarwal, Dhruv, et autres
Publié: (2025)
Different Bias Under Different Criteria: Assessing Bias in LLMs with a Fact-Based Approach
par: Ko, Changgeon, et autres
Publié: (2024)
par: Ko, Changgeon, et autres
Publié: (2024)
Controlling Cloze-test Question Item Difficulty with PLM-based Surrogate Models for IRT Assessment
par: Zhang, Jingshen, et autres
Publié: (2024)
par: Zhang, Jingshen, et autres
Publié: (2024)
Measuring Teaching with LLMs
par: Hardy, Michael
Publié: (2025)
par: Hardy, Michael
Publié: (2025)
Break the Checkbox: Challenging Closed-Style Evaluations of Cultural Alignment in LLMs
par: Kabir, Mohsinul, et autres
Publié: (2025)
par: Kabir, Mohsinul, et autres
Publié: (2025)
Fake Alignment: Are LLMs Really Aligned Well?
par: Wang, Yixu, et autres
Publié: (2023)
par: Wang, Yixu, et autres
Publié: (2023)
Position is Power: System Prompts as a Mechanism of Bias in Large Language Models (LLMs)
par: Neumann, Anna, et autres
Publié: (2025)
par: Neumann, Anna, et autres
Publié: (2025)
PICACO: Pluralistic In-Context Value Alignment of LLMs via Total Correlation Optimization
par: Jiang, Han, et autres
Publié: (2025)
par: Jiang, Han, et autres
Publié: (2025)
Multilingual != Multicultural: Evaluating Gaps Between Multilingual Capabilities and Cultural Alignment in LLMs
par: Rystrøm, Jonathan, et autres
Publié: (2025)
par: Rystrøm, Jonathan, et autres
Publié: (2025)
Red Teaming LLMs as Socio-Technical Practice: From Exploration and Data Creation to Evaluation
par: Garcia, Adriana Alvarado, et autres
Publié: (2026)
par: Garcia, Adriana Alvarado, et autres
Publié: (2026)
Gender Bias in LLMs: Preliminary Evidence from Shared Parenting Scenario in Czech Family Law
par: Harasta, Jakub, et autres
Publié: (2026)
par: Harasta, Jakub, et autres
Publié: (2026)
LLMs as Strategic Actors: Behavioral Alignment, Risk Calibration, and Argumentation Framing in Geopolitical Simulations
par: Solopova, Veronika, et autres
Publié: (2026)
par: Solopova, Veronika, et autres
Publié: (2026)
Ask LLMs Directly, "What shapes your bias?": Measuring Social Bias in Large Language Models
par: Shin, Jisu, et autres
Publié: (2024)
par: Shin, Jisu, et autres
Publié: (2024)
A Comprehensive Survey of Bias in LLMs: Current Landscape and Future Directions
par: Ranjan, Rajesh, et autres
Publié: (2024)
par: Ranjan, Rajesh, et autres
Publié: (2024)
EulerESG: Automating ESG Disclosure Analysis with LLMs
par: Ding, Yi, et autres
Publié: (2025)
par: Ding, Yi, et autres
Publié: (2025)
Do LLMs Know Tool Irrelevance? Demystifying Structural Alignment Bias in Tool Invocations
par: Liu, Yilong, et autres
Publié: (2026)
par: Liu, Yilong, et autres
Publié: (2026)
Assessing the Performance of Human-Capable LLMs -- Are LLMs Coming for Your Job?
par: Mavi, John, et autres
Publié: (2024)
par: Mavi, John, et autres
Publié: (2024)
Can LLMs Estimate Student Struggles? Human-AI Difficulty Alignment with Proficiency Simulation for Item Difficulty Prediction
par: Li, Ming, et autres
Publié: (2025)
par: Li, Ming, et autres
Publié: (2025)
Bias Beyond Borders: Political Ideology Evaluation and Steering in Multilingual LLMs
par: Nadeem, Afrozah, et autres
Publié: (2026)
par: Nadeem, Afrozah, et autres
Publié: (2026)
The simulation of judgment in LLMs
par: Loru, Edoardo, et autres
Publié: (2025)
par: Loru, Edoardo, et autres
Publié: (2025)
The Political Preferences of LLMs
par: Rozado, David
Publié: (2024)
par: Rozado, David
Publié: (2024)
Aligned but Blind: Alignment Increases Implicit Bias by Reducing Awareness of Race
par: Sun, Lihao, et autres
Publié: (2025)
par: Sun, Lihao, et autres
Publié: (2025)
Why are all LLMs Obsessed with Japanese Culture? On the Hidden Cultural and Regional Biases of LLMs
par: de Landa, Joseba Fernandez, et autres
Publié: (2026)
par: de Landa, Joseba Fernandez, et autres
Publié: (2026)
When Style Breaks Safety: Defending LLMs Against Superficial Style Alignment
par: Xiao, Yuxin, et autres
Publié: (2025)
par: Xiao, Yuxin, et autres
Publié: (2025)
Moral Mazes in the Era of LLMs
par: Nguyen, Dang, et autres
Publié: (2026)
par: Nguyen, Dang, et autres
Publié: (2026)
Culturally Grounded Personas in Large Language Models: Characterization and Alignment with Socio-Psychological Value Frameworks
par: Greco, Candida M., et autres
Publié: (2026)
par: Greco, Candida M., et autres
Publié: (2026)
Interpretability Framework for LLMs in Undergraduate Calculus
par: Dakshit, Sagnik, et autres
Publié: (2025)
par: Dakshit, Sagnik, et autres
Publié: (2025)
Unsupervised Concept Vector Extraction for Bias Control in LLMs
par: Cyberey, Hannah, et autres
Publié: (2025)
par: Cyberey, Hannah, et autres
Publié: (2025)
Understanding The Effect Of Temperature On Alignment With Human Opinions
par: Pavlovic, Maja, et autres
Publié: (2024)
par: Pavlovic, Maja, et autres
Publié: (2024)
Political Alignment in Large Language Models: A Multidimensional Audit of Psychometric Identity and Behavioral Bias
par: Sakhawat, Adib, et autres
Publié: (2026)
par: Sakhawat, Adib, et autres
Publié: (2026)
On the Credibility of Evaluating LLMs using Survey Questions
par: Libovický, Jindřich
Publié: (2026)
par: Libovický, Jindřich
Publié: (2026)
Verbalizing LLMs' assumptions to explain and control sycophancy
par: Cheng, Myra, et autres
Publié: (2026)
par: Cheng, Myra, et autres
Publié: (2026)
Misaligned by Reward: Socially Undesirable Preferences in LLMs
par: Ghazaryan, Gayane, et autres
Publié: (2026)
par: Ghazaryan, Gayane, et autres
Publié: (2026)
MEDEQUALQA: Evaluating Biases in LLMs with Counterfactual Reasoning
par: Ghosh, Rajarshi, et autres
Publié: (2025)
par: Ghosh, Rajarshi, et autres
Publié: (2025)
ELEPHANT: Measuring and understanding social sycophancy in LLMs
par: Cheng, Myra, et autres
Publié: (2025)
par: Cheng, Myra, et autres
Publié: (2025)
Documents similaires
-
Perceived Political Bias in LLMs Reduces Persuasive Abilities
par: DiGiuseppe, Matthew, et autres
Publié: (2026) -
Ideological Bias in LLMs' Economic Causal Reasoning
par: Lee, Donggyu, et autres
Publié: (2026) -
EtiCor++: Towards Understanding Etiquettical Bias in LLMs
par: Dwivedi, Ashutosh, et autres
Publié: (2025) -
Mitigating Gender Bias via Fostering Exploratory Thinking in LLMs
par: Wei, Kangda, et autres
Publié: (2025) -
Widespread Gender and Pronoun Bias in Moral Judgments Across LLMs
par: Fernandes, Gustavo Lúcius, et autres
Publié: (2026)