Evaluation of Large Language Models: STEM education and Gender Stereotypes
Fuente:
arXiv
Saved in:
| Main Authors: | Due, Smilla, Das, Sneha, Andersen, Marianne, López, Berta Plandolit, Nexø, Sniff Andersen, Clemmensen, Line |
|---|---|
| Format: | Preprint |
| Published: |
2024
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Investigating Gender Stereotypes in Large Language Models via Social Determinants of Health
by: Ngo, Trung Hieu, et al.
Published: (2026)
by: Ngo, Trung Hieu, et al.
Published: (2026)
More Women, Same Stereotypes: Unpacking the Gender Bias Paradox in Large Language Models
by: Chen, Evan, et al.
Published: (2025)
by: Chen, Evan, et al.
Published: (2025)
An Empirical Investigation of Gender Stereotype Representation in Large Language Models: The Italian Case
by: Giachino, Gioele, et al.
Published: (2025)
by: Giachino, Gioele, et al.
Published: (2025)
Intra-Fairness Dynamics: The Bias Spillover Effect in Targeted LLM Alignment
by: Paraschou, Eva, et al.
Published: (2026)
by: Paraschou, Eva, et al.
Published: (2026)
Dual Debiasing: Remove Stereotypes and Keep Factual Gender for Fair Language Modeling and Translation
by: Limisiewicz, Tomasz, et al.
Published: (2025)
by: Limisiewicz, Tomasz, et al.
Published: (2025)
Detecting Linguistic Indicators for Stereotype Assessment with Large Language Models
by: Görge, Rebekka, et al.
Published: (2025)
by: Görge, Rebekka, et al.
Published: (2025)
Knowledge-Informed Automatic Feature Extraction via Collaborative Large Language Model Agents
by: Bradland, Henrik, et al.
Published: (2025)
by: Bradland, Henrik, et al.
Published: (2025)
Analysing Differences in Persuasive Language in LLM-Generated Text: Uncovering Stereotypical Gender Patterns
by: Pauli, Amalie Brogaard, et al.
Published: (2026)
by: Pauli, Amalie Brogaard, et al.
Published: (2026)
Large Language Models Reproduce Racial Stereotypes When Used for Text Annotation
by: Törnberg, Petter
Published: (2026)
by: Törnberg, Petter
Published: (2026)
Examining Alignment of Large Language Models through Representative Heuristics: The Case of Political Stereotypes
by: Jeoung, Sullam, et al.
Published: (2025)
by: Jeoung, Sullam, et al.
Published: (2025)
A Taxonomy of Stereotype Content in Large Language Models
by: Nicolas, Gandalf, et al.
Published: (2024)
by: Nicolas, Gandalf, et al.
Published: (2024)
AfriStereo: A Culturally Grounded Dataset for Evaluating Stereotypical Bias in Large Language Models
by: Beux, Yann Le, et al.
Published: (2025)
by: Beux, Yann Le, et al.
Published: (2025)
Investigating Gender Bias in LLM-Generated Stories via Psychological Stereotypes
by: Masoudian, Shahed, et al.
Published: (2025)
by: Masoudian, Shahed, et al.
Published: (2025)
Blind Men and the Elephant: Diverse Perspectives on Gender Stereotypes in Benchmark Datasets
by: Zakizadeh, Mahdi, et al.
Published: (2025)
by: Zakizadeh, Mahdi, et al.
Published: (2025)
Still Not Quite There! Evaluating Large Language Models for Comorbid Mental Health Diagnosis
by: Hengle, Amey, et al.
Published: (2024)
by: Hengle, Amey, et al.
Published: (2024)
A Stereotype Content Analysis on Color-related Social Bias in Large Vision Language Models
by: Choi, Junhyuk, et al.
Published: (2025)
by: Choi, Junhyuk, et al.
Published: (2025)
STEMVerse: A Dual-Axis Diagnostic Framework for STEM Reasoning in Large Language Models
by: Li, Xuzhao, et al.
Published: (2026)
by: Li, Xuzhao, et al.
Published: (2026)
GenderAlign: An Alignment Dataset for Mitigating Gender Bias in Large Language Models
by: Zhang, Tao, et al.
Published: (2024)
by: Zhang, Tao, et al.
Published: (2024)
DCR-Consistency: Divide-Conquer-Reasoning for Consistency Evaluation and Improvement of Large Language Models
by: Cui, Wendi, et al.
Published: (2024)
by: Cui, Wendi, et al.
Published: (2024)
REFINE-LM: Mitigating Language Model Stereotypes via Reinforcement Learning
by: Qureshi, Rameez, et al.
Published: (2024)
by: Qureshi, Rameez, et al.
Published: (2024)
Identifying Gender Stereotypes and Biases in Automated Translation from English to Italian using Similarity Networks
by: Mohammadi, Fatemeh, et al.
Published: (2025)
by: Mohammadi, Fatemeh, et al.
Published: (2025)
Locating and Mitigating Gender Bias in Large Language Models
by: Cai, Yuchen, et al.
Published: (2024)
by: Cai, Yuchen, et al.
Published: (2024)
Gender Stereotypes in Professional Roles Among Saudis: An Analytical Study of AI-Generated Images Using Language Models
by: AlKhalifah, Khaloud S., et al.
Published: (2025)
by: AlKhalifah, Khaloud S., et al.
Published: (2025)
Self-Debiasing Large Language Models: Zero-Shot Recognition and Reduction of Stereotypes
by: Gallegos, Isabel O., et al.
Published: (2024)
by: Gallegos, Isabel O., et al.
Published: (2024)
The LLM Wears Prada: Analysing Gender Bias and Stereotypes through Online Shopping Data
by: Luca, Massimiliano, et al.
Published: (2025)
by: Luca, Massimiliano, et al.
Published: (2025)
GenderCARE: A Comprehensive Framework for Assessing and Reducing Gender Bias in Large Language Models
by: Tang, Kunsheng, et al.
Published: (2024)
by: Tang, Kunsheng, et al.
Published: (2024)
A New HOPE: Domain-agnostic Automatic Evaluation of Text Chunking
by: Brådland, Henrik, et al.
Published: (2025)
by: Brådland, Henrik, et al.
Published: (2025)
The Cost-Benefit of Interdisciplinarity in AI for Mental Health
by: Drakos, Katerina, et al.
Published: (2025)
by: Drakos, Katerina, et al.
Published: (2025)
Gender Bias in Machine Translation and The Era of Large Language Models
by: Vanmassenhove, Eva
Published: (2024)
by: Vanmassenhove, Eva
Published: (2024)
Inclusivity in Large Language Models: Personality Traits and Gender Bias in Scientific Abstracts
by: Pervez, Naseela, et al.
Published: (2024)
by: Pervez, Naseela, et al.
Published: (2024)
AraSTEM: A Native Arabic Multiple Choice Question Benchmark for Evaluating LLMs Knowledge In STEM Subjects
by: Mustapha, Ahmad, et al.
Published: (2024)
by: Mustapha, Ahmad, et al.
Published: (2024)
Using Large Language Models for education managements in Vietnamese with low resources
by: Minh, Duc Do, et al.
Published: (2025)
by: Minh, Duc Do, et al.
Published: (2025)
Measuring What VLMs Don't Say: Validation Metrics Hide Clinical Terminology Erasure in Radiology Report Generation
by: Parikh, Aditya, et al.
Published: (2026)
by: Parikh, Aditya, et al.
Published: (2026)
BiasEdit: Debiasing Stereotyped Language Models via Model Editing
by: Xu, Xin, et al.
Published: (2025)
by: Xu, Xin, et al.
Published: (2025)
Evaluating Quantized Large Language Models
by: Li, Shiyao, et al.
Published: (2024)
by: Li, Shiyao, et al.
Published: (2024)
LFTF: Locating First and Then Fine-Tuning for Mitigating Gender Bias in Large Language Models
by: Qin, Zhanyue, et al.
Published: (2025)
by: Qin, Zhanyue, et al.
Published: (2025)
Auto-Search and Refinement: An Automated Framework for Gender Bias Mitigation in Large Language Models
by: Xu, Yue, et al.
Published: (2025)
by: Xu, Yue, et al.
Published: (2025)
Continual-learning for Modelling Low-Resource Languages from Large Language Models
by: K, Santosh Srinath, et al.
Published: (2026)
by: K, Santosh Srinath, et al.
Published: (2026)
SPUQ: Perturbation-Based Uncertainty Quantification for Large Language Models
by: Gao, Xiang, et al.
Published: (2024)
by: Gao, Xiang, et al.
Published: (2024)
Measuring Vision-Language STEM Skills of Neural Models
by: Shen, Jianhao, et al.
Published: (2024)
by: Shen, Jianhao, et al.
Published: (2024)
Similar Items
-
Investigating Gender Stereotypes in Large Language Models via Social Determinants of Health
by: Ngo, Trung Hieu, et al.
Published: (2026) -
More Women, Same Stereotypes: Unpacking the Gender Bias Paradox in Large Language Models
by: Chen, Evan, et al.
Published: (2025) -
An Empirical Investigation of Gender Stereotype Representation in Large Language Models: The Italian Case
by: Giachino, Gioele, et al.
Published: (2025) -
Intra-Fairness Dynamics: The Bias Spillover Effect in Targeted LLM Alignment
by: Paraschou, Eva, et al.
Published: (2026) -
Dual Debiasing: Remove Stereotypes and Keep Factual Gender for Fair Language Modeling and Translation
by: Limisiewicz, Tomasz, et al.
Published: (2025)