StereoTales: A Multilingual Framework for Open-Ended Stereotype Discovery in LLMs
Fuente:
arXiv
Saved in:
| Main Authors: | Jeune, Pierre Le, Duchesne, Étienne, Xiao, Weixuan, Palminteri, Stefano, Houssin, Bazire, Malézieux, Benoît, Dora, Matteo |
|---|---|
| Format: | Preprint |
| Published: |
2026
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Phare: A Safety Probe for Large Language Models
by: Jeune, Pierre Le, et al.
Published: (2025)
by: Jeune, Pierre Le, et al.
Published: (2025)
RealHarm: A Collection of Real-World Language Model Application Failures
by: Jeune, Pierre Le, et al.
Published: (2025)
by: Jeune, Pierre Le, et al.
Published: (2025)
Bias Association Discovery Framework for Open-Ended LLM Generations
by: Pan, Jinhao, et al.
Published: (2025)
by: Pan, Jinhao, et al.
Published: (2025)
PhyloLM : Inferring the Phylogeny of Large Language Models and Predicting their Performances in Benchmarks
by: Yax, Nicolas, et al.
Published: (2024)
by: Yax, Nicolas, et al.
Published: (2024)
LogProber: Disentangling confidence from contamination in LLM responses
by: Yax, Nicolas, et al.
Published: (2024)
by: Yax, Nicolas, et al.
Published: (2024)
BanStereoSet: A Dataset to Measure Stereotypical Social Biases in LLMs for Bangla
by: Kamruzzaman, Mahammed, et al.
Published: (2024)
by: Kamruzzaman, Mahammed, et al.
Published: (2024)
Surfacing Subtle Stereotypes: A Multilingual, Debate-Oriented Evaluation of Modern LLMs
by: Saeed, Muhammed, et al.
Published: (2025)
by: Saeed, Muhammed, et al.
Published: (2025)
Modelling crypto markets by multi-agent reinforcement learning
by: Lussange, Johann, et al.
Published: (2024)
by: Lussange, Johann, et al.
Published: (2024)
Evolving choice hysteresis in reinforcement learning: comparing the adaptive value of positivity bias and gradual perseveration
by: Hoxha, Isabelle, et al.
Published: (2024)
by: Hoxha, Isabelle, et al.
Published: (2024)
The Moral Turing Test: Evaluating Human-LLM Alignment in Moral Decision-Making
by: Garcia, Basile, et al.
Published: (2024)
by: Garcia, Basile, et al.
Published: (2024)
Towards Open-Ended Discovery for Low-Resource NLP
by: Dossou, Bonaventure F. P., et al.
Published: (2025)
by: Dossou, Bonaventure F. P., et al.
Published: (2025)
Probing Gender Bias in Multilingual LLMs: A Case Study of Stereotypes in Persian
by: Kalhor, Ghazal, et al.
Published: (2025)
by: Kalhor, Ghazal, et al.
Published: (2025)
Stereo Anywhere: Robust Zero-Shot Deep Stereo Matching Even Where Either Stereo or Mono Fail
by: Bartolomei, Luca, et al.
Published: (2024)
by: Bartolomei, Luca, et al.
Published: (2024)
Towards Open-Ended Visual Scientific Discovery with Sparse Autoencoders
by: Stevens, Samuel, et al.
Published: (2025)
by: Stevens, Samuel, et al.
Published: (2025)
CausalEvolve: Towards Open-Ended Discovery with Causal Scratchpad
by: Chen, Yongqiang, et al.
Published: (2026)
by: Chen, Yongqiang, et al.
Published: (2026)
GLOSS: Group of LLMs for Open-Ended Sensemaking of Passive Sensing Data for Health and Wellbeing
by: Choube, Akshat, et al.
Published: (2025)
by: Choube, Akshat, et al.
Published: (2025)
Relative Value Biases in Large Language Models
by: Hayes, William M., et al.
Published: (2024)
by: Hayes, William M., et al.
Published: (2024)
Large Language Models are Biased Reinforcement Learners
by: Hayes, William M., et al.
Published: (2024)
by: Hayes, William M., et al.
Published: (2024)
StereoDetect: Detecting Stereotypes and Anti-stereotypes the Correct Way Using Social Psychological Underpinnings
by: Shejole, Kaustubh Shivshankar, et al.
Published: (2025)
by: Shejole, Kaustubh Shivshankar, et al.
Published: (2025)
MCU: An Evaluation Framework for Open-Ended Game Agents
by: Zheng, Xinyue, et al.
Published: (2023)
by: Zheng, Xinyue, et al.
Published: (2023)
Open-Det: An Efficient Learning Framework for Open-Ended Detection
by: Cao, Guiping, et al.
Published: (2025)
by: Cao, Guiping, et al.
Published: (2025)
Purdah and Patriarchy: Evaluating and Mitigating South Asian Biases in Open-Ended Multilingual LLM Generations
by: Rinki, Mamnuya, et al.
Published: (2025)
by: Rinki, Mamnuya, et al.
Published: (2025)
Generating Planning Feedback for Open-Ended Programming Exercises with LLMs
by: Demirtaş, Mehmet Arif, et al.
Published: (2025)
by: Demirtaş, Mehmet Arif, et al.
Published: (2025)
The AI Scientist: Towards Fully Automated Open-Ended Scientific Discovery
by: Lu, Chris, et al.
Published: (2024)
by: Lu, Chris, et al.
Published: (2024)
An Adaptive Tangent Feature Perspective of Neural Networks
by: LeJeune, Daniel, et al.
Published: (2023)
by: LeJeune, Daniel, et al.
Published: (2023)
FairI Tales: Evaluation of Fairness in Indian Contexts with a Focus on Bias and Stereotypes
by: Nawale, Janki Atul, et al.
Published: (2025)
by: Nawale, Janki Atul, et al.
Published: (2025)
The Hyperfitting Phenomenon: Sharpening and Stabilizing LLMs for Open-Ended Text Generation
by: Carlsson, Fredrik, et al.
Published: (2024)
by: Carlsson, Fredrik, et al.
Published: (2024)
AfriStereo: A Culturally Grounded Dataset for Evaluating Stereotypical Bias in Large Language Models
by: Beux, Yann Le, et al.
Published: (2025)
by: Beux, Yann Le, et al.
Published: (2025)
LiDAR-Event Stereo Fusion with Hallucinations
by: Bartolomei, Luca, et al.
Published: (2024)
by: Bartolomei, Luca, et al.
Published: (2024)
SeeGULL Multilingual: a Dataset of Geo-Culturally Situated Stereotypes
by: Bhutani, Mukul, et al.
Published: (2024)
by: Bhutani, Mukul, et al.
Published: (2024)
MEDAL: A Framework for Benchmarking LLMs as Multilingual Open-Domain Dialogue Evaluators
by: Mendonça, John, et al.
Published: (2025)
by: Mendonça, John, et al.
Published: (2025)
Do Multilingual Large Language Models Mitigate Stereotype Bias?
by: Nie, Shangrui, et al.
Published: (2024)
by: Nie, Shangrui, et al.
Published: (2024)
Open-Ended Wargames with Large Language Models
by: Hogan, Daniel P., et al.
Published: (2024)
by: Hogan, Daniel P., et al.
Published: (2024)
OpenEP: Open-Ended Future Event Prediction
by: Guan, Yong, et al.
Published: (2024)
by: Guan, Yong, et al.
Published: (2024)
OpenSIR: Open-Ended Self-Improving Reasoner
by: Kwan, Wai-Chung, et al.
Published: (2025)
by: Kwan, Wai-Chung, et al.
Published: (2025)
Demystifying Multilingual Chain-of-Thought in Process Reward Modeling
by: Wang, Weixuan, et al.
Published: (2025)
by: Wang, Weixuan, et al.
Published: (2025)
Analysis and Synthesis Denoisers for Forward-Backward Plug-and-Play Algorithms
by: Kowalski, Matthieu, et al.
Published: (2024)
by: Kowalski, Matthieu, et al.
Published: (2024)
Do LLMs Exhibit Human-Like Reasoning? Evaluating Theory of Mind in LLMs for Open-Ended Responses
by: Amirizaniani, Maryam, et al.
Published: (2024)
by: Amirizaniani, Maryam, et al.
Published: (2024)
MinosEval: Distinguishing Factoid and Non-Factoid for Tailored Open-Ended QA Evaluation with LLMs
by: Fan, Yongqi, et al.
Published: (2025)
by: Fan, Yongqi, et al.
Published: (2025)
Active Stereo in the Wild through Virtual Pattern Projection
by: Bartolomei, Luca, et al.
Published: (2024)
by: Bartolomei, Luca, et al.
Published: (2024)
Similar Items
-
Phare: A Safety Probe for Large Language Models
by: Jeune, Pierre Le, et al.
Published: (2025) -
RealHarm: A Collection of Real-World Language Model Application Failures
by: Jeune, Pierre Le, et al.
Published: (2025) -
Bias Association Discovery Framework for Open-Ended LLM Generations
by: Pan, Jinhao, et al.
Published: (2025) -
PhyloLM : Inferring the Phylogeny of Large Language Models and Predicting their Performances in Benchmarks
by: Yax, Nicolas, et al.
Published: (2024) -
LogProber: Disentangling confidence from contamination in LLM responses
by: Yax, Nicolas, et al.
Published: (2024)