REFINE-LM: Mitigating Language Model Stereotypes via Reinforcement Learning
Fuente:
arXiv
Saved in:
| Main Authors: | Qureshi, Rameez, Es-Sebbani, Naïm, Galárraga, Luis, Graham, Yvette, Couceiro, Miguel, Bouraoui, Zied |
|---|---|
| Format: | Preprint |
| Published: |
2024
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Evaluating Robustness of Reasoning Models on Parameterized Logical Problems
by: Es-sebbani, Naïm, et al.
Published: (2026)
by: Es-sebbani, Naïm, et al.
Published: (2026)
The Balancing Act: Unmasking and Alleviating ASR Biases in Portuguese
by: Kulkarni, Ajinkya, et al.
Published: (2024)
by: Kulkarni, Ajinkya, et al.
Published: (2024)
Skim-Aware Contrastive Learning for Efficient Document Representation
by: Abro, Waheed Ahmed, et al.
Published: (2025)
by: Abro, Waheed Ahmed, et al.
Published: (2025)
Grounding Agent Reasoning in Image Schemas: A Neurosymbolic Approach to Embodied Cognition
by: Olivier, François, et al.
Published: (2025)
by: Olivier, François, et al.
Published: (2025)
Towards a Neurosymbolic Reasoning System Grounded in Schematic Representations
by: Olivier, François, et al.
Published: (2025)
by: Olivier, François, et al.
Published: (2025)
Generalizing Analogical Inference from Boolean to Continuous Domains
by: Cunha, Francisco, et al.
Published: (2025)
by: Cunha, Francisco, et al.
Published: (2025)
Modelling Commonsense Commonalities with Multi-Facet Concept Embeddings
by: Kteich, Hanane, et al.
Published: (2024)
by: Kteich, Hanane, et al.
Published: (2024)
Credal Concept Bottleneck Models for Epistemic-Aleatoric Uncertainty Decomposition
by: Mukherjee, Tanmoy, et al.
Published: (2026)
by: Mukherjee, Tanmoy, et al.
Published: (2026)
MODE: Multi-Objective Adaptive Coreset Selection
by: Mukherjee, Tanmoy, et al.
Published: (2025)
by: Mukherjee, Tanmoy, et al.
Published: (2025)
Investigating Gender Stereotypes in Large Language Models via Social Determinants of Health
by: Ngo, Trung Hieu, et al.
Published: (2026)
by: Ngo, Trung Hieu, et al.
Published: (2026)
Solving morphological analogies: from retrieval to generation
by: Marquer, Esteban, et al.
Published: (2023)
by: Marquer, Esteban, et al.
Published: (2023)
Evaluation of Large Language Models: STEM education and Gender Stereotypes
by: Due, Smilla, et al.
Published: (2024)
by: Due, Smilla, et al.
Published: (2024)
Detecting Linguistic Indicators for Stereotype Assessment with Large Language Models
by: Görge, Rebekka, et al.
Published: (2025)
by: Görge, Rebekka, et al.
Published: (2025)
Credal Concept Bottleneck Models: Structural Separation of Epistemic and Aleatoric Uncertainty
by: Mukherjee, Tanmoy, et al.
Published: (2026)
by: Mukherjee, Tanmoy, et al.
Published: (2026)
KG-BiLM: Knowledge Graph Embedding via Bidirectional Language Models
by: Chen, Zirui, et al.
Published: (2025)
by: Chen, Zirui, et al.
Published: (2025)
FlowLM: Few-Step Language Modeling via Diffusion-to-Flow Adaptation
by: Zhang, Runzhe, et al.
Published: (2026)
by: Zhang, Runzhe, et al.
Published: (2026)
KaLM: Knowledge-aligned Autoregressive Language Modeling via Dual-view Knowledge Graph Contrastive Learning
by: Yu, Peng, et al.
Published: (2024)
by: Yu, Peng, et al.
Published: (2024)
Episodic Memories Generation and Evaluation Benchmark for Large Language Models
by: Huet, Alexis, et al.
Published: (2025)
by: Huet, Alexis, et al.
Published: (2025)
Vector Field Oriented Diffusion Model for Crystal Material Generation
by: Klipfel, Astrid, et al.
Published: (2023)
by: Klipfel, Astrid, et al.
Published: (2023)
Large Language Models Reproduce Racial Stereotypes When Used for Text Annotation
by: Törnberg, Petter
Published: (2026)
by: Törnberg, Petter
Published: (2026)
BiasEdit: Debiasing Stereotyped Language Models via Model Editing
by: Xu, Xin, et al.
Published: (2025)
by: Xu, Xin, et al.
Published: (2025)
CogLM: Tracking Cognitive Development of Large Language Models
by: Wang, Xinglin, et al.
Published: (2024)
by: Wang, Xinglin, et al.
Published: (2024)
PonderLM: Pretraining Language Models to Ponder in Continuous Space
by: Zeng, Boyi, et al.
Published: (2025)
by: Zeng, Boyi, et al.
Published: (2025)
SensorLM: Learning the Language of Wearable Sensors
by: Zhang, Yuwei, et al.
Published: (2025)
by: Zhang, Yuwei, et al.
Published: (2025)
Language corpora for the Dutch medical domain
by: van Es, B.
Published: (2026)
by: van Es, B.
Published: (2026)
More Women, Same Stereotypes: Unpacking the Gender Bias Paradox in Large Language Models
by: Chen, Evan, et al.
Published: (2025)
by: Chen, Evan, et al.
Published: (2025)
Dual Debiasing: Remove Stereotypes and Keep Factual Gender for Fair Language Modeling and Translation
by: Limisiewicz, Tomasz, et al.
Published: (2025)
by: Limisiewicz, Tomasz, et al.
Published: (2025)
Examining Alignment of Large Language Models through Representative Heuristics: The Case of Political Stereotypes
by: Jeoung, Sullam, et al.
Published: (2025)
by: Jeoung, Sullam, et al.
Published: (2025)
UrduLM: A Resource-Efficient Monolingual Urdu Language Model
by: Ali, Syed Muhammad, et al.
Published: (2026)
by: Ali, Syed Muhammad, et al.
Published: (2026)
JudgeLM: Fine-tuned Large Language Models are Scalable Judges
by: Zhu, Lianghui, et al.
Published: (2023)
by: Zhu, Lianghui, et al.
Published: (2023)
Language Models Learn Constructional Semantics, Not To Mention Syntax: Investigating LM Understanding of Paired-Focus Constructions
by: Scivetti, Wesley, et al.
Published: (2026)
by: Scivetti, Wesley, et al.
Published: (2026)
DiffLM: Controllable Synthetic Data Generation via Diffusion Language Models
by: Zhou, Ying, et al.
Published: (2024)
by: Zhou, Ying, et al.
Published: (2024)
IntroLM: Introspective Language Models via Prefilling-Time Self-Evaluation
by: Kasnavieh, Hossein Hosseini, et al.
Published: (2026)
by: Kasnavieh, Hossein Hosseini, et al.
Published: (2026)
FrameNet Semantic Role Classification by Analogy
by: Ngo, Van-Duy, et al.
Published: (2026)
by: Ngo, Van-Duy, et al.
Published: (2026)
MachineLearningLM: Scaling Many-shot In-context Learning via Continued Pretraining
by: Dong, Haoyu, et al.
Published: (2025)
by: Dong, Haoyu, et al.
Published: (2025)
A Stereotype Content Analysis on Color-related Social Bias in Large Vision Language Models
by: Choi, Junhyuk, et al.
Published: (2025)
by: Choi, Junhyuk, et al.
Published: (2025)
Overview of the First Workshop on Language Models for Low-Resource Languages (LoResLM 2025)
by: Hettiarachchi, Hansi, et al.
Published: (2024)
by: Hettiarachchi, Hansi, et al.
Published: (2024)
LM-Infinite: Zero-Shot Extreme Length Generalization for Large Language Models
by: Han, Chi, et al.
Published: (2023)
by: Han, Chi, et al.
Published: (2023)
Foundation CAN LM: A Pretrained Language Model For Automotive CAN Data
by: Esashi, Akiharu, et al.
Published: (2026)
by: Esashi, Akiharu, et al.
Published: (2026)
SyllableLM: Learning Coarse Semantic Units for Speech Language Models
by: Baade, Alan, et al.
Published: (2024)
by: Baade, Alan, et al.
Published: (2024)
Similar Items
-
Evaluating Robustness of Reasoning Models on Parameterized Logical Problems
by: Es-sebbani, Naïm, et al.
Published: (2026) -
The Balancing Act: Unmasking and Alleviating ASR Biases in Portuguese
by: Kulkarni, Ajinkya, et al.
Published: (2024) -
Skim-Aware Contrastive Learning for Efficient Document Representation
by: Abro, Waheed Ahmed, et al.
Published: (2025) -
Grounding Agent Reasoning in Image Schemas: A Neurosymbolic Approach to Embodied Cognition
by: Olivier, François, et al.
Published: (2025) -
Towards a Neurosymbolic Reasoning System Grounded in Schematic Representations
by: Olivier, François, et al.
Published: (2025)