Bias Attribution in Filipino Language Models: Extending a Bias Interpretability Metric for Application on Agglutinative Languages
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Gamboa, Lance Calvin Lim, Feng, Yue, Lee, Mark |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Robust Bias Evaluation with FilBBQ: A Filipino Bias Benchmark for Question-Answering Language Models
par: Gamboa, Lance Calvin Lim, et autres
Publié: (2026)
par: Gamboa, Lance Calvin Lim, et autres
Publié: (2026)
A Novel Interpretability Metric for Explaining Bias in Language Models: Applications on Multilingual Models from Southeast Asia
par: Gamboa, Lance Calvin Lim, et autres
Publié: (2024)
par: Gamboa, Lance Calvin Lim, et autres
Publié: (2024)
Filipino Benchmarks for Measuring Sexist and Homophobic Bias in Multilingual Language Models from Southeast Asia
par: Gamboa, Lance Calvin Lim, et autres
Publié: (2024)
par: Gamboa, Lance Calvin Lim, et autres
Publié: (2024)
Social Bias in Multilingual Language Models: A Survey
par: Gamboa, Lance Calvin Lim, et autres
Publié: (2025)
par: Gamboa, Lance Calvin Lim, et autres
Publié: (2025)
Interpreting Bias in Large Language Models: A Feature-Based Approach
par: Prakash, Nirmalendu, et autres
Publié: (2024)
par: Prakash, Nirmalendu, et autres
Publié: (2024)
Talent or Luck? Evaluating Attribution Bias in Large Language Models
par: Raj, Chahat, et autres
Publié: (2025)
par: Raj, Chahat, et autres
Publié: (2025)
Large Language Models Portray Socially Subordinate Groups as More Homogeneous, Consistent with a Bias Observed in Humans
par: Lee, Messi H. J., et autres
Publié: (2024)
par: Lee, Messi H. J., et autres
Publié: (2024)
Gender Bias in Emotion Recognition by Large Language Models
par: Herbert, Maureen, et autres
Publié: (2025)
par: Herbert, Maureen, et autres
Publié: (2025)
Exploring the Jungle of Bias: Political Bias Attribution in Language Models via Dependency Analysis
par: Jenny, David F., et autres
Publié: (2023)
par: Jenny, David F., et autres
Publié: (2023)
Bias in, Bias out: Annotation Bias in Multilingual Large Language Models
par: Cui, Xia, et autres
Publié: (2025)
par: Cui, Xia, et autres
Publié: (2025)
Evaluation of Attribution Bias in Generator-Aware Retrieval-Augmented Large Language Models
par: Abolghasemi, Amin, et autres
Publié: (2024)
par: Abolghasemi, Amin, et autres
Publié: (2024)
Towards Resource Efficient and Interpretable Bias Mitigation in Large Language Models
par: Tong, Schrasing, et autres
Publié: (2024)
par: Tong, Schrasing, et autres
Publié: (2024)
Assessing Political Bias in Large Language Models
par: Rettenberger, Luca, et autres
Publié: (2024)
par: Rettenberger, Luca, et autres
Publié: (2024)
VerChol -- Grammar-First Tokenization for Agglutinative Languages
par: Raja, Prabhu
Publié: (2026)
par: Raja, Prabhu
Publié: (2026)
KatotohananQA: Evaluating Truthfulness of Large Language Models in Filipino
par: Nery, Lorenzo Alfred, et autres
Publié: (2025)
par: Nery, Lorenzo Alfred, et autres
Publié: (2025)
Probability of Differentiation Reveals Brittleness of Homogeneity Bias in GPT-4
par: Lee, Messi H. J., et autres
Publié: (2024)
par: Lee, Messi H. J., et autres
Publié: (2024)
Acquiescence Bias in Large Language Models
par: Braun, Daniel
Publié: (2025)
par: Braun, Daniel
Publié: (2025)
Measuring Agreeableness Bias in Multimodal Models
par: Lim, Jaehyuk, et autres
Publié: (2024)
par: Lim, Jaehyuk, et autres
Publié: (2024)
Bi-directional Bias Attribution: Debiasing Large Language Models without Modifying Prompts
par: Lin, Yujie, et autres
Publié: (2026)
par: Lin, Yujie, et autres
Publié: (2026)
Surface Fairness, Deep Bias: A Comparative Study of Bias in Language Models
par: Sorokovikova, Aleksandra, et autres
Publié: (2025)
par: Sorokovikova, Aleksandra, et autres
Publié: (2025)
Open-DeBias: Toward Mitigating Open-Set Bias in Language Models
par: Rani, Arti, et autres
Publié: (2025)
par: Rani, Arti, et autres
Publié: (2025)
BiasDPO: Mitigating Bias in Language Models through Direct Preference Optimization
par: Allam, Ahmed
Publié: (2024)
par: Allam, Ahmed
Publié: (2024)
Marvelous Agglutinative Language Effect on Cross Lingual Transfer Learning
par: Kim, Wooyoung, et autres
Publié: (2022)
par: Kim, Wooyoung, et autres
Publié: (2022)
KLAAD: Refining Attention Mechanisms to Reduce Societal Bias in Generative Language Models
par: Kim, Seorin, et autres
Publié: (2025)
par: Kim, Seorin, et autres
Publié: (2025)
Detecting Bias in Large Language Models: Fine-tuned KcBERT
par: Lee, J. K., et autres
Publié: (2024)
par: Lee, J. K., et autres
Publié: (2024)
RuBia: A Russian Language Bias Detection Dataset
par: Grigoreva, Veronika, et autres
Publié: (2024)
par: Grigoreva, Veronika, et autres
Publié: (2024)
BiasGuard: A Reasoning-enhanced Bias Detection Tool For Large Language Models
par: Fan, Zhiting, et autres
Publié: (2025)
par: Fan, Zhiting, et autres
Publié: (2025)
Bias A-head? Analyzing Bias in Transformer-Based Language Model Attention Heads
par: Yang, Yi, et autres
Publié: (2023)
par: Yang, Yi, et autres
Publié: (2023)
Social Bias in Large Language Models For Bangla: An Empirical Study on Gender and Religious Bias
par: Sadhu, Jayanta, et autres
Publié: (2024)
par: Sadhu, Jayanta, et autres
Publié: (2024)
Gender Bias in Large Language Models across Multiple Languages
par: Zhao, Jinman, et autres
Publié: (2024)
par: Zhao, Jinman, et autres
Publié: (2024)
Evaluating Gender Bias in Large Language Models
par: Döll, Michael, et autres
Publié: (2024)
par: Döll, Michael, et autres
Publié: (2024)
Mitigating the Bias of Large Language Model Evaluation
par: Zhou, Hongli, et autres
Publié: (2024)
par: Zhou, Hongli, et autres
Publié: (2024)
Investigating Gender Bias in Turkish Language Models
par: Caglidil, Orhun Mersin, et autres
Publié: (2024)
par: Caglidil, Orhun Mersin, et autres
Publié: (2024)
Assessing Bias in Metric Models for LLM Open-Ended Generation Bias Benchmarks
par: Demchak, Nathaniel, et autres
Publié: (2024)
par: Demchak, Nathaniel, et autres
Publié: (2024)
Cross-Language Bias Examination in Large Language Models
par: Liang, Yuxuan, et autres
Publié: (2025)
par: Liang, Yuxuan, et autres
Publié: (2025)
Regional Bias in Large Language Models
par: Gopinadh, M P V S, et autres
Publié: (2026)
par: Gopinadh, M P V S, et autres
Publié: (2026)
Deontological Keyword Bias: The Impact of Modal Expressions on Normative Judgments of Language Models
par: Park, Bumjin, et autres
Publié: (2025)
par: Park, Bumjin, et autres
Publié: (2025)
Evaluating Metrics for Bias in Word Embeddings
par: Schröder, Sarah, et autres
Publié: (2021)
par: Schröder, Sarah, et autres
Publié: (2021)
On Bias and Fairness in NLP: Investigating the Impact of Bias and Debiasing in Language Models on the Fairness of Toxicity Detection
par: Elsafoury, Fatma, et autres
Publié: (2023)
par: Elsafoury, Fatma, et autres
Publié: (2023)
Large Means Left: Political Bias in Large Language Models Increases with Their Number of Parameters
par: Exler, David, et autres
Publié: (2025)
par: Exler, David, et autres
Publié: (2025)
Documents similaires
-
Robust Bias Evaluation with FilBBQ: A Filipino Bias Benchmark for Question-Answering Language Models
par: Gamboa, Lance Calvin Lim, et autres
Publié: (2026) -
A Novel Interpretability Metric for Explaining Bias in Language Models: Applications on Multilingual Models from Southeast Asia
par: Gamboa, Lance Calvin Lim, et autres
Publié: (2024) -
Filipino Benchmarks for Measuring Sexist and Homophobic Bias in Multilingual Language Models from Southeast Asia
par: Gamboa, Lance Calvin Lim, et autres
Publié: (2024) -
Social Bias in Multilingual Language Models: A Survey
par: Gamboa, Lance Calvin Lim, et autres
Publié: (2025) -
Interpreting Bias in Large Language Models: A Feature-Based Approach
par: Prakash, Nirmalendu, et autres
Publié: (2024)