Evaluating Nuanced Bias in Large Language Model Free Response Answers
Fuente:
arXiv
Salvato in:
| Autori principali: | Healey, Jennifer, Byrum, Laurie, Akhtar, Md Nadeem, Sinha, Moumita |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Developing A Framework to Support Human Evaluation of Bias in Generated Free Response Text
di: Healey, Jennifer, et al.
Pubblicazione: (2025)
di: Healey, Jennifer, et al.
Pubblicazione: (2025)
Beyond Keywords: Evaluating Large Language Model Classification of Nuanced Ableism
di: Rizvi, Naba, et al.
Pubblicazione: (2025)
di: Rizvi, Naba, et al.
Pubblicazione: (2025)
No perspective, no perception!! Perspective-aware Healthcare Answer Summarization
di: Naik, Gauri, et al.
Pubblicazione: (2024)
di: Naik, Gauri, et al.
Pubblicazione: (2024)
BiasFreeBench: a Benchmark for Mitigating Bias in Large Language Model Responses
di: Xu, Xin, et al.
Pubblicazione: (2025)
di: Xu, Xin, et al.
Pubblicazione: (2025)
No LLM is Free From Bias: A Comprehensive Study of Bias Evaluation in Large Language Models
di: Kumar, Charaka Vinayak, et al.
Pubblicazione: (2025)
di: Kumar, Charaka Vinayak, et al.
Pubblicazione: (2025)
Knowledge Planning in Large Language Models for Domain-Aligned Counseling Summarization
di: Srivastava, Aseem, et al.
Pubblicazione: (2024)
di: Srivastava, Aseem, et al.
Pubblicazione: (2024)
Do Large Language Models Plan Answer Positions? Position Bias in Multiple-Choice Question Generation
di: Tang, Xuemei, et al.
Pubblicazione: (2026)
di: Tang, Xuemei, et al.
Pubblicazione: (2026)
Evaluating Gender Bias in Large Language Models
di: Döll, Michael, et al.
Pubblicazione: (2024)
di: Döll, Michael, et al.
Pubblicazione: (2024)
Mitigating the Bias of Large Language Model Evaluation
di: Zhou, Hongli, et al.
Pubblicazione: (2024)
di: Zhou, Hongli, et al.
Pubblicazione: (2024)
A Novel Nuanced Conversation Evaluation Framework for Large Language Models in Mental Health
di: Marrapese, Alexander, et al.
Pubblicazione: (2024)
di: Marrapese, Alexander, et al.
Pubblicazione: (2024)
Clarification Is Not Enough: Post-Clarification Answering Remains the Bottleneck in Multi-Turn QA
di: Su, Jinyan, et al.
Pubblicazione: (2026)
di: Su, Jinyan, et al.
Pubblicazione: (2026)
SNFinLLM: Systematic and Nuanced Financial Domain Adaptation of Chinese Large Language Models
di: Zhao, Shujuan, et al.
Pubblicazione: (2024)
di: Zhao, Shujuan, et al.
Pubblicazione: (2024)
On the Impact of Language Nuances on Sentiment Analysis with Large Language Models: Paraphrasing, Sarcasm, and Emojis
di: Bhargava, Naman, et al.
Pubblicazione: (2025)
di: Bhargava, Naman, et al.
Pubblicazione: (2025)
Evaluation Methodology for Large Language Models for Multilingual Document Question and Answer
di: Kahana, Adar, et al.
Pubblicazione: (2024)
di: Kahana, Adar, et al.
Pubblicazione: (2024)
The Illusionist's Prompt: Exposing the Factual Vulnerabilities of Large Language Models with Linguistic Nuances
di: Wang, Yining, et al.
Pubblicazione: (2025)
di: Wang, Yining, et al.
Pubblicazione: (2025)
Diagnosing Failures in Large Language Models' Answers: Integrating Error Attribution into Evaluation Framework
di: Xu, Zishan, et al.
Pubblicazione: (2025)
di: Xu, Zishan, et al.
Pubblicazione: (2025)
Automatic Question & Answer Generation Using Generative Large Language Model (LLM)
di: Ehsan, Md. Alvee, et al.
Pubblicazione: (2025)
di: Ehsan, Md. Alvee, et al.
Pubblicazione: (2025)
Talent or Luck? Evaluating Attribution Bias in Large Language Models
di: Raj, Chahat, et al.
Pubblicazione: (2025)
di: Raj, Chahat, et al.
Pubblicazione: (2025)
Framing Political Bias in Multilingual LLMs Across Pakistani Languages
di: Nadeem, Afrozah, et al.
Pubblicazione: (2025)
di: Nadeem, Afrozah, et al.
Pubblicazione: (2025)
Finding Answers in Thought Matters: Revisiting Evaluation on Large Language Models with Reasoning
di: Jo, Hwiyeol, et al.
Pubblicazione: (2025)
di: Jo, Hwiyeol, et al.
Pubblicazione: (2025)
Developing Safe and Responsible Large Language Model : Can We Balance Bias Reduction and Language Understanding in Large Language Models?
di: Raza, Shaina, et al.
Pubblicazione: (2024)
di: Raza, Shaina, et al.
Pubblicazione: (2024)
QA-prompting: Improving Summarization with Large Language Models using Question-Answering
di: Sinha, Neelabh
Pubblicazione: (2025)
di: Sinha, Neelabh
Pubblicazione: (2025)
Bias in Large Language Models: Origin, Evaluation, and Mitigation
di: Guo, Yufei, et al.
Pubblicazione: (2024)
di: Guo, Yufei, et al.
Pubblicazione: (2024)
Social Bias Evaluation for Large Language Models Requires Prompt Variations
di: Hida, Rem, et al.
Pubblicazione: (2024)
di: Hida, Rem, et al.
Pubblicazione: (2024)
Evaluating the Presence of Sex Bias in Clinical Reasoning by Large Language Models
di: Tsintsiper, Isabel, et al.
Pubblicazione: (2026)
di: Tsintsiper, Isabel, et al.
Pubblicazione: (2026)
Refining Answer Distributions for Improved Large Language Model Reasoning
di: Pal, Soumyasundar, et al.
Pubblicazione: (2024)
di: Pal, Soumyasundar, et al.
Pubblicazione: (2024)
Persona-aware Generative Model for Code-mixed Language
di: Sengupta, Ayan, et al.
Pubblicazione: (2023)
di: Sengupta, Ayan, et al.
Pubblicazione: (2023)
Modeling and Predicting Multi-Turn Answer Instability in Large Language Models
di: He, Jiahang, et al.
Pubblicazione: (2025)
di: He, Jiahang, et al.
Pubblicazione: (2025)
Bias in, Bias out: Annotation Bias in Multilingual Large Language Models
di: Cui, Xia, et al.
Pubblicazione: (2025)
di: Cui, Xia, et al.
Pubblicazione: (2025)
LLM-as-a-Grader: Practical Insights from Large Language Model for Short-Answer and Report Evaluation
di: Byun, Grace, et al.
Pubblicazione: (2025)
di: Byun, Grace, et al.
Pubblicazione: (2025)
Eka-Eval: An Evaluation Framework for Low-Resource Multilingual Large Language Models
di: Sinha, Samridhi Raj, et al.
Pubblicazione: (2025)
di: Sinha, Samridhi Raj, et al.
Pubblicazione: (2025)
Bias Beyond Borders: Political Ideology Evaluation and Steering in Multilingual LLMs
di: Nadeem, Afrozah, et al.
Pubblicazione: (2026)
di: Nadeem, Afrozah, et al.
Pubblicazione: (2026)
Bengali Text Classification: An Evaluation of Large Language Model Approaches
di: Hoque, Md Mahmudul, et al.
Pubblicazione: (2026)
di: Hoque, Md Mahmudul, et al.
Pubblicazione: (2026)
Are Large Language Models Really Bias-Free? Jailbreak Prompts for Assessing Adversarial Robustness to Bias Elicitation
di: Cantini, Riccardo, et al.
Pubblicazione: (2024)
di: Cantini, Riccardo, et al.
Pubblicazione: (2024)
DataAgent: Evaluating Large Language Models' Ability to Answer Zero-Shot, Natural Language Queries
di: Mishra, Manit, et al.
Pubblicazione: (2024)
di: Mishra, Manit, et al.
Pubblicazione: (2024)
Navigating the Nuances: A Fine-grained Evaluation of Vision-Language Navigation
di: Wang, Zehao, et al.
Pubblicazione: (2024)
di: Wang, Zehao, et al.
Pubblicazione: (2024)
Acquiescence Bias in Large Language Models
di: Braun, Daniel
Pubblicazione: (2025)
di: Braun, Daniel
Pubblicazione: (2025)
Likelihood-based Mitigation of Evaluation Bias in Large Language Models
di: Oi, Masanari, et al.
Pubblicazione: (2024)
di: Oi, Masanari, et al.
Pubblicazione: (2024)
Evaluating and Mitigating Social Bias for Large Language Models in Open-ended Settings
di: Liu, Zhao, et al.
Pubblicazione: (2024)
di: Liu, Zhao, et al.
Pubblicazione: (2024)
Evaluation of Attribution Bias in Generator-Aware Retrieval-Augmented Large Language Models
di: Abolghasemi, Amin, et al.
Pubblicazione: (2024)
di: Abolghasemi, Amin, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Developing A Framework to Support Human Evaluation of Bias in Generated Free Response Text
di: Healey, Jennifer, et al.
Pubblicazione: (2025) -
Beyond Keywords: Evaluating Large Language Model Classification of Nuanced Ableism
di: Rizvi, Naba, et al.
Pubblicazione: (2025) -
No perspective, no perception!! Perspective-aware Healthcare Answer Summarization
di: Naik, Gauri, et al.
Pubblicazione: (2024) -
BiasFreeBench: a Benchmark for Mitigating Bias in Large Language Model Responses
di: Xu, Xin, et al.
Pubblicazione: (2025) -
No LLM is Free From Bias: A Comprehensive Study of Bias Evaluation in Large Language Models
di: Kumar, Charaka Vinayak, et al.
Pubblicazione: (2025)