Evaluating the Effect of Retrieval Augmentation on Social Biases
Fuente:
arXiv
Guardado en:
| Autores principales: | Zhang, Tianhui, Zhou, Yi, Bollegala, Danushka |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Evaluating the Evaluation of Diversity in Commonsense Generation
por: Zhang, Tianhui, et al.
Publicado: (2025)
por: Zhang, Tianhui, et al.
Publicado: (2025)
Evaluating Short-Term Temporal Fluctuations of Social Biases in Social Media Data and Masked Language Models
por: Zhou, Yi, et al.
Publicado: (2024)
por: Zhou, Yi, et al.
Publicado: (2024)
Synthetic Data Generation for Training Diversified Commonsense Reasoning Models
por: Zhang, Tianhui, et al.
Publicado: (2026)
por: Zhang, Tianhui, et al.
Publicado: (2026)
Improving Diversity of Commonsense Generation by Large Language Models via In-Context Learning
por: Zhang, Tianhui, et al.
Publicado: (2024)
por: Zhang, Tianhui, et al.
Publicado: (2024)
Evaluating Unsupervised Dimensionality Reduction Methods for Pretrained Sentence Embeddings
por: Zhang, Gaifan, et al.
Publicado: (2024)
por: Zhang, Gaifan, et al.
Publicado: (2024)
Annotating Training Data for Conditional Semantic Textual Similarity Measurement using Large Language Models
por: Zhang, Gaifan, et al.
Publicado: (2025)
por: Zhang, Gaifan, et al.
Publicado: (2025)
CASE -- Condition-Aware Sentence Embeddings for Conditional Semantic Textual Similarity Measurement
por: Zhang, Gaifan, et al.
Publicado: (2025)
por: Zhang, Gaifan, et al.
Publicado: (2025)
Map of Encoders -- Mapping Sentence Encoders using Quantum Relative Entropy
por: Zhang, Gaifan, et al.
Publicado: (2026)
por: Zhang, Gaifan, et al.
Publicado: (2026)
SCDTour: Embedding Axis Ordering and Merging for Interpretable Semantic Change Detection
por: Aida, Taichi, et al.
Publicado: (2025)
por: Aida, Taichi, et al.
Publicado: (2025)
A Semantic Distance Metric Learning approach for Lexical Semantic Change Detection
por: Aida, Taichi, et al.
Publicado: (2024)
por: Aida, Taichi, et al.
Publicado: (2024)
Investigating the Contextualised Word Embedding Dimensions Specified for Contextual and Temporal Semantic Changes
por: Aida, Taichi, et al.
Publicado: (2024)
por: Aida, Taichi, et al.
Publicado: (2024)
The Gaps between Pre-train and Downstream Settings in Bias Evaluation and Debiasing
por: Kaneko, Masahiro, et al.
Publicado: (2024)
por: Kaneko, Masahiro, et al.
Publicado: (2024)
In-Contextual Gender Bias Suppression for Large Language Models
por: Oba, Daisuke, et al.
Publicado: (2023)
por: Oba, Daisuke, et al.
Publicado: (2023)
Eagle: Ethical Dataset Given from Real Interactions
por: Kaneko, Masahiro, et al.
Publicado: (2024)
por: Kaneko, Masahiro, et al.
Publicado: (2024)
Bias Mitigation or Cultural Commonsense? Evaluating LLMs with a Japanese Dataset
por: Yamamoto, Taisei, et al.
Publicado: (2025)
por: Yamamoto, Taisei, et al.
Publicado: (2025)
Evaluating Gender Bias in Large Language Models via Chain-of-Thought Prompting
por: Kaneko, Masahiro, et al.
Publicado: (2024)
por: Kaneko, Masahiro, et al.
Publicado: (2024)
Neuron-Level Analysis of Cultural Understanding in Large Language Models
por: Yamamoto, Taisei, et al.
Publicado: (2025)
por: Yamamoto, Taisei, et al.
Publicado: (2025)
Improving Unsupervised Constituency Parsing via Maximizing Semantic Information
por: Chen, Junjie, et al.
Publicado: (2024)
por: Chen, Junjie, et al.
Publicado: (2024)
Unsupervised Parsing by Searching for Frequent Word Sequences among Sentences with Equivalent Predicate-Argument Structures
por: Chen, Junjie, et al.
Publicado: (2024)
por: Chen, Junjie, et al.
Publicado: (2024)
Stopping Computation for Converged Tokens in Masked Diffusion-LM Decoding
por: Oba, Daisuke, et al.
Publicado: (2026)
por: Oba, Daisuke, et al.
Publicado: (2026)
LLMs are Biased Evaluators But Not Biased for Retrieval Augmented Generation
por: Chen, Yen-Shan, et al.
Publicado: (2024)
por: Chen, Yen-Shan, et al.
Publicado: (2024)
Improving Pre-trained Language Model Sensitivity via Mask Specific losses: A case study on Biomedical NER
por: Abaho, Micheal, et al.
Publicado: (2024)
por: Abaho, Micheal, et al.
Publicado: (2024)
MSRS: Evaluating Multi-Source Retrieval-Augmented Generation
por: Phanse, Rohan, et al.
Publicado: (2025)
por: Phanse, Rohan, et al.
Publicado: (2025)
Robust Evaluation Measures for Evaluating Social Biases in Masked Language Models
por: Liu, Yang
Publicado: (2024)
por: Liu, Yang
Publicado: (2024)
Unanswerability Evaluation for Retrieval Augmented Generation
por: Peng, Xiangyu, et al.
Publicado: (2024)
por: Peng, Xiangyu, et al.
Publicado: (2024)
BiasCause: Evaluate Socially Biased Causal Reasoning of Large Language Models
por: Xie, Tian, et al.
Publicado: (2025)
por: Xie, Tian, et al.
Publicado: (2025)
Evaluating Retrieval Quality in Retrieval-Augmented Generation
por: Salemi, Alireza, et al.
Publicado: (2024)
por: Salemi, Alireza, et al.
Publicado: (2024)
Ragas: Automated Evaluation of Retrieval Augmented Generation
por: Es, Shahul, et al.
Publicado: (2023)
por: Es, Shahul, et al.
Publicado: (2023)
RARE: Retrieval-Aware Robustness Evaluation for Retrieval-Augmented Generation Systems
por: Zeng, Yixiao, et al.
Publicado: (2025)
por: Zeng, Yixiao, et al.
Publicado: (2025)
Evaluation of Retrieval-Augmented Generation: A Survey
por: Yu, Hao, et al.
Publicado: (2024)
por: Yu, Hao, et al.
Publicado: (2024)
Bias Evaluation and Mitigation in Retrieval-Augmented Medical Question-Answering Systems
por: Ji, Yuelyu, et al.
Publicado: (2025)
por: Ji, Yuelyu, et al.
Publicado: (2025)
Does RAG Introduce Unfairness in LLMs? Evaluating Fairness in Retrieval-Augmented Generation Systems
por: Wu, Xuyang, et al.
Publicado: (2024)
por: Wu, Xuyang, et al.
Publicado: (2024)
Retrieval-Augmented Linguistic Calibration
por: Yeh, Yi-Fan, et al.
Publicado: (2026)
por: Yeh, Yi-Fan, et al.
Publicado: (2026)
Rethinking Evaluation in Retrieval-Augmented Personalized Dialogue: A Cognitive and Linguistic Perspective
por: Zhang, Tianyi, et al.
Publicado: (2026)
por: Zhang, Tianyi, et al.
Publicado: (2026)
LRAGE: Legal Retrieval Augmented Generation Evaluation Tool
por: Park, Minhu, et al.
Publicado: (2025)
por: Park, Minhu, et al.
Publicado: (2025)
RAR$^2$: Retrieval-Augmented Medical Reasoning via Thought-Driven Retrieval
por: Xu, Kaishuai, et al.
Publicado: (2025)
por: Xu, Kaishuai, et al.
Publicado: (2025)
Do LLMs Align Human Values Regarding Social Biases? Judging and Explaining Social Biases with LLMs
por: Liu, Yang, et al.
Publicado: (2025)
por: Liu, Yang, et al.
Publicado: (2025)
Neural Retrievers are Biased Towards LLM-Generated Content
por: Dai, Sunhao, et al.
Publicado: (2023)
por: Dai, Sunhao, et al.
Publicado: (2023)
Explainable Depression Detection in Clinical Interviews with Personalized Retrieval-Augmented Generation
por: Zhang, Linhai, et al.
Publicado: (2025)
por: Zhang, Linhai, et al.
Publicado: (2025)
Retrieval-Augmented Machine Translation with Unstructured Knowledge
por: Wang, Jiaan, et al.
Publicado: (2024)
por: Wang, Jiaan, et al.
Publicado: (2024)
Ejemplares similares
-
Evaluating the Evaluation of Diversity in Commonsense Generation
por: Zhang, Tianhui, et al.
Publicado: (2025) -
Evaluating Short-Term Temporal Fluctuations of Social Biases in Social Media Data and Masked Language Models
por: Zhou, Yi, et al.
Publicado: (2024) -
Synthetic Data Generation for Training Diversified Commonsense Reasoning Models
por: Zhang, Tianhui, et al.
Publicado: (2026) -
Improving Diversity of Commonsense Generation by Large Language Models via In-Context Learning
por: Zhang, Tianhui, et al.
Publicado: (2024) -
Evaluating Unsupervised Dimensionality Reduction Methods for Pretrained Sentence Embeddings
por: Zhang, Gaifan, et al.
Publicado: (2024)