OffsetBias: Leveraging Debiased Data for Tuning Evaluators
Fuente:
arXiv
Guardado en:
| Autores principales: | Park, Junsoo, Jwa, Seungyeon, Ren, Meiying, Kim, Daeyoung, Choi, Sanghyuk |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Becoming Experienced Judges: Selective Test-Time Learning for Evaluators
por: Jwa, Seungyeon, et al.
Publicado: (2025)
por: Jwa, Seungyeon, et al.
Publicado: (2025)
Bias Beyond English: Evaluating Social Bias and Debiasing Methods in a Low-Resource Setting
por: Zhou, Ej, et al.
Publicado: (2025)
por: Zhou, Ej, et al.
Publicado: (2025)
The Gaps between Pre-train and Downstream Settings in Bias Evaluation and Debiasing
por: Kaneko, Masahiro, et al.
Publicado: (2024)
por: Kaneko, Masahiro, et al.
Publicado: (2024)
LooComp: Leverage Leave-One-Out Strategy to Encoder-only Transformer for Efficient Query-aware Context Compression
por: Do, Thao, et al.
Publicado: (2026)
por: Do, Thao, et al.
Publicado: (2026)
Model-Dowser: Data-Free Importance Probing to Mitigate Catastrophic Forgetting in Multimodal Large Language Models
por: Hwang, Hyeontaek, et al.
Publicado: (2026)
por: Hwang, Hyeontaek, et al.
Publicado: (2026)
Unboxing Occupational Bias: Grounded Debiasing of LLMs with U.S. Labor Data
por: Gorti, Atmika, et al.
Publicado: (2024)
por: Gorti, Atmika, et al.
Publicado: (2024)
Toward Robust LLM-Based Judges: Taxonomic Bias Evaluation and Debiasing Optimization
por: Zhou, Hongli, et al.
Publicado: (2026)
por: Zhou, Hongli, et al.
Publicado: (2026)
VARCO-VISION: Expanding Frontiers in Korean Vision-Language Models
por: Ju, Jeongho, et al.
Publicado: (2024)
por: Ju, Jeongho, et al.
Publicado: (2024)
On Bias and Fairness in NLP: Investigating the Impact of Bias and Debiasing in Language Models on the Fairness of Toxicity Detection
por: Elsafoury, Fatma, et al.
Publicado: (2023)
por: Elsafoury, Fatma, et al.
Publicado: (2023)
Debiasing CLIP: Interpreting and Correcting Bias in Attention Heads
por: Yeo, Wei Jie, et al.
Publicado: (2025)
por: Yeo, Wei Jie, et al.
Publicado: (2025)
What is Your Favorite Gender, MLM? Gender Bias Evaluation in Multilingual Masked Language Models
por: Yu, Jeongrok, et al.
Publicado: (2024)
por: Yu, Jeongrok, et al.
Publicado: (2024)
Evaluating Learner Representations for Differentiation Prior to Instructional Outcomes
por: Park, Junsoo, et al.
Publicado: (2026)
por: Park, Junsoo, et al.
Publicado: (2026)
BiasFilter: An Inference-Time Debiasing Framework for Large Language Models
por: Cheng, Xiaoqing, et al.
Publicado: (2025)
por: Cheng, Xiaoqing, et al.
Publicado: (2025)
Enhancing Multilingual RAG Systems with Debiased Language Preference-Guided Query Fusion
por: Park, Jeonghyun, et al.
Publicado: (2026)
por: Park, Jeonghyun, et al.
Publicado: (2026)
Unlocking the Potential of Diffusion Language Models through Template Infilling
por: Lee, Junhoo, et al.
Publicado: (2025)
por: Lee, Junhoo, et al.
Publicado: (2025)
Towards Multimodal Sentiment Analysis Debiasing via Bias Purification
por: Yang, Dingkang, et al.
Publicado: (2024)
por: Yang, Dingkang, et al.
Publicado: (2024)
Towards Understanding Task-agnostic Debiasing Through the Lenses of Intrinsic Bias and Forgetfulness
por: Liu, Guangliang, et al.
Publicado: (2024)
por: Liu, Guangliang, et al.
Publicado: (2024)
Religious Bias Landscape in Language and Text-to-Image Models: Analysis, Detection, and Debiasing Strategies
por: Abrar, Ajwad, et al.
Publicado: (2025)
por: Abrar, Ajwad, et al.
Publicado: (2025)
DiagESC: Dialogue Synthesis for Integrating Depression Diagnosis into Emotional Support Conversation
por: Seo, Seungyeon, et al.
Publicado: (2024)
por: Seo, Seungyeon, et al.
Publicado: (2024)
Deontological Keyword Bias: The Impact of Modal Expressions on Normative Judgments of Language Models
por: Park, Bumjin, et al.
Publicado: (2025)
por: Park, Bumjin, et al.
Publicado: (2025)
Leveraging Web-Crawled Data for High-Quality Fine-Tuning
por: Zhou, Jing, et al.
Publicado: (2024)
por: Zhou, Jing, et al.
Publicado: (2024)
Reference-Based Post-OCR Processing with LLM for Precise Diacritic Text in Historical Document Recognition
por: Do, Thao, et al.
Publicado: (2024)
por: Do, Thao, et al.
Publicado: (2024)
From Measurement to Mitigation: Exploring the Transferability of Debiasing Approaches to Gender Bias in Maltese Language Models
por: Galea, Melanie, et al.
Publicado: (2025)
por: Galea, Melanie, et al.
Publicado: (2025)
Structural Optimization Ambiguity and Simplicity Bias in Unsupervised Neural Grammar Induction
por: Park, Jinwook, et al.
Publicado: (2024)
por: Park, Jinwook, et al.
Publicado: (2024)
BiasEdit: Debiasing Stereotyped Language Models via Model Editing
por: Xu, Xin, et al.
Publicado: (2025)
por: Xu, Xin, et al.
Publicado: (2025)
A Dual-Layered Evaluation of Geopolitical and Cultural Bias in LLMs
por: Kim, Sean, et al.
Publicado: (2025)
por: Kim, Sean, et al.
Publicado: (2025)
Self-Adaptive Cognitive Debiasing for Large Language Models in Decision-Making
por: Lyu, Yougang, et al.
Publicado: (2025)
por: Lyu, Yougang, et al.
Publicado: (2025)
Position Debiasing Fine-Tuning for Causal Perception in Long-Term Dialogue
por: Fan, Shixuan, et al.
Publicado: (2024)
por: Fan, Shixuan, et al.
Publicado: (2024)
Bi-directional Bias Attribution: Debiasing Large Language Models without Modifying Prompts
por: Lin, Yujie, et al.
Publicado: (2026)
por: Lin, Yujie, et al.
Publicado: (2026)
B-score: Detecting biases in large language models using response history
por: Vo, An, et al.
Publicado: (2025)
por: Vo, An, et al.
Publicado: (2025)
Tuning Into Bias: A Computational Study of Gender Bias in Song Lyrics
por: Chen, Danqing, et al.
Publicado: (2024)
por: Chen, Danqing, et al.
Publicado: (2024)
Any Large Language Model Can Be a Reliable Judge: Debiasing with a Reasoning-based Bias Detector
por: Yang, Haoyan, et al.
Publicado: (2025)
por: Yang, Haoyan, et al.
Publicado: (2025)
Uncovering the Potential Risks in Unlearning: Danger of English-only Unlearning in Multilingual LLMs
por: Hwang, Kyomin, et al.
Publicado: (2025)
por: Hwang, Kyomin, et al.
Publicado: (2025)
Delving into Multilingual Ethical Bias: The MSQAD with Statistical Hypothesis Tests for Large Language Models
por: Yu, Seunguk, et al.
Publicado: (2025)
por: Yu, Seunguk, et al.
Publicado: (2025)
MCS-SQL: Leveraging Multiple Prompts and Multiple-Choice Selection For Text-to-SQL Generation
por: Lee, Dongjun, et al.
Publicado: (2024)
por: Lee, Dongjun, et al.
Publicado: (2024)
Leveraging In-Context Learning for Political Bias Testing of LLMs
por: Haller, Patrick, et al.
Publicado: (2025)
por: Haller, Patrick, et al.
Publicado: (2025)
Revealing User Familiarity Bias in Task-Oriented Dialogue via Interactive Evaluation
por: Kim, Takyoung, et al.
Publicado: (2023)
por: Kim, Takyoung, et al.
Publicado: (2023)
Teacher-Student Training for Debiasing: General Permutation Debiasing for Large Language Models
por: Liusie, Adian, et al.
Publicado: (2024)
por: Liusie, Adian, et al.
Publicado: (2024)
Toward Interactive Regional Understanding in Vision-Large Language Models
por: Lee, Jungbeom, et al.
Publicado: (2024)
por: Lee, Jungbeom, et al.
Publicado: (2024)
Soft-prompt Tuning for Large Language Models to Evaluate Bias
por: Tian, Jacob-Junqi, et al.
Publicado: (2023)
por: Tian, Jacob-Junqi, et al.
Publicado: (2023)
Ejemplares similares
-
Becoming Experienced Judges: Selective Test-Time Learning for Evaluators
por: Jwa, Seungyeon, et al.
Publicado: (2025) -
Bias Beyond English: Evaluating Social Bias and Debiasing Methods in a Low-Resource Setting
por: Zhou, Ej, et al.
Publicado: (2025) -
The Gaps between Pre-train and Downstream Settings in Bias Evaluation and Debiasing
por: Kaneko, Masahiro, et al.
Publicado: (2024) -
LooComp: Leverage Leave-One-Out Strategy to Encoder-only Transformer for Efficient Query-aware Context Compression
por: Do, Thao, et al.
Publicado: (2026) -
Model-Dowser: Data-Free Importance Probing to Mitigate Catastrophic Forgetting in Multimodal Large Language Models
por: Hwang, Hyeontaek, et al.
Publicado: (2026)