FairPy: A Toolkit for Evaluation of Prediction Biases and their Mitigation in Large Language Models
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Viswanath, Hrishikesh, Zhang, Tianyi |
|---|---|
| Format: | Preprint |
| Publié: |
2023
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
FairFlow: Mitigating Dataset Biases through Undecided Learning
par: Cheng, Jiali, et autres
Publié: (2025)
par: Cheng, Jiali, et autres
Publié: (2025)
Arcee's MergeKit: A Toolkit for Merging Large Language Models
par: Goddard, Charles, et autres
Publié: (2024)
par: Goddard, Charles, et autres
Publié: (2024)
Laissez-Faire Harms: Algorithmic Biases in Generative Language Models
par: Shieh, Evan, et autres
Publié: (2024)
par: Shieh, Evan, et autres
Publié: (2024)
Relative Value Biases in Large Language Models
par: Hayes, William M., et autres
Publié: (2024)
par: Hayes, William M., et autres
Publié: (2024)
Large Language Models are Biased Reinforcement Learners
par: Hayes, William M., et autres
Publié: (2024)
par: Hayes, William M., et autres
Publié: (2024)
LLMC: Benchmarking Large Language Model Quantization with a Versatile Compression Toolkit
par: Gong, Ruihao, et autres
Publié: (2024)
par: Gong, Ruihao, et autres
Publié: (2024)
Mitigating Biases for Instruction-following Language Models via Bias Neurons Elimination
par: Yang, Nakyeong, et autres
Publié: (2023)
par: Yang, Nakyeong, et autres
Publié: (2023)
Large Language Models are Geographically Biased
par: Manvi, Rohin, et autres
Publié: (2024)
par: Manvi, Rohin, et autres
Publié: (2024)
Self-contradictory Hallucinations of Large Language Models: Evaluation, Detection and Mitigation
par: Mündler, Niels, et autres
Publié: (2023)
par: Mündler, Niels, et autres
Publié: (2023)
Do Large Language Models Show Biases in Causal Learning?
par: Carro, Maria Victoria, et autres
Publié: (2024)
par: Carro, Maria Victoria, et autres
Publié: (2024)
Benchmarking Cognitive Biases in Large Language Models as Evaluators
par: Koo, Ryan, et autres
Publié: (2023)
par: Koo, Ryan, et autres
Publié: (2023)
Prompting Fairness: Integrating Causality to Debias Large Language Models
par: Li, Jingling, et autres
Publié: (2024)
par: Li, Jingling, et autres
Publié: (2024)
ELF-Gym: Evaluating Large Language Models Generated Features for Tabular Prediction
par: Zhang, Yanlin, et autres
Publié: (2024)
par: Zhang, Yanlin, et autres
Publié: (2024)
Active Layer-Contrastive Decoding Reduces Hallucination in Large Language Model Generation
par: Zhang, Hongxiang, et autres
Publié: (2025)
par: Zhang, Hongxiang, et autres
Publié: (2025)
Bias and Fairness in Large Language Models: A Survey
par: Gallegos, Isabel O., et autres
Publié: (2023)
par: Gallegos, Isabel O., et autres
Publié: (2023)
BiasJailbreak:Analyzing Ethical Biases and Jailbreak Vulnerabilities in Large Language Models
par: Lee, Isack, et autres
Publié: (2024)
par: Lee, Isack, et autres
Publié: (2024)
Reasoning Towards Fairness: Mitigating Bias in Language Models through Reasoning-Guided Fine-Tuning
par: Kabra, Sanchit, et autres
Publié: (2025)
par: Kabra, Sanchit, et autres
Publié: (2025)
Fairness Definitions in Language Models Explained
par: Yin, Zhipeng, et autres
Publié: (2024)
par: Yin, Zhipeng, et autres
Publié: (2024)
Subtle Biases Need Subtler Measures: Dual Metrics for Evaluating Representative and Affinity Bias in Large Language Models
par: Kumar, Abhishek, et autres
Publié: (2024)
par: Kumar, Abhishek, et autres
Publié: (2024)
Exploring Accuracy-Fairness Trade-off in Large Language Models
par: Zhang, Qingquan, et autres
Publié: (2024)
par: Zhang, Qingquan, et autres
Publié: (2024)
Can Small-Scale Data Poisoning Exacerbate Dialect-Linked Biases in Large Language Models?
par: Abbas, Chaymaa, et autres
Publié: (2025)
par: Abbas, Chaymaa, et autres
Publié: (2025)
Collaborative Performance Prediction for Large Language Models
par: Zhang, Qiyuan, et autres
Publié: (2024)
par: Zhang, Qiyuan, et autres
Publié: (2024)
Mitigating Hallucinations in Large Language Models via Causal Reasoning
par: Li, Yuangang, et autres
Publié: (2025)
par: Li, Yuangang, et autres
Publié: (2025)
DistiLLM: Towards Streamlined Distillation for Large Language Models
par: Ko, Jongwoo, et autres
Publié: (2024)
par: Ko, Jongwoo, et autres
Publié: (2024)
The Fair Language Model Paradox
par: Pinto, Andrea, et autres
Publié: (2024)
par: Pinto, Andrea, et autres
Publié: (2024)
Uncovering Biases with Reflective Large Language Models
par: Chang, Edward Y.
Publié: (2024)
par: Chang, Edward Y.
Publié: (2024)
Is Your Model Fairly Certain? Uncertainty-Aware Fairness Evaluation for LLMs
par: Wang, Yinong Oliver, et autres
Publié: (2025)
par: Wang, Yinong Oliver, et autres
Publié: (2025)
LangFair: A Python Package for Assessing Bias and Fairness in Large Language Model Use Cases
par: Bouchard, Dylan, et autres
Publié: (2025)
par: Bouchard, Dylan, et autres
Publié: (2025)
Empowering Many, Biasing a Few: Generalist Credit Scoring through Large Language Models
par: Feng, Duanyu, et autres
Publié: (2023)
par: Feng, Duanyu, et autres
Publié: (2023)
CPR: Mitigating Large Language Model Hallucinations with Curative Prompt Refinement
par: Shim, Jung-Woo, et autres
Publié: (2025)
par: Shim, Jung-Woo, et autres
Publié: (2025)
Multi-stage Prompt Refinement for Mitigating Hallucinations in Large Language Models
par: Shim, Jung-Woo, et autres
Publié: (2025)
par: Shim, Jung-Woo, et autres
Publié: (2025)
TLPO: Token-Level Policy Optimization for Mitigating Language Confusion in Large Language Models
par: Choo, Jinho, et autres
Publié: (2026)
par: Choo, Jinho, et autres
Publié: (2026)
Towards Large Language Models that Benefit for All: Benchmarking Group Fairness in Reward Models
par: Song, Kefan, et autres
Publié: (2025)
par: Song, Kefan, et autres
Publié: (2025)
Fundamental Safety-Capability Trade-offs in Fine-tuning Large Language Models
par: Chen, Pin-Yu, et autres
Publié: (2025)
par: Chen, Pin-Yu, et autres
Publié: (2025)
PoliTune: Analyzing the Impact of Data Selection and Fine-Tuning on Economic and Political Biases in Large Language Models
par: Agiza, Ahmed, et autres
Publié: (2024)
par: Agiza, Ahmed, et autres
Publié: (2024)
Mitigating Selection Bias in Large Language Models via Permutation-Aware GRPO
par: Zheng, Jinquan, et autres
Publié: (2026)
par: Zheng, Jinquan, et autres
Publié: (2026)
Mitigating Hallucinated Translations in Large Language Models with Hallucination-focused Preference Optimization
par: Tang, Zilu, et autres
Publié: (2025)
par: Tang, Zilu, et autres
Publié: (2025)
Uncertainty-Aware Fusion: An Ensemble Framework for Mitigating Hallucinations in Large Language Models
par: Dey, Prasenjit, et autres
Publié: (2025)
par: Dey, Prasenjit, et autres
Publié: (2025)
Large Language Models for Travel Behavior Prediction
par: Mo, Baichuan, et autres
Publié: (2023)
par: Mo, Baichuan, et autres
Publié: (2023)
CPLLM: Clinical Prediction with Large Language Models
par: Shoham, Ofir Ben, et autres
Publié: (2023)
par: Shoham, Ofir Ben, et autres
Publié: (2023)
Documents similaires
-
FairFlow: Mitigating Dataset Biases through Undecided Learning
par: Cheng, Jiali, et autres
Publié: (2025) -
Arcee's MergeKit: A Toolkit for Merging Large Language Models
par: Goddard, Charles, et autres
Publié: (2024) -
Laissez-Faire Harms: Algorithmic Biases in Generative Language Models
par: Shieh, Evan, et autres
Publié: (2024) -
Relative Value Biases in Large Language Models
par: Hayes, William M., et autres
Publié: (2024) -
Large Language Models are Biased Reinforcement Learners
par: Hayes, William M., et autres
Publié: (2024)