Attribution Bias in Large Language Models
Fuente:
arXiv
Salvato in:
| Autori principali: | Berman, Eliza, Chang, Bella, Neill, Daniel B., Black, Emily |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Generative Monoculture in Large Language Models
di: Wu, Fan, et al.
Pubblicazione: (2024)
di: Wu, Fan, et al.
Pubblicazione: (2024)
Bi-directional Bias Attribution: Debiasing Large Language Models without Modifying Prompts
di: Lin, Yujie, et al.
Pubblicazione: (2026)
di: Lin, Yujie, et al.
Pubblicazione: (2026)
Contractual Deepfakes: Can Large Language Models Generate Contracts?
di: Mik, Eliza
Pubblicazione: (2026)
di: Mik, Eliza
Pubblicazione: (2026)
Interpreting Multi-Attribute Confounding through Numerical Attributes in Large Language Models
di: Takagi, Hirohane, et al.
Pubblicazione: (2025)
di: Takagi, Hirohane, et al.
Pubblicazione: (2025)
CogBias: Measuring and Mitigating Cognitive Bias in Large Language Models
di: Huang, Fan, et al.
Pubblicazione: (2026)
di: Huang, Fan, et al.
Pubblicazione: (2026)
BiasBusters: Uncovering and Mitigating Tool Selection Bias in Large Language Models
di: Blankenstein, Thierry, et al.
Pubblicazione: (2025)
di: Blankenstein, Thierry, et al.
Pubblicazione: (2025)
A Longitudinal Measurement of Privacy Policy Evolution for Large Language Models
di: Tao, Zhen, et al.
Pubblicazione: (2025)
di: Tao, Zhen, et al.
Pubblicazione: (2025)
DataDignity: Training Data Attribution for Large Language Models
di: Li, Xiaomin, et al.
Pubblicazione: (2026)
di: Li, Xiaomin, et al.
Pubblicazione: (2026)
Backdooring Bias in Large Language Models
di: Das, Anudeep, et al.
Pubblicazione: (2026)
di: Das, Anudeep, et al.
Pubblicazione: (2026)
Regional Bias in Large Language Models
di: Gopinadh, M P V S, et al.
Pubblicazione: (2026)
di: Gopinadh, M P V S, et al.
Pubblicazione: (2026)
Do Large Language Models Know What They Are Capable Of?
di: Barkan, Casey O., et al.
Pubblicazione: (2025)
di: Barkan, Casey O., et al.
Pubblicazione: (2025)
Bias Amplification: Large Language Models as Increasingly Biased Media
di: Wang, Ze, et al.
Pubblicazione: (2024)
di: Wang, Ze, et al.
Pubblicazione: (2024)
Assessing Political Bias in Large Language Models
di: Rettenberger, Luca, et al.
Pubblicazione: (2024)
di: Rettenberger, Luca, et al.
Pubblicazione: (2024)
Source Attribution for Large Language Model-Generated Data
di: Wang, Jingtan, et al.
Pubblicazione: (2023)
di: Wang, Jingtan, et al.
Pubblicazione: (2023)
Exploring the Jungle of Bias: Political Bias Attribution in Language Models via Dependency Analysis
di: Jenny, David F., et al.
Pubblicazione: (2023)
di: Jenny, David F., et al.
Pubblicazione: (2023)
Adaptive Multi-Subspace Representation Steering for Attribute Alignment in Large Language Models
di: Jiang, Xinyan, et al.
Pubblicazione: (2025)
di: Jiang, Xinyan, et al.
Pubblicazione: (2025)
Analyzing Memorization in Large Language Models through the Lens of Model Attribution
di: Menta, Tarun Ram, et al.
Pubblicazione: (2025)
di: Menta, Tarun Ram, et al.
Pubblicazione: (2025)
Noiser: Bounded Input Perturbations for Attributing Large Language Models
di: Madani, Mohammad Reza Ghasemi, et al.
Pubblicazione: (2025)
di: Madani, Mohammad Reza Ghasemi, et al.
Pubblicazione: (2025)
Explaining the Reasoning of Large Language Models Using Attribution Graphs
di: Walker, Chase, et al.
Pubblicazione: (2025)
di: Walker, Chase, et al.
Pubblicazione: (2025)
Advancing Large Language Model Attribution through Self-Improving
di: Huang, Lei, et al.
Pubblicazione: (2024)
di: Huang, Lei, et al.
Pubblicazione: (2024)
Locating and Mitigating Gender Bias in Large Language Models
di: Cai, Yuchen, et al.
Pubblicazione: (2024)
di: Cai, Yuchen, et al.
Pubblicazione: (2024)
Cultural Bias and Cultural Alignment of Large Language Models
di: Tao, Yan, et al.
Pubblicazione: (2023)
di: Tao, Yan, et al.
Pubblicazione: (2023)
Cross-Language Bias Examination in Large Language Models
di: Liang, Yuxuan, et al.
Pubblicazione: (2025)
di: Liang, Yuxuan, et al.
Pubblicazione: (2025)
Uncovering Political Bias in Large Language Models using Parliamentary Voting Records
di: Chen, Jieying, et al.
Pubblicazione: (2026)
di: Chen, Jieying, et al.
Pubblicazione: (2026)
Bias of AI-Generated Content: An Examination of News Produced by Large Language Models
di: Fang, Xiao, et al.
Pubblicazione: (2023)
di: Fang, Xiao, et al.
Pubblicazione: (2023)
No LLM is Free From Bias: A Comprehensive Study of Bias Evaluation in Large Language Models
di: Kumar, Charaka Vinayak, et al.
Pubblicazione: (2025)
di: Kumar, Charaka Vinayak, et al.
Pubblicazione: (2025)
Document Attribution: Examining Citation Relationships using Large Language Models
di: Rawte, Vipula, et al.
Pubblicazione: (2025)
di: Rawte, Vipula, et al.
Pubblicazione: (2025)
Revisiting Large Language Model Pruning using Neuron Semantic Attribution
di: Ding, Yizhuo, et al.
Pubblicazione: (2025)
di: Ding, Yizhuo, et al.
Pubblicazione: (2025)
Learning Fine-Grained Grounded Citations for Attributed Large Language Models
di: Huang, Lei, et al.
Pubblicazione: (2024)
di: Huang, Lei, et al.
Pubblicazione: (2024)
Multi-Persona Thinking for Bias Mitigation in Large Language Models
di: Chen, Yuxing, et al.
Pubblicazione: (2026)
di: Chen, Yuxing, et al.
Pubblicazione: (2026)
Measuring and Mitigating Bias in Code Generated by Large Language Models
di: Chen, Yuxi, et al.
Pubblicazione: (2026)
di: Chen, Yuxi, et al.
Pubblicazione: (2026)
Prompt Programming for Cultural Bias and Alignment of Large Language Models
di: Eren, Maksim, et al.
Pubblicazione: (2026)
di: Eren, Maksim, et al.
Pubblicazione: (2026)
Quantifying Self-Preservation Bias in Large Language Models
di: Migliarini, Matteo, et al.
Pubblicazione: (2026)
di: Migliarini, Matteo, et al.
Pubblicazione: (2026)
Likelihood-based Mitigation of Evaluation Bias in Large Language Models
di: Oi, Masanari, et al.
Pubblicazione: (2024)
di: Oi, Masanari, et al.
Pubblicazione: (2024)
Mitigating Propensity Bias of Large Language Models for Recommender Systems
di: Zhang, Guixian, et al.
Pubblicazione: (2024)
di: Zhang, Guixian, et al.
Pubblicazione: (2024)
Large Language Models Are Still Misled by Simple Bias Ensembles
di: Sun, Zhouhao, et al.
Pubblicazione: (2025)
di: Sun, Zhouhao, et al.
Pubblicazione: (2025)
Evaluation of Bias Towards Medical Professionals in Large Language Models
di: Chen, Xi, et al.
Pubblicazione: (2024)
di: Chen, Xi, et al.
Pubblicazione: (2024)
Behavioral Bias of Vision-Language Models: A Behavioral Finance View
di: Xiao, Yuhang, et al.
Pubblicazione: (2024)
di: Xiao, Yuhang, et al.
Pubblicazione: (2024)
Label Deconvolution for Node Representation Learning on Large-scale Attributed Graphs against Learning Bias
di: Shi, Zhihao, et al.
Pubblicazione: (2023)
di: Shi, Zhihao, et al.
Pubblicazione: (2023)
FairMedQA: Benchmarking Bias in Large Language Models for Medical Question Answering
di: Xiao, Ying, et al.
Pubblicazione: (2025)
di: Xiao, Ying, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Generative Monoculture in Large Language Models
di: Wu, Fan, et al.
Pubblicazione: (2024) -
Bi-directional Bias Attribution: Debiasing Large Language Models without Modifying Prompts
di: Lin, Yujie, et al.
Pubblicazione: (2026) -
Contractual Deepfakes: Can Large Language Models Generate Contracts?
di: Mik, Eliza
Pubblicazione: (2026) -
Interpreting Multi-Attribute Confounding through Numerical Attributes in Large Language Models
di: Takagi, Hirohane, et al.
Pubblicazione: (2025) -
CogBias: Measuring and Mitigating Cognitive Bias in Large Language Models
di: Huang, Fan, et al.
Pubblicazione: (2026)