CogBias: Measuring and Mitigating Cognitive Bias in Large Language Models
Fuente:
arXiv
Guardado en:
| Autores principales: | Huang, Fan, Zhang, Songheng, Kwak, Haewoon, An, Jisun |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Understanding Moral Reasoning Trajectories in Large Language Models: Toward Probing-Based Explainability
por: Huang, Fan, et al.
Publicado: (2026)
por: Huang, Fan, et al.
Publicado: (2026)
Vulnerability of LLMs' Stated Beliefs? LLMs Belief Resistance Check Through Strategic Persuasive Conversation Interventions
por: Huang, Fan, et al.
Publicado: (2026)
por: Huang, Fan, et al.
Publicado: (2026)
ToBlend: Token-Level Blending With an Ensemble of LLMs to Attack AI-Generated Text Detection
por: Huang, Fan, et al.
Publicado: (2024)
por: Huang, Fan, et al.
Publicado: (2024)
ChatGPT Rates Natural Language Explanation Quality Like Humans: But on Which Scales?
por: Huang, Fan, et al.
Publicado: (2024)
por: Huang, Fan, et al.
Publicado: (2024)
Can Lessons From Human Teams Be Applied to Multi-Agent Systems? The Role of Structure, Diversity, and Interaction Dynamics
por: Muralidharan, Rasika, et al.
Publicado: (2025)
por: Muralidharan, Rasika, et al.
Publicado: (2025)
XChoice: Explainable Evaluation of AI-Human Alignment in LLM-based Constrained Choice Decision Making
por: Qi, Weihong, et al.
Publicado: (2026)
por: Qi, Weihong, et al.
Publicado: (2026)
Can we trust the evaluation on ChatGPT?
por: Aiyappa, Rachith, et al.
Publicado: (2023)
por: Aiyappa, Rachith, et al.
Publicado: (2023)
Measuring and Mitigating Bias in Code Generated by Large Language Models
por: Chen, Yuxi, et al.
Publicado: (2026)
por: Chen, Yuxi, et al.
Publicado: (2026)
Benchmarking zero-shot stance detection with FlanT5-XXL: Insights from training data, prompting, and decoding strategies into its near-SoTA performance
por: Aiyappa, Rachith, et al.
Publicado: (2024)
por: Aiyappa, Rachith, et al.
Publicado: (2024)
BiasBusters: Uncovering and Mitigating Tool Selection Bias in Large Language Models
por: Blankenstein, Thierry, et al.
Publicado: (2025)
por: Blankenstein, Thierry, et al.
Publicado: (2025)
Mitigating Propensity Bias of Large Language Models for Recommender Systems
por: Zhang, Guixian, et al.
Publicado: (2024)
por: Zhang, Guixian, et al.
Publicado: (2024)
PluRule: A Benchmark for Moderating Pluralistic Communities on Social Media
por: Kachwala, Zoher, et al.
Publicado: (2026)
por: Kachwala, Zoher, et al.
Publicado: (2026)
Locating and Mitigating Gender Bias in Large Language Models
por: Cai, Yuchen, et al.
Publicado: (2024)
por: Cai, Yuchen, et al.
Publicado: (2024)
Mitigating Cognitive Bias in RLHF by Altering Rationality
por: Horter, Tiffany, et al.
Publicado: (2026)
por: Horter, Tiffany, et al.
Publicado: (2026)
CogLM: Tracking Cognitive Development of Large Language Models
por: Wang, Xinglin, et al.
Publicado: (2024)
por: Wang, Xinglin, et al.
Publicado: (2024)
A Cross-Cultural Comparison of LLM-based Public Opinion Simulation: Evaluating Chinese and U.S. Models on Diverse Societies
por: Qi, Weihong, et al.
Publicado: (2025)
por: Qi, Weihong, et al.
Publicado: (2025)
Multi-Persona Thinking for Bias Mitigation in Large Language Models
por: Chen, Yuxing, et al.
Publicado: (2026)
por: Chen, Yuxing, et al.
Publicado: (2026)
Likelihood-based Mitigation of Evaluation Bias in Large Language Models
por: Oi, Masanari, et al.
Publicado: (2024)
por: Oi, Masanari, et al.
Publicado: (2024)
Mitigating Gender Bias in Code Large Language Models via Model Editing
por: Qin, Zhanyue, et al.
Publicado: (2024)
por: Qin, Zhanyue, et al.
Publicado: (2024)
Enhancing Diagnostic Accuracy through Multi-Agent Conversations: Using Large Language Models to Mitigate Cognitive Bias
por: Ke, Yu He, et al.
Publicado: (2024)
por: Ke, Yu He, et al.
Publicado: (2024)
BiasFreeBench: a Benchmark for Mitigating Bias in Large Language Model Responses
por: Xu, Xin, et al.
Publicado: (2025)
por: Xu, Xin, et al.
Publicado: (2025)
GenderAlign: An Alignment Dataset for Mitigating Gender Bias in Large Language Models
por: Zhang, Tao, et al.
Publicado: (2024)
por: Zhang, Tao, et al.
Publicado: (2024)
Large Language Model Bias Mitigation from the Perspective of Knowledge Editing
por: Chen, Ruizhe, et al.
Publicado: (2024)
por: Chen, Ruizhe, et al.
Publicado: (2024)
Simulating a Bias Mitigation Scenario in Large Language Models
por: Kiashemshaki, Kiana, et al.
Publicado: (2025)
por: Kiashemshaki, Kiana, et al.
Publicado: (2025)
Attribution Bias in Large Language Models
por: Berman, Eliza, et al.
Publicado: (2026)
por: Berman, Eliza, et al.
Publicado: (2026)
BiasLab: A Multilingual, Dual-Framing Framework for Robust Measurement of Output-Level Bias in Large Language Models
por: Guey, William, et al.
Publicado: (2026)
por: Guey, William, et al.
Publicado: (2026)
CogGPT: Unleashing the Power of Cognitive Dynamics on Large Language Models
por: Lv, Yaojia, et al.
Publicado: (2024)
por: Lv, Yaojia, et al.
Publicado: (2024)
Bias Fitting to Mitigate Length Bias of Reward Model in RLHF
por: Zhao, Kangwen, et al.
Publicado: (2025)
por: Zhao, Kangwen, et al.
Publicado: (2025)
CogToM: A Comprehensive Theory of Mind Benchmark inspired by Human Cognition for Large Language Models
por: Tong, Haibo, et al.
Publicado: (2026)
por: Tong, Haibo, et al.
Publicado: (2026)
Identifying and Mitigating Social Bias Knowledge in Language Models
por: Chen, Ruizhe, et al.
Publicado: (2024)
por: Chen, Ruizhe, et al.
Publicado: (2024)
Understanding and Mitigating Tokenization Bias in Language Models
por: Phan, Buu, et al.
Publicado: (2024)
por: Phan, Buu, et al.
Publicado: (2024)
KnowBias: Mitigating Social Bias in LLMs via Know-Bias Neuron Enhancement
por: Pan, Jinhao, et al.
Publicado: (2026)
por: Pan, Jinhao, et al.
Publicado: (2026)
Instructed to Bias: Instruction-Tuned Language Models Exhibit Emergent Cognitive Bias
por: Itzhak, Itay, et al.
Publicado: (2023)
por: Itzhak, Itay, et al.
Publicado: (2023)
Language Bias in Information Retrieval: The Nature of the Beast and Mitigation Methods
por: Yang, Jinrui, et al.
Publicado: (2025)
por: Yang, Jinrui, et al.
Publicado: (2025)
LFTF: Locating First and Then Fine-Tuning for Mitigating Gender Bias in Large Language Models
por: Qin, Zhanyue, et al.
Publicado: (2025)
por: Qin, Zhanyue, et al.
Publicado: (2025)
Auto-Search and Refinement: An Automated Framework for Gender Bias Mitigation in Large Language Models
por: Xu, Yue, et al.
Publicado: (2025)
por: Xu, Yue, et al.
Publicado: (2025)
Mitigating Boundary Ambiguity and Inherent Bias for Text Classification in the Era of Large Language Models
por: Lu, Zhenyi, et al.
Publicado: (2024)
por: Lu, Zhenyi, et al.
Publicado: (2024)
Backdooring Bias in Large Language Models
por: Das, Anudeep, et al.
Publicado: (2026)
por: Das, Anudeep, et al.
Publicado: (2026)
Regional Bias in Large Language Models
por: Gopinadh, M P V S, et al.
Publicado: (2026)
por: Gopinadh, M P V S, et al.
Publicado: (2026)
CogBench: A Large Language Model Benchmark for Multilingual Speech-Based Cognitive Impairment Assessment
por: Feng, Rui, et al.
Publicado: (2025)
por: Feng, Rui, et al.
Publicado: (2025)
Ejemplares similares
-
Understanding Moral Reasoning Trajectories in Large Language Models: Toward Probing-Based Explainability
por: Huang, Fan, et al.
Publicado: (2026) -
Vulnerability of LLMs' Stated Beliefs? LLMs Belief Resistance Check Through Strategic Persuasive Conversation Interventions
por: Huang, Fan, et al.
Publicado: (2026) -
ToBlend: Token-Level Blending With an Ensemble of LLMs to Attack AI-Generated Text Detection
por: Huang, Fan, et al.
Publicado: (2024) -
ChatGPT Rates Natural Language Explanation Quality Like Humans: But on Which Scales?
por: Huang, Fan, et al.
Publicado: (2024) -
Can Lessons From Human Teams Be Applied to Multi-Agent Systems? The Role of Structure, Diversity, and Interaction Dynamics
por: Muralidharan, Rasika, et al.
Publicado: (2025)