Assessing Judging Bias in Large Reasoning Models: An Empirical Study
Fuente:
arXiv
Guardado en:
| Autores principales: | Wang, Qian, Lou, Zhanzhi, Tang, Zhenheng, Chen, Nuo, Zhao, Xuandong, Zhang, Wenxuan, Song, Dawn, He, Bingsheng |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Towards Evaluting Fake Reasoning Bias in Language Models
por: Wang, Qian, et al.
Publicado: (2025)
por: Wang, Qian, et al.
Publicado: (2025)
Making Bias Non-Predictive: Training Robust LLM Reasoning via Reinforcement Learning
por: Wang, Qian, et al.
Publicado: (2026)
por: Wang, Qian, et al.
Publicado: (2026)
JudgeLRM: Large Reasoning Models as a Judge
por: Chen, Nuo, et al.
Publicado: (2025)
por: Chen, Nuo, et al.
Publicado: (2025)
From ChatGPT to DeepSeek: Can LLMs Simulate Humanity?
por: Wang, Qian, et al.
Publicado: (2025)
por: Wang, Qian, et al.
Publicado: (2025)
Position: The Current AI Conference Model is Unsustainable! Diagnosing the Crisis of Centralized AI Conference
por: Chen, Nuo, et al.
Publicado: (2025)
por: Chen, Nuo, et al.
Publicado: (2025)
JudgeMeNot: Personalizing Large Language Models to Emulate Judicial Reasoning in Hebrew
por: Razumenko, Itay, et al.
Publicado: (2026)
por: Razumenko, Itay, et al.
Publicado: (2026)
Beyond Brainstorming: What Drives High-Quality Scientific Ideas? Lessons from Multi-Agent Collaboration
por: Chen, Nuo, et al.
Publicado: (2025)
por: Chen, Nuo, et al.
Publicado: (2025)
LLM-based Human Simulations Have Not Yet Been Reliable
por: Wang, Qian, et al.
Publicado: (2025)
por: Wang, Qian, et al.
Publicado: (2025)
Language of Thought Shapes Output Diversity in Large Language Models
por: Xu, Shaoyang, et al.
Publicado: (2026)
por: Xu, Shaoyang, et al.
Publicado: (2026)
Scalable Best-of-N Selection for Large Language Models via Self-Certainty
por: Kang, Zhewei, et al.
Publicado: (2025)
por: Kang, Zhewei, et al.
Publicado: (2025)
Inference-Time Reasoning Selectively Reduces Implicit Social Bias in Large Language Models
por: Apsel, Molly, et al.
Publicado: (2026)
por: Apsel, Molly, et al.
Publicado: (2026)
Translate With Care: Addressing Gender Bias, Neutrality, and Reasoning in Large Language Model Translations
por: Zahraei, Pardis Sadat, et al.
Publicado: (2025)
por: Zahraei, Pardis Sadat, et al.
Publicado: (2025)
In-Context Watermarks for Large Language Models
por: Liu, Yepeng, et al.
Publicado: (2025)
por: Liu, Yepeng, et al.
Publicado: (2025)
Different Bias Under Different Criteria: Assessing Bias in LLMs with a Fact-Based Approach
por: Ko, Changgeon, et al.
Publicado: (2024)
por: Ko, Changgeon, et al.
Publicado: (2024)
Intrinsic Meets Extrinsic Fairness: Assessing the Downstream Impact of Bias Mitigation in Large Language Models
por: Arzaghi', 'Mina, et al.
Publicado: (2025)
por: Arzaghi', 'Mina, et al.
Publicado: (2025)
BiasFreeBench: a Benchmark for Mitigating Bias in Large Language Model Responses
por: Xu, Xin, et al.
Publicado: (2025)
por: Xu, Xin, et al.
Publicado: (2025)
Characterizing Selective Refusal Bias in Large Language Models
por: Khorramrouz, Adel, et al.
Publicado: (2025)
por: Khorramrouz, Adel, et al.
Publicado: (2025)
Gender Bias in Emotion Recognition by Large Language Models
por: Herbert, Maureen, et al.
Publicado: (2025)
por: Herbert, Maureen, et al.
Publicado: (2025)
The Hidden Risks of Large Reasoning Models: A Safety Assessment of R1
por: Zhou, Kaiwen, et al.
Publicado: (2025)
por: Zhou, Kaiwen, et al.
Publicado: (2025)
Measuring Implicit Bias in Explicitly Unbiased Large Language Models
por: Bai, Xuechunzi, et al.
Publicado: (2024)
por: Bai, Xuechunzi, et al.
Publicado: (2024)
Beyond English: Unveiling Multilingual Bias in LLM Copyright Compliance
por: Chen, Yupeng, et al.
Publicado: (2025)
por: Chen, Yupeng, et al.
Publicado: (2025)
Learning to Reason without External Rewards
por: Zhao, Xuandong, et al.
Publicado: (2025)
por: Zhao, Xuandong, et al.
Publicado: (2025)
Assessing the Impact of Conspiracy Theories Using Large Language Models
por: Jiang, Bohan, et al.
Publicado: (2024)
por: Jiang, Bohan, et al.
Publicado: (2024)
AesBiasBench: Evaluating Bias and Alignment in Multimodal Language Models for Personalized Image Aesthetic Assessment
por: Li, Kun, et al.
Publicado: (2025)
por: Li, Kun, et al.
Publicado: (2025)
Policy Frameworks for Transparent Chain-of-Thought Reasoning in Large Language Models
por: Chen, Yihang, et al.
Publicado: (2025)
por: Chen, Yihang, et al.
Publicado: (2025)
Towards Equitable AI: Detecting Bias in Using Large Language Models for Marketing
por: Yilmaz, Berk, et al.
Publicado: (2025)
por: Yilmaz, Berk, et al.
Publicado: (2025)
Characterizing Bias: Benchmarking Large Language Models in Simplified versus Traditional Chinese
por: Lyu, Hanjia, et al.
Publicado: (2025)
por: Lyu, Hanjia, et al.
Publicado: (2025)
A Framework to Assess the Persuasion Risks Large Language Model Chatbots Pose to Democratic Societies
por: Chen, Zhongren, et al.
Publicado: (2025)
por: Chen, Zhongren, et al.
Publicado: (2025)
Potential and Perils of Large Language Models as Judges of Unstructured Textual Data
por: Bedemariam, Rewina, et al.
Publicado: (2025)
por: Bedemariam, Rewina, et al.
Publicado: (2025)
Sentient Agent as a Judge: Evaluating Higher-Order Social Cognition in Large Language Models
por: Zhang, Bang, et al.
Publicado: (2025)
por: Zhang, Bang, et al.
Publicado: (2025)
Leveraging Large Language Models to Measure Gender Representation Bias in Gendered Language Corpora
por: Derner, Erik, et al.
Publicado: (2024)
por: Derner, Erik, et al.
Publicado: (2024)
InfoSynth: Information-Guided Benchmark Synthesis for LLMs
por: Garg, Ishir, et al.
Publicado: (2026)
por: Garg, Ishir, et al.
Publicado: (2026)
AgentSynth: Scalable Task Generation for Generalist Computer-Use Agents
por: Xie, Jingxu, et al.
Publicado: (2025)
por: Xie, Jingxu, et al.
Publicado: (2025)
LangFair: A Python Package for Assessing Bias and Fairness in Large Language Model Use Cases
por: Bouchard, Dylan, et al.
Publicado: (2025)
por: Bouchard, Dylan, et al.
Publicado: (2025)
What Large Language Models Do Not Talk About: An Empirical Study of Moderation and Censorship Practices
por: Noels, Sander, et al.
Publicado: (2025)
por: Noels, Sander, et al.
Publicado: (2025)
A Unified Framework and Dataset for Assessing Societal Bias in Vision-Language Models
por: Sathe, Ashutosh, et al.
Publicado: (2024)
por: Sathe, Ashutosh, et al.
Publicado: (2024)
Down the Toxicity Rabbit Hole: A Novel Framework to Bias Audit Large Language Models
por: Dutta, Arka, et al.
Publicado: (2023)
por: Dutta, Arka, et al.
Publicado: (2023)
Divine LLaMAs: Bias, Stereotypes, Stigmatization, and Emotion Representation of Religion in Large Language Models
por: Plaza-del-Arco, Flor Miriam, et al.
Publicado: (2024)
por: Plaza-del-Arco, Flor Miriam, et al.
Publicado: (2024)
WinoQueer: A Community-in-the-Loop Benchmark for Anti-LGBTQ+ Bias in Large Language Models
por: Felkner, Virginia K., et al.
Publicado: (2023)
por: Felkner, Virginia K., et al.
Publicado: (2023)
DECASTE: Unveiling Caste Stereotypes in Large Language Models through Multi-Dimensional Bias Analysis
por: Vijayaraghavan, Prashanth, et al.
Publicado: (2025)
por: Vijayaraghavan, Prashanth, et al.
Publicado: (2025)
Ejemplares similares
-
Towards Evaluting Fake Reasoning Bias in Language Models
por: Wang, Qian, et al.
Publicado: (2025) -
Making Bias Non-Predictive: Training Robust LLM Reasoning via Reinforcement Learning
por: Wang, Qian, et al.
Publicado: (2026) -
JudgeLRM: Large Reasoning Models as a Judge
por: Chen, Nuo, et al.
Publicado: (2025) -
From ChatGPT to DeepSeek: Can LLMs Simulate Humanity?
por: Wang, Qian, et al.
Publicado: (2025) -
Position: The Current AI Conference Model is Unsustainable! Diagnosing the Crisis of Centralized AI Conference
por: Chen, Nuo, et al.
Publicado: (2025)