Beyond Bias Scores: Unmasking Vacuous Neutrality in Small Language Models
Fuente:
arXiv
Guardado en:
| Autores principales: | Manduru, Sumanth, Domeniconi, Carlotta |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Inside CORE-KG: Evaluating Structured Prompting and Coreference Resolution for Knowledge Graphs
por: Meher, Dipak, et al.
Publicado: (2025)
por: Meher, Dipak, et al.
Publicado: (2025)
CORE-KG: An LLM-Driven Knowledge Graph Construction Framework for Human Smuggling Networks
por: Meher, Dipak, et al.
Publicado: (2025)
por: Meher, Dipak, et al.
Publicado: (2025)
Unmasking Conversational Bias in AI Multiagent Systems
por: Coppolillo, Erica, et al.
Publicado: (2025)
por: Coppolillo, Erica, et al.
Publicado: (2025)
DLM-SWAI: Steering Diffusion Language Models Before They Unmask
por: An, Hyeseon, et al.
Publicado: (2026)
por: An, Hyeseon, et al.
Publicado: (2026)
Unmasking the Shadows of AI: Investigating Deceptive Capabilities in Large Language Models
por: Guo, Linge
Publicado: (2024)
por: Guo, Linge
Publicado: (2024)
Correcting Negative Bias in Large Language Models through Negative Attention Score Alignment
por: Yu, Sangwon, et al.
Publicado: (2024)
por: Yu, Sangwon, et al.
Publicado: (2024)
PRISON: Unmasking the Criminal Potential of Large Language Models
por: Wu, Xinyi, et al.
Publicado: (2025)
por: Wu, Xinyi, et al.
Publicado: (2025)
Artificial Intelligence Bias on English Language Learners in Automatic Scoring
por: Guo, Shuchen, et al.
Publicado: (2025)
por: Guo, Shuchen, et al.
Publicado: (2025)
Gender-Neutral Large Language Models for Medical Applications: Reducing Bias in PubMed Abstracts
por: Schaefer, Elizabeth, et al.
Publicado: (2025)
por: Schaefer, Elizabeth, et al.
Publicado: (2025)
Automated Item Neutralization for Non-Cognitive Scales: A Large Language Model Approach to Reducing Social-Desirability Bias
por: Wu, Sirui, et al.
Publicado: (2025)
por: Wu, Sirui, et al.
Publicado: (2025)
Unmasking Deceptive Visuals: Benchmarking Multimodal Large Language Models on Misleading Chart Question Answering
por: Chen, Zixin, et al.
Publicado: (2025)
por: Chen, Zixin, et al.
Publicado: (2025)
Bias Neutralization Framework: Measuring Fairness in Large Language Models with Bias Intelligence Quotient (BiQ)
por: Narayan, Malur, et al.
Publicado: (2024)
por: Narayan, Malur, et al.
Publicado: (2024)
Rank-Then-Score: Enhancing Large Language Models for Automated Essay Scoring
por: Cai, Yida, et al.
Publicado: (2025)
por: Cai, Yida, et al.
Publicado: (2025)
Regional Bias in Large Language Models
por: Gopinadh, M P V S, et al.
Publicado: (2026)
por: Gopinadh, M P V S, et al.
Publicado: (2026)
Measuring Stability Beyond Accuracy in Small Open-Source Medical Large Language Models for Pediatric Endocrinology
por: D'Amario, Vanessa, et al.
Publicado: (2025)
por: D'Amario, Vanessa, et al.
Publicado: (2025)
Beyond Semantics: Measuring Fine-Grained Emotion Preservation in Small Language Model-Based Machine Translation
por: Wisniewski, Dawid, et al.
Publicado: (2026)
por: Wisniewski, Dawid, et al.
Publicado: (2026)
Contrastive Decoding Mitigates Score Range Bias in LLM-as-a-Judge
por: Fujinuma, Yoshinari
Publicado: (2025)
por: Fujinuma, Yoshinari
Publicado: (2025)
BRIDGE the Gap: Mitigating Bias Amplification in Automated Scoring of English Language Learners via Inter-group Data Augmentation
por: Wang, Yun, et al.
Publicado: (2026)
por: Wang, Yun, et al.
Publicado: (2026)
Unmask It! AI-Generated Product Review Detection in Dravidian Languages
por: De, Somsubhra, et al.
Publicado: (2025)
por: De, Somsubhra, et al.
Publicado: (2025)
Assessing Political Bias in Large Language Models
por: Rettenberger, Luca, et al.
Publicado: (2024)
por: Rettenberger, Luca, et al.
Publicado: (2024)
Poser: Unmasking Alignment Faking LLMs by Manipulating Their Internals
por: Clymer, Joshua, et al.
Publicado: (2024)
por: Clymer, Joshua, et al.
Publicado: (2024)
InfiR : Crafting Effective Small Language Models and Multimodal Small Language Models in Reasoning
por: Xie, Congkai, et al.
Publicado: (2025)
por: Xie, Congkai, et al.
Publicado: (2025)
What Gets Unmasked First? Trajectory Analysis of Diffusion Models for Graph-to-Text Generation
por: Wang, Qing, et al.
Publicado: (2026)
por: Wang, Qing, et al.
Publicado: (2026)
Beyond Scores: A Modular RAG-Based System for Automatic Short Answer Scoring with Feedback
por: Fateen, Menna, et al.
Publicado: (2024)
por: Fateen, Menna, et al.
Publicado: (2024)
DiffScore: Text Evaluation Beyond Autoregressive Likelihood
por: Lai, Wen, et al.
Publicado: (2026)
por: Lai, Wen, et al.
Publicado: (2026)
LLM Essay Scoring Under Holistic and Analytic Rubrics: Prompt Effects and Bias
por: Kucia, Filip J., et al.
Publicado: (2026)
por: Kucia, Filip J., et al.
Publicado: (2026)
User Embedding Model for Personalized Language Prompting
por: Doddapaneni, Sumanth, et al.
Publicado: (2024)
por: Doddapaneni, Sumanth, et al.
Publicado: (2024)
No LLM is Free From Bias: A Comprehensive Study of Bias Evaluation in Large Language Models
por: Kumar, Charaka Vinayak, et al.
Publicado: (2025)
por: Kumar, Charaka Vinayak, et al.
Publicado: (2025)
Small Language Model as Data Prospector for Large Language Model
por: Ni, Shiwen, et al.
Publicado: (2024)
por: Ni, Shiwen, et al.
Publicado: (2024)
Unmasking and Improving Data Credibility: A Study with Datasets for Training Harmless Language Models
por: Zhu, Zhaowei, et al.
Publicado: (2023)
por: Zhu, Zhaowei, et al.
Publicado: (2023)
Identifying and Mitigating Social Bias Knowledge in Language Models
por: Chen, Ruizhe, et al.
Publicado: (2024)
por: Chen, Ruizhe, et al.
Publicado: (2024)
Locating and Mitigating Gender Bias in Large Language Models
por: Cai, Yuchen, et al.
Publicado: (2024)
por: Cai, Yuchen, et al.
Publicado: (2024)
On the Relationship between Truth and Political Bias in Language Models
por: Fulay, Suyash, et al.
Publicado: (2024)
por: Fulay, Suyash, et al.
Publicado: (2024)
Cultural Bias and Cultural Alignment of Large Language Models
por: Tao, Yan, et al.
Publicado: (2023)
por: Tao, Yan, et al.
Publicado: (2023)
Hallucination Detection with Small Language Models
por: Cheung, Ming
Publicado: (2025)
por: Cheung, Ming
Publicado: (2025)
Cross-Language Bias Examination in Large Language Models
por: Liang, Yuxuan, et al.
Publicado: (2025)
por: Liang, Yuxuan, et al.
Publicado: (2025)
Are Large Language Models Really Bias-Free? Jailbreak Prompts for Assessing Adversarial Robustness to Bias Elicitation
por: Cantini, Riccardo, et al.
Publicado: (2024)
por: Cantini, Riccardo, et al.
Publicado: (2024)
Applying Large Language Models and Chain-of-Thought for Automatic Scoring
por: Lee, Gyeong-Geon, et al.
Publicado: (2023)
por: Lee, Gyeong-Geon, et al.
Publicado: (2023)
Large Language Models Are Still Misled by Simple Bias Ensembles
por: Sun, Zhouhao, et al.
Publicado: (2025)
por: Sun, Zhouhao, et al.
Publicado: (2025)
Likelihood-based Mitigation of Evaluation Bias in Large Language Models
por: Oi, Masanari, et al.
Publicado: (2024)
por: Oi, Masanari, et al.
Publicado: (2024)
Ejemplares similares
-
Inside CORE-KG: Evaluating Structured Prompting and Coreference Resolution for Knowledge Graphs
por: Meher, Dipak, et al.
Publicado: (2025) -
CORE-KG: An LLM-Driven Knowledge Graph Construction Framework for Human Smuggling Networks
por: Meher, Dipak, et al.
Publicado: (2025) -
Unmasking Conversational Bias in AI Multiagent Systems
por: Coppolillo, Erica, et al.
Publicado: (2025) -
DLM-SWAI: Steering Diffusion Language Models Before They Unmask
por: An, Hyeseon, et al.
Publicado: (2026) -
Unmasking the Shadows of AI: Investigating Deceptive Capabilities in Large Language Models
por: Guo, Linge
Publicado: (2024)