Analyzing Dialectical Biases in LLMs for Knowledge and Reasoning Benchmarks
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Pan, Eileen, Choi, Anna Seo Gyeong, ter Hoeve, Maartje, Seto, Skyler, Koenecke, Allison |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2025
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Multilingual Knowledge Transfer under Data Constraints via Lexical Interventions
von: Sedova, Anastasiia, et al.
Veröffentlicht: (2026)
von: Sedova, Anastasiia, et al.
Veröffentlicht: (2026)
Assessing the Role of Data Quality in Training Bilingual Language Models
von: Seto, Skyler, et al.
Veröffentlicht: (2025)
von: Seto, Skyler, et al.
Veröffentlicht: (2025)
Training Bilingual LMs with Data Constraints in the Targeted Language
von: Seto, Skyler, et al.
Veröffentlicht: (2024)
von: Seto, Skyler, et al.
Veröffentlicht: (2024)
Analyzing the Effect of Linguistic Similarity on Cross-Lingual Transfer: Tasks and Experimental Setups Matter
von: Blaschke, Verena, et al.
Veröffentlicht: (2025)
von: Blaschke, Verena, et al.
Veröffentlicht: (2025)
Discriminating Form and Meaning in Multilingual Models with Minimal-Pair ABX Tasks
von: de Seyssel, Maureen, et al.
Veröffentlicht: (2025)
von: de Seyssel, Maureen, et al.
Veröffentlicht: (2025)
Careless Whisper: Speech-to-Text Hallucination Harms
von: Koenecke, Allison, et al.
Veröffentlicht: (2024)
von: Koenecke, Allison, et al.
Veröffentlicht: (2024)
How Value Induction Reshapes LLM Behaviour
von: Arora, Arnav, et al.
Veröffentlicht: (2026)
von: Arora, Arnav, et al.
Veröffentlicht: (2026)
mRAKL: Multilingual Retrieval-Augmented Knowledge Graph Construction for Low-Resourced Languages
von: Nigatu, Hellina Hailu, et al.
Veröffentlicht: (2025)
von: Nigatu, Hellina Hailu, et al.
Veröffentlicht: (2025)
On the Limited Generalization Capability of the Implicit Reward Model Induced by Direct Preference Optimization
von: Lin, Yong, et al.
Veröffentlicht: (2024)
von: Lin, Yong, et al.
Veröffentlicht: (2024)
Addressing Pitfalls in Auditing Practices of Automatic Speech Recognition Technologies: A Case Study of People with Aphasia
von: Mei, Katelyn Xiaoying, et al.
Veröffentlicht: (2025)
von: Mei, Katelyn Xiaoying, et al.
Veröffentlicht: (2025)
GrammaMT: Improving Machine Translation with Grammar-Informed In-Context Learning
von: Ramos, Rita, et al.
Veröffentlicht: (2024)
von: Ramos, Rita, et al.
Veröffentlicht: (2024)
On the Way to LLM Personalization: Learning to Remember User Conversations
von: Magister, Lucie Charlotte, et al.
Veröffentlicht: (2024)
von: Magister, Lucie Charlotte, et al.
Veröffentlicht: (2024)
Fairness of Automatic Speech Recognition: Looking Through a Philosophical Lens
von: Choi, Anna Seo Gyeong, et al.
Veröffentlicht: (2025)
von: Choi, Anna Seo Gyeong, et al.
Veröffentlicht: (2025)
Characterizing Bias: Benchmarking Large Language Models in Simplified versus Traditional Chinese
von: Lyu, Hanjia, et al.
Veröffentlicht: (2025)
von: Lyu, Hanjia, et al.
Veröffentlicht: (2025)
Robust Pronoun Fidelity with English LLMs: Are they Reasoning, Repeating, or Just Biased?
von: Gautam, Vagrant, et al.
Veröffentlicht: (2024)
von: Gautam, Vagrant, et al.
Veröffentlicht: (2024)
Tasks and Roles in Legal AI: Data Curation, Annotation, and Verification
von: Koenecke, Allison, et al.
Veröffentlicht: (2025)
von: Koenecke, Allison, et al.
Veröffentlicht: (2025)
Data-Driven Mispronunciation Pattern Discovery for Robust Speech Recognition
von: Choi, Anna Seo Gyeong, et al.
Veröffentlicht: (2025)
von: Choi, Anna Seo Gyeong, et al.
Veröffentlicht: (2025)
A Framework for Auditing Chatbots for Dialect-Based Quality-of-Service Harms
von: Harvey, Emma, et al.
Veröffentlicht: (2025)
von: Harvey, Emma, et al.
Veröffentlicht: (2025)
Steering into New Embedding Spaces: Analyzing Cross-Lingual Alignment Induced by Model Interventions in Multilingual Language Models
von: Sundar, Anirudh, et al.
Veröffentlicht: (2025)
von: Sundar, Anirudh, et al.
Veröffentlicht: (2025)
CLM-Bench: Benchmarking and Analyzing Cross-lingual Misalignment of LLMs in Knowledge Editing
von: Hu, Yucheng, et al.
Veröffentlicht: (2026)
von: Hu, Yucheng, et al.
Veröffentlicht: (2026)
Soup-of-Experts: Pretraining Specialist Models via Parameters Averaging
von: Ablin, Pierre, et al.
Veröffentlicht: (2025)
von: Ablin, Pierre, et al.
Veröffentlicht: (2025)
Scaling Laws for Mixture Pretraining Under Data Constraints
von: Sedova, Anastasiia, et al.
Veröffentlicht: (2026)
von: Sedova, Anastasiia, et al.
Veröffentlicht: (2026)
Task-Adaptive Pretrained Language Models via Clustered-Importance Sampling
von: Grangier, David, et al.
Veröffentlicht: (2024)
von: Grangier, David, et al.
Veröffentlicht: (2024)
Assessing Thai Dialect Performance in LLMs with Automatic Benchmarks and Human Evaluation
von: Limkonchotiwat, Peerat, et al.
Veröffentlicht: (2025)
von: Limkonchotiwat, Peerat, et al.
Veröffentlicht: (2025)
JBBQ: Japanese Bias Benchmark for Analyzing Social Biases in Large Language Models
von: Yanaka, Hitomi, et al.
Veröffentlicht: (2024)
von: Yanaka, Hitomi, et al.
Veröffentlicht: (2024)
Camellia: Benchmarking Cultural Biases in LLMs for Asian Languages
von: Naous, Tarek, et al.
Veröffentlicht: (2025)
von: Naous, Tarek, et al.
Veröffentlicht: (2025)
Hierarchical Deconstruction of LLM Reasoning: A Graph-Based Framework for Analyzing Knowledge Utilization
von: Ko, Miyoung, et al.
Veröffentlicht: (2024)
von: Ko, Miyoung, et al.
Veröffentlicht: (2024)
Beyond Single Ground Truth: Reference Monism as Epistemic Injustice in ASR Evaluation
von: Choi, Anna Seo Gyeong, et al.
Veröffentlicht: (2026)
von: Choi, Anna Seo Gyeong, et al.
Veröffentlicht: (2026)
A Multi-Agent Framework for Mitigating Dialect Biases in Privacy Policy Question-Answering Systems
von: Klisura, Đorđe, et al.
Veröffentlicht: (2025)
von: Klisura, Đorđe, et al.
Veröffentlicht: (2025)
MEDEQUALQA: Evaluating Biases in LLMs with Counterfactual Reasoning
von: Ghosh, Rajarshi, et al.
Veröffentlicht: (2025)
von: Ghosh, Rajarshi, et al.
Veröffentlicht: (2025)
Cultural Benchmarking of LLMs in Standard and Dialectal Arabic Dialogues
von: Kautsar, Muhammad Dehan Al, et al.
Veröffentlicht: (2026)
von: Kautsar, Muhammad Dehan Al, et al.
Veröffentlicht: (2026)
Tokenization and Representation Biases in Multilingual Models on Dialectal NLP Tasks
von: Kanjirangat, Vani, et al.
Veröffentlicht: (2025)
von: Kanjirangat, Vani, et al.
Veröffentlicht: (2025)
Test of Time: A Benchmark for Evaluating LLMs on Temporal Reasoning
von: Fatemi, Bahare, et al.
Veröffentlicht: (2024)
von: Fatemi, Bahare, et al.
Veröffentlicht: (2024)
AL-QASIDA: Analyzing LLM Quality and Accuracy Systematically in Dialectal Arabic
von: Robinson, Nathaniel R., et al.
Veröffentlicht: (2024)
von: Robinson, Nathaniel R., et al.
Veröffentlicht: (2024)
From Reasoning to Generalization: Knowledge-Augmented LLMs for ARC Benchmark
von: Lei, Chao, et al.
Veröffentlicht: (2025)
von: Lei, Chao, et al.
Veröffentlicht: (2025)
Rephrasing the Web: A Recipe for Compute and Data-Efficient Language Modeling
von: Maini, Pratyush, et al.
Veröffentlicht: (2024)
von: Maini, Pratyush, et al.
Veröffentlicht: (2024)
Bias Runs Deep: Implicit Reasoning Biases in Persona-Assigned LLMs
von: Gupta, Shashank, et al.
Veröffentlicht: (2023)
von: Gupta, Shashank, et al.
Veröffentlicht: (2023)
DialectGen: Benchmarking and Improving Dialect Robustness in Multimodal Generation
von: Zhou, Yu, et al.
Veröffentlicht: (2025)
von: Zhou, Yu, et al.
Veröffentlicht: (2025)
LocalBench: Benchmarking LLMs on County-Level Local Knowledge and Reasoning
von: Gao, Zihan, et al.
Veröffentlicht: (2025)
von: Gao, Zihan, et al.
Veröffentlicht: (2025)
LLMs are Biased Evaluators But Not Biased for Retrieval Augmented Generation
von: Chen, Yen-Shan, et al.
Veröffentlicht: (2024)
von: Chen, Yen-Shan, et al.
Veröffentlicht: (2024)
Ähnliche Einträge
-
Multilingual Knowledge Transfer under Data Constraints via Lexical Interventions
von: Sedova, Anastasiia, et al.
Veröffentlicht: (2026) -
Assessing the Role of Data Quality in Training Bilingual Language Models
von: Seto, Skyler, et al.
Veröffentlicht: (2025) -
Training Bilingual LMs with Data Constraints in the Targeted Language
von: Seto, Skyler, et al.
Veröffentlicht: (2024) -
Analyzing the Effect of Linguistic Similarity on Cross-Lingual Transfer: Tasks and Experimental Setups Matter
von: Blaschke, Verena, et al.
Veröffentlicht: (2025) -
Discriminating Form and Meaning in Multilingual Models with Minimal-Pair ABX Tasks
von: de Seyssel, Maureen, et al.
Veröffentlicht: (2025)