EsBBQ and CaBBQ: The Spanish and Catalan Bias Benchmarks for Question Answering
Fuente:
arXiv
Salvato in:
| Autori principali: | Ruiz-Fernández, Valle, Mina, Mario, Falcão, Júlia, Vasquez-Reina, Luis, Sallés, Anna, Gonzalez-Agirre, Aitor, Perez-de-Viñaspre, Olatz |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
KoBBQ: Korean Bias Benchmark for Question Answering
di: Jin, Jiho, et al.
Pubblicazione: (2023)
di: Jin, Jiho, et al.
Pubblicazione: (2023)
GG-BBQ: German Gender Bias Benchmark for Question Answering
di: Satheesh, Shalaka, et al.
Pubblicazione: (2025)
di: Satheesh, Shalaka, et al.
Pubblicazione: (2025)
BharatBBQ: A Multilingual Bias Benchmark for Question Answering in the Indian Context
di: Tomar, Aditya, et al.
Pubblicazione: (2025)
di: Tomar, Aditya, et al.
Pubblicazione: (2025)
Robust Bias Evaluation with FilBBQ: A Filipino Bias Benchmark for Question-Answering Language Models
di: Gamboa, Lance Calvin Lim, et al.
Pubblicazione: (2026)
di: Gamboa, Lance Calvin Lim, et al.
Pubblicazione: (2026)
PakBBQ: A Culturally Adapted Bias Benchmark for QA
di: Hashmat, Abdullah, et al.
Pubblicazione: (2025)
di: Hashmat, Abdullah, et al.
Pubblicazione: (2025)
BBQ-V: Benchmarking Visual Stereotype Bias in Large Multimodal Models
di: Narnaware, Vishal, et al.
Pubblicazione: (2025)
di: Narnaware, Vishal, et al.
Pubblicazione: (2025)
Gender Bias in MT for a Genderless Language: New Benchmarks for Basque
di: Murillo, Amaia, et al.
Pubblicazione: (2026)
di: Murillo, Amaia, et al.
Pubblicazione: (2026)
ImplicitBBQ: Benchmarking Implicit Bias in Large Language Models through Characteristic Based Cues
di: Vedula, Bhaskara Hanuma, et al.
Pubblicazione: (2026)
di: Vedula, Bhaskara Hanuma, et al.
Pubblicazione: (2026)
VoiceBBQ: Investigating Effect of Content and Acoustics in Social Bias of Spoken Language Model
di: Choi, Junhyuk, et al.
Pubblicazione: (2025)
di: Choi, Junhyuk, et al.
Pubblicazione: (2025)
Costillas BBQ en exquisita salsa casera / Evangelina Ric rdez
di: Ricárdez, Evangelina
di: Ricárdez, Evangelina
BBQ-mIS: a parallel quantum algorithm for graph coloring problems
di: Vercellino, Chiara, et al.
Pubblicazione: (2026)
di: Vercellino, Chiara, et al.
Pubblicazione: (2026)
"The Dentist is an involved parent, the bartender is not": Revealing Implicit Biases in QA with Implicit BBQ
di: Wagh, Aarushi, et al.
Pubblicazione: (2025)
di: Wagh, Aarushi, et al.
Pubblicazione: (2025)
BBQ-to-Image: Numeric Bounding Box and Qolor Control in Large-Scale Text-to-Image Models
di: Kachlon, Eliran, et al.
Pubblicazione: (2026)
di: Kachlon, Eliran, et al.
Pubblicazione: (2026)
Social Bias in Popular Question-Answering Benchmarks
di: Kraft, Angelie, et al.
Pubblicazione: (2025)
di: Kraft, Angelie, et al.
Pubblicazione: (2025)
Colombian Waitresses y Jueces canadienses: Gender and Country Biases in Occupation Recommendations from LLMs
di: Rodríguez, Elisa Forcada, et al.
Pubblicazione: (2025)
di: Rodríguez, Elisa Forcada, et al.
Pubblicazione: (2025)
Lexical semantics, Basque and Spanish in QTLeap: Quality Translation by Deep Language Engineering Approaches
di: Eneko Agirre
Pubblicazione: (2015)
di: Eneko Agirre
Pubblicazione: (2015)
Mexican Experience in Spanish Question Answering
di: Manuel Montes y Gómez
Pubblicazione: (2008)
di: Manuel Montes y Gómez
Pubblicazione: (2008)
Multilingual Medical Reasoning for Question Answering with Large Language Models
di: Ferrazzi, Pietro, et al.
Pubblicazione: (2025)
di: Ferrazzi, Pietro, et al.
Pubblicazione: (2025)
Salamandra Technical Report
di: Gonzalez-Agirre, Aitor, et al.
Pubblicazione: (2025)
di: Gonzalez-Agirre, Aitor, et al.
Pubblicazione: (2025)
Mitigating Bias for Question Answering Models by Tracking Bias Influence
di: Ma, Mingyu Derek, et al.
Pubblicazione: (2023)
di: Ma, Mingyu Derek, et al.
Pubblicazione: (2023)
Assessing Modality Bias in Video Question Answering Benchmarks with Multimodal Large Language Models
di: Park, Jean, et al.
Pubblicazione: (2024)
di: Park, Jean, et al.
Pubblicazione: (2024)
FairMedQA: Benchmarking Bias in Large Language Models for Medical Question Answering
di: Xiao, Ying, et al.
Pubblicazione: (2025)
di: Xiao, Ying, et al.
Pubblicazione: (2025)
More Bias, Less Bias: BiasPrompting for Enhanced Multiple-Choice Question Answering
di: Vu, Duc Anh, et al.
Pubblicazione: (2025)
di: Vu, Duc Anh, et al.
Pubblicazione: (2025)
Language Model Knowledge Distillation for Efficient Question Answering in Spanish
di: Bazaga, Adrián, et al.
Pubblicazione: (2023)
di: Bazaga, Adrián, et al.
Pubblicazione: (2023)
Paraphrase Extraction from Validated Question Answering Corpora in Spanish
di: Jesús Herrera
Pubblicazione: (2007)
di: Jesús Herrera
Pubblicazione: (2007)
CaST-Bench: Benchmarking Causal Chain-Grounded Spatio-Temporal Reasoning for Video Question Answering
di: Zhang, Mingfang, et al.
Pubblicazione: (2026)
di: Zhang, Mingfang, et al.
Pubblicazione: (2026)
Mass-Editing Memory with Attention in Transformers: A cross-lingual exploration of knowledge
di: Tamayo, Daniel, et al.
Pubblicazione: (2025)
di: Tamayo, Daniel, et al.
Pubblicazione: (2025)
Mitigating Easy Option Bias in Multiple-Choice Question Answering
di: Zhang, Hao, et al.
Pubblicazione: (2025)
di: Zhang, Hao, et al.
Pubblicazione: (2025)
Evaluating Variance in Visual Question Answering Benchmarks
di: SR, Nikitha
Pubblicazione: (2025)
di: SR, Nikitha
Pubblicazione: (2025)
IMB: An Italian Medical Benchmark for Question Answering
di: Romano, Antonio, et al.
Pubblicazione: (2025)
di: Romano, Antonio, et al.
Pubblicazione: (2025)
Hallucination Benchmark in Medical Visual Question Answering
di: Wu, Jinge, et al.
Pubblicazione: (2024)
di: Wu, Jinge, et al.
Pubblicazione: (2024)
Bilingualism and Naming in MCI and Alzheimer's Disease: Insights from Catalan‐Spanish Speakers
di: Marco Calabria, et al.
Pubblicazione: (2025)
di: Marco Calabria, et al.
Pubblicazione: (2025)
Multi-Domain Audio Question Answering Benchmark Toward Acoustic Content Reasoning
di: Yang, Chao-Han Huck, et al.
Pubblicazione: (2025)
di: Yang, Chao-Han Huck, et al.
Pubblicazione: (2025)
Bias Evaluation and Mitigation in Retrieval-Augmented Medical Question-Answering Systems
di: Ji, Yuelyu, et al.
Pubblicazione: (2025)
di: Ji, Yuelyu, et al.
Pubblicazione: (2025)
Utilización de servicios y costes de los pacientes con gripe (H1N1) 2009 en España: antecedentes y protocolo de investigación
di: Olatz Garin
Pubblicazione: (2011)
di: Olatz Garin
Pubblicazione: (2011)
Un entorno para el desarrollo y la evaluación de un sistema de búsqueda de respuestas en euskara
di: Olatz Ansa
Pubblicazione: (2005)
di: Olatz Ansa
Pubblicazione: (2005)
WikiVQABench: A Knowledge-Grounded Visual Question Answering Benchmark from Wikipedia and Wikidata
di: Shbita, Basel, et al.
Pubblicazione: (2026)
di: Shbita, Basel, et al.
Pubblicazione: (2026)
OWLViz: An Open-World Benchmark for Visual Question Answering
di: Nguyen, Thuy, et al.
Pubblicazione: (2025)
di: Nguyen, Thuy, et al.
Pubblicazione: (2025)
TSAQA: Time Series Analysis Question And Answering Benchmark
di: Jing, Baoyu, et al.
Pubblicazione: (2026)
di: Jing, Baoyu, et al.
Pubblicazione: (2026)
Visual Robustness Benchmark for Visual Question Answering (VQA)
di: Ishmam, Md Farhan, et al.
Pubblicazione: (2024)
di: Ishmam, Md Farhan, et al.
Pubblicazione: (2024)
Documenti analoghi
-
KoBBQ: Korean Bias Benchmark for Question Answering
di: Jin, Jiho, et al.
Pubblicazione: (2023) -
GG-BBQ: German Gender Bias Benchmark for Question Answering
di: Satheesh, Shalaka, et al.
Pubblicazione: (2025) -
BharatBBQ: A Multilingual Bias Benchmark for Question Answering in the Indian Context
di: Tomar, Aditya, et al.
Pubblicazione: (2025) -
Robust Bias Evaluation with FilBBQ: A Filipino Bias Benchmark for Question-Answering Language Models
di: Gamboa, Lance Calvin Lim, et al.
Pubblicazione: (2026) -
PakBBQ: A Culturally Adapted Bias Benchmark for QA
di: Hashmat, Abdullah, et al.
Pubblicazione: (2025)