BLEnD: A Benchmark for LLMs on Everyday Knowledge in Diverse Cultures and Languages
Fuente:
arXiv
Guardado en:
| Autores principales: | Myung, Junho, Lee, Nayeon, Zhou, Yi, Jin, Jiho, Putri, Rifki Afina, Antypas, Dimosthenis, Borkakoty, Hsuvas, Kim, Eunsu, Perez-Almendros, Carla, Ayele, Abinew Ali, Gutiérrez-Basulto, Víctor, Ibáñez-García, Yazmín, Lee, Hwaran, Muhammad, Shamsuddeen Hassan, Park, Kiwoong, Rzayev, Anar Sabuhi, White, Nina, Yimam, Seid Muhie, Pilehvar, Mohammad Taher, Ousidhoum, Nedjma, Camacho-Collados, Jose, Oh, Alice |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Causal Effects of Trigger Words in Social Media Discussions: A Large-Scale Case Study about UK Politics on Reddit
por: Antypas, Dimosthenis, et al.
Publicado: (2024)
por: Antypas, Dimosthenis, et al.
Publicado: (2024)
BLEnD-Vis: Benchmarking Multimodal Cultural Understanding in Vision Language Models
por: Tan, Bryan Chen Zhengyu, et al.
Publicado: (2025)
por: Tan, Bryan Chen Zhengyu, et al.
Publicado: (2025)
Automatic Extraction of Metaphoric Analogies from Literary Texts: Task Formulation, Dataset Construction, and Evaluation
por: Boisson, Joanne, et al.
Publicado: (2024)
por: Boisson, Joanne, et al.
Publicado: (2024)
Sensitive Content Classification in Social Media: A Holistic Resource and Evaluation
por: Antypas, Dimosthenis, et al.
Publicado: (2024)
por: Antypas, Dimosthenis, et al.
Publicado: (2024)
Adapting Language Models to Indonesian Local Languages: An Empirical Study of Language Transferability on Zero-Shot Settings
por: Putri, Rifki Afina
Publicado: (2025)
por: Putri, Rifki Afina
Publicado: (2025)
WiDe-analysis: Enabling One-click Content Moderation Analysis on Wikipedia's Articles for Deletion
por: Borkakoty, Hsuvas, et al.
Publicado: (2024)
por: Borkakoty, Hsuvas, et al.
Publicado: (2024)
Wikipedia is Not a Dictionary, Delete! Text Classification as a Proxy for Analysing Wiki Deletion Discussions
por: Borkakoty, Hsuvas, et al.
Publicado: (2025)
por: Borkakoty, Hsuvas, et al.
Publicado: (2025)
Hoaxpedia: A Unified Wikipedia Hoax Articles Dataset
por: Borkakoty, Hsuvas, et al.
Publicado: (2024)
por: Borkakoty, Hsuvas, et al.
Publicado: (2024)
CHEW: A Dataset of CHanging Events in Wikipedia
por: Borkakoty, Hsuvas, et al.
Publicado: (2024)
por: Borkakoty, Hsuvas, et al.
Publicado: (2024)
Multilingual Topic Classification in X: Dataset and Analysis
por: Antypas, Dimosthenis, et al.
Publicado: (2024)
por: Antypas, Dimosthenis, et al.
Publicado: (2024)
Where Knowledge Collides: A Mechanistic Study of Intra-Memory Knowledge Conflict in Language Models
por: Pham, Minh Vu, et al.
Publicado: (2026)
por: Pham, Minh Vu, et al.
Publicado: (2026)
The State of Large Language Models for African Languages: Progress and Challenges
por: Hussen, Kedir Yassin, et al.
Publicado: (2025)
por: Hussen, Kedir Yassin, et al.
Publicado: (2025)
Silenced voices: social media polarization and women's marginalization in peacebuilding during the Northern Ethiopia War
por: Ali, Adem Chanie, et al.
Publicado: (2024)
por: Ali, Adem Chanie, et al.
Publicado: (2024)
Annotating Dimensions of Social Perception in Text: A Sentence-Level Dataset of Warmth and Competence
por: Ayesh, Mutaz, et al.
Publicado: (2026)
por: Ayesh, Mutaz, et al.
Publicado: (2026)
Building Better: Avoiding Pitfalls in Developing Language Resources when Data is Scarce
por: Ousidhoum, Nedjma, et al.
Publicado: (2024)
por: Ousidhoum, Nedjma, et al.
Publicado: (2024)
Exploring Boundaries and Intensities in Offensive and Hate Speech: Unveiling the Complex Spectrum of Social Media Discourse
por: Ayele, Abinew Ali, et al.
Publicado: (2024)
por: Ayele, Abinew Ali, et al.
Publicado: (2024)
DRIP-R: A Benchmark for Decision-Making and Reasoning Under Real-World Policy Ambiguity in the Retail Domain
por: Borkakoty, Hsuvas, et al.
Publicado: (2026)
por: Borkakoty, Hsuvas, et al.
Publicado: (2026)
Social Good or Scientific Curiosity? Uncovering the Research Framing Behind NLP Artefacts
por: Chamoun, Eric, et al.
Publicado: (2025)
por: Chamoun, Eric, et al.
Publicado: (2025)
AfroXLMR-Social: Adapting Pre-trained Language Models for African Languages Social Media Text
por: Belay, Tadesse Destaw, et al.
Publicado: (2025)
por: Belay, Tadesse Destaw, et al.
Publicado: (2025)
KoBBQ: Korean Bias Benchmark for Question Answering
por: Jin, Jiho, et al.
Publicado: (2023)
por: Jin, Jiho, et al.
Publicado: (2023)
Beyond Majority Voting: Agreement-Based Clustering to Model Annotator Perspectives in Subjective NLP Tasks
por: Belay, Tadesse Destaw, et al.
Publicado: (2026)
por: Belay, Tadesse Destaw, et al.
Publicado: (2026)
Insights from the ICLR Peer Review and Rebuttal Process
por: Kargaran, Amir Hossein, et al.
Publicado: (2025)
por: Kargaran, Amir Hossein, et al.
Publicado: (2025)
Exploring State Tracking Capabilities of Large Language Models
por: Rezaee, Kiamehr, et al.
Publicado: (2025)
por: Rezaee, Kiamehr, et al.
Publicado: (2025)
Understanding LLM Performance Degradation in Multi-Instance Processing: The Roles of Instance Count and Context Length
por: Chen, Jingxuan, et al.
Publicado: (2026)
por: Chen, Jingxuan, et al.
Publicado: (2026)
Algorithmic Fragility and Persona Bias in LLM-Generated Autistic Communication
por: Rizvi, Naba, et al.
Publicado: (2026)
por: Rizvi, Naba, et al.
Publicado: (2026)
Can LLM Generate Culturally Relevant Commonsense QA Data? Case Study in Indonesian and Sundanese
por: Putri, Rifki Afina, et al.
Publicado: (2024)
por: Putri, Rifki Afina, et al.
Publicado: (2024)
Enhancing Multi-Label Emotion Analysis and Corresponding Intensities for Ethiopian Languages
por: Belay, Tadesse Destaw, et al.
Publicado: (2025)
por: Belay, Tadesse Destaw, et al.
Publicado: (2025)
Hate Speech Detection and Classification in Amharic Text with Deep Learning
por: Gashe, Samuel Minale, et al.
Publicado: (2024)
por: Gashe, Samuel Minale, et al.
Publicado: (2024)
SemEval-2024 Task 1: Semantic Textual Relatedness for African and Asian Languages
por: Ousidhoum, Nedjma, et al.
Publicado: (2024)
por: Ousidhoum, Nedjma, et al.
Publicado: (2024)
Exploring Cultural Nuances in Emotion Perception Across 15 African Languages
por: Ahmad, Ibrahim Said, et al.
Publicado: (2025)
por: Ahmad, Ibrahim Said, et al.
Publicado: (2025)
SemEval-2025 Task 11: Bridging the Gap in Text-Based Emotion Detection
por: Muhammad, Shamsuddeen Hassan, et al.
Publicado: (2025)
por: Muhammad, Shamsuddeen Hassan, et al.
Publicado: (2025)
Evaluating the Capabilities of Large Language Models for Multi-label Emotion Understanding
por: Belay, Tadesse Destaw, et al.
Publicado: (2024)
por: Belay, Tadesse Destaw, et al.
Publicado: (2024)
Li Stripping Behavior of Anode‐Free Solid‐State Batteries Under Intermittent‐Current Discharge Conditions
por: Kiwoong Lee, et al.
Publicado: (2024)
por: Kiwoong Lee, et al.
Publicado: (2024)
Automatic Speech Recognition for African Low-Resource Languages: Challenges and Future Directions
por: Imam, Sukairaj Hafiz, et al.
Publicado: (2025)
por: Imam, Sukairaj Hafiz, et al.
Publicado: (2025)
Why are all LLMs Obsessed with Japanese Culture? On the Hidden Cultural and Regional Biases of LLMs
por: de Landa, Joseba Fernandez, et al.
Publicado: (2026)
por: de Landa, Joseba Fernandez, et al.
Publicado: (2026)
La almendra: memorias eróticas de una mujer rabe / Nedjma; traductor, Cora Cebza
por: Nedjma
por: Nedjma
The Role of Muhammad Amin Rasulzadeh's Ideas in the Formation of National Consciousness in Azerbaijan
por: Mammad Rzayev
Publicado: (2026)
por: Mammad Rzayev
Publicado: (2026)
A Quest for True Islam
por: Rosyad, Rifki
Publicado: (2013)
por: Rosyad, Rifki
Publicado: (2013)
PingPong: A Natural Benchmark for Multi-Turn Code-Switching Dialogues
por: Farhansyah, Mohammad Rifqi, et al.
Publicado: (2026)
por: Farhansyah, Mohammad Rifqi, et al.
Publicado: (2026)
Evaluating Deep Learning Models for African Wildlife Image Classification: From DenseNet to Vision Transformers
por: Aliyu, Lukman Jibril, et al.
Publicado: (2025)
por: Aliyu, Lukman Jibril, et al.
Publicado: (2025)
Ejemplares similares
-
Causal Effects of Trigger Words in Social Media Discussions: A Large-Scale Case Study about UK Politics on Reddit
por: Antypas, Dimosthenis, et al.
Publicado: (2024) -
BLEnD-Vis: Benchmarking Multimodal Cultural Understanding in Vision Language Models
por: Tan, Bryan Chen Zhengyu, et al.
Publicado: (2025) -
Automatic Extraction of Metaphoric Analogies from Literary Texts: Task Formulation, Dataset Construction, and Evaluation
por: Boisson, Joanne, et al.
Publicado: (2024) -
Sensitive Content Classification in Social Media: A Holistic Resource and Evaluation
por: Antypas, Dimosthenis, et al.
Publicado: (2024) -
Adapting Language Models to Indonesian Local Languages: An Empirical Study of Language Transferability on Zero-Shot Settings
por: Putri, Rifki Afina
Publicado: (2025)