MALAMUTE: A Multilingual, Highly-granular, Template-free, Education-based Probing Dataset
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Shaier, Sagi, Baker, George Arthur, Sridhar, Chiranthan, Hunter, Lawrence E, von der Wense, Katharina |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Comparing Template-based and Template-free Language Model Probing
par: Shaier, Sagi, et autres
Publié: (2024)
par: Shaier, Sagi, et autres
Publié: (2024)
Desiderata for the Context Use of Question Answering Systems
par: Shaier, Sagi, et autres
Publié: (2024)
par: Shaier, Sagi, et autres
Publié: (2024)
It Is Not About What You Say, It Is About How You Say It: A Surprisingly Simple Approach for Improving Reading Comprehension
par: Shaier, Sagi, et autres
Publié: (2024)
par: Shaier, Sagi, et autres
Publié: (2024)
Who Are All The Stochastic Parrots Imitating? They Should Tell Us!
par: Shaier, Sagi, et autres
Publié: (2023)
par: Shaier, Sagi, et autres
Publié: (2023)
Lost in the Middle, and In-Between: Enhancing Language Models' Ability to Reason Over Long Contexts in Multi-Hop QA
par: Baker, George Arthur, et autres
Publié: (2024)
par: Baker, George Arthur, et autres
Publié: (2024)
Asking Again and Again: Exploring LLM Robustness to Repeated Questions
par: Shaier, Sagi, et autres
Publié: (2024)
par: Shaier, Sagi, et autres
Publié: (2024)
More Experts Than Galaxies: Conditionally-overlapping Experts With Biologically-Inspired Fixed Routing
par: Shaier, Sagi, et autres
Publié: (2024)
par: Shaier, Sagi, et autres
Publié: (2024)
Multi3Hate: Multimodal, Multilingual, and Multicultural Hate Speech Detection with Vision-Language Models
par: Bui, Minh Duc, et autres
Publié: (2024)
par: Bui, Minh Duc, et autres
Publié: (2024)
Adaptive Question Answering: Enhancing Language Model Proficiency for Addressing Knowledge Conflicts with Source Citations
par: Shaier, Sagi, et autres
Publié: (2024)
par: Shaier, Sagi, et autres
Publié: (2024)
Improving Low-Resource Morphological Inflection via Self-Supervised Objectives
par: Wiemerslage, Adam, et autres
Publié: (2025)
par: Wiemerslage, Adam, et autres
Publié: (2025)
Excitation: Momentum For Experts
par: Shaier, Sagi
Publié: (2026)
par: Shaier, Sagi
Publié: (2026)
The Trade-off between Performance, Efficiency, and Fairness in Adapter Modules for Text Classification
par: Bui, Minh Duc, et autres
Publié: (2024)
par: Bui, Minh Duc, et autres
Publié: (2024)
Mitigating Label Length Bias in Large Language Models
par: Sanz-Guerrero, Mario, et autres
Publié: (2025)
par: Sanz-Guerrero, Mario, et autres
Publié: (2025)
Corrective In-Context Learning: Evaluating Self-Correction in Large Language Models
par: Sanz-Guerrero, Mario, et autres
Publié: (2025)
par: Sanz-Guerrero, Mario, et autres
Publié: (2025)
Interdisciplinary Research in Conversation: A Case Study in Computational Morphology for Language Documentation
par: Rice, Enora, et autres
Publié: (2025)
par: Rice, Enora, et autres
Publié: (2025)
Model-Based Ranking of Source Languages for Zero-Shot Cross-Lingual Transfer
par: Ebrahimi, Abteen, et autres
Publié: (2025)
par: Ebrahimi, Abteen, et autres
Publié: (2025)
CLIX: Cross-Lingual Explanations of Idiomatic Expressions
par: Gluck, Aaron, et autres
Publié: (2025)
par: Gluck, Aaron, et autres
Publié: (2025)
Mind the Gap: A Closer Look at Tokenization for Multiple-Choice Question Answering with LLMs
par: Sanz-Guerrero, Mario, et autres
Publié: (2025)
par: Sanz-Guerrero, Mario, et autres
Publié: (2025)
Knowledge Distillation vs. Pretraining from Scratch under a Fixed (Computation) Budget
par: Bui, Minh Duc, et autres
Publié: (2024)
par: Bui, Minh Duc, et autres
Publié: (2024)
Meenz bleibt Meenz, but Large Language Models Do Not Speak Its Dialect
par: Bui, Minh Duc, et autres
Publié: (2026)
par: Bui, Minh Duc, et autres
Publié: (2026)
Untangling the Influence of Typology, Data and Model Architecture on Ranking Transfer Languages for Cross-Lingual POS Tagging
par: Rice, Enora, et autres
Publié: (2025)
par: Rice, Enora, et autres
Publié: (2025)
TAMS: Translation-Assisted Morphological Segmentation
par: Rice, Enora, et autres
Publié: (2024)
par: Rice, Enora, et autres
Publié: (2024)
From Priest to Doctor: Domain Adaptation for Low-Resource Neural Machine Translation
par: Marashian, Ali, et autres
Publié: (2024)
par: Marashian, Ali, et autres
Publié: (2024)
Large Language Models Discriminate Against Speakers of German Dialects
par: Bui, Minh Duc, et autres
Publié: (2025)
par: Bui, Minh Duc, et autres
Publié: (2025)
JGU Mainz's Submission to the WMT25 Shared Task on LLMs with Limited Resources for Slavic Languages: MT and QA
par: Saadi, Hossain Shaikh, et autres
Publié: (2025)
par: Saadi, Hossain Shaikh, et autres
Publié: (2025)
MASSIVE Multilingual Abstract Meaning Representation: A Dataset and Baselines for Hallucination Detection
par: Regan, Michael, et autres
Publié: (2024)
par: Regan, Michael, et autres
Publié: (2024)
From If-Statements to ML Pipelines: Revisiting Bias in Code-Generation
par: Bui, Minh Duc, et autres
Publié: (2026)
par: Bui, Minh Duc, et autres
Publié: (2026)
Measuring Contextual Informativeness in Child-Directed Text
par: Valentini, Maria, et autres
Publié: (2024)
par: Valentini, Maria, et autres
Publié: (2024)
On Generalization across Measurement Systems: LLMs Entail More Test-Time Compute for Underrepresented Cultures
par: Bui, Minh Duc, et autres
Publié: (2025)
par: Bui, Minh Duc, et autres
Publié: (2025)
Greater accessibility can amplify discrimination in generative AI
par: Holtermann, Carolin, et autres
Publié: (2026)
par: Holtermann, Carolin, et autres
Publié: (2026)
NALA_MAINZ at BLP-2025 Task 2: A Multi-agent Approach for Bangla Instruction to Python Code Generation
par: Saadi, Hossain Shaikh, et autres
Publié: (2025)
par: Saadi, Hossain Shaikh, et autres
Publié: (2025)
A New Massive Multilingual Dataset for High-Performance Language Technologies
par: de Gibert, Ona, et autres
Publié: (2024)
par: de Gibert, Ona, et autres
Publié: (2024)
LangMark: A Multilingual Dataset for Automatic Post-Editing
par: Velazquez, Diego, et autres
Publié: (2025)
par: Velazquez, Diego, et autres
Publié: (2025)
MultiMUC: Multilingual Template Filling on MUC-4
par: Gantt, William, et autres
Publié: (2024)
par: Gantt, William, et autres
Publié: (2024)
Generating Harder Cross-document Event Coreference Resolution Datasets using Metaphoric Paraphrasing
par: Ahmed, Shafiuddin Rehan, et autres
Publié: (2024)
par: Ahmed, Shafiuddin Rehan, et autres
Publié: (2024)
M2G-Eval: Enhancing and Evaluating Multi-granularity Multilingual Code Generation
par: Xu, Fanglin, et autres
Publié: (2025)
par: Xu, Fanglin, et autres
Publié: (2025)
An Expanded Massive Multilingual Dataset for High-Performance Language Technologies (HPLT)
par: Burchell, Laurie, et autres
Publié: (2025)
par: Burchell, Laurie, et autres
Publié: (2025)
Macaron: Controlled, Human-Written Benchmark for Multilingual and Multicultural Reasoning via Template-Filling
par: Elsetohy, Alaa, et autres
Publié: (2026)
par: Elsetohy, Alaa, et autres
Publié: (2026)
ViClaim: A Multilingual Multilabel Dataset for Automatic Claim Detection in Videos
par: Giedemann, Patrick, et autres
Publié: (2025)
par: Giedemann, Patrick, et autres
Publié: (2025)
Verifying Lock-free Search Structure Templates
par: Patel, Nisarg, et autres
Publié: (2024)
par: Patel, Nisarg, et autres
Publié: (2024)
Documents similaires
-
Comparing Template-based and Template-free Language Model Probing
par: Shaier, Sagi, et autres
Publié: (2024) -
Desiderata for the Context Use of Question Answering Systems
par: Shaier, Sagi, et autres
Publié: (2024) -
It Is Not About What You Say, It Is About How You Say It: A Surprisingly Simple Approach for Improving Reading Comprehension
par: Shaier, Sagi, et autres
Publié: (2024) -
Who Are All The Stochastic Parrots Imitating? They Should Tell Us!
par: Shaier, Sagi, et autres
Publié: (2023) -
Lost in the Middle, and In-Between: Enhancing Language Models' Ability to Reason Over Long Contexts in Multi-Hop QA
par: Baker, George Arthur, et autres
Publié: (2024)