Form and Meaning in Intrinsic Multilingual Evaluations
Fuente:
arXiv
Saved in:
| Main Authors: | Poelman, Wessel, de Lhoneux, Miryam |
|---|---|
| Format: | Preprint |
| Published: |
2026
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
The Roles of English in Evaluating Multilingual Language Models
by: Poelman, Wessel, et al.
Published: (2024)
by: Poelman, Wessel, et al.
Published: (2024)
QQ: A Toolkit for Language Identifiers and Metadata
by: Poelman, Wessel, et al.
Published: (2026)
by: Poelman, Wessel, et al.
Published: (2026)
On the Interplay between Positional Encodings, Morphological Complexity, and Word Order Flexibility
by: Tatariya, Kushal, et al.
Published: (2025)
by: Tatariya, Kushal, et al.
Published: (2025)
Confounding Factors in Relating Model Performance to Morphology
by: Poelman, Wessel, et al.
Published: (2025)
by: Poelman, Wessel, et al.
Published: (2025)
What is "Typological Diversity" in NLP?
by: Ploeger, Esther, et al.
Published: (2024)
by: Ploeger, Esther, et al.
Published: (2024)
A Principled Framework for Evaluating on Typologically Diverse Languages
by: Ploeger, Esther, et al.
Published: (2024)
by: Ploeger, Esther, et al.
Published: (2024)
How Good is Your Wikipedia? Auditing Data Quality for Low-resource and Multilingual NLP
by: Tatariya, Kushal, et al.
Published: (2024)
by: Tatariya, Kushal, et al.
Published: (2024)
Type and Complexity Signals in Multilingual Question Representations
by: Kokot, Robin, et al.
Published: (2025)
by: Kokot, Robin, et al.
Published: (2025)
Typologically Informed Parameter Aggregation
by: Accou, Stef, et al.
Published: (2026)
by: Accou, Stef, et al.
Published: (2026)
Recipe for Zero-shot POS Tagging: Is It Useful in Realistic Scenarios?
by: Vandenbulcke, Zeno, et al.
Published: (2024)
by: Vandenbulcke, Zeno, et al.
Published: (2024)
Pixology: Probing the Linguistic and Visual Capabilities of Pixel-based Language Models
by: Tatariya, Kushal, et al.
Published: (2024)
by: Tatariya, Kushal, et al.
Published: (2024)
Sociolinguistically Informed Interpretability: A Case Study on Hinglish Emotion Classification
by: Tatariya, Kushal, et al.
Published: (2024)
by: Tatariya, Kushal, et al.
Published: (2024)
Engineering Conversational Search Systems: A Review of Applications, Architectures, and Functional Components
by: Schneider, Phillip, et al.
Published: (2024)
by: Schneider, Phillip, et al.
Published: (2024)
Trans-Tokenization and Cross-lingual Vocabulary Transfers: Language Adaptation of LLMs for Low-Resource NLP
by: Remy, François, et al.
Published: (2024)
by: Remy, François, et al.
Published: (2024)
Discriminating Form and Meaning in Multilingual Models with Minimal-Pair ABX Tasks
by: de Seyssel, Maureen, et al.
Published: (2025)
by: de Seyssel, Maureen, et al.
Published: (2025)
CreoleVal: Multilingual Multitask Benchmarks for Creoles
by: Lent, Heather, et al.
Published: (2023)
by: Lent, Heather, et al.
Published: (2023)
Ad-hoc Concept Forming in the Game Codenames as a Means for Evaluating Large Language Models
by: Hakimov, Sherzod, et al.
Published: (2025)
by: Hakimov, Sherzod, et al.
Published: (2025)
The Roots of Performance Disparity in Multilingual Language Models: Intrinsic Modeling Difficulty or Design Choices?
by: Shani, Chen, et al.
Published: (2026)
by: Shani, Chen, et al.
Published: (2026)
Exploring Intrinsic Language-specific Subspaces in Fine-tuning Multilingual Neural Machine Translation
by: Cao, Zhe, et al.
Published: (2024)
by: Cao, Zhe, et al.
Published: (2024)
The Visual Iconicity Challenge: Evaluating Vision-Language Models on Sign Language Form-Meaning Mapping
by: Keleş, Onur, et al.
Published: (2025)
by: Keleş, Onur, et al.
Published: (2025)
ShortCheck: Checkworthiness Detection of Multilingual Short-Form Videos
by: Vatndal, Henrik, et al.
Published: (2025)
by: Vatndal, Henrik, et al.
Published: (2025)
MASSIVE Multilingual Abstract Meaning Representation: A Dataset and Baselines for Hallucination Detection
by: Regan, Michael, et al.
Published: (2024)
by: Regan, Michael, et al.
Published: (2024)
Systematicity between Forms and Meanings across Languages Supports Efficient Communication
by: Osmelak, Doreen, et al.
Published: (2026)
by: Osmelak, Doreen, et al.
Published: (2026)
XFormParser: A Simple and Effective Multimodal Multilingual Semi-structured Form Parser
by: Cheng, Xianfu, et al.
Published: (2024)
by: Cheng, Xianfu, et al.
Published: (2024)
CorPipe at CRAC 2025: Evaluating Multilingual Encoders for Multilingual Coreference Resolution
by: Straka, Milan
Published: (2025)
by: Straka, Milan
Published: (2025)
METAL: Towards Multilingual Meta-Evaluation
by: Hada, Rishav, et al.
Published: (2024)
by: Hada, Rishav, et al.
Published: (2024)
Multilingual Evaluation of Semantic Textual Relatedness
by: Endait, Sharvi, et al.
Published: (2024)
by: Endait, Sharvi, et al.
Published: (2024)
Are Large Language Model-based Evaluators the Solution to Scaling Up Multilingual Evaluation?
by: Hada, Rishav, et al.
Published: (2023)
by: Hada, Rishav, et al.
Published: (2023)
Exploring the Multilingual NLG Evaluation Abilities of LLM-Based Evaluators
by: Chang, Jiayi, et al.
Published: (2025)
by: Chang, Jiayi, et al.
Published: (2025)
Test Set Quality in Multilingual LLM Evaluation
by: Kranti, Chalamalasetti, et al.
Published: (2025)
by: Kranti, Chalamalasetti, et al.
Published: (2025)
TreeForm: End-to-end Annotation and Evaluation for Form Document Parsing
by: Zmigrod, Ran, et al.
Published: (2024)
by: Zmigrod, Ran, et al.
Published: (2024)
Intrinsic Task-based Evaluation for Referring Expression Generation
by: Chen, Guanyi, et al.
Published: (2024)
by: Chen, Guanyi, et al.
Published: (2024)
INCLUDE: Evaluating Multilingual Language Understanding with Regional Knowledge
by: Romanou, Angelika, et al.
Published: (2024)
by: Romanou, Angelika, et al.
Published: (2024)
Multilingual LLMs Are Not Multilingual Thinkers: Evidence from Hindi Analogy Evaluation
by: Gupta, Ashray, et al.
Published: (2025)
by: Gupta, Ashray, et al.
Published: (2025)
Open ASR Leaderboard: Towards Reproducible and Transparent Multilingual and Long-Form Speech Recognition Evaluation
by: Srivastav, Vaibhav, et al.
Published: (2025)
by: Srivastav, Vaibhav, et al.
Published: (2025)
Linguistically Informed Evaluation of Multilingual ASR for African Languages
by: Chen, Fei-Yueh, et al.
Published: (2026)
by: Chen, Fei-Yueh, et al.
Published: (2026)
Evaluating Cross-Lingual Unlearning in Multilingual Language Models
by: Lizzo, Tyler, et al.
Published: (2026)
by: Lizzo, Tyler, et al.
Published: (2026)
Quantifying the Impact of Translation Errors on Multilingual LLM Evaluation
by: Thellmann, Klaudia-Doris, et al.
Published: (2026)
by: Thellmann, Klaudia-Doris, et al.
Published: (2026)
CLINIC: Evaluating Multilingual Trustworthiness in Language Models for Healthcare
by: Ghosh, Akash, et al.
Published: (2025)
by: Ghosh, Akash, et al.
Published: (2025)
ECoh: Turn-level Coherence Evaluation for Multilingual Dialogues
by: Mendonça, John, et al.
Published: (2024)
by: Mendonça, John, et al.
Published: (2024)
Similar Items
-
The Roles of English in Evaluating Multilingual Language Models
by: Poelman, Wessel, et al.
Published: (2024) -
QQ: A Toolkit for Language Identifiers and Metadata
by: Poelman, Wessel, et al.
Published: (2026) -
On the Interplay between Positional Encodings, Morphological Complexity, and Word Order Flexibility
by: Tatariya, Kushal, et al.
Published: (2025) -
Confounding Factors in Relating Model Performance to Morphology
by: Poelman, Wessel, et al.
Published: (2025) -
What is "Typological Diversity" in NLP?
by: Ploeger, Esther, et al.
Published: (2024)