PrOnto: Language Model Evaluations for 859 Languages
Fuente:
arXiv
Enregistré dans:
| Auteur principal: | Gessler, Luke |
|---|---|
| Format: | Preprint |
| Publié: |
2023
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
OntoURL: A Benchmark for Evaluating Large Language Models on Symbolic Ontological Understanding, Reasoning and Learning
par: Zhang, Xiao, et autres
Publié: (2025)
par: Zhang, Xiao, et autres
Publié: (2025)
OntoTune: Ontology-Driven Self-training for Aligning Large Language Models
par: Liu, Zhiqiang, et autres
Publié: (2025)
par: Liu, Zhiqiang, et autres
Publié: (2025)
OntoType: Ontology-Guided and Pre-Trained Language Model Assisted Fine-Grained Entity Typing
par: Komarlu, Tanay, et autres
Publié: (2023)
par: Komarlu, Tanay, et autres
Publié: (2023)
From Babbling to Fluency: Evaluating the Evolution of Language Models in Terms of Human Language Acquisition
par: Yang, Qiyuan, et autres
Publié: (2024)
par: Yang, Qiyuan, et autres
Publié: (2024)
iPrOp: Interactive Prompt Optimization for Large Language Models with a Human in the Loop
par: Li, Jiahui, et autres
Publié: (2024)
par: Li, Jiahui, et autres
Publié: (2024)
Evaluating Copyright Takedown Methods for Language Models
par: Wei, Boyi, et autres
Publié: (2024)
par: Wei, Boyi, et autres
Publié: (2024)
TAMS: Translation-Assisted Morphological Segmentation
par: Rice, Enora, et autres
Publié: (2024)
par: Rice, Enora, et autres
Publié: (2024)
Re-evaluating Open-ended Evaluation of Large Language Models
par: Liu, Siqi, et autres
Publié: (2025)
par: Liu, Siqi, et autres
Publié: (2025)
eRST: A Signaled Graph Theory of Discourse Relations and Organization
par: Zeldes, Amir, et autres
Publié: (2024)
par: Zeldes, Amir, et autres
Publié: (2024)
MUSE: Machine Unlearning Six-Way Evaluation for Language Models
par: Shi, Weijia, et autres
Publié: (2024)
par: Shi, Weijia, et autres
Publié: (2024)
Micro Language Models Enable Instant Responses
par: Cheng, Wen, et autres
Publié: (2026)
par: Cheng, Wen, et autres
Publié: (2026)
Evaluating Large Language Models for Radiology Natural Language Processing
par: Liu, Zhengliang, et autres
Publié: (2023)
par: Liu, Zhengliang, et autres
Publié: (2023)
Performance Evaluation of Tokenizers in Large Language Models for the Assamese Language
par: Tamang, Sagar, et autres
Publié: (2024)
par: Tamang, Sagar, et autres
Publié: (2024)
Disentangling Language and Culture for Evaluating Multilingual Large Language Models
par: Ying, Jiahao, et autres
Publié: (2025)
par: Ying, Jiahao, et autres
Publié: (2025)
Pragmatic Competence Evaluation of Large Language Models for the Korean Language
par: Park, Dojun, et autres
Publié: (2024)
par: Park, Dojun, et autres
Publié: (2024)
Language Shapes Mental Health Evaluations in Large Language Models
par: Xu, Jiayi, et autres
Publié: (2026)
par: Xu, Jiayi, et autres
Publié: (2026)
Demystifying Prompts in Language Models via Perplexity Estimation
par: Gonen, Hila, et autres
Publié: (2022)
par: Gonen, Hila, et autres
Publié: (2022)
Evaluation of Geographical Distortions in Language Models
par: Decoupes, Rémy, et autres
Publié: (2024)
par: Decoupes, Rémy, et autres
Publié: (2024)
Evaluating Human-Language Model Interaction
par: Lee, Mina, et autres
Publié: (2022)
par: Lee, Mina, et autres
Publié: (2022)
Evaluating Large Language Models with Psychometrics
par: Li, Yuan, et autres
Publié: (2024)
par: Li, Yuan, et autres
Publié: (2024)
Evaluating Language Model Character Traits
par: Ward, Francis Rhys, et autres
Publié: (2024)
par: Ward, Francis Rhys, et autres
Publié: (2024)
From Priest to Doctor: Domain Adaptation for Low-Resource Neural Machine Translation
par: Marashian, Ali, et autres
Publié: (2024)
par: Marashian, Ali, et autres
Publié: (2024)
PrE-Text: Training Language Models on Private Federated Data in the Age of LLMs
par: Hou, Charlie, et autres
Publié: (2024)
par: Hou, Charlie, et autres
Publié: (2024)
Evaluating Metalinguistic Knowledge in Large Language Models across the World's Languages
par: Arčon, Tjaša, et autres
Publié: (2026)
par: Arčon, Tjaša, et autres
Publié: (2026)
Annotation Errors and NER: A Study with OntoNotes 5.0
par: Bernier-Colborne, Gabriel, et autres
Publié: (2024)
par: Bernier-Colborne, Gabriel, et autres
Publié: (2024)
Prometheus 2: An Open Source Language Model Specialized in Evaluating Other Language Models
par: Kim, Seungone, et autres
Publié: (2024)
par: Kim, Seungone, et autres
Publié: (2024)
Evaluating Language Models' Evaluations of Games
par: Collins, Katherine M., et autres
Publié: (2025)
par: Collins, Katherine M., et autres
Publié: (2025)
Evaluating Neural Language Models as Cognitive Models of Language Acquisition
par: Martínez, Héctor Javier Vázquez, et autres
Publié: (2023)
par: Martínez, Héctor Javier Vázquez, et autres
Publié: (2023)
ConspirED: A Dataset for Cognitive Traits of Conspiracy Theories and Large Language Model Safety
par: Bates, Luke, et autres
Publié: (2025)
par: Bates, Luke, et autres
Publié: (2025)
Comprehensive Evaluation of Large Language Models for Topic Modeling
par: Doi, Tomoki, et autres
Publié: (2024)
par: Doi, Tomoki, et autres
Publié: (2024)
RESPONSE: Benchmarking the Ability of Language Models to Undertake Commonsense Reasoning in Crisis Situation
par: Diallo, Aissatou, et autres
Publié: (2025)
par: Diallo, Aissatou, et autres
Publié: (2025)
AC-EVAL: Evaluating Ancient Chinese Language Understanding in Large Language Models
par: Wei, Yuting, et autres
Publié: (2024)
par: Wei, Yuting, et autres
Publié: (2024)
A Systematic Evaluation of Large Language Models for Natural Language Generation Tasks
par: Ni, Xuanfan, et autres
Publié: (2024)
par: Ni, Xuanfan, et autres
Publié: (2024)
Evaluating and Adapting Large Language Models to Represent Folktales in Low-Resource Languages
par: Meaney, JA, et autres
Publié: (2024)
par: Meaney, JA, et autres
Publié: (2024)
EthioLLM: Multilingual Large Language Models for Ethiopian Languages with Task Evaluation
par: Tonja, Atnafu Lambebo, et autres
Publié: (2024)
par: Tonja, Atnafu Lambebo, et autres
Publié: (2024)
MELAC: Massive Evaluation of Large Language Models with Alignment of Culture in Persian Language
par: Farsi, Farhan, et autres
Publié: (2025)
par: Farsi, Farhan, et autres
Publié: (2025)
Evaluating the Deductive Competence of Large Language Models
par: Seals, Spencer M., et autres
Publié: (2023)
par: Seals, Spencer M., et autres
Publié: (2023)
Evaluating Language Models as Synthetic Data Generators
par: Kim, Seungone, et autres
Publié: (2024)
par: Kim, Seungone, et autres
Publié: (2024)
Evaluating Large Language Models for Material Selection
par: Grandi, Daniele, et autres
Publié: (2024)
par: Grandi, Daniele, et autres
Publié: (2024)
Evaluating Language Translation Models by Playing Telephone
par: Saba, Syeda Jannatus, et autres
Publié: (2025)
par: Saba, Syeda Jannatus, et autres
Publié: (2025)
Documents similaires
-
OntoURL: A Benchmark for Evaluating Large Language Models on Symbolic Ontological Understanding, Reasoning and Learning
par: Zhang, Xiao, et autres
Publié: (2025) -
OntoTune: Ontology-Driven Self-training for Aligning Large Language Models
par: Liu, Zhiqiang, et autres
Publié: (2025) -
OntoType: Ontology-Guided and Pre-Trained Language Model Assisted Fine-Grained Entity Typing
par: Komarlu, Tanay, et autres
Publié: (2023) -
From Babbling to Fluency: Evaluating the Evolution of Language Models in Terms of Human Language Acquisition
par: Yang, Qiyuan, et autres
Publié: (2024) -
iPrOp: Interactive Prompt Optimization for Large Language Models with a Human in the Loop
par: Li, Jiahui, et autres
Publié: (2024)