PrOnto: Language Model Evaluations for 859 Languages
Fuente:
arXiv
Guardado en:
| Autor principal: | Gessler, Luke |
|---|---|
| Formato: | Preprint |
| Publicado: |
2023
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
OntoURL: A Benchmark for Evaluating Large Language Models on Symbolic Ontological Understanding, Reasoning and Learning
por: Zhang, Xiao, et al.
Publicado: (2025)
por: Zhang, Xiao, et al.
Publicado: (2025)
OntoTune: Ontology-Driven Self-training for Aligning Large Language Models
por: Liu, Zhiqiang, et al.
Publicado: (2025)
por: Liu, Zhiqiang, et al.
Publicado: (2025)
OntoType: Ontology-Guided and Pre-Trained Language Model Assisted Fine-Grained Entity Typing
por: Komarlu, Tanay, et al.
Publicado: (2023)
por: Komarlu, Tanay, et al.
Publicado: (2023)
From Babbling to Fluency: Evaluating the Evolution of Language Models in Terms of Human Language Acquisition
por: Yang, Qiyuan, et al.
Publicado: (2024)
por: Yang, Qiyuan, et al.
Publicado: (2024)
iPrOp: Interactive Prompt Optimization for Large Language Models with a Human in the Loop
por: Li, Jiahui, et al.
Publicado: (2024)
por: Li, Jiahui, et al.
Publicado: (2024)
Evaluating Copyright Takedown Methods for Language Models
por: Wei, Boyi, et al.
Publicado: (2024)
por: Wei, Boyi, et al.
Publicado: (2024)
TAMS: Translation-Assisted Morphological Segmentation
por: Rice, Enora, et al.
Publicado: (2024)
por: Rice, Enora, et al.
Publicado: (2024)
Re-evaluating Open-ended Evaluation of Large Language Models
por: Liu, Siqi, et al.
Publicado: (2025)
por: Liu, Siqi, et al.
Publicado: (2025)
eRST: A Signaled Graph Theory of Discourse Relations and Organization
por: Zeldes, Amir, et al.
Publicado: (2024)
por: Zeldes, Amir, et al.
Publicado: (2024)
MUSE: Machine Unlearning Six-Way Evaluation for Language Models
por: Shi, Weijia, et al.
Publicado: (2024)
por: Shi, Weijia, et al.
Publicado: (2024)
Micro Language Models Enable Instant Responses
por: Cheng, Wen, et al.
Publicado: (2026)
por: Cheng, Wen, et al.
Publicado: (2026)
Evaluating Large Language Models for Radiology Natural Language Processing
por: Liu, Zhengliang, et al.
Publicado: (2023)
por: Liu, Zhengliang, et al.
Publicado: (2023)
Performance Evaluation of Tokenizers in Large Language Models for the Assamese Language
por: Tamang, Sagar, et al.
Publicado: (2024)
por: Tamang, Sagar, et al.
Publicado: (2024)
Disentangling Language and Culture for Evaluating Multilingual Large Language Models
por: Ying, Jiahao, et al.
Publicado: (2025)
por: Ying, Jiahao, et al.
Publicado: (2025)
Pragmatic Competence Evaluation of Large Language Models for the Korean Language
por: Park, Dojun, et al.
Publicado: (2024)
por: Park, Dojun, et al.
Publicado: (2024)
Language Shapes Mental Health Evaluations in Large Language Models
por: Xu, Jiayi, et al.
Publicado: (2026)
por: Xu, Jiayi, et al.
Publicado: (2026)
Demystifying Prompts in Language Models via Perplexity Estimation
por: Gonen, Hila, et al.
Publicado: (2022)
por: Gonen, Hila, et al.
Publicado: (2022)
Evaluation of Geographical Distortions in Language Models
por: Decoupes, Rémy, et al.
Publicado: (2024)
por: Decoupes, Rémy, et al.
Publicado: (2024)
Evaluating Human-Language Model Interaction
por: Lee, Mina, et al.
Publicado: (2022)
por: Lee, Mina, et al.
Publicado: (2022)
Evaluating Large Language Models with Psychometrics
por: Li, Yuan, et al.
Publicado: (2024)
por: Li, Yuan, et al.
Publicado: (2024)
Evaluating Language Model Character Traits
por: Ward, Francis Rhys, et al.
Publicado: (2024)
por: Ward, Francis Rhys, et al.
Publicado: (2024)
From Priest to Doctor: Domain Adaptation for Low-Resource Neural Machine Translation
por: Marashian, Ali, et al.
Publicado: (2024)
por: Marashian, Ali, et al.
Publicado: (2024)
PrE-Text: Training Language Models on Private Federated Data in the Age of LLMs
por: Hou, Charlie, et al.
Publicado: (2024)
por: Hou, Charlie, et al.
Publicado: (2024)
Evaluating Metalinguistic Knowledge in Large Language Models across the World's Languages
por: Arčon, Tjaša, et al.
Publicado: (2026)
por: Arčon, Tjaša, et al.
Publicado: (2026)
Annotation Errors and NER: A Study with OntoNotes 5.0
por: Bernier-Colborne, Gabriel, et al.
Publicado: (2024)
por: Bernier-Colborne, Gabriel, et al.
Publicado: (2024)
Prometheus 2: An Open Source Language Model Specialized in Evaluating Other Language Models
por: Kim, Seungone, et al.
Publicado: (2024)
por: Kim, Seungone, et al.
Publicado: (2024)
Evaluating Language Models' Evaluations of Games
por: Collins, Katherine M., et al.
Publicado: (2025)
por: Collins, Katherine M., et al.
Publicado: (2025)
Evaluating Neural Language Models as Cognitive Models of Language Acquisition
por: Martínez, Héctor Javier Vázquez, et al.
Publicado: (2023)
por: Martínez, Héctor Javier Vázquez, et al.
Publicado: (2023)
ConspirED: A Dataset for Cognitive Traits of Conspiracy Theories and Large Language Model Safety
por: Bates, Luke, et al.
Publicado: (2025)
por: Bates, Luke, et al.
Publicado: (2025)
Comprehensive Evaluation of Large Language Models for Topic Modeling
por: Doi, Tomoki, et al.
Publicado: (2024)
por: Doi, Tomoki, et al.
Publicado: (2024)
RESPONSE: Benchmarking the Ability of Language Models to Undertake Commonsense Reasoning in Crisis Situation
por: Diallo, Aissatou, et al.
Publicado: (2025)
por: Diallo, Aissatou, et al.
Publicado: (2025)
AC-EVAL: Evaluating Ancient Chinese Language Understanding in Large Language Models
por: Wei, Yuting, et al.
Publicado: (2024)
por: Wei, Yuting, et al.
Publicado: (2024)
A Systematic Evaluation of Large Language Models for Natural Language Generation Tasks
por: Ni, Xuanfan, et al.
Publicado: (2024)
por: Ni, Xuanfan, et al.
Publicado: (2024)
Evaluating and Adapting Large Language Models to Represent Folktales in Low-Resource Languages
por: Meaney, JA, et al.
Publicado: (2024)
por: Meaney, JA, et al.
Publicado: (2024)
EthioLLM: Multilingual Large Language Models for Ethiopian Languages with Task Evaluation
por: Tonja, Atnafu Lambebo, et al.
Publicado: (2024)
por: Tonja, Atnafu Lambebo, et al.
Publicado: (2024)
MELAC: Massive Evaluation of Large Language Models with Alignment of Culture in Persian Language
por: Farsi, Farhan, et al.
Publicado: (2025)
por: Farsi, Farhan, et al.
Publicado: (2025)
Evaluating the Deductive Competence of Large Language Models
por: Seals, Spencer M., et al.
Publicado: (2023)
por: Seals, Spencer M., et al.
Publicado: (2023)
Evaluating Language Models as Synthetic Data Generators
por: Kim, Seungone, et al.
Publicado: (2024)
por: Kim, Seungone, et al.
Publicado: (2024)
Evaluating Large Language Models for Material Selection
por: Grandi, Daniele, et al.
Publicado: (2024)
por: Grandi, Daniele, et al.
Publicado: (2024)
Evaluating Language Translation Models by Playing Telephone
por: Saba, Syeda Jannatus, et al.
Publicado: (2025)
por: Saba, Syeda Jannatus, et al.
Publicado: (2025)
Ejemplares similares
-
OntoURL: A Benchmark for Evaluating Large Language Models on Symbolic Ontological Understanding, Reasoning and Learning
por: Zhang, Xiao, et al.
Publicado: (2025) -
OntoTune: Ontology-Driven Self-training for Aligning Large Language Models
por: Liu, Zhiqiang, et al.
Publicado: (2025) -
OntoType: Ontology-Guided and Pre-Trained Language Model Assisted Fine-Grained Entity Typing
por: Komarlu, Tanay, et al.
Publicado: (2023) -
From Babbling to Fluency: Evaluating the Evolution of Language Models in Terms of Human Language Acquisition
por: Yang, Qiyuan, et al.
Publicado: (2024) -
iPrOp: Interactive Prompt Optimization for Large Language Models with a Human in the Loop
por: Li, Jiahui, et al.
Publicado: (2024)