Localizing AI: Evaluating Open-Weight Language Models for Languages of Baltic States
Fuente:
arXiv
Guardado en:
| Autores principales: | Kapočiūtė-Dzikienė, Jurgita, Bergmanis, Toms, Pinnis, Mārcis |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
TildeOpen LLM: Leveraging Curriculum Learning to Achieve Equitable Language Representation
por: Bergmanis, Toms, et al.
Publicado: (2026)
por: Bergmanis, Toms, et al.
Publicado: (2026)
Seimo posėdžių stenogramų tekstynas autorystės nustatymo bei autoriaus profilio sudarymo tyrimams
por: Jurgita Kapočiūtė-Dzikienė
Publicado: (2014)
por: Jurgita Kapočiūtė-Dzikienė
Publicado: (2014)
Evaluating Open-Weight Large Language Models for Structured Data Extraction from Narrative Medical Reports Across Multiple Use Cases and Languages
por: Spaanderman, Douwe J., et al.
Publicado: (2025)
por: Spaanderman, Douwe J., et al.
Publicado: (2025)
Ensemble Debates with Local Large Language Models for AI Alignment
por: Sarabamoun, Ephraiem
Publicado: (2025)
por: Sarabamoun, Ephraiem
Publicado: (2025)
Systematic Weight Evaluation for Pruning Large Language Models: Enhancing Performance and Sustainability
por: Islam, Ashhadul, et al.
Publicado: (2025)
por: Islam, Ashhadul, et al.
Publicado: (2025)
The Super Weight in Large Language Models
por: Yu, Mengxia, et al.
Publicado: (2024)
por: Yu, Mengxia, et al.
Publicado: (2024)
Scaling Open-Weight Large Language Models for Hydropower Regulatory Information Extraction: A Systematic Analysis
por: Yoon, Hong-Jun, et al.
Publicado: (2025)
por: Yoon, Hong-Jun, et al.
Publicado: (2025)
Evaluating Text Summaries Generated by Large Language Models Using OpenAI's GPT
por: Shakil, Hassan, et al.
Publicado: (2024)
por: Shakil, Hassan, et al.
Publicado: (2024)
Mathematical Reasoning in Large Language Models: Benchmarks, Architectures, Evaluation, and Open Challenges
por: Amjad, Husnain, et al.
Publicado: (2026)
por: Amjad, Husnain, et al.
Publicado: (2026)
Language Statistics and False Belief Reasoning: Evidence from 41 Open-Weight LMs
por: Trott, Sean, et al.
Publicado: (2026)
por: Trott, Sean, et al.
Publicado: (2026)
Multi-RADS Synthetic Radiology Report Dataset and Head-to-Head Benchmarking of 41 Open-Weight and Proprietary Language Models
por: Bose, Kartik, et al.
Publicado: (2026)
por: Bose, Kartik, et al.
Publicado: (2026)
Latxa: An Open Language Model and Evaluation Suite for Basque
por: Etxaniz, Julen, et al.
Publicado: (2024)
por: Etxaniz, Julen, et al.
Publicado: (2024)
Weights-Rotated Preference Optimization for Large Language Models
por: Yang, Chenxu, et al.
Publicado: (2025)
por: Yang, Chenxu, et al.
Publicado: (2025)
Performance Evaluation of Open-Source Large Language Models for Assisting Pathology Report Writing in Japanese
por: Kawai, Masataka, et al.
Publicado: (2026)
por: Kawai, Masataka, et al.
Publicado: (2026)
Evaluating Contrast Localizer for Identifying Causal Units in Social & Mathematical Tasks in Language Models
por: Jamaa, Yassine, et al.
Publicado: (2025)
por: Jamaa, Yassine, et al.
Publicado: (2025)
Evaluating Language Models' Evaluations of Games
por: Collins, Katherine M., et al.
Publicado: (2025)
por: Collins, Katherine M., et al.
Publicado: (2025)
Offline Training of Language Model Agents with Functions as Learnable Weights
por: Zhang, Shaokun, et al.
Publicado: (2024)
por: Zhang, Shaokun, et al.
Publicado: (2024)
Evaluating Neural Language Models as Cognitive Models of Language Acquisition
por: Martínez, Héctor Javier Vázquez, et al.
Publicado: (2023)
por: Martínez, Héctor Javier Vázquez, et al.
Publicado: (2023)
On the Importance and Evaluation of Narrativity in Natural Language AI Explanations
por: Cedro, Mateusz, et al.
Publicado: (2026)
por: Cedro, Mateusz, et al.
Publicado: (2026)
SafetyPrompts: a Systematic Review of Open Datasets for Evaluating and Improving Large Language Model Safety
por: Röttger, Paul, et al.
Publicado: (2024)
por: Röttger, Paul, et al.
Publicado: (2024)
OpenToM: A Comprehensive Benchmark for Evaluating Theory-of-Mind Reasoning Capabilities of Large Language Models
por: Xu, Hainiu, et al.
Publicado: (2024)
por: Xu, Hainiu, et al.
Publicado: (2024)
Open Ko-LLM Leaderboard: Evaluating Large Language Models in Korean with Ko-H5 Benchmark
por: Park, Chanjun, et al.
Publicado: (2024)
por: Park, Chanjun, et al.
Publicado: (2024)
OpenJAI-v1.0: An Open Thai Large Language Model
por: Trakuekul, Pontakorn, et al.
Publicado: (2025)
por: Trakuekul, Pontakorn, et al.
Publicado: (2025)
OpenR: An Open Source Framework for Advanced Reasoning with Large Language Models
por: Wang, Jun, et al.
Publicado: (2024)
por: Wang, Jun, et al.
Publicado: (2024)
Cultural Bias in Large Language Models: Evaluating AI Agents through Moral Questionnaires
por: Münker, Simon
Publicado: (2025)
por: Münker, Simon
Publicado: (2025)
TinyLlama: An Open-Source Small Language Model
por: Zhang, Peiyuan, et al.
Publicado: (2024)
por: Zhang, Peiyuan, et al.
Publicado: (2024)
Sailor: Open Language Models for South-East Asia
por: Dou, Longxu, et al.
Publicado: (2024)
por: Dou, Longxu, et al.
Publicado: (2024)
YuLan: An Open-source Large Language Model
por: Zhu, Yutao, et al.
Publicado: (2024)
por: Zhu, Yutao, et al.
Publicado: (2024)
DOCS: Quantifying Weight Similarity for Deeper Insights into Large Language Models
por: Min, Zeping, et al.
Publicado: (2025)
por: Min, Zeping, et al.
Publicado: (2025)
Importance Weighting Can Help Large Language Models Self-Improve
por: Jiang, Chunyang, et al.
Publicado: (2024)
por: Jiang, Chunyang, et al.
Publicado: (2024)
Merge and Conquer: Instructing Multilingual Models by Adding Target Language Weights
por: Valero, Eneko, et al.
Publicado: (2026)
por: Valero, Eneko, et al.
Publicado: (2026)
OpenAI's GPT-OSS-20B Model and Safety Alignment Issues in a Low-Resource Language
por: Inuwa-Dutse, Isa
Publicado: (2025)
por: Inuwa-Dutse, Isa
Publicado: (2025)
Open-SQL Framework: Enhancing Text-to-SQL on Open-source Large Language Models
por: Chen, Xiaojun, et al.
Publicado: (2024)
por: Chen, Xiaojun, et al.
Publicado: (2024)
LlamaTurk: Adapting Open-Source Generative Large Language Models for Low-Resource Language
por: Toraman, Cagri
Publicado: (2024)
por: Toraman, Cagri
Publicado: (2024)
Open-Ended Wargames with Large Language Models
por: Hogan, Daniel P., et al.
Publicado: (2024)
por: Hogan, Daniel P., et al.
Publicado: (2024)
Understanding AI Evaluation Patterns: How Different GPT Models Assess Vision-Language Descriptions
por: Abdoli, Sajjad, et al.
Publicado: (2025)
por: Abdoli, Sajjad, et al.
Publicado: (2025)
On Speeding Up Language Model Evaluation
por: Zhou, Jin Peng, et al.
Publicado: (2024)
por: Zhou, Jin Peng, et al.
Publicado: (2024)
Evaluating Quantized Large Language Models
por: Li, Shiyao, et al.
Publicado: (2024)
por: Li, Shiyao, et al.
Publicado: (2024)
FlexOlmo: Open Language Models for Flexible Data Use
por: Shi, Weijia, et al.
Publicado: (2025)
por: Shi, Weijia, et al.
Publicado: (2025)
An Open Source Data Contamination Report for Large Language Models
por: Li, Yucheng, et al.
Publicado: (2023)
por: Li, Yucheng, et al.
Publicado: (2023)
Ejemplares similares
-
TildeOpen LLM: Leveraging Curriculum Learning to Achieve Equitable Language Representation
por: Bergmanis, Toms, et al.
Publicado: (2026) -
Seimo posėdžių stenogramų tekstynas autorystės nustatymo bei autoriaus profilio sudarymo tyrimams
por: Jurgita Kapočiūtė-Dzikienė
Publicado: (2014) -
Evaluating Open-Weight Large Language Models for Structured Data Extraction from Narrative Medical Reports Across Multiple Use Cases and Languages
por: Spaanderman, Douwe J., et al.
Publicado: (2025) -
Ensemble Debates with Local Large Language Models for AI Alignment
por: Sarabamoun, Ephraiem
Publicado: (2025) -
Systematic Weight Evaluation for Pruning Large Language Models: Enhancing Performance and Sustainability
por: Islam, Ashhadul, et al.
Publicado: (2025)