Benchmarking Multimodal Models for Ukrainian Language Understanding Across Academic and Cultural Domains
Fuente:
arXiv
Guardado en:
| Autores principales: | Paniv, Yurii, Kiulian, Artur, Chaplynskyi, Dmytro, Khandoga, Mykola, Polishko, Anton, Bas, Tetiana, Gabrielli, Guillermo |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
From Bytes to Borsch: Fine-Tuning Gemma and Mistral for the Ukrainian Language Representation
por: Kiulian, Artur, et al.
Publicado: (2024)
por: Kiulian, Artur, et al.
Publicado: (2024)
Setting up the Data Printer with Improved English to Ukrainian Machine Translation
por: Paniv, Yurii, et al.
Publicado: (2024)
por: Paniv, Yurii, et al.
Publicado: (2024)
From English-Centric to Effective Bilingual: LLMs with Custom Tokenizers for Underrepresented Languages
por: Kiulian, Artur, et al.
Publicado: (2024)
por: Kiulian, Artur, et al.
Publicado: (2024)
Sovereign Large Language Models: Advantages, Strategy and Regulations
por: Bondarenko, Mykhailo, et al.
Publicado: (2025)
por: Bondarenko, Mykhailo, et al.
Publicado: (2025)
Unsupervised Data Validation Methods for Efficient Model Training
por: Paniv, Yurii
Publicado: (2024)
por: Paniv, Yurii
Publicado: (2024)
Beyond Uniform Credit: Causal Credit Assignment for Policy Optimization
por: Khandoga, Mykola, et al.
Publicado: (2026)
por: Khandoga, Mykola, et al.
Publicado: (2026)
Qwen Goes Brrr: Off-the-Shelf RAG for Ukrainian Multi-Domain Document Understanding
por: Bazdyrev, Anton, et al.
Publicado: (2026)
por: Bazdyrev, Anton, et al.
Publicado: (2026)
Assessing Gender Bias in LLMs: Comparing LLM Outputs with Human Perceptions and Official Statistics
por: Bas, Tetiana
Publicado: (2024)
por: Bas, Tetiana
Publicado: (2024)
Towards Multilingual LLM Evaluation for Baltic and Nordic languages: A study on Lithuanian History
por: Kostiuk, Yevhen, et al.
Publicado: (2025)
por: Kostiuk, Yevhen, et al.
Publicado: (2025)
The Veln(ia)s is in the Details: Evaluating LLM Judgment on Latvian and Lithuanian Short Answer Matching
por: Kostiuk, Yevhen, et al.
Publicado: (2025)
por: Kostiuk, Yevhen, et al.
Publicado: (2025)
DRISHTIKON: A Multimodal Multilingual Benchmark for Testing Language Models' Understanding on Indian Culture
por: Maji, Arijit, et al.
Publicado: (2025)
por: Maji, Arijit, et al.
Publicado: (2025)
Entropy of Ukrainian
por: Lavreniuk, Anton, et al.
Publicado: (2026)
por: Lavreniuk, Anton, et al.
Publicado: (2026)
Do Large Language Models Understand Morality Across Cultures?
por: Mohammadi, Hadi, et al.
Publicado: (2025)
por: Mohammadi, Hadi, et al.
Publicado: (2025)
An End-to-End Ukrainian RAG for Local Deployment. Optimized Hybrid Search and Lightweight Generation
por: Trokhymovych, Mykola, et al.
Publicado: (2026)
por: Trokhymovych, Mykola, et al.
Publicado: (2026)
AlignTune: Modular Toolkit for Post-Training Alignment of Large Language Models
por: Lyngkhoi, R E Zera Marveen, et al.
Publicado: (2026)
por: Lyngkhoi, R E Zera Marveen, et al.
Publicado: (2026)
The Tokenizer Tax Across 25 European Languages: Domain Invariance, Cross-Lingual Few-Shot Effects, and the Ukrainian Penalty
por: Ovcharov, Volodymyr
Publicado: (2026)
por: Ovcharov, Volodymyr
Publicado: (2026)
Let's Play Across Cultures: A Large Multilingual, Multicultural Benchmark for Assessing Language Models' Understanding of Sports
por: Singh, Punit Kumar, et al.
Publicado: (2025)
por: Singh, Punit Kumar, et al.
Publicado: (2025)
Do LLMs Understand Wine Descriptors Across Cultures? A Benchmark for Cultural Adaptations of Wine Reviews
por: Zou, Chenye, et al.
Publicado: (2025)
por: Zou, Chenye, et al.
Publicado: (2025)
Benchmarking Vision Language Models for Cultural Understanding
por: Nayak, Shravan, et al.
Publicado: (2024)
por: Nayak, Shravan, et al.
Publicado: (2024)
Cultural Bias Matters: A Cross-Cultural Benchmark Dataset and Sentiment-Enriched Model for Understanding Multimodal Metaphors
por: Yang, Senqi, et al.
Publicado: (2025)
por: Yang, Senqi, et al.
Publicado: (2025)
Just on Time: Token-Level Early Stopping for Diffusion Language Models
por: Kohut, Zahar, et al.
Publicado: (2026)
por: Kohut, Zahar, et al.
Publicado: (2026)
Adversarial Confusion Attack: Disrupting Multimodal Large Language Models
por: Hoscilowicz, Jakub, et al.
Publicado: (2025)
por: Hoscilowicz, Jakub, et al.
Publicado: (2025)
Russo-Ukrainian war disinformation detection in suspicious Telegram channels
por: Bazdyrev, Anton
Publicado: (2025)
por: Bazdyrev, Anton
Publicado: (2025)
Eye Movements, Item Modality, and Multimodal Second Language Vocabulary Learning: Processing and Outcomes
por: Jonathan Malone, et al.
Publicado: (2025)
por: Jonathan Malone, et al.
Publicado: (2025)
A Culturally-diverse Multilingual Multimodal Video Benchmark & Model
por: Shafique, Bhuiyan Sanjid, et al.
Publicado: (2025)
por: Shafique, Bhuiyan Sanjid, et al.
Publicado: (2025)
Beyond KL Divergence: Policy Optimization with Flexible Bregman Divergences for LLM Reasoning
por: Yuan, Rui, et al.
Publicado: (2026)
por: Yuan, Rui, et al.
Publicado: (2026)
RAVENEA: A Benchmark for Multimodal Retrieval-Augmented Visual Culture Understanding
por: Li, Jiaang, et al.
Publicado: (2025)
por: Li, Jiaang, et al.
Publicado: (2025)
Evolution of wartime discourse on Telegram: A comparative study of Ukrainian and Russian policymakers' communication before and after Russia's full-scale invasion of Ukraine
por: Makhortykh, Mykola, et al.
Publicado: (2025)
por: Makhortykh, Mykola, et al.
Publicado: (2025)
Disparities In Negation Understanding Across Languages In Vision-Language Models
por: Moraitaki, Charikleia, et al.
Publicado: (2026)
por: Moraitaki, Charikleia, et al.
Publicado: (2026)
MAC: A Live Benchmark for Multimodal Large Language Models in Scientific Understanding
por: Jiang, Mohan, et al.
Publicado: (2025)
por: Jiang, Mohan, et al.
Publicado: (2025)
Hanfu-Bench: A Multimodal Benchmark on Cross-Temporal Cultural Understanding and Transcreation
por: Zhou, Li, et al.
Publicado: (2025)
por: Zhou, Li, et al.
Publicado: (2025)
Large Language Models for Expansion of Spoken Language Understanding Systems to New Languages
por: Hoscilowicz, Jakub, et al.
Publicado: (2024)
por: Hoscilowicz, Jakub, et al.
Publicado: (2024)
ReadMe++: Benchmarking Multilingual Language Models for Multi-Domain Readability Assessment
por: Naous, Tarek, et al.
Publicado: (2023)
por: Naous, Tarek, et al.
Publicado: (2023)
MEGAVERSE: Benchmarking Large Language Models Across Languages, Modalities, Models and Tasks
por: Ahuja, Sanchit, et al.
Publicado: (2023)
por: Ahuja, Sanchit, et al.
Publicado: (2023)
Cosine-Similarity Routing with Semantic Anchors for Interpretable Mixture-of-Experts Language Models
por: Ternovtsii, Ivan, et al.
Publicado: (2025)
por: Ternovtsii, Ivan, et al.
Publicado: (2025)
Inverse Language Modeling towards Robust and Grounded LLMs
por: Gabrielli, Davide, et al.
Publicado: (2025)
por: Gabrielli, Davide, et al.
Publicado: (2025)
SPORTU: A Comprehensive Sports Understanding Benchmark for Multimodal Large Language Models
por: Xia, Haotian, et al.
Publicado: (2024)
por: Xia, Haotian, et al.
Publicado: (2024)
MMRC: A Large-Scale Benchmark for Understanding Multimodal Large Language Model in Real-World Conversation
por: Xue, Haochen, et al.
Publicado: (2025)
por: Xue, Haochen, et al.
Publicado: (2025)
HKCanto-Eval: A Benchmark for Evaluating Cantonese Language Understanding and Cultural Comprehension in LLMs
por: Cheng, Tsz Chung, et al.
Publicado: (2025)
por: Cheng, Tsz Chung, et al.
Publicado: (2025)
EmoBench-UA: A Benchmark Dataset for Emotion Detection in Ukrainian
por: Dementieva, Daryna, et al.
Publicado: (2025)
por: Dementieva, Daryna, et al.
Publicado: (2025)
Ejemplares similares
-
From Bytes to Borsch: Fine-Tuning Gemma and Mistral for the Ukrainian Language Representation
por: Kiulian, Artur, et al.
Publicado: (2024) -
Setting up the Data Printer with Improved English to Ukrainian Machine Translation
por: Paniv, Yurii, et al.
Publicado: (2024) -
From English-Centric to Effective Bilingual: LLMs with Custom Tokenizers for Underrepresented Languages
por: Kiulian, Artur, et al.
Publicado: (2024) -
Sovereign Large Language Models: Advantages, Strategy and Regulations
por: Bondarenko, Mykhailo, et al.
Publicado: (2025) -
Unsupervised Data Validation Methods for Efficient Model Training
por: Paniv, Yurii
Publicado: (2024)