Evaluating Polish linguistic and cultural competency in large language models
Fuente:
arXiv
Saved in:
| Main Authors: | Dadas, Sławomir, Grębowiec, Małgorzata, Perełkiewicz, Michał, Poświata, Rafał |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
PL-MTEB: Polish Massive Text Embedding Benchmark
by: Poświata, Rafał, et al.
Published: (2024)
by: Poświata, Rafał, et al.
Published: (2024)
PIRB: A Comprehensive Benchmark of Polish Dense and Hybrid Text Retrieval Methods
by: Dadas, Sławomir, et al.
Published: (2024)
by: Dadas, Sławomir, et al.
Published: (2024)
Unveiling Dual Quality in Product Reviews: An NLP-Based Approach
by: Poświata, Rafał, et al.
Published: (2025)
by: Poświata, Rafał, et al.
Published: (2025)
Long-Context Encoder Models for Polish Language Understanding
by: Dadas, Sławomir, et al.
Published: (2026)
by: Dadas, Sławomir, et al.
Published: (2026)
SMCLM: Semantically Meaningful Causal Language Modeling for Autoregressive Paraphrase Generation
by: Perełkiewicz, Michał, et al.
Published: (2025)
by: Perełkiewicz, Michał, et al.
Published: (2025)
Assessing generalization capability of text ranking models in Polish
by: Dadas, Sławomir, et al.
Published: (2024)
by: Dadas, Sławomir, et al.
Published: (2024)
A Review of the Challenges with Massive Web-mined Corpora Used in Large Language Models Pre-Training
by: Perełkiewicz, Michał, et al.
Published: (2024)
by: Perełkiewicz, Michał, et al.
Published: (2024)
A blind spot for large language models: Supradiegetic linguistic information
by: Zimmerman, Julia Witte, et al.
Published: (2023)
by: Zimmerman, Julia Witte, et al.
Published: (2023)
PRODIS -- a speech database and a phoneme-based language model for the study of predictability effects in Polish
by: Malisz, Zofia, et al.
Published: (2024)
by: Malisz, Zofia, et al.
Published: (2024)
Large language models and linguistic intentionality
by: Grindrod, Jumbly
Published: (2024)
by: Grindrod, Jumbly
Published: (2024)
A conclusive remark on linguistic theorizing and language modeling
by: Chesi, Cristiano
Published: (2025)
by: Chesi, Cristiano
Published: (2025)
Investigating large language models for their competence in extracting grammatically sound sentences from transcribed noisy utterances
by: Wróblewska, Alina
Published: (2024)
by: Wróblewska, Alina
Published: (2024)
Distinct social-linguistic processing between humans and large audio-language models: Evidence from model-brain alignment
by: Wu, Hanlin, et al.
Published: (2025)
by: Wu, Hanlin, et al.
Published: (2025)
Do language models accommodate their users? A study of linguistic convergence
by: Blevins, Terra, et al.
Published: (2025)
by: Blevins, Terra, et al.
Published: (2025)
Are formal and functional linguistic mechanisms dissociated in language models?
by: Hanna, Michael, et al.
Published: (2025)
by: Hanna, Michael, et al.
Published: (2025)
PLLuM: A Family of Polish Large Language Models
by: Kocoń, Jan, et al.
Published: (2025)
by: Kocoń, Jan, et al.
Published: (2025)
Vocabulary embeddings organize linguistic structure early in language model training
by: Papadimitriou, Isabel, et al.
Published: (2025)
by: Papadimitriou, Isabel, et al.
Published: (2025)
Linguini: A benchmark for language-agnostic linguistic reasoning
by: Sánchez, Eduardo, et al.
Published: (2024)
by: Sánchez, Eduardo, et al.
Published: (2024)
Efficient argument classification with compact language models and ChatGPT-4 refinements
by: Pietron, Marcin, et al.
Published: (2024)
by: Pietron, Marcin, et al.
Published: (2024)
Retrieval augmentation of large language models for lay language generation
by: Guo, Yue, et al.
Published: (2022)
by: Guo, Yue, et al.
Published: (2022)
Do large language models resemble humans in language use?
by: Cai, Zhenguang G., et al.
Published: (2023)
by: Cai, Zhenguang G., et al.
Published: (2023)
Evaluating large language models in medical applications: a survey
by: Chen, Xiaolan, et al.
Published: (2024)
by: Chen, Xiaolan, et al.
Published: (2024)
Evaluating the performance and fragility of large language models on the self-assessment for neurological surgeons
by: Vishwanath, Krithik, et al.
Published: (2025)
by: Vishwanath, Krithik, et al.
Published: (2025)
Dissociating language and thought in large language models
by: Mahowald, Kyle, et al.
Published: (2023)
by: Mahowald, Kyle, et al.
Published: (2023)
PhDGPT: Introducing a psychometric and linguistic dataset about how large language models perceive graduate students and professors in psychology
by: De Duro, Edoardo Sebastiano, et al.
Published: (2024)
by: De Duro, Edoardo Sebastiano, et al.
Published: (2024)
Assessing the alignment between infants' visual and linguistic experience using multimodal language models
by: Tan, Alvin Wei Ming, et al.
Published: (2025)
by: Tan, Alvin Wei Ming, et al.
Published: (2025)
Prompting language influences diagnostic reasoning and accuracy of large language models
by: Bazoge, Adrien, et al.
Published: (2026)
by: Bazoge, Adrien, et al.
Published: (2026)
Investigating the interaction of linguistic and mathematical reasoning in language models using multilingual number puzzles
by: Bhattacharya, Antara Raaghavi, et al.
Published: (2025)
by: Bhattacharya, Antara Raaghavi, et al.
Published: (2025)
Performance of large language models in numerical vs. semantic medical knowledge: Benchmarking on evidence-based Q&As
by: Avnat, Eden, et al.
Published: (2024)
by: Avnat, Eden, et al.
Published: (2024)
Dynamic data sampler for cross-language transfer learning in large language models
by: Li, Yudong, et al.
Published: (2024)
by: Li, Yudong, et al.
Published: (2024)
Multilingual large language models leak human stereotypes across language boundaries
by: Cao, Yang Trista, et al.
Published: (2023)
by: Cao, Yang Trista, et al.
Published: (2023)
On the attribution of confidence to large language models
by: Keeling, Geoff, et al.
Published: (2024)
by: Keeling, Geoff, et al.
Published: (2024)
AI-AI Bias: large language models favor communications generated by large language models
by: Laurito, Walter, et al.
Published: (2024)
by: Laurito, Walter, et al.
Published: (2024)
Measuring short-form factuality in large language models
by: Wei, Jason, et al.
Published: (2024)
by: Wei, Jason, et al.
Published: (2024)
Can adversarial attacks by large language models be attributed?
by: Cebrian, Manuel, et al.
Published: (2024)
by: Cebrian, Manuel, et al.
Published: (2024)
Representation in large language models
by: Yetman, Cameron
Published: (2025)
by: Yetman, Cameron
Published: (2025)
World model inspired sarcasm reasoning with large language model agents
by: Inoshita, Keito, et al.
Published: (2025)
by: Inoshita, Keito, et al.
Published: (2025)
Evaluation of large language models for discovery of gene set function
by: Hu, Mengzhou, et al.
Published: (2023)
by: Hu, Mengzhou, et al.
Published: (2023)
IHC-LLMiner: Automated extraction of tumour immunohistochemical profiles from PubMed abstracts using large language models
by: Kim, Yunsoo, et al.
Published: (2025)
by: Kim, Yunsoo, et al.
Published: (2025)
Failure of contextual invariance in large language models
by: Kumar, Sagar, et al.
Published: (2026)
by: Kumar, Sagar, et al.
Published: (2026)
Similar Items
-
PL-MTEB: Polish Massive Text Embedding Benchmark
by: Poświata, Rafał, et al.
Published: (2024) -
PIRB: A Comprehensive Benchmark of Polish Dense and Hybrid Text Retrieval Methods
by: Dadas, Sławomir, et al.
Published: (2024) -
Unveiling Dual Quality in Product Reviews: An NLP-Based Approach
by: Poświata, Rafał, et al.
Published: (2025) -
Long-Context Encoder Models for Polish Language Understanding
by: Dadas, Sławomir, et al.
Published: (2026) -
SMCLM: Semantically Meaningful Causal Language Modeling for Autoregressive Paraphrase Generation
by: Perełkiewicz, Michał, et al.
Published: (2025)