Assessing generalization capability of text ranking models in Polish
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Dadas, Sławomir, Grębowiec, Małgorzata |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Evaluating Polish linguistic and cultural competency in large language models
par: Dadas, Sławomir, et autres
Publié: (2025)
par: Dadas, Sławomir, et autres
Publié: (2025)
Long-Context Encoder Models for Polish Language Understanding
par: Dadas, Sławomir, et autres
Publié: (2026)
par: Dadas, Sławomir, et autres
Publié: (2026)
Unveiling Dual Quality in Product Reviews: An NLP-Based Approach
par: Poświata, Rafał, et autres
Publié: (2025)
par: Poświata, Rafał, et autres
Publié: (2025)
PL-MTEB: Polish Massive Text Embedding Benchmark
par: Poświata, Rafał, et autres
Publié: (2024)
par: Poświata, Rafał, et autres
Publié: (2024)
PIRB: A Comprehensive Benchmark of Polish Dense and Hybrid Text Retrieval Methods
par: Dadas, Sławomir, et autres
Publié: (2024)
par: Dadas, Sławomir, et autres
Publié: (2024)
SMCLM: Semantically Meaningful Causal Language Modeling for Autoregressive Paraphrase Generation
par: Perełkiewicz, Michał, et autres
Publié: (2025)
par: Perełkiewicz, Michał, et autres
Publié: (2025)
PRODIS -- a speech database and a phoneme-based language model for the study of predictability effects in Polish
par: Malisz, Zofia, et autres
Publié: (2024)
par: Malisz, Zofia, et autres
Publié: (2024)
Evaluating the capability of large language models to personalize science texts for diverse middle-school-age learners
par: Vaccaro Jr, Michael, et autres
Publié: (2024)
par: Vaccaro Jr, Michael, et autres
Publié: (2024)
PLLuM: A Family of Polish Large Language Models
par: Kocoń, Jan, et autres
Publié: (2025)
par: Kocoń, Jan, et autres
Publié: (2025)
Assessing SPARQL capabilities of Large Language Models
par: Meyer, Lars-Peter, et autres
Publié: (2024)
par: Meyer, Lars-Peter, et autres
Publié: (2024)
Analysis of instruction-based LLMs' capabilities to score and judge text-input problems in an academic setting
par: Ramirez-Garcia, Valeria, et autres
Publié: (2025)
par: Ramirez-Garcia, Valeria, et autres
Publié: (2025)
Assessing socio-economic climate impacts from text data
par: de Brito, Mariana Madruga, et autres
Publié: (2026)
par: de Brito, Mariana Madruga, et autres
Publié: (2026)
Evidence of interrelated cognitive-like capabilities in large language models: Indications of artificial general intelligence or achievement?
par: Ilić, David, et autres
Publié: (2023)
par: Ilić, David, et autres
Publié: (2023)
Bi-reachability in Petri nets with data
par: Kamiński, Łukasz, et autres
Publié: (2024)
par: Kamiński, Łukasz, et autres
Publié: (2024)
Reachability in symmetric VASS
par: Kamiński, Łukasz, et autres
Publié: (2025)
par: Kamiński, Łukasz, et autres
Publié: (2025)
Polish-ASTE: Aspect-Sentiment Triplet Extraction Datasets for Polish
par: Lango, Marta, et autres
Publié: (2025)
par: Lango, Marta, et autres
Publié: (2025)
MedMobile: A mobile-sized language model with clinical capabilities
par: Vishwanath, Krithik, et autres
Publié: (2024)
par: Vishwanath, Krithik, et autres
Publié: (2024)
LLMs left, right, and center: Assessing GPT's capabilities to label political bias from web domains
par: Hernandes, Raphael, et autres
Publié: (2024)
par: Hernandes, Raphael, et autres
Publié: (2024)
Identifying social isolation themes in NVDRS text narratives using topic modeling and text-classification methods
par: Walker, Drew, et autres
Publié: (2025)
par: Walker, Drew, et autres
Publié: (2025)
POLygraph: Polish Fake News Dataset
par: Dzienisiewicz, Daniel, et autres
Publié: (2024)
par: Dzienisiewicz, Daniel, et autres
Publié: (2024)
Solvability of orbit-finite systems of linear equations
par: Ghosh, Arka, et autres
Publié: (2022)
par: Ghosh, Arka, et autres
Publié: (2022)
AIDBench: A benchmark for evaluating the authorship identification capability of large language models
par: Wen, Zichen, et autres
Publié: (2024)
par: Wen, Zichen, et autres
Publié: (2024)
Auxiliary task demands mask the capabilities of smaller language models
par: Hu, Jennifer, et autres
Publié: (2024)
par: Hu, Jennifer, et autres
Publié: (2024)
Synthetically generated text for supervised text analysis
par: Halterman, Andrew
Publié: (2023)
par: Halterman, Andrew
Publié: (2023)
Two Approaches to Diachronic Normalization of Polish Texts
par: Dudzic, Kacper, et autres
Publié: (2024)
par: Dudzic, Kacper, et autres
Publié: (2024)
Punctuation Prediction for Polish Texts using Transformers
par: Pokrywka, Jakub
Publié: (2024)
par: Pokrywka, Jakub
Publié: (2024)
PolQA: Polish Question Answering Dataset
par: Rybak, Piotr, et autres
Publié: (2022)
par: Rybak, Piotr, et autres
Publié: (2022)
Assessing News Thumbnail Representativeness: Counterfactual text can enhance the cross-modal matching ability
par: Yoon, Yejun, et autres
Publié: (2024)
par: Yoon, Yejun, et autres
Publié: (2024)
ZNO-Eval: Benchmarking reasoning capabilities of large language models in Ukrainian
par: Syromiatnikov, Mykyta, et autres
Publié: (2025)
par: Syromiatnikov, Mykyta, et autres
Publié: (2025)
Polish phonology and morphology through the lens of distributional semantics
par: Orzechowska, Paula, et autres
Publié: (2026)
par: Orzechowska, Paula, et autres
Publié: (2026)
Large language models struggle with ethnographic text annotation
par: Goodall, Leonardo S., et autres
Publié: (2026)
par: Goodall, Leonardo S., et autres
Publié: (2026)
Evaluation of Few-Shot Learning for Classification Tasks in the Polish Language
par: Hadeliya, Tsimur, et autres
Publié: (2024)
par: Hadeliya, Tsimur, et autres
Publié: (2024)
Explanation sensitivity to the randomness of large language models: the case of journalistic text classification
par: Bogaert, Jeremie, et autres
Publié: (2024)
par: Bogaert, Jeremie, et autres
Publié: (2024)
Automatic detection of Gen-AI texts: A comparative framework of neural models
par: Buttaro, Cristian, et autres
Publié: (2026)
par: Buttaro, Cristian, et autres
Publié: (2026)
Achieving Operational Universality through a Turing Complete Chemputer
par: Gahler, Daniel, et autres
Publié: (2025)
par: Gahler, Daniel, et autres
Publié: (2025)
How do we measure privacy in text? A survey of text anonymization metrics
par: Ren, Yaxuan, et autres
Publié: (2025)
par: Ren, Yaxuan, et autres
Publié: (2025)
Machine-generated text detection prevents language model collapse
par: Drayson, George, et autres
Publié: (2025)
par: Drayson, George, et autres
Publié: (2025)
Do LLMs exhibit the same commonsense capabilities across languages?
par: Martínez-Murillo, Ivan, et autres
Publié: (2025)
par: Martínez-Murillo, Ivan, et autres
Publié: (2025)
Analysis of child development facts and myths using text mining techniques and classification models
par: Tajrian, Mehedi, et autres
Publié: (2024)
par: Tajrian, Mehedi, et autres
Publié: (2024)
Can human clinical rationales improve the performance and explainability of clinical text classification models?
par: Metzner, Christoph, et autres
Publié: (2025)
par: Metzner, Christoph, et autres
Publié: (2025)
Documents similaires
-
Evaluating Polish linguistic and cultural competency in large language models
par: Dadas, Sławomir, et autres
Publié: (2025) -
Long-Context Encoder Models for Polish Language Understanding
par: Dadas, Sławomir, et autres
Publié: (2026) -
Unveiling Dual Quality in Product Reviews: An NLP-Based Approach
par: Poświata, Rafał, et autres
Publié: (2025) -
PL-MTEB: Polish Massive Text Embedding Benchmark
par: Poświata, Rafał, et autres
Publié: (2024) -
PIRB: A Comprehensive Benchmark of Polish Dense and Hybrid Text Retrieval Methods
par: Dadas, Sławomir, et autres
Publié: (2024)