Long-Context Encoder Models for Polish Language Understanding
Fuente:
arXiv
Guardado en:
| Autores principales: | Dadas, Sławomir, Poświata, Rafał, Kozłowski, Marek, Grębowiec, Małgorzata, Perełkiewicz, Michał, Klimiuk, Paweł, Boruta, Przemysław |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Evaluating Polish linguistic and cultural competency in large language models
por: Dadas, Sławomir, et al.
Publicado: (2025)
por: Dadas, Sławomir, et al.
Publicado: (2025)
PL-MTEB: Polish Massive Text Embedding Benchmark
por: Poświata, Rafał, et al.
Publicado: (2024)
por: Poświata, Rafał, et al.
Publicado: (2024)
PIRB: A Comprehensive Benchmark of Polish Dense and Hybrid Text Retrieval Methods
por: Dadas, Sławomir, et al.
Publicado: (2024)
por: Dadas, Sławomir, et al.
Publicado: (2024)
Unveiling Dual Quality in Product Reviews: An NLP-Based Approach
por: Poświata, Rafał, et al.
Publicado: (2025)
por: Poświata, Rafał, et al.
Publicado: (2025)
SMCLM: Semantically Meaningful Causal Language Modeling for Autoregressive Paraphrase Generation
por: Perełkiewicz, Michał, et al.
Publicado: (2025)
por: Perełkiewicz, Michał, et al.
Publicado: (2025)
Assessing generalization capability of text ranking models in Polish
por: Dadas, Sławomir, et al.
Publicado: (2024)
por: Dadas, Sławomir, et al.
Publicado: (2024)
A Review of the Challenges with Massive Web-mined Corpora Used in Large Language Models Pre-Training
por: Perełkiewicz, Michał, et al.
Publicado: (2024)
por: Perełkiewicz, Michał, et al.
Publicado: (2024)
PLLuM: A Family of Polish Large Language Models
por: Kocoń, Jan, et al.
Publicado: (2025)
por: Kocoń, Jan, et al.
Publicado: (2025)
E2LLM: Encoder Elongated Large Language Models for Long-Context Understanding and Reasoning
por: Liao, Zihan, et al.
Publicado: (2024)
por: Liao, Zihan, et al.
Publicado: (2024)
POLygraph: Polish Fake News Dataset
por: Dzienisiewicz, Daniel, et al.
Publicado: (2024)
por: Dzienisiewicz, Daniel, et al.
Publicado: (2024)
LooGLE: Can Long-Context Language Models Understand Long Contexts?
por: Li, Jiaqi, et al.
Publicado: (2023)
por: Li, Jiaqi, et al.
Publicado: (2023)
On Multilingual Encoder Language Model Compression for Low-Resource Languages
por: Gurgurov, Daniil, et al.
Publicado: (2025)
por: Gurgurov, Daniil, et al.
Publicado: (2025)
Self-training Language Models for Arithmetic Reasoning
por: Kadlčík, Marek, et al.
Publicado: (2024)
por: Kadlčík, Marek, et al.
Publicado: (2024)
Preservation of Language Understanding Capabilities in Speech-aware Large Language Models
por: Kubis, Marek, et al.
Publicado: (2025)
por: Kubis, Marek, et al.
Publicado: (2025)
Polish-English medical knowledge transfer: A new benchmark and results
por: Grzybowski, Łukasz, et al.
Publicado: (2024)
por: Grzybowski, Łukasz, et al.
Publicado: (2024)
FltLM: An Intergrated Long-Context Large Language Model for Effective Context Filtering and Understanding
por: Deng, Jingyang, et al.
Publicado: (2024)
por: Deng, Jingyang, et al.
Publicado: (2024)
MiniLongBench: The Low-cost Long Context Understanding Benchmark for Large Language Models
por: Huang, Zhongzhan, et al.
Publicado: (2025)
por: Huang, Zhongzhan, et al.
Publicado: (2025)
Through the Thicket: A Study of Number-Oriented LLMs derived from Random Forest Models
por: Romaszewski, Michał, et al.
Publicado: (2024)
por: Romaszewski, Michał, et al.
Publicado: (2024)
Latency Adjustable Transformer Encoder for Language Understanding
por: Kachuee, Sajjad, et al.
Publicado: (2022)
por: Kachuee, Sajjad, et al.
Publicado: (2022)
Negation: A Pink Elephant in the Large Language Models' Room?
por: Vrabcová, Tereza, et al.
Publicado: (2025)
por: Vrabcová, Tereza, et al.
Publicado: (2025)
AraModernBERT: Transtokenized Initialization and Long-Context Encoder Modeling for Arabic
por: Elshehy, Omar, et al.
Publicado: (2026)
por: Elshehy, Omar, et al.
Publicado: (2026)
LLMzSzŁ: a comprehensive LLM benchmark for Polish
por: Jassem, Krzysztof, et al.
Publicado: (2025)
por: Jassem, Krzysztof, et al.
Publicado: (2025)
Two Approaches to Diachronic Normalization of Polish Texts
por: Dudzic, Kacper, et al.
Publicado: (2024)
por: Dudzic, Kacper, et al.
Publicado: (2024)
Long-Context Language Modeling with Parallel Context Encoding
por: Yen, Howard, et al.
Publicado: (2024)
por: Yen, Howard, et al.
Publicado: (2024)
Semantic Structure of Feature Space in Large Language Models
por: Kozlowski, Austin C., et al.
Publicado: (2026)
por: Kozlowski, Austin C., et al.
Publicado: (2026)
Concept-aware Data Construction Improves In-context Learning of Language Models
por: Štefánik, Michal, et al.
Publicado: (2024)
por: Štefánik, Michal, et al.
Publicado: (2024)
An Empirical Evaluation of Encoder Architectures for Fast Real-Time Long Conversational Understanding
por: Senthilnathan, Annamalai, et al.
Publicado: (2025)
por: Senthilnathan, Annamalai, et al.
Publicado: (2025)
Large Language Models for Expansion of Spoken Language Understanding Systems to New Languages
por: Hoscilowicz, Jakub, et al.
Publicado: (2024)
por: Hoscilowicz, Jakub, et al.
Publicado: (2024)
PaceLLM: Brain-Inspired Large Language Models for Long-Context Understanding
por: Li, Kangcong, et al.
Publicado: (2025)
por: Li, Kangcong, et al.
Publicado: (2025)
Can Large Language Models Understand Context?
por: Zhu, Yilun, et al.
Publicado: (2024)
por: Zhu, Yilun, et al.
Publicado: (2024)
LongProc: Benchmarking Long-Context Language Models on Long Procedural Generation
por: Ye, Xi, et al.
Publicado: (2025)
por: Ye, Xi, et al.
Publicado: (2025)
Pre-trained Language Models Learn Remarkably Accurate Representations of Numbers
por: Kadlčík, Marek, et al.
Publicado: (2025)
por: Kadlčík, Marek, et al.
Publicado: (2025)
Analyzing Temporal Complex Events with Large Language Models? A Benchmark towards Temporal, Long Context Understanding
por: Zhang, Zhihan, et al.
Publicado: (2024)
por: Zhang, Zhihan, et al.
Publicado: (2024)
Semantic Structure in Large Language Model Embeddings
por: Kozlowski, Austin C., et al.
Publicado: (2025)
por: Kozlowski, Austin C., et al.
Publicado: (2025)
LongBench: A Bilingual, Multitask Benchmark for Long Context Understanding
por: Bai, Yushi, et al.
Publicado: (2023)
por: Bai, Yushi, et al.
Publicado: (2023)
Passage Retrieval of Polish Texts Using OKAPI BM25 and an Ensemble of Cross Encoders
por: Pokrywka, Jakub
Publicado: (2024)
por: Pokrywka, Jakub
Publicado: (2024)
Leveraging Long-Context Large Language Models for Multi-Document Understanding and Summarization in Enterprise Applications
por: Godbole, Aditi, et al.
Publicado: (2024)
por: Godbole, Aditi, et al.
Publicado: (2024)
Long Context Automated Essay Scoring with Language Models
por: Ormerod, Christopher, et al.
Publicado: (2025)
por: Ormerod, Christopher, et al.
Publicado: (2025)
In Defense of RAG in the Era of Long-Context Language Models
por: Yu, Tan, et al.
Publicado: (2024)
por: Yu, Tan, et al.
Publicado: (2024)
A Controllable Examination for Long-Context Language Models
por: Yang, Yijun, et al.
Publicado: (2025)
por: Yang, Yijun, et al.
Publicado: (2025)
Ejemplares similares
-
Evaluating Polish linguistic and cultural competency in large language models
por: Dadas, Sławomir, et al.
Publicado: (2025) -
PL-MTEB: Polish Massive Text Embedding Benchmark
por: Poświata, Rafał, et al.
Publicado: (2024) -
PIRB: A Comprehensive Benchmark of Polish Dense and Hybrid Text Retrieval Methods
por: Dadas, Sławomir, et al.
Publicado: (2024) -
Unveiling Dual Quality in Product Reviews: An NLP-Based Approach
por: Poświata, Rafał, et al.
Publicado: (2025) -
SMCLM: Semantically Meaningful Causal Language Modeling for Autoregressive Paraphrase Generation
por: Perełkiewicz, Michał, et al.
Publicado: (2025)