Enregistré dans:
| Auteurs principaux: | Saveliev, Denis, Kuchakov, Ruslan |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | https://arxiv.org/abs/2406.04855 |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
SinhaLegal: A Benchmark Corpus for Information Extraction and Analysis in Sinhala Legislative Texts
par: Lasandi, Minduli, et autres
Publié: (2026)
par: Lasandi, Minduli, et autres
Publié: (2026)
Benchmarking terminology building capabilities of ChatGPT on an English-Russian Fashion Corpus
par: Bezobrazova, Anastasiia, et autres
Publié: (2024)
par: Bezobrazova, Anastasiia, et autres
Publié: (2024)
Long Input Benchmark for Russian Analysis
par: Churin, Igor, et autres
Publié: (2024)
par: Churin, Igor, et autres
Publié: (2024)
The GELATO Dataset for Legislative NER
par: Flynn, Matthew, et autres
Publié: (2026)
par: Flynn, Matthew, et autres
Publié: (2026)
MERA: A Comprehensive LLM Evaluation in Russian
par: Fenogenova, Alena, et autres
Publié: (2024)
par: Fenogenova, Alena, et autres
Publié: (2024)
Contextual Clarity: Generating Sentences with Transformer Models using Context-Reverso Data
par: Musaev, Ruslan
Publié: (2024)
par: Musaev, Ruslan
Publié: (2024)
Algorithm for Automatic Legislative Text Consolidation
par: Etcheverry, Matias, et autres
Publié: (2025)
par: Etcheverry, Matias, et autres
Publié: (2025)
Can Legislation Be Made Machine-Readable in PROLEG?
par: Zin, May-Myo, et autres
Publié: (2026)
par: Zin, May-Myo, et autres
Publié: (2026)
Creating an Aligned Corpus of Sound and Text: The Multimodal Corpus of Shakespeare and Milton
par: Agirrezabal, Manex
Publié: (2024)
par: Agirrezabal, Manex
Publié: (2024)
RusCode: Russian Cultural Code Benchmark for Text-to-Image Generation
par: Vasilev, Viacheslav, et autres
Publié: (2025)
par: Vasilev, Viacheslav, et autres
Publié: (2025)
The Material Contracts Corpus
par: Adelson, Peter, et autres
Publié: (2025)
par: Adelson, Peter, et autres
Publié: (2025)
Multimodal Evaluation of Russian-language Architectures
par: Chervyakov, Artem, et autres
Publié: (2025)
par: Chervyakov, Artem, et autres
Publié: (2025)
Is Semi-Automatic Transcription Useful in Corpus Creation? Preliminary Considerations on the KIParla Corpus
par: Simonotti, Martina, et autres
Publié: (2026)
par: Simonotti, Martina, et autres
Publié: (2026)
The Medical Metaphors Corpus (MCC)
par: Lippolis, Anna Sofia, et autres
Publié: (2025)
par: Lippolis, Anna Sofia, et autres
Publié: (2025)
Speak & Improve Corpus 2025: an L2 English Speech Corpus for Language Assessment and Feedback
par: Knill, Kate, et autres
Publié: (2024)
par: Knill, Kate, et autres
Publié: (2024)
RLSR: Reinforcement Learning with Supervised Reward Outperforms SFT in Instruction Following
par: Wang, Zhichao, et autres
Publié: (2025)
par: Wang, Zhichao, et autres
Publié: (2025)
TypedCSIP: Typed Counterfactual Pretraining for Chinese Legislative Conflict Classification
par: Liu, Yao
Publié: (2026)
par: Liu, Yao
Publié: (2026)
Computational Identification of Regulatory Statements in EU Legislation
par: Brandsma, Gijs Jan, et autres
Publié: (2025)
par: Brandsma, Gijs Jan, et autres
Publié: (2025)
The Russian-focused embedders' exploration: ruMTEB benchmark and Russian embedding model design
par: Snegirev, Artem, et autres
Publié: (2024)
par: Snegirev, Artem, et autres
Publié: (2024)
The SAMER Arabic Text Simplification Corpus
par: Alhafni, Bashar, et autres
Publié: (2024)
par: Alhafni, Bashar, et autres
Publié: (2024)
The TUB Sign Language Corpus Collection
par: Avramidis, Eleftherios, et autres
Publié: (2025)
par: Avramidis, Eleftherios, et autres
Publié: (2025)
The Pilot Corpus of the English Semantic Sketches
par: Petrova, Maria, et autres
Publié: (2025)
par: Petrova, Maria, et autres
Publié: (2025)
LexDrafter: Terminology Drafting for Legislative Documents using Retrieval Augmented Generation
par: Chouhan, Ashish, et autres
Publié: (2024)
par: Chouhan, Ashish, et autres
Publié: (2024)
The Moral Foundations Reddit Corpus
par: Trager, Jackson, et autres
Publié: (2022)
par: Trager, Jackson, et autres
Publié: (2022)
CorpusLM: Towards a Unified Language Model on Corpus for Knowledge-Intensive Tasks
par: Li, Xiaoxi, et autres
Publié: (2024)
par: Li, Xiaoxi, et autres
Publié: (2024)
CorpusQA: A 10 Million Token Benchmark for Corpus-Level Analysis and Reasoning
par: Lu, Zhiyuan, et autres
Publié: (2026)
par: Lu, Zhiyuan, et autres
Publié: (2026)
CRAFT: Cultural Russian-Oriented Dataset Adaptation for Focused Text-to-Image Generation
par: Vasilev, Viacheslav, et autres
Publié: (2025)
par: Vasilev, Viacheslav, et autres
Publié: (2025)
The Knesset Corpus: An Annotated Corpus of Hebrew Parliamentary Proceedings
par: Goldin, Gili, et autres
Publié: (2024)
par: Goldin, Gili, et autres
Publié: (2024)
FFSTC: Fongbe to French Speech Translation Corpus
par: Kponou, D. Fortune, et autres
Publié: (2024)
par: Kponou, D. Fortune, et autres
Publié: (2024)
A French Version of the OLDI Seed Corpus
par: Marmonier, Malik, et autres
Publié: (2025)
par: Marmonier, Malik, et autres
Publié: (2025)
MDC-R: The Minecraft Dialogue Corpus with Reference
par: Madge, Chris, et autres
Publié: (2025)
par: Madge, Chris, et autres
Publié: (2025)
SiDiaC: Sinhala Diachronic Corpus
par: Jayatilleke, Nevidu, et autres
Publié: (2025)
par: Jayatilleke, Nevidu, et autres
Publié: (2025)
Corpus Frequencies in Morphological Inflection: Do They Matter?
par: Sourada, Tomáš, et autres
Publié: (2025)
par: Sourada, Tomáš, et autres
Publié: (2025)
Vacaspati: A Diverse Corpus of Bangla Literature
par: Bhattacharyya, Pramit, et autres
Publié: (2023)
par: Bhattacharyya, Pramit, et autres
Publié: (2023)
Large Language Models in Legislative Content Analysis: A Dataset from the Polish Parliament
par: Bryłkowski, Arkadiusz, et autres
Publié: (2025)
par: Bryłkowski, Arkadiusz, et autres
Publié: (2025)
The Moral Foundations Weibo Corpus
par: Cao, Renjie, et autres
Publié: (2024)
par: Cao, Renjie, et autres
Publié: (2024)
The PLLuM Instruction Corpus
par: Pęzik, Piotr, et autres
Publié: (2025)
par: Pęzik, Piotr, et autres
Publié: (2025)
GigaEmbeddings: Efficient Russian Language Embedding Model
par: Kolodin, Egor, et autres
Publié: (2025)
par: Kolodin, Egor, et autres
Publié: (2025)
Light Coreference Resolution for Russian with Hierarchical Discourse Features
par: Chistova, Elena, et autres
Publié: (2023)
par: Chistova, Elena, et autres
Publié: (2023)
Detecting Spelling and Grammatical Anomalies in Russian Poetry Texts
par: Koziev, Ilya
Publié: (2025)
par: Koziev, Ilya
Publié: (2025)
Documents similaires
-
SinhaLegal: A Benchmark Corpus for Information Extraction and Analysis in Sinhala Legislative Texts
par: Lasandi, Minduli, et autres
Publié: (2026) -
Benchmarking terminology building capabilities of ChatGPT on an English-Russian Fashion Corpus
par: Bezobrazova, Anastasiia, et autres
Publié: (2024) -
Long Input Benchmark for Russian Analysis
par: Churin, Igor, et autres
Publié: (2024) -
The GELATO Dataset for Legislative NER
par: Flynn, Matthew, et autres
Publié: (2026) -
MERA: A Comprehensive LLM Evaluation in Russian
par: Fenogenova, Alena, et autres
Publié: (2024)