Enregistré dans:
| Auteurs principaux: | Ghinea, Dragos-Dumitru, Corbeanu, Adela-Nicoleta, Dumitran, Adrian-Marius |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | https://arxiv.org/abs/2509.25813 |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Exploring Large Language Models for Translating Romanian Computational Problems into English
par: Dumitran, Adrian Marius, et autres
Publié: (2025)
par: Dumitran, Adrian Marius, et autres
Publié: (2025)
GRILE: A Benchmark for Grammar Reasoning and Explanation in Romanian LLMs
par: Dumitran, Adrian-Marius, et autres
Publié: (2025)
par: Dumitran, Adrian-Marius, et autres
Publié: (2025)
Do LLMs Understand Romanian Driving Laws? A Study on Multimodal and Fine-Tuned Question Answering
par: Barbu, Eduard, et autres
Publié: (2025)
par: Barbu, Eduard, et autres
Publié: (2025)
A Culturally-Rich Romanian NLP Dataset from "Who Wants to Be a Millionaire?" Videos
par: Ganea, Alexandru-Gabriel, et autres
Publié: (2025)
par: Ganea, Alexandru-Gabriel, et autres
Publié: (2025)
RoLegalGEC: Legal Domain Grammatical Error Detection and Correction Dataset for Romanian
par: Timpuriu, Mircea, et autres
Publié: (2026)
par: Timpuriu, Mircea, et autres
Publié: (2026)
RoMathExam: A Longitudinal Dataset of Romanian Math Exams (1895-2025) with a Seven-Decade Core (1957-2025)
par: Cuclea, Luca-Ncolae, et autres
Publié: (2026)
par: Cuclea, Luca-Ncolae, et autres
Publié: (2026)
A Cross-Lingual Analysis of Bias in Large Language Models Using Romanian History
par: Cocu, Matei-Iulian, et autres
Publié: (2025)
par: Cocu, Matei-Iulian, et autres
Publié: (2025)
Parameter Efficient Multimodal Instruction Tuning for Romanian Vision Language Models
par: Dima, George-Andrei, et autres
Publié: (2025)
par: Dima, George-Andrei, et autres
Publié: (2025)
RoQLlama: A Lightweight Romanian Adapted Language Model
par: Dima, George-Andrei, et autres
Publié: (2024)
par: Dima, George-Andrei, et autres
Publié: (2024)
MoRoVoc: A Large Dataset for Geographical Variation Identification of the Spoken Romanian Language
par: Avram, Andrei-Marius, et autres
Publié: (2025)
par: Avram, Andrei-Marius, et autres
Publié: (2025)
MateInfoUB: A Real-World Benchmark for Testing LLMs in Competitive, Multilingual, and Multimodal Educational Tasks
par: Marius, Dumitran Adrian, et autres
Publié: (2025)
par: Marius, Dumitran Adrian, et autres
Publié: (2025)
RoIt-XMASA: Multi-Domain Multilingual Sentiment Analysis Dataset for Romanian and Italian
par: Avram, Andrei-Marius, et autres
Publié: (2026)
par: Avram, Andrei-Marius, et autres
Publié: (2026)
PoPreRo: A New Dataset for Popularity Prediction of Romanian Reddit Posts
par: Rogoz, Ana-Cristina, et autres
Publié: (2024)
par: Rogoz, Ana-Cristina, et autres
Publié: (2024)
RoLargeSum: A Large Dialect-Aware Romanian News Dataset for Summary, Headline, and Keyword Generation
par: Avram, Andrei-Marius, et autres
Publié: (2024)
par: Avram, Andrei-Marius, et autres
Publié: (2024)
BacPrep: Lessons from Deploying an LLM-Based Bacalaureat Assessment Platform
par: Dumitran, Adrian-Marius, et autres
Publié: (2025)
par: Dumitran, Adrian-Marius, et autres
Publié: (2025)
RoCoISLR: A Romanian Corpus for Isolated Sign Language Recognition
par: Rîpanu, Cătălin-Alexandru, et autres
Publié: (2025)
par: Rîpanu, Cătălin-Alexandru, et autres
Publié: (2025)
OpenLLM-Ro -- Technical Report on Open-source Romanian LLMs
par: Masala, Mihai, et autres
Publié: (2024)
par: Masala, Mihai, et autres
Publié: (2024)
The Large Language Model GreekLegalRoBERTa
par: Saketos, Vasileios, et autres
Publié: (2024)
par: Saketos, Vasileios, et autres
Publié: (2024)
Evaluating the Performance of Large Language Models in Competitive Programming: A Multi-Year, Multi-Grade Analysis
par: Dumitran, Adrian Marius, et autres
Publié: (2024)
par: Dumitran, Adrian Marius, et autres
Publié: (2024)
SeLeRoSa: Sentence-Level Romanian Satire Detection Dataset
par: Smădu, Răzvan-Alexandru, et autres
Publié: (2025)
par: Smădu, Răzvan-Alexandru, et autres
Publié: (2025)
MuSaRoNews: A Multidomain, Multimodal Satire Dataset from Romanian News Articles
par: Smădu, Răzvan-Alexandru, et autres
Publié: (2025)
par: Smădu, Răzvan-Alexandru, et autres
Publié: (2025)
A Novel Cartography-Based Curriculum Learning Method Applied on RoNLI: The First Romanian Natural Language Inference Corpus
par: Poesina, Eduard, et autres
Publié: (2024)
par: Poesina, Eduard, et autres
Publié: (2024)
PeruMedQA: Benchmarking Large Language Models (LLMs) on Peruvian Medical Exams -- Dataset Construction and Evaluation
par: Carrillo-Larco, Rodrigo M., et autres
Publié: (2025)
par: Carrillo-Larco, Rodrigo M., et autres
Publié: (2025)
A Large-Scale Benchmark for Evaluating Large Language Models on Medical Question Answering in Romanian
par: Rogoz, Ana-Cristina, et autres
Publié: (2025)
par: Rogoz, Ana-Cristina, et autres
Publié: (2025)
C-ing Clearly: Enhanced Binary Code Explanations using C code
par: Poncu, Teodor, et autres
Publié: (2025)
par: Poncu, Teodor, et autres
Publié: (2025)
SaRoHead: Detecting Satire in a Multi-Domain Romanian News Headline Dataset
par: Vîrlan, Mihnea-Alexandru, et autres
Publié: (2025)
par: Vîrlan, Mihnea-Alexandru, et autres
Publié: (2025)
Algorithmical Aspects of Some Bio Inspired Operations
par: Dumitran, Marius
Publié: (2025)
par: Dumitran, Marius
Publié: (2025)
An Agentic Evaluation Architecture for Historical Bias Detection in Educational Textbooks
par: Stefan, Gabriel, et autres
Publié: (2026)
par: Stefan, Gabriel, et autres
Publié: (2026)
Listening to the Wise Few: Select-and-Copy Attention Heads for Multiple-Choice QA
par: Tulchinskii, Eduard, et autres
Publié: (2024)
par: Tulchinskii, Eduard, et autres
Publié: (2024)
Leveraging Generative AI for Enhancing Automated Assessment in Programming Education Contests
par: Dascalescu, Stefan, et autres
Publié: (2025)
par: Dascalescu, Stefan, et autres
Publié: (2025)
HistNERo: Historical Named Entity Recognition for the Romanian Language
par: Avram, Andrei-Marius, et autres
Publié: (2024)
par: Avram, Andrei-Marius, et autres
Publié: (2024)
FinanceQA: A Benchmark for Evaluating Financial Analysis Capabilities of Large Language Models
par: Mateega, Spencer, et autres
Publié: (2025)
par: Mateega, Spencer, et autres
Publié: (2025)
QA-Calibration of Language Model Confidence Scores
par: Manggala, Putra, et autres
Publié: (2024)
par: Manggala, Putra, et autres
Publié: (2024)
RoBERTurk: Adjusting RoBERTa for Turkish
par: Tas, Nuri
Publié: (2024)
par: Tas, Nuri
Publié: (2024)
FoQA: A Faroese Question-Answering Dataset
par: Simonsen, Annika, et autres
Publié: (2025)
par: Simonsen, Annika, et autres
Publié: (2025)
Building Large-Scale English-Romanian Literary Translation Resources with Open Models
par: Nadas, Mihai, et autres
Publié: (2025)
par: Nadas, Mihai, et autres
Publié: (2025)
RoCode: A Dataset for Measuring Code Intelligence from Problem Definitions in Romanian
par: Cosma, Adrian, et autres
Publié: (2024)
par: Cosma, Adrian, et autres
Publié: (2024)
Enhancing Romanian Offensive Language Detection through Knowledge Distillation, Multi-Task Learning, and Data Augmentation
par: Matei, Vlad-Cristian, et autres
Publié: (2024)
par: Matei, Vlad-Cristian, et autres
Publié: (2024)
FictionalQA: A Dataset for Studying Memorization and Knowledge Acquisition
par: Kirchenbauer, John, et autres
Publié: (2025)
par: Kirchenbauer, John, et autres
Publié: (2025)
Neural Grammatical Error Correction for Romanian
par: Cotet, Teodor-Mihai, et autres
Publié: (2026)
par: Cotet, Teodor-Mihai, et autres
Publié: (2026)
Documents similaires
-
Exploring Large Language Models for Translating Romanian Computational Problems into English
par: Dumitran, Adrian Marius, et autres
Publié: (2025) -
GRILE: A Benchmark for Grammar Reasoning and Explanation in Romanian LLMs
par: Dumitran, Adrian-Marius, et autres
Publié: (2025) -
Do LLMs Understand Romanian Driving Laws? A Study on Multimodal and Fine-Tuned Question Answering
par: Barbu, Eduard, et autres
Publié: (2025) -
A Culturally-Rich Romanian NLP Dataset from "Who Wants to Be a Millionaire?" Videos
par: Ganea, Alexandru-Gabriel, et autres
Publié: (2025) -
RoLegalGEC: Legal Domain Grammatical Error Detection and Correction Dataset for Romanian
par: Timpuriu, Mircea, et autres
Publié: (2026)