LengClaro2023: A Dataset of Administrative Texts in Spanish with Plain Language adaptations
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Agüera-Marco, Belén, Gonzalez-Dios, Itziar |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Text Adaptation to Plain Language and Easy Read via Automatic Post-Editing Cycles
par: Calleja, Jesús, et autres
Publié: (2025)
par: Calleja, Jesús, et autres
Publié: (2025)
BenchOverflow: Measuring Overflow in Large Language Models via Plain-Text Prompts
par: Feiglin, Erin, et autres
Publié: (2026)
par: Feiglin, Erin, et autres
Publié: (2026)
CardiffNLP at CLEARS-2025: Prompting Large Language Models for Plain Language and Easy-to-Read Text Rewriting
par: Ayesh, Mutaz, et autres
Publié: (2025)
par: Ayesh, Mutaz, et autres
Publié: (2025)
SimplifyMyText: An LLM-Based System for Inclusive Plain Language Text Simplification
par: Färber, Michael, et autres
Publié: (2025)
par: Färber, Michael, et autres
Publié: (2025)
NoticIA: A Clickbait Article Summarization Dataset in Spanish
par: García-Ferrero, Iker, et autres
Publié: (2024)
par: García-Ferrero, Iker, et autres
Publié: (2024)
Lost in Variation? Evaluating NLI Performance in Basque and Spanish Geographical Variants
par: Bengoetxea, Jaione, et autres
Publié: (2025)
par: Bengoetxea, Jaione, et autres
Publié: (2025)
MessIRve: A Large-Scale Spanish Information Retrieval Dataset
par: Valentini, Francisco, et autres
Publié: (2024)
par: Valentini, Francisco, et autres
Publié: (2024)
RigoChat 2: an adapted language model to Spanish using a bounded dataset and reduced hardware
par: Gómez, Gonzalo Santamaría, et autres
Publié: (2025)
par: Gómez, Gonzalo Santamaría, et autres
Publié: (2025)
Online Social Support Detection in Spanish Social Media Texts
par: Tash, Moein Shahiki, et autres
Publié: (2025)
par: Tash, Moein Shahiki, et autres
Publié: (2025)
The Grammar of Transformers: A Systematic Review of Interpretability Research on Syntactic Knowledge in Language Models
par: Graichen, Nora, et autres
Publié: (2026)
par: Graichen, Nora, et autres
Publié: (2026)
Classification of Radiological Text in Small and Imbalanced Datasets in a Non-English Language
par: Beliveau, Vincent, et autres
Publié: (2024)
par: Beliveau, Vincent, et autres
Publié: (2024)
Classification of Human- and AI-Generated Texts for English, French, German, and Spanish
par: Schaaff, Kristina, et autres
Publié: (2023)
par: Schaaff, Kristina, et autres
Publié: (2023)
MuSeD: A Multimodal Spanish Dataset for Sexism Detection in Social Media Videos
par: De Grazia, Laura, et autres
Publié: (2025)
par: De Grazia, Laura, et autres
Publié: (2025)
Investigating Large Language Models' Linguistic Abilities for Text Preprocessing
par: Braga, Marco, et autres
Publié: (2025)
par: Braga, Marco, et autres
Publié: (2025)
Seventeenth-Century Spanish American Notary Records for Fine-Tuning Spanish Large Language Models
par: Sarker, Shraboni, et autres
Publié: (2024)
par: Sarker, Shraboni, et autres
Publié: (2024)
Automatic Histograms: Leveraging Language Models for Text Dataset Exploration
par: Reif, Emily, et autres
Publié: (2024)
par: Reif, Emily, et autres
Publié: (2024)
LSTM-Based Text Generation: A Study on Historical Datasets
par: Hussein, Mustafa Abbas Hussein, et autres
Publié: (2024)
par: Hussein, Mustafa Abbas Hussein, et autres
Publié: (2024)
REZE: Representation Regularization for Domain-adaptive Text Embedding Pre-finetuning
par: Lee, Seungmin, et autres
Publié: (2026)
par: Lee, Seungmin, et autres
Publié: (2026)
KGGen: Extracting Knowledge Graphs from Plain Text with Language Models
par: Mo, Belinda, et autres
Publié: (2025)
par: Mo, Belinda, et autres
Publié: (2025)
A Vietnamese Dataset for Text Segmentation and Multiple Choices Reading Comprehension
par: Hai, Toan Nguyen, et autres
Publié: (2025)
par: Hai, Toan Nguyen, et autres
Publié: (2025)
Breaking the Silence: A Dataset and Benchmark for Bangla Text-to-Gloss Translation
par: Abdullah, Sharif Mohammad, et autres
Publié: (2025)
par: Abdullah, Sharif Mohammad, et autres
Publié: (2025)
PulseLM: A Foundation Dataset and Benchmark for PPG-Text Learning
par: Pham, Hung Manh, et autres
Publié: (2026)
par: Pham, Hung Manh, et autres
Publié: (2026)
Spanish TrOCR: Leveraging Transfer Learning for Language Adaptation
par: Lauar, Filipe, et autres
Publié: (2024)
par: Lauar, Filipe, et autres
Publié: (2024)
Ontology-Free General-Domain Knowledge Graph-to-Text Generation Dataset Synthesis using Large Language Model
par: Kim, Daehee, et autres
Publié: (2024)
par: Kim, Daehee, et autres
Publié: (2024)
FMI@SU ToxHabits: Evaluating LLMs Performance on Toxic Habit Extraction in Spanish Clinical Texts
par: Vassileva, Sylvia, et autres
Publié: (2026)
par: Vassileva, Sylvia, et autres
Publié: (2026)
Bharat Scene Text: A Novel Comprehensive Dataset and Benchmark for Indian Language Scene Text Understanding
par: De, Anik, et autres
Publié: (2025)
par: De, Anik, et autres
Publié: (2025)
FinTextQA: A Dataset for Long-form Financial Question Answering
par: Chen, Jian, et autres
Publié: (2024)
par: Chen, Jian, et autres
Publié: (2024)
Text2VLM: Adapting Text-Only Datasets to Evaluate Alignment Training in Visual Language Models
par: Downer, Gabriel, et autres
Publié: (2025)
par: Downer, Gabriel, et autres
Publié: (2025)
ClinText-SP and RigoBERTa Clinical: a new set of open resources for Spanish Clinical NLP
par: Subies, Guillem García, et autres
Publié: (2025)
par: Subies, Guillem García, et autres
Publié: (2025)
Plain language adaptations of biomedical text using LLMs: Comparision of evaluation metrics
par: Kocbek, Primoz, et autres
Publié: (2025)
par: Kocbek, Primoz, et autres
Publié: (2025)
AceParse: A Comprehensive Dataset with Diverse Structured Texts for Academic Literature Parsing
par: Ji, Huawei, et autres
Publié: (2024)
par: Ji, Huawei, et autres
Publié: (2024)
Forecasting Future International Events: A Reliable Dataset for Text-Based Event Modeling
par: Gwak, Daehoon, et autres
Publié: (2024)
par: Gwak, Daehoon, et autres
Publié: (2024)
HeSum: a Novel Dataset for Abstractive Text Summarization in Hebrew
par: Paz-Argaman, Tzuf, et autres
Publié: (2024)
par: Paz-Argaman, Tzuf, et autres
Publié: (2024)
Ace-CEFR -- A Dataset for Automated Evaluation of the Linguistic Difficulty of Conversational Texts for LLM Applications
par: Kogan, David, et autres
Publié: (2025)
par: Kogan, David, et autres
Publié: (2025)
MultiBanAbs: A Comprehensive Multi-Domain Bangla Abstractive Text Summarization Dataset
par: Ferdous, Md. Tanzim, et autres
Publié: (2025)
par: Ferdous, Md. Tanzim, et autres
Publié: (2025)
Datasets for Large Language Models: A Comprehensive Survey
par: Liu, Yang, et autres
Publié: (2024)
par: Liu, Yang, et autres
Publié: (2024)
Lost-in-the-Middle in Long-Text Generation: Synthetic Dataset, Evaluation Framework, and Mitigation
par: Zhang, Junhao, et autres
Publié: (2025)
par: Zhang, Junhao, et autres
Publié: (2025)
BIRDTurk: Adaptation of the BIRD Text-to-SQL Dataset to Turkish
par: Aktaş, Burak, et autres
Publié: (2026)
par: Aktaş, Burak, et autres
Publié: (2026)
CDTP: A Large-Scale Chinese Data-Text Pair Dataset for Comprehensive Evaluation of Chinese LLMs
par: Wu, Chengwei, et autres
Publié: (2025)
par: Wu, Chengwei, et autres
Publié: (2025)
Text2Zinc: A Cross-Domain Dataset for Modeling Optimization and Satisfaction Problems in MiniZinc
par: Singirikonda, Akash, et autres
Publié: (2025)
par: Singirikonda, Akash, et autres
Publié: (2025)
Documents similaires
-
Text Adaptation to Plain Language and Easy Read via Automatic Post-Editing Cycles
par: Calleja, Jesús, et autres
Publié: (2025) -
BenchOverflow: Measuring Overflow in Large Language Models via Plain-Text Prompts
par: Feiglin, Erin, et autres
Publié: (2026) -
CardiffNLP at CLEARS-2025: Prompting Large Language Models for Plain Language and Easy-to-Read Text Rewriting
par: Ayesh, Mutaz, et autres
Publié: (2025) -
SimplifyMyText: An LLM-Based System for Inclusive Plain Language Text Simplification
par: Färber, Michael, et autres
Publié: (2025) -
NoticIA: A Clickbait Article Summarization Dataset in Spanish
par: García-Ferrero, Iker, et autres
Publié: (2024)