DORE: A Dataset For Portuguese Definition Generation
Fuente:
arXiv
Salvato in:
| Autori principali: | Furtado, Anna Beatriz Dimas, Ranasinghe, Tharindu, Blain, Frédéric, Mitkov, Ruslan |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
LLM-based Embedders for Prior Case Retrieval
di: Premasiri, Damith, et al.
Pubblicazione: (2025)
di: Premasiri, Damith, et al.
Pubblicazione: (2025)
A Federated Learning Approach to Privacy Preserving Offensive Language Identification
di: Zampieri, Marcos, et al.
Pubblicazione: (2024)
di: Zampieri, Marcos, et al.
Pubblicazione: (2024)
Guided Distant Supervision for Multilingual Relation Extraction Data: Adapting to a New Language
di: Plum, Alistair, et al.
Pubblicazione: (2024)
di: Plum, Alistair, et al.
Pubblicazione: (2024)
AHaSIS: Shared Task on Sentiment Analysis for Arabic Dialects
di: Alharbi, Maram, et al.
Pubblicazione: (2025)
di: Alharbi, Maram, et al.
Pubblicazione: (2025)
From Text to Graph: Leveraging Graph Neural Networks for Enhanced Explainability in NLP
di: Yáñez-Romero, Fabio, et al.
Pubblicazione: (2025)
di: Yáñez-Romero, Fabio, et al.
Pubblicazione: (2025)
NSINA: A News Corpus for Sinhala
di: Hettiarachchi, Hansi, et al.
Pubblicazione: (2024)
di: Hettiarachchi, Hansi, et al.
Pubblicazione: (2024)
Vicarious Offense and Noise Audit of Offensive Speech Classifiers: Unifying Human and Machine Disagreement on What is Offensive
di: Weerasooriya, Tharindu Cyril, et al.
Pubblicazione: (2023)
di: Weerasooriya, Tharindu Cyril, et al.
Pubblicazione: (2023)
ALEXSIS-PT: A New Resource for Portuguese Lexical Simplification
di: North, Kai, et al.
Pubblicazione: (2022)
di: North, Kai, et al.
Pubblicazione: (2022)
SOLD: Sinhala Offensive Language Dataset
di: Ranasinghe, Tharindu, et al.
Pubblicazione: (2022)
di: Ranasinghe, Tharindu, et al.
Pubblicazione: (2022)
Overview of the First Workshop on Language Models for Low-Resource Languages (LoResLM 2025)
di: Hettiarachchi, Hansi, et al.
Pubblicazione: (2024)
di: Hettiarachchi, Hansi, et al.
Pubblicazione: (2024)
Text Generation Models for Luxembourgish with Limited Data: A Balanced Multilingual Strategy
di: Plum, Alistair, et al.
Pubblicazione: (2024)
di: Plum, Alistair, et al.
Pubblicazione: (2024)
What do Large Language Models Need for Machine Translation Evaluation?
di: Qian, Shenbin, et al.
Pubblicazione: (2024)
di: Qian, Shenbin, et al.
Pubblicazione: (2024)
Can Knowledge Graphs Reduce Hallucinations in LLMs? : A Survey
di: Agrawal, Garima, et al.
Pubblicazione: (2023)
di: Agrawal, Garima, et al.
Pubblicazione: (2023)
Do LLMs Judge Distantly Supervised Named Entity Labels Well? Constructing the JudgeWEL Dataset
di: Plum, Alistair, et al.
Pubblicazione: (2026)
di: Plum, Alistair, et al.
Pubblicazione: (2026)
Which Side Are You On? A Multi-task Dataset for End-to-End Argument Summarisation and Evaluation
di: Li, Hao, et al.
Pubblicazione: (2024)
di: Li, Hao, et al.
Pubblicazione: (2024)
EUROPA: A Legal Multilingual Keyphrase Generation Dataset
di: Salaün, Olivier, et al.
Pubblicazione: (2024)
di: Salaün, Olivier, et al.
Pubblicazione: (2024)
ALBA: A European Portuguese Benchmark for Evaluating Language and Linguistic Dimensions in Generative LLMs
di: Vieira, Inês, et al.
Pubblicazione: (2026)
di: Vieira, Inês, et al.
Pubblicazione: (2026)
Cross-Platform Hate Speech Detection with Weakly Supervised Causal Disentanglement
di: Sheth, Paras, et al.
Pubblicazione: (2024)
di: Sheth, Paras, et al.
Pubblicazione: (2024)
Tucano: Advancing Neural Text Generation for Portuguese
di: Corrêa, Nicholas Kluge, et al.
Pubblicazione: (2024)
di: Corrêa, Nicholas Kluge, et al.
Pubblicazione: (2024)
Brazilian Portuguese Image Captioning with Transformers: A Study on Cross-Native-Translated Dataset
di: Bromonschenkel, Gabriel, et al.
Pubblicazione: (2026)
di: Bromonschenkel, Gabriel, et al.
Pubblicazione: (2026)
DefAn: Definitive Answer Dataset for LLMs Hallucination Evaluation
di: Rahman, A B M Ashikur, et al.
Pubblicazione: (2024)
di: Rahman, A B M Ashikur, et al.
Pubblicazione: (2024)
Do LLMs Adhere to Label Definitions? Examining Their Receptivity to External Label Definitions
di: Mohammadi, Seyedali, et al.
Pubblicazione: (2025)
di: Mohammadi, Seyedali, et al.
Pubblicazione: (2025)
SALSA: Single-pass Autoregressive LLM Structured Classification
di: Berdichevsky, Ruslan, et al.
Pubblicazione: (2025)
di: Berdichevsky, Ruslan, et al.
Pubblicazione: (2025)
Multi-Relational Hyperbolic Word Embeddings from Natural Language Definitions
di: Valentino, Marco, et al.
Pubblicazione: (2023)
di: Valentino, Marco, et al.
Pubblicazione: (2023)
Towards Generalized Offensive Language Identification
di: Dmonte, Alphaeus, et al.
Pubblicazione: (2024)
di: Dmonte, Alphaeus, et al.
Pubblicazione: (2024)
ARTICLE: Annotator Reliability Through In-Context Learning
di: Dutta, Sujan, et al.
Pubblicazione: (2024)
di: Dutta, Sujan, et al.
Pubblicazione: (2024)
FalAR: A Large-scale Speaker-Annotated European Portuguese Speech Corpus of Parliamentary Sessions
di: Teixeira, Francisco, et al.
Pubblicazione: (2026)
di: Teixeira, Francisco, et al.
Pubblicazione: (2026)
DFA-RAG: Conversational Semantic Router for Large Language Model with Definite Finite Automaton
di: Sun, Yiyou, et al.
Pubblicazione: (2024)
di: Sun, Yiyou, et al.
Pubblicazione: (2024)
A Unified Definition of Hallucination: It's The World Model, Stupid!
di: Liu, Emmy, et al.
Pubblicazione: (2025)
di: Liu, Emmy, et al.
Pubblicazione: (2025)
Odysseys: Benchmarking Web Agents on Realistic Long Horizon Tasks
di: Jang, Lawrence Keunho, et al.
Pubblicazione: (2026)
di: Jang, Lawrence Keunho, et al.
Pubblicazione: (2026)
VOYAGER: A Training Free Approach for Generating Diverse Datasets using LLMs
di: Amballa, Avinash, et al.
Pubblicazione: (2025)
di: Amballa, Avinash, et al.
Pubblicazione: (2025)
Fairness Definitions in Language Models Explained
di: Yin, Zhipeng, et al.
Pubblicazione: (2024)
di: Yin, Zhipeng, et al.
Pubblicazione: (2024)
TeenyTinyLlama: open-source tiny language models trained in Brazilian Portuguese
di: Corrêa, Nicholas Kluge, et al.
Pubblicazione: (2024)
di: Corrêa, Nicholas Kluge, et al.
Pubblicazione: (2024)
Scientific Hypothesis Generation and Validation: Methods, Datasets, and Future Directions
di: Kulkarni, Adithya, et al.
Pubblicazione: (2025)
di: Kulkarni, Adithya, et al.
Pubblicazione: (2025)
Learning to Generate Instruction Tuning Datasets for Zero-Shot Task Adaptation
di: Nayak, Nihal V., et al.
Pubblicazione: (2024)
di: Nayak, Nihal V., et al.
Pubblicazione: (2024)
WolBanking77: Wolof Banking Speech Intent Classification Dataset
di: Kandji, Abdou Karim, et al.
Pubblicazione: (2025)
di: Kandji, Abdou Karim, et al.
Pubblicazione: (2025)
AutoJudge: Judge Decoding Without Manual Annotation
di: Garipov, Roman, et al.
Pubblicazione: (2025)
di: Garipov, Roman, et al.
Pubblicazione: (2025)
Attention Meets Post-hoc Interpretability: A Mathematical Perspective
di: Lopardo, Gianluigi, et al.
Pubblicazione: (2024)
di: Lopardo, Gianluigi, et al.
Pubblicazione: (2024)
AMALIA Technical Report: A Fully Open Source Large Language Model for European Portuguese
di: Simplício, Afonso, et al.
Pubblicazione: (2026)
di: Simplício, Afonso, et al.
Pubblicazione: (2026)
MAMUT: A Novel Framework for Modifying Mathematical Formulas for the Generation of Specialized Datasets for Language Model Training
di: Drechsel, Jonathan, et al.
Pubblicazione: (2025)
di: Drechsel, Jonathan, et al.
Pubblicazione: (2025)
Documenti analoghi
-
LLM-based Embedders for Prior Case Retrieval
di: Premasiri, Damith, et al.
Pubblicazione: (2025) -
A Federated Learning Approach to Privacy Preserving Offensive Language Identification
di: Zampieri, Marcos, et al.
Pubblicazione: (2024) -
Guided Distant Supervision for Multilingual Relation Extraction Data: Adapting to a New Language
di: Plum, Alistair, et al.
Pubblicazione: (2024) -
AHaSIS: Shared Task on Sentiment Analysis for Arabic Dialects
di: Alharbi, Maram, et al.
Pubblicazione: (2025) -
From Text to Graph: Leveraging Graph Neural Networks for Enhanced Explainability in NLP
di: Yáñez-Romero, Fabio, et al.
Pubblicazione: (2025)