Sina at FigNews 2024: Multilingual Datasets Annotated with Bias and Propaganda
Fuente:
arXiv
Salvato in:
| Autori principali: | Duaibes, Lina, Jaber, Areej, Jarrar, Mustafa, Qadi, Ahmad, Qandeel, Mais |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
SinaTools: Open Source Toolkit for Arabic Natural Language Processing
di: Hammouda, Tymaa, et al.
Pubblicazione: (2024)
di: Hammouda, Tymaa, et al.
Pubblicazione: (2024)
QuranMorph: Morphologically Annotated Quranic Corpus
di: Akra, Diyam, et al.
Pubblicazione: (2025)
di: Akra, Diyam, et al.
Pubblicazione: (2025)
Event-Arguments Extraction Corpus and Modeling using BERT for Arabic
di: Aljabari, Alaa, et al.
Pubblicazione: (2024)
di: Aljabari, Alaa, et al.
Pubblicazione: (2024)
Qabas: An Open-Source Arabic Lexicographic Database
di: Jarrar, Mustafa, et al.
Pubblicazione: (2024)
di: Jarrar, Mustafa, et al.
Pubblicazione: (2024)
Konooz: Multi-domain Multi-dialect Corpus for Named Entity Recognition
di: Hamad, Nagham, et al.
Pubblicazione: (2025)
di: Hamad, Nagham, et al.
Pubblicazione: (2025)
GPT Assisted Annotation of Rhetorical and Linguistic Features for Interpretable Propaganda Technique Detection in News Text
di: Hamilton, Kyle, et al.
Pubblicazione: (2024)
di: Hamilton, Kyle, et al.
Pubblicazione: (2024)
WojoodNER 2024: The Second Arabic Named Entity Recognition Shared Task
di: Jarrar, Mustafa, et al.
Pubblicazione: (2024)
di: Jarrar, Mustafa, et al.
Pubblicazione: (2024)
GPTs Are Multilingual Annotators for Sequence Generation Tasks
di: Choi, Juhwan, et al.
Pubblicazione: (2024)
di: Choi, Juhwan, et al.
Pubblicazione: (2024)
Are Large Language Models the New Interface for Data Pipelines?
di: Junior, Sylvio Barbon, et al.
Pubblicazione: (2024)
di: Junior, Sylvio Barbon, et al.
Pubblicazione: (2024)
The Token Tax: Systematic Bias in Multilingual Tokenization
di: Lundin, Jessica M., et al.
Pubblicazione: (2025)
di: Lundin, Jessica M., et al.
Pubblicazione: (2025)
How News Feels: Understanding Affective Bias in Multilingual Headlines for Human-Centered Media Design
di: Ameen, Mohd Ruhul, et al.
Pubblicazione: (2025)
di: Ameen, Mohd Ruhul, et al.
Pubblicazione: (2025)
Hotter and Colder: A New Approach to Annotating Sentiment, Emotions, and Bias in Icelandic Blog Comments
di: Friðriksdóttir, Steinunn Rut, et al.
Pubblicazione: (2025)
di: Friðriksdóttir, Steinunn Rut, et al.
Pubblicazione: (2025)
Tibyan Corpus: Balanced and Comprehensive Error Coverage Corpus Using ChatGPT for Arabic Grammatical Error Correction
di: Alrehili, Ahlam, et al.
Pubblicazione: (2024)
di: Alrehili, Ahlam, et al.
Pubblicazione: (2024)
Towards the Development of Balanced Synthetic Data for Correcting Grammatical Errors in Arabic: An Approach Based on Error Tagging Model and Synthetic Data Generating Model
di: Alrehili, Ahlam, et al.
Pubblicazione: (2025)
di: Alrehili, Ahlam, et al.
Pubblicazione: (2025)
ArbESC+: Arabic Enhanced Edit Selection System Combination for Grammatical Error Correction Resolving conflict and improving system combination in Arabic GEC
di: Alrehili, Ahlam, et al.
Pubblicazione: (2025)
di: Alrehili, Ahlam, et al.
Pubblicazione: (2025)
COMMENTATOR: A Code-mixed Multilingual Text Annotation Framework
di: Sheth, Rajvee, et al.
Pubblicazione: (2024)
di: Sheth, Rajvee, et al.
Pubblicazione: (2024)
The 2021 Tokyo Olympics Multilingual News Article Dataset
di: Novak, Erik, et al.
Pubblicazione: (2025)
di: Novak, Erik, et al.
Pubblicazione: (2025)
Prompt Engineering Techniques for Mitigating Cultural Bias Against Arabs and Muslims in Large Language Models: A Systematic Review
di: Asseri, Bushra, et al.
Pubblicazione: (2025)
di: Asseri, Bushra, et al.
Pubblicazione: (2025)
PARROT: An Open Multilingual Radiology Reports Dataset
di: Guellec, Bastien Le, et al.
Pubblicazione: (2025)
di: Guellec, Bastien Le, et al.
Pubblicazione: (2025)
Multi-News+: Cost-efficient Dataset Cleansing via LLM-based Data Annotation
di: Choi, Juhwan, et al.
Pubblicazione: (2024)
di: Choi, Juhwan, et al.
Pubblicazione: (2024)
Framing Political Bias in Multilingual LLMs Across Pakistani Languages
di: Nadeem, Afrozah, et al.
Pubblicazione: (2025)
di: Nadeem, Afrozah, et al.
Pubblicazione: (2025)
FIBER: A Multilingual Evaluation Resource for Factual Inference Bias
di: Munis, Evren Ayberk, et al.
Pubblicazione: (2025)
di: Munis, Evren Ayberk, et al.
Pubblicazione: (2025)
A Survey on Multilingual Large Language Models: Corpora, Alignment, and Bias
di: Xu, Yuemei, et al.
Pubblicazione: (2024)
di: Xu, Yuemei, et al.
Pubblicazione: (2024)
Bias Beyond Borders: Political Ideology Evaluation and Steering in Multilingual LLMs
di: Nadeem, Afrozah, et al.
Pubblicazione: (2026)
di: Nadeem, Afrozah, et al.
Pubblicazione: (2026)
Are Large Language Models Good at Detecting Propaganda?
di: Jose, Julia, et al.
Pubblicazione: (2025)
di: Jose, Julia, et al.
Pubblicazione: (2025)
Are Bias Evaluation Methods Biased ?
di: Berrayana, Lina, et al.
Pubblicazione: (2025)
di: Berrayana, Lina, et al.
Pubblicazione: (2025)
Arabic Tweet Act: A Weighted Ensemble Pre-Trained Transformer Model for Classifying Arabic Speech Acts on Twitter
di: Alshehri, Khadejaa, et al.
Pubblicazione: (2024)
di: Alshehri, Khadejaa, et al.
Pubblicazione: (2024)
BiasLab: A Multilingual, Dual-Framing Framework for Robust Measurement of Output-Level Bias in Large Language Models
di: Guey, William, et al.
Pubblicazione: (2026)
di: Guey, William, et al.
Pubblicazione: (2026)
Whose Morality Do They Speak? Unraveling Cultural Bias in Multilingual Language Models
di: Aksoy, Meltem
Pubblicazione: (2024)
di: Aksoy, Meltem
Pubblicazione: (2024)
Prompting Implicit Discourse Relation Annotation
di: Yung, Frances, et al.
Pubblicazione: (2024)
di: Yung, Frances, et al.
Pubblicazione: (2024)
TruthStance: An Annotated Dataset of Conversations on Truth Social
di: Ameen, Fathima, et al.
Pubblicazione: (2026)
di: Ameen, Fathima, et al.
Pubblicazione: (2026)
Aya Dataset: An Open-Access Collection for Multilingual Instruction Tuning
di: Singh, Shivalika, et al.
Pubblicazione: (2024)
di: Singh, Shivalika, et al.
Pubblicazione: (2024)
BETA-Labeling for Multilingual Dataset Construction in Low-Resource IR
di: Hasan, Md. Najib, et al.
Pubblicazione: (2026)
di: Hasan, Md. Najib, et al.
Pubblicazione: (2026)
Mitigating Translationese Bias in Multilingual LLM-as-a-Judge via Disentangled Information Bottleneck
di: Zhang, Hongbin, et al.
Pubblicazione: (2026)
di: Zhang, Hongbin, et al.
Pubblicazione: (2026)
Multi-EuP: The Multilingual European Parliament Dataset for Analysis of Bias in Information Retrieval
di: Yang, Jinrui, et al.
Pubblicazione: (2023)
di: Yang, Jinrui, et al.
Pubblicazione: (2023)
Detecting Propaganda Techniques in Code-Switched Social Media Text
di: Salman, Muhammad Umar, et al.
Pubblicazione: (2023)
di: Salman, Muhammad Umar, et al.
Pubblicazione: (2023)
Teochew-Wild: The First In-the-wild Teochew Dataset with Orthographic Annotations
di: Pan, Linrong, et al.
Pubblicazione: (2025)
di: Pan, Linrong, et al.
Pubblicazione: (2025)
Tagengo: A Multilingual Chat Dataset
di: Devine, Peter
Pubblicazione: (2024)
di: Devine, Peter
Pubblicazione: (2024)
Enforcing Human Rights of Palestinians in the Occupied Territory
di: Qandeel, Mais
Pubblicazione: (2019)
di: Qandeel, Mais
Pubblicazione: (2019)
Legend: Leveraging Representation Engineering to Annotate Safety Margin for Preference Datasets
di: Feng, Duanyu, et al.
Pubblicazione: (2024)
di: Feng, Duanyu, et al.
Pubblicazione: (2024)
Documenti analoghi
-
SinaTools: Open Source Toolkit for Arabic Natural Language Processing
di: Hammouda, Tymaa, et al.
Pubblicazione: (2024) -
QuranMorph: Morphologically Annotated Quranic Corpus
di: Akra, Diyam, et al.
Pubblicazione: (2025) -
Event-Arguments Extraction Corpus and Modeling using BERT for Arabic
di: Aljabari, Alaa, et al.
Pubblicazione: (2024) -
Qabas: An Open-Source Arabic Lexicographic Database
di: Jarrar, Mustafa, et al.
Pubblicazione: (2024) -
Konooz: Multi-domain Multi-dialect Corpus for Named Entity Recognition
di: Hamad, Nagham, et al.
Pubblicazione: (2025)