Towards Better Inclusivity: A Diverse Tweet Corpus of English Varieties
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Pham, Nhi, Pham, Lachlan, Meyers, Adam L. |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
EmoScan: Automatic Screening of Depression Symptoms in Romanized Sinhala Tweets
par: Hewapathirana, Jayathi, et autres
Publié: (2024)
par: Hewapathirana, Jayathi, et autres
Publié: (2024)
Towards Better Health Conversations: The Benefits of Context-seeking
par: Sayres, Rory, et autres
Publié: (2025)
par: Sayres, Rory, et autres
Publié: (2025)
MAFIA: Multi-Adapter Fused Inclusive LanguAge Models
par: Jain, Prachi, et autres
Publié: (2024)
par: Jain, Prachi, et autres
Publié: (2024)
Mapping the Podcast Ecosystem with the Structured Podcast Research Corpus
par: Litterer, Benjamin, et autres
Publié: (2024)
par: Litterer, Benjamin, et autres
Publié: (2024)
Reading Between the Tweets: Deciphering Ideological Stances of Interconnected Mixed-Ideology Communities
par: He, Zihao, et autres
Publié: (2024)
par: He, Zihao, et autres
Publié: (2024)
The Cambridge Law Corpus: A Dataset for Legal AI Research
par: Östling, Andreas, et autres
Publié: (2023)
par: Östling, Andreas, et autres
Publié: (2023)
An Annotated Corpus of Arabic Tweets for Hate Speech Analysis
par: Zaghouani, Wajdi, et autres
Publié: (2025)
par: Zaghouani, Wajdi, et autres
Publié: (2025)
SocialNLP Fake-EmoReact 2021 Challenge Overview: Predicting Fake Tweets from Their Replies and GIFs
par: Huang, Chien-Kun, et autres
Publié: (2024)
par: Huang, Chien-Kun, et autres
Publié: (2024)
The Moral Foundations Reddit Corpus
par: Trager, Jackson, et autres
Publié: (2022)
par: Trager, Jackson, et autres
Publié: (2022)
SPOT: An Annotated French Corpus and Benchmark for Detecting Critical Interventions in Online Conversations
par: Berriche, Manon, et autres
Publié: (2025)
par: Berriche, Manon, et autres
Publié: (2025)
Mechanism Plausibility in Generative Agent-Based Modeling
par: Zhao, Patrick, et autres
Publié: (2026)
par: Zhao, Patrick, et autres
Publié: (2026)
Better Together: Quantifying the Benefits of AI-Assisted Recruitment
par: Aka, Ada, et autres
Publié: (2025)
par: Aka, Ada, et autres
Publié: (2025)
ARCADE: A City-Scale Corpus for Fine-Grained Arabic Dialect Tagging
par: Nacar, Omer, et autres
Publié: (2026)
par: Nacar, Omer, et autres
Publié: (2026)
Divergent Emotional Patterns in Disinformation on Social Media? An Analysis of Tweets and TikToks about the DANA in Valencia
par: Arcos, Iván, et autres
Publié: (2025)
par: Arcos, Iván, et autres
Publié: (2025)
Improving Stance Detection by Leveraging Measurement Knowledge from Social Sciences: A Case Study of Dutch Political Tweets and Traditional Gender Role Division
par: Fang, Qixiang, et autres
Publié: (2022)
par: Fang, Qixiang, et autres
Publié: (2022)
SLM-Bench: A Comprehensive Benchmark of Small Language Models on Environmental Impacts--Extended Version
par: Pham, Nghiem Thanh, et autres
Publié: (2025)
par: Pham, Nghiem Thanh, et autres
Publié: (2025)
SMILE: Single-turn to Multi-turn Inclusive Language Expansion via ChatGPT for Mental Health Support
par: Qiu, Huachuan, et autres
Publié: (2023)
par: Qiu, Huachuan, et autres
Publié: (2023)
Corpus-Based Approaches to Igbo Diacritic Restoration
par: Ezeani, Ignatius
Publié: (2026)
par: Ezeani, Ignatius
Publié: (2026)
The Better Angels of Machine Personality: How Personality Relates to LLM Safety
par: Zhang, Jie, et autres
Publié: (2024)
par: Zhang, Jie, et autres
Publié: (2024)
Better Call GPT, Comparing Large Language Models Against Lawyers
par: Martin, Lauren, et autres
Publié: (2024)
par: Martin, Lauren, et autres
Publié: (2024)
Extending a Parliamentary Corpus with MPs' Tweets: Automatic Annotation and Evaluation Using MultiParTweet
par: Bagci, Mevlüt, et autres
Publié: (2025)
par: Bagci, Mevlüt, et autres
Publié: (2025)
The Homogenization Problem in LLMs: Towards Meaningful Diversity in AI Safety
par: Rios-Sialer, Ian
Publié: (2026)
par: Rios-Sialer, Ian
Publié: (2026)
Extracting O*NET Features from the NLx Corpus to Build Public Use Aggregate Labor Market Data
par: Meisenbacher, Stephen, et autres
Publié: (2025)
par: Meisenbacher, Stephen, et autres
Publié: (2025)
EquiSumm : A Gender Bias-Aware Framework for Inclusive Tweet Summarization
par: Wanjari, Chaitanya, et autres
Publié: (2026)
par: Wanjari, Chaitanya, et autres
Publié: (2026)
Evaluating Digital Inclusiveness of Digital Agri-Food Tools Using Large Language Models: A Comparative Analysis Between Human and AI-Based Evaluations
par: Pewinya, Githma, et autres
Publié: (2026)
par: Pewinya, Githma, et autres
Publié: (2026)
Building Better: Avoiding Pitfalls in Developing Language Resources when Data is Scarce
par: Ousidhoum, Nedjma, et autres
Publié: (2024)
par: Ousidhoum, Nedjma, et autres
Publié: (2024)
Ethical Concern Identification in NLP: A Corpus of ACL Anthology Ethics Statements
par: Karamolegkou, Antonia, et autres
Publié: (2024)
par: Karamolegkou, Antonia, et autres
Publié: (2024)
GPT-HateCheck: Can LLMs Write Better Functional Tests for Hate Speech Detection?
par: Jin, Yiping, et autres
Publié: (2024)
par: Jin, Yiping, et autres
Publié: (2024)
Do Llamas Work in English? On the Latent Language of Multilingual Transformers
par: Wendler, Chris, et autres
Publié: (2024)
par: Wendler, Chris, et autres
Publié: (2024)
Beyond English: Unveiling Multilingual Bias in LLM Copyright Compliance
par: Chen, Yupeng, et autres
Publié: (2025)
par: Chen, Yupeng, et autres
Publié: (2025)
Benchmarking Sociolinguistic Diversity in Swahili NLP: A Taxonomy-Guided Approach
par: Oketch, Kezia, et autres
Publié: (2025)
par: Oketch, Kezia, et autres
Publié: (2025)
Robust Pronoun Fidelity with English LLMs: Are they Reasoning, Repeating, or Just Biased?
par: Gautam, Vagrant, et autres
Publié: (2024)
par: Gautam, Vagrant, et autres
Publié: (2024)
Multilingual Prompting for Improving LLM Generation Diversity
par: Wang, Qihan, et autres
Publié: (2025)
par: Wang, Qihan, et autres
Publié: (2025)
Can Large Language Models Understand You Better? An MBTI Personality Detection Dataset Aligned with Population Traits
par: Li, Bohan, et autres
Publié: (2024)
par: Li, Bohan, et autres
Publié: (2024)
People Make Better Edits: Measuring the Efficacy of LLM-Generated Counterfactually Augmented Data for Harmful Language Detection
par: Sen, Indira, et autres
Publié: (2023)
par: Sen, Indira, et autres
Publié: (2023)
Words of Warmth: Trust and Sociability Norms for over 26k English Words
par: Mohammad, Saif M.
Publié: (2025)
par: Mohammad, Saif M.
Publié: (2025)
Inverse Scaling: When Bigger Isn't Better
par: McKenzie, Ian R., et autres
Publié: (2023)
par: McKenzie, Ian R., et autres
Publié: (2023)
LangLingual: A Personalised, Exercise-oriented English Language Learning Tool Leveraging Large Language Models
par: Gupta, Sammriddh, et autres
Publié: (2025)
par: Gupta, Sammriddh, et autres
Publié: (2025)
What is Stigma Attributed to? A Theory-Grounded, Expert-Annotated Interview Corpus for Demystifying Mental-Health Stigma
par: Meng, Han, et autres
Publié: (2025)
par: Meng, Han, et autres
Publié: (2025)
Language of Thought Shapes Output Diversity in Large Language Models
par: Xu, Shaoyang, et autres
Publié: (2026)
par: Xu, Shaoyang, et autres
Publié: (2026)
Documents similaires
-
EmoScan: Automatic Screening of Depression Symptoms in Romanized Sinhala Tweets
par: Hewapathirana, Jayathi, et autres
Publié: (2024) -
Towards Better Health Conversations: The Benefits of Context-seeking
par: Sayres, Rory, et autres
Publié: (2025) -
MAFIA: Multi-Adapter Fused Inclusive LanguAge Models
par: Jain, Prachi, et autres
Publié: (2024) -
Mapping the Podcast Ecosystem with the Structured Podcast Research Corpus
par: Litterer, Benjamin, et autres
Publié: (2024) -
Reading Between the Tweets: Deciphering Ideological Stances of Interconnected Mixed-Ideology Communities
par: He, Zihao, et autres
Publié: (2024)