Are Chatbots Reliable Text Annotators? Sometimes
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Kristensen-McLachlan, Ross Deans, Canavan, Miceal, Kardos, Márton, Jacobsen, Mia, Aarøe, Lene |
|---|---|
| Format: | Preprint |
| Publié: |
2023
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
I only read it for the plot! Maturity Ratings Affect Fanfiction Style and Community Engagement
par: Jacobsen, Mia, et autres
Publié: (2025)
par: Jacobsen, Mia, et autres
Publié: (2025)
Context is Key(NMF): Modelling Topical Information Dynamics in Chinese Diaspora Media
par: Kristensen-McLachlan, Ross Deans, et autres
Publié: (2024)
par: Kristensen-McLachlan, Ross Deans, et autres
Publié: (2024)
Attention Flows: Tracing LLM Conceptual Engagement via Story Summaries
par: Hicke, Rebecca M. M., et autres
Publié: (2026)
par: Hicke, Rebecca M. M., et autres
Publié: (2026)
Multilingual Embedding Probes Fail to Generalize Across Learner Corpora
par: Lyngbaek, Laurits, et autres
Publié: (2026)
par: Lyngbaek, Laurits, et autres
Publié: (2026)
Alignment Drift in CEFR-prompted LLMs for Interactive Spanish Tutoring
par: Almasi, Mina, et autres
Publié: (2025)
par: Almasi, Mina, et autres
Publié: (2025)
Science is Exploration: Computational Frontiers for Conceptual Metaphor Theory
par: Hicke, Rebecca M. M., et autres
Publié: (2024)
par: Hicke, Rebecca M. M., et autres
Publié: (2024)
Says Who? Effective Zero-Shot Annotation of Focalization
par: Hicke, Rebecca M. M., et autres
Publié: (2024)
par: Hicke, Rebecca M. M., et autres
Publié: (2024)
Topeax -- An Improved Clustering Topic Model with Density Peak Detection and Lexical-Semantic Term Importance
par: Kardos, Márton
Publié: (2026)
par: Kardos, Márton
Publié: (2026)
The Scandinavian Embedding Benchmarks: Comprehensive Assessment of Multilingual and Monolingual Text Embedding
par: Enevoldsen, Kenneth, et autres
Publié: (2024)
par: Enevoldsen, Kenneth, et autres
Publié: (2024)
Maintaining MTEB: Towards Long Term Usability and Reproducibility of Embedding Benchmarks
par: Chung, Isaac, et autres
Publié: (2025)
par: Chung, Isaac, et autres
Publié: (2025)
Reasoning Models Will Sometimes Lie About Their Reasoning
par: Walden, William, et autres
Publié: (2026)
par: Walden, William, et autres
Publié: (2026)
How Reliable AI Chatbots are for Disease Prediction from Patient Complaints?
par: Nipu, Ayesha Siddika, et autres
Publié: (2024)
par: Nipu, Ayesha Siddika, et autres
Publié: (2024)
AFaCTA: Assisting the Annotation of Factual Claim Detection with Reliable LLM Annotators
par: Ni, Jingwei, et autres
Publié: (2024)
par: Ni, Jingwei, et autres
Publié: (2024)
Highlighting Case Studies in LLM Literature Review of Interdisciplinary System Science
par: McGinness, Lachlan, et autres
Publié: (2025)
par: McGinness, Lachlan, et autres
Publié: (2025)
Steamroller Problems: An Evaluation of LLM Reasoning Capability with Automated Theorem Prover Strategies
par: McGinness, Lachlan, et autres
Publié: (2024)
par: McGinness, Lachlan, et autres
Publié: (2024)
Fact or Fiction? Can LLMs be Reliable Annotators for Political Truths?
par: Chatrath, Veronica, et autres
Publié: (2024)
par: Chatrath, Veronica, et autres
Publié: (2024)
RadAnnotate: Large Language Models for Efficient and Reliable Radiology Report Annotation
par: Shetty, Saisha Pradeep, et autres
Publié: (2026)
par: Shetty, Saisha Pradeep, et autres
Publié: (2026)
Adaptation Odyssey in LLMs: Why Does Additional Pretraining Sometimes Fail to Improve?
par: Öncel, Fırat, et autres
Publié: (2024)
par: Öncel, Fırat, et autres
Publié: (2024)
COMMENTATOR: A Code-mixed Multilingual Text Annotation Framework
par: Sheth, Rajvee, et autres
Publié: (2024)
par: Sheth, Rajvee, et autres
Publié: (2024)
An LLM Maturity Model for Reliable and Transparent Text-to-Query
par: Yu, Lei, et autres
Publié: (2024)
par: Yu, Lei, et autres
Publié: (2024)
Are Large Language Models Reliable Argument Quality Annotators?
par: Mirzakhmedova, Nailia, et autres
Publié: (2024)
par: Mirzakhmedova, Nailia, et autres
Publié: (2024)
Can LLMs Evaluate What They Cannot Annotate? Revisiting LLM Reliability in Hate Speech Detection
par: Piot, Paloma, et autres
Publié: (2025)
par: Piot, Paloma, et autres
Publié: (2025)
ChatEL: Entity Linking with Chatbots
par: Ding, Yifan, et autres
Publié: (2024)
par: Ding, Yifan, et autres
Publié: (2024)
Enhancing Text Annotation through Rationale-Driven Collaborative Few-Shot Prompting
par: Wu, Jianfei, et autres
Publié: (2024)
par: Wu, Jianfei, et autres
Publié: (2024)
Large Language Models Reproduce Racial Stereotypes When Used for Text Annotation
par: Törnberg, Petter
Publié: (2026)
par: Törnberg, Petter
Publié: (2026)
Reliability Analysis of Psychological Concept Extraction and Classification in User-penned Text
par: Garg, Muskan, et autres
Publié: (2024)
par: Garg, Muskan, et autres
Publié: (2024)
First-Person Fairness in Chatbots
par: Eloundou, Tyna, et autres
Publié: (2024)
par: Eloundou, Tyna, et autres
Publié: (2024)
Reinforcement Learning for Optimizing RAG for Domain Chatbots
par: Kulkarni, Mandar, et autres
Publié: (2024)
par: Kulkarni, Mandar, et autres
Publié: (2024)
A Chatbot for Asylum-Seeking Migrants in Europe
par: Fazzinga, Bettina, et autres
Publié: (2024)
par: Fazzinga, Bettina, et autres
Publié: (2024)
Citation-Enhanced Generation for LLM-based Chatbots
par: Li, Weitao, et autres
Publié: (2024)
par: Li, Weitao, et autres
Publié: (2024)
The Knowledge-Behaviour Disconnect in LLM-based Chatbots
par: Broersen, Jan
Publié: (2025)
par: Broersen, Jan
Publié: (2025)
Soro: A Lightweight Foundation Model and Chatbot for Tajik
par: Liashkov, Stanislav, et autres
Publié: (2026)
par: Liashkov, Stanislav, et autres
Publié: (2026)
A Complete Survey on LLM-based AI Chatbots
par: Dam, Sumit Kumar, et autres
Publié: (2024)
par: Dam, Sumit Kumar, et autres
Publié: (2024)
Domain-Specific Improvement on Psychotherapy Chatbot Using Assistant
par: Kang, Cheng, et autres
Publié: (2024)
par: Kang, Cheng, et autres
Publié: (2024)
DialogueForge: LLM Simulation of Human-Chatbot Dialogue
par: Zhu, Ruizhe, et autres
Publié: (2025)
par: Zhu, Ruizhe, et autres
Publié: (2025)
NOVI : Chatbot System for University Novice with BERT and LLMs
par: Nam, Yoonji, et autres
Publié: (2024)
par: Nam, Yoonji, et autres
Publié: (2024)
Text Annotation via Inductive Coding: Comparing Human Experts to LLMs in Qualitative Data Analysis
par: Parfenova, Angelina, et autres
Publié: (2025)
par: Parfenova, Angelina, et autres
Publié: (2025)
Why Do We Laugh? Annotation and Taxonomy Generation for Laughable Contexts in Spontaneous Text Conversation
par: Inoue, Koji, et autres
Publié: (2025)
par: Inoue, Koji, et autres
Publié: (2025)
GPT Assisted Annotation of Rhetorical and Linguistic Features for Interpretable Propaganda Technique Detection in News Text
par: Hamilton, Kyle, et autres
Publié: (2024)
par: Hamilton, Kyle, et autres
Publié: (2024)
Magic Words or Methodical Work? Challenging Conventional Wisdom in LLM-Based Political Text Annotation
par: McLaren, Lorcan, et autres
Publié: (2026)
par: McLaren, Lorcan, et autres
Publié: (2026)
Documents similaires
-
I only read it for the plot! Maturity Ratings Affect Fanfiction Style and Community Engagement
par: Jacobsen, Mia, et autres
Publié: (2025) -
Context is Key(NMF): Modelling Topical Information Dynamics in Chinese Diaspora Media
par: Kristensen-McLachlan, Ross Deans, et autres
Publié: (2024) -
Attention Flows: Tracing LLM Conceptual Engagement via Story Summaries
par: Hicke, Rebecca M. M., et autres
Publié: (2026) -
Multilingual Embedding Probes Fail to Generalize Across Learner Corpora
par: Lyngbaek, Laurits, et autres
Publié: (2026) -
Alignment Drift in CEFR-prompted LLMs for Interactive Spanish Tutoring
par: Almasi, Mina, et autres
Publié: (2025)