Evaluation is all you need. Prompting Generative Large Language Models for Annotation Tasks in the Social Sciences. A Primer using Open Models
Fuente:
arXiv
Guardado en:
| Autores principales: | Weber, Maximilian, Reichardt, Merle |
|---|---|
| Formato: | Preprint |
| Publicado: |
2023
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Large Language Models aren't all that you need
por: Holla, Kiran Voderhobli, et al.
Publicado: (2024)
por: Holla, Kiran Voderhobli, et al.
Publicado: (2024)
Steps are all you need: Rethinking STEM Education with Prompt Engineering
por: Addala, Krishnasai, et al.
Publicado: (2024)
por: Addala, Krishnasai, et al.
Publicado: (2024)
Camouflage is all you need: Evaluating and Enhancing Language Model Robustness Against Camouflage Adversarial Attacks
por: Huertas-García, Álvaro, et al.
Publicado: (2024)
por: Huertas-García, Álvaro, et al.
Publicado: (2024)
Prompt Selection Matters: Enhancing Text Annotations for Social Sciences with Large Language Models
por: Abraham, Louis, et al.
Publicado: (2024)
por: Abraham, Louis, et al.
Publicado: (2024)
Multilingual Natural Language Processing Model for Radiology Reports -- The Summary is all you need!
por: Lindo, Mariana, et al.
Publicado: (2023)
por: Lindo, Mariana, et al.
Publicado: (2023)
Downstream bias mitigation is all you need
por: Baksi, Arkadeep, et al.
Publicado: (2024)
por: Baksi, Arkadeep, et al.
Publicado: (2024)
Multimodal LLMs are not all you need for Pediatric Speech Language Pathology
por: Fürst, Darren, et al.
Publicado: (2026)
por: Fürst, Darren, et al.
Publicado: (2026)
Reddit is all you need: Authorship profiling for Romanian
por: Ştefănescu, Ecaterina, et al.
Publicado: (2024)
por: Ştefănescu, Ecaterina, et al.
Publicado: (2024)
Do we still need Human Annotators? Prompting Large Language Models for Aspect Sentiment Quad Prediction
por: Hellwig, Nils Constantin, et al.
Publicado: (2025)
por: Hellwig, Nils Constantin, et al.
Publicado: (2025)
Navigating the Risks of Using Large Language Models for Text Annotation in Social Science Research
por: Lin, Hao, et al.
Publicado: (2025)
por: Lin, Hao, et al.
Publicado: (2025)
Prompt Stability Scoring for Text Annotation with Large Language Models
por: Barrie, Christopher, et al.
Publicado: (2024)
por: Barrie, Christopher, et al.
Publicado: (2024)
Signformer is all you need: Towards Edge AI for Sign Language
por: Yang, Eta
Publicado: (2024)
por: Yang, Eta
Publicado: (2024)
Evaluating Large Language Models as Expert Annotators
por: Tseng, Yu-Min, et al.
Publicado: (2025)
por: Tseng, Yu-Min, et al.
Publicado: (2025)
Social Bias Evaluation for Large Language Models Requires Prompt Variations
por: Hida, Rem, et al.
Publicado: (2024)
por: Hida, Rem, et al.
Publicado: (2024)
Knowledge Graphs are all you need: Leveraging KGs in Physics Question Answering
por: Addala, Krishnasai, et al.
Publicado: (2024)
por: Addala, Krishnasai, et al.
Publicado: (2024)
AUEB-Archimedes at RIRAG-2025: Is obligation concatenation really all you need?
por: Chasandras, Ioannis, et al.
Publicado: (2024)
por: Chasandras, Ioannis, et al.
Publicado: (2024)
A Systematic Evaluation of Large Language Models for Natural Language Generation Tasks
por: Ni, Xuanfan, et al.
Publicado: (2024)
por: Ni, Xuanfan, et al.
Publicado: (2024)
Evaluating and Mitigating Social Bias for Large Language Models in Open-ended Settings
por: Liu, Zhao, et al.
Publicado: (2024)
por: Liu, Zhao, et al.
Publicado: (2024)
OpenEthics: A Comprehensive Ethical Evaluation of Open-Source Generative Large Language Models
por: Özen, Yıldırım, et al.
Publicado: (2025)
por: Özen, Yıldırım, et al.
Publicado: (2025)
Neural Models and Language Model Prompting for the Multidimensional Evaluation of Open-Ended Conversations
por: Elizabeth, Michelle, et al.
Publicado: (2025)
por: Elizabeth, Michelle, et al.
Publicado: (2025)
Navigating Prompt Complexity for Zero-Shot Classification: A Study of Large Language Models in Computational Social Science
por: Mu, Yida, et al.
Publicado: (2023)
por: Mu, Yida, et al.
Publicado: (2023)
OMGEval: An Open Multilingual Generative Evaluation Benchmark for Large Language Models
por: Liu, Yang, et al.
Publicado: (2024)
por: Liu, Yang, et al.
Publicado: (2024)
Instructions are all you need: Self-supervised Reinforcement Learning for Instruction Following
por: Ren, Qingyu, et al.
Publicado: (2025)
por: Ren, Qingyu, et al.
Publicado: (2025)
Good Parenting is all you need -- Multi-agentic LLM Hallucination Mitigation
por: Kwartler, Ted, et al.
Publicado: (2024)
por: Kwartler, Ted, et al.
Publicado: (2024)
An Evaluation of Large Language Models on Text Summarization Tasks Using Prompt Engineering Techniques
por: Aly, Walid Mohamed, et al.
Publicado: (2025)
por: Aly, Walid Mohamed, et al.
Publicado: (2025)
Meta-Task Prompting Elicits Embeddings from Large Language Models
por: Lei, Yibin, et al.
Publicado: (2024)
por: Lei, Yibin, et al.
Publicado: (2024)
Cross-Modal Safety Alignment: Is textual unlearning all you need?
por: Chakraborty, Trishna, et al.
Publicado: (2024)
por: Chakraborty, Trishna, et al.
Publicado: (2024)
Collaboration is all you need: LLM Assisted Safe Code Translation
por: Karanjai, Rabimba, et al.
Publicado: (2025)
por: Karanjai, Rabimba, et al.
Publicado: (2025)
IDEAlign: Comparing Large Language Models to Human Experts in Open-ended Interpretive Annotations
por: Nam, Hyunji, et al.
Publicado: (2025)
por: Nam, Hyunji, et al.
Publicado: (2025)
Augmenting Human-Annotated Training Data with Large Language Model Generation and Distillation in Open-Response Assessment
por: Borchers, Conrad, et al.
Publicado: (2025)
por: Borchers, Conrad, et al.
Publicado: (2025)
Open Generative Large Language Models for Galician
por: Gamallo, Pablo, et al.
Publicado: (2024)
por: Gamallo, Pablo, et al.
Publicado: (2024)
Evaluating the Prompt Steerability of Large Language Models
por: Miehling, Erik, et al.
Publicado: (2024)
por: Miehling, Erik, et al.
Publicado: (2024)
Tower: An Open Multilingual Large Language Model for Translation-Related Tasks
por: Alves, Duarte M., et al.
Publicado: (2024)
por: Alves, Duarte M., et al.
Publicado: (2024)
KZ-SafetyPrompts: A Kazakh Safety Evaluation Prompt Dataset for Large Language Models
por: Zaghouani, Wajdi, et al.
Publicado: (2026)
por: Zaghouani, Wajdi, et al.
Publicado: (2026)
Malicious Repurposing of Open Science Artefacts by Using Large Language Models
por: Hashemi, Zahra, et al.
Publicado: (2026)
por: Hashemi, Zahra, et al.
Publicado: (2026)
Prompting Science Report 3: I'll pay you or I'll kill you -- but will you care?
por: Meincke, Lennart, et al.
Publicado: (2025)
por: Meincke, Lennart, et al.
Publicado: (2025)
Evaluating Large Language Models on Spatial Tasks: A Multi-Task Benchmarking Study
por: Xu, Liuchang, et al.
Publicado: (2024)
por: Xu, Liuchang, et al.
Publicado: (2024)
Ambiguity is the last thing you need
por: Chivers, Emily, et al.
Publicado: (2024)
por: Chivers, Emily, et al.
Publicado: (2024)
Introducing Bode: A Fine-Tuned Large Language Model for Portuguese Prompt-Based Task
por: Garcia, Gabriel Lino, et al.
Publicado: (2024)
por: Garcia, Gabriel Lino, et al.
Publicado: (2024)
Benchmarking Large Language Models on Multiple Tasks in Bioinformatics NLP with Prompting
por: Jiang, Jiyue, et al.
Publicado: (2025)
por: Jiang, Jiyue, et al.
Publicado: (2025)
Ejemplares similares
-
Large Language Models aren't all that you need
por: Holla, Kiran Voderhobli, et al.
Publicado: (2024) -
Steps are all you need: Rethinking STEM Education with Prompt Engineering
por: Addala, Krishnasai, et al.
Publicado: (2024) -
Camouflage is all you need: Evaluating and Enhancing Language Model Robustness Against Camouflage Adversarial Attacks
por: Huertas-García, Álvaro, et al.
Publicado: (2024) -
Prompt Selection Matters: Enhancing Text Annotations for Social Sciences with Large Language Models
por: Abraham, Louis, et al.
Publicado: (2024) -
Multilingual Natural Language Processing Model for Radiology Reports -- The Summary is all you need!
por: Lindo, Mariana, et al.
Publicado: (2023)