Evaluating Digital Inclusiveness of Digital Agri-Food Tools Using Large Language Models: A Comparative Analysis Between Human and AI-Based Evaluations
Fuente:
arXiv
Guardado en:
| Autores principales: | Pewinya, Githma, Martins, Carolina, Mariangel, Garcia |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Speciesism in AI: Evaluating Discrimination Against Animals in Large Language Models
por: Jotautaitė, Monika, et al.
Publicado: (2025)
por: Jotautaitė, Monika, et al.
Publicado: (2025)
Evaluation of AI Ethics Tools in Language Models: A Developers' Perspective Case Study
por: Silva, Jhessica, et al.
Publicado: (2025)
por: Silva, Jhessica, et al.
Publicado: (2025)
Generalization in Healthcare AI: Evaluation of a Clinical Large Language Model
por: Rahman, Salman, et al.
Publicado: (2024)
por: Rahman, Salman, et al.
Publicado: (2024)
Evaluating Proactive Risk Awareness of Large Language Models
por: Luo, Xuan, et al.
Publicado: (2026)
por: Luo, Xuan, et al.
Publicado: (2026)
Extrinsic Evaluation of Cultural Competence in Large Language Models
por: Bhatt, Shaily, et al.
Publicado: (2024)
por: Bhatt, Shaily, et al.
Publicado: (2024)
MalAlgoQA: Pedagogical Evaluation of Counterfactual Reasoning in Large Language Models and Implications for AI in Education
por: Liu, Naiming, et al.
Publicado: (2024)
por: Liu, Naiming, et al.
Publicado: (2024)
IDEAlign: Comparing Large Language Models to Human Experts in Open-ended Interpretive Annotations
por: Nam, Hyunji, et al.
Publicado: (2025)
por: Nam, Hyunji, et al.
Publicado: (2025)
Leveraging Large Language Models for Predictive Analysis of Human Misery
por: Seal, Bishanka, et al.
Publicado: (2025)
por: Seal, Bishanka, et al.
Publicado: (2025)
Psychometric Comparability of LLM-Based Digital Twins
por: Zhang, Yufei, et al.
Publicado: (2025)
por: Zhang, Yufei, et al.
Publicado: (2025)
Invisible Filters: Cultural Bias in Hiring Evaluations Using Large Language Models
por: Rao, Pooja S. B., et al.
Publicado: (2025)
por: Rao, Pooja S. B., et al.
Publicado: (2025)
Evaluating open-source Large Language Models for automated fact-checking
por: Fontana, Nicolo', et al.
Publicado: (2025)
por: Fontana, Nicolo', et al.
Publicado: (2025)
Evaluating Large Language Models Against Human Annotators in Latent Content Analysis: Sentiment, Political Leaning, Emotional Intensity, and Sarcasm
por: Bojic, Ljubisa, et al.
Publicado: (2025)
por: Bojic, Ljubisa, et al.
Publicado: (2025)
Evaluating Large Language Models for Detecting Antisemitism
por: Patel, Jay, et al.
Publicado: (2025)
por: Patel, Jay, et al.
Publicado: (2025)
Evaluating Psychological Safety of Large Language Models
por: Li, Xingxuan, et al.
Publicado: (2022)
por: Li, Xingxuan, et al.
Publicado: (2022)
Towards Equitable AI: Detecting Bias in Using Large Language Models for Marketing
por: Yilmaz, Berk, et al.
Publicado: (2025)
por: Yilmaz, Berk, et al.
Publicado: (2025)
JiraiBench: A Bilingual Benchmark for Evaluating Large Language Models' Detection of Human Self-Destructive Behavior Content in Jirai Community
por: Xiao, Yunze, et al.
Publicado: (2025)
por: Xiao, Yunze, et al.
Publicado: (2025)
Cancer-Myth: Evaluating Large Language Models on Patient Questions with False Presuppositions
por: Zhu, Wang Bill, et al.
Publicado: (2025)
por: Zhu, Wang Bill, et al.
Publicado: (2025)
Not All Jokes Land: Evaluating Large Language Models Understanding of Workplace Humor
por: Shafiei, Mohammadamin, et al.
Publicado: (2025)
por: Shafiei, Mohammadamin, et al.
Publicado: (2025)
Leveraging Large Language Models for Actionable Course Evaluation Student Feedback to Lecturers
por: Zhang, Mike, et al.
Publicado: (2024)
por: Zhang, Mike, et al.
Publicado: (2024)
Quantitative Intertextuality from the Digital Humanities Perspective: A Survey
por: Duan, Siyu
Publicado: (2025)
por: Duan, Siyu
Publicado: (2025)
Evaluating Large Language Models in Theory of Mind Tasks
por: Kosinski, Michal
Publicado: (2023)
por: Kosinski, Michal
Publicado: (2023)
Evaluating Large Language Models on Spatial Tasks: A Multi-Task Benchmarking Study
por: Xu, Liuchang, et al.
Publicado: (2024)
por: Xu, Liuchang, et al.
Publicado: (2024)
Multi-turn Evaluation of Anthropomorphic Behaviours in Large Language Models
por: Ibrahim, Lujain, et al.
Publicado: (2025)
por: Ibrahim, Lujain, et al.
Publicado: (2025)
An Exploration of Higher Education Course Evaluation by Large Language Models
por: Yuan, Bo, et al.
Publicado: (2024)
por: Yuan, Bo, et al.
Publicado: (2024)
AI Safety in Generative AI Large Language Models: A Survey
por: Chua, Jaymari, et al.
Publicado: (2024)
por: Chua, Jaymari, et al.
Publicado: (2024)
Better Call GPT, Comparing Large Language Models Against Lawyers
por: Martin, Lauren, et al.
Publicado: (2024)
por: Martin, Lauren, et al.
Publicado: (2024)
The World of Generative AI: Deepfakes and Large Language Models
por: Mitra, Alakananda, et al.
Publicado: (2024)
por: Mitra, Alakananda, et al.
Publicado: (2024)
Bias and Volatility: A Statistical Framework for Evaluating Large Language Model's Stereotypes and the Associated Generation Inconsistency
por: Liu, Yiran, et al.
Publicado: (2024)
por: Liu, Yiran, et al.
Publicado: (2024)
LangLingual: A Personalised, Exercise-oriented English Language Learning Tool Leveraging Large Language Models
por: Gupta, Sammriddh, et al.
Publicado: (2025)
por: Gupta, Sammriddh, et al.
Publicado: (2025)
ELMES: An Automated Framework for Evaluating Large Language Models in Educational Scenarios
por: Wei, Shou'ang, et al.
Publicado: (2025)
por: Wei, Shou'ang, et al.
Publicado: (2025)
How Far Are LLMs from Believable AI? A Benchmark for Evaluating the Believability of Human Behavior Simulation
por: Xiao, Yang, et al.
Publicado: (2023)
por: Xiao, Yang, et al.
Publicado: (2023)
AI-VERDE: A Gateway for Egalitarian Access to Large Language Model-Based Resources For Educational Institutions
por: Mithun, Paul, et al.
Publicado: (2025)
por: Mithun, Paul, et al.
Publicado: (2025)
Dual Use Concerns of Generative AI and Large Language Models
por: Grinbaum, Alexei, et al.
Publicado: (2023)
por: Grinbaum, Alexei, et al.
Publicado: (2023)
A Systematic Review on the Evaluation of Large Language Models in Theory of Mind Tasks
por: Sarıtaş, Karahan, et al.
Publicado: (2025)
por: Sarıtaş, Karahan, et al.
Publicado: (2025)
Evaluation Awareness in Language Models Has Limited Effect on Behaviour
por: Knecht, Amelie, et al.
Publicado: (2026)
por: Knecht, Amelie, et al.
Publicado: (2026)
Secure On-Premise Deployment of Open-Weights Large Language Models in Radiology: An Isolation-First Architecture with Prospective Pilot Evaluation
por: Nowak, Sebastian, et al.
Publicado: (2026)
por: Nowak, Sebastian, et al.
Publicado: (2026)
A Comparative Evaluation of Structural Topic Models and BERTopic for Short, Open-Ended Survey Responses
por: Jiang, Yan, et al.
Publicado: (2026)
por: Jiang, Yan, et al.
Publicado: (2026)
CBT-Bench: Evaluating Large Language Models on Assisting Cognitive Behavior Therapy
por: Zhang, Mian, et al.
Publicado: (2024)
por: Zhang, Mian, et al.
Publicado: (2024)
Evaluation of Large Language Models in Legal Applications: Challenges, Methods, and Future Directions
por: Hu, Yiran, et al.
Publicado: (2026)
por: Hu, Yiran, et al.
Publicado: (2026)
Assessing the Impact of Conspiracy Theories Using Large Language Models
por: Jiang, Bohan, et al.
Publicado: (2024)
por: Jiang, Bohan, et al.
Publicado: (2024)
Ejemplares similares
-
Speciesism in AI: Evaluating Discrimination Against Animals in Large Language Models
por: Jotautaitė, Monika, et al.
Publicado: (2025) -
Evaluation of AI Ethics Tools in Language Models: A Developers' Perspective Case Study
por: Silva, Jhessica, et al.
Publicado: (2025) -
Generalization in Healthcare AI: Evaluation of a Clinical Large Language Model
por: Rahman, Salman, et al.
Publicado: (2024) -
Evaluating Proactive Risk Awareness of Large Language Models
por: Luo, Xuan, et al.
Publicado: (2026) -
Extrinsic Evaluation of Cultural Competence in Large Language Models
por: Bhatt, Shaily, et al.
Publicado: (2024)