Tell me the truth: A system to measure the trustworthiness of Large Language Models
Fuente:
arXiv
Enregistré dans:
| Auteur principal: | Lipizzi, Carlo |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Reducing Large Language Model Bias with Emphasis on 'Restricted Industries': Automated Dataset Augmentation and Prejudice Quantification
par: Mondal, Devam, et autres
Publié: (2024)
par: Mondal, Devam, et autres
Publié: (2024)
Large Language Models for Education: A Survey
par: Xu, Hanyi, et autres
Publié: (2024)
par: Xu, Hanyi, et autres
Publié: (2024)
Large Language Models for Medicine: A Survey
par: Zheng, Yanxin, et autres
Publié: (2024)
par: Zheng, Yanxin, et autres
Publié: (2024)
On the Creativity of Large Language Models
par: Franceschelli, Giorgio, et autres
Publié: (2023)
par: Franceschelli, Giorgio, et autres
Publié: (2023)
Show, Don't Tell: Uncovering Implicit Character Portrayal using LLMs
par: Jaipersaud, Brandon, et autres
Publié: (2024)
par: Jaipersaud, Brandon, et autres
Publié: (2024)
Regulating Large Language Models: A Roundtable Report
par: Nicholas, Gabriel, et autres
Publié: (2024)
par: Nicholas, Gabriel, et autres
Publié: (2024)
A Systematic Analysis of Biases in Large Language Models
par: Zhang, Xulang, et autres
Publié: (2025)
par: Zhang, Xulang, et autres
Publié: (2025)
Cross-Language Bias Examination in Large Language Models
par: Liang, Yuxuan, et autres
Publié: (2025)
par: Liang, Yuxuan, et autres
Publié: (2025)
Large Language Model for Mental Health: A Systematic Review
par: Guo, Zhijun, et autres
Publié: (2024)
par: Guo, Zhijun, et autres
Publié: (2024)
PRISM: A Methodology for Auditing Biases in Large Language Models
par: Azzopardi, Leif, et autres
Publié: (2024)
par: Azzopardi, Leif, et autres
Publié: (2024)
Large Language Models in Politics and Democracy: A Comprehensive Survey
par: Aoki, Goshi
Publié: (2024)
par: Aoki, Goshi
Publié: (2024)
A Comprehensive Survey on the Trustworthiness of Large Language Models in Healthcare
par: Aljohani, Manar, et autres
Publié: (2025)
par: Aljohani, Manar, et autres
Publié: (2025)
Large Legal Fictions: Profiling Legal Hallucinations in Large Language Models
par: Dahl, Matthew, et autres
Publié: (2024)
par: Dahl, Matthew, et autres
Publié: (2024)
Open-Ended Wargames with Large Language Models
par: Hogan, Daniel P., et autres
Publié: (2024)
par: Hogan, Daniel P., et autres
Publié: (2024)
Large Language Models as Misleading Assistants in Conversation
par: Hou, Betty Li, et autres
Publié: (2024)
par: Hou, Betty Li, et autres
Publié: (2024)
Are Large Language Models Good Essay Graders?
par: Kundu, Anindita, et autres
Publié: (2024)
par: Kundu, Anindita, et autres
Publié: (2024)
Evaluating Large Language Models for Detecting Antisemitism
par: Patel, Jay, et autres
Publié: (2025)
par: Patel, Jay, et autres
Publié: (2025)
Anticipating Innovation Using Large Language Models
par: Fenoaltea, Enrico Maria, et autres
Publié: (2026)
par: Fenoaltea, Enrico Maria, et autres
Publié: (2026)
How Large Language Models are Designed to Hallucinate
par: Ackermann, Richard, et autres
Publié: (2025)
par: Ackermann, Richard, et autres
Publié: (2025)
Evaluating Psychological Safety of Large Language Models
par: Li, Xingxuan, et autres
Publié: (2022)
par: Li, Xingxuan, et autres
Publié: (2022)
PersLLM: A Personified Training Approach for Large Language Models
par: Zeng, Zheni, et autres
Publié: (2024)
par: Zeng, Zheni, et autres
Publié: (2024)
Large Language Models (LLMs) as Agents for Augmented Democracy
par: Gudiño-Rosero, Jairo, et autres
Publié: (2024)
par: Gudiño-Rosero, Jairo, et autres
Publié: (2024)
UrbanGPT: Spatio-Temporal Large Language Models
par: Li, Zhonghang, et autres
Publié: (2024)
par: Li, Zhonghang, et autres
Publié: (2024)
Dual Traits in Probabilistic Reasoning of Large Language Models
par: Li, Shenxiong, et autres
Publié: (2024)
par: Li, Shenxiong, et autres
Publié: (2024)
Large Language Models as symbolic DNA of cultural dynamics
par: Pourdavood, Parham, et autres
Publié: (2025)
par: Pourdavood, Parham, et autres
Publié: (2025)
The Human Condition as Reflected in Contemporary Large Language Models
par: Neuman, W. Russell
Publié: (2026)
par: Neuman, W. Russell
Publié: (2026)
Semantic Consistency for Assuring Reliability of Large Language Models
par: Raj, Harsh, et autres
Publié: (2023)
par: Raj, Harsh, et autres
Publié: (2023)
Navigating the Cultural Kaleidoscope: A Hitchhiker's Guide to Sensitivity in Large Language Models
par: Banerjee, Somnath, et autres
Publié: (2024)
par: Banerjee, Somnath, et autres
Publié: (2024)
Large Language Models are Zero-Shot Next Location Predictors
par: Beneduce, Ciro, et autres
Publié: (2024)
par: Beneduce, Ciro, et autres
Publié: (2024)
AuditWen:An Open-Source Large Language Model for Audit
par: Huang, Jiajia, et autres
Publié: (2024)
par: Huang, Jiajia, et autres
Publié: (2024)
An Exploration of Higher Education Course Evaluation by Large Language Models
par: Yuan, Bo, et autres
Publié: (2024)
par: Yuan, Bo, et autres
Publié: (2024)
Gender Bias in Machine Translation and The Era of Large Language Models
par: Vanmassenhove, Eva
Publié: (2024)
par: Vanmassenhove, Eva
Publié: (2024)
AccessEval: Benchmarking Disability Bias in Large Language Models
par: Panda, Srikant, et autres
Publié: (2025)
par: Panda, Srikant, et autres
Publié: (2025)
DarkBench: Benchmarking Dark Patterns in Large Language Models
par: Kran, Esben, et autres
Publié: (2025)
par: Kran, Esben, et autres
Publié: (2025)
Classroom AI: Large Language Models as Grade-Specific Teachers
par: Oh, Jio, et autres
Publié: (2026)
par: Oh, Jio, et autres
Publié: (2026)
Dr.Academy: A Benchmark for Evaluating Questioning Capability in Education for Large Language Models
par: Chen, Yuyan, et autres
Publié: (2024)
par: Chen, Yuyan, et autres
Publié: (2024)
Psychological Assessments with Large Language Models: A Privacy-Focused and Cost-Effective Approach
par: Blanco-Cuaresma, Sergi
Publié: (2024)
par: Blanco-Cuaresma, Sergi
Publié: (2024)
JobFair: A Framework for Benchmarking Gender Hiring Bias in Large Language Models
par: Wang, Ze, et autres
Publié: (2024)
par: Wang, Ze, et autres
Publié: (2024)
Aligning Large Language Models with Healthcare Stakeholders: A Pathway to Trustworthy AI Integration
par: Ding, Kexin, et autres
Publié: (2025)
par: Ding, Kexin, et autres
Publié: (2025)
Large Language Models Leverage External Knowledge to Extend Clinical Insight Beyond Language Boundaries
par: Wu, Jiageng, et autres
Publié: (2023)
par: Wu, Jiageng, et autres
Publié: (2023)
Documents similaires
-
Reducing Large Language Model Bias with Emphasis on 'Restricted Industries': Automated Dataset Augmentation and Prejudice Quantification
par: Mondal, Devam, et autres
Publié: (2024) -
Large Language Models for Education: A Survey
par: Xu, Hanyi, et autres
Publié: (2024) -
Large Language Models for Medicine: A Survey
par: Zheng, Yanxin, et autres
Publié: (2024) -
On the Creativity of Large Language Models
par: Franceschelli, Giorgio, et autres
Publié: (2023) -
Show, Don't Tell: Uncovering Implicit Character Portrayal using LLMs
par: Jaipersaud, Brandon, et autres
Publié: (2024)