Skip to content
Descubridor Institucional UMAR
Inicio
Búsqueda avanzada
Explorar
Inicio
Búsqueda avanzada
Explorar
Login
Language
English
Deutsch
Español
Français
Italiano
All Fields
Title
Author
Subject
Call Number
ISBN/ISSN
Tag
Find
Advanced
The Benchmark Illusion: Why Current AI Evaluations Cannot Detect Structural Confabulation
The Benchmark Illusion: Why Current AI Evaluations Cannot Detect Structural Confabulation
Fuente:
Zenodo
Saved in:
Bibliographic Details
Main Author:
Devin, Andrew James
Format:
Recurso digital
Published:
Zenodo
2026
Subjects:
AI evaluation, AI Benchmarks, Structural confabulation, Verification capability, Trustworthiness in AI, Transformer architectures, AI governance, Category error in AI evaluation, Epistemic verification, KEV framework, Large language models
Online Access:
Acceder al recurso
Tags:
Add Tag
No Tags, Be the first to tag this record!
Cite this
Text this
Email this
Print
Export Record
Export to RefWorks
Export to EndNoteWeb
Export to EndNote
Save to List
Permanent link
Holdings
Description
Comments
Similar Items
Staff View
Internet
https://doi.org/10.5281/zenodo.18223209
Similar Items
AGI Certification Framework: A Multi-Dimensional Evaluation Standard for Measuring AI Understanding
by: Head, Hank
Published: (2026)
Twenty Years of Personality Computing: Threats, Challenges and Future Directions
by: Celli, Fabio, et al.
Published: (2026)
Explanations for Trustworthy AI in Critical Infrastructure: A Case from Wastewater Treatment in Norway
by: Følstad, Asbjørn, et al.
Published: (2025)
Human-Final Decision Authority in Artificial Intelligence: A Deterministic and Auditable Governance Architecture
by: KALAFATOGLU, YASIN
Published: (2026)
Architecting Accountability - An Epistemic Blueprint for Enforcing the EU AI Act
by: Apro, William Zoltan
Published: (2026)