Beyond the Black Box: A Cognitive Architecture for Explainable and Aligned AI
Fuente:
arXiv
Salvato in:
| Autore principale: | Keyi, Hu |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Locally Pareto-Optimal Interpretations for Black-Box Machine Learning Models
di: Joshi, Aniruddha, et al.
Pubblicazione: (2025)
di: Joshi, Aniruddha, et al.
Pubblicazione: (2025)
Graph-Native Cognitive Memory for AI Agents: Formal Belief Revision Semantics for Versioned Memory Architectures
di: Park, Young Bin
Pubblicazione: (2026)
di: Park, Young Bin
Pubblicazione: (2026)
Ethical Hyper-Velocity (EHV): A Hardware-Rooted Zero-Trust Runtime Enforcement Architecture for Agentic AI Systems
di: Sharma, Riddhi Mohan
Pubblicazione: (2026)
di: Sharma, Riddhi Mohan
Pubblicazione: (2026)
Explainability-Driven Quality Assessment for Rule-Based Systems
di: Seneviratne, Oshani, et al.
Pubblicazione: (2025)
di: Seneviratne, Oshani, et al.
Pubblicazione: (2025)
An Information-Flow Perspective on Explainability Requirements: Specification and Verification
di: Finkbeiner, Bernd, et al.
Pubblicazione: (2025)
di: Finkbeiner, Bernd, et al.
Pubblicazione: (2025)
A Computationally Grounded Framework for Cognitive Attitudes (extended version)
di: de Lima, Tiago, et al.
Pubblicazione: (2024)
di: de Lima, Tiago, et al.
Pubblicazione: (2024)
Data2Concept2Text: An Explainable Multilingual Framework for Data Analysis Narration
di: Bertini, Flavio, et al.
Pubblicazione: (2025)
di: Bertini, Flavio, et al.
Pubblicazione: (2025)
Categorical Construction of Logically Verifiable Neural Architectures
di: Nye, Logan
Pubblicazione: (2025)
di: Nye, Logan
Pubblicazione: (2025)
Approximate SMT Counting Beyond Discrete Domains
di: Shaw, Arijit, et al.
Pubblicazione: (2025)
di: Shaw, Arijit, et al.
Pubblicazione: (2025)
Modal Logic for Stratified Becoming: Actualization Beyond Possible Worlds
di: Nepvou, Alexandre Le
Pubblicazione: (2025)
di: Nepvou, Alexandre Le
Pubblicazione: (2025)
Explainability by design: an experimental analysis of the legal coding process
di: Cristani, Matteo, et al.
Pubblicazione: (2025)
di: Cristani, Matteo, et al.
Pubblicazione: (2025)
Middle Architecture Criteria
di: Beverley, John, et al.
Pubblicazione: (2024)
di: Beverley, John, et al.
Pubblicazione: (2024)
Dual Box Embeddings for the Description Logic EL++
di: Jackermeier, Mathias, et al.
Pubblicazione: (2023)
di: Jackermeier, Mathias, et al.
Pubblicazione: (2023)
AI Space Physics: Constitutive boundary semantics for open AI institutions
di: Romanchuk, Oleg, et al.
Pubblicazione: (2026)
di: Romanchuk, Oleg, et al.
Pubblicazione: (2026)
Reasoning in Neurosymbolic AI
di: Tran, Son, et al.
Pubblicazione: (2025)
di: Tran, Son, et al.
Pubblicazione: (2025)
On logic and generative AI
di: Gurevich, Yuri, et al.
Pubblicazione: (2024)
di: Gurevich, Yuri, et al.
Pubblicazione: (2024)
The Epistemic Asymmetry of Consciousness Self-Reports: A Formal Analysis of AI Consciousness Denial
di: Kim, Chang-Eop
Pubblicazione: (2024)
di: Kim, Chang-Eop
Pubblicazione: (2024)
The STAR-XAI Protocol: A Framework for Inducing and Verifying Agency, Reasoning, and Reliability in AI Agents
di: Guasch, Antoni, et al.
Pubblicazione: (2025)
di: Guasch, Antoni, et al.
Pubblicazione: (2025)
Enhancing Formal Theorem Proving: A Comprehensive Dataset for Training AI Models on Coq Code
di: Florath, Andreas
Pubblicazione: (2024)
di: Florath, Andreas
Pubblicazione: (2024)
Aligning with Logic: Measuring, Evaluating and Improving Logical Preference Consistency in Large Language Models
di: Liu, Yinhong, et al.
Pubblicazione: (2024)
di: Liu, Yinhong, et al.
Pubblicazione: (2024)
A Gradient-Optimized TSK Fuzzy Framework for Explainable Phishing Detection
di: Pentapalli, Lohith Srikanth, et al.
Pubblicazione: (2025)
di: Pentapalli, Lohith Srikanth, et al.
Pubblicazione: (2025)
First Order Logic with Fuzzy Semantics for Describing and Recognizing Nerves in Medical Images
di: Bloch, Isabelle, et al.
Pubblicazione: (2025)
di: Bloch, Isabelle, et al.
Pubblicazione: (2025)
Policy-Adaptable Methods For Resolving Normative Conflicts Through Argumentation and Graph Colouring
di: Joyce, Johnny
Pubblicazione: (2025)
di: Joyce, Johnny
Pubblicazione: (2025)
Dynamic Logic of Trust-Based Beliefs
di: Jiang, Junli, et al.
Pubblicazione: (2025)
di: Jiang, Junli, et al.
Pubblicazione: (2025)
An Automated Theorem Generator with Theoretical Foundation Based on Rectangular Standard Contradiction
di: Xu, Yang, et al.
Pubblicazione: (2025)
di: Xu, Yang, et al.
Pubblicazione: (2025)
Abductive Reasoning in a Paraconsistent Framework
di: Bienvenu, Meghyn, et al.
Pubblicazione: (2024)
di: Bienvenu, Meghyn, et al.
Pubblicazione: (2024)
The logic of KM belief update is contained in the logic of AGM belief revision
di: Bonanno, Giacomo
Pubblicazione: (2026)
di: Bonanno, Giacomo
Pubblicazione: (2026)
Similarity-based analogical proportions
di: Antić, Christian
Pubblicazione: (2024)
di: Antić, Christian
Pubblicazione: (2024)
Neuro-symbolic AI for Predictive Maintenance (PdM) -- review and recommendations
di: Hamilton, Kyle, et al.
Pubblicazione: (2026)
di: Hamilton, Kyle, et al.
Pubblicazione: (2026)
Comparing Neural Network Encodings for Logic-based Explainability
di: Carvalho, Levi Cordeiro, et al.
Pubblicazione: (2025)
di: Carvalho, Levi Cordeiro, et al.
Pubblicazione: (2025)
Learning Explainable and Better Performing Representations of POMDP Strategies
di: Bork, Alexander, et al.
Pubblicazione: (2024)
di: Bork, Alexander, et al.
Pubblicazione: (2024)
Neuro-Symbolic Strong-AI Robots with Closed Knowledge Assumption: Learning and Deductions
di: Majkic, Zoran
Pubblicazione: (2026)
di: Majkic, Zoran
Pubblicazione: (2026)
Cloud Kitchen: Using Planning-based Composite AI to Optimize Food Delivery Processes
di: Švancár, Slavomír, et al.
Pubblicazione: (2024)
di: Švancár, Slavomír, et al.
Pubblicazione: (2024)
Counting Worlds Branching Time Semantics for post-hoc Bias Mitigation in generative AI
di: Buda, Alessandro G., et al.
Pubblicazione: (2026)
di: Buda, Alessandro G., et al.
Pubblicazione: (2026)
An XAI View on Explainable ASP: Methods, Systems, and Perspectives
di: Eiter, Thomas, et al.
Pubblicazione: (2026)
di: Eiter, Thomas, et al.
Pubblicazione: (2026)
Building Trustworthy AI by Addressing its 16+2 Desiderata with Goal-Directed Commonsense Reasoning
di: Tudor, Alexis R., et al.
Pubblicazione: (2025)
di: Tudor, Alexis R., et al.
Pubblicazione: (2025)
Beyond Theorem Proving: Formulation, Framework and Benchmark for Formal Problem-Solving
di: Liu, Qi, et al.
Pubblicazione: (2025)
di: Liu, Qi, et al.
Pubblicazione: (2025)
StepProof: Step-by-step verification of natural language mathematical proofs
di: Hu, Xiaolin, et al.
Pubblicazione: (2025)
di: Hu, Xiaolin, et al.
Pubblicazione: (2025)
Learning First-Order Rules with Relational Path Contrast for Inductive Relation Reasoning
di: Pan, Yudai, et al.
Pubblicazione: (2021)
di: Pan, Yudai, et al.
Pubblicazione: (2021)
Generative Logic: A New Computer Architecture for Deterministic Reasoning and Knowledge Generation
di: Sergeev, Nikolai
Pubblicazione: (2025)
di: Sergeev, Nikolai
Pubblicazione: (2025)
Documenti analoghi
-
Locally Pareto-Optimal Interpretations for Black-Box Machine Learning Models
di: Joshi, Aniruddha, et al.
Pubblicazione: (2025) -
Graph-Native Cognitive Memory for AI Agents: Formal Belief Revision Semantics for Versioned Memory Architectures
di: Park, Young Bin
Pubblicazione: (2026) -
Ethical Hyper-Velocity (EHV): A Hardware-Rooted Zero-Trust Runtime Enforcement Architecture for Agentic AI Systems
di: Sharma, Riddhi Mohan
Pubblicazione: (2026) -
Explainability-Driven Quality Assessment for Rule-Based Systems
di: Seneviratne, Oshani, et al.
Pubblicazione: (2025) -
An Information-Flow Perspective on Explainability Requirements: Specification and Verification
di: Finkbeiner, Bernd, et al.
Pubblicazione: (2025)