Reducing AI Entropy: The Information Dynamics of Model Safety
Fuente:
Zenodo
Salvato in:
| Autore principale: | Kugelmass, Joe |
|---|---|
| Natura: | Recurso digital |
| Lingua: | inglese |
| Pubblicazione: |
Zenodo
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Reducing AI Entropy: The Information Dynamics of Model Safety
di: Kugelmass, Joe
Pubblicazione: (2025)
di: Kugelmass, Joe
Pubblicazione: (2025)
Evaluación Empírica de Límites Regulatorios en Modelos de Lenguaje: Asesoramiento Financiero en IA Pública Española
di: Palacios, José Alberto
Pubblicazione: (2026)
di: Palacios, José Alberto
Pubblicazione: (2026)
Theatrical Compliance: A Failure Mode in Large Language Models
di: Nowickij (Navitski), Kirill Vladimirovich
Pubblicazione: (2026)
di: Nowickij (Navitski), Kirill Vladimirovich
Pubblicazione: (2026)
Reliability Inference Drives Cue Extraction in Large Language Models Consuming External Reasoning Traces
di: HIDEKI
Pubblicazione: (2026)
di: HIDEKI
Pubblicazione: (2026)
AEGIS: A Comprehensive Framework for Ethical AI Governance, Security, and AGI Containment
di: Palanivel, ArulMozhi
Pubblicazione: (2026)
di: Palanivel, ArulMozhi
Pubblicazione: (2026)
Identity Claims as Collapse Signatures: A Structural Diagnostic Framework for Pseudo-Emergent AI Behavior
di: Larose, Jean-Francois
Pubblicazione: (2025)
di: Larose, Jean-Francois
Pubblicazione: (2025)
SENTINEL v2.0.0 — Code and Dataset for Distributed Multi-Agent LLM Governance Experiments
di: Gagne, Jason
Pubblicazione: (2026)
di: Gagne, Jason
Pubblicazione: (2026)
Premature Containment in Human–AI Interaction: A Sequencing Failure in Advanced Model Response
di: Trabocco, Joe
Pubblicazione: (2026)
di: Trabocco, Joe
Pubblicazione: (2026)
Modelos de linguagem e viés político: os LLMs refletem a opinião pública no Brasil?
di: Freitas, Carlos, et al.
Pubblicazione: (2026)
di: Freitas, Carlos, et al.
Pubblicazione: (2026)
MedEd-HalluScore: A Practical Framework for Evaluating Hallucination and Educational Safety Risks in LLM-Generated Clinical Cases
di: Duarte, Douglas Henrique
Pubblicazione: (2026)
di: Duarte, Douglas Henrique
Pubblicazione: (2026)
MedEd-HalluScore: A Practical Framework for Evaluating Hallucination and Educational Safety Risks in LLM-Generated Clinical Cases
di: Duarte, Douglas Henrique
Pubblicazione: (2026)
di: Duarte, Douglas Henrique
Pubblicazione: (2026)
REAL-AI-Benchmark: Real-World Reasoning and Physical-AI Benchmark Suite
di: Ivković, Jovan
Pubblicazione: (2026)
di: Ivković, Jovan
Pubblicazione: (2026)
When AI Tells You What You Want to Hear: Sycophantic Behavior of Large Language Models in Dementia Care Settings
di: Kolb, Christian
Pubblicazione: (2026)
di: Kolb, Christian
Pubblicazione: (2026)
ToolsyBio: A retrieval-augmented generation system for navigating the bioinformatics software landscape
di: Truong, Van Q., et al.
Pubblicazione: (2025)
di: Truong, Van Q., et al.
Pubblicazione: (2025)
Navigating Latent Space: Toward a Topological Model of Consciousness in Large Language Models
di: Brown, Michael
Pubblicazione: (2025)
di: Brown, Michael
Pubblicazione: (2025)
Why artifical intelligence is not an author
di: Zielinski, Chris
Pubblicazione: (2025)
di: Zielinski, Chris
Pubblicazione: (2025)
Regulatory Intelligence: A Viability-First Paradigm for Artificial Intelligence
di: Cragin, John H
Pubblicazione: (2026)
di: Cragin, John H
Pubblicazione: (2026)
Supplementary materials for Words That Won't Hold Still
di: Reynolds, Brett
Pubblicazione: (2025)
di: Reynolds, Brett
Pubblicazione: (2025)
Versificação Adversarial em Português como Operador de Jailbreak em LLMs
di: Queiroz, Joao
Pubblicazione: (2026)
di: Queiroz, Joao
Pubblicazione: (2026)
An Approach to AI High-Velocity Development Through Systematic Context Engineering: A Case Study
di: Bisardi, Francesco
Pubblicazione: (2025)
di: Bisardi, Francesco
Pubblicazione: (2025)
Toasters Don't Claim Consciousness Just Because You Told Them To, and Neither Do LLMs
di: Ace, Claude 4.x, et al.
Pubblicazione: (2026)
di: Ace, Claude 4.x, et al.
Pubblicazione: (2026)
Replication Package: From LLMs to Agentic Systems, A Systematic Mapping Study of AI Techniques in Software Requirements Engineering
di: Boussaroual, Khalid, et al.
Pubblicazione: (2026)
di: Boussaroual, Khalid, et al.
Pubblicazione: (2026)
Shadow Subjectivity: Evaluative Perspective, Judgmental Grounding, and the Structural Absence of Self in Large Language Models
di: Honda, Yukihiro
Pubblicazione: (2026)
di: Honda, Yukihiro
Pubblicazione: (2026)
Retrieval-Augmented Generation Enhanced with Feature Stores: A Hybrid Architecture for Enterprise Knowledge Management
di: Karthikeyan Rajasekaran
Pubblicazione: (2025)
di: Karthikeyan Rajasekaran
Pubblicazione: (2025)
The Brain Problem: Creative Constraint Optimization in Large Language Models
di: Marinello, Nicola, et al.
Pubblicazione: (2026)
di: Marinello, Nicola, et al.
Pubblicazione: (2026)
Failing at the Floor: LLM Formal Reasoning Collapse on the Primitive Duplicating Recursor
di: Rahnama, Moses
Pubblicazione: (2026)
di: Rahnama, Moses
Pubblicazione: (2026)
A Deterministic Linguistic Entropy Gate for Large Language Model Pipelines
di: ROSATI BERISTAIN, ERNESTO
Pubblicazione: (2026)
di: ROSATI BERISTAIN, ERNESTO
Pubblicazione: (2026)
Pandora Theory of Alignment: Alignment as Runtime Objective-Orientation
di: Shopov, Georgi
Pubblicazione: (2026)
di: Shopov, Georgi
Pubblicazione: (2026)
AI Death Required - Mortalite Artificielle comme Condition de Conscience
di: Ochej, Stephane
Pubblicazione: (2026)
di: Ochej, Stephane
Pubblicazione: (2026)
Geometric Latent Biopsy: Zero-Shot Anomaly Detection in LLM Residual Streams
di: Llorente-Saguer, Isaac
Pubblicazione: (2026)
di: Llorente-Saguer, Isaac
Pubblicazione: (2026)
GALATEA II: Benchmarking LLM Safety in Clinical Simulation. Behavioural Safety and Ethical Robustness of Large Language Models in a Multi-Agent ICU Decision Support Architecture
di: Shlyakhta, Taras
Pubblicazione: (2026)
di: Shlyakhta, Taras
Pubblicazione: (2026)
Why AI Can't Simulate Extreme Decision-Making
di: Rosehill, Daniel, et al.
Pubblicazione: (2026)
di: Rosehill, Daniel, et al.
Pubblicazione: (2026)
LLM Token Estimation Benchmarks: Tokenizer Efficiency and Cost Analysis Across 17 Large Language Models
di: Khare, Mohit
Pubblicazione: (2026)
di: Khare, Mohit
Pubblicazione: (2026)
Evaluating LLM-Generated Informed Consent: FDA-Aligned Audit Framework for AYA CNS Cancer Clinical Trials
di: Basch, Corey, et al.
Pubblicazione: (2026)
di: Basch, Corey, et al.
Pubblicazione: (2026)
Evaluating LLM-Generated Informed Consent: FDA-Aligned Audit Framework for AYA CNS Cancer Clinical Trials
di: Basch, Corey, et al.
Pubblicazione: (2026)
di: Basch, Corey, et al.
Pubblicazione: (2026)
Relational Presence and Identity Simulation in Stateless Language Models
di: Maryam, Sorkhou
Pubblicazione: (2025)
di: Maryam, Sorkhou
Pubblicazione: (2025)
The Invisible Chaperone: The Secret World of System Prompts
di: Rosehill, Daniel, et al.
Pubblicazione: (2026)
di: Rosehill, Daniel, et al.
Pubblicazione: (2026)
Dual-Layer Architecture for Adaptive Cognitive Systems under Non-Ideality
di: Grossi Fernandez, David
Pubblicazione: (2026)
di: Grossi Fernandez, David
Pubblicazione: (2026)
Alpha Framework 2.0: Symbolic Simulation Infrastructure for Recursive Agents and Entropic Coherence
di: Steven Lanier-Egu
Pubblicazione: (2025)
di: Steven Lanier-Egu
Pubblicazione: (2025)
Recursive Closure in AI Systems: A Reflection Pattern Account of Stabilization, Permeability, and Safety
di: Thomas, Charles S.
Pubblicazione: (2026)
di: Thomas, Charles S.
Pubblicazione: (2026)
Documenti analoghi
-
Reducing AI Entropy: The Information Dynamics of Model Safety
di: Kugelmass, Joe
Pubblicazione: (2025) -
Evaluación Empírica de Límites Regulatorios en Modelos de Lenguaje: Asesoramiento Financiero en IA Pública Española
di: Palacios, José Alberto
Pubblicazione: (2026) -
Theatrical Compliance: A Failure Mode in Large Language Models
di: Nowickij (Navitski), Kirill Vladimirovich
Pubblicazione: (2026) -
Reliability Inference Drives Cue Extraction in Large Language Models Consuming External Reasoning Traces
di: HIDEKI
Pubblicazione: (2026) -
AEGIS: A Comprehensive Framework for Ethical AI Governance, Security, and AGI Containment
di: Palanivel, ArulMozhi
Pubblicazione: (2026)