Meta-Corrigibility: Architectures for Self-Modifying AI with Enduring Human Oversight
Fuente:
Zenodo
Guardado en:
| Autores principales: | Revista, Zen, IA, 10 |
|---|---|
| Formato: | Recurso digital |
| Publicado: |
Zenodo
2025
|
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Meta-Calculus: Learning Differentiable Optimization Rules for AI
por: Revista, Zen, et al.
Publicado: (2025)
por: Revista, Zen, et al.
Publicado: (2025)
Beyond Benchmarks: The Qualitative Imperative in Human-Centered AI Evaluation
por: Revista, Zen, et al.
Publicado: (2025)
por: Revista, Zen, et al.
Publicado: (2025)
The AI Alignment Loop: Iterative Self-Correction for Robust and Generalizable Models
por: Revista, Zen, et al.
Publicado: (2025)
por: Revista, Zen, et al.
Publicado: (2025)
Emergent Goal Concordance: Architecting Self-Correcting AI Alignment Systems
por: Revista, Zen, et al.
Publicado: (2025)
por: Revista, Zen, et al.
Publicado: (2025)
Meta-SARSA: Learning Adaptive On-Policy Exploration Strategies
por: Revista, Zen, et al.
Publicado: (2025)
por: Revista, Zen, et al.
Publicado: (2025)
Bridging Locality and Globality: Hierarchical Transformer Architectures for Infinite Context
por: Revista, Zen, et al.
Publicado: (2025)
por: Revista, Zen, et al.
Publicado: (2025)
Unveiling AI Decision-Making: A Comprehensive Framework for Interpretable Methods and Explainable AI
por: Revista, Zen, et al.
Publicado: (2025)
por: Revista, Zen, et al.
Publicado: (2025)
Co-evolving Policies and Values for Generalizable and Aligned AI
por: Revista, Zen, et al.
Publicado: (2025)
por: Revista, Zen, et al.
Publicado: (2025)
Harmonizing Heterogeneity: Unified Embedding Spaces for Generalist AI
por: Revista, Zen, et al.
Publicado: (2025)
por: Revista, Zen, et al.
Publicado: (2025)
Gradient Manifolds: Navigating Complex Loss Landscapes for Enhanced AI Generalization
por: Revista, Zen, et al.
Publicado: (2025)
por: Revista, Zen, et al.
Publicado: (2025)
Data Quality Cascades in AI: Characterizing, Mitigating, and Preventing Error Propagation
por: Revista, Zen, et al.
Publicado: (2025)
por: Revista, Zen, et al.
Publicado: (2025)
Normative Engineering of AI: Leveraging Inner Product Geometry for Robustness and Alignment
por: Revista, Zen, et al.
Publicado: (2025)
por: Revista, Zen, et al.
Publicado: (2025)
Intelligent Vector Databases: A Self-Optimizing Framework for Context-Aware Semantic Retrieval
por: Revista, Zen, et al.
Publicado: (2025)
por: Revista, Zen, et al.
Publicado: (2025)
Unmasking the Trojan Horse: Provable Detection and Mitigation of Deceptive Alignment in AI Systems
por: Revista, Zen, et al.
Publicado: (2025)
por: Revista, Zen, et al.
Publicado: (2025)
AI's Achilles Heel: The Critical Role of Data Validation in Robust and Trustworthy Systems
por: Revista, Zen, et al.
Publicado: (2025)
por: Revista, Zen, et al.
Publicado: (2025)
AI-Powered Data Cleaning: Revolutionizing Data Quality and Trust Through Generative Models
por: Revista, Zen, et al.
Publicado: (2025)
por: Revista, Zen, et al.
Publicado: (2025)
AI Training Observability: A Comprehensive Framework for Real-Time Monitoring, Diagnosis, and Optimization
por: Revista, Zen, et al.
Publicado: (2025)
por: Revista, Zen, et al.
Publicado: (2025)
A Unified Performance-Cost-Efficiency Model for Large-Scale AI Training on GPU and TPU Accelerators
por: Revista, Zen, et al.
Publicado: (2025)
por: Revista, Zen, et al.
Publicado: (2025)
Adaptive Information Granularity: A Unified Learning Framework for Sparse and Dense Representations
por: Revista, Zen, et al.
Publicado: (2025)
por: Revista, Zen, et al.
Publicado: (2025)
Beyond Rectification: Reassessing Activation Function Geometry for Enhanced Neural Network Performance
por: Revista, Zen, et al.
Publicado: (2025)
por: Revista, Zen, et al.
Publicado: (2025)
Adaptive Semantic Chunking for Enhanced Contextual Fidelity in Long-Document RAG
por: Revista, Zen, et al.
Publicado: (2025)
por: Revista, Zen, et al.
Publicado: (2025)
Adaptive Step Sizes and Implicit Regularization: Decoding the Generalization Landscape of Gradient Optimizers
por: Revista, Zen, et al.
Publicado: (2025)
por: Revista, Zen, et al.
Publicado: (2025)
Beyond Quadratic: Sublinear Attention via Learnable Orthogonal Projections
por: Revista, Zen, et al.
Publicado: (2025)
por: Revista, Zen, et al.
Publicado: (2025)
Unmasking Causal Representations: A Novel Masking Paradigm for Explainable Language Models
por: Revista, Zen, et al.
Publicado: (2025)
por: Revista, Zen, et al.
Publicado: (2025)
Extreme Few-Shot Learning: Beyond Exemplars to Generalizable Abstractions
por: Revista, Zen, et al.
Publicado: (2025)
por: Revista, Zen, et al.
Publicado: (2025)
Neuro-Symbolic Scene Graph Reasoning for Explainable Vision
por: Revista, Zen, et al.
Publicado: (2025)
por: Revista, Zen, et al.
Publicado: (2025)
From Patching to Preventing: Architecting Intrinsic Jailbreak Resistance in Foundation Models
por: Revista, Zen, et al.
Publicado: (2025)
por: Revista, Zen, et al.
Publicado: (2025)
Adaptive Early Exits: Bridging Accuracy and Efficiency in Deep Learning via Resource-Aware Optimization
por: Revista, Zen, et al.
Publicado: (2025)
por: Revista, Zen, et al.
Publicado: (2025)
The Declaration as Global Grammar: Inventing Modern Self-Determination in the Human Story
por: Revista, Zen, et al.
Publicado: (2025)
por: Revista, Zen, et al.
Publicado: (2025)
Coupled Spatiotemporal AI: Unlocking Predictive Power in Dynamic Human-Environment Systems
por: Revista, Zen, et al.
Publicado: (2025)
por: Revista, Zen, et al.
Publicado: (2025)
Aesthetic Justice: Architectures of Desire in Liberal and Communitarian Thought
por: Revista, Zen, et al.
Publicado: (2025)
por: Revista, Zen, et al.
Publicado: (2025)
Architectures of Subordination: Manorial Production, Feudal Power, and the Tripartite Imaginary.
por: Revista, Zen, et al.
Publicado: (2025)
por: Revista, Zen, et al.
Publicado: (2025)
Decoding the Architectural Diversity of Planetary Systems: A Unified Statistical Synthesis of Kepler, TESS, and PLATO Sensitivity Profiles
por: Revista, Zen, et al.
Publicado: (2025)
por: Revista, Zen, et al.
Publicado: (2025)
The End of Utility: Marx, Materialism, and the Pursuit of Human Flourishing
por: Revista, Zen, et al.
Publicado: (2025)
por: Revista, Zen, et al.
Publicado: (2025)
The Echoes of Empire: Historicizing Humanity's Off-World Colonization
por: Revista, Zen, et al.
Publicado: (2025)
por: Revista, Zen, et al.
Publicado: (2025)
The Discursive Crucible: Encyclopédie, Philosophes, and the Remaking of Human Understanding
por: Revista, Zen, et al.
Publicado: (2025)
por: Revista, Zen, et al.
Publicado: (2025)
The Cosmopolitan Polis: Greek Identity, Mobility, and the Foundations of Human Universalism
por: Revista, Zen, et al.
Publicado: (2025)
por: Revista, Zen, et al.
Publicado: (2025)
The Human Timestream: Rethinking Continuity and Disruption in Ancient Egypt's Millennia
por: Revista, Zen, et al.
Publicado: (2025)
por: Revista, Zen, et al.
Publicado: (2025)
A Compactness Criterion for Non-Self-Adjoint Spectral Decompositions
por: Revista, Zen, et al.
Publicado: (2025)
por: Revista, Zen, et al.
Publicado: (2025)
Epoch of Flux: Powering and Producing a New Humanity, 1870–1914
por: Revista, Zen, et al.
Publicado: (2025)
por: Revista, Zen, et al.
Publicado: (2025)
Ejemplares similares
-
Meta-Calculus: Learning Differentiable Optimization Rules for AI
por: Revista, Zen, et al.
Publicado: (2025) -
Beyond Benchmarks: The Qualitative Imperative in Human-Centered AI Evaluation
por: Revista, Zen, et al.
Publicado: (2025) -
The AI Alignment Loop: Iterative Self-Correction for Robust and Generalizable Models
por: Revista, Zen, et al.
Publicado: (2025) -
Emergent Goal Concordance: Architecting Self-Correcting AI Alignment Systems
por: Revista, Zen, et al.
Publicado: (2025) -
Meta-SARSA: Learning Adaptive On-Policy Exploration Strategies
por: Revista, Zen, et al.
Publicado: (2025)