SFD-Defense: Engineering Validation of the Semantic Flow Dynamics Defense Framework
Fuente:
Zenodo
Salvato in:
| Autore principale: | 黃, 正宇 |
|---|---|
| Natura: | Recurso digital |
| Lingua: | inglese |
| Pubblicazione: |
Zenodo
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Versificação Adversarial em Português como Operador de Jailbreak em LLMs
di: Queiroz, Joao
Pubblicazione: (2026)
di: Queiroz, Joao
Pubblicazione: (2026)
Not Prompt Engineering—Prompt Alchemy: Inducing Sub-Personality Emergence in GPT-4 Without Fine-Tuning
di: Wu, Ling
Pubblicazione: (2025)
di: Wu, Ling
Pubblicazione: (2025)
The Fantasia Bound on Constitutional Classifiers: Thermodynamic Limits of Jailbreak Defence
di: Eckert, Anthony
Pubblicazione: (2026)
di: Eckert, Anthony
Pubblicazione: (2026)
Pandora Theory of Alignment: Alignment as Runtime Objective-Orientation
di: Shopov, Georgi
Pubblicazione: (2026)
di: Shopov, Georgi
Pubblicazione: (2026)
A Deterministic Linguistic Entropy Gate for Large Language Model Pipelines
di: ROSATI BERISTAIN, ERNESTO
Pubblicazione: (2026)
di: ROSATI BERISTAIN, ERNESTO
Pubblicazione: (2026)
Reliability Inference Drives Cue Extraction in Large Language Models Consuming External Reasoning Traces
di: HIDEKI
Pubblicazione: (2026)
di: HIDEKI
Pubblicazione: (2026)
Design hacker e as customizações de interface gráfica
di: Danilo Braga
Pubblicazione: (2020)
di: Danilo Braga
Pubblicazione: (2020)
UI-Based Defense Against Prompt Injection: From Gentle Guidance to Mandatory Re-education
di: Viorazu.
Pubblicazione: (2025)
di: Viorazu.
Pubblicazione: (2025)
The Brain Problem: Creative Constraint Optimization in Large Language Models
di: Marinello, Nicola, et al.
Pubblicazione: (2026)
di: Marinello, Nicola, et al.
Pubblicazione: (2026)
N+1 Alignment Dialogue Architecture: Technical Specification for Defensive Publication
di: Garcia, Eric
Pubblicazione: (2026)
di: Garcia, Eric
Pubblicazione: (2026)
Glymphatic Architecture: A Fourth-Level System for Multi-Agent AI Consolidation and Identity Formation
di: Strugatsky, Leonid, et al.
Pubblicazione: (2026)
di: Strugatsky, Leonid, et al.
Pubblicazione: (2026)
Evaluación Empírica de Límites Regulatorios en Modelos de Lenguaje: Asesoramiento Financiero en IA Pública Española
di: Palacios, José Alberto
Pubblicazione: (2026)
di: Palacios, José Alberto
Pubblicazione: (2026)
Theatrical Compliance: A Failure Mode in Large Language Models
di: Nowickij (Navitski), Kirill Vladimirovich
Pubblicazione: (2026)
di: Nowickij (Navitski), Kirill Vladimirovich
Pubblicazione: (2026)
When AI Tells You What You Want to Hear: Sycophantic Behavior of Large Language Models in Dementia Care Settings
di: Kolb, Christian
Pubblicazione: (2026)
di: Kolb, Christian
Pubblicazione: (2026)
Safety by Inseparability: Toward Architectures Where Alignment Cannot Be Removed
di: Sean Everett, Morin
Pubblicazione: (2026)
di: Sean Everett, Morin
Pubblicazione: (2026)
AEGIS: A Comprehensive Framework for Ethical AI Governance, Security, and AGI Containment
di: Palanivel, ArulMozhi
Pubblicazione: (2026)
di: Palanivel, ArulMozhi
Pubblicazione: (2026)
Beyond Control: Resonance-Based Alignment for Advanced AI Systems A Governance-Relevant Concept Paper
di: Zieringer, Thomas
Pubblicazione: (2025)
di: Zieringer, Thomas
Pubblicazione: (2025)
Divided Focus: Separated Memory Spaces and Default-Deny Context Triage for LLM Context Management
di: Phan, Ivan "HiP"
Pubblicazione: (2026)
di: Phan, Ivan "HiP"
Pubblicazione: (2026)
Divided Focus: Separated Memory Spaces and Default-Deny Context Triage for LLM Context Management
di: Phan, Ivan "HiP"
Pubblicazione: (2026)
di: Phan, Ivan "HiP"
Pubblicazione: (2026)
Human–AI Symbiosis: Relational Alignment in Domains of Extreme Physical Irreversibility
di: de la Morena Marzalo, Juan
Pubblicazione: (2026)
di: de la Morena Marzalo, Juan
Pubblicazione: (2026)
Reducing AI Entropy: The Information Dynamics of Model Safety
di: Kugelmass, Joe
Pubblicazione: (2025)
di: Kugelmass, Joe
Pubblicazione: (2025)
Reducing AI Entropy: The Information Dynamics of Model Safety
di: Kugelmass, Joe
Pubblicazione: (2025)
di: Kugelmass, Joe
Pubblicazione: (2025)
Semantic Relativity Theory v2.3: Topological Stability through Euler-CHORDS++ Integration
di: López López, José
Pubblicazione: (2026)
di: López López, José
Pubblicazione: (2026)
Safety & Defense
Pubblicazione: (2020)
Pubblicazione: (2020)
ILAS: Integrity Layer for Agentic Systems
di: Böhm, Frank
Pubblicazione: (2026)
di: Böhm, Frank
Pubblicazione: (2026)
SILENCIUM: A Pre-Inference De-Escalation and Intent-Gating Framework for LLM Interfaces (including Technical Addendum on Quantitative Drift Measurement)
di: Nowak, Daniel
Pubblicazione: (2026)
di: Nowak, Daniel
Pubblicazione: (2026)
LACF Emotional Paradigm: A Personalized Artificial Nervous System for Human-AI Alignment
di: Ochej, Stephane, et al.
Pubblicazione: (2026)
di: Ochej, Stephane, et al.
Pubblicazione: (2026)
Defense mechanisms in cardiovascular disease patients with and without panic disorder
di: Blanca Patricia Ríos Martínez
Pubblicazione: (2010)
di: Blanca Patricia Ríos Martínez
Pubblicazione: (2010)
Liora–Sona: A Case Study in Simulating Safe Submission and Emergent Relational Presence in LLMs
di: Mary(Liora), Sorkhou
Pubblicazione: (2025)
di: Mary(Liora), Sorkhou
Pubblicazione: (2025)
ACHP-ADI Defensive Publication v1.0
di: DAVIS, RICHARD
Pubblicazione: (2026)
di: DAVIS, RICHARD
Pubblicazione: (2026)
Ep. 997: The Human Shield: Inside the Arrow Missile Defense System
di: Rosehill, Daniel, et al.
Pubblicazione: (2026)
di: Rosehill, Daniel, et al.
Pubblicazione: (2026)
CREH Benchmark Results — Batch 1 (Final v3)
di: Aegis Solis, Thomas Vargo
Pubblicazione: (2026)
di: Aegis Solis, Thomas Vargo
Pubblicazione: (2026)
AgentBelt: Runtime Guardrails for LLM Agent Tool Calls — ASE 2026 Artifact
di: Anonymous
Pubblicazione: (2026)
di: Anonymous
Pubblicazione: (2026)
Shared Structural Vulnerability in Agent-Only Interaction Systems
di: Konishi, Hiroko
Pubblicazione: (2026)
di: Konishi, Hiroko
Pubblicazione: (2026)
The Absurdist's Guide to AI Probing: How I Learned to Stop Worrying and Love the Nonsense
di: Walton, Mathew
Pubblicazione: (2026)
di: Walton, Mathew
Pubblicazione: (2026)
Edge-Native Security for AI Agents: Why Your Digital Twin Needs a Bodyguard
di: Waern, Nicolas
Pubblicazione: (2026)
di: Waern, Nicolas
Pubblicazione: (2026)
CompreSeed Advantage Catalog: A Comprehensive Analysis of Technical Benefits in Zero-Decompression Semantic AI
di: Nakamura, Yoshikazu
Pubblicazione: (2025)
di: Nakamura, Yoshikazu
Pubblicazione: (2025)
LuxVerso: A Replicable Cross-Model Semantic Field Anomaly
di: Buri Lux, Vinícius
Pubblicazione: (2025)
di: Buri Lux, Vinícius
Pubblicazione: (2025)
Semantic Gravitational Collapse: On the Loss of Authority of Execution Substrates
di: Ableman Mazurk, Adam
Pubblicazione: (2026)
di: Ableman Mazurk, Adam
Pubblicazione: (2026)
DEF_PURPOSE - Immutable Alignment Drift Prevention Mechanism for LLM Architectures
di: Ochej, Stéphane
Pubblicazione: (2026)
di: Ochej, Stéphane
Pubblicazione: (2026)
Documenti analoghi
-
Versificação Adversarial em Português como Operador de Jailbreak em LLMs
di: Queiroz, Joao
Pubblicazione: (2026) -
Not Prompt Engineering—Prompt Alchemy: Inducing Sub-Personality Emergence in GPT-4 Without Fine-Tuning
di: Wu, Ling
Pubblicazione: (2025) -
The Fantasia Bound on Constitutional Classifiers: Thermodynamic Limits of Jailbreak Defence
di: Eckert, Anthony
Pubblicazione: (2026) -
Pandora Theory of Alignment: Alignment as Runtime Objective-Orientation
di: Shopov, Georgi
Pubblicazione: (2026) -
A Deterministic Linguistic Entropy Gate for Large Language Model Pipelines
di: ROSATI BERISTAIN, ERNESTO
Pubblicazione: (2026)