Institutional AI: A Governance Framework for Distributional AGI Safety
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Pierucci, Federico, Galisai, Marcello, Bracale, Marcantonio Syrnikov, Prandi, Matteo, Bisconti, Piercosma, Giarrusso, Francesco, Sorokoletova, Olga, Suriani, Vincenzo, Nardi, Daniele |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2026
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Institutional AI: Governing LLM Collusion in Multi-Agent Cournot Markets via Public Governance Graphs
von: Syrnikov, Marcantonio Bracale, et al.
Veröffentlicht: (2026)
von: Syrnikov, Marcantonio Bracale, et al.
Veröffentlicht: (2026)
From Adversarial Poetry to Adversarial Tales: An Interpretability Research Agenda
von: Bisconti, Piercosma, et al.
Veröffentlicht: (2025)
von: Bisconti, Piercosma, et al.
Veröffentlicht: (2025)
Adversarial Poetry as a Universal Single-Turn Jailbreak Mechanism in Large Language Models
von: Bisconti, Piercosma, et al.
Veröffentlicht: (2025)
von: Bisconti, Piercosma, et al.
Veröffentlicht: (2025)
Agentic Microphysics: A Manifesto for Generative AI Safety
von: Pierucci, Federico, et al.
Veröffentlicht: (2026)
von: Pierucci, Federico, et al.
Veröffentlicht: (2026)
Beyond Single-Agent Safety: A Taxonomy of Risks in LLM-to-LLM Interactions
von: Bisconti, Piercosma, et al.
Veröffentlicht: (2025)
von: Bisconti, Piercosma, et al.
Veröffentlicht: (2025)
Bench-2-CoP: Can We Trust Benchmarking for EU AI Compliance?
von: Prandi, Matteo, et al.
Veröffentlicht: (2025)
von: Prandi, Matteo, et al.
Veröffentlicht: (2025)
Metaphor Is Not All Attention Needs
von: Sorokoletova, Olga, et al.
Veröffentlicht: (2026)
von: Sorokoletova, Olga, et al.
Veröffentlicht: (2026)
Adversarial Humanities Benchmark: Results on Stylistic Robustness in Frontier Model Safety
von: Galisai, Marcello, et al.
Veröffentlicht: (2026)
von: Galisai, Marcello, et al.
Veröffentlicht: (2026)
Boiling the Frog: A Multi-Turn Benchmark for Agentic Safety
von: Bisconti, Piercosma, et al.
Veröffentlicht: (2026)
von: Bisconti, Piercosma, et al.
Veröffentlicht: (2026)
Standards for trustworthy AI in the European Union: technical rationale, structural challenges, and an implementation path
von: Bisconti, Piercosma, et al.
Veröffentlicht: (2026)
von: Bisconti, Piercosma, et al.
Veröffentlicht: (2026)
Guarding the Guardrails: A Taxonomy-Driven Approach to Jailbreak Detection
von: Giarrusso, Francesco, et al.
Veröffentlicht: (2025)
von: Giarrusso, Francesco, et al.
Veröffentlicht: (2025)
Learning from Mistakes: Can LLM Self-Recover after Misalignment?
von: Sorokoletova, Olga E., et al.
Veröffentlicht: (2026)
von: Sorokoletova, Olga E., et al.
Veröffentlicht: (2026)
Play Everywhere: A Temporal Logic based Game Environment Independent Approach for Playing Soccer with Robots
von: Suriani, Vincenzo, et al.
Veröffentlicht: (2024)
von: Suriani, Vincenzo, et al.
Veröffentlicht: (2024)
Shape and Style GAN-based Multispectral Data Augmentation for Crop/Weed Segmentation in Precision Farming
von: Fawakherji, Mulham, et al.
Veröffentlicht: (2024)
von: Fawakherji, Mulham, et al.
Veröffentlicht: (2024)
Multi Robot Coordination in Highly Dynamic Environments: Tackling Asymmetric Obstacles and Limited Communication
von: Suriani, Vincenzo, et al.
Veröffentlicht: (2025)
von: Suriani, Vincenzo, et al.
Veröffentlicht: (2025)
A Participatory Strategy for AI Ethics in Education and Rehabilitation grounded in the Capability Approach
von: Cesaroni, Valeria, et al.
Veröffentlicht: (2025)
von: Cesaroni, Valeria, et al.
Veröffentlicht: (2025)
EMPOWER: Embodied Multi-role Open-vocabulary Planning with Online Grounding and Execution
von: Argenziano, Francesco, et al.
Veröffentlicht: (2024)
von: Argenziano, Francesco, et al.
Veröffentlicht: (2024)
Multi-Agent Planning Using Visual Language Models
von: Brienza, Michele, et al.
Veröffentlicht: (2024)
von: Brienza, Michele, et al.
Veröffentlicht: (2024)
Curriculum-Based Multi-Tier Semantic Exploration via Deep Reinforcement Learning
von: Drid, Abdel Hakim, et al.
Veröffentlicht: (2025)
von: Drid, Abdel Hakim, et al.
Veröffentlicht: (2025)
LLM Based Multi-Agent Generation of Semi-structured Documents from Semantic Templates in the Public Administration Domain
von: Musumeci, Emanuele, et al.
Veröffentlicht: (2024)
von: Musumeci, Emanuele, et al.
Veröffentlicht: (2024)
Multi-Agent Coordination for a Partially Observable and Dynamic Robot Soccer Environment with Limited Communication
von: Affinita, Daniele, et al.
Veröffentlicht: (2024)
von: Affinita, Daniele, et al.
Veröffentlicht: (2024)
LLCoach: Generating Robot Soccer Plans using Multi-Role Large Language Models
von: Brienza, Michele, et al.
Veröffentlicht: (2024)
von: Brienza, Michele, et al.
Veröffentlicht: (2024)
Boosting Deep Reinforcement Learning with Semantic Knowledge for Robotic Manipulators
von: Güitta-López, Lucía, et al.
Veröffentlicht: (2026)
von: Güitta-López, Lucía, et al.
Veröffentlicht: (2026)
Distributional AGI Safety
von: Tomašev, Nenad, et al.
Veröffentlicht: (2025)
von: Tomašev, Nenad, et al.
Veröffentlicht: (2025)
Self-supervised Feature Extraction for Enhanced Ball Detection on Soccer Robots
von: Lin, Can, et al.
Veröffentlicht: (2025)
von: Lin, Can, et al.
Veröffentlicht: (2025)
Context Matters! Relaxing Goals with LLMs for Feasible 3D Scene Planning
von: Musumeci, Emanuele, et al.
Veröffentlicht: (2025)
von: Musumeci, Emanuele, et al.
Veröffentlicht: (2025)
LOST-3DSG: Lightweight Open-Vocabulary 3D Scene Graphs with Semantic Tracking in Dynamic Environments
von: Ferraina, Sara Micol, et al.
Veröffentlicht: (2026)
von: Ferraina, Sara Micol, et al.
Veröffentlicht: (2026)
Towards a scalable AI-driven framework for data-independent Cyber Threat Intelligence Information Extraction
von: Sorokoletova, Olga, et al.
Veröffentlicht: (2025)
von: Sorokoletova, Olga, et al.
Veröffentlicht: (2025)
Agentic AI, Retrieval-Augmented Generation, and the Institutional Turn: Legal Architectures and Financial Governance in the Age of Distributional AGI
von: Osmond, Marcel
Veröffentlicht: (2026)
von: Osmond, Marcel
Veröffentlicht: (2026)
Enhancing robot reliability for health-care facilities by means of Human-Aware Navigation Planning
von: Sorokoletova, Olga E., et al.
Veröffentlicht: (2024)
von: Sorokoletova, Olga E., et al.
Veröffentlicht: (2024)
Equilibrium and Pricing in Consumer Networks with Nonlinear Utilities: An Online Shape-Constrained Learning Approach
von: Bracale, Daniele, et al.
Veröffentlicht: (2026)
von: Bracale, Daniele, et al.
Veröffentlicht: (2026)
Learning the Distribution Map in Reverse Causal Performative Prediction
von: Bracale, Daniele, et al.
Veröffentlicht: (2024)
von: Bracale, Daniele, et al.
Veröffentlicht: (2024)
R2F: Repurposing Ray Frontiers for LLM-free Object Navigation
von: Argenziano, Francesco, et al.
Veröffentlicht: (2026)
von: Argenziano, Francesco, et al.
Veröffentlicht: (2026)
Real-Time Multimodal Signal Processing for HRI in RoboCup: Understanding a Human Referee
von: Ansalone, Filippo, et al.
Veröffentlicht: (2024)
von: Ansalone, Filippo, et al.
Veröffentlicht: (2024)
AI Agents Under EU Law
von: Nannini, Luca, et al.
Veröffentlicht: (2026)
von: Nannini, Luca, et al.
Veröffentlicht: (2026)
Descripción morfológica de amebas testadas del género Arcella sp., a través del uso de técnicas multiples
von: Karen Bracale
Veröffentlicht: (2019)
von: Karen Bracale
Veröffentlicht: (2019)
AGI, Governments, and Free Societies
von: Bullock, Justin B., et al.
Veröffentlicht: (2025)
von: Bullock, Justin B., et al.
Veröffentlicht: (2025)
Fatty acid amide hydrolase (FAAH) and the endocannabinoid system in obesity: Mechanistic insights and pharmacological opportunities beyond incretin‐based therapies
von: Ilaria Serra, et al.
Veröffentlicht: (2026)
von: Ilaria Serra, et al.
Veröffentlicht: (2026)
AEGIS: A Comprehensive Framework for Ethical AI Governance, Security, and AGI Containment
von: Palanivel, ArulMozhi
Veröffentlicht: (2026)
von: Palanivel, ArulMozhi
Veröffentlicht: (2026)
An Approach to Technical AGI Safety and Security
von: Shah, Rohin, et al.
Veröffentlicht: (2025)
von: Shah, Rohin, et al.
Veröffentlicht: (2025)
Ähnliche Einträge
-
Institutional AI: Governing LLM Collusion in Multi-Agent Cournot Markets via Public Governance Graphs
von: Syrnikov, Marcantonio Bracale, et al.
Veröffentlicht: (2026) -
From Adversarial Poetry to Adversarial Tales: An Interpretability Research Agenda
von: Bisconti, Piercosma, et al.
Veröffentlicht: (2025) -
Adversarial Poetry as a Universal Single-Turn Jailbreak Mechanism in Large Language Models
von: Bisconti, Piercosma, et al.
Veröffentlicht: (2025) -
Agentic Microphysics: A Manifesto for Generative AI Safety
von: Pierucci, Federico, et al.
Veröffentlicht: (2026) -
Beyond Single-Agent Safety: A Taxonomy of Risks in LLM-to-LLM Interactions
von: Bisconti, Piercosma, et al.
Veröffentlicht: (2025)