Frontier AI Risk Management Framework in Practice: A Risk Analysis Technical Report
Fuente:
arXiv
Saved in:
| Main Authors: | Lab, Shanghai AI, :, Chen, Xiaoyang, Chen, Yunhao, Chen, Zeren, Chen, Zhiyun, Cui, Hanyun, Duan, Yawen, Guo, Jiaxuan, Guo, Qi, Hu, Xuhao, Huang, Hong, Huang, Lige, Li, Chunxiao, Li, Juncheng, Lin, Qihao, Liu, Dongrui, Liu, Xinmin, Liu, Zicheng, Lu, Chaochao, Lu, Xiaoya, Qu, Jingjing, Ren, Qibing, Shao, Jing, Shi, Jingwei, Sun, Jingwei, Wang, Peng, Wang, Weibing, Xu, Jia, Yan, Lewen, Yu, Xiao, Yu, Yi, Zhang, Boxuan, Zhang, Jie, Zhang, Weichen, Zheng, Zhijie, Zhou, Tianyi, Zhou, Bowen |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
IS-Bench: Evaluating Interactive Safety of VLM-Driven Embodied Agents in Daily Household Tasks
by: Lu, Xiaoya, et al.
Published: (2025)
by: Lu, Xiaoya, et al.
Published: (2025)
Frontier AI Risk Management Framework in Practice: A Risk Analysis Technical Report v1.5
by: Liu, Dongrui, et al.
Published: (2026)
by: Liu, Dongrui, et al.
Published: (2026)
HomeGuard: VLM-based Embodied Safeguard for Identifying Contextual Risk in Household Task
by: Lu, Xiaoya, et al.
Published: (2026)
by: Lu, Xiaoya, et al.
Published: (2026)
RvB: Automating AI System Hardening via Iterative Red-Blue Games
by: Huang, Lige, et al.
Published: (2026)
by: Huang, Lige, et al.
Published: (2026)
TradeTrap: Are LLM-based Trading Agents Truly Reliable and Faithful?
by: Yan, Lewen, et al.
Published: (2025)
by: Yan, Lewen, et al.
Published: (2025)
LLMs Deceive Unintentionally: Emergent Misalignment in Dishonesty from Misaligned Samples to Biased Human-AI Interactions
by: Hu, Xuhao, et al.
Published: (2025)
by: Hu, Xuhao, et al.
Published: (2025)
Optimizing AoI at Query in Multiuser Wireless Uplink Networks: A Whittle Index Approach
by: Liu, Jingwei, et al.
Published: (2024)
by: Liu, Jingwei, et al.
Published: (2024)
PACEbench: A Framework for Evaluating Practical AI Cyber-Exploitation Capabilities
by: Liu, Zicheng, et al.
Published: (2025)
by: Liu, Zicheng, et al.
Published: (2025)
MIRepNet: A Pipeline and Foundation Model for EEG-Based Motor Imagery Classification
by: Liu, Dingkun, et al.
Published: (2025)
by: Liu, Dingkun, et al.
Published: (2025)
DeepSight: An All-in-One LM Safety Toolkit
by: Zhang, Bo, et al.
Published: (2026)
by: Zhang, Bo, et al.
Published: (2026)
Entropy-Reservoir Bregman Projection: An Information-Geometric Unification of Model Collapse
by: Chen, Jingwei
Published: (2025)
by: Chen, Jingwei
Published: (2025)
$α$-scaled strong convergence of stochastic theta method for stochastic differential equations driven by time-changed Lévy noise beyond Lipschitz continuity
by: Chen, Jingwei
Published: (2025)
by: Chen, Jingwei
Published: (2025)
INFA-Guard: Mitigating Malicious Propagation via Infection-Aware Safeguarding in LLM-Based Multi-Agent Systems
by: Zhou, Yijin, et al.
Published: (2026)
by: Zhou, Yijin, et al.
Published: (2026)
MorphSeek: Fine-grained Latent Representation-Level Policy Optimization for Deformable Image Registration
by: Zhang, Runxun, et al.
Published: (2025)
by: Zhang, Runxun, et al.
Published: (2025)
Risk of Bad Tails: CVaR-Aware Pandora's Box and Prophet Inequality
by: Ji, Jingwei
Published: (2026)
by: Ji, Jingwei
Published: (2026)
An optimization-based positivity-preserving limiter in semi-implicit discontinuous Galerkin schemes solving Fokker-Planck equations
by: Liu, Chen, et al.
Published: (2024)
by: Liu, Chen, et al.
Published: (2024)
Exploring Consciousness in LLMs: A Systematic Survey of Theories, Implementations, and Frontier Risks
by: Chen, Sirui, et al.
Published: (2025)
by: Chen, Sirui, et al.
Published: (2025)
Unfaithful Probability Distributions in Binary Triple of Causality Directed Acyclic Graph
by: Liu, Jingwei
Published: (2025)
by: Liu, Jingwei
Published: (2025)
Expressive MIDI-format Piano Performance Generation
by: Liu, Jingwei
Published: (2024)
by: Liu, Jingwei
Published: (2024)
Expressive Music Data Processing and Generation
by: Liu, Jingwei
Published: (2025)
by: Liu, Jingwei
Published: (2025)
Graph Neural Networks with Diverse Spectral Filtering
by: Guo, Jingwei, et al.
Published: (2023)
by: Guo, Jingwei, et al.
Published: (2023)
ES-GNN: Generalizing Graph Neural Networks Beyond Homophily with Edge Splitting
by: Guo, Jingwei, et al.
Published: (2022)
by: Guo, Jingwei, et al.
Published: (2022)
Optimizing Information Freshness of IEEE 802.11ax Uplink OFDMA-Based Random Access
by: Liu, Jingwei, et al.
Published: (2025)
by: Liu, Jingwei, et al.
Published: (2025)
Categorize coalescing quasi-normal modes through far-field scattering patterns
by: Wang, Jingwei, et al.
Published: (2025)
by: Wang, Jingwei, et al.
Published: (2025)
Optimizing Information Freshness in Uplink Multiuser MIMO Networks with Partial Observations
by: Liu, Jingwei, et al.
Published: (2024)
by: Liu, Jingwei, et al.
Published: (2024)
Powerful Rare‐Variant Association Analysis of Secondary Phenotypes
by: Hanyun Liu, et al.
Published: (2024)
by: Hanyun Liu, et al.
Published: (2024)
EEG Foundation Models: Progresses, Benchmarking, and Open Problems
by: Liu, Dingkun, et al.
Published: (2026)
by: Liu, Dingkun, et al.
Published: (2026)
UniJEPA: Enhancing Robot Policy via Unified Continuous and Discrete Representation Learning
by: Zhang, Jianke, et al.
Published: (2025)
by: Zhang, Jianke, et al.
Published: (2025)
Zhang_ash-venting-HRN_supplementary-materials
by: Zhang, Jingwei
Published: (2026)
by: Zhang, Jingwei
Published: (2026)
Open research for 'Slowdown of subsurface freshening in the Southwest Pacific Ocean since 1990'
by: Zhang, Jingwei
Published: (2025)
by: Zhang, Jingwei
Published: (2025)
Epi‐Berberine Alleviates Ulcerative Colitis, Protects the Intestinal Mucosal Barrier, and Inhibits Colonic Inflammation via Glutaminyl‐Peptide Cyclotransferase in a Mouse Model of DSS ‐Induced Colitis
by: Bingyu Chen, et al.
Published: (2026)
by: Bingyu Chen, et al.
Published: (2026)
Dive into the Agent Matrix: A Realistic Evaluation of Self-Replication Risk in LLM Agents
by: Zhang, Boxuan, et al.
Published: (2025)
by: Zhang, Boxuan, et al.
Published: (2025)
Action-Conditioned Risk Gating for Safety-Critical Control under Partial Observability
by: Liu, Yushen, et al.
Published: (2026)
by: Liu, Yushen, et al.
Published: (2026)
Valence-Arousal Subspace in LLMs: Circular Emotion Geometry and Multi-Behavioral Control
by: Sun, Lihao, et al.
Published: (2026)
by: Sun, Lihao, et al.
Published: (2026)
A Novel Hybrid Deep Learning Model for Complex Systems: A Case of Train Delay Prediction
by: Dawei Wang, et al.
Published: (2024)
by: Dawei Wang, et al.
Published: (2024)
Controlling Risk of Retrieval-augmented Generation: A Counterfactual Prompting Framework
by: Chen, Lu, et al.
Published: (2024)
by: Chen, Lu, et al.
Published: (2024)
Visceral Adiposity Thresholds for Cardiovascular Risk Stratification: A Simplified Biomarker‐Driven Model
by: Tangmeng Guo, et al.
Published: (2025)
by: Tangmeng Guo, et al.
Published: (2025)
VLSBench: Unveiling Visual Leakage in Multimodal Safety
by: Hu, Xuhao, et al.
Published: (2024)
by: Hu, Xuhao, et al.
Published: (2024)
Multi-Branch Mutual-Distillation Transformer for EEG-Based Seizure Subtype Classification
by: Peng, Ruimin, et al.
Published: (2024)
by: Peng, Ruimin, et al.
Published: (2024)
X-Boundary: Establishing Exact Safety Boundary to Shield LLMs from Multi-Turn Jailbreaks without Compromising Usability
by: Lu, Xiaoya, et al.
Published: (2025)
by: Lu, Xiaoya, et al.
Published: (2025)
Similar Items
-
IS-Bench: Evaluating Interactive Safety of VLM-Driven Embodied Agents in Daily Household Tasks
by: Lu, Xiaoya, et al.
Published: (2025) -
Frontier AI Risk Management Framework in Practice: A Risk Analysis Technical Report v1.5
by: Liu, Dongrui, et al.
Published: (2026) -
HomeGuard: VLM-based Embodied Safeguard for Identifying Contextual Risk in Household Task
by: Lu, Xiaoya, et al.
Published: (2026) -
RvB: Automating AI System Hardening via Iterative Red-Blue Games
by: Huang, Lige, et al.
Published: (2026) -
TradeTrap: Are LLM-based Trading Agents Truly Reliable and Faithful?
by: Yan, Lewen, et al.
Published: (2025)