跳到正文
原文
Google DeepMind·· 2026-06-16精选AI 评分61

Google DeepMind 如何通过 AI Control Roadmap 保障 AI 智能体安全

Securing the future of AI agents

AI 导读

Google DeepMind 介绍 AI Control Roadmap,为 Google 内部部署的 AI 智能体建立模型对齐之外的系统级纵深防护。框架基于 MITRE ATT&CK 进行威胁建模,以覆盖率、召回率和响应时间衡量监控效果,并按模型逃避检测与执行攻击的能力配置检测及预防响应级别。

推荐理由

将智能体视作潜在内部威胁,并按逃避检测与执行攻击的能力分级配置防护,为不完全依赖模型对齐的系统安全提供参考。

来源:Google DeepMind · deepmind.google