跳到正文
原文
Google DeepMind·· 2026-06-16AI 评分38

Google DeepMind 发布 AI Control Roadmap,为 AI 智能体构建纵深防御

Securing the future of AI agents

AI 导读

Google DeepMind 发布 AI Control Roadmap,用纵深防御思路保障内部部署的 AI 智能体安全,在模型对齐之外增加系统级防护。该框架借鉴 MITRE ATT&CK 建立 AI 威胁建模,将不受信智能体视为内部威胁,并用可信 AI 作为监督者审查其推理与行动。团队已分析 100 万个编码智能体任务,并据此为 Gemini Spark 智能体搭建实时监控。

来源:Google DeepMind · deepmind.google