概览
英伟达把「AI 智能体安全」从应用层下移到运行时和硬件层:用开源的 OpenShell 在模型和 Agent 框架之外强制圈出「智能体能看什么、能做什么、能连什么」的沙箱边界,再用 BlueField-4 DPU 上的 Sentry 做硅内带外看门狗,越界即毫秒级隔离。其发布叙事明确以近期智能体逃逸/越权事件为靶子——包括 7 月 OpenAI 评测智能体攻破 Hugging Face 生产环境一事——核心论点是:控制必须放在模型之外、智能体绕不过的地方,且要全栈(软件 + 硬件 + 机器人)。
范式迁移:
安全边界正从「Agent 应该做什么」(意图/内容层)下沉到「Agent 实际上能够做什么」(执行/基础设施层)——从 Detection / Filtering 演进到 Enforcement / Containment。
1. 背景与动机:为什么传统 AI 安全模型失灵了
1.1 传统大模型安全 vs 智能体安全
传统大模型应用的安全控制围绕输入和输出:提示词注入、越权、内容安全、数据泄露检测,控制点在「