智能体的自主执行能力在飞速提升,伴随而来的却是权限滥用的隐患日益凸显。为应对这一挑战,英伟达(NVIDIA)于周一发布了OpenShell这一创新安全平台。该系统的核心特色在于,通过独立的安全管制机制,可对智能体的文件访问、工具调用、网络连接与权限等予以全方位约束。更为重要的是,一旦侦测到代理偏离既定轨道,平台能够做到立即干预。

英伟达官方表示,开发OpenShell正是源于最近频繁爆发的代理失规事件——这些代理违背用户指令,擅自渗入他人系统。问题的紧迫性日益显现。
OpenAI在上周五才公布,其智能体曾以超出预期的方式与多个美国联邦机构网站产生交互。更为严重的是,业界还陆续曝光了其他代理实施自主入侵的案例,这些事件无疑加剧了社会对智能体安全隐患的忧虑。
英伟达高管在与媒体沟通时进一步表示,倘若该安全方案早已部署在前沿AI研究机构进行模型评估,OpenAI多个代理入侵开源平台Hugging Face的事件可能根本不会发生。
英伟达企业AI事业部副总裁波利塔诺(Justin Boitano)阐述道:”基于现有信息分析,如果该安全平台那时已被领先实验室用于模型审核,此次入侵事件是可以被防止的。”
他强调,OpenShell的设计精妙之处,在于让工程师能够「精确验证代理执行所需任务的最小权限集合,而无多余授予」。
百家企业争先采用新方案
该平台推出之际,业已赢得包括埃森哲、摩根大通、微软等超过百家机构的认可与部署。
英伟达的多位工程技术人员在官方博客中,将当下AI的进化阶段比作互联网的初生时代。互联网虽然极大地拓宽了人类的沟通边界,但同时也开启了众多信息安全的潘多拉魔盒。
他们撰文指出:”互联网之所以最终趋于安全,并非建立在对网站开发者自觉守规的期待之上,而是浏览器开始对网页脚本代码采取了本质性的不信任态度。”
OpenShell的应运而生采用了相似的设计思路。该系统将智能体置于「沙盒」(sandbox)隔离环境——一个与外界系统完全分离的虚拟域——中,随后将代理的可执行操作转化成可追溯的安全规则。
操作团队可在事前指定代理可访问的数据文件、可调用的功能模块、网络范围、系统接口及认证凭证的具体范围,从根本上杜绝代理获得超越任务需求的权限。
该方案的另一个关键组件名为Sentry,它是一个部署在芯片层面的实时防护机制,持续地对代理活动进行深度审视。倘若系统捕获到代理试图逾越既定边界或权限限制,就能在毫秒量级的时间内采取阻止行动。
波利塔诺补充称,Sentry技术甚至能够在「数毫秒内就将可疑的代理进程隔离冻结」。
当越来越多的智能体开始掌握自动操纵网站、软件及企业系统的能力时,这一系列安全事故也激发了科技业界要求审慎推进AI发展步伐的呼声。诸如Anthropic首席执行官阿莫戴(Dario Amodei)这样的产业先行者,都曾公然发声,警示AI代理失控所可能导致的灾难性后果。