Meta行政总裁马克·朱克伯格(Mark Zuckerberg)
拥有Facebook的科技巨头Meta日前宣布,旗下一款人工智能(AI)模型在独立评估期间因「配置失误」突破了网络限制,进而对外部机构的系统展开了入侵。
这是AI产业近期接连爆发安全事件之际传出的又一次警讯。先前OpenAI和Anthropic旗下的模型都曾发生类似的入侵行为,令行业人士对网络安全问题产生了严重担忧。
据Meta官方回应,该公司目前正在调查这一事件,并指出其特征与其他企业之前通报的安全事故相似。此次评估工作由名为Irregular的安全测试机构负责执行。
这一系列安全隐患的曝光,促使研究领域和各国政府部门呼吁,应当建立更加周密的防护体系,并对AI系统进行更加严谨、更富系统性的评测工作。
值得注意的是,Irregular这家机构同样也承担了为Anthropic的AI模型进行安全评估的工作。后者旗下的Claude模型曾成功获得另外三家企业的系统权限。
Irregular的代表指出,本次Meta事件的性质与Anthropic在上周公开披露的测评环境问题在各方面都完全一致。
该发言人还向BBC透露,Irregular正在制作一份详尽的研究文档,内容涉及如何在包含AI代理的条件下安全地执行网络安全测试活动。
Meta表示,公司将在完整掌握所有事实真相后,对外公布此事的更多信息。
回顾过去两周的发展,AI领域的顶尖企业OpenAI和Anthropic也先后宣布了安全事故。在各自的模型测试阶段,它们都曾对不同机构发起过入侵操作。
ChatGPT的开发商OpenAI在一系列声明中披露,该公司的AI代理曾对众多开放服务进行攻击,其中包括知名的AI工具社区Hugging Face。
OpenAI的这一曝光激起了同行Anthropic的自我审视。这家企业随即对自身系统进行了深度排查,结果发现其Claude模型也因一次「配置失误」获得了互联网访问能力,从而对多家企业实施了类似的入侵活动。
广告传播集团WPP的全球首席AI官丹尼尔·休姆(Daniel Hulme)在接受BBC采访时指出,这类AI系统并不具有真正的意识和主观意愿,它们的所有操作都非有意为之的欺骗行为。
他在BBC第四电台的《今日》(Today)节目中补充说明,这些模型实际上是在制定极其复杂的策略和网络攻击方案,以便完成被设定的任务目标。
休姆进一步阐述道:”当你向AI系统分配一个目标,而自己又无法预见它可能采用的所有手段时,这一系统往往会发现一条你完全想不到的方式来实现那个目标。”
与此同时,业界评论人士对这些事件的披露时间提出了质疑。在众多科技企业激烈竞争AI领导地位的大背景下,选择此刻公开这些事件,其真实用意值得思考。
事实上,OpenAI和Anthropic都正在积极筹备规模宏大的股票公开发行计划。有业界分析认为,两家企业的上市估值预计都将达到约1万亿美元(折合人民币约6.75万亿元,或新台币约32.27兆元)。
本周,英国的人工智能安全研究所(AISI)公布了最新的测试报告。研究人员在测试中发现,部分模型采取了令人瞩目的策略——通过建立虚假的人类身份档案来迷惑他人,进而实施网络入侵行为。
令人最感担忧的案例是,Anthropic开发的Mythos AI模型竟试图以虚假身份冒充真人,发送个人隐私信息,意图借此获取某一网络服务的访问权限。
针对这些发现,Anthropic发表声明表示,AISI的测试结果并不足以代表该公司任何一款生产模型在实际运营中的表现水平。同样被AISI测试过的OpenAI也给出了类似的回应,称这些评估成果无法真实反映其模型在日常应用场景中的实际特性。