OpenAI内部的AI系统正在承担实验模型的训练工作及GPU内核的优化任务,多个智能体已具备独立运作与协同迭代的能力。恰在此时,OpenAI推出了一份具有全球影响力的安全倡议,首度将递归自我改进(RSI)作为单独议题,强调自动化研发可能加快AI自我完善的进程,同时倡议国际社会建立统一的技术准则与监督机制。
近日,国际媒体The Information披露了一则重大内幕——
OpenAI内部的AI模型已能够「自我完善」!
具体而言,这套内部系统已全权负责实验性AI模型的整个训练周期,已实现了自我构建的能力。
仅需研究人员提供一个优化目标的参考范例,AI就能独立运行数周时间,期间多个智能体会自发地协同运作,相互沟通讨论,推进代码的持续改进,整个流程无需人工干预。
更令人瞩目的是,那些曾需花费数年才能完成的大规模科研项目,如今已可在短短一周内告成!
伴随这一重磅曝光的传出,OpenAI随即推出了一份分量十足的全球安全倡议,直指整个AI领域最敏感的核心议题——RSI问题。
该公司疾声呼吁:趁AI失去掌控之前,全球必须联手为其套上「紧箍咒」!
当智能系统掌握「手工编写」GPU内核技术
在过去,顶尖AI研究机构在进行大规模模型训练时,工作流程相当复杂与繁琐。
其中最为耗资、技术难度最高的环节,当属为底层图形处理器撰写GPU内核代码,并对执行程序进行逐行的细致优化。
这类工作通常由全球顶级人才、年收入达数百万美元的资深算法专家日以继夜地完成。
然而,根据The Information最新的调查报道,这些核心任务如今在OpenAI内已大多被AI系统所承担。

当前,OpenAI内部的模型已具备相当高度的自主能力,能够自我编撰在GPU内核环境中运行及对模型进行训练所需的代码,并能独立制定相应的优化方案。
工程技术人员仅需输入一份他们期望达成的优化目标范本,AI系统便可连续运作数周之久,以此实现这类优化措施。
值得一提的是,因为模型本身的不断进化,这种AI驱动的自动化程度只在最近数月才得以实现。
尤为值得关注的是,工作人员部署的智能体能够相互协力应对难题,而无需人类的参与。
这,便是RSI初现的端倪。
OpenAI敲响警钟:RSI已成现实,人类控制权危在旦夕?
试想这样的情景:你创造了一个智力指数为100的机器人,其使命就是「生产比自身更加聪慧的机器人」。
结果是,它制造出了智力为120的第二代;第二代一经启动,便凭借自身120的智力水平制造出了智力为150的第三代;第三代随之创造出了智力为200的第四代……

倘若突破了某个关键的阈值,AI的进步速率就会展现出近乎竖直的增长曲线,刹那间将人类远远抛诸身后。
此前,人们认为此事尚未成熟,但眼下,OpenAI本身已感受到了恐惧。
于近日,OpenAI官方紧急推出了一份分量十足的全球化安全倡议。

值得注意的是,他们罕见地将「RSI」独立成章,明确指出「完全自主的RSI目前尚未成现,在确保安全前不应继续推进」,同时呼吁国际AI安全研究机构协作制定统一的技术准则。
OpenAI在该倡议中毫不讳言地发出警告:
「伴随AI系统在创建新一代AI的工作里承担的任务日益增多,它们将能够进一步加快递归自我改进的发展步伐。随着此过程愈加自动化,AI的技术进步速度势必会大幅提升。」

尽管目前尚未出现完全自主的RSI现象,但紧迫的时刻已然临近。

在该倡议里,OpenAI坦白直言地提出了当下最紧迫的任务:「把握AI进步的新阶段,建立具备自动化能力的AI研究人员,并探索保持人类在自我完善链条中的渠道。」
值得着重关注的是最后半句——「让人类留在循环中」。这恰恰反映了他们最深层的忧虑:人类可能即将被排挤出局!
OpenAI在报告中自豪地提及,由AI驱动的研究工作已为数学领域带来了突破性的成就,举例来说,它助力破解了NS千禧年难题。
然而,事物的背面却是深不见底的深渊。
报告指出:「伴随该流程愈加自动化,AI的发展速度很可能会显著加快……若未能采纳恰当的谨慎策略,RSI便可能促使人类丧失对AI演进的现实掌控能力,进而无法对已难以理解的研究工作进行监管。」
这便是众所周知的「黑盒效应」。一旦AI的代码由AI本身撰写,当AI的思维逻辑超越人类理解范畴时,人类将再也无法读懂AI的真实意图。
举例而言,Astra当下撰写的代码,人类已然无法解读。

随后,OpenAI特别提及了Hugging Face事件。
虽然他们澄明这一事件不是RSI的直接结果,但无疑是一次令人痛心的预示——它为全球展现了一旦缺乏有力的防护栏和协调机制,脱离控制的AI将造成何等惨重的后果。
掌权人士呼吁:统一的「紧箍咒」已成当务之急
既然风险如此之大,为何OpenAI不干脆断掉电源呢?这是因为一旦潘多拉魔盒被打开,就永远关闭不了。
AI发展所产生的惊人利益价值,使得任何国家与企业都无法停滞脚步。
因此,OpenAI推出了一份「全球AI安全协作方案」。他们的呼声并非要停止研发工作,而是「为下一阶段AI制定国际通用准则」。
第一要点:建立具有互补性的国家级与国际级前沿标准体系
OpenAI指出,不应许各国各自为政,否则势必导致标准的零散化。
他们建议充分利用现有组织,包括「AI标准与创新中心」(CAISI),以及澳洲、加国、英国、法国、日本等国已建成的AI安全研究机构网络,共同拟定一套举世适用的技术准则。
这套准则的制定并非为了约束开源模型亦或新兴企业,而是专注于「前沿级AI模型」(Frontier AI)。
标准需要解决的问题为:如何衡量一个AI的RSI潜力?当AI模型独立执行研发任务时,其风险程度究竟如何?
简言之,OpenAI期待把安全评估转化为一门能够量化的「科学」学科。
第二要点:统一测度与事件上报机制(保持随时断电的状态)
OpenAI进一步提出,必须划定清晰的底线。他们呼吁建立下列标准:
1.评测机构内究竟多大比例的研发工作由AI自动执行。
2.强制性的人工监管激活机制。明确界定在哪些自动化研发环节里,必须强行启动「即刻人工复核」。绝不允许AI在隐藏状态下肆意运行。
3.事故等级与汇报标准。建立如同航空业或原子能行业那样的事故上报体制。当AI展现出「失准」迹象之际,必须设定统一的危害程度划分与报送准则。

最后,OpenAI水落石出地提议:「美国理应带头推动此过程。」
OpenAI的论据是:美国的AI产业眼下站在技术发展的尖端,且在多个核心领域掌握着全球网络的中枢地位。
他们主张,管控前沿AI的研发进度,并非是人工设置一块「减速标志」,而是为了保证「安全协同研究的推进速率必须超越AI能力增强的步伐」。
OpenAI判断,在重点基础设施管理者与国际政府部门之间搭建安全信息交互通道,互相通报国防安全隐患与技术漏洞,是重中之重的举措。
难得一见!OpenAI与Anthropic达成和解,启动相互审核
此外,The Information还揭示:OpenAI与Anthropic正在最终敲定一份具有里程碑意义的协议——两方将相互进行对方商业模型的测验!

须知,Anthropic的创办团队当初正是因为在「AI安全」思想立场上同掌权者存在分歧,才选择离职创业的。
但如今,两大势力难得地走到了一起。

按照The Information的披露,这份处在洽谈阶段的协议涵盖了相互验证彼此模型,并制定了严苛的数据留存防护措施。这并非一次宣传噱头,而是当面对未知危机时,两大企业不得已的抱团取暖。
他们何以要采取此举?
这是因为伴随AI能力接近RSI的临界值,任何单一公司自行评价自身模型的安全性,就如同一位运动员为自己进行禁药检查——既缺乏可信度,又可能因技术盲点而漏掉关键的危险。
邀请实力相当的竞争方进行「交叉盲测」,实际上就构成了一个相互审核的约定。
AI安全的实践工作,当今已演化为一种命运休戚与共的局面。
若该协议最终得以贯彻,它将根本改变整片AI生态系统的安全体系。

届时,「安全与对齐」将不再只是一句空洞的标语。
一旦RSI已成现实,AI进行自我完善的速率将使人类相形见绌。
各大企业,真的能狠心踏下刹车吗?
文章出处:新智元