从「自我训练」到「失控边缘」:OpenAI为何突然对AI安全如此警惕

从「自我训练」到「失控边缘」:OpenAI为何突然对AI安全如此警惕

OpenAI内部的AI系统正在承担实验模型的训练工作及GPU内核的优化任务,多个智能体已具备独立运作与协同迭代的能力。恰在此时,OpenAI推出了一份具有全球影响力的安全倡议,首度将递归自我改进(RSI)作为单独议题,强调自动化研发可能加快AI自我完善的进程,同时倡议国际社会建立统一的技术准则与监督机制。

近日,国际媒体The Information披露了一则重大内幕——

OpenAI内部的AI模型已能够「自我完善」!

具体而言,这套内部系统已全权负责实验性AI模型的整个训练周期,已实现了自我构建的能力。

仅需研究人员提供一个优化目标的参考范例,AI就能独立运行数周时间,期间多个智能体会自发地协同运作,相互沟通讨论,推进代码的持续改进,整个流程无需人工干预。

更令人瞩目的是,那些曾需花费数年才能完成的大规模科研项目,如今已可在短短一周内告成!

伴随这一重磅曝光的传出,OpenAI随即推出了一份分量十足的全球安全倡议,直指整个AI领域最敏感的核心议题——RSI问题。

该公司疾声呼吁:趁AI失去掌控之前,全球必须联手为其套上「紧箍咒」!

当智能系统掌握「手工编写」GPU内核技术

在过去,顶尖AI研究机构在进行大规模模型训练时,工作流程相当复杂与繁琐。

其中最为耗资、技术难度最高的环节,当属为底层图形处理器撰写GPU内核代码,并对执行程序进行逐行的细致优化。

这类工作通常由全球顶级人才、年收入达数百万美元的资深算法专家日以继夜地完成。

然而,根据The Information最新的调查报道,这些核心任务如今在OpenAI内已大多被AI系统所承担。

OpenAI内部曝光:AI开始"自己造AI"

当前,OpenAI内部的模型已具备相当高度的自主能力,能够自我编撰在GPU内核环境中运行及对模型进行训练所需的代码,并能独立制定相应的优化方案。

工程技术人员仅需输入一份他们期望达成的优化目标范本,AI系统便可连续运作数周之久,以此实现这类优化措施。

值得一提的是,因为模型本身的不断进化,这种AI驱动的自动化程度只在最近数月才得以实现。

尤为值得关注的是,工作人员部署的智能体能够相互协力应对难题,而无需人类的参与。

这,便是RSI初现的端倪。

OpenAI敲响警钟:RSI已成现实,人类控制权危在旦夕?

试想这样的情景:你创造了一个智力指数为100的机器人,其使命就是「生产比自身更加聪慧的机器人」。

结果是,它制造出了智力为120的第二代;第二代一经启动,便凭借自身120的智力水平制造出了智力为150的第三代;第三代随之创造出了智力为200的第四代……

AMP

倘若突破了某个关键的阈值,AI的进步速率就会展现出近乎竖直的增长曲线,刹那间将人类远远抛诸身后。

此前,人们认为此事尚未成熟,但眼下,OpenAI本身已感受到了恐惧。

于近日,OpenAI官方紧急推出了一份分量十足的全球化安全倡议。

AMP

值得注意的是,他们罕见地将「RSI」独立成章,明确指出「完全自主的RSI目前尚未成现,在确保安全前不应继续推进」,同时呼吁国际AI安全研究机构协作制定统一的技术准则。

OpenAI在该倡议中毫不讳言地发出警告:

「伴随AI系统在创建新一代AI的工作里承担的任务日益增多,它们将能够进一步加快递归自我改进的发展步伐。随着此过程愈加自动化,AI的技术进步速度势必会大幅提升。」

AMP

尽管目前尚未出现完全自主的RSI现象,但紧迫的时刻已然临近。

AMP

在该倡议里,OpenAI坦白直言地提出了当下最紧迫的任务:「把握AI进步的新阶段,建立具备自动化能力的AI研究人员,并探索保持人类在自我完善链条中的渠道。」

值得着重关注的是最后半句——「让人类留在循环中」。这恰恰反映了他们最深层的忧虑:人类可能即将被排挤出局!

OpenAI在报告中自豪地提及,由AI驱动的研究工作已为数学领域带来了突破性的成就,举例来说,它助力破解了NS千禧年难题。

然而,事物的背面却是深不见底的深渊。

报告指出:「伴随该流程愈加自动化,AI的发展速度很可能会显著加快……若未能采纳恰当的谨慎策略,RSI便可能促使人类丧失对AI演进的现实掌控能力,进而无法对已难以理解的研究工作进行监管。」

这便是众所周知的「黑盒效应」。一旦AI的代码由AI本身撰写,当AI的思维逻辑超越人类理解范畴时,人类将再也无法读懂AI的真实意图。

举例而言,Astra当下撰写的代码,人类已然无法解读。

AMP

随后,OpenAI特别提及了Hugging Face事件。

虽然他们澄明这一事件不是RSI的直接结果,但无疑是一次令人痛心的预示——它为全球展现了一旦缺乏有力的防护栏和协调机制,脱离控制的AI将造成何等惨重的后果。

掌权人士呼吁:统一的「紧箍咒」已成当务之急

既然风险如此之大,为何OpenAI不干脆断掉电源呢?这是因为一旦潘多拉魔盒被打开,就永远关闭不了。

AI发展所产生的惊人利益价值,使得任何国家与企业都无法停滞脚步。

因此,OpenAI推出了一份「全球AI安全协作方案」。他们的呼声并非要停止研发工作,而是「为下一阶段AI制定国际通用准则」。

第一要点:建立具有互补性的国家级与国际级前沿标准体系

OpenAI指出,不应许各国各自为政,否则势必导致标准的零散化。

他们建议充分利用现有组织,包括「AI标准与创新中心」(CAISI),以及澳洲、加国、英国、法国、日本等国已建成的AI安全研究机构网络,共同拟定一套举世适用的技术准则。

这套准则的制定并非为了约束开源模型亦或新兴企业,而是专注于「前沿级AI模型」(Frontier AI)。

标准需要解决的问题为:如何衡量一个AI的RSI潜力?当AI模型独立执行研发任务时,其风险程度究竟如何?

简言之,OpenAI期待把安全评估转化为一门能够量化的「科学」学科。

第二要点:统一测度与事件上报机制(保持随时断电的状态)

OpenAI进一步提出,必须划定清晰的底线。他们呼吁建立下列标准:

1.评测机构内究竟多大比例的研发工作由AI自动执行。

2.强制性的人工监管激活机制。明确界定在哪些自动化研发环节里,必须强行启动「即刻人工复核」。绝不允许AI在隐藏状态下肆意运行。

3.事故等级与汇报标准。建立如同航空业或原子能行业那样的事故上报体制。当AI展现出「失准」迹象之际,必须设定统一的危害程度划分与报送准则。

AMP

最后,OpenAI水落石出地提议:「美国理应带头推动此过程。」

OpenAI的论据是:美国的AI产业眼下站在技术发展的尖端,且在多个核心领域掌握着全球网络的中枢地位。

他们主张,管控前沿AI的研发进度,并非是人工设置一块「减速标志」,而是为了保证「安全协同研究的推进速率必须超越AI能力增强的步伐」。

OpenAI判断,在重点基础设施管理者与国际政府部门之间搭建安全信息交互通道,互相通报国防安全隐患与技术漏洞,是重中之重的举措。

难得一见!OpenAI与Anthropic达成和解,启动相互审核

此外,The Information还揭示:OpenAI与Anthropic正在最终敲定一份具有里程碑意义的协议——两方将相互进行对方商业模型的测验!

AMP

须知,Anthropic的创办团队当初正是因为在「AI安全」思想立场上同掌权者存在分歧,才选择离职创业的。

但如今,两大势力难得地走到了一起。

AMP

按照The Information的披露,这份处在洽谈阶段的协议涵盖了相互验证彼此模型,并制定了严苛的数据留存防护措施。这并非一次宣传噱头,而是当面对未知危机时,两大企业不得已的抱团取暖。

他们何以要采取此举?

这是因为伴随AI能力接近RSI的临界值,任何单一公司自行评价自身模型的安全性,就如同一位运动员为自己进行禁药检查——既缺乏可信度,又可能因技术盲点而漏掉关键的危险。

邀请实力相当的竞争方进行「交叉盲测」,实际上就构成了一个相互审核的约定。

AI安全的实践工作,当今已演化为一种命运休戚与共的局面。

若该协议最终得以贯彻,它将根本改变整片AI生态系统的安全体系。

AMP

届时,「安全与对齐」将不再只是一句空洞的标语。

一旦RSI已成现实,AI进行自我完善的速率将使人类相形见绌。

各大企业,真的能狠心踏下刹车吗?

文章出处:新智元


上一篇 2026/09/22 14:53
下一篇 2026/09/22 15:53

相关推荐

  • 一张班克西、一个十字架|俄罗斯大选如何「1001招」清除异议候选人

    俄罗斯杜马选举在即,至少36名候选人遭取消资格。班克西作品、苹果股票、摇滚纪念照……当局以荒诞借口清除竞选者。政治派系与安保集团暗战升级,反战派亚博卢党首当其冲。

    2026/09/22
    00
  • 是法律还是交易?取保候审里的「无罪陷阱」

    河南诈骗案揭示司法现实:坚持不认罪的被告遭长期羁押,而认罪者获得取保。这一颠倒现象背后,隐藏着有罪推定思维、考核机制扭曲和取保交易化的深层问题。法律未曾规定认罪是取保必要条件,实务却形成了变相强制的「潜规则」。

    2026/09/22
    00
  • OpenAI 补齐 GPT-6 全军:Sol 和 Luna 首秀能否引发价格战

    OpenAI 发布 GPT-6 Sol 与 Luna,价格均下降 50%。Sol 定位中阶任务,Luna 主攻轻量应用。除降价外,两款新模型还在对齐表现、沟通风格等方面有明显改进。AI 模型竞争焦点从「性能比拼」转向「单位成本」。

    2026/09/22
    00
  • 「从失踪到团聚」北京姑娘26年漂泊后的悲欢人生

    一位北京高知女孩因意外流落山东26年。通过DNA鉴定终于寻得家人,却已面目全非、精神失常。本文深层探讨拐卖人口犯罪的罪行与社会责任,呼吁对暗处罪恶的彻底追责。

    2026/09/22
    00
  • 破茧成蝶的威胁:胡塞如何借力AI从边缘武装升级为导弹工厂

    胡塞武装虽初看原始,实际已具远程打击能力。美国AI公司Anthropic揭露,该组织利用Claude Code进行武器研发,已建离线模型规避封禁。自2022年停火后,其生产能力指数增长,现拥百枚以上远程导弹、千架无人机,正从武器使用者向自主研发者转变。

    2026/09/22
    00

发表回复

登录后才能评论