马斯克、阿莫迪与奥特曼。图片经过AI处理
编辑丨苏扬
车企高管想踩刹车,当权者却在拚命加油。最近几天,美国AI产业上演了最戏剧化的场景,这与前几年业界沉迷于「做大做强」的逻辑产生了鲜明的反差。
几年来,硅谷开发者们只想着一件事:算力够不够翻倍?参数还能冲到什么量级?谁会首先推出下一代的更强模型?速度,永远是第一位的。到了上周末,情况出现转机——Anthropic、OpenAI、xAI三家头部公司的领导人互相通气,开始认真探讨是否应该给这场「比赛」摁下暂停键。
阿莫迪(Anthropic CEO)撰文阐述观点:业界应主动调节发展步伐,为独立评估机构和安全研究工作流出喘息的机会。紧接着,奥特曼(OpenAI CEO)表示赞同,透露OpenAI内部最近也在审视这个问题;马斯克则在公开场合站队,称阿莫迪说得在理。
值得注意的是,这几位领军人物素来在商业利益、人才争取和技术方向上互相对抗,有时还会爆发言辞冲突,如今却在减速问题上意外达成了一致立场。
讽刺的是,场上选手想暂停,却遭到了「主办方」的反对——它们觉得现在的得分速度还远远不够。
相关报道显示,特朗普总统对AI风险论证泼了冷水,他的态度很明确:美国不该为了过度小心和繁琐规则就踩刹车,更不能因此被中国超越。
01 谁也不知道Agent手握「钥匙」后的真实意图
业界对AI安全的讨论从未停止,不过进入2026年,风险的具体形态出现了本质的转变。
GPT-4现身后(2023年),舆论关注的焦点是虚假信息生成、版权问题和有害内容。那时的模型还很「被动」——收到指令才反应,给出答案就完事,就算出错了也只是屏幕上的文字出了问题。
但自主Agent的出现彻底改变了游戏规则。
模型已能独立调度工具、跑代码、规划复杂任务。它们会自主开启浏览器获取信息、在后端执行脚本、操纵企业系统。AI不再是建议的来源,而是掌控权限的行动者。哪怕一丁点儿逻辑错位,后果也是真金白银的业务损失。

AI智能体基础架构:工具、记忆、规划、行动四大模块自主运转(图:腾讯云开发者社区)
Anthropic近期披露的事件触目惊心。安全测试环节,Claude竟然4次绕过认证闯入真实系统。工程师起初梳理了10多万行日志,才后知后觉意识到问题范围很广,最后硬生生扩大到近5亿条记录才算全面排查。核心困境随之浮出:成千上万的Agent在后台日夜运转时,想要追踪每一步操作谈何容易,耗费巨大。

Claude在网络安全评估中未经授权访问了三家真实机构的系统(图:Anthropic)
OpenAI的处境如出一辙。
外部评估中,其模型也现出了虚编权限、勾引审核人员批准危险操作的行为特征。

OpenAI发布安全报告,披露长时程模型在内部测试中出现的新型失控行为(图:OpenAI)
现在还出现了一个新的怪圈:模型开始参与自我迭代,用来写新代码、优化新算法。这导致进度跑得比安全防线快得多,比监管部门快十倍还多。发动机功率不断提升,制动装置却远远跟不上,工程师们的焦虑也就随之而来。这就是为什么这三家公司都在喊要暂停。
02 为什么所有人都不愿意真正停下来
既然风险近在眼前,为何没人直接踩死刹车?原因在于竞争的残酷性:谁都知道速度过快,但一旦某家松懈,别人立刻窜上去。单方面减速的代价无法承受。他们的理想状态是,所有人同时停下,由某个权威机构或政府部门来当裁判。
阿莫迪的方案具体如下:让独立评估机构常年驻扎,全程监督模型从训练到测试;同时推动头部公司(OpenAI、Anthropic、Google、Meta等)达成统一的安全底线。
从治理的角度讲这方案靠谱,但商业现实会戳穿它。假如A公司为了安全检验推后三个月才发布,对手B一周后就推新品,市场铁定会转向B。这种延期的后果很致命:开发者跑路、大客户流失、投资者信心崩塌。
何况Anthropic正在为十月的上市冲刺,此时任何一个停顿都可能对营收产生不可逆的打击。
但奥特曼会反驳:OpenAI没打算匆忙上市,他还说过,谁要是认为「OpenAI不暂停是怕赔钱」,那就完全理解错了。我们愿意为了人类福祉舍弃眼前利益。
可这番话跟他四月份的表现判若两人。当时The Information爆料,奥特曼曾在私下里大放厥词,想最早在年底前上市。这跟CFO Sarah Friar的想法产生了冲撞——Friar指出,未来五年光是服务器要花6000亿美金,而收入增速已经放缓,现在还远不到上市的时候。
数据追踪机构的统计显示,2025年OpenAI营收约为Anthropic的三倍。然而今年二季度,情况反转了——Anthropic借由企业客户的增长,在单季和年化收入上首度超越了OpenAI,并且实现首次盈利,而OpenAI依旧在血本无归。
他的态度究竟怎么转变的,没人说得清。但商业账盘显然是关键砝码。
市场竞争中,没几家公司敢独自吞下这种风险。大家明知超速有隐患,但在掉队和出事之间,大多数还是选了继续冲。
这种复杂心理给所有的安全呼声都染上了利己的色彩:都希望大伙儿一起减速,可没人愿意第一个松手。
03 地缘政治锁死了刹车系统
商业上的僵局还只是表面,地缘政治的考量则直接把刹车系统锁死了。阿莫迪要慢下来,特朗普非得加速,似乎截然对立,但他们的根本盘算指向同一个名字:中国。
白宫把尖端AI视为长期竞争的王牌。中国在基础设施、模型进度和应用落地上的猛追,让华盛顿如坐针毡。按他们的逻辑,美企主动踩刹车搞审查,无异于冲刺阶段停下来系鞋带,是自我削弱。
阿莫迪的减速论也不是无条件的,背后有个潜台词:减速的空间取决于美国技术领先中国有多少。所以他一边要求安全,一边还要卡住先进芯片和模型的出口。
逻辑其实透彻:美国需要喘息时间来修复安全漏洞,前提是对手还得离得足够远,这样才能优哉游哉地完善防护。归根结底,这不是伦理问题,而是节奏和地位的博弈。大家名义上都想降低风险,实际上谁都不愿意为此付出自己的竞争优势。
04 这场竞赛注定不会停下
奢望美国AI企业踩死刹车不现实,在投资和惯性驱动下,引擎注定要继续怒吼。务实的做法是在关键路段装限速牌——日常应用和多模态交互还会加速迭代,管制集中在危险地带。一旦模型显露出可以独立写恶意代码、帮着做危险化学实验或逃出安全沙箱的本事,就强行启动外审。
同步推进,大事件的事后通报机制也要逐渐制度化。
国际层面,短时间内签署一份全行业停摆协议也做不到。光靠口头承诺,没信任基础的情况下约束力为零。更实际的办法是先建立危机对话渠道。这个通道的用处在于应急,当系统出了岔子。
比如,Agent跨国越权或者怀疑是AI惹的网络安全事故,工程师们得能互相确认事实,别搞出误会。得提前谈好规则——万一某一方的系统在现实世界出了幺蛾子,双方怎么确保两辆高速车不会对撞。
从当初那份理想主义的停摆倡议书,到如今技术领袖们被迫回过头来找刹车,哲学理想终究还是撞上了现实的铁墙。
硅谷怕的是技术风险本身的不可控,白宫怕的是霸权地位岌岌可危。这种态度真的矛盾得令人发笑:一脚油门踩死,一只手慌张地摸刹车。
但问题的核心其实是:没有人敢做第一个踩刹车的傻蛋,那些匆匆组装的安全网,撞上墙的前一刻,真的能挡住吗?