「AI安全的两面镜」|中美竞争背后的价值观对立

要勾勒中国人工智能版图的最前沿,绕不开唐杰这个名字。

这位具有数据工程背景的业界人士与他人共建了中国最顶尖的AI实验室智谱AI(Z.ai),并兼任首席科学家和最大个人股东。该公司开发的模型已迈入国内顶级序列,也因此让唐杰稳居中国AI生态的领导地位。

从某种角度看,唐杰对人工智能的言论与美国Anthropic公司(Claude背后的力量)联合创始人兼首席执行官阿莫迪的表述似乎有着共鸣。阿莫迪因既肯定AI前景又警告其危害而在业界享有盛名。唐杰则将近乎乌托邦的理想与所谓「极致安全治理」这一「最沉甸甸的责任」融为一体。

「当技术已具有改写文明进程的能量时,安全就不再是可有可无的配件,而是这项技术得以永续和被许可应用的根本基础。」唐杰在七月发出的一封员工信中如是表示。

这样的论述虽然在字面上与美国领先的AI机构的警示不无相似,但若要深入理解,需置于习近平主席的政治话语框架中——对他而言,人工智能的「安全」最终指向一个核心诉求:中共执政的安全。

西方多个民主国家将讨论的中心放在AI对社会的潜在危害,中国最为关切的却是其对统治体系的威胁。中国的模型因审查政治敏感议题、适应国家管制制度而闻名。但唐杰等开发者在做得更加深入——他们要将执政党的政治理念层层嵌入模型的底层代码,这对中国AI系统所承载的价值观及其可能存在的弱点具有深远的意义。

理解这场在塑造下一个世纪的技术上所展现的观念鸿沟,对于把握特朗普与习近平本周四在白宫的会谈基调至关紧要。两国领导人准备探讨如何管控AI的风险。然而要达成实质性协议面临巨大困难,甚至几乎无望成功,原因在于太平洋两岸对「AI安全」的定义属于完全不同的话语体系。

这种分歧的影响可能是巨大的。唐杰和他的同事正在向模型中注入特定的价值体系,从而深刻影响模型对世界的理解与应对方式。随着中国AI系统在全球范围内得到越来越广泛的应用,这些植入其中的价值观也可能扩散开来,将执政党的政治视角无形地传到远超中国国土的地方。

在唐杰的那封信发出六天后,习近平于七月十七日在上海出席全球人工智能峰会,展现了他的政策思路。在官方英文表述中,习近平指出「China lays great emphasis on safety and security in A.I.」(中国高度重视人工智能的安全与保障),并致力于确保其「safe, secure and controllable」(安全、可靠与可控)。在与特朗普预定会面前夕,这似乎传递出一个令人放心的信号。

然而,中国官方媒体在向外国观众翻译领导人讲话时,往往会软化其政治意蕴。习近平用中文原话的意思是:中国坚持「发展和安全并重」,确保「人工智能安全、可靠、可控」。

翻译上这似乎只是措辞的细微差异。但在习的理论话语中,「安全」与「控制」等关键词的根本所指就是执政党的政治安全。他多次明确表示,维护中国社会主义制度在快变的世界中的长期稳定,是他执政议程的核心。

如今硅谷的开拓者多成长于自由民主制度下,他们接触的科幻想象通常讲述人类出于善意创造的机器最终可能毁灭人类的故事。阿莫迪在今年一月发表的关于AI风险的文章《技术的青年期》开篇引用了他最喜爱的一部影片《超越时空接触》(Contact)的情景:朱迪·福斯特扮演的女主人公被问及想对来自外太空并建立无线电联系的高等文明说什么。

她的回答是:「你们是如何演化而来的?你们如何度过这个技术青年期而没有毁灭自己?」

该文详尽阐述了如何管理阿莫迪所参与开发的技术所内在具有的灾难性风险,其中包括将安全理念融入AI,使其与模型本身浑然一体。这种被称为「宪政AI」(constitutional A.I.)的方法,试图在价值品质的层面教导这项技术何为「合格的AI」——「就像一个正在形塑自身身份的成长期孩童,」阿莫迪写道。

Anthropric注入其模型的价值观汲取于《世界人权宣言》,特别强调信息获取权、法治精神、政治自由、民族自决权和个人权利。

Google DeepMind的共同创始人兼主席德米斯·哈萨比斯也制定了一套明确植根于民主价值观的AI原则,并主张民主制度的国家应在「自由、平等和尊重人权等根本价值观的指导下」推动AI的发展。

而中国新一代科技领袖则成长在迥然不同的背景中——在一个威权体制内,自由民主理念被定性为敌对意识形态,科技的研发与部署完全服从于执政党的战略利益。

习近平任命的国家安全部部长陈一新在本月发表的一篇关于AI风险的文章中清晰诠释了这一点。陈一新完全没有提及困扰美国AI先驱们的存在性风险,即AI失控而伤害人类的恐惧。相反,他强调中国必须加强防御敌对势力利用这一强大工具「直接威胁我国政治安全、制度安全、意识形态安全」。

在陈一新的论述框架中,人工智能的安全系于大力推进中国AI发展以防被美国拉开差距,他暗示这样的滞后才是对中国最大的威胁。中国日趋完善的AI监管体系也将防范对社会主义价值体制、国家权力和政治稳定的冲击列为政府的核心安全关切。

外界对极少公开发言的唐杰这个人物知之不多。他与清华大学这所北京顶级学府的知识工程实验室其他成员合作创办了智谱AI。该团队曾开发出用于分析社交网络和信息流动的先进工具,包括可对国内外研究人员进行身份刻画、地理定位和绘制关系网络的系统,这些被定位为人才招聘工具。

唐杰在七月的信中否决了为AI加装「外挂式」安全防护的做法,转而主张必须将行为准则融入公司模型的深层架构中,具体是把国家法律、发展战略与安全考量——说到底就是执政党的政治利益——写入AI的基因代码中。到了八月,唐杰更进一步,发表评论文章倡议通过立法对中国AI产业强制推行意识形态一致性。

前不久,他的公司发布了中国最强大的AI模型之一GLM-5.3。智谱AI将其定位为一款低成本、易获得且功能强大的开源权重文件,其性能已接近Anthropic高端网络安全模型Mythos 5的水准。用户可以下载并调整开源权重文件,针对特定任务进行参数微调,尽管其中根深蒂固的约束可能难以完全清除。智谱AI主张将这类尖端工具向全球开发者和网络安全团队开放,这条路线与Anthropic和OpenAI采取的保密专有模型方案形成了鲜明对比。

尽管唐杰高调宣扬开放,智谱AI在模型训练和评估方法上却几乎毫无透明度可言。此外,中国公民、企业及其他社会组织均受《国家安全法》约束,该法规定他们有义务在接到要求时配合国家安全工作。智谱AI的运营数据显示,其模型发现的安全缺陷会上报给中方当局,包括向国家安全隐患数据库提交网络漏洞讯息的整理和汇总,而这个数据库正是由陈一新领导的国家安全部门管理。

这引出了一个令人不安的疑问,尤其是在中国开源AI模型在海外广泛使用的背景下:如果智谱AI发现一个严重的安全漏洞,究竟是需要修复该漏洞的公司先获悉,还是中国政府先获悉?

美国顶尖AI机构的研究人员,以及美国及其盟国的政府机构,对「沉睡特工」(sleeper agents)这类潜伏威胁日益表示关注。这种隐蔽的恶意指令可提前植入AI模型内部,保持隐伏状态直至某个特定条件触发它们,极其不易被检测或移除。而伴随着具有更高自主度、可直接操控计算机系统的「智能体型」AI的出现,这种危险被进一步放大。

以上种种都突出了中美两国在人工智能领域寻求共识的紧迫性——同时也充分说明了为什么达成这种共识将极其困难。

中共致力于在与美国的竞争中获胜,并将政权安全放在首位,这使得两方在AI的灾难性风险上几乎没有达成共识的可能。而特朗普似乎也认为,地缘竞争的重要性超过了不受约束的AI发展所带来的危害,他近日在多个公开场合和社交平台反复否定监管的必要性。

特朗普的这种自由市场态度忽视了正在浮现的更大全局。围绕AI的竞争已不止于谁的技术更先进,而是关乎自由、安全与国家职能等观念的较量。胜出的观念理想将被融入到越来越深刻地塑造社会思维、决策流程和权力运作的巨大系统之中。


上一篇 2026/09/26 02:00
下一篇 2026/09/26 02:00

相关推荐

  • 常春藤名校曝性侵丑闻:女大学生遭多人下药侵害数小时,校方态度令人失望

    美国常春藤名校康乃尔大学曝出严重性侵事件。一名女学生控诉在2024年10月被兄弟会7名成员下药性侵,遭灌酒、强迫吸毒,过程持续至次日清晨。检方未起诉,校方处分轻微。受害女生因心理创伤休学。此案引发关于校园安全的深思。

    2026/09/27
    00
  • 突发|美国200年来首次处决女性死囚,她在18岁时就犯下了骇人罪行

    美国田纳西州50岁女死囚派克将于月底被执行死刑,成为该州逾200年来首度被判处极刑的女性罪犯。派克在1995年年仅18岁时,因怀疑同学勾引男友,与其男友及好友联手进行了残暴杀害。派克被判一级谋杀罪。如今行刑日近,派克提出多项诉求,律师团申请减刑,但受害者家属强烈反对。

    2026/09/27
    00
  • 权力游戏中的谢幕者|联合国「铁娘子」为何同时失去中美青睐

    智利前总统巴切莱特在联合国秘书长竞选中遭遇滑铁卢,仅获1票支持却收获11票反对与3票弃权,被迫退选。她的出局并非因缺乏履历,而源于在涉华和涉美问题上的战略失误,同时触怒两个大国核心底线,最终被多边权力秩序无情清算。

    2026/09/27
    00
  • 震撼:TikTok向美国支付巨额赔款,未成年用户将被严格管控

    TikTok与阿拉巴马州达成历史性和解,承诺支付一亿美元并实施儿童使用管制措施。新政策包括每日两小时使用限额、夜间禁用、年龄认证等。这是短视频平台在美国各州的首次和解协议,防止未成年人成瘾问题的又一重要举措。

    2026/09/27
    00
  • 财政困局下的激进决策:乌克兰力推色情产业合法化筹资

    面对270亿美元军费缺口,乌克兰国会推进色情产业除罪化法案。年度税收进账预计达2500万美元,用于采购无人机等军事装备。该举措源于百万粉丝OnlyFans创作者德沃尼科娃的请愿——她缴纳90万美元税款后遭刑事起诉,引发2.5万人连署支持。2023年数据显示,近8000名乌克兰创作者年收入超1.31亿美元。

    2026/09/27
    00

发表回复

登录后才能评论