中国AI初创公司DeepSeek如何与硅谷巨头竞争?

圣诞节的第二天,一家名为深度求索(DeepSeek)的中国小型初创公司发布了一个新的人工智能系统,其功能可与OpenAI和谷歌等公司的尖端聊天机器人相媲美。

能做到这点本已是一个里程碑。但这个名为DeepSeek-V3的大模型背后的团队描述了一个更大的进步。深度求索的工程师在介绍他们如何构建这个大模型的研究论文中写道,他们在训练该系统时只用了领先人工智能公司用的高度专业化计算机芯片的一小部分。

这些芯片是美中激烈技术竞争的核心。随着美国政府努力保持本国在全球人工智能竞争中的领先地位,它正在试图对能出售给中国以及其他竞争对手的高性能芯片(如硅谷公司英伟达生产的那些)进行限制。

但DeepSeek大模型的表现让人们对美国政府贸易限制的意外后果产生了质疑。美国的出口管制措施已迫使中国研究人员使用互联网上免费提供的各种工具来发挥创造力。

据美国人工智能公司一直使用的行业基准测试,DeepSeek聊天机器人能回答问题、解决逻辑问题,并编写自己的计算机程序,其能力不亚于市场上已有的任何产品。

而且它的造价很低,挑战了只有最大的科技企业(它们全都在美国)才能制造出最先进的人工智能系统的普遍观念。中国工程师称,他们只花了约600万美元的原始计算能力就训练了新模型,不到科技巨头Meta训练其最新人工智能模型所耗资金的十分之一。

“有600万美元资金的公司在数量上远远多于有1亿美元或10亿美元资金的公司,”风险投资公司Page OneVentures的投资人克里斯·尼科尔森说道,他主要投资人工智能技术。

自从OpenAI2022年发布了ChatGPT,引发人工智能热潮以来,许多专家和投资者曾得出结论认为,如果不投入数亿美元购买人工智能专用芯片的话,没有公司能与行业领军者竞争。

世界领先的人工智能公司用超级计算机来训练它们的聊天机器人,这些超级计算机需要多达1.6万个芯片,甚至更多。但DeepSeek的工程师却说,他们只用了约2000个英伟达生产的专用芯片。

中国进口芯片受到限制,迫使DeepSeek工程师“更有效地训练大模型,以让其仍有竞争力”,乔治华盛顿大学专门研究新兴技术和国际关系的助理教授杰弗里·丁(音)说。

本月早些时候,拜登政府颁布了旨在阻止中国通过其他国家获得先进人工智能芯片的新规则。新规则出台前,美国已采取了多轮限制措施,阻止中国公司购买或制造尖端计算机芯片。特朗普总统尚未表明他是否会继续实施或取消这些措施。

美国政府一直试图阻止中国公司获得先进芯片,因为担心这些芯片可能用于军事目的。作为回应,中国的一些公司囤积了大量这类芯片,另一些公司则在蓬勃发展的黑市采购走私芯片。

DeepSeek由一家名叫幻方的量化股票交易公司运营。到2001年,它已将利润投入购买数千枚英伟达芯片,用于训练其早期模型。

DeepSeek不制造任何消费者产品,而是让工程师全神贯注地做研究。这意味着其技术不受中国有关人工智能法规中最严格部分的限制,中国要求面向消费者的技术必须遵循政府对信息的控制。

领先的美国公司继续推动人工智能的发展。去年12月,OpenAI公布了一款性能超过现有技术的名为o3的新“推理”系统,尽管该系统尚未在该公司以外得到广泛使用。但DeepSeek继续表明自己并不落后,它在本月发布了自己的一个推理模型,性能同样令人印象深刻。

这个快速变化的全球市场的关键部分是一个存在已久的想法:开源软件。与许多其他公司一样,DeepSeek也将其最新的人工智能模型放入开源软件系统,这意味着它已经与其他企业和研究人员共享了基础代码,让其他人能用相同的技术构建和发布自己的产品。

虽然中国大型科技企业的员工只与自己的同事合作,但“如果你从事开源软件开发,你其实是在与世界各地的人才合作”,旧金山Baseten的首席软件工程师张一能(音)说。

2023年,Meta免费分享了一个名为LLama的人工智能模型后,人工智能的开源生态系统开始蓬勃发展。许多人曾假设,只有像Meta这样的科技巨头——拥有使用大量专用芯片的大型数据中心——继续开源其技术,人工智能社区才会蓬勃发展。但DeepSeek和其他公司已表明,它们也可以拓展开源技术的能力。

许多高管和专家认为,美国大公司不应该开源其技术,因为它们能被用来传播虚假信息或造成其他严重危害。一些美国立法者已在探索阻止或限制开源的可能性。

但也有人认为,如果监管机构扼杀了开源技术在美国的进步,中国将获得显著优势。他们认为,如果最好的开源技术来自中国,美国开发人员将在这些技术的基础上构建他们的系统。从长远来看,这可能会让中国成为研发人工智能的中心。

“开源社区的重心已在向中国转移,”加州大学伯克利分校计算机科学教授伊恩·斯托伊卡说。“这对美国来说可能是一个巨大的危险”,因为它让中国得以加速新技术的研发。

就职典礼数小时后,特朗普总统撤销了拜登政府威胁限制开源技术的行政命令。

斯托伊卡和他的学生最近构建了一个名为Sky-T1的人工智能模型,在某些基准测试中,该模型的性能可与最新的OpenAI系统——OpenAIo1相媲美。他们的模型只需要450美元的计算能力。

多伦多的技术顾问鲁文·科恩从去年12月下旬起一直在使用DeepSeek-V3。他说,该模型与OpenAI、谷歌,以及旧金山初创公司Anthropic的最新系统能力相当,而且使用起来便宜得多。

“DeepSeek是让我省钱的办法,”他说。“这是像我这样的人想用的技术。”

上一篇 2025/01/24 08:21
下一篇 2025/01/24 20:25

相关推荐

  • 川普「双面」人生:一边禁中企,一边与黑名单AI合作赚14亿

    川普支持的加密货币集团与被美国列为威胁的中国AI企业合作,川普家族获利超14亿美元。这一做法与政府对中国科技的强硬立场相悖,引发国家安全和利益冲突担忧。

    2026/08/18
    00
  • 价格战谢幕,性能时代开启——DeepSeek与Grok的深夜对决

    8月12日午夜,DeepSeek和SpaceX AI同步发布新模型,在智能体能力上展开激烈竞争。V4 Pro性能与Fable 5不相上下,定价仅为后者1/57。从永久降价到宣布涨价,DeepSeek的转身标志着AI行业已进入新阶段——头部厂商共识达成,性能而非价格才是真正的竞争壁垒。

    2026/08/12
    00
  • Claude文本加隐形「身份证」 Anthropic的追踪方案引发热议

    Anthropic宣布为Claude嵌入隐形水印,直接融入文本本身,可随文本流转。该举措源于欧盟AI法案,将全球推行,图片等文件附加数字签名元数据。但标记仅表明内容「可能」来自Claude,非铁证确凿。

    2026/08/11
    00
  • 开放人工智能是否将成为历史?

    中美两国正愈加将人工智能视为科技竞争的新领域。 据路透社报道,中国政府正与阿里巴巴、字节跳动和Z.ai等国内大型语言模型开发公司进行磋商,探讨限制外国获取最先进模型的可能性。讨论内…

    2026/07/09
    00
  • OpenAI发布GPT-Live语音新模型:支持边说边听,交互体验更贴近真实对话

    AI领域知名企业OpenAI于今日正式发布了全新的语音模型系列——GPT-Live。这一系列模型的最大亮点在于能够同步进行场景与表达,并会在对话中穿插“嗯哼”、“对啊”(yeah)…

    2026/07/08
    00