阿里云发布Qwen2.5-Max超越DeepSeek-V3

中国科技巨头阿里巴巴旗下的阿里云周三发布“通义千问”旗舰版模型(Qwen2.5-Max)全新升级版,并声称该模型超越了备受推崇的DeepSeek-V3。

本周三,阿里云通义千问旗舰版模型(Qwen2.5-Max)正式发布。选在春节期间发布也反映出中国AI初创公司DeepSeek在过去三周的迅猛崛起不仅给海外竞争对手带来压力,也让国内同行压力倍增。

在其官方微信账号阿里云上发布的公告称,在六项基准测试中,Qwen2.5-Max比肩Claude-3.5-Sonnet,并几乎全面超越了GPT-4o、DeepSeek-V3及Llama-3.1-405B。”

其中,GPT-4o来自OpenAI,DeepSeek-V3来自深度求索DeepSeek,而Llama-3.1-405B则是Meta推出的最先进开源AI模型。

DeepSeek崛起引发竞争对手加速模型升级

DeepSeek于1月10日发布的DeepSeek人工智能助手由 DeepSeek-V3模型驱动,并在1月20日推出了R1模型,这一系列举措震惊硅谷,并导致多家科技公司股价下挫。

与此同时,DeepSeek的成功也促使国内竞争对手加紧升级自己的AI模型。

DeepSeek-R1发布两日后,字节跳动更新了其旗舰AI模型,并声称该模型在AIME测试中优于OpenAI的o1模型。

无独有偶,DeepSeek此前在推出新模型时也是拿ChatGPT的o1模型做比,表示其R1模型在多个性能基准测试中可与o1媲美。

DeepSeek与国内竞争对手的较量

DeepSeek-V3模型的前身DeepSeek-V2于去年5月发布后,在中国AI行业引发了一场价格战。

DeepSeek-V2的开源特性和极低的使用成本迫使阿里巴巴云计算部门宣布对其一系列模型降价,最高降幅达97%。随后,其他中国科技公司也纷纷跟进。

DeepSeek创始人梁文峰在去年7月接受采访时表示,自己的这间初创公司“并不在乎”价格战,而是专注于实现通用人工智能(AGI)。

与阿里巴巴等拥有数十万员工的中国科技巨头不同,DeepSeek更像是一个研究实验室,主要由中国顶尖大学的年轻毕业生和博士生组成。

梁文峰在采访中表示,他认为中国的大型科技公司可能并不适应AI行业的未来,将这些巨头的高成本与DeepSeek精简的运营进行了对比。

上一篇 2025/01/29 23:21
下一篇 2025/01/30 01:20

相关推荐

  • 川普「双面」人生:一边禁中企,一边与黑名单AI合作赚14亿

    川普支持的加密货币集团与被美国列为威胁的中国AI企业合作,川普家族获利超14亿美元。这一做法与政府对中国科技的强硬立场相悖,引发国家安全和利益冲突担忧。

    2026/08/18
    00
  • 价格战谢幕,性能时代开启——DeepSeek与Grok的深夜对决

    8月12日午夜,DeepSeek和SpaceX AI同步发布新模型,在智能体能力上展开激烈竞争。V4 Pro性能与Fable 5不相上下,定价仅为后者1/57。从永久降价到宣布涨价,DeepSeek的转身标志着AI行业已进入新阶段——头部厂商共识达成,性能而非价格才是真正的竞争壁垒。

    2026/08/12
    00
  • Claude文本加隐形「身份证」 Anthropic的追踪方案引发热议

    Anthropic宣布为Claude嵌入隐形水印,直接融入文本本身,可随文本流转。该举措源于欧盟AI法案,将全球推行,图片等文件附加数字签名元数据。但标记仅表明内容「可能」来自Claude,非铁证确凿。

    2026/08/11
    00
  • 开放人工智能是否将成为历史?

    中美两国正愈加将人工智能视为科技竞争的新领域。 据路透社报道,中国政府正与阿里巴巴、字节跳动和Z.ai等国内大型语言模型开发公司进行磋商,探讨限制外国获取最先进模型的可能性。讨论内…

    2026/07/09
    00
  • OpenAI发布GPT-Live语音新模型:支持边说边听,交互体验更贴近真实对话

    AI领域知名企业OpenAI于今日正式发布了全新的语音模型系列——GPT-Live。这一系列模型的最大亮点在于能够同步进行场景与表达,并会在对话中穿插“嗯哼”、“对啊”(yeah)…

    2026/07/08
    00