中国科技巨头阿里巴巴旗下的阿里云周三发布“通义千问”旗舰版模型(Qwen2.5-Max)全新升级版,并声称该模型超越了备受推崇的DeepSeek-V3。
本周三,阿里云通义千问旗舰版模型(Qwen2.5-Max)正式发布。选在春节期间发布也反映出中国AI初创公司DeepSeek在过去三周的迅猛崛起不仅给海外竞争对手带来压力,也让国内同行压力倍增。
在其官方微信账号阿里云上发布的公告称,在六项基准测试中,Qwen2.5-Max比肩Claude-3.5-Sonnet,并几乎全面超越了GPT-4o、DeepSeek-V3及Llama-3.1-405B。”
其中,GPT-4o来自OpenAI,DeepSeek-V3来自深度求索DeepSeek,而Llama-3.1-405B则是Meta推出的最先进开源AI模型。
DeepSeek崛起引发竞争对手加速模型升级
DeepSeek于1月10日发布的DeepSeek人工智能助手由 DeepSeek-V3模型驱动,并在1月20日推出了R1模型,这一系列举措震惊硅谷,并导致多家科技公司股价下挫。
与此同时,DeepSeek的成功也促使国内竞争对手加紧升级自己的AI模型。
DeepSeek-R1发布两日后,字节跳动更新了其旗舰AI模型,并声称该模型在AIME测试中优于OpenAI的o1模型。
无独有偶,DeepSeek此前在推出新模型时也是拿ChatGPT的o1模型做比,表示其R1模型在多个性能基准测试中可与o1媲美。
DeepSeek与国内竞争对手的较量
DeepSeek-V3模型的前身DeepSeek-V2于去年5月发布后,在中国AI行业引发了一场价格战。
DeepSeek-V2的开源特性和极低的使用成本迫使阿里巴巴云计算部门宣布对其一系列模型降价,最高降幅达97%。随后,其他中国科技公司也纷纷跟进。
DeepSeek创始人梁文峰在去年7月接受采访时表示,自己的这间初创公司“并不在乎”价格战,而是专注于实现通用人工智能(AGI)。
与阿里巴巴等拥有数十万员工的中国科技巨头不同,DeepSeek更像是一个研究实验室,主要由中国顶尖大学的年轻毕业生和博士生组成。
梁文峰在采访中表示,他认为中国的大型科技公司可能并不适应AI行业的未来,将这些巨头的高成本与DeepSeek精简的运营进行了对比。