业内研究机构通过全球AI模型基准测试发现,中国初创DeepSeek旗下的某版本模型在成本竞争力上表现遥遥领先。其运行费用与Anthropic的Claude Fable 5相比,差距大得惊人——前者仅为后者的百分之一都不到。

IPO融资计划曝光之际,DeepSeek于周五推出V4-Flash模型,继续贯彻其既定策略——以极具竞争力的价格提供AI解决方案。路透社援引知情人士的消息显示,这家公司正在筹备上市事宜。
R1模型在本年初的横空出世掀起了全球轩然大波,不仅引爆了科技圈,还引发了股市震荡,众人开始质疑美国科技巨头在AI领域的巨额投入是否物有所值。
人工分析机构(Artificial Analysis)公开了V4-Flash的定价细节。处理百万级输入数据单位需支付0.14美元,生成等量输出内容则为0.28美元。其中Token作为AI计费的基础度量单位,代表数据处理的体量。
这家位于旧金山的分析机构进一步估算,V4-Flash完成一轮评估的成本仅为3美分。反观整个竞争格局,月之暗面的Kimi K3需要86美分,OpenAI的GPT-5.6 Sol要1.86美元,而Claude Fable 5则需3.15美元。成本悬殊由此可见一斑。

为何这种对标方式比单纯的价格对比更具说服力?关键在于它衡量的是完成实际任务所需的总投入。某些标价低廉的模型,若需多轮迭代才能输出结果,最终成本仍可能高企。
DeepSeek曾是舆论焦点,如今却陷入群雄割据的局面。来自月之暗面、稀宇科技(MiniMax)、智谱AI等初创企业的挑战,以及来自字节跳动、阿里巴巴等科技巨头的压力,齐头并进。这些中国企业都在争夺那些寻求低成本大规模部署AI技术的全球客户。
性能评估上,人工分析给出了明确数据。V4-Flash在「智能指数」上得50分(满分100),该指数综合了编程、推理、职场应用等9项测试结果。与谷歌的Gemini 3.6 Flash打成平手,但被Meta的Muse Spark 1.1和智谱AI的GLM-5.2压过1分。
Kimi K3的得分则达到57分,而Claude Opus 5、Fable 5以及OpenAI的GPT-5.6等则均超59分。值得注意的是,DeepSeek也在开发性能更强的V4-Pro版本,但具体发布日期尚未透露。
平行之处,阿里巴巴也不甘落后。周一发布的Qwen3.8-Max是其迄今为止规模最宏大、能力最全面的产品。就参数量而言,与月之暗面上月推出的产品相差无几。
Qwen3.8-Max配备2.4万亿参数——这些是模型通过学习从而识别规律、生成输出、执行任务的数值权重。而Kimi K3拥有2.8万亿参数。虽然参数数量并非衡量模型优劣的唯一标准,但它已成为业界观察先进AI系统背后算力与数据投入的重要指标。
国内科技企业习惯公开参数规模,借此吸引开发者的关注。这些模型多数采用开放权重架构,允许开发者下载、运行或适配底层学习参数。与之相反,OpenAI、Anthropic和谷歌则对闭源模型的参数数据保密。
Qwen3.8-Max在众包评测平台Arena.AI上线后,迅速成为中文文本类的榜单冠军。虽然在与Claude Fable 5及其Opus系列三个变体的对标中仍有差距,但已属本土顶尖。
在视觉素材识别能力的排行上,Qwen3.8-Max的表现更为抢眼——全球排名第二,仅被Claude Fable 5的某个变体版本压过。Qwen3.8-Max和Kimi K3均具备文本、图像、视频的处理能力,单次可处理Token数量高达100万。
降低成本的秘诀何在?阿里提供了答案:采用「混合专家」(Mixture-of-Experts)架构。这种设计摒弃了为每个请求动员整个系统的做法,而是让不同功能模块根据任务需求各司其职。每次仅激活950亿参数,既降低运营费用,又加快响应速度。
实际表现上,阿里称该模型在16天内就完成了整个软件工程项目。Qwen3.8-Max将于下周通过阿里云的百炼平台正式推送给用户。