就在智谱AI推出GLM-5.2之后,6月18日,一位X平台用户向独立研究员兼AI开发博主Teortaxes抛出了一个问题:“中国大模型要到什么时候才能达到Fable的水平?”
Teortaxes给出了”约7个月差距”的判断。马斯克随即介入,留言称”大概是(2027年)第一季度”;智谱AI掌舵人唐杰则当即反驳,表示”用不了那么久”。

马斯克进一步补充道,在基准测试上缩小差距并不太难,但若以”真实使用价值”作为衡量尺度,明年一季度能追上已经相当了不起。

这场讨论有其具体背景:GLM-5.2在核心编程评测基准FrontierSWE上斩获74.4分,与Anthropic顶级闭源模型Opus 4.8相比仅差约1个百分点,同时还超越了GPT-5.5的表现。

此前华尔街见闻曾报道,美国商务部对Anthropic的Fable 5和Mythos 5两款模型实施出口管制,规定向任何外国用户开放访问均须事先获得政府许可,Anthropic因此随即关闭了这两款模型的境外访问通道。
技术层面的追赶态势与AI使用成本的大幅下降,正合力重塑全球人工智能的竞争版图。正如zerohedge所指出的,当”10%的智能落差”可能换来”90%的成本节省”时,超过5万亿美元的资本布局究竟是否出现了错配,将是市场持续追问、难以回避的深层命题。

时间表之争:从7个月到”用不了那么久”
这场争论的导火索,是Teortaxes对GLM-5.2综合能力位置的定性。
他判断,GLM-5.2的整体水平大致落在Opus 4.7到4.8之间。他同时指出,Opus本身的视觉能力偏弱,一旦将视觉维度纳入综合考量,中国模型与顶尖水平的差距大约对应7个月左右。
他的推算依据是:Mythos模型于2026年2月初进入Preview状态(即具备不低于Opus 4.8的功能水准),以此作为参照点向后推算,中国模型完整达到”Fable”量级的时间窗口,预计落在2026年11月至12月之间。
马斯克的预估则更为谨慎,仅用”Probably Q1″一语带过,意即2027年第一季度。
不过他随即补充了一个重要区分:从基准测试的维度看,追赶的速度或许确实令人刮目相看;但一旦换成”真实使用价值”这把尺子来量,即便到了第一季度能够比肩,那也已经殊为不易。
他特别点出Anthropic的核心竞争力在于持续专注于提升真实智能——这种优势不会直接体现在跑分上,却会清晰地映射在营收数字里。
对于马斯克的这番判断,部分AI业内人士认为他的预测偏于保守,中美两国模型之间的实际时间差,很可能比7个月还要短。
谷歌DeepMind CEO德米斯·哈萨比斯此前也曾公开表示,中国AI模型在能力上距离国际前沿或许”仅差几个月”。