发布于2026-08-24 阅读(0)
扫一扫,手机访问
GLM-5.2刚上线没多久,关于中国大模型什么时候能追上Anthropic最新Fable级别的问题,就引发了一场不大不小的公开讨论——参与方分别是马斯克,以及亲手打造出GLM-5.2的智谱创始人唐杰。

先说说这个讨论的缘起。智谱AI最近上线并开源了新一代旗舰模型GLM-5.2,成绩相当亮眼:在FrontierSWE编程基准测试中拿到了74.4分,这个分数已经很接近Anthropic最强的Claude Opus 4.8。更夸张的是,在一个由全球百万用户盲测的前端开发评估系统Code Arena上,GLM-5.2直接拿下了全球可用模型的第一名。
这条消息传开后,有用户在X上向独立研究员、AI博主Teortaxes提了个问题:“中国大模型什么时候能到Fable级别?”
这里说的“Fable”,指的是Anthropic在6月9日向公众开放的那款“Mythos级别”模型——Claude Fable 5。按照Anthropic自己的说法,Fable 5的性能超过了自家之前发布的所有模型,在几乎所有AI基准测试里都处于领先水平。
——Teortaxes的推算:7个月差距
针对这个问题,Teortaxes给出了一个分两步走的大致判断:
第一步,先给GLM-5.2定个位。在他看来,GLM-5.2的整体能力大致相当于Claude Opus 4.7到4.8之间。
第二步,再看看目标在哪里。Mythos这个梯队(Fable所在的那个级别),其实早在2026年2月就已经进入了预览状态,完整版是在今年6月才正式开放的。注意,这个时间点很关键。
有了这两个参照点之后,Teortaxes推出来的结论是:中美模型之间大概差了7个月左右,时间窗口差不多在2026年11月到12月之间。
——马斯克的判断:可能2027年Q1
没想到这个帖子把马斯克给炸出来了。他在下面回了一句:“可能(2027年)第一季度。”
不过马斯克随后又追加了一个重要分层——他说如果单看基准测试,追赶的速度确实令人印象深刻;但要是拿“真实的实用性”来当尺子,就算到2027年Q1能赶上,也已经算相当不错了。
他还特别点了一句:Anthropic真正厉害的地方,是它在“有用的智能”上的专注。这种能力不一定体现在基准测试的分数上,但会直接反映在营收数字里。
——唐杰的回应:“不需要那么久”
既然提到了GLM-5.2,那被点名的唐杰自然也坐不住了。他在X上给出了一个简短但有力的回应:“won't take that long”——不需要那么久。
唐杰没有给出具体的年份或季度,但这句话本身就已经很能说明问题了:智谱对自己迭代速度的信心,显然不是一般的高。
从Teortaxes的“7个月”,到马斯克的“2027年Q1”,再到唐杰的“不需要那么久”——三个时间预期之间横亘的,不只是技术判断的差异,更是对“追赶”这件事理解方式的不同。到底是基准测试先行,还是实用性为王,这个问题的答案,或许会直接决定最终的节奏。
关于“中国大模型何时追上Fable”这个问题,笔者的看法是:技术层面的追赶或许比多数人想象的要快,但真正意义上的“对标”能否在2027年之内完成,恐怕还得看各家在“有用的智能”这条线上能跑出什么样的加速度来。
售后无忧
立即购买>office旗舰店
售后无忧
立即购买>office旗舰店
售后无忧
立即购买>office旗舰店
售后无忧
立即购买>office旗舰店
正版软件
正版软件
正版软件
正版软件
正版软件
1
2
3
4
5
6
7
8
9