智谱GLM-5.2登顶全球前三:中国AI大模型首次打入世界顶级阵营
6月18日,富瑞发布研报指出,智谱旗下GLM-5.2模型在Artificial Analysis模型智能指数中排名全球第三,成为中国AI发展里程碑。更令人瞩目的是,6月20日Design Arena单轮HTML网页设计评测中,GLM-5.2超过Claude Fable 5等模型,首次登顶总分第一。从编程能力全球第四,到智能体能力全球第二,再到设计评测登顶——中国大模型用一组数据宣告:全球AI竞赛的格局正在被改写。
三份榜单,同一信号
如果把过去一周的AI评测榜单拼在一起,会发现一个清晰的信号:智谱GLM-5.2正在多个维度同时冲击全球顶尖水平。
Artificial Analysis模型智能指数,是全球最权威的大模型综合评测体系之一,覆盖推理、代码、数学、多语言等核心能力。GLM-5.2拿下全球第三,是**中国模型历史上首次打入前三位**。此前这一位置长期被OpenAI、Anthropic、Google三巨头垄断。
Design Arena则走了一条不同的路——它通过群众外包盲测(crowdsourced blind test)来评估AI生成设计质量,更像”AI版DxOmark”,但评委是真实用户。GLM-5.2在这里超过Claude Fable 5登顶,意味着在**网页设计、前端代码生成、视觉呈现**这一特定但高价值的场景中,中国模型已经做到了全球最好。
第三份值得关注的榜单是编程专项。在FrontierSWE(对标顶级程序员能力)测评中,GLM-5.2得分仅落后Claude Opus 4.8不到1个百分点,同时超越GPT-5.5;Terminal-Bench 2.1测评得分81.0,相比前代GLM-5.1直接提升17.5分。这意味着GLM-5.2已经具备**承接大型软件工程任务**的实战能力。
为什么是智谱?
智谱的打法和其他中国大模型公司不太一样。
它长期坚持”基座模型+平台+生态”的战略定位,不追热点、不卷应用,而是死磕基座模型能力。GLM系列模型在全球Coding榜单长期位列前茅,不是靠一次刷榜,而是持续迭代的结果——GLM-5.1到GLM-5.2,Terminal-Bench分数跳升17.5分,说明其**代码理解与生成能力**在短期内实现了质的飞跃。
更关键的是,智谱选择了**开源路线**。GLM-5.2发布即开源,MIT许可,意味着全球开发者可以免费使用、修改、部署这套模型。这在商业上看起来”吃亏”,但在AI这场”生态战”中,开源是赢得开发者心智最快的方式。Anthropic限制Claude Fable 5的存取,反而给开源模型留出了空间——富瑞研报也提醒了这一点。
另一个容易被忽视的细节:GLM-5.2能**单次承接88万Token以上的长周期任务**。这意味着它可以独立跑完一个中小型软件项目的全流程,从需求分析到代码生成到调试,不需要人工频繁介入。这种”长任务自主性”,正是AI智能体(Agent)从演示走向生产的核心门槛。
资本市场给出的答案
模型能力的突破,资本市场最先给出定价。
2026年1月8日,智谱以116.2港元发行价登陆港交所,首日市值579亿港元。6月18日收盘,股价2094港元,总市值9335亿港元,距离万亿仅一步之遥。**不到半年,涨幅超过16倍**。
国联民生证券维持”推荐”评级,预计智谱2026-2028年营收29、75、206亿元,以6月17日收盘价计算,2026-2028年PS估值分别为220、85、31倍。这个估值当然不便宜,但市场愿意给的,是对”中国AI底座”的溢价。
更值得玩味的是估值结构的演变。智谱的早期投资者在116港元发行价买入,今天账面上是18倍回报。但真正的分水岭发生在GLM-5.2发布之后——6月18日单日股价涨幅超过15%,说明**模型能力的可验证突破,是AI公司估值重估的最强催化剂**。
全球AI竞赛的新变量
GLM-5.2的全球前三,不是一个孤立事件。把它放在过去三个月的全球AI格局里看,有几个趋势同时发生:
**第一,开源模型正在缩小与闭源模型的差距。** GLM-5.2(开源)在多个榜单上逼近或超越Claude Fable 5、GPT-5.5(闭源)。这对整个行业的影响是深远的——当顶尖能力可以被免费获取,闭源模型的商业护城河就需要重新计算。
**第二,中国AI的”集团军”效应开始显现。** 智谱GLM-5.2全球前三,月之暗面Kimi K2在长文本处理上持续领先,阿里Qwen 3系列在全球开源榜单霸榜,DeepSeek V4在推理效率上不断创新。这些模型加起来,意味着中国AI不再只有”一个点”在突围,而是形成了**多点突破的矩阵**。
**第三,评测体系的多元化正在削弱”一家独大”的叙事。** 过去全球AI评测几乎被OpenAI系定义,但现在Artificial Analysis、Design Arena、FrontierSWE、Terminal-Bench等多家独立评测机构同时发声,每个榜单都可能诞生一个新的”世界第一”。这种多元化,客观上给了更多模型”被看见”的机会。
挑战依然真实存在
当然,把GLM-5.2的成就放在全局里看,挑战依然不容忽视。
富瑞研报在给予高度评价的同时,也提醒了两个风险:一是美国对Anthropic Fable 5的存取限制可能难以持续——暗含的意思是,如果Claude重新向全球开发者开放,GLM-5.2的替代价值会被稀释;二是开发者有多种替代方案和开源模型可选——这其实是所有开源模型的共同挑战,**如何把”用的人多”变成”赚的钱多”**,是整个开源AI赛道没有解决好的问题。
智谱目前220倍PS估值(2026年),意味着市场对其未来三年营收高增长的预期已经充分定价。如果GLM-5.2之后不能持续推出同等量级的模型迭代,或者商业化落地速度不及预期,估值回调的压力就会显现。
另一个更长期的挑战是**算力**。GLM-5.2的训练和推理都需要大量GPU资源,而全球算力供应链的不确定性,是所有中国AI公司的共同隐忧。智谱市值逼近万亿,但背后如果没有稳定的算力供给支撑,这个估值就是建在沙滩上的城堡。