AI大模型

中国大模型狂飙:70天10款新模型,GLM-5.3编程逼近顶级闭源

智谱刚放了个大招,GLM-5.3来了。参数没瞎冲万亿,还是7400多亿。但实际上,他们把功夫全花在后训练上,硬生生把性能拔高了50%。编程和智能体这两块,直接跟Claude Fable 5硬刚,在开源圈稳坐头把交椅。这哪是挤牙膏,简直是把牙膏管直接踩爆了。

整个中国AI圈的节奏更吓人。6月到现在算下来也就70天,9家公司硬是砸出10款新模型。推理、编程、智能体这些要命的赛道上,跟美国顶尖闭源大厂的差距眼看就快磨平了。连CNBC都坐不住了,直接挑明:美国的限制反倒把中国AI的创新给逼出来了,甚至加速了这些模型往全球企业里渗透。

说白了,看调用量数据最直观。中国大模型已经连续15周碾压美国了。做企业的都不傻,哪个便宜好用,掏钱时自然就投奔哪个。

落地场景铺得也越来越开。一汽-大众纯电新车ID. AURA T6直接接进了豆包大模型,智能座舱的风潮从油车刮到了新能源。车企敢直接把大模型塞进车里,说明什么?说明这玩意早不是停留在PPT上的demo了,真刀真枪能干活的生产力。

学术界同样没闲着。最近有新研究开始用受控知识暴露的方法去训小模型,去扒大模型到底是怎么获取知识的。基础研究跟着产业狂奔一起开火。这波中国AI实际上早就不是单纯跟在屁股后面追了,人家在换赛道超车。