万益资讯网

为什么AI大模型竞争中国必赢、美国必输?中国AI大模型Kimi K3已经赶上最顶

为什么AI大模型竞争中国必赢、美国必输?

中国AI大模型Kimi K3已经赶上最顶级水平,美国打不过想拔网线,准备下手段禁止中国AI使用。而这只是开始,中国一定会赢得AI竞赛,原因注定在AI大模型的原理里:【深度扒开底层技术原理和整活方法】

很多人以为训练AI大模型技术高深,错,现在统一使用transformer型底层架构,不需要你做,网上随便都能搜到从零搭建Transformer的完整Python代码,不是什么独门秘方,PyTorch、DeepSpeed、Megatron-LM这些开源框架,已经把分布式训练、多卡优化封装完毕,训练代码根本没技术门槛,它是行业通用、可随处获取的标准化流程,好比你在电脑上安装windows\linux系统,系统不是你做的,安装系统不牛逼。开发者需要做的,是买来算力芯片(如H100、B200),找好训练数据,然后开始运行起来。

听起来很简单?确实不复杂,它的本质打个比方说,训练AI就如训练聪明的狗,transformer这个品种的狗是培育好的,你要做的是建狗场(数据中心)、资料数据、训练师(调教员),狗种是免费下载领养的,然后训练出来的狗好与不好,在于场地、数据、训练人员,而不是很多人误以为的,无中生有创造了一个狗的品种,没有,transformer是通用的,早在发明那会就定型了。

transformer是什么品种的狗?trans交流、form形态、er物件,trans+form+er=变形器,你可以理解是变形金刚狗,本质原理是关注前文猜后文,比较难理解?你可以想象别人写文章到一半,请你写下一个字、词、句,你把文章从头看到这里,再写下一个合理的字、词、句,你已经完成了和transformer框架一样的工作,你作为“碳基AI大模型”已经输出了一个token,这样是不是很好理解。而你看到的人工智能生成文章,本质上都是这样生成出来的。每一个token都要关注之前的所有文字再“猜着最好的下一个Token”输出。

注意这个不是你或谁刚发明的,这是Google论文《attention you are need》发表的“变形金刚狗”品种,同时代码早就被写好开源,开源的谁也可以下载来用,这就怯魅了这么高深的技术,为什么谁都能做,因为理论、技术、代码全公开,谁都可以下载后自由使用,你需要的是买或租算力芯片,这就不是什么技术或人才问题,而是财力问题了。

好,问题来了这儿,AI大模型竞争的是什么?钱,对,说到本质上了。论资本投入,中国只要想做,怕过谁,只怕自己的产能过剩。钱怎么用?1、建数据中心场地,这是中国最擅长的基础建设。2、数据收集,又是中国最有优势的。3、训练人员,这本质上工作形式和网吧管理员差不多,很容易的,高中肆业就可培训上岗。说到底AI大模型不是技术问题,而是工程问题,这是中国强项。在工程能力方面,美国跟中国竞争,必输。

此外,中国能赢还在于形式,中国发展AI大模型的主流竞争形态是开源,美国主流形态是闭源,长期来说开源必赢,这是行业形态决定的,不展开说,否则篇幅就过长了。