这两天,大家都被 Kimi K3 刷屏了吧,到底应该怎么看待这个史上最大开源模型?
我来说说我的看法,分成几点。
(1)它的性能是否真的接近 Fable 5?
根据多个国外机构的测试,以及我自己的测试,我认为是真的。
(2)为什么它的能力突然变强了?
比起以前的版本,K3 最大不同就是参数数量从 1T 增加到了 2.8T,这大概就是它能力飞跃的原因。
(3)参数越多,计算量越大,从而模型的使用成本会大幅上升。那么,Kimi 如何减少计算量?
主要的一点就是大幅提高模型的稀疏率,激活参数的数量变得更小,它的实际运算量并不像表面看上去 2.8T 参数那么大。
(4)Kimi K3 的使用成本还是很贵。你应该有心理预期,这是一个费用较高的模型。
它在国内的 API 定价是百万 Token 输入输出价格为20元/100元,比上一个版本 K2.7 Code 的6.7元/27元翻了好几倍。它应该是目前国内最贵的模型了。
后面链接是我对它进行的一些测试,以及与 Fable 5 的结果比较。
