开源模型又上头了。StartLux 放出 StartLux-Decision,一个开源决策模型,官方口径直接写"RSI 再创奇迹"。数据也拿得出手:独立的 Decision Index 0.2.1 评测中,27B 版本得分 63.88,38 项基准里有 31 项高于 Jev 1.13。
上海AI实验室发布 Intern-Decision 时用的那七项评测,27B 平均准确率跑到 91.82%,Jev 是 88.74%。差距不算碾压,但方向清楚——开源在决策类任务上的追赶速度超出预期。这块过去被当成闭源模型的舒适区,现在坐得没那么稳了。
西方同样在加速。消息称 Reflection 等多家企业本月将推出开放权重模型,预期别拉太满:这批模型初期大概率还落后于美国最顶尖的闭源产品,但足以跟中国友商的顶级开放权重模型正面竞争。开放权重这条赛道上,玩家变多了,也不再是某一方的独角戏。
硅谷的风向确实在转。行业里讨论的话题,从"哪家模型最强"变成了"哪家模型合适"。开放权重的好处很实在:企业能自己部署、自己微调、自己算成本账。闭源 API 再强,也解不开数据出域和长期账单这两道题。
开源就是个选项。中国团队用基准分数证明开源模型能打,西方企业用产品路线承认这条路绕不开。接下来拼的是谁能让用户把这笔账算明白。